ABBYY به OCR قدیمی یک شغل در خط لوله هوش مصنوعی می دهد
FineParser در یک ظرف مجهز به CPU اجرا می شود، جداول و طرح بندی را قبل از تحویل اسناد به یک LLM حفظ می کند.
ABBYY موتور FineReader OCR خود را به عنوان یک ابزار خود میزبان برای تبدیل اسناد به متن ساختاریافته ای که سیستم های هوش مصنوعی می توانند استفاده کنند، بسته بندی کرده است. FineParser جدید این شرکت در یک کانتینر Docker بر روی یک CPU اجرا می شود، بدون نیاز به GPU. هدف آن حفظ طرح بندی یک سند به هنگام استخراج محتوای آن است. این تصاویر از اسناد به چندین زبان میگیرد و آنها را به متنی ساختاریافته و قالببندی شده تبدیل میکند – به طوری که میتوان آنها را با استفاده از LLMهای AI مولد مدرن پردازش کرد.
این تنها هدف آن نیست: این شرکت پیشنهاد کرد که میتواند به آوردن متن چاپی در یک CMS مدرن، یا برای بایگانی، یا به عنوان مرحلهای در نوعی خط لوله تولید کمک کند. ABBYY رویکرد FineParser را به عنوان هوش مصنوعی «قطعی» توصیف میکند. متن و ساختار سند را به جای ایجاد یک بازخوانی قابل قبول از آنها استخراج می کند. سپس خروجی آن می تواند به یک سیستم هوش مصنوعی مولد منتقل شود که پاسخ های آن کمتر قابل پیش بینی است. این شرکت همچنین چارچوب یادگیری ماشینی قابل برنامه ریزی خود، NeoML را ارائه می دهد که FOSS است و در GitHub در دسترس است.
همچنین یک OCR SDK را برای شرکت هایی که می خواهند موتور FineReader را در محصولات خود جاسازی کنند منتشر می کند. FineParser خود منبع باز نیست، اگرچه ABBYY یک مخزن GitHub برای نمونه ها و پشتیبانی انجمن دارد. ابزار میزبانی خود دارای یک ردیف رایگان است که اجازه می دهد 1000 صفحه در ماه به مدت یک سال داشته باشد. ABBYY میگوید که ردیفهای اشتراکش برای اعتبارسنجی به سرور مجوز متصل میشوند. استقرار کاملا آفلاین به یک طرح سازمانی نیاز دارد.
حفظ ساختار به معنای تشخیص ستونها به ترتیب خواندن، سرفصلها و جداول - حتی آنهایی که حاشیه ندارند - به جای بازگرداندن مجموعهای از متن استخراجشده است. ABBYY می گوید FineParser همچنین دستخط و بیش از 200 زبان را مدیریت می کند. توسعه دهندگان می توانند اسناد را از طریق FineParser's REST API ارسال کنند و خروجی را به صورت متن ساده، JSON یا DocLang دریافت کنند، قالبی فشرده که برای ورودی LLM در نظر گرفته شده است. هدف FineParser این است که قبل از اینکه یک LLM بتواند از یک سند استفاده کند، چیزی باید آن را به درستی بخواند.
ABBYY شرط میبندد که رویکرد دهها سالهاش به OCR - اجرا بر روی یک CPU، حفظ طرحبندی و واگذاری متن به ابزارهای دیگر - هنوز هم جایگاهی در خط لوله هوش مصنوعی دارد. گاهی اوقات قسمت قدیمی قسمت مفید است. ®
متن اصلی (انگلیسی)
ABBYY gives old-school OCR a job in the AI pipeline
FineParser runs in a CPU-powered container, preserving tables and layout before handing documents to an LLM