پرش به محتوای اصلی

ABBYY به OCR قدیمی یک شغل در خط لوله هوش مصنوعی می دهد

دِ رجیستر۱۴۰۵ شهریور ۳۱, سه‌شنبه، ساعت ۲۰:۴۵حدود 2 دقیقه مطالعه

FineParser در یک ظرف مجهز به CPU اجرا می شود، جداول و طرح بندی را قبل از تحویل اسناد به یک LLM حفظ می کند.

ABBYY موتور FineReader OCR خود را به عنوان یک ابزار خود میزبان برای تبدیل اسناد به متن ساختاریافته ای که سیستم های هوش مصنوعی می توانند استفاده کنند، بسته بندی کرده است. FineParser جدید این شرکت در یک کانتینر Docker بر روی یک CPU اجرا می شود، بدون نیاز به GPU. هدف آن حفظ طرح بندی یک سند به هنگام استخراج محتوای آن است. این تصاویر از اسناد به چندین زبان می‌گیرد و آنها را به متنی ساختاریافته و قالب‌بندی شده تبدیل می‌کند – به طوری که می‌توان آن‌ها را با استفاده از LLM‌های AI مولد مدرن پردازش کرد.

این تنها هدف آن نیست: این شرکت پیشنهاد کرد که می‌تواند به آوردن متن چاپی در یک CMS مدرن، یا برای بایگانی، یا به عنوان مرحله‌ای در نوعی خط لوله تولید کمک کند. ABBYY رویکرد FineParser را به عنوان هوش مصنوعی «قطعی» توصیف می‌کند. متن و ساختار سند را به جای ایجاد یک بازخوانی قابل قبول از آنها استخراج می کند. سپس خروجی آن می تواند به یک سیستم هوش مصنوعی مولد منتقل شود که پاسخ های آن کمتر قابل پیش بینی است. این شرکت همچنین چارچوب یادگیری ماشینی قابل برنامه ریزی خود، NeoML را ارائه می دهد که FOSS است و در GitHub در دسترس است.

همچنین یک OCR SDK را برای شرکت هایی که می خواهند موتور FineReader را در محصولات خود جاسازی کنند منتشر می کند. FineParser خود منبع باز نیست، اگرچه ABBYY یک مخزن GitHub برای نمونه ها و پشتیبانی انجمن دارد. ابزار میزبانی خود دارای یک ردیف رایگان است که اجازه می دهد 1000 صفحه در ماه به مدت یک سال داشته باشد. ABBYY می‌گوید که ردیف‌های اشتراکش برای اعتبارسنجی به سرور مجوز متصل می‌شوند. استقرار کاملا آفلاین به یک طرح سازمانی نیاز دارد.

حفظ ساختار به معنای تشخیص ستون‌ها به ترتیب خواندن، سرفصل‌ها و جداول - حتی آنهایی که حاشیه ندارند - به جای بازگرداندن مجموعه‌ای از متن استخراج‌شده است. ABBYY می گوید FineParser همچنین دستخط و بیش از 200 زبان را مدیریت می کند. توسعه دهندگان می توانند اسناد را از طریق FineParser's REST API ارسال کنند و خروجی را به صورت متن ساده، JSON یا DocLang دریافت کنند، قالبی فشرده که برای ورودی LLM در نظر گرفته شده است. هدف FineParser این است که قبل از اینکه یک LLM بتواند از یک سند استفاده کند، چیزی باید آن را به درستی بخواند.

ABBYY شرط می‌بندد که رویکرد ده‌ها ساله‌اش به OCR - اجرا بر روی یک CPU، حفظ طرح‌بندی و واگذاری متن به ابزارهای دیگر - هنوز هم جایگاهی در خط لوله هوش مصنوعی دارد. گاهی اوقات قسمت قدیمی قسمت مفید است. ®

خواندن متن کامل در دِ رجیستربه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

ABBYY gives old-school OCR a job in the AI pipeline

FineParser runs in a CPU-powered container, preserving tables and layout before handing documents to an LLM

همه‌ی اخبار فناوری