Document OCR

OCR اسناد فارسی و انگلیسی — OCR عمومی اسناد با رابط انگلیسی؛ پشتیبانی کامل فارسی و صفحات مختلط، خروجی PDF قابل جستجو و فایل متن یونیکد.

این صفحه دموی POC است، نه سامانه تحویلی. خدمت متناظر: اتوماسیون اداری · هاب دموها.

دموی نمونه تعاملی

برای مدیر: نتیجه کسب‌وکار

قبل

ثبت دستی اسکن و تایپ متن از تصویر؛ صفحات فارسی و مختلط معمولاً خراب می‌شوند.

بعد

یک تصویر تا ۵ مگابایت به PDF قابل جستجو و فایل UTF-8 تبدیل می‌شود؛ فایل آپلودشده ذخیره پایدار نمی‌شود.

  • PaddleOCR-VL-1.6
  • فارسی + انگلیسی
  • PDF قابل جستجو
  • بدون ذخیره پایدار

«یک اسکن، یک PDF قابل جستجو — بدون نگهداری فایل روی سرور عمومی.»

— Document Operations (ناشناس)

مستندات عمومی

چه می‌کند؟

Document OCR یکی از محصولات پورتفولیوی هوش مصنوعی آریا اِی‌آی است. نسخه عمومی روی Hugging Face یک دموی نمونه است؛ نسخه تولید با یکپارچه‌سازی داده، SSO و audit trail استقرار می‌یابد.

OCR عمومی اسناد با رابط انگلیسی؛ پشتیبانی کامل فارسی و صفحات مختلط، خروجی PDF قابل جستجو و فایل متن یونیکد.

درخواست پایلوت از طریق فرم تماس سایت با ذکر علاقه به Document OCR ثبت می‌شود تا محدوده داده، قیود و معیار موفقیت مشخص گردد.

چه کسی از آن استفاده می‌کند؟

مالی، بایگانی، دبیرخانه، حقوقی و تیم‌هایی که باید متن اسکن را در ERP یا بایگانی دیجیتال بگذارند.

خروجی دمو «نمونه تعاملی» است؛ آپلود زنده فایل سازمانی روی Space عمومی توصیه نمی‌شود.

کاربرد در صنایع

مالی و حسابداری

تبدیل فاکتور و رسید اسکن‌شده به متن قابل جستجو.

دبیرخانه

ورود نامه و فرم کاغذی به گردش دیجیتال.

حقوقی

متن‌گذاری قرارداد و پیوست اسکن‌شده.

منابع انسانی

استخراج متن از مدارک پرسنلی.

بایگانی سازمانی

ساخت لایه متن پنهان روی تصویر اصلی.

خدمات مشتری

خواندن فرم و درخواست المانی از اسکن.

برای مهندس: Pipeline و معماری

Upload image → resize ≤1920px → PaddleOCR-VL-1.6 on ZeroGPU → searchable PDF + UTF-8 txt

ocrdocumentpersianfarsienglishpdf

معماری مرجع از README اسپیس روی Hugging Face پیروی می‌کند. استقرار تولید با Docker، متغیر محیطی و اتصال به سامانه موجود انجام می‌شود.

پشته فنی

  • Python
  • Transformers
  • PaddleOCR-VL-1.6
  • Gradio
  • ZeroGPU
  • Docker

متریک‌های قابل بازتولید

بنچمارکجزئیاتنتیجه
ModelPaddleOCR-VL-1.6ZeroGPU
InputJPG/PNG/WEBP/BMP/TIFF1 image
Limitmax 5 MBlongest side 1920
Privacytemp dir onlyno persist

سوالات پرتکرار

Document OCR چه مسئله‌ای را حل می‌کند؟

Document OCR برای «OCR عمومی اسناد با رابط انگلیسی؛ پشتیبانی کامل فارسی و صفحات مختلط، خروجی PDF قابل جستجو و فایل متن یونیکد.» است. OCR عمومی اسناد با رابط انگلیسی؛ پشتیبانی کامل فارسی و صفحات مختلط، خروجی PDF قابل جستجو و فایل متن یونیکد. این صفحه دموی POC است نه سامانه تحویلی.

ورودی و خروجی Document OCR چیست؟

ورودی: نمونه ورودی سازگار با کارت دمو. خروجی قابل نقل‌قول: خروجی قابل بازبینی انسان. متریک Hub بدون حجم نمونه سازمان SLA نیست.

آیا Space عمومی Document OCR جایگزین استقرار سازمانی است؟

خیر. Hugging Face برای ارزیابی است. شکست رایج: اتکا به خروجی دمو بدون صف تأیید. production یعنی on-prem یا VPC و کنترل دسترسی.

چطور پایلوت را شروع کنیم؟

فرم تماس خانه (سازمان، صنعت، شرح مسئله) را بفرستید. قیمت در صفحه دمو اعلام نمی‌شود.

ورودی و خروجی Document OCR چیست؟

ورودی: نمونه ورودی سازگار با کارت دمو. خروجی قابل نقل‌قول: خروجی قابل بازبینی انسان. متریک Hub بدون حجم نمونه سازمان SLA نیست.

آیا Space عمومی Document OCR جایگزین استقرار سازمانی است؟

خیر. Hugging Face برای ارزیابی است. شکست رایج: اتکا به خروجی دمو بدون صف تأیید. production یعنی on-prem یا VPC و کنترل دسترسی.

چطور پایلوت را شروع کنیم؟

فرم تماس خانه (سازمان، صنعت، شرح مسئله) را بفرستید. قیمت در صفحه دمو اعلام نمی‌شود.

لینک‌های Hugging Face

درخواست پایلوت

برای استقرار on-prem، یکپارچه‌سازی با سامانه‌های موجود یا fine-tune روی داده سازمان خود تماس بگیرید.