Document OCR
OCR اسناد فارسی و انگلیسی — OCR عمومی اسناد با رابط انگلیسی؛ پشتیبانی کامل فارسی و صفحات مختلط، خروجی PDF قابل جستجو و فایل متن یونیکد.
این صفحه دموی POC است، نه سامانه تحویلی. خدمت متناظر: اتوماسیون اداری · هاب دموها.
دموی نمونه تعاملیبرای مدیر: نتیجه کسبوکار
ثبت دستی اسکن و تایپ متن از تصویر؛ صفحات فارسی و مختلط معمولاً خراب میشوند.
یک تصویر تا ۵ مگابایت به PDF قابل جستجو و فایل UTF-8 تبدیل میشود؛ فایل آپلودشده ذخیره پایدار نمیشود.
- PaddleOCR-VL-1.6
- فارسی + انگلیسی
- PDF قابل جستجو
- بدون ذخیره پایدار
«یک اسکن، یک PDF قابل جستجو — بدون نگهداری فایل روی سرور عمومی.»
مستندات عمومی
چه میکند؟
Document OCR یکی از محصولات پورتفولیوی هوش مصنوعی آریا اِیآی است. نسخه عمومی روی Hugging Face یک دموی نمونه است؛ نسخه تولید با یکپارچهسازی داده، SSO و audit trail استقرار مییابد.
OCR عمومی اسناد با رابط انگلیسی؛ پشتیبانی کامل فارسی و صفحات مختلط، خروجی PDF قابل جستجو و فایل متن یونیکد.
درخواست پایلوت از طریق فرم تماس سایت با ذکر علاقه به Document OCR ثبت میشود تا محدوده داده، قیود و معیار موفقیت مشخص گردد.
چه کسی از آن استفاده میکند؟
مالی، بایگانی، دبیرخانه، حقوقی و تیمهایی که باید متن اسکن را در ERP یا بایگانی دیجیتال بگذارند.
خروجی دمو «نمونه تعاملی» است؛ آپلود زنده فایل سازمانی روی Space عمومی توصیه نمیشود.
کاربرد در صنایع
مالی و حسابداری
تبدیل فاکتور و رسید اسکنشده به متن قابل جستجو.
دبیرخانه
ورود نامه و فرم کاغذی به گردش دیجیتال.
حقوقی
متنگذاری قرارداد و پیوست اسکنشده.
منابع انسانی
استخراج متن از مدارک پرسنلی.
بایگانی سازمانی
ساخت لایه متن پنهان روی تصویر اصلی.
خدمات مشتری
خواندن فرم و درخواست المانی از اسکن.
برای مهندس: Pipeline و معماری
Upload image → resize ≤1920px → PaddleOCR-VL-1.6 on ZeroGPU → searchable PDF + UTF-8 txt
معماری مرجع از README اسپیس روی Hugging Face پیروی میکند. استقرار تولید با Docker، متغیر محیطی و اتصال به سامانه موجود انجام میشود.
پشته فنی
- Python
- Transformers
- PaddleOCR-VL-1.6
- Gradio
- ZeroGPU
- Docker
متریکهای قابل بازتولید
| بنچمارک | جزئیات | نتیجه |
|---|---|---|
| Model | PaddleOCR-VL-1.6 | ZeroGPU |
| Input | JPG/PNG/WEBP/BMP/TIFF | 1 image |
| Limit | max 5 MB | longest side 1920 |
| Privacy | temp dir only | no persist |
سوالات پرتکرار
Document OCR چه مسئلهای را حل میکند؟
Document OCR برای «OCR عمومی اسناد با رابط انگلیسی؛ پشتیبانی کامل فارسی و صفحات مختلط، خروجی PDF قابل جستجو و فایل متن یونیکد.» است. OCR عمومی اسناد با رابط انگلیسی؛ پشتیبانی کامل فارسی و صفحات مختلط، خروجی PDF قابل جستجو و فایل متن یونیکد. این صفحه دموی POC است نه سامانه تحویلی.
ورودی و خروجی Document OCR چیست؟
ورودی: نمونه ورودی سازگار با کارت دمو. خروجی قابل نقلقول: خروجی قابل بازبینی انسان. متریک Hub بدون حجم نمونه سازمان SLA نیست.
آیا Space عمومی Document OCR جایگزین استقرار سازمانی است؟
خیر. Hugging Face برای ارزیابی است. شکست رایج: اتکا به خروجی دمو بدون صف تأیید. production یعنی on-prem یا VPC و کنترل دسترسی.
چطور پایلوت را شروع کنیم؟
فرم تماس خانه (سازمان، صنعت، شرح مسئله) را بفرستید. قیمت در صفحه دمو اعلام نمیشود.