اتوماسیون اسناد و OCR فارسی با هوش مصنوعی

فاکتور، قرارداد، فرم و مکاتبه فارسی را به داده ساخت‌یافته تبدیل کنید و هر مورد را با نقطه تأیید انسانی به گردش‌کار فعلی برسانید.

جریان اسناد فارسی از اسکن تا استخراج فیلد و صف بازبینی انسانی

فرق OCR با پردازش هوشمند اسناد

OCR فقط تصویر را به متن تبدیل می‌کند. پردازش هوشمند اسناد یک قدم جلوتر می‌رود: نوع سند را تشخیص می‌دهد، فیلدهای معنادار (مبلغ، تاریخ شمسی، شناسه ملی، شماره قرارداد) را با اطمینان‌سنجی استخراج می‌کند، با داده مرجع اعتبارسنجی می‌کند و موارد مبهم را به کارشناس می‌سپارد. این خدمت برای هر دو لایه طراحی می‌شود.

اسنادی که معمولاً ارزش خودکارسازی دارند

01

فاکتور و رسید

خواندن فاکتور خرید، رسید و صورت‌حساب فروشنده و انتقال فیلدها به صف ثبت مالی.

02

قرارداد و الحاقیه

استخراج طرفین، مبلغ، تاریخ‌ها، بندهای تعهد و جریمه برای بایگانی قابل جست‌وجو.

03

فرم‌های اداری

فرم ثبت‌نام، درخواست، بیمه و پرونده با فیلدهای ثابت و امضا یا مهر.

04

مکاتبات و نامه

دسته‌بندی نامه‌های ورودی، تعیین واحد مسئول و پیش‌نویس پاسخ برای بازبینی.

05

اسناد شناسایی و احراز

استخراج اطلاعات کارت، گواهی و مدرک با کنترل حریم خصوصی و نگهداشت محدود.

06

آرشیو اسکن‌شده

دیجیتال‌سازی بایگانی کاغذی و ساخت لایه جست‌وجوی معنایی روی آن.

روش کار

دقت استخراج روی نمونه واقعی همان سازمان سنجیده می‌شود، نه روی دموی آماده. کیفیت اسکن، دست‌خط، مهر و چیدمان متغیر بیشترین اثر را روی نتیجه دارند.

  1. 01

    نمونه‌گیری

    نمونه‌ای نماینده از هر نوع سند، شامل موارد بد و استثنا، با حذف داده غیرضروری آماده می‌شود.

  2. 02

    استخراج چندلایه

    ترکیب OCR فارسی، مدل زبانی و قواعد اعتبارسنجی (مانند جمع ردیف‌ها با مبلغ کل) برای هر فیلد.

  3. 03

    اطمینان‌سنجی

    هر فیلد امتیاز اطمینان دارد؛ زیر آستانه به صف استثنا می‌رود، نه به ثبت خودکار.

  4. 04

    اتصال به گردش‌کار

    خروجی ساخت‌یافته به فایل کنترل‌شده، صف کار یا رابط نرم‌افزاری سامانه فعلی تحویل می‌شود.

  5. 05

    اندازه‌گیری

    دقت هر فیلد، نرخ اصلاح کارشناس و زمان پردازش با خط مبنای دستی مقایسه می‌شود.

کنترل‌های طراحی

صف استثنا
اطمینان پایین، سند ناقص و تضاد داده به کارشناس ارجاع می‌شود، نه حدس زده می‌شود.
ردپای تصمیم
تصویر اصلی، فیلد استخراج‌شده، ویرایش کاربر و تأیید نهایی برای حسابرسی ثبت می‌شود.
حریم خصوصی
داده شخصی حذف یا پوشانده می‌شود و نگهداشت بر اساس سیاست سازمان تعریف می‌شود.
ارزیابی دوره‌ای
با تغییر قالب اسناد، افت دقت با نمونه‌های تأییدشده ردیابی می‌شود.
ژرف

دستیار هوش مصنوعی ژرف را همین حالا امتحان کنید

درباره دستیار فارسی، اتوماسیون اسناد یا شروع یک پایلوت سوال کنید.

پرسش‌های متداول درباره اتوماسیون اسناد

دقت OCR فارسی چقدر است؟

عدد ثابتی وجود ندارد؛ دقت به کیفیت اسکن، فونت یا دست‌خط، مهر و چیدمان سند وابسته است. به همین دلیل دقت هر فیلد را روی نمونه واقعی شما گزارش می‌کنیم و فیلدهای حیاتی همیشه با آستانه اطمینان و بازبینی انسانی محافظت می‌شوند.

آیا دست‌خط فارسی هم پشتیبانی می‌شود؟

دست‌خط قابل ارزیابی است اما خطای آن بالاتر از متن چاپی است. برای فیلدهای دست‌نویس معمولاً ترکیب استخراج خودکار و تأیید انسانی پیشنهاد می‌شود و نتیجه در پایلوت مشخص می‌کند کدام فیلدها ارزش خودکارسازی دارند.

خروجی به کدام سامانه‌ها وصل می‌شود؟

خروجی ساخت‌یافته (JSON یا CSV) می‌تواند به سامانه حسابداری، اتوماسیون اداری، بایگانی یا صف کار تحویل شود. نوع اتصال پس از بررسی سامانه فعلی و الزامات دسترسی تعیین می‌شود.

آیا داده‌های اسناد از سازمان خارج می‌شود؟

مدل استقرار بر اساس الزام امنیتی هر سازمان بررسی می‌شود؛ گزینه پردازش روی زیرساخت سازمان یا میزبانی داخل ایران وجود دارد و جریان داده پیش از شروع مکتوب می‌شود.

چقدر طول می‌کشد؟

یک پایلوت محدود روی یک نوع سند معمولاً چند هفته زمان می‌برد و با گزارش دقت، نرخ استثنا و زمان پردازش تمام می‌شود. توسعه به اسناد دیگر پس از تصمیم بر پایه همان گزارش انجام می‌شود.

یک نوع سند را برای پایلوت انتخاب کنید

نوع سند، حجم ماهانه، زمان فعلی، موارد استثنا و نقطه تأیید را مشخص کنید. نتیجه مرحله کشف می‌تواند اجرای پایلوت یا کنار گذاشتن آن باشد.

درخواست جلسه کشف نیاز