المعالجة الذكية للمستندات (IDP) هي استخدام الذكاء الاصطناعي لتحويل المستندات غير المهيكلة إلى بيانات مهيكلة متحقَّق منها تستطيع الأنظمة اللاحقة العمل بها.
والمصطلح يصف مسارًا لا تقنية واحدة. فالمستند يصل في صورة ما يقرأها الإنسان، كمسح ضوئي أو صورة فوتوغرافية أو ملف PDF أو مرفق بريد، ويخرج على هيئة سجلات في قاعدة بيانات، أو حقول في نظام إدارة حالات، أو رسالة في قائمة انتظار. وكل ما بين هاتين النقطتين هو IDP.
مراحل المسار
يشغّل التطبيق النموذجي ست مراحل: الإدخال، والقراءة، والتصنيف، والاستخراج، والتحقق، والتوجيه.
الإدخال يجمع المستندات من القنوات التي تستخدمها المؤسسة فعلًا. وعمليًا نادرًا ما يكون هذا مصدرًا واحدًا. فالبريد الممسوح وصناديق البريد المشتركة وبوابات التحميل وإيداعات SFTP من الشركاء والتصدير من الأنظمة القديمة تظهر كلها عادةً في المشروع نفسه.
القراءة تحوّل صورة المستند إلى نص وتنسيق مقروءين آليًا. وهنا يقع التعرّف البصري على الحروف، إلى جانب تقسيم الصفحات وكشف الجداول وتحليل ترتيب القراءة.
التصنيف يقرر ماهية المستند. فـتصنيف المستندات يحدد النوع، وغالبًا سياق العمل وفئة السجل والحساسية، لأن تلك القرارات تحرّك كل ما يليها.
الاستخراج ينتزع القيم المحددة التي تحتاجها العملية. واستخراج بيانات المستندات يغطي حقول الترويسة وبنود السطور والجداول والبنود التعاقدية والتواريخ والأطراف والتوقيعات.
التحقق يفحص البيانات المستخرجة مقابل القواعد والبيانات المرجعية والاتساق الداخلي. فإجمالي فاتورة لا يساوي مجموع سطورها يُلتقط هنا، وكذلك مورّد غير موجود في سجل المورّدين الرئيسي.
التوجيه يسلّم النتيجة إلى ما يأتي تاليًا: موافقة، أو قائمة استثناءات، أو نظام سجل، أو مراجع بشري.
كيف تختلف IDP عن OCR
هذا هو التمييز الذي يُطوى أكثر ما يُطوى في مواد المورّدين، وهو مهم. فـ OCR يجيب عن سؤال “أي الحروف على هذه الصفحة”. أما IDP فتجيب عن “ما هذا المستند، وماذا يعني، وهل هو صحيح”.
OCR يُنتج نصًا. أما IDP فتُنتج بيانات مهيكلة بمخطط معروف، وقيمة ثقة لكل حقل، ونتيجة تحقق، ومسار تدقيق. والنظام الذي يتوقف عند OCR قد حوّل صورة إلى جدار من الحروف، وهو أسهل في البحث ولا أسهل في المعالجة الآلية.
وعمليًا، الفرق هو كل ما لا يفعله OCR: التصنيف، والاستخراج على مستوى الحقل، والتحقق مقابل قواعد العمل، وتقييم الثقة بعتبات، ومعالجة الاستثناءات، والتكامل مع سير العمل.
علاقة IDP بـ RPA
أتمتة العمليات الروبوتية (RPA) و IDP متكاملتان لا متنافستان. فـ RPA بارعة في تشغيل أنظمة لا تملك API قابلة للاستخدام، عبر تشغيل واجهاتها كما يفعل الشخص. لكنها ضعيفة في تفسير مستند غير مهيكل، لأنه لا يوجد تسلسل نقرات حتمي يقرأ عقدًا.
والنمط الشائع هو IDP تُنتج بيانات مهيكلة و RPA أو محرك سير عمل يعمل بها. وموضع الصعوبة عند الفرق هو استخدام RPA وحدها على المستندات، عادةً بمطابقة قوالب هشّة، ثم اكتشاف أن مورّدًا غيّر تنسيق فاتورته فكسر الأتمتة بهدوء.
ما يخطئ عادةً
قياس الدقة على الشيء الخطأ. رقم دقة على مستوى الحقل محسوب كمتوسط عبر جميع الحقول يخفي الحقول التي تهم. فإصابة مرجع المستند في 99 بالمئة من الحالات ومبلغ الدفع في 90 بالمئة ليس نظامًا بدقة 94 بالمئة، بل نظامًا سيدفع المبلغ الخطأ.
ضبط عتبات الثقة عالميًا. العتبة التي تصلح لفاتورة مطبوعة خطأ لنموذج مكتوب بخط اليد. والعتبات تنتمي إلى كل نوع مستند وغالبًا إلى كل حقل.
تصميم معالجة الاستثناءات آخرًا. معدل المعالجة الآلية الكاملة لا يبلغ 100 بالمئة أبدًا، لذا فتجربة المراجع هي ما يحدد إن كان النظام يوفّر الوقت في المحصلة. وقائمة أبطأ في العمل من العملية اليدوية الأصلية تُلغي الفائدة.
بيانات التدريب لا تطابق الإنتاج. النماذج المبنية على عيّنات نظيفة تتراجع على المستندات المصوّرة والمائلة والمحجوبة جزئيًا التي تصل في الواقع.
حيث تُستخدم
تُطبَّق IDP حيث يكون حجم المستندات كبيرًا والعملية اللاحقة محكومة بقواعد: الحسابات الدائنة، ومعالجة المطالبات، وتسجيل العملاء وفحوص “اعرف عميلك” (KYC)، وتأسيس القروض، ومستندات التجارة، وبرامج رقمنة السجلات. والعامل المشترك ليس القطاع بل الجمع بين مدخل غير مهيكل وعملية يجب أن تكون قابلة للتدقيق.
يطبّق Contellect One هذا المسار في المعالجة الذكية للمستندات، عبر المراحل الست الموصوفة أعلاه.
