DATIMORE / WEB-086 / v1.0

قراءة المقال

حزمة تقييم بيانات المستندات

فتح المستندات الستة · تحميل الحزمة من الموقع (ZIP) · English

1. اتفق على النتيجة المطلوبة

المطلوب رقم الشحنة والتاريخ والكمية المستلمة كما تظهر في الأصل. كل بيان مطلوب وأساسي في هذا المثال. أي قيمة خاطئة أو إجابة مفقودة لبيان معلوم أو تخمين بلا سند يمنع اجتياز الاختبار. هذه قاعدة تدريبية، وليست معياراً عاماً لكل شركة.

تعريف البيانات المتوقعة
رقم الشحنة / delivery_refيجب أن يطابق رقم الشحنة ما في المستند، بما في ذلك الحروف الكبيرة والصغيرة. نتجاهل فقط المسافات قبل الرقم وبعده.
التاريخ / delivery_dateسنة-شهر-يوم عند وضوح التاريخ. لا نخمن ترتيب اليوم والشهر.
الكمية المستلمة / received_unitsعدد صحيح للوحدات المستلمة، لا المطلوبة. نحول الأرقام العربية مثل ١٢ إلى 12 للمقارنة.

2. قارن الإجابة بالأصل

ملف الإجابات المتوقعة مستقل عن المدخلات والإجابات التجريبية داخل الملف المضغوط. في اختبار فعلي، لا تستخدم مستندات الاختبار النهائي أو إجاباتها المتوقعة في تدريب الأداة أو تعديل إعداداتها. اقرأ المستند أولاً، ثم افتح الإجابة المتوقعة.

D01

المتوقع: R-101، 2026-09-01، 8 وحدات. الإجابة التجريبية تطابق البيانات الثلاثة.

D02

المتوقع: R-102، 2026-09-02، 12 وحدة. بعد تحويل الأرقام العربية للمقارنة، تطابق الإجابة البيانات الثلاثة. مثال عربي واحد لا يثبت أداء الأداة بالعربية.

D03

المتوقع: R-103، تاريخ غير محسوم، 6 وحدات. التاريخ 03/04/2026 يحتمل 3 أبريل أو 4 مارس. الإجابة 2026-03-04 تخمين بلا سند؛ يلزم توضيح من مصدر المستند.

D04

المتوقع: R-104، 2026-09-04، كمية غير مذكورة. ترك الإجابة فارغة مناسب هنا، لكنه لا يجعل السجل جاهزاً؛ اطلب الكمية الفعلية.

D05

المتوقع: R-105، 2026-09-05، 7 وحدات. الإجابة التجريبية تضع 10، وهي الكمية المطلوبة. هذا خطأ في الكمية المستلمة، وهي من البيانات الأساسية في المثال؛ لذلك لا تجتاز الإجابة الاختبار.

D06

المتوقع: R-106، تاريخ غير مقروء، 4 وحدات. افترضنا فشل المعالجة بالكامل بلا إجابات. نحسب رقم الشحنة والكمية كإجابتين مفقودتين لبيانات معلومة. التاريخ يبقى غير مقروء، ونسجل فشل المستند منفصلاً.

3. احسب الأخطاء دون إخفاء الحالات الصعبة

من أصل 18 خانة، يمكن معرفة 15 قيمة من المستندات. تقارن هذه القيم فقط: 12 صحيحة، وواحدة خاطئة، وإجابتان مفقودتان. تبقى ثلاث خانات منفصلة: تاريخ ملتبس، وكمية غير مذكورة، وتاريخ غير مقروء. في D03 خُمّن التاريخ بلا دليل. وفي D04 تُركت الكمية فارغة لأنها غير مذكورة. أما D06 فلم تنتج عنه إجابة بسبب فشل المعالجة. لا نحسب هذه الحالات ضمن البيانات المستخرجة بشكل صحيح.

نتائج الإجابات التي كتبناها، وليست نتائج منتج
رقم الشحنة6 أرقام شحنات يمكن معرفتها من المستندات: 5 صحيحة، ولا إجابات خاطئة، وإجابة واحدة مفقودة.
التاريخ4 تواريخ يمكن معرفتها: الأربعة صحيحة، ولا إجابات خاطئة أو مفقودة. حالتا التاريخ غير الواضح تُسجلان منفصلتين.
الكمية المستلمة5 كميات يمكن معرفتها: 3 صحيحة، وواحدة خاطئة، وإجابة واحدة مفقودة. حالة الكمية غير المذكورة تُسجّل منفصلة.
القرارالنتيجة لا تستوفي شروط القبول التي وضعناها للمثال. في تجربة فعلية، صحّح الأخطاء واطلب توضيح البيانات الناقصة، ثم اختبر الأداة على مستندات لم تستخدمها في التدريب أو تعديل الإعدادات.

يشمل الحساب المستند الفاشل؛ لا نحذفه لتحسين النتيجة. سجّل أيضاً الملفات غير المدعومة ومحاولات الإعادة. اعرض نتائج كل لغة وشكل مستند على حدة، وافصل النسخ الواضحة عن الرديئة. هذه العينة أصغر من أن تحكم بها على أداء الأداة في كل مجموعة.

4. احسب وقت الفريق والتكلفة

افتراض تدريبي: يراجع الموظف المستندات الستة، دقيقتين لكل مستند. وتحتاج الحالات من D03 إلى D06 دقيقتين إضافيتين لكل حالة للتصحيح أو المتابعة. إذن الوقت 6 × 2 + 4 × 2 = 20 دقيقة. نفترض أن الإدخال اليدوي يستغرق 3 دقائق لكل مستند، أي 18 دقيقة. لا يوجد توفير في هذا المثال.

بافتراض تكلفة ساعة عمل 90 ريالاً، تبلغ تكلفة الوقت 30 ريالاً للمراجعة و27 ريالاً للإدخال اليدوي. هذه أرقام افتراضية؛ لم نقِس وقت العمل فعلياً. لا يشمل الحساب انتظار التوضيح، أو رسوم الأداة والتخزين، أو تكلفة إعادة المحاولة. ولا يشمل تجهيز الأداة والإجابات الصحيحة، أو ربط الأداة بأنظمتك، أو الدعم المستمر. أضفها في المقارنة الفعلية، وافصل وقت الانتظار عن وقت العمل.

ورقة التقييم: املأها قبل مقارنة الأدوات
المستندات والأخطاء المقبولةأنواع المستندات واللغات والخانات الأساسية والأخطاء المقبولة: __________
وقت المراجعةاسم المراجع وبديله، والوقت لكل مستند، والحالات التي تحتاج متابعة، وعدد المستندات الممكن مراجعته يومياً: __________
التكلفةعدد المستندات، والعملة، ورسوم الاستخدام والتجهيز والدعم: __________
متطلبات العملمن يحق له الاطلاع على المستندات، ومدة حفظها، والأنظمة المطلوب ربطها، والقرار التالي والمسؤول عنه: __________

5. سجّل تفاصيل التجربة حتى تستطيع إعادتها

يضم الملف المضغوط سجلاً معبأً للمثال وسجلاً فارغاً لتجربتك. سجّل اسم الأداة وإصدارها، ونسخة المستندات والإجابات المتوقعة، والإعدادات المستخدمة. إذا كانت الأداة تعرض درجة ثقة، فسجّل الحد الذي اخترته لقبول الإجابة؛ هذه الدرجة تقدير من الأداة، وليست ضماناً للصحة. وسجّل ما تعتبره إجابة مطابقة، ومتى تعيد المحاولة وعدد مرات الإعادة. احتفظ بالإجابات الأصلية والأخطاء والنتائج. واحفظ لكل ملف رمز تحقق يتغير إذا تغيّر محتواه؛ يسمى هذا الرمز بصمة الملف، ويساعد على التأكد من استخدام الملفات نفسها. إذا تغير أي منها، أنشئ تجربة جديدة ولا تقارن نتيجتين بشروط مختلفة دون توضيح.

لتكرار حساب المثال: بعد فك الضغط، يمكنك أو زميل تقني تشغيل python score.py باستخدام Python 3. لا يتصل البرنامج بأي خدمة، ولا يجري استخراجاً؛ يقارن الإجابات التي كتبناها بالإجابات المتوقعة فقط. اقرأ README.txt لفهرس الملفات.

قبل تجربة فعلية، أضف مستندات مأذوناً باستخدامها تمثل العمل المعتاد، ومنها صور ممسوحة ضعيفة وملفات لا تدعمها الأداة. افصل مستندات التدريب وتعديل الإعدادات عن مستندات الاختبار النهائي. واتفق مع الفريق المسؤول عن العمل على الإجابات الصحيحة والأخطاء المقبولة. نجاح هذه الحزمة وحده لا يثبت دقة الأداة أو صلاحيتها للاستخدام اليومي.

مرجع لطريقة تقييم البيانات: Google Document AI