ما استيعاب المستندات بالتعرّف الضوئي على الحروف (OCR)؟

استيعاب المستندات بالتعرّف الضوئي على الحروف (OCR) هو عملية قراءة النص من الملفات الممسوحة ضوئياً وملفات PDF — بما فيها صور الصفحات — وتحويله إلى بيانات مهيكلة يمكنك الاستعلام عنها. ويستطيع iDBQuery استيعاب مجلد كامل من المستندات بهذه الطريقة، فيجعل محتوياتها جزءاً من نموذجك الحي الواحد.

يعيش كثير من المعلومات المهمة في المستندات لا في قواعد البيانات — الفواتير والعقود والكشوف والنماذج الممسوحة ضوئياً. والتعرّف الضوئي على الحروف (OCR) هو التقنية التي تقرأ النص من تلك الملفات، بما فيها الصور الممسوحة ضوئياً حيث لا يكون النص قابلاً للتحديد، فيمكن تحليله كأي بيانات أخرى.

يستخدم iDBQuery استيعاب OCR لجعل المستندات قابلة للاستعلام. ويمكنك توجيهه نحو ملف PDF واحد أو مجلد كامل من الملفات، فيعالجها، ويستخرج المحتوى، ويطويه ضمن النموذج الحي نفسه إلى جانب قواعد بياناتك وجداول البيانات.

مع استيعاب المستندات بـ OCR يمكنك:

  • طرح أسئلة على المستندات — استعلم عن محتويات ملفات PDF والمسح الضوئي بلغة طبيعية، تماماً كجدول.
  • معالجة المجلدات بالجملة — استوعب ملفات كثيرة دفعة واحدة بدلاً من التعامل معها واحداً تلو الآخر.
  • دمج المستندات مع البيانات المهيكلة — يستطيع سؤال واحد ربط رقم من ملف PDF بسجلات من قاعدة بيانات.

يعمل الاستيعاب في الخلفية فلا تعطّلك المجلدات الكبيرة، ويُفهرَس المحتوى المستخرَج فيصبح قابلاً للبحث والاستشهاد — بمعنى أن إجابة مستمدة من مستند تظل تعود إلى الملف الذي أتت منه. هكذا تصبح الأوراق غير المهيكلة جزءاً أصيلاً من تحليلك بدلاً من شيء تقرأه يدوياً.

Updated 2026-06-22