كيف يقرأ iDBQuery ملفات PDF والمستندات الممسوحة ضوئيًا؟

يقرأ iDBQuery ملفات PDF والمستندات الممسوحة ضوئيًا باستخراج نصّها وبنيتها — مستخدمًا التعرّف الضوئي على الحروف (OCR) للصفحات الممسوحة أو القائمة على الصور — ويحوّل المحتوى إلى جزء من نموذجك الحيّ القابل للاستعلام. وبعدها يمكنك أن تسأل عبر مستنداتك بالطريقة نفسها التي تستعلم بها قاعدة بيانات، بإجابات موثّقة رجوعًا إلى صفحة المصدر.

تحمل المستندات قدرًا هائلًا من بيانات الأعمال — العقود والفواتير والكشوف والتقارير — وهي عادةً محبوسة بعيدًا عن التحليل. يفكّ iDBQuery هذا القفل.

حين تضيف ملف PDF أو مستندًا، يقوم iDBQuery بما يلي:

  • يستخرج النصّ من ملفات PDF الأصلية مباشرةً.
  • يشغّل التعرّف الضوئي على الحروف (OCR) على الصفحات الممسوحة وملفات PDF القائمة على الصور، قارئًا الحروف من على الصفحة، فحتى المستند المصوَّر أو المُرسَل بالفاكس يصبح بيانات قابلة للبحث ومنظَّمة.
  • يلتقط البنية — الجداول والحقول والقيم — فتصبح الأرقام داخل المستند قابلة للاستعلام لا للبحث بالكلمات المفتاحية فحسب.
  • يدمجه في نموذجك الحيّ، إلى جانب قواعد بياناتك وجداولك البيانية، فيمكن لسؤال واحد أن يستقي من المستندات والأنظمة المنظَّمة معًا.

ولأن كل قيمة مستخرَجة تحتفظ برابط إلى مصدرها، تكون الإجابات المستقاة من المستندات موثّقة رجوعًا إلى المصدر — فترى الصفحة والسجلّ الدقيقين خلف كل رقم. وهذا ما يتيح لك أن تسأل أشياء مثل "كم إجمالي هذه الفواتير" أو "أيّ العقود يذكر هذا البند" وتحصل على إجابة حقيقية يمكن التحقّق منها بدلًا من التنقيب في الملفات يدويًا.

Updated 2026-06-22