Comment iDBQuery ingère-t-il un dossier de fichiers avec l'OCR ?
iDBQuery ingère un dossier de fichiers en traitant chaque document qu'il contient — extraction du texte, OCR sur les pages numérisées et capture de la structure — de sorte que l'ensemble du dossier devienne un seul modèle interrogeable. L'ingestion s'effectue en arrière-plan, et vous pouvez suivre le statut de chaque fichier à mesure qu'il est traité et rendu interrogeable.
Indiquer un dossier à iDBQuery est le moyen le plus rapide de rendre interrogeable une pile de fichiers. Au lieu de traiter les documents un par un, vous lui confiez le dossier et il traite tout ce qu'il contient.
Pour chaque fichier, il :
- Détecte le type — tableur, PDF natif, image numérisée, etc.
- Extrait le contenu, en appliquant l'OCR à toute page numérisée ou de type image afin de ne rien laisser de côté.
- Structure les données pour que les valeurs et les tableaux contenus dans les fichiers puissent être interrogés, et pas seulement recherchés.
- Signale la progression fichier par fichier, pour que vous voyiez ce qui a été ingéré, ce qui est encore en traitement et quels fichiers sont prêts.
Comme cela se déroule en arrière-plan, un dossier volumineux ne vous bloque pas — vous pouvez commencer à poser des questions à mesure que les fichiers deviennent disponibles. Une fois l'ingestion terminée, l'ensemble du dossier se comporte comme une source unique dans votre modèle vivant : vous posez une seule question et iDBQuery s'appuie sur chaque fichier pertinent, en citant le document et la page précis derrière chaque chiffre. C'est idéal pour des lots de factures, de relevés, de rapports ou toute archive de documents variés que vous devez réellement analyser plutôt que simplement stocker.
Updated 2026-06-22