Aller au contenu principal

OCR

Convertit une image ou un PDF scanné (document support) en texte exploitable — reconnaissance optique de caractères — avec de nombreux réglages de prétraitement d'image pour améliorer la qualité de lecture.

Ports

  • Entrée (gauche, type image) — typiquement en aval d'un Filtre MIME.
  • Sortie (droite, type document support).

Moteur

  • Tesseract (par défaut) — intégré, gratuit.
  • Modèle OCR configuré — s'appuie sur un modèle OCR enregistré par un manager (par exemple Mistral OCR).

Réglages Tesseract

  • Langue : français + anglais (par défaut), français seul, ou anglais seul.
  • Mode de segmentation de page (PSM) — défaut 3 (segmentation automatique).
  • Configuration avancée (modale dédiée) :
    • Moteur OCR (OEM) — défaut 3.
    • Résolution (DPI) — 72 à 1200, défaut 300.
    • Prétraitement d'image (coché par défaut), et si activé :
      • Agrandissement minimal en pixels — 200 à 6000, défaut 1600.
      • Mode de contraste — automatique (par défaut), CLAHE, ou aucun.
      • Binarisation — aucune (par défaut), Otsu, ou adaptative.
      • Débruitage, redressement (deskew) et renforcement de netteté — décochés par défaut.
    • Options Tesseract brutes en texte libre (ex. --psm 11 -c preserve_interword_spaces=1).

Réglages « modèle OCR »

  • Sélection du modèle OCR configuré.
  • Pages ciblées (ex. 0,2,5-7).
  • Granularité des scores de confiance (aucune / page / mot).
  • Confiance minimale (0–100).
  • Instructions d'annotation en texte libre.

Les deux modes de configuration avancée intègrent un panneau de test : on y téléverse une image d'essai et on exécute un vrai passage OCR avec les réglages actuels du nœud, pour calibrer les paramètres avant de lancer une analyse réelle (rien n'est conservé, c'est un aperçu).