Extracteur d'images/texte PDF

Extrayez et révisez le texte des captures d'écran, des photos et des PDF dans votre navigateur.

Choisissez des images ou un PDF, sélectionnez la langue du texte et extrayez. Passez en revue chaque page à côté de l'original, modifiez les erreurs, puis copiez ou téléchargez TXT.

Comment utiliser

Extraire le texte d'une capture d'écran ou d'un PDF

Choisissez des images ou un PDF, sélectionnez la langue du texte et extrayez. Passez en revue chaque page à côté de l'original, modifiez les erreurs, puis copiez ou téléchargez TXT.

Exemple et résultat attendu

Exemple : l'exemple de facture contient « Total : 125,50 USD ». Vérifiez les numéros par rapport à l'original avant de copier. TXT conserve les séparateurs de texte et de page ; il ne conserve pas les tableaux ni la mise en page PDF.

Limites de reconnaissance

Jusqu'à 10 images ou un PDF de 20 pages. Le texte imprimé fonctionne mieux. Les tableaux, l'écriture manuscrite et les colonnes complexes nécessitent une révision manuelle. La reconnaissance bengali n'est pas prise en charge.

Vérifiez attentivement les résultats en arabe, en ourdou et en vietnamien : des écritures ou des accents mélangés peuvent entraîner des chiffres ou des lettres manquants.

Premier téléchargement

Le moteur et les modèles sélectionnés sont téléchargés en cas de besoin. Les fichiers restent dans ce navigateur. Le mode qualité charge environ 31 Mo de modèles plus le moteur ; le mode léger charge environ 6 Mo de modèles. Les actifs mis en cache peuvent être réutilisés.

Calques de texte PDF

Le texte PDF existant est extrait directement. Les pages numérisées utilisent l'OCR. Reconnaître à nouveau cette page force l'OCR si le calque de texte d'origine est incomplet. L'exportation est du texte brut, et non un PDF consultable ou un tableau Excel.