Aller au contenu principal
Renamed.to logorenamed.to
Outil gratuit

Extrayez le texte des images et des PDF numérisés — OCR gratuit, privé et dans le navigateur

  • Importez votre image ou PDF numérisé
  • Sélectionnez la langue OCR et le prétraitement facultatif
  • Vérifiez, modifiez et exportez le texte extrait

Proof: Prend en charge 14 langues avec traitement côté client. Vos fichiers ne quittent jamais votre navigateur.

Extrayez le texte de photos, captures d’écran, documents numérisés et PDF — entièrement dans votre navigateur, sans envoi vers un serveur.

  • Prend en charge 14 langues : anglais, espagnol, français, allemand, italien, portugais, et 8 autres.
  • Gère les PDF numérisés multipages avec extraction de texte par page et séparateurs de page.
  • Prétraitement intégré : modes niveaux de gris et contraste élevé pour améliorer la précision sur les numérisations de mauvaise qualité.

La plupart des outils OCR gratuits envoient vos fichiers vers des serveurs inconnus, limitent à une page ou masquent les résultats derrière des publicités et des inscriptions obligatoires. Cet outil fonctionne entièrement dans votre navigateur avec WebAssembly — vos fichiers ne quittent jamais votre appareil.

Propulsé par Tesseract.js, le même moteur OCR open source utilisé par Google et LibreOffice.

Extracteur OCR

Importez une image ou un PDF ci-dessous. Le traitement s’exécute localement dans votre navigateur.

Comment extraire le texte des images et des PDF numérisés

1. Importez votre fichier

Déposez ou sélectionnez un JPEG, PNG, TIFF, WebP, BMP ou PDF numérisé jusqu’à 20 MB. Les PDF multipages jusqu’à 20 pages sont traités page par page avec des séparateurs clairs dans le résultat.

2. Choisissez la langue et les paramètres

Sélectionnez parmi 14 langues. Activez le prétraitement en niveaux de gris ou à contraste élevé pour une meilleure précision sur les numérisations de mauvaise qualité.

3. Le texte est extrait localement

Le moteur OCR Tesseract s’exécute dans votre navigateur via WebAssembly. Aucun fichier n’est envoyé où que ce soit.

4. Modifiez et exportez

Vérifiez le texte extrait, corrigez directement les éventuelles erreurs OCR, puis copiez dans le presse-papiers ou téléchargez au format .txt.

Bonnes pratiques OCR

01

Utilisez des numérisations haute résolution

La précision de l’OCR s’améliore nettement avec la résolution. Visez 300 DPI ou plus. Si vous numérisez, utilisez le réglage de qualité le plus élevé disponible.

02

Essayez le prétraitement pour le texte pâle

Activez le mode à contraste élevé pour les reçus, anciens documents ou impressions pâles. Les niveaux de gris aident avec les arrière-plans colorés qui perturbent l’OCR.

03

Vérifiez les scores de confiance

Un score de confiance inférieur à 60% signifie généralement que la qualité de la numérisation est trop faible. Essayez de numériser à nouveau en plus haute résolution ou d’ajuster les paramètres de prétraitement.

04

Nettoyez les résultats avant de les partager

L’OCR n’est jamais précis à 100%. Vérifiez toujours le résultat, en particulier pour les nombres, noms propres et caractères spéciaux que l’OCR lit souvent mal.

Organisez vos documents selon leur contenu

Une fois le texte extrait de vos documents, laissez renamed.to organiser et renommer automatiquement les fichiers selon leur contenu.

50 renommages gratuits pour commencer. Aucune carte bancaire requise.

Questions fréquentes

Quelle est la précision de cet outil OCR ?

La précision dépend de la qualité de l’image. Des numérisations nettes et haute résolution de texte imprimé atteignent généralement 90-98% de précision. Le texte manuscrit, les images basse résolution et les polices inhabituelles produiront une précision plus faible. Utilisez les options de prétraitement pour améliorer les résultats sur les numérisations difficiles.

Mes fichiers sont-ils envoyés vers un serveur ?

Non. Tout le traitement OCR s’exécute localement dans votre navigateur avec WebAssembly (Tesseract.js). Vos fichiers ne quittent jamais votre appareil. Les seules requêtes réseau servent à charger le moteur OCR et les données de langue depuis un CDN public lors de la première utilisation.

Quels formats d’image sont pris en charge ?

Les images JPEG, PNG, TIFF, WebP et BMP sont prises en charge, ainsi que les documents PDF numérisés jusqu’à 20 pages. La taille maximale du fichier est de 20 MB.

Puis-je utiliser l’OCR pour du texte dans d’autres langues ?

Oui. L’outil prend en charge 14 langues : anglais, espagnol, français, allemand, italien, portugais, néerlandais, polonais, russe, chinois (simplifié), japonais, coréen, arabe et turc. Sélectionnez la langue avant de lancer l’OCR pour de meilleurs résultats.

Comment puis-je améliorer la précision de l’OCR ?

Trois éléments aident le plus : (1) utiliser des numérisations haute résolution (300+ DPI), (2) activer des options de prétraitement comme les niveaux de gris et le contraste élevé, et (3) s’assurer que le document est bien éclairé et non incliné. Pour les PDF multipages, chaque page est traitée indépendamment.