Nouplo

Extraire le texte d'un PDF scanné

Vos scans deviennent du texte à copier et à rechercher, sans que le document quitte votre appareil.

Déposez vos fichiers ici

ou cliquez pour les choisir sur votre appareilFormats acceptés : PDF

Jusqu'à 3 fichiers par opérationJusqu'à 20 Mo par fichier10 opérations par jourSupprimer les limites avec Pro✓ Fonctionne hors ligne

Vos fichiers restent sur votre appareil

Cet outil fonctionne entièrement dans votre navigateur. Rien n'est envoyé, rien n'est stocké, et vous pouvez même couper votre connexion internet avant de commencer.

Comment ça marche

  1. Déposez un PDF : un scan, un document photographié puis enregistré en PDF, ou tout PDF dont vous voulez récupérer le texte.
  2. Laissez le champ « Pages » vide pour lire tout le fichier, ou saisissez des pages comme 1-3, 5. Jusqu'à 20 pages scannées sont lues par opération.
  3. Cliquez sur « Extraire le texte ». La première fois, les modèles de reconnaissance de texte et leur moteur d'exécution (environ 11 Mo) sont téléchargés.
  4. Copiez le texte affiché ou téléchargez-le en fichier .txt. Les pages y sont repérées par --- 1 ---, --- 2 --- et ainsi de suite.

Questions fréquentes

Le PDF devient-il consultable par recherche ?
Cette page vous donne le texte. Pour garder le PDF et pouvoir y lancer des recherches, utilisez « Rendre un PDF consultable », qui ajoute le même texte reconnu sous forme de couche invisible sur chaque page scannée.
Que deviennent les pages qui contiennent déjà du texte ?
Leur texte est repris directement dans le PDF, instantanément et à l'identique. Seules les pages sans texte exploitable, comme les scans, passent par la reconnaissance de texte.
Pourquoi seulement 20 pages scannées à la fois ?
La lecture d'une page prend plusieurs secondes et beaucoup de mémoire dans le navigateur. Pour un scan plus long, saisissez les pages par lots, par exemple 1-20 puis 21-40.
Quels documents fonctionnent bien ?
Les documents imprimés en français et en anglais, ainsi qu'en allemand, espagnol, italien, portugais, turc et japonais. Sur nos pages de test en français (factures, courriers, tickets de caisse et captures d'écran, en scan à 300 dpi, en JPEG ou en photo), moins d'un caractère sur 100 était faux, les é, è, ê, à et ç ont été lus correctement et tous les montants et dates étaient exacts. Ces pages ayant été générées, un scan pâle ou de mauvaise qualité donnera un moins bon résultat. L'écriture manuscrite n'est pas lue de façon fiable et les pages en plusieurs colonnes peuvent ressortir avec les colonnes mélangées : vérifiez le texte avant de l'utiliser.
Mon PDF est-il envoyé sur un serveur ?
Non. Les pages sont affichées et lues dans votre navigateur. L'offre gratuite autorise 1 PDF par opération, jusqu'à 20 Mo, et 10 opérations par jour ; Pro supprime ces limites.

Pour un usage précis

Outils associés