Passer au contenu

PDF en texte

Choisissez un PDF, extrayez son texte sélectionnable et, si nécessaire, reconnaissez les pages scannées par OCR local avant de copier ou télécharger un fichier TXT.

Choisir un PDF

Déposez ou sélectionnez un PDF. L'extraction de texte et l'OCR facultatif s'exécutent localement dans votre navigateur.

Laissez vide pour toutes les pages. Séparez les pages et plages par des virgules.

Extraire le texte

Lit d'abord le texte existant du PDF, puis lance éventuellement l'OCR uniquement sur les pages sélectionnées sans texte extractible.

PDF en texte

Démarrage rapide

1
Choisir un PDF
2
Définir les pages si besoin
3
Extraire le texte et reconnaître les scans par OCR si nécessaire
4
Copier ou télécharger le TXT

Scénarios courants

Copie

récupérez le texte sélectionnable ou scanné d'un PDF dans des notes, un e-mail ou un autre éditeur.

Extraction ciblée

lisez ou traitez par OCR uniquement les pages utiles d'un long PDF.

Archivage

gardez une copie TXT légère d'un PDF local sans envoyer le fichier.

Entrée et sortie

Entrée : un PDF local contenant du texte sélectionnable, des pages scannées ou les deux.
Pages : toutes les pages par défaut, ou une plage comme 1-3,5.
Sortie : du texte brut à copier ou à télécharger en fichier TXT.

Conseils d'utilisation

Laissez l'OCR désactivé pour le texte PDF sélectionnable. Activez-le lorsque les pages choisies sont des scans ou des images.
Sur un PDF long ou atypique, extrayez d'abord une petite plage de pages.
Les très grands PDF peuvent prendre du temps et atteindre les limites de mémoire ou de texte du navigateur.

Limitations et compatibilité

L'OCR est facultatif et s'exécute uniquement sur les pages sélectionnées sans texte extractible. L'écriture manuscrite, les scans en basse résolution et les mises en page complexes peuvent réduire la précision.
La sortie en texte brut ne conserve pas les mises en page complexes, les colonnes, les tableaux, les polices ni les annotations du PDF.
Les PDF protégés par mot de passe ou inhabituels peuvent échouer si PDF.js ou le navigateur ne peut pas les décoder.

Confidentialité & sécurité

Le traitement s'exécute dans votre navigateur. CrateX.app n'envoie ni le PDF ni le texte extrait. Lorsque l'OCR est activé, des ressources linguistiques sont téléchargées pour la reconnaissance locale ; le PDF et les résultats restent en mémoire de la page et ne sont pas synchronisés par défaut.

FAQ

9

Poursuivez avec ces outils associés pour l’étape suivante.

Tout le traitement des outils s'effectue localement dans votre navigateur.