Aller au contenu

Convertir un PDF en texte

Extrayez page par page le texte déjà présent, sans téléverser le PDF.

PDF et pages

Traitement dans le navigateur.

Le PDF reste dans cet onglet. 100 Mo maximum.

all ou 1-3,5.

Texte extrait

Choisissez un PDF et extrayez sa couche de texte.

Texte extrait

L’outil lit la couche de texte sélectionnable et sépare les pages. Il n’analyse pas les pixels et n’envoie rien à un OCR.

Un scan sans couche OCR existante donnera normalement un résultat vide.

Étapes

Choisissez le PDF, saisissez all ou des pages et lancez l’extraction. Le texte réel précède les comptes.

Vérifiez ordre et retours, copiez tout ou téléchargez un TXT UTF-8. Une modification efface l’ancien résultat.

Exemples et ordre

Pour cinq pages, 1,3-4 crée trois sections. Deux colonnes peuvent se mélanger car un PDF stocke souvent des positions.

Les tableaux perdent bordures et colonnes ; les limites de page et fins de ligne disponibles restent.

Usages

Utile pour notes, recherche, accessibilité et import dans un éditeur. Comparez les citations importantes au PDF.

TXT ne garde ni polices, liens, images, formulaires ni mise en page. L’original ne change pas.

Limites

PDF chiffrés, endommagés ou mal encodés peuvent échouer. Testez une petite plage.

Aucun OCR des scans, photos ou écritures. Le fichier est abandonné à la fermeture.

Questions fréquentes

Un résultat vide indique souvent une image. L’ordre dépend de la structure PDF. TXT ne conserve pas les tableaux. Plages et étiquettes de pages sont prises en charge.