Texte extrait
L’outil lit la couche de texte sélectionnable et sépare les pages. Il n’analyse pas les pixels et n’envoie rien à un OCR.
Un scan sans couche OCR existante donnera normalement un résultat vide.
Étapes
Choisissez le PDF, saisissez all ou des pages et lancez l’extraction. Le texte réel précède les comptes.
Vérifiez ordre et retours, copiez tout ou téléchargez un TXT UTF-8. Une modification efface l’ancien résultat.
Exemples et ordre
Pour cinq pages, 1,3-4 crée trois sections. Deux colonnes peuvent se mélanger car un PDF stocke souvent des positions.
Les tableaux perdent bordures et colonnes ; les limites de page et fins de ligne disponibles restent.
Usages
Utile pour notes, recherche, accessibilité et import dans un éditeur. Comparez les citations importantes au PDF.
TXT ne garde ni polices, liens, images, formulaires ni mise en page. L’original ne change pas.
Limites
PDF chiffrés, endommagés ou mal encodés peuvent échouer. Testez une petite plage.
Aucun OCR des scans, photos ou écritures. Le fichier est abandonné à la fermeture.
Questions fréquentes
Un résultat vide indique souvent une image. L’ordre dépend de la structure PDF. TXT ne conserve pas les tableaux. Plages et étiquettes de pages sont prises en charge.