Extraire le texte et les tableaux d’un PDF
Copiez les mots d’un PDF sans vous battre avec la sélection, ou exportez un tableau en CSV pour un tableur. L’outil lit la couche de texte dans l’ordre de lecture, détecte les colonnes alignées comme des tableaux et peut garder la mise en page.
Tooloat fonctionne dans votre navigateur et a besoin de JavaScript. Il s’ouvre en un instant, et vos fichiers sont traités sur votre appareil.
Comment ça marche
- Déposez vos PDF.
- Choisissez l’ordre de lecture, les pages et la détection des tableaux.
- Téléchargez des fichiers TXT, CSV ou JSON.
Pourquoi l’utiliser
- Garde l’ordre de lecture ou la mise en page d’origine.
- Détecte les tableaux simples et exporte chacun en CSV.
- JSON structuré avec le texte de chaque page.
- Lot avec téléchargement ZIP.
Façons courantes d’utiliser cet outil
Questions et réponses
Pourquoi n’ai-je obtenu aucun texte ?
Les PDF numérisés contiennent des images de pages, pas du texte. Passez-les d’abord dans Image en texte (OCR).
La détection des tableaux est-elle bonne ?
Elle marche mieux sur les grilles simples aux colonnes alignées. Les mises en page complexes peuvent demander une correction à la main.
Mon document est-il envoyé ?
Non, l’extraction se fait dans votre navigateur.
Outils associés
- Convertisseur d’image en texte (OCR)Lisez les mots d’une photo, d’une capture d’écran ou d’une page numérisée.
- Convertisseur PDF en WordTransformez un PDF en document Word que vous pouvez modifier.
- Convertisseur Excel en CSVConvertissez un classeur en CSV, TSV ou JSON avec un fichier par feuille, ou transformez un CSV en vrai fichier Excel.
- Convertir un PDF en imagesEnregistrez des pages PDF sous forme d’images pour des diapositives, des publications ou des documents qui exigent des images.