Tooloat

Extraire le texte et les tableaux d’un PDF

Copiez les mots d’un PDF sans vous battre avec la sélection, ou exportez un tableau en CSV pour un tableur. L’outil lit la couche de texte dans l’ordre de lecture, détecte les colonnes alignées comme des tableaux et peut garder la mise en page.

Tooloat fonctionne dans votre navigateur et a besoin de JavaScript. Il s’ouvre en un instant, et vos fichiers sont traités sur votre appareil.

Comment ça marche

  1. Déposez vos PDF.
  2. Choisissez l’ordre de lecture, les pages et la détection des tableaux.
  3. Téléchargez des fichiers TXT, CSV ou JSON.

Pourquoi l’utiliser

  • Garde l’ordre de lecture ou la mise en page d’origine.
  • Détecte les tableaux simples et exporte chacun en CSV.
  • JSON structuré avec le texte de chaque page.
  • Lot avec téléchargement ZIP.

Façons courantes d’utiliser cet outil

Questions et réponses

Pourquoi n’ai-je obtenu aucun texte ?

Les PDF numérisés contiennent des images de pages, pas du texte. Passez-les d’abord dans Image en texte (OCR).

La détection des tableaux est-elle bonne ?

Elle marche mieux sur les grilles simples aux colonnes alignées. Les mises en page complexes peuvent demander une correction à la main.

Mon document est-il envoyé ?

Non, l’extraction se fait dans votre navigateur.

Outils associés