En quoi consiste cet outil ?
Cet outil lit le contenu textuel de chaque page d'un PDF et le reconstruit sous forme de lignes et de colonnes dans un classeur Excel, avec une feuille par page. Il regroupe le texte en lignes selon leur position verticale, puis divise chaque ligne en cellules dès qu'il détecte un large espace horizontal entre les mots — une approximation raisonnable pour repérer 'ici commence une nouvelle colonne', plutôt qu'une simple espace.
Cette méthode fonctionne bien pour les PDF avec des tableaux ou des listes simples et régulièrement espacés — factures, listes de prix, rapports exportés. Elle ne reconstitue pas de façon fiable les mises en page complexes comportant des cellules fusionnées, du contenu sur plusieurs lignes dans une cellule, ou des tableaux sans espacement clair entre les colonnes ; dans ces cas, attendez-vous à devoir ajuster manuellement le résultat après le téléchargement.
Pourquoi l'utiliser ?
- Transforme les tableaux et listes d'un PDF en fichier Excel modifiable et triable, au lieu de ressaisir les données à la main.
- Sans inscription, sans filigrane, entièrement gratuit.
- Local et confidentiel — votre PDF n'est jamais envoyé sur un serveur.
- Une feuille par page du PDF, pour que les documents de plusieurs pages restent bien organisés.
Mode d'emploi
- Cliquez sur la zone ou glissez-déposez un fichier PDF dessus.
- Patientez pendant que l'outil extrait le texte et l'organise en lignes et colonnes.
- Téléchargez le fichier .xlsx et ouvrez-le dans Excel, Google Sheets ou tout autre tableur.
- Vérifiez les découpages de colonnes — pour les tableaux complexes, il peut être nécessaire d'ajuster manuellement quelques cellules.
Exemple
Entrée
invoice.pdf — une facture d'une page avec un tableau de lignes de détailRésultat
invoice.xlsx — une feuille avec chaque ligne de facture sous forme de ligne, des colonnes pour l'article, la quantité et le prixLa précision dépend fortement de la mise en page du PDF d'origine — les tableaux simples avec des espaces de colonnes bien nets se convertissent proprement, tandis que les tableaux denses ou irrégulièrement espacés peuvent nécessiter un nettoyage manuel.
Foire aux questions
Pourquoi certaines de mes colonnes sont-elles fusionnées ou mal séparées ?
Cet outil devine les limites des colonnes à partir de l'espacement horizontal entre les mots dans la couche de texte sous-jacente du PDF — il n'a pas accès à la structure de tableau d'origine du PDF (la plupart des PDF n'en conservent pas). Si les colonnes sont proches ou si un tableau utilise un espacement inhabituel, l'estimation peut être erronée. Vérifiez le résultat et ajustez-le manuellement si besoin.
Est-ce que cela fonctionne avec les PDF scannés ?
Non. Cet outil lit la couche de texte intégrée dans le PDF ; les documents scannés ne sont que des images et ne contiennent aucun texte extractible. Utilisez d'abord un outil d'OCR pour PDF afin d'ajouter une couche de texte, puis utilisez ce convertisseur.
Mon PDF est-il envoyé sur un serveur ?
Non. L'extraction du texte et la génération du fichier Excel se font toutes deux localement dans votre navigateur en JavaScript. Votre fichier ne quitte jamais votre appareil.
Cet outil conserve-t-il la mise en forme des cellules, les couleurs ou les cellules fusionnées du tableau d'origine ?
Non. Le résultat est du texte brut organisé en grille — les polices, couleurs, bordures et cellules fusionnées du PDF d'origine ne sont pas conservées.