📄 PDF vers Markdown
Le même contenu, pour une fraction des tokens quand vous le donnez à votre IA
Déposer un PDF ici
ou cliquez pour sélectionner un fichier — un seul PDF, en français ou en anglais
✅ Markdown généré !
Pourquoi cet outil existe
J'utilise Claude et ChatGPT tous les jours, et je me suis fait avoir plus d'une fois en donnant un PDF de vingt ou trente pages à lire à une IA : le quota de tokens qui s'envole d'un coup, avant même d'avoir posé une seule question. La raison est simple, mais peu de gens la connaissent : ces assistants ne se contentent pas de lire le texte, ils transforment aussi chaque page en image pour l'analyser, ce qui double voire triple la note.
La solution n'a rien de compliqué : donner à l'IA du texte brut plutôt qu'un PDF entier. Encore fallait-il un outil simple pour extraire proprement ce texte, y compris sur les PDF scannés (donc sans texte "sélectionnable"), sans avoir à installer quoi que ce soit. C'est ce que fait celui-ci.
Comment ça marche, concrètement
Concrètement, voici ce que vous pouvez y faire :
- Extraire directement le texte d'un PDF "normal" (rapport, contrat, article, mémoire) en quelques secondes
- Basculer automatiquement sur l'OCR pour les PDF scannés, en français, en anglais ou dans les deux langues à la fois
- Reconstituer titres, listes et notes de bas de page en Markdown propre, au lieu d'un bloc de texte informe
- Voir en direct l'estimation du nombre de tokens économisés par rapport à un envoi du PDF "tel quel" à votre IA
- Copier le résultat en un clic dans le presse-papiers, ou télécharger le fichier .md
Ce n'est pas une extraction parfaite dans tous les cas : les tableaux perdent leur mise en grille, et une mise en page à plusieurs colonnes peut parfois mélanger l'ordre du texte. Sur l'immense majorité des PDF de texte, en revanche, le gain est immédiat, et ça change vraiment la façon dont votre quota de tokens tient la journée. Si un cas particulier vous pose problème, dites-le-moi.