Cheap Site BAB

📄 PDF vers Markdown

Le même contenu, pour une fraction des tokens quand vous le donnez à votre IA

Un PDF envoyé tel quel à une IA comme Claude ou ChatGPT peut coûter des dizaines de milliers de tokens, car chaque page est aussi lue comme une image. En Markdown, le même texte coûte une fraction de ce prix. Et tout se passe ici : votre PDF ne quitte jamais ce navigateur, rien n'est envoyé ni conservé sur nos serveurs.

Déposer un PDF ici

ou cliquez pour sélectionner un fichier — un seul PDF, en français ou en anglais

En attente d'un fichier…

✅ Markdown généré !

Tokens si le PDF est envoyé tel quel
Tokens avec ce Markdown
Tokens économisés
Estimations approximatives (1 token ≈ 4 caractères ; ~1500 à 3000 tokens de texte par page pour un PDF envoyé tel quel, plus les tokens d'image, d'après la documentation Anthropic).
Télécharger le .md

Pourquoi cet outil existe

FranckL - Cheap Site BAB

J'utilise Claude et ChatGPT tous les jours, et je me suis fait avoir plus d'une fois en donnant un PDF de vingt ou trente pages à lire à une IA : le quota de tokens qui s'envole d'un coup, avant même d'avoir posé une seule question. La raison est simple, mais peu de gens la connaissent : ces assistants ne se contentent pas de lire le texte, ils transforment aussi chaque page en image pour l'analyser, ce qui double voire triple la note.

La solution n'a rien de compliqué : donner à l'IA du texte brut plutôt qu'un PDF entier. Encore fallait-il un outil simple pour extraire proprement ce texte, y compris sur les PDF scannés (donc sans texte "sélectionnable"), sans avoir à installer quoi que ce soit. C'est ce que fait celui-ci.

Comment ça marche, concrètement

1
Vous déposez votre PDF. L'outil lit directement le texte qu'il contient ; s'il s'agit d'un scan sans texte, il bascule automatiquement sur une reconnaissance optique (OCR).
2
Le texte est remis en forme en Markdown : les titres, les listes à puces et les notes de bas de page sont reconstitués automatiquement.
3
Vous copiez le résultat directement dans votre conversation avec l'IA, ou vous téléchargez le fichier .md pour le garder de côté. Les deux sont possibles.
🔒 Votre PDF ne quitte jamais votre navigateur. La lecture, l'OCR et la mise en Markdown se font entièrement sur votre ordinateur : rien n'est envoyé, ni stocké, sur les serveurs de Cheap Site BAB. Je n'ai aucun accès à vos documents, même le temps d'un traitement.

Concrètement, voici ce que vous pouvez y faire :

  • Extraire directement le texte d'un PDF "normal" (rapport, contrat, article, mémoire) en quelques secondes
  • Basculer automatiquement sur l'OCR pour les PDF scannés, en français, en anglais ou dans les deux langues à la fois
  • Reconstituer titres, listes et notes de bas de page en Markdown propre, au lieu d'un bloc de texte informe
  • Voir en direct l'estimation du nombre de tokens économisés par rapport à un envoi du PDF "tel quel" à votre IA
  • Copier le résultat en un clic dans le presse-papiers, ou télécharger le fichier .md

Ce n'est pas une extraction parfaite dans tous les cas : les tableaux perdent leur mise en grille, et une mise en page à plusieurs colonnes peut parfois mélanger l'ordre du texte. Sur l'immense majorité des PDF de texte, en revanche, le gain est immédiat, et ça change vraiment la façon dont votre quota de tokens tient la journée. Si un cas particulier vous pose problème, dites-le-moi.