PDF en Markdown
Extrayez le texte d'un PDF et récupérez un Markdown propre — titres, listes et tableaux conservés — prêt pour vos notes ou pour alimenter une IA. Les pages scannées peuvent être lues par OCR dans la même passe. Tout s'exécute sur votre appareil.
Your PDF
Déposez un PDF ici — ou cliquez pour en choisir un
PDFVos fichiers ne sont jamais téléversés — tout s'exécute sur votre appareil.
Markdown
Comment ça marche
-
Ajoutez votre PDF
Glissez-déposez un PDF ou cliquez pour en choisir un. Il se charge directement dans votre navigateur — rien n'est téléversé.
-
Extrayez le texte
Cliquez sur Convertir en Markdown. Le texte, les titres, les listes et les tableaux sont extraits sur votre appareil en un instant. Si le PDF s'avère être un scan, un bouton apparaît pour lire ces pages avec l'OCR.
-
Copiez ou téléchargez
Copiez le Markdown dans votre presse-papiers ou téléchargez-le sous forme de fichier .md — prêt pour vos notes, documents ou pour alimenter une IA.
Ce que vous obtenez
Extraire les tableaux d'un PDF
Les titres, les listes à puces ou numérotées et les tableaux sont restitués sous forme de vrai Markdown — ordre de lecture conservé — et non comme un simple bloc de texte brut.
Prêt pour l'IA et vos notes
Un Markdown propre est exactement ce dont les outils comme ChatGPT et les applications de prise de notes ont besoin — collez-le directement ou téléchargez un fichier .md.
Confidentiel et gratuit
Aucun compte requis, aucune limite de pages, aucun filigrane. Votre PDF n'est jamais téléversé — l'intégralité de la conversion s'exécute dans votre navigateur.
Sur quoi il repose
Construit sur pdf.js, le moteur PDF de Mozilla, qui lit la couche de texte que le PDF contient déjà : aucun modèle, aucune supposition. Les pages scannées n'ont pas de couche de texte et passent donc par l'OCR Tesseract.
Foire aux questions
- Mon PDF est-il téléversé quelque part ?
- Non. La conversion s'exécute entièrement dans le navigateur de votre propre appareil. Votre PDF n'est jamais téléversé et rien n'est conservé une fois l'onglet fermé.
- Gère-t-il les tableaux et les titres ?
- Oui. Les titres deviennent des titres Markdown, les tableaux deviennent des tableaux Markdown avec des barres verticales, et les listes numérotées sont préservées. L'ordre de lecture du document est respecté.
- Peut-il faire l'OCR d'un PDF scanné ?
- Oui. Les pages scannées ou composées uniquement d'images sont détectées automatiquement, et un bouton « Lire les pages scannées avec l'OCR » apparaît. Les pages sont rasterisées et reconnues sur votre appareil, et le texte récupéré est réintégré au Markdown dans le bon ordre de lecture.
- Comment convertir un PDF en texte brut ?
- De la même façon — le Markdown est du texte brut. Convertissez, puis utilisez « Copier le Markdown » ou téléchargez le fichier .md et ouvrez-le dans n'importe quel éditeur de texte. Les marqueurs ne sont que des caractères comme # et -, supprimez-les si vous voulez quelque chose de totalement nu.
- Puis-je extraire les tableaux d'un PDF ?
- Oui. Les tableaux ressortent sous forme de tableaux Markdown à barres verticales, qui se collent proprement dans tout ce qui lit le Markdown. Une limite mérite d'être connue : la sortie est uniquement du Markdown — il n'y a pas d'export CSV ni tableur, un tableau que vous voulez en colonnes demande donc une conversion de votre côté.
- Est-ce vraiment gratuit ? Y a-t-il des limites ?
- Oui — totalement gratuit, sans compte et sans aucune limite de pages. Puisque tout s'exécute sur votre appareil, nous n'avons aucun quota à appliquer.
- Utilise-t-il un modèle d’IA ?
- Pour les PDF ordinaires, non : pdf.js lit directement le texte intégré, d'où sa rapidité et son exactitude. Seules les pages scannées nécessitent le moteur OCR Tesseract, et ce sont précisément celles où des erreurs peuvent apparaître.