Convertisseur PDF en Markdown
Pour convertir un PDF en Markdown, envoyez le PDF et choisissez Markdown (MD). Notre serveur extrait le texte, transforme les tailles de police plus grandes en titres #, ## et ###, reconnaît les listes à puces et numérotées et renvoie un fichier .md au format GitHub. Les tableaux du PDF ne sont pas reconstruits en tableaux Markdown ; leur texte arrive sous forme de paragraphes. Les PDF numérisés ne sont pas pris en charge faute d'OCR.
- Gratuit, sans inscription
- Fichiers supprimés sous 30 minutes
- Jusqu'à 100 Mo
Les fichiers sont supprimés définitivement de nos serveurs sous 30 minutes.
Comment convertir PDF en Markdown
Envoyez votre fichier PDF
Glissez votre fichier PDF dans la zone d'envoi ou parcourez vos dossiers (jusqu'à 100 Mo).
Gardez Markdown comme format cible
Markdown est déjà sélectionné dans le menu ; vous pouvez choisir un autre format si besoin.
Convertissez et téléchargez
Cliquez sur « Convertir » et le téléchargement du fichier converti démarre automatiquement.
Qu'est-ce qui est conservé ?
Conservé
- Texte courant et paragraphes
- Titres détectés d'après la taille de police (#, ##, ###)
- Listes à puces et numérotées
Modifié
- Les lignes commençant par #, -, > ou 1. sont échappées pour rester littérales
Non reporté
- Structure des tableaux : les cellules deviennent des paragraphes
- Polices, couleurs et mise en page
- Images d'arrière-plan pleine page
Quand l'utiliser
Préparer des documents pour les LLM et les flux RAG
Avant de confier des PDF à ChatGPT, Claude ou à un système de génération augmentée par récupération (RAG), les convertir en Markdown élimine le bruit de mise en page tout en conservant la hiérarchie des titres, ce qui facilite beaucoup le découpage et la citation des sections.
Transférer des manuels vers du docs-as-code et des applications de notes
Lorsque vous migrez des manuels PDF vers GitHub, un wiki GitLab, Obsidian ou Notion, vous pouvez partir d'un fichier .md dont les titres et les listes sont déjà balisés au lieu de tout mettre en forme à la main.
Limites à connaître
- Pas d'OCR pour les PDF numérisés.
- La détection des titres repose sur la taille de police ; les titres en gras à la taille du texte courant peuvent rester des paragraphes.
- Les PDF chiffrés sont rejetés.
À propos des formats
Qu'est-ce que PDF ?
Le PDF (Portable Document Format) est un format de document à mise en page figée créé par Adobe et normalisé sous la référence ISO 32000. Chaque texte, image et trait est enregistré avec sa position sur la page : un PDF s'affiche donc de la même façon sur tous les appareils et s'imprime de manière fiable. Le revers de la médaille est la modification : un PDF stocke des positions sur une page, pas des paragraphes ni des tableaux. Les PDF numérisés ne contiennent que des images de pages et nécessitent une OCR (reconnaissance optique de caractères) avant toute extraction de texte.
Qu'est-ce que Markdown (MD) ?
Markdown est un langage de balisage léger conçu par John Gruber en 2004. La mise en forme s'écrit avec de simples symboles dans du texte brut : # pour les titres, ** pour le gras, - pour les éléments de liste et | pour les tableaux. Les fichiers Markdown (.md) sont partout : fichiers README sur GitHub, documentation technique, applications de prise de notes et réponses des assistants d'IA. La variante la plus répandue est le GitHub Flavored Markdown (GFM), qui ajoute les tableaux, les listes de tâches et le texte barré.
Questions fréquentes
Comment les titres sont-ils détectés dans le PDF ?
Le convertisseur compare la taille de police de chaque bloc de texte à celle du texte courant. Les blocs nettement plus grands deviennent des titres #, ## ou ### selon leur taille relative. Les titres en gras à la taille du texte courant peuvent rester des paragraphes normaux, que vous pouvez corriger dans le fichier .md.
Les tableaux PDF deviennent-ils des tableaux Markdown ?
Non. Un PDF ne stocke que du texte positionné, pas des lignes et des cellules : le convertisseur écrit donc le contenu des tableaux sous forme de paragraphes. Si vous avez besoin de vrais tableaux Markdown et que vous disposez aussi du document au format Word ou DOC, convertissez plutôt ce fichier en Markdown, car les tableaux des fichiers Word sont conservés.
Le résultat convient-il à ChatGPT et aux autres LLM ?
Oui, c'est un usage courant. Le Markdown est compact et facile à analyser pour les modèles de langage : les titres marquent les sections et les marqueurs de liste marquent les éléments. Envoyez le fichier .md ou collez son contenu. N'oubliez simplement pas que les PDF numérisés ne produisent aucun texte, puisqu'aucune OCR n'est effectuée.
La conversion de PDF en Markdown est-elle gratuite ?
Oui, entièrement gratuite. Pas de compte, d'abonnement ni de filigrane — il suffit d'envoyer votre fichier et de le convertir.
Mon fichier est-il en sécurité et quand est-il supprimé ?
Votre fichier est transféré en HTTPS et stocké sur notre serveur sous un code aléatoire. Le fichier envoyé et le résultat sont supprimés définitivement sous 30 minutes, et le lien de téléchargement ne fonctionne que pour la personne qui détient votre code unique.