Transformer un PDF en texte Markdown
Choisissez un PDF et obtenez un fichier .md dont les titres, paragraphes et listes sont déjà balisés, prêt pour un wiki, un site statique ou vos notes. La conversion se fait dans votre navigateur.
- Les fichiers ne quittent jamais votre navigateur.
- Sans compte
- Aucun filigrane ajouté
- Fonctionne sur tout appareil
Comment ça marche
Étape 1: Choisissez un fichier PDF ou déposez-le sur la page.
Étape 2: Lancez la conversion et patientez pendant l'analyse du texte page par page.
Étape 3: Vérifiez l'aperçu Markdown pour contrôler les titres et les listes.
Étape 4: Téléchargez le fichier .md ou copiez le texte.
Comment un PDF devient du Markdown
Un PDF ne conserve ni titres ni paragraphes : il place des caractères à des coordonnées sur une page. Pour reconstruire la structure, l'outil lit le texte avec PDF.js, mesure les tailles de police et considère les plus grandes comme des titres, avec des dièses selon le niveau. Les lignes espacées normalement sont regroupées en paragraphes, et celles qui débutent par une puce deviennent des éléments de liste.
Quand la police indique du gras ou de l'italique, le passage est encadré par la syntaxe Markdown correspondante. Vous obtenez un simple fichier .md, lisible dans n'importe quel éditeur, collable dans un outil de documentation ou versionnable dans un dépôt.
C'est une conversion centrée sur le texte. Les tableaux et les images ne sont pas reproduits, et la mise en page en colonnes est aplatie en un seul flux de lecture. Attendez-vous à un bon premier jet à retoucher, pas à une copie parfaite.
Pourquoi utiliser cet outil
De la structure, pas seulement du texte
Titres, listes à puces et mise en valeur sont repérés d'après la taille et le style de la police : vous évitez l'essentiel du formatage manuel.
Reste dans votre navigateur
Le PDF est lu localement et n'est pas envoyé, ce qui convient aux documentations internes et aux brouillons non publiés.
Un format portable
Le Markdown s'ouvre dans tous les éditeurs et fonctionne avec Git, les générateurs de sites statiques, Obsidian, Notion et la plupart des wikis.
Usages courants
Migrer une documentation vers un wiki
Une équipe qui possède d'anciens manuels en PDF peut les convertir en Markdown et les importer dans un site de documentation, au lieu de tout retaper.
Prendre des notes sur un article
Transformez un article de recherche en Markdown, puis citez-le, annotez-le et reliez-le dans votre base de connaissances personnelle.
Alimenter une chaîne de rédaction
Les rédacteurs qui travaillent en Markdown partent du texte converti plutôt que de copier les paragraphes un par un depuis un lecteur PDF.
Publier un PDF en page web
Convertissez une lettre d'information ou un guide, corrigez les titres et passez le tout dans un générateur de site statique pour obtenir du HTML.
Que vérifier après la conversion
Un PDF décrit une apparence et non un sens ; quelques points méritent donc un coup d'œil dans l'aperçu avant d'utiliser le fichier ailleurs.
- Titres : une grande citation ou un gros numéro de page peut être pris pour un titre.
- Césures : un mot coupé en fin de ligne peut garder son trait d'union au milieu du mot.
- En-têtes et pieds de page : le texte répété apparaît à chaque page et se supprime d'un seul rechercher-remplacer.
- Listes : les listes numérotées peuvent arriver en paragraphes commençant par un chiffre, ce que le Markdown affiche souvent correctement.
Formats pris en charge
- Entrée
- Fichiers PDF (.pdf) contenant une couche de texte.
- Sortie
- Un fichier Markdown (.md).
Pour du texte brut sans balisage, utilisez PDF en texte ; pour une page web, PDF en HTML.
Bon à savoir
- Les tableaux ne sont pas convertis : leur contenu apparaît en lignes ordinaires et doit être reconstruit à la main (PDF en Excel gère mieux les données tabulaires).
- Les images et les graphiques vectoriels sont ignorés. Utilisez Extraire les images d'un PDF pour récupérer les visuels.
- Un PDF numérisé n'a pas de couche de texte et donne un résultat vide ; passez d'abord par OCR PDF.
- Les niveaux de titre dépendent de la taille de police : un document qui l'emploie de façon irrégulière peut donner des niveaux étranges à corriger.
Vos fichiers ne quittent jamais votre navigateur
Cet outil s'exécute entièrement sur votre appareil, dans votre navigateur. Vos fichiers ne sont pas envoyés à nos serveurs et ne sont stockés nulle part. Fermer l'onglet efface tout.
Questions fréquentes
PDF en Markdown envoie-t-il mon fichier sur un serveur ?
Non. Le texte est extrait dans votre navigateur avec PDF.js : le PDF ne quitte pas votre appareil et nous ne conservons rien.
Les tableaux et les images sont-ils inclus dans le Markdown ?
Non. Seul le texte est converti : titres, paragraphes, listes à puces, gras et italique. Les tableaux apparaissent en lignes simples et les images sont ignorées.
Pourquoi le résultat est-il vide pour mon PDF ?
Le PDF est probablement une numérisation : chaque page est une image sans vrai texte. Passez-le dans OCR PDF pour ajouter une couche de texte, puis reconvertissez-le.
Comment les titres sont-ils détectés ?
D'après la taille de police. Un texte nettement plus grand que le corps devient un titre, et les plus grandes tailles reçoivent les niveaux les plus élevés. Si votre PDF est mis en forme de façon atypique, ajustez les dièses ensuite.
Quelle différence avec PDF en texte ?
PDF en texte fournit du texte brut sans balisage. PDF en Markdown ajoute les marques de titre, de liste et de mise en valeur pour conserver la structure.