Texte et données
PDF en Markdown
Déposez un PDF et obtenez du Markdown avec titres, paragraphes et listes — pas une ligne par ligne imprimée. Convertissez-en plusieurs d’un coup et repartez avec un ZIP. Le fichier ne quitte pas ce navigateur.
Enregistrer et continuer dans le bureau
Téléchargez ou copiez votre résultat ici d'abord. Continuez sur le bureau pour Fichiers ou plus de fonctionnalités.
- Notes simples avec gras et listes — enregistrées en local
- Enregistrez dans Fichiers quand vous continuez sur le bureau
- Tous les outils au même endroit — sans nouveaux onglets
Après le téléchargement — continuez sur le bureau pour Fichiers ou l'app complète.
Ce que PDF en Markdown peut faire
Des paragraphes, pas des lignes imprimées
Un PDF n’a pas de paragraphes. Il a des glyphes à des coordonnées, et tout ce qu’un lecteur perçoit comme structure se déduit de leur position et de leur taille. Copiez depuis une liseuse de PDF et vous obtiendrez exactement cela : un saut de ligne dur là où la page a coupé, un tiret au milieu de chaque mot coupé en marge, et un numéro de page au milieu d’une phrase. Ce résultat est inutilisable dans un document et pire encore dans un prompt. Ici les lignes sont recomposées en paragraphes, les mots coupés sont recollés, et les en-têtes et pieds de page courants — le même titre quarante fois — sont écartés.
Les titres viennent du corps de la police
Rien dans un PDF ne dit « ceci est un titre ». Ce qu’il dit, c’est qu’une ligne est composée en 18 points au milieu d’un texte en 10 : elle devient donc un H1, celles en 13 deviennent des H3, et une ligne longue en corps légèrement plus grand reste un paragraphe — c’est le garde-fou qui empêche toute une introduction de devenir un titre. C’est une inférence, juste bien plus souvent que fausse, mais il vaut la peine de savoir que c’en est une, et non une structure que le fichier transportait.
Ce qu’il ne prétendra pas faire
Du texte et des titres, pas de mise en page : les articles sur deux colonnes sont lus comme du texte, et les figures, graphiques et encadrés ne sont pas reconstruits. Si le PDF est un scan, ses pages sont des images de lettres et il n’y a pas de texte à prendre : l’outil le dit au lieu de vous rendre un fichier vide. Le lire demanderait de l’OCR, soit 40 Mo de modèle et une tout autre promesse.
Apps associées
Texte et données
Word en Markdown
Déposez un .docx et obtenez du Markdown qui conserve les titres…
Fusionner des fichiers PDF
Importez deux PDF ou plus, réorganisez l'ordre et téléchargez un seul…
Diviser un fichier PDF
Transformez un PDF en plusieurs PDF plus petits — chaque page seule…
Texte et données
Supprimer les caractères masqués
Collez le texte et la partie invisible apparaît : espaces de largeur…
Texte et données
Écrire une note
Écrivez du texte, mettez en forme avec gras et listes — téléchargez ou…
Questions
Mon PDF est-il envoyé quelque part ?
Non. Il est analysé dans votre navigateur, sur cet appareil. Le fichier n’est jamais envoyé à un serveur et nous ne le voyons pas.
Puis-je convertir plusieurs fichiers à la fois ?
Oui. Ajoutez-en autant que vous voulez : chacun devient son propre `.md`, et un bouton les emporte tous dans un ZIP.
Pourquoi mon PDF scanné ne donne-t-il rien ?
Parce qu’il n’a pas de couche de texte : les pages sont des images, il n’y a donc aucun caractère à lire. L’outil vous le dit plutôt que de renvoyer un fichier vide. Extraire du texte d’un scan demande de l’OCR, que nopa ne fait pas ici.
Les tableaux sont-ils convertis ?
Pas depuis un PDF. Un tableau dans un PDF, ce sont des traits et du texte à des coordonnées, sans rien qui le désigne comme tableau : ses cellules arrivent en texte. Les tableaux issus de fichiers `.docx`, eux, sont convertis en vrais tableaux Markdown.
Est-ce que ça marche hors ligne ?
Oui, une fois la page ouverte au moins une fois. La conversion est du code qui tourne dans votre navigateur : il n’y a rien à aller chercher.