PDF en Markdown — gratuit, dans votre navigateur, sans envoi | nopa

Texte et données

PDF en Markdown

Déposez un PDF et obtenez du Markdown avec titres, paragraphes et listes — pas une ligne par ligne imprimée. Convertissez-en plusieurs d’un coup et repartez avec un ZIP. Le fichier ne quitte pas ce navigateur.

Essayez maintenant — sans compte

Enregistrer et continuer dans le bureau

Téléchargez ou copiez votre résultat ici d'abord. Continuez sur le bureau pour Fichiers ou plus de fonctionnalités.

  • Notes simples avec gras et listes — enregistrées en local
  • Enregistrez dans Fichiers quand vous continuez sur le bureau
  • Tous les outils au même endroit — sans nouveaux onglets
Ouvrir le bureau gratuit

Après le téléchargement — continuez sur le bureau pour Fichiers ou l'app complète.

Ce que PDF en Markdown peut faire

Des paragraphes, pas des lignes imprimées

Un PDF n’a pas de paragraphes. Il a des glyphes à des coordonnées, et tout ce qu’un lecteur perçoit comme structure se déduit de leur position et de leur taille. Copiez depuis une liseuse de PDF et vous obtiendrez exactement cela : un saut de ligne dur là où la page a coupé, un tiret au milieu de chaque mot coupé en marge, et un numéro de page au milieu d’une phrase. Ce résultat est inutilisable dans un document et pire encore dans un prompt. Ici les lignes sont recomposées en paragraphes, les mots coupés sont recollés, et les en-têtes et pieds de page courants — le même titre quarante fois — sont écartés.

Les titres viennent du corps de la police

Rien dans un PDF ne dit « ceci est un titre ». Ce qu’il dit, c’est qu’une ligne est composée en 18 points au milieu d’un texte en 10 : elle devient donc un H1, celles en 13 deviennent des H3, et une ligne longue en corps légèrement plus grand reste un paragraphe — c’est le garde-fou qui empêche toute une introduction de devenir un titre. C’est une inférence, juste bien plus souvent que fausse, mais il vaut la peine de savoir que c’en est une, et non une structure que le fichier transportait.

Ce qu’il ne prétendra pas faire

Du texte et des titres, pas de mise en page : les articles sur deux colonnes sont lus comme du texte, et les figures, graphiques et encadrés ne sont pas reconstruits. Si le PDF est un scan, ses pages sont des images de lettres et il n’y a pas de texte à prendre : l’outil le dit au lieu de vous rendre un fichier vide. Le lire demanderait de l’OCR, soit 40 Mo de modèle et une tout autre promesse.

Apps associées

Questions

Mon PDF est-il envoyé quelque part ?

Non. Il est analysé dans votre navigateur, sur cet appareil. Le fichier n’est jamais envoyé à un serveur et nous ne le voyons pas.

Puis-je convertir plusieurs fichiers à la fois ?

Oui. Ajoutez-en autant que vous voulez : chacun devient son propre `.md`, et un bouton les emporte tous dans un ZIP.

Pourquoi mon PDF scanné ne donne-t-il rien ?

Parce qu’il n’a pas de couche de texte : les pages sont des images, il n’y a donc aucun caractère à lire. L’outil vous le dit plutôt que de renvoyer un fichier vide. Extraire du texte d’un scan demande de l’OCR, que nopa ne fait pas ici.

Les tableaux sont-ils convertis ?

Pas depuis un PDF. Un tableau dans un PDF, ce sont des traits et du texte à des coordonnées, sans rien qui le désigne comme tableau : ses cellules arrivent en texte. Les tableaux issus de fichiers `.docx`, eux, sont convertis en vrais tableaux Markdown.

Est-ce que ça marche hors ligne ?

Oui, une fois la page ouverte au moins une fois. La conversion est du code qui tourne dans votre navigateur : il n’y a rien à aller chercher.