Le Markdown, c’est du texte brut avec un peu de structure : une ligne qui commence par # est un titre, une ligne qui commence par un tiret est un élément de liste, et tout le reste est un paragraphe. C’est le format des applications de notes comme Obsidian et Notion, des fichiers README sur GitHub, de nombreux wikis et blogs, et c’est le format que les assistants IA lisent le mieux. PDF en Markdown transforme un PDF en texte propre et structuré de ce type, pour que vous puissiez conserver, rechercher, modifier et réutiliser le contenu du document.
L’outil lit chaque page et en déduit la structure. Un texte nettement plus grand que le corps de texte devient un titre, avec un, deux ou trois signes # selon sa taille : un titre de chapitre et un titre de section restent distincts. Les lignes qui commencent par une puce, un tiret ou un numéro deviennent une vraie liste. Les lignes coupées par la largeur de la page sont réunies en paragraphes entiers, et les mots coupés par un trait d’union en fin de ligne sont recollés.
Les en-têtes, pieds de page et numéros de page sont retirés par défaut, car dans une note ils ne font que gêner. L’outil repère le texte qui se répète en haut ou en bas de la plupart des pages, comme le titre d’un rapport ou « Page 3 sur 20 », et l’écarte. Désactivez Retirer en-têtes et numéros de page si vous voulez les garder. Vous pouvez convertir tout le PDF ou seulement quelques pages : touchez-les ou tapez une plage comme 5-12.
Une fois terminé, téléchargez le fichier .md ou appuyez sur Copier le texte et collez-le directement dans vos notes ou une conversation. Les caractères qui ont un sens en Markdown, comme les astérisques, sont échappés pour s’afficher tels quels. Tout fonctionne dans votre navigateur, sur cet appareil, le fichier n’est jamais envoyé et il n’y a rien à installer.
Certaines choses ne passent pas : les images sont omises, et les tableaux et pages en deux colonnes sortent en lignes de texte dans l’ordre de lecture, vérifiez donc ces passages. Un PDF scanné ne contient pas de texte à lire : passez-le d’abord dans OCR PDF. Pour du texte brut sans structure, PDF en texte est plus simple.