Gratuit – OCR inclus

Convertir un PDF en Markdown gratuitement, même scanné

Face à un PDF scanné, la plupart des convertisseurs abandonnent. Celui-ci le détecte et lance l'OCR : rapports, contrats et formulaires ressortent en vrai Markdown, tableaux, titres et formules compris.

Déposez un PDF ici ou cliquez pour parcourir

Jusqu'à 10 Mo et 30 pages · connectez-vous pour relever la limite

Convertir un PDF en Markdown, c'est quoi ?

Convertir un PDF en Markdown consiste à extraire le texte et la structure enfermés dans le PDF pour les réécrire en texte brut : les titres deviennent des lignes à dièse, les tableaux des tableaux à barres verticales, et les images suivent. La difficulté : une bonne partie des PDF sont des scans dépourvus de couche texte, où l'extraction ne renvoie rien et où seul l'OCR peut aider. Cet outil détecte de quel type il s'agit. Une fois en Markdown, vous pouvez continuer vers Word (.docx), PDF ou HTML.

Trois façons de passer du PDF au Markdown

1

Convertisseurs en ligne – vous déposez un PDF et le Markdown arrive en quelques secondes. Le meilleur choix pour préserver la structure sans rien installer, et la seule voie praticable pour les fichiers scannés qui réclament de l'OCR.

2

Ligne de commande – des bibliothèques comme pymupdf4llm ou marker travaillent en local et se scriptent pour du traitement par lots. Adapté aux développeurs qui traitent beaucoup de fichiers, au prix de l'installation, du réglage, et sans OCR d'origine.

3

Copier-coller – sélectionner le texte dans un lecteur PDF et le coller dans un éditeur. Acceptable pour un paragraphe, mais titres, tableaux et mises en page multicolonnes s'effondrent, et les pages scannées ne donnent rien du tout.

Example Output

À quoi ressemble vraiment le résultat

Quatre choses que ce convertisseur réussit et qu'un copier-coller ne fera jamais.

Les titres et la structure tiennent

Niveaux de titre, listes imbriquées et sauts de paragraphe sont reconstruits en vrai Markdown : le document est prêt à être modifié ou publié, au lieu d'un bloc de texte uniforme.

Une présentation de projet en PDF convertie en Markdown structuré, avec niveaux de titre et listes imbriquées conservés

Les tableaux deviennent des tableaux Markdown

Les tableaux à bordures sont reconstruits en tableaux à barres verticales, colonnes alignées : rapports, spécifications et comparatifs restent réutilisables au lieu de se disperser en texte.

Un tableau de ventes issu d'un PDF, converti en tableau Markdown à colonnes alignées

Les pages scannées lues par OCR

Quand un PDF n'a pas de couche texte, l'OCR lit les images de page à la place : scans, documents photographiés et formulaires, dans plus de 170 langues, chinois, japonais et coréen compris.

Un rapport papier scanné, reconnu par OCR et converti en Markdown modifiable

Les formules reviennent en LaTeX

Passez une feuille de formules à l'OCR et les mathématiques reviennent en vrai LaTeX entre blocs $$ : fractions, racines, intégrales et exposants gardent leur structure, prêts pour Obsidian, Notion ou un article. (Dans un PDF numérique, les équations sont stockées en glyphes épars ; l'OCR est donc la voie qui les récupère correctement.)

Une feuille de formules en PDF convertie par OCR en Markdown, avec les équations LaTeX entre blocs de symboles dollar

Guide complet : convertir un PDF en Markdown

Pourquoi certains PDF passent sans accroc et d'autres réclament de l'OCR – et comment obtenir le résultat le plus propre dans les deux cas.

PDF numériques et PDF scannés

PDF numérique – avec couche texte

Produit par un logiciel (Word, LaTeX, la boîte d'impression du navigateur). Les caractères sont réellement dans le fichier, l'extraction est rapide et quasiment sans perte. C'est le cas d'environ 97 % des documents du quotidien, et cela prend quelques secondes.

PDF scanné – de simples images de pages

Sorti d'un photocopieur, d'un téléphone ou d'un fax. Il n'y a aucun texte à extraire : sélectionner et copier ne donne rien. Seul l'OCR sait les lire, et c'est précisément pour cela que la plupart des convertisseurs gratuits renvoient discrètement un fichier vide.

PDF numérique et PDF scanné comparés côte à côte, indiquant lequel nécessite l'OCR

Ce qui passe bien

Documents sur une colonne

Rapports, documentations, articles et contrats passent proprement : les titres gardent leur niveau et les listes leur imbrication.

Tableaux à bordures

Les tableaux dont les filets sont visibles sont reconstruits en tableaux Markdown qui s'affichent correctement partout.

Images intégrées

Les images contenues dans le PDF sont extraites et référencées dans le texte, pour que rien ne disparaisse du document.

Scans et formulaires

Les pages sans couche texte sont reconnues par OCR, y compris les mises en page multilingues et les formulaires remplis.

Obtenir le résultat le plus propre

  1. 1.

    Laissez d'abord la détection trancher

    Déposez le fichier tel quel. L'outil vérifie la présence d'une couche texte et ne propose l'OCR que si le fichier en a réellement besoin : vous ne payez jamais pour un OCR inutile.

  2. 2.

    Forcez l'OCR si le résultat est illisible

    Les vieux scans traînent parfois une mauvaise couche OCR datant d'années passées. Aucune détection n'y résiste, c'est pourquoi la page de résultat garde un bouton « lancer l'OCR à la place » – à utiliser dès que le texte ressort déformé.

  3. 3.

    Relisez les pages multicolonnes

    Encadrés, notes de bas de page et articles sur deux colonnes sont lus dans l'ordre où le PDF les stocke, qui n'est pas toujours l'ordre de lecture. Parcourez ces passages avant de vous y fier.

  4. 4.

    Découpez les documents très longs

    Les limites de pages existent parce que la durée croît avec la longueur. Pour un livre ou un dossier, convertissez chapitre par chapitre – la relecture y gagne aussi.

Key Capabilities

Ce que ce convertisseur PDF en Markdown sait faire

Conçu pour les documents sur lesquels vous comptez continuer à travailler, pas seulement à lire.

OCR pour les PDF scannés

Les pages sans couche texte sont reconnues à partir des images : scans, photos et formulaires, dans plus de 170 langues, chinois, japonais et coréen compris.

Structure préservée

Niveaux de titre, listes imbriquées et citations reviennent en vrai Markdown, pas en bouillie de paragraphes aplatis.

Tableaux à barres verticales

Les tableaux à bordures sont reconstruits avec des colonnes alignées et s'affichent correctement dans n'importe quel éditeur Markdown, wiki ou dépôt.

Formules et images

Les images intégrées suivent le document, et l'OCR récupère la notation mathématique des pages techniques scannées.

Retour vers Word

Envoyez le Markdown au convertisseur Word en un clic et téléchargez un .docx – le document modifiable que le PDF vous refusait.

Supprimé après conversion

Votre fichier transite par une connexion chiffrée, ne sert qu'à cette conversion, puis il est supprimé. Rien n'est conservé ni analysé.

Use Cases

Qui convertit des PDF en Markdown

Cinq usages quotidiens de cet outil – l'un d'eux ressemble sans doute au vôtre.

Développeuses et développeurs

Sortez références d'API, fiches techniques et manuels constructeur du PDF pour les amener dans votre site de doc, votre README ou votre wiki – du Markdown qui entre directement dans le gestionnaire de versions.

Recherche

Transformez les articles en notes Markdown pour Obsidian, Notion ou Zotero. Les anciens numéros scannés passent par l'OCR, et les équations reviennent en LaTeX plutôt qu'en caractères cassés.

Rédaction et édition

Récupérez un texte propre et modifiable depuis des rapports clients, des briefs et des dossiers de presse sans retaper une page – puis continuez dans l'éditeur Markdown que vous utilisez déjà.

Étudiantes et étudiants

Convertissez diapositives de cours, polycopiés et notes photographiées en Markdown que vous pouvez chercher, résumer et réorganiser avant un examen. Les pages photographiées passent par l'OCR.

Chaînes IA et RAG

Le Markdown est ce que les modèles de langage lisent le mieux. Convertissez les PDF sources avant d'alimenter une base de connaissances, un jeu d'affinage ou une invite – structure préservée, sans le bruit du PDF.

Simple Process

Comment convertir un PDF en Markdown

Trois étapes, et aucun compte nécessaire pour commencer.

01

Déposez votre PDF

Glissez le fichier ou parcourez vos dossiers. Taille et nombre de pages sont vérifiés avant tout traitement, pour ne jamais attendre sur un fichier qui sera refusé.

02

Numérique ou scanné – détecté pour vous

Les documents avec couche texte se convertissent aussitôt. Si le fichier s'avère être un scan, on vous demande avant de lancer l'OCR : jamais de facturation silencieuse.

03

Copiez ou téléchargez votre Markdown

Relisez le résultat, puis copiez-le dans le presse-papiers ou téléchargez le fichier .md. Si un scan ressort illisible, un bouton le repasse par l'OCR.

FAQ

Questions fréquentes sur PDF vers Markdown

Limites, OCR, qualité et confidentialité – réponses sans détour.

1

Ce convertisseur PDF en Markdown est-il gratuit ?

Oui. Chaque visiteur dispose de conversions gratuites quotidiennes, et créer un compte relève les limites de taille et de pages. L'OCR des fichiers scannés consomme un crédit par conversion, car il repose sur un moteur de reconnaissance payant.

2

Fonctionne-t-il avec les PDF scannés ?

Oui – et c'est précisément ce qui le distingue de la plupart des convertisseurs gratuits. L'outil vérifie si votre PDF possède une vraie couche texte ; sinon, il propose l'OCR, qui lit les caractères depuis les images de page.

3

Quelles sont les limites de taille et de pages ?

Sans compte, vous convertissez des PDF jusqu'à 10 Mo et 30 pages. La connexion porte cela à 30 Mo et 150 pages et débloque l'OCR pour les fichiers numérisés, tandis que les abonnés vont jusqu'à 50 Mo et 300 pages.

4

Quelles langues l'OCR reconnaît-il ?

Plus de 170, dont le chinois, le japonais, le coréen, l'arabe et les grandes langues européennes. Les pages mêlant plusieurs langues passent en une seule fois – inutile de choisir une langue au préalable.

5

Les tableaux sont-ils préservés ?

Les tableaux à bordures deviennent des tableaux Markdown de façon fiable. Les tableaux sans filets et les cellules très fusionnées sont le point faible de tout analyseur PDF : relisez ces passages avant de vous y fier.

6

Que deviennent les images du PDF ?

Les images intégrées sont extraites et référencées dans le Markdown, elles suivent donc le document. Pour un PDF très lourd en images, elles peuvent être écartées afin de garder un fichier exploitable – vous en êtes averti.

7

Les formules mathématiques sont-elles gérées ?

Dans les documents scannés, l'OCR restitue les formules en notation LaTeX. Dans un PDF numérique, la structure des équations est stockée en glyphes positionnés plutôt qu'en balisage : les formules complexes arrivent donc en simples caractères – lancer l'OCR sur ces pages donne souvent un meilleur résultat.

8

Pourquoi mon résultat semble-t-il désordonné ?

Les mises en page multicolonnes, les encadrés et les notes de bas de page sont lus dans l'ordre où le PDF les stocke, qui ne correspond pas toujours à la lecture humaine. Les documents sur une seule colonne donnent un résultat bien plus propre. Si le texte lui-même paraît déformé, le fichier traîne sans doute une mauvaise couche OCR : utilisez « lancer l'OCR à la place » sur la page de résultat.

9

Mon PDF est-il en sécurité ?

Oui. Votre fichier transite par une connexion chiffrée, ne sert qu'à la conversion demandée, et il est retiré du stockage une fois le traitement terminé. Nous ne lisons pas vos documents, ne nous en servons jamais pour entraîner des modèles, et nous ne les vendons ni ne les publions. Notre politique de confidentialité détaille précisément le traitement des fichiers envoyés.

10

La conversion d'un PDF consomme-t-elle des crédits ?

Une fois connecté, chaque conversion consomme des crédits : 1 crédit par tranche de 30 pages, toute page entamée comptant pour un crédit entier — la même règle s'applique à l'OCR des fichiers numérisés. Les abonnés convertissent sans limite.

Faites de ce PDF quelque chose de modifiable

Scanné ou numérique – d'abord en Markdown, puis vers Word, PDF ou HTML.

Démarrage immédiat · Conversions gratuites chaque jour · PDF scannés pris en charge par OCR