PDF en Markdown
Exporte le texte existant d'un PDF en Markdown avec libellés de page.
PDF en Markdown
Drop your files here
or choose files from your device
Comment utiliser PDF en Markdown
PDF to Markdown exports the existing text layer of a PDF as Markdown, with a Page heading for each page. Text is read in approximate top-to-bottom, left-to-right order, and you can limit processing to between 1 and 100 pages, with 20 as the default. The result can be copied or downloaded as document.md.
- Choisissez un fichier source. Si l'outil accepte plusieurs fichiers, classez-les dans l'ordre souhaité.
- Définissez le nombre maximal de pages.
- Lancez la conversion PDF en Markdown, vérifiez le résultat, puis utilisez les commandes de copie ou de téléchargement disponibles.
Ce que cet outil prend en charge
Extrait la couche de texte existante du PDF dans l'ordre des coordonnées. Les documents numérisés nécessitent d'abord un OCR. Les colonnes et les mises en page complexes peuvent nécessiter des corrections manuelles ; le JSON conserve les numéros de page et les zones de délimitation.
- Nombre maximal de pages
- Range: 1 to 100
Limites et traitement
Saisies d'images : jusqu'à 32 mégapixels, lots de 10 images maximum. Importations audio/vidéo : 50 MB ; transcription : 120 secondes. Vidéos modifiées : 20 secondes, 4 fps et 640 pixels de large. Traduction : anglais/espagnol, 30 000 caractères ; sous-titres : 200 répliques. Parole neuronale : 1 000 caractères en anglais. Le téléchargement des modèles et les besoins en mémoire varient selon l'appareil.
Exemple de source
A useful tool makes everyday work easier. Review the results before sharing.
Questions fréquentes
Does PDF to Markdown keep headings, bold and tables?
No. It outputs the text of each page under a heading such as Page 1, with each text item on its own line. Formatting like bold, lists and table structure is not reconstructed, so expect to edit the result.
Why does PDF to Markdown say no text layer was found?
The PDF contains scanned images instead of text. Run it through PDF OCR first to add a text layer, then convert the searchable PDF to Markdown.
How do I convert more than 20 pages to Markdown?
Raise the Maximum pages setting, which defaults to 20 and goes up to 100. Pages beyond the limit are skipped, so set it to cover the full document.
Où ma saisie est-elle traitée ?
Traite la source dans votre navigateur. La copie et le téléchargement sont des actions explicites ; la source n'est pas enregistrée dans l'historique du compte.
Quelles sont les limites de saisie ?
Saisies d'images : jusqu'à 32 mégapixels, lots de 10 images maximum. Importations audio/vidéo : 50 MB ; transcription : 120 secondes. Vidéos modifiées : 20 secondes, 4 fps et 640 pixels de large. Traduction : anglais/espagnol, 30 000 caractères ; sous-titres : 200 répliques. Parole neuronale : 1 000 caractères en anglais. Le téléchargement des modèles et les besoins en mémoire varient selon l'appareil.