# Document en JSON structuré

> Exporte les blocs de texte d'un PDF avec les numéros de page et les zones de délimitation.

[Open tool](https://www.toolcabana.com/fr/document-to-json) · [PDF et documents](https://www.toolcabana.com/fr/category/pdf-and-documents)

Tool ID: document-to-json. Requested language: fr. Description language: fr. Complete guide translation: yes.

## Overview (en)

Document to structured JSON exports the text of a PDF as JSON, listing every page with its width and height and each text block with its text, x and y position, width and height. Blocks are sorted top to bottom and left to right. You can process up to 100 pages, and the file downloads as document.json.

## Supported tasks (fr)

Extrait la couche de texte existante du PDF dans l'ordre des coordonnées. Les documents numérisés nécessitent d'abord un OCR. Les colonnes et les mises en page complexes peuvent nécessiter des corrections manuelles ; le JSON conserve les numéros de page et les zones de délimitation.

## Steps (fr)

1. Choisissez un fichier source. Si l'outil accepte plusieurs fichiers, classez-les dans l'ordre souhaité.
2. Définissez le nombre maximal de pages.
3. Lancez la conversion du document en JSON structuré, vérifiez le résultat, puis utilisez les commandes de copie ou de téléchargement disponibles.

## Settings

- Nombre maximal de pages (fr; key: maxPages; type: number); minimum: 1; maximum: 100

## Limitations (fr)

Saisies d'images : jusqu'à 32 mégapixels, lots de 10 images maximum. Importations audio/vidéo : 50 MB ; transcription : 120 secondes. Vidéos modifiées : 20 secondes, 4 fps et 640 pixels de large. Traduction : anglais/espagnol, 30 000 caractères ; sous-titres : 200 répliques. Parole neuronale : 1 000 caractères en anglais. Le téléchargement des modèles et les besoins en mémoire varient selon l'appareil.

## Example input

```text
A useful tool makes everyday work easier. Review the results before sharing.
```

## Privacy and connections (fr)

Traite la source dans votre navigateur. La copie et le téléchargement sont des actions explicites ; la source n'est pas enregistrée dans l'historique du compte.

## Questions (fr)

### What does the JSON output of a PDF look like?

It is an object with a pages array. Each page has page, width, height and blocks, and each block has text, x, y, width and height, so you can locate every text run on the page.

### What units are the coordinates in the PDF JSON?

Positions and sizes use PDF points at a scale of 1, matching the page width and height in the same output. The y value is measured from the top of the page, so larger values sit lower down.

### Can I get JSON from a scanned PDF?

Only after OCR. The tool reads the existing text layer and reports that no text layer was found when pages are images. Make the PDF searchable with OCR first, then export it.

### Où ma saisie est-elle traitée ?

Traite la source dans votre navigateur. La copie et le téléchargement sont des actions explicites ; la source n'est pas enregistrée dans l'historique du compte.

### Quelles sont les limites de saisie ?

Saisies d'images : jusqu'à 32 mégapixels, lots de 10 images maximum. Importations audio/vidéo : 50 MB ; transcription : 120 secondes. Vidéos modifiées : 20 secondes, 4 fps et 640 pixels de large. Traduction : anglais/espagnol, 30 000 caractères ; sous-titres : 200 répliques. Parole neuronale : 1 000 caractères en anglais. Le téléchargement des modèles et les besoins en mémoire varient selon l'appareil.

## Related tools

- [PDF to Markdown](https://www.toolcabana.com/fr/pdf-to-markdown)
- [Table image to CSV](https://www.toolcabana.com/fr/table-image-to-csv)
- [Invoice field extractor](https://www.toolcabana.com/fr/invoice-extractor)
- [Receipt to spreadsheet](https://www.toolcabana.com/fr/receipt-extractor)
