Ispeziona ordine di lettura PDF
Esamina i blocchi di testo PDF ordinati per coordinate e i limiti delle pagine.
Ispeziona ordine di lettura PDF
Drop your files here
or choose files from your device
Come usare Ispeziona ordine di lettura PDF
PDF reading order inspector shows how the text blocks on each PDF page are ordered once sorted by position, along with each page's width and height. Blocks whose vertical positions are within 3 points count as one line and are read left to right. The JSON report covers 1 to 100 pages and helps diagnose jumbled text extraction.
- Scegli un file di origine. Se lo strumento accetta più file, disponili nell'ordine desiderato.
- Imposta il numero massimo di pagine.
- Esegui Ispeziona ordine di lettura PDF, esamina il risultato, poi usa i controlli disponibili per copiare o scaricare.
Cosa supporta questo strumento
Estrae il livello di testo PDF esistente in ordine di coordinate. Le scansioni richiedono prima l'OCR. Colonne e layout complessi possono richiedere correzioni manuali; JSON conserva numeri di pagina e riquadri di delimitazione.
- Numero massimo di pagine
- Range: 1 to 100
Limiti ed elaborazione
Input immagine: fino a 32 megapixel, batch fino a 10 immagini. Caricamenti audio/video: 50 MB; trascrizione: 120 secondi. Video modificati: 20 secondi, 4 fps e 640 pixel di larghezza. Traduzione: inglese/spagnolo, 30.000 caratteri; sottotitoli: 200 cue. Sintesi vocale neurale: 1.000 caratteri inglesi. Download dei modelli e requisiti di memoria variano in base al dispositivo.
Origine di esempio
A useful tool makes everyday work easier. Review the results before sharing.
Domande frequenti
Why is the text from my PDF extracted in the wrong order?
PDFs store text as positioned fragments, not as a reading sequence. This inspector lists each block with its coordinates in sorted order, so you can see where columns, sidebars or headers interleave with the main text.
How does the inspector decide the reading order?
Blocks are sorted by their distance from the top of the page. Blocks less than 3 points apart vertically are treated as the same line and ordered left to right. Multi-column layouts may still need manual correction.
Can I check the reading order of a scanned PDF?
Not until it has a text layer. Scanned pages contain only images, so the tool reports that no text layer was found. Run OCR on the PDF first, then inspect the result.
Dove viene elaborato il mio input?
Elabora i dati di origine nel tuo browser. Copia e download sono azioni esplicite; l'origine non viene salvata nella cronologia dell'account.
Quali sono i limiti di input?
Input immagine: fino a 32 megapixel, batch fino a 10 immagini. Caricamenti audio/video: 50 MB; trascrizione: 120 secondi. Video modificati: 20 secondi, 4 fps e 640 pixel di larghezza. Traduzione: inglese/spagnolo, 30.000 caratteri; sottotitoli: 200 cue. Sintesi vocale neurale: 1.000 caratteri inglesi. Download dei modelli e requisiti di memoria variano in base al dispositivo.