Inspector de orden de lectura PDF
Inspecciona bloques de texto PDF ordenados por coordenadas y límites de página.
Inspector de orden de lectura PDF
Drop your files here
or choose files from your device
Cómo usar Inspector de orden de lectura PDF
PDF reading order inspector shows how the text blocks on each PDF page are ordered once sorted by position, along with each page's width and height. Blocks whose vertical positions are within 3 points count as one line and are read left to right. The JSON report covers 1 to 100 pages and helps diagnose jumbled text extraction.
- Elige un archivo de origen. Si la herramienta acepta varios archivos, ordénalos como quieras.
- Configura las páginas máximas.
- Ejecuta el inspector de orden de lectura PDF, revisa la salida y usa los controles disponibles para copiar o descargar.
Qué admite esta herramienta
Extrae la capa de texto existente del PDF en orden de coordenadas. Los escaneos requieren OCR primero. Las columnas y diseños complejos pueden necesitar correcciones manuales; JSON conserva números de página y recuadros.
- Páginas máximas
- Range: 1 to 100
Límites y procesamiento
Entradas de imagen: hasta 32 megapíxeles, lotes de hasta 10 imágenes. Subidas de audio/vídeo: 50 MB; transcripción: 120 segundos. Vídeos editados: 20 segundos, 4 fps y 640 píxeles de ancho. Traducción: inglés/español, 30,000 caracteres; subtítulos: 200 entradas. Voz neuronal: 1,000 caracteres en inglés. Las descargas de modelos y los requisitos de memoria varían según el dispositivo.
Fuente de ejemplo
A useful tool makes everyday work easier. Review the results before sharing.
Preguntas frecuentes
Why is the text from my PDF extracted in the wrong order?
PDFs store text as positioned fragments, not as a reading sequence. This inspector lists each block with its coordinates in sorted order, so you can see where columns, sidebars or headers interleave with the main text.
How does the inspector decide the reading order?
Blocks are sorted by their distance from the top of the page. Blocks less than 3 points apart vertically are treated as the same line and ordered left to right. Multi-column layouts may still need manual correction.
Can I check the reading order of a scanned PDF?
Not until it has a text layer. Scanned pages contain only images, so the tool reports that no text layer was found. Run OCR on the PDF first, then inspect the result.
¿Dónde se procesa mi entrada?
Procesa la fuente en tu navegador. Copiar y descargar son acciones explícitas; la fuente no se guarda en el historial de la cuenta.
¿Cuáles son los límites de entrada?
Entradas de imagen: hasta 32 megapíxeles, lotes de hasta 10 imágenes. Subidas de audio/vídeo: 50 MB; transcripción: 120 segundos. Vídeos editados: 20 segundos, 4 fps y 640 píxeles de ancho. Traducción: inglés/español, 30,000 caracteres; subtítulos: 200 entradas. Voz neuronal: 1,000 caracteres en inglés. Las descargas de modelos y los requisitos de memoria varían según el dispositivo.