Inspetor de ordem de leitura de PDF
Inspecione blocos de texto do PDF ordenados por coordenadas e os limites das páginas.
Inspetor de ordem de leitura de PDF
Drop your files here
or choose files from your device
Como usar Inspetor de ordem de leitura de PDF
PDF reading order inspector shows how the text blocks on each PDF page are ordered once sorted by position, along with each page's width and height. Blocks whose vertical positions are within 3 points count as one line and are read left to right. The JSON report covers 1 to 100 pages and helps diagnose jumbled text extraction.
- Escolha um arquivo de origem. Se a ferramenta aceitar vários arquivos, ordene-os como quiser.
- Defina o máximo de páginas.
- Execute o inspetor de ordem de leitura de PDF, revise a saída e use os controles disponíveis para copiar ou baixar.
O que esta ferramenta suporta
Extrai a camada de texto existente do PDF na ordem das coordenadas. Digitalizações exigem OCR primeiro. Colunas e layouts complexos podem precisar de correções manuais; o JSON mantém os números de página e as caixas delimitadoras.
- Máximo de páginas
- Range: 1 to 100
Limites e processamento
Entradas de imagem: até 32 megapixels, lotes de até 10 imagens. Uploads de áudio/vídeo: 50 MB; transcrição: 120 segundos. Vídeos editados: 20 segundos, 4 fps e 640 pixels de largura. Tradução: inglês/espanhol, 30,000 caracteres; legendas: 200 entradas. Voz neural: 1,000 caracteres em inglês. Os downloads de modelos e os requisitos de memória variam por dispositivo.
Fonte de exemplo
A useful tool makes everyday work easier. Review the results before sharing.
Perguntas frequentes
Why is the text from my PDF extracted in the wrong order?
PDFs store text as positioned fragments, not as a reading sequence. This inspector lists each block with its coordinates in sorted order, so you can see where columns, sidebars or headers interleave with the main text.
How does the inspector decide the reading order?
Blocks are sorted by their distance from the top of the page. Blocks less than 3 points apart vertically are treated as the same line and ordered left to right. Multi-column layouts may still need manual correction.
Can I check the reading order of a scanned PDF?
Not until it has a text layer. Scanned pages contain only images, so the tool reports that no text layer was found. Run OCR on the PDF first, then inspect the result.
Onde minha entrada é processada?
Processa a fonte no seu navegador. Copiar e baixar são ações explícitas; a fonte não é salva no histórico da conta.
Quais são os limites de entrada?
Entradas de imagem: até 32 megapixels, lotes de até 10 imagens. Uploads de áudio/vídeo: 50 MB; transcrição: 120 segundos. Vídeos editados: 20 segundos, 4 fps e 640 pixels de largura. Tradução: inglês/espanhol, 30,000 caracteres; legendas: 200 entradas. Voz neural: 1,000 caracteres em inglês. Os downloads de modelos e os requisitos de memória variam por dispositivo.