Tradutor de documentos digitalizados
Traduza o texto extraído de PDF para Markdown.
Tradutor de documentos digitalizados
Drop your files here
or choose files from your device
Como usar Tradutor de documentos digitalizados
Translate scanned document extracts the text layer from a PDF and translates it between English and Spanish with Marian models that run in your browser after a first download. It processes 1 to 30 pages, 10 by default, and up to 30,000 characters per run. The translation downloads as Markdown with a Page label for each page.
- Escolha um arquivo de origem. Se a ferramenta aceitar vários arquivos, ordene-os como quiser.
- Defina o código do idioma de origem, o código do idioma de destino e o máximo de páginas.
- Execute o tradutor de documentos digitalizados, revise a saída e use os controles disponíveis para copiar ou baixar.
O que esta ferramenta suporta
A tradução inglês ↔ espanhol usa modelos Marian do navegador, baixados na primeira execução. A tradução de documentos exporta o texto extraído em Markdown e não reconstrói o layout das páginas.
- Código do idioma de origem
- Set this value for your task.
- Código do idioma de destino
- Set this value for your task.
- Máximo de páginas
- Range: 1 to 30
Limites e processamento
Entradas de imagem: até 32 megapixels, lotes de até 10 imagens. Uploads de áudio/vídeo: 50 MB; transcrição: 120 segundos. Vídeos editados: 20 segundos, 4 fps e 640 pixels de largura. Tradução: inglês/espanhol, 30,000 caracteres; legendas: 200 entradas. Voz neural: 1,000 caracteres em inglês. Os downloads de modelos e os requisitos de memória variam por dispositivo.
Fonte de exemplo
A useful tool makes everyday work easier. Review the results before sharing.
Perguntas frequentes
Which languages can the document translator handle?
Only English to Spanish and Spanish to English. Set the source and target codes to en and es in either order; any other combination is rejected with an error.
Will the translated document keep its original layout?
No. The tool extracts the text, translates it and exports Markdown labeled by page. Images, columns, fonts and page design are not rebuilt, so the result is a text draft to review.
Can I translate a scanned PDF that has no text layer?
Not directly. The tool reads existing PDF text and reports when no text layer is found. Run PDF OCR first to make the scan searchable, then translate the resulting file.
Onde minha entrada é processada?
Os arquivos e o texto de origem permanecem neste navegador. A primeira execução baixa modelos públicos do Hugging Face e recursos locais do ambiente de execução a partir do site. Os modelos podem ficar no cache do navegador. Não é preciso enviar a fonte ao Vercel, Supabase nem a um serviço de conversão.
Quais são os limites de entrada?
Entradas de imagem: até 32 megapixels, lotes de até 10 imagens. Uploads de áudio/vídeo: 50 MB; transcrição: 120 segundos. Vídeos editados: 20 segundos, 4 fps e 640 pixels de largura. Tradução: inglês/espanhol, 30,000 caracteres; legendas: 200 entradas. Voz neural: 1,000 caracteres em inglês. Os downloads de modelos e os requisitos de memória variam por dispositivo.