ToolCabana

PDF в Markdown

Экспортирует существующий текст PDF в Markdown с пометкой страниц.

Favorites are saved in this browser. Find them in My favorites.

PDF в Markdown

Your input stays in this browser unless stated otherwise
Clear your input, files and result, and restore the default settings.

Drop your files here

or choose files from your device

Как использовать PDF в Markdown

PDF to Markdown exports the existing text layer of a PDF as Markdown, with a Page heading for each page. Text is read in approximate top-to-bottom, left-to-right order, and you can limit processing to between 1 and 100 pages, with 20 as the default. The result can be copied or downloaded as document.md.

  1. Выберите исходный файл. Если инструмент принимает несколько файлов, расположите их в нужном порядке.
  2. Укажите максимальное число страниц.
  3. Запустите «PDF в Markdown», просмотрите результат и используйте доступные элементы копирования или скачивания.

Что поддерживает этот инструмент

Извлекает существующий текстовый слой PDF в порядке координат. Для сканов сначала требуется OCR. Столбцы и сложные макеты могут потребовать ручной правки; JSON сохраняет номера страниц и ограничивающие рамки.

Максимум страниц
Range: 1 to 100

Ограничения и обработка

Изображения на входе: до 32 мегапикселей, пакеты до 10 изображений. Загрузки аудио и видео: 50 МБ; транскрипция: 120 секунд. Отредактированные видео: 20 секунд, 4 кадра/с и 640 пикселей в ширину. Перевод: английский/испанский, 30 000 символов; субтитры: 200 реплик. Нейросинтез речи: 1 000 символов английского текста. Загрузки моделей и требования к памяти зависят от устройства.

Пример исходных данных
A useful tool makes everyday work easier. Review the results before sharing.

Частые вопросы

Does PDF to Markdown keep headings, bold and tables?

No. It outputs the text of each page under a heading such as Page 1, with each text item on its own line. Formatting like bold, lists and table structure is not reconstructed, so expect to edit the result.

Why does PDF to Markdown say no text layer was found?

The PDF contains scanned images instead of text. Run it through PDF OCR first to add a text layer, then convert the searchable PDF to Markdown.

How do I convert more than 20 pages to Markdown?

Raise the Maximum pages setting, which defaults to 20 and goes up to 100. Pages beyond the limit are skipped, so set it to cover the full document.

Где обрабатываются мои данные?

Обрабатывает исходные данные в вашем браузере. Копирование и скачивание выполняются только по вашему действию; исходные данные не сохраняются в истории учётной записи.

Каковы ограничения входных данных?

Изображения на входе: до 32 мегапикселей, пакеты до 10 изображений. Загрузки аудио и видео: 50 МБ; транскрипция: 120 секунд. Отредактированные видео: 20 секунд, 4 кадра/с и 640 пикселей в ширину. Перевод: английский/испанский, 30 000 символов; субтитры: 200 реплик. Нейросинтез речи: 1 000 символов английского текста. Загрузки моделей и требования к памяти зависят от устройства.