Ваши файлы остаются на устройстве

Файлы обрабатываются в браузере и не загружаются на наши серверы. Сайт может скачивать движки и отправлять события использования или обратной связи без содержимого файлов.

Как мы обращаемся с данными →
← Все PDF-инструменты

PDF в Markdown

Создайте текстовую копию PDF с поиском в формате Markdown, сохранив группировку по страницам. Текст выгружается дословно; макет не восстанавливается.

Учебный пример: проверьте настройки операции перед запуском.

Документы остаются на устройстве. Загрузка движков и статистика не включают содержимое файлов.

Локальные лимиты: Максимальный размер файла: 10 MB

Файлы обрабатываются в вашем браузере. Они не загружаются на этот сайт.

Практическое руководство

Сохраните контекст страниц рядом с извлечённым текстом.

  1. Выберите PDF с имеющимся текстовым слоем.
  2. Экспортируйте в Markdown и просмотрите каждый раздел страницы.
  3. Используйте повторно только ту формулировку, которую сверили с исходным PDF.

Попробуйте этот пример

Преобразуйте в Markdown бриф клиента на три страницы с поиском. Убедитесь, что запрошенная дата и два пункта действий стоят под тем же заголовком страницы, что и в PDF.

До

  • PDF: Привет

После

  • Заголовок страницы + буквальный блок текста
Входные файлы и ожидаемый результат этой задачи. Наглядный пример.

Пример файла .md

## Page 1

    Привет из PDF, Пётр Иванов!

Выделяемый исходный текст: Привет из PDF.

Перед началом: Имеющийся текст выгружается дословно блоками кода; PDF не превращается в редактируемый макет.

Продолжить с исходным PDF
Результат

Экспортируйте встроенный текст как буквальные блоки кода Markdown, сгруппированные по страницам. Заголовки, таблицы, изображения и исходный макет не восстанавливаются. Страницы без текста помечаются; OCR нет. Ограничения: 10 МиБ на входе, 200 страниц, 4 МиБ на выходе.

Ограничения

Не более 10 МиБ на входе, 200 страниц и 4 МиБ текста на выходе. Для сканированных документов без текстового слоя выдаётся ошибка вместо ложного успешного извлечения. Порядок чтения, колонки и шрифты могут не совпадать с визуальным макетом. Это не OCR и не PDF в Word.

Пример

Экспортируйте выделяемый текст отчёта в .md. Заголовки страниц создаются; текст PDF остаётся буквальным внутри блоков кода и не превращается в исполняемый HTML или предполагаемые таблицы. Проверьте порядок чтения, прежде чем использовать текст повторно.