PDF в Markdown

Чистый текст с заголовками и списками — для заметок и нейросетей.

Наоборот: Markdown в PDF

Markdown стал языком, на котором пишут заметки в Obsidian, документацию на GitHub и промпты для нейросетей. PDF же — формат для печати: текст в нём разложен по координатам, а не по смыслу. Этот конвертер собирает смысл обратно.

Заголовки распознаются по кеглю — тем же способом, что в нашем инструменте оглавления: основной текст определяется как кегль, которым набрано больше всего знаков, всё заметно крупнее становится #, ## или ###. Маркированные списки превращаются в дефисы, нумерованные сохраняют свои номера, жирный и курсив помечаются звёздочками. Слова, перенесённые со строки на строку через дефис, склеиваются обратно.

Отдельный частый сценарий — подготовка документа для языковой модели: нейросети понимают Markdown заметно лучше, чем сырой текст из PDF с обрывками строк. Файл на выходе — обычный .md в UTF-8, он откроется в любом редакторе.

Чего инструмент не обещает: сложные таблицы превращаются в строки текста, а не в Markdown-таблицы, и картинки в .md не переносятся. Для точной копии страницы со всеми картинками есть конвертер PDF в HTML.

Как это работает

  1. 1

    Загрузите PDF

    Перетащите файл или выберите его на устройстве.

  2. 2

    Дождитесь разбора

    Обычно несколько секунд: заголовки, списки и абзацы собираются автоматически.

  3. 3

    Скачайте .md

    Готовый файл открывается в Obsidian, VS Code и любом текстовом редакторе.

  4. 4

    Удаление через час

    Загруженный файл и результат удаляются с наших серверов в течение часа.

Частые вопросы

Заметки, база знаний, документация, промпты для нейросетей. Языковые модели разбирают Markdown с заголовками и списками заметно лучше, чем сырой текст, выдранный из PDF.

Похожие инструменты

Гайды и инструкции