Структура восстановлена, а не текст свален
Большинство инструментов «PDF в Markdown» выдают стену текста с решётками на случайных строках. Этот анализирует реальную типографику документа — размеры шрифтов, начертания, интервалы, геометрию таблиц — и восстанавливает настоящую структуру: уровни заголовков, маркированные и нумерованные списки, полноценные таблицы Markdown. Движок написан на Rust и скомпилирован в WebAssembly, так что документ на сотню страниц конвертируется за секунды — целиком в вашем браузере.
Это делает его идеальным мостом ко всему, что говорит на Markdown: ИИ-ассистенты рассуждают над структурированным текстом куда лучше, чем над сырым PDF, а ещё есть приложения для заметок вроде Obsidian, вики и генераторы статических сайтов. И он честен насчёт пределов: страницы-сканы без текстового слоя сообщаются по номерам, а не пропускаются молча — им нужен OCR, который ни один конвертер текстового слоя честно не заменит.