PDF в текст и Markdown — онлайн и бесплатно
Перетащите PDF — получите текст и Markdown с заголовками и таблицами. Файл не покидает ваше устройство: разбор идёт в браузере. Если внутри скан (страницы-картинки), инструмент скажет об этом прямо и назовёт номера таких страниц — распознавания текста с картинки здесь нет.
Почему текст из PDF часто выходит кашей
В PDF нет абзацев и таблиц в том виде, в каком их видит человек: внутри лежат отдельные кусочки текста с координатами на листе. Простые конвертеры читают их подряд — и колонки слипаются, таблица превращается в поток слов, заголовки теряются. Здесь работает движок, который смотрит на положение текста на странице, поэтому таблица остаётся таблицей, а заголовок — заголовком.
Как отличить текстовый PDF от скана
Если документ сделан из Word, 1С, выгрузки из банка или сайта — внутри есть текстовый слой, и он достаётся целиком и точно. Если страницу сфотографировали или отсканировали, внутри лежит картинка: букв в файле нет, есть только изображение букв. Инструмент показывает класс файла и номера страниц-картинок, чтобы не гадать.
Куда деть полученный Markdown
Markdown — формат, который одинаково понимают редакторы, движки сайтов и языковые модели. Из него удобно собрать статью, перенести смету в таблицу или скормить документ ИИ-помощнику, не тратя его внимание на мусорную разметку.
Коротко
- Текст и Markdown из PDF — заголовки, списки и таблицы, а не слипшаяся каша.
- Файл не уезжает с устройства: разбор идёт в браузере, серверу он не показывается.
- Скан честно назван сканом: OCR здесь нет, и мы об этом говорим сразу.
Частые вопросы
Файл загружается на ваш сервер?
Нет. Разбор идёт прямо в вашем браузере: движок скачивается один раз и работает на вашем устройстве. Файл никуда не отправляется — ни к нам, ни третьим лицам. Поэтому инструментом можно пользоваться для договоров, счетов и документов с персональными данными.
Чем это отличается от «PDF в Word»?
Мы отдаём текст и Markdown — заголовки, списки и таблицы в чистом виде, пригодном для правки, ИИ-запроса или переноса на сайт. Мы не обещаем документ Word с вёрсткой один в один: честный текст лучше, чем кривая копия макета, из которой всё равно всё придётся переделывать.
Почему из моего файла ничего не достали?
Скорее всего это скан: страницы внутри — картинки, текстового слоя в файле нет. Инструмент честно скажет об этом и назовёт номера страниц-картинок. Распознавание текста с картинки (OCR) здесь не выполняется — для этого нужен другой инструмент.
Таблицы сохранятся?
Да, таблицы выходят Markdown-таблицами, а заголовки — заголовками. Движок читает не только строки, но и координаты текста на странице, поэтому колонки не слипаются в кашу.
Есть ограничение по размеру и языку?
Размер ограничен только памятью вашего устройства — обычные документы на сотни страниц разбираются за доли секунды. Кириллица, сложные шрифты и вертикальные языки поддерживаются; файл под паролем нужно сначала расшифровать.
Сколько это стоит?
Нисколько, без регистрации и без ограничений по числу файлов: инструмент не тратит наши серверы, поэтому и брать за него деньги не за что.
Документы — это только начало
Травинов разбирает входящие документы, ведёт переписку и продаёт за вас — на ИИ, круглосуточно.
Посмотреть, как это работает

