📄 Документы ✓ Бесплатно

PDF в HTML
онлайн

Из документа собирается страница с настоящей разметкой: заголовки тегами h1 и h2, списки — ul, таблицы с линиями — table. Не картинка в обёртке, а текст, который читается поиском и правится руками.
Обратная конвертация HTML в PDF

Мгновенно
🗑Файл не уходит на сервер
🏷Настоящие теги
👁Разбор виден заранее
Перетащите PDF сюдаили нажмите кнопку нижеОдин PDF · до 100 МБ

Почему получается структура, а не копия вёрстки

PDF описывает, где на листе стоит каждая буква. HTML описывает, что это за текст: заголовок, абзац, пункт списка. Между этими описаниями нет прямого перевода — структуру приходится восстанавливать по косвенным признакам. Мы собираем строки из фрагментов, склеиваем их в абзацы, а заголовки узнаём по кеглю относительно основного текста.

Точную вёрстку страницы воспроизвести нельзя в принципе: для этого нужен движок браузера, расставляющий блоки по абсолютным координатам. Такой результат выглядит похоже, но им невозможно пользоваться — ни поправить, ни встроить в сайт, ни прочитать на телефоне. Поэтому мы переносим смысл документа, а не его внешний вид.

  • Заголовки, абзацы и списки — настоящими тегами
  • Таблицы с линиями сетки переносятся как table
  • Целая страница с кодировкой либо голый фрагмент — на выбор
  • Результат виден и копируется прямо из окна
  • Документ не покидает устройство
Что теряется Честно
Шрифты и цвета Не переносятся
Вёрстка в колонки Развернётся в текст
Картинки Достаются отдельно
Сканы без текста Достать нечего
Что переносится Надёжно
Заголовки h1 и h2
Абзацы и списки p, ul, li
Таблицы с границами table
Кириллица Без кракозябр

Частые вопросы

Нет. Документ читается и пересобирается прямо в браузере, файл никуда не отправляется.
Переносится структура документа, а не его оформление: шрифты, цвета и положение блоков остаются в PDF. Полученный HTML оформляется вашими стилями — так его и можно встроить в сайт.
Они не переносятся: в HTML их пришлось бы встраивать прямо в код, и файл раздулся бы до мегабайтов. Достаньте их отдельно инструментом «Картинки из PDF» и подставьте ссылками.
Они распознаются по размеру шрифта относительно основного текста, и в документах с необычным оформлением это иногда ошибается. Выключите «Распознавать заголовки» — тогда весь текст станет обычными абзацами.
Значит, у неё нет линий сетки. Таблицы без границ здесь намеренно не ищутся: на обычном тексте разбор по отступам разорвал бы абзацы. Для таких таблиц есть «PDF в Excel», где этот разбор включён и настраивается.
Если результат пойдёт куском внутрь чужой страницы — в статью, в письмо, в шаблон. Тогда doctype и head будут лишними, и останется только сама разметка содержимого.