iloveepub
Меню
RU

Обработка на устройстве — файлы никогда не покидают его

PDF в EPUB

Превратите книгу из PDF в перетекаемый EPUB, размер которого можно менять на любой читалке — с автоматической проверкой на скан до всякой конвертации. Бесплатно, без загрузки, без ограничений.

01Выберите PDF

Как конвертировать PDF в EPUB

  1. Выберите файл PDF

    Файл анализируется локально в вашем браузере — проверка на скан занимает миллисекунды, до всякой конвертации.

  2. Подтвердите название книги

    Мы подставляем название, найденное в PDF. Исправьте при желании — оно уйдет в метаданные и оглавление EPUB.

  3. Скачайте EPUB

    Главы распознаются по заголовкам, аккуратно верстаются и собираются в перетекаемый EPUB, сохраняемый на ваше устройство.

Перетекаемое против фиксированного: зачем вообще конвертировать

PDF и EPUB воплощают две философии. PDF — печатная мастер-копия: страницы фиксированного размера, каждый глиф прибит к координате, прекрасен на бумаге и на экранах, достаточно больших для целой страницы. EPUB — веб-страница в книжной одежде: текст, переносящийся на любую ширину, размер шрифта под контролем читателя и верстка, подстраивающаяся от 6-дюймовой читалки до 13-дюймового планшета.

Конвертация PDF в EPUB означает расфиксацию страницы. Сделанная хорошо, она дает все, в чем сильны читалки — мгновенную смену размера шрифта, словарные подсказки, чтение вслух, синхронизацию прогресса и удобное чтение одной рукой на маленьких экранах. Сделанная плохо — бардак. Разницу почти полностью объясняет один вопрос: с какого рода PDF вы начинаете?

Два рода PDF — и конвертируется только один

Откройте свой PDF и попробуйте выделить предложение. Если над буквами появилась подсветка, у вас текстовый PDF: файл содержит настоящие символы с информацией о шрифте и позиции. Издатели экспортируют их прямо из верстальных программ, и это сырье, с которым конвертер может работать.

Если же курсор тянет рамку по фотографии страницы, у вас скан — каждая страница это снимок бумаги. Внутри нет текста для извлечения, только краска. Добыча текста из скана требует OCR (оптического распознавания символов) — тяжелого и ошибкоопасного процесса, который честно не выполнить во вкладке браузера. Каждый честный конвертер — наш в том числе — откажет сканам, вместо того чтобы вручить вам пустую или искореженную книгу. Третий вариант, скан с невидимым текстовым слоем OCR, находится посередине: он конвертируется, но наследует ошибки OCR.

Что конвейер конвертации делает на самом деле

Текстовый PDF хранит строки, а не абзацы: каждая строка — набор символов на позиции. Первая задача конвертера — реконструкция: сгруппировать строки в абзацы, склеить слова, разорванные переносами на концах строк, и выбросить колонтитулы и номера страниц, которые иначе усыпали бы текст.

Вторая задача — структура: распознать заголовки глав по размеру шрифта и отступам, построить из них оглавление и разметить заголовки, выделения и блочные цитаты. Третья — ресурсы: извлечь встроенные изображения и заново встроить их в EPUB в разумных размерах. Если все три шага сделаны верно, результат неотличим от родного EPUB; если реконструкция абзацев провалена, предложения приходят вперемешку — классический провал дешевых конвертеров.

Что вы теряете и что приобретаете

Честный баланс. Вы теряете точную верстку: многостраничные журнальные колонки перетекут в одну колонку в порядке чтения (обычно верно, изредка нет), а дизайнерская типографика станет типографикой читалки. Аннотации, сделанные в PDF, останутся в PDF — они принадлежат просмотрщику, а не файлу.

Вы приобретаете весь инструментарий читалки: текст, помещающийся на экран, который вы держите, шрифты, в которые усталые глаза могут вырасти, список глав с переходом куда угодно и файл, весящий долю оригинала. Для книг — в отличие от бланков, нот и презентаций — это почти всегда честный обмен.

Как проверить свой PDF перед конвертацией

Три быстрых теста. Тест выделением выше: выделяемый текст означает конвертируемость. Тест размера: книга на 200 страниц весом 60 MB почти наверняка скан — изображения тяжелы, текст дешев. Тест титульной страницы: приблизьте угол страницы; отсканированные страницы размываются как фотографии, а изначально цифровой текст остается бритвенно резким при любом увеличении.

Наш конвертер проводит эту диагностику за вас автоматически, за миллисекунды, прежде чем пытаться что-либо конвертировать, — отсканированная книга получает ясное объяснение вместо сломанного файла на выходе.

Типы PDF и их судьба при конвертации в EPUB

Тип PDFЧто внутриКонвертируется в EPUB?
ТекстовыйНастоящие символы со шрифтом и позициейДа — хороший случай
СканФото каждой страницы; без текстового слояНет — нужен OCR, в браузере невозможно
Скан + слой OCRФото плюс скрытый, несовершенный текстЧастично — наследует ошибки OCR
ГибридЧасть глав текст, часть сканыТолько текстовые главы
Формы / тегированныеИнтерактивные поля или теги доступностиПоля пропадают; теги могут помочь

Частые вопросы

Почему вы не конвертируете отсканированные PDF?

Потому что этого нельзя честно сделать в браузере. Сканы содержат фотографии текста, а его извлечение требует OCR — тяжелых и ошибкоопасных вычислений, которые мы не можем запустить локально. Вместо инструмента, молча производящего мусор, мы определяем сканы и говорим об этом прямо.

Конвертер PDF в EPUB бесплатный?

Да — как и каждый инструмент на этом сайте: без аккаунтов, кредитов и дневных лимитов на страницы.

Мой PDF куда-нибудь загружается?

Нет. Разбор, диагностика и конвертация выполняются в вашем браузере. Обещание приватности на этом сайте структурное, а не декларативное: конечной точки для загрузки просто не существует.

Как инструмент решает, где начинаются главы?

Он смотрит на заголовки, восстановленные из PDF: если у книги есть ясные заголовки верхнего уровня, каждый становится главой в оглавлении EPUB. Книги без структуры заголовков проходят как один непрерывный, аккуратно сверстанный файл.

А можно в обратную сторону, EPUB в PDF?

Да — это направление проще, потому что сверстать книгу легче, чем расверстать. Как это работает — на странице EPUB в PDF.

Похожие инструменты