Перейти к содержимому
pdftools.kz

Почему после конвертации поехала вёрстка

Сдвиг после конвертации — почти всегда следствие одной из пяти причин, и все они устранимы, если понять, какая именно сработала. Подставился другой шрифт. В PDF не было абзацев, и они восстанавливались наугад. Таблица оказалась набором линий. Лист подогнали под содержимое вместо содержимого под лист. Поля по умолчанию отличаются от ваших. Ниже — как отличить их друг от друга.

Локально в браузеребез регистрации

Коротко о цифрах

Причина №1
подстановка шрифта: меняется ширина знаков
Причина №2
в PDF нет абзацев, они восстанавливаются по координатам
Причина №3
рамка таблицы в PDF — это отрезки, а не сетка
Причина №4
режим «уместить» меняет размер листа, а не масштаб
Причина №5
поля и формат листа по умолчанию, например A4 и 0,4 дюйма

Пять причин, по которым текст съезжает

  • Подстановка шрифта. Если использованного вами начертания нет на конвертере, берётся похожее — но у него другая ширина знаков. Строка становится длиннее, появляется лишний перенос, и вся страница уезжает вниз. Признак: текст тот же, но переносы и разбивка на страницы другие.
  • Восстановление абзацев из координат. При переводе PDF в Word абзацев в исходнике не было: были куски строк с координатами. Конвертер решает по расстояниям, где кончается абзац. Признак: разрывы в середине предложения или, наоборот, слипшиеся абзацы.
  • Таблица, которой не было. В PDF рамка — это отрезки, а не сетка. Если линии не нарисованы, ячейки автоматически не соберутся. Признак: числа стоят абзацами, а колонки держатся на пробелах.
  • Лист подогнан под содержимое. Так работает режим «уместить на страницу» при конвертации таблиц: он меняет не масштаб, а размер страницы. Признак: PDF с крошечной страничкой размером с визитку или с длинной узкой лентой.
  • Чужие поля и формат листа. Конвертер HTML печатает на A4 с полями 0,4 дюйма, а офисный пакет берёт поля из документа. Признак: содержимое то же, но начинается и обрывается в других местах.

Как понять, какая причина сработала

  1. Сравните число страниц. Изменилось — почти наверняка виноват шрифт: перенос строк поехал, и текст перетёк.
  2. Посмотрите на текст в местах разрыва. Абзац оборван на середине фразы — это восстановление структуры по координатам.
  3. Проверьте таблицы: если границы пропали, а данные встали строками, в исходнике не было настоящей таблицы.
  4. Откройте свойства документа и посмотрите размер страницы: непривычные размеры выдают подгонку листа под содержимое.
  5. Убедитесь, что исходник — не скан: у страницы-картинки нечего восстанавливать, и любая «конвертация в текст» тут будет догадкой.

Что делать, чтобы не разъезжалось

  • Экспортируйте PDF из той программы, где документ свёрстан: тогда используются ваши шрифты и ваши поля.
  • Если это невозможно, встройте шрифты в документ или замените экзотические начертания на распространённые.
  • Для таблиц задавайте область печати и масштаб по ширине страницы в самой книге, а не надейтесь на переключатели конвертера.
  • Проверяйте результат по трём местам: последняя страница, самая плотная таблица, колонтитул. Там сдвиг виден раньше всего.
  • Если документ нужен только для чтения и печати, а правки не планируются, не гоняйте его обратно в редактируемый формат — каждая конвертация добавляет свою порцию расхождений.

Частые вопросы

Почему число страниц после конвертации изменилось?

Так проявляется подстановка шрифта. У замены другая ширина знаков, строки перестают помещаться, добавляются переносы, и текст постепенно выталкивается на дополнительный лист. Проверьте, встроены ли шрифты в исходный документ.

Почему в Word после PDF абзацы разорваны?

Потому что абзацев в PDF не было. Конвертер разбивал текст по вертикальным промежуткам между строками, и на документах с увеличенным межстрочным интервалом он принимает обычные строки за границы абзацев.

Можно ли конвертировать так, чтобы вообще ничего не сдвинулось?

Только в одну сторону: экспортом в PDF из программы, где документ был свёрстан. Любое обратное преобразование восстанавливает структуру приблизительно, потому что в готовой странице этой структуры физически нет.

Помогает ли повторная конвертация туда и обратно?

Нет, становится хуже. Каждый проход добавляет свои допущения: сначала абзацы угаданы по координатам, потом на угаданное накладываются подстановки шрифтов. Возвращайтесь к исходному файлу, а не к его копиям.

Рядом