Почему после конвертации поехала вёрстка
Сдвиг после конвертации — почти всегда следствие одной из пяти причин, и все они устранимы, если понять, какая именно сработала. Подставился другой шрифт. В PDF не было абзацев, и они восстанавливались наугад. Таблица оказалась набором линий. Лист подогнали под содержимое вместо содержимого под лист. Поля по умолчанию отличаются от ваших. Ниже — как отличить их друг от друга.
Коротко о цифрах
- Причина №1
- подстановка шрифта: меняется ширина знаков
- Причина №2
- в PDF нет абзацев, они восстанавливаются по координатам
- Причина №3
- рамка таблицы в PDF — это отрезки, а не сетка
- Причина №4
- режим «уместить» меняет размер листа, а не масштаб
- Причина №5
- поля и формат листа по умолчанию, например A4 и 0,4 дюйма
Пять причин, по которым текст съезжает
- Подстановка шрифта. Если использованного вами начертания нет на конвертере, берётся похожее — но у него другая ширина знаков. Строка становится длиннее, появляется лишний перенос, и вся страница уезжает вниз. Признак: текст тот же, но переносы и разбивка на страницы другие.
- Восстановление абзацев из координат. При переводе PDF в Word абзацев в исходнике не было: были куски строк с координатами. Конвертер решает по расстояниям, где кончается абзац. Признак: разрывы в середине предложения или, наоборот, слипшиеся абзацы.
- Таблица, которой не было. В PDF рамка — это отрезки, а не сетка. Если линии не нарисованы, ячейки автоматически не соберутся. Признак: числа стоят абзацами, а колонки держатся на пробелах.
- Лист подогнан под содержимое. Так работает режим «уместить на страницу» при конвертации таблиц: он меняет не масштаб, а размер страницы. Признак: PDF с крошечной страничкой размером с визитку или с длинной узкой лентой.
- Чужие поля и формат листа. Конвертер HTML печатает на A4 с полями 0,4 дюйма, а офисный пакет берёт поля из документа. Признак: содержимое то же, но начинается и обрывается в других местах.
Как понять, какая причина сработала
- Сравните число страниц. Изменилось — почти наверняка виноват шрифт: перенос строк поехал, и текст перетёк.
- Посмотрите на текст в местах разрыва. Абзац оборван на середине фразы — это восстановление структуры по координатам.
- Проверьте таблицы: если границы пропали, а данные встали строками, в исходнике не было настоящей таблицы.
- Откройте свойства документа и посмотрите размер страницы: непривычные размеры выдают подгонку листа под содержимое.
- Убедитесь, что исходник — не скан: у страницы-картинки нечего восстанавливать, и любая «конвертация в текст» тут будет догадкой.
Что делать, чтобы не разъезжалось
- Экспортируйте PDF из той программы, где документ свёрстан: тогда используются ваши шрифты и ваши поля.
- Если это невозможно, встройте шрифты в документ или замените экзотические начертания на распространённые.
- Для таблиц задавайте область печати и масштаб по ширине страницы в самой книге, а не надейтесь на переключатели конвертера.
- Проверяйте результат по трём местам: последняя страница, самая плотная таблица, колонтитул. Там сдвиг виден раньше всего.
- Если документ нужен только для чтения и печати, а правки не планируются, не гоняйте его обратно в редактируемый формат — каждая конвертация добавляет свою порцию расхождений.
Частые вопросы
Почему число страниц после конвертации изменилось?
Так проявляется подстановка шрифта. У замены другая ширина знаков, строки перестают помещаться, добавляются переносы, и текст постепенно выталкивается на дополнительный лист. Проверьте, встроены ли шрифты в исходный документ.
Почему в Word после PDF абзацы разорваны?
Потому что абзацев в PDF не было. Конвертер разбивал текст по вертикальным промежуткам между строками, и на документах с увеличенным межстрочным интервалом он принимает обычные строки за границы абзацев.
Можно ли конвертировать так, чтобы вообще ничего не сдвинулось?
Только в одну сторону: экспортом в PDF из программы, где документ был свёрстан. Любое обратное преобразование восстанавливает структуру приблизительно, потому что в готовой странице этой структуры физически нет.
Помогает ли повторная конвертация туда и обратно?
Нет, становится хуже. Каждый проход добавляет свои допущения: сначала абзацы угаданы по координатам, потом на угаданное накладываются подстановки шрифтов. Возвращайтесь к исходному файлу, а не к его копиям.