Скан телефоном в PDF
Настоящего сканирования — с поиском краёв листа, выравниванием перспективы и распознаванием текста — у нас нет, и обещать его было бы неправдой. Есть цепочка из трёх шагов, которая даёт годный результат: снять документ ровно, обрезать всё лишнее вокруг листа, сжать снимок и собрать из снимков PDF. Обрезка здесь не косметика, а главный рычаг веса: фон стола — это шум, который кодировщик вынужден описывать пиксель за пикселем.
Коротко о цифрах
- Чего у нас нет
- поиска краёв, выравнивания перспективы, распознавания текста
- Пропорции обрезки
- свободно, 1:1, 4:3, 3:2, 16:9
- Лимит на изображение
- 100 МБ на файл
- Подбор веса снимка
- бисекция 25…95, до 7 проб, затем сторона 0,7 и 0,5
- Безопасное ограничение стороны
- 1920 точек для читаемого текста
Съёмка: четыре вещи, которые решают всё
- Свет сбоку и сверху, без вспышки: вспышка даёт блик по центру листа и провал по краям.
- Камера параллельно бумаге, а не под углом: перспективу мы не выравниваем, и трапеция останется трапецией.
- Тень от собственной руки — самая частая порча кадра, сдвиньтесь так, чтобы её не было на листе.
- Заполните кадр листом целиком: чем больше стола в кадре, тем больше лишних байтов и тем мельче текст.
Почему обрезка важнее качества
Кодировщик описывает всё, что попало в кадр. Однородный белый лист сжимается хорошо, а вот текстура стола, край клавиатуры и складка скатерти — это шум, и на него уходят килобайты, которые вам не нужны. Обрезав кадр по краю листа, вы убираете самую дорогую часть изображения ещё до всякого сжатия.
В инструменте обрезки есть свободная рамка и пропорции 1:1, 4:3, 3:2 и 16:9. Пропорции листа A4 среди пресетов нет намеренно: подгонять кадр под лист незачем, потому что при сборке PDF изображение и так впишется в страницу с сохранением пропорций.
После обрезки снимок стоит сжать: подбор идёт бисекцией качества от 25 до 95, не более семи проб, а если цель по весу не взята, длинная сторона уменьшается до 0,7 и до 0,5 от исходной. Для читаемого текста ограничение стороны в 1920 точек безопасно, 1280 — уже на грани для мелкого шрифта.
Цепочка целиком
- Снимите документ при ровном свете, камера параллельно листу.
- Откройте обрезку изображения и вырежьте лист по краям, убрав стол и тени.
- Сожмите снимок: по размеру, если есть ограничение, или по качеству, если важна читаемость.
- Повторите для остальных листов, сохраняя их по порядку.
- Соберите PDF из снимков, выбрав размер страницы A4.
- Если итоговый файл не укладывается в нужный вес, пропустите его через сжатие документа.
Частые вопросы
Почему сайт не обрезает лист по краям автоматически?
Потому что такого инструмента у нас нет, и делать вид, что он есть, нечестно. Ручная рамка занимает несколько секунд и даёт предсказуемый результат, тогда как автоматика ошибается на цветном фоне и тенях.
Можно ли получить текст, который потом отредактировать?
Из фотографии — нет. Распознавания у нас нет, а перевод PDF в Word работает только с документами, где текстовый слой уже есть. Снимок остаётся картинкой, сколько бы его ни конвертировали.
Сколько страниц можно собрать таким способом на телефоне?
Сборка PDF из снимков не растрирует страницы, поэтому упирается в общий вес изображений, а не в их количество. Десяток сжатых снимков телефон соберёт спокойно, полсотни несжатых — уже риск.
Что делать, если текст на скане стал нечитаемым после сжатия?
Верните исходный снимок и уменьшайте не качество, а разрешение — либо наоборот, оставьте сторону как есть и поднимите качество. Мелкий шрифт страдает в первую очередь от нехватки точек, а не от степени сжатия.