Перейти к содержимому
pdftools.kz
Организация

Как считать скачивания PDF и что мешает счёту

Считать вы будете не открытия документа, а обращения к его адресу — это разные вещи, и разница может быть кратной. Источников два: журнал веб-сервера и событие в аналитике по клику на ссылку. Оба врут в известные стороны: боты предпросмотра и запросы по диапазонам байтов цифру завышают, кэш браузера и промежуточные узлы — занижают. Уведомления «документ открыли» PDF не даёт вовсе.

Локально в браузередо 1 ГБбез регистрации

Коротко о цифрах

Что реально считается
обращения к адресу файла, а не открытия документа
Где живёт счёт
журнал веб-сервера или событие клика в аналитике
Что завышает цифру
боты предпросмотра и запросы по диапазонам байтов у линеаризованного файла
Что занижает цифру
кэш браузера и промежуточные узлы: повторное открытие до сервера не доходит
Чего PDF не умеет
сообщать отправителю, что документ открыли
Водяной знак
непрозрачность 0,1…1,0, диагональ −45°, наносится в браузере

Два способа считать и что каждый видит

Журнал сервера фиксирует каждый запрос к файлу. Он видит и человека, и робота поисковика, и бота мессенджера, который скачивает документ ради карточки предпросмотра. Зато он не видит открытие из кэша: если читатель вернулся к файлу через час, второго запроса может не быть вовсе.

Событие в аналитике срабатывает на клик по ссылке на вашей странице. Оно ближе к человеку, но пропускает всё, что происходит мимо страницы: прямую ссылку из письма, переход из мессенджера, повторное открытие из загрузок. Совпадения между двумя счётчиками не будет никогда, и это нормально.

Что искажает цифру

  • Боты предпросмотра ссылок: карточка в мессенджере означает, что файл кто-то уже скачал, но это не читатель.
  • Линеаризованный файл в браузере: просмотрщик запрашивает документ кусками по диапазонам байтов, и один просмотр даёт несколько записей в журнале.
  • Кэш браузера и промежуточные узлы: повторное открытие до вашего сервера не доходит.
  • Скачал один — переслал десяти: дальнейшая судьба файла в статистике не отражается никак.
  • Скачивание не равно прочтению: файл может годами лежать в папке загрузок неоткрытым.

Что можно сделать честно

  1. Разведите каналы: для рассылки, соцсети и страницы сайта сделайте разные адреса одного документа — так вы увидите источник, а не общую кучу.
  2. Считайте посещения страницы-обёртки со ссылкой, а не только сам файл: у страницы аналитика точнее и подробнее.
  3. Для адресных рассылок ставьте персональный водяной знак: непрозрачность настраивается от 0,1 до 1,0, диагональ по умолчанию −45°.
  4. Проставьте номера страниц перед раздачей — по ним удобно ссылаться, а копию проще опознать.
  5. Не рассчитывайте на «маячок» внутри файла: сетевые обращения из документа просмотрщики ограничивают, и работать это будет не у всех.
  6. Публикуйте честные выводы: «файл запросили N раз» — правда, «его прочитали N человек» — нет.

Частые вопросы

Можно ли узнать, кто именно открыл документ?

Нет. Журнал видит запрос к адресу, а не человека за экраном. Единственный честный способ адресности — персональная копия с водяным знаком, розданная поимённо.

Почему в журнале скачиваний больше, чем людей?

Часть запросов сделали боты предпросмотра ссылок и поисковые роботы. Ещё часть — один и тот же читатель: просмотрщик берёт линеаризованный файл кусками по диапазонам байтов.

Работают ли «уведомления о прочтении» для PDF?

Нет, в формате такого механизма не предусмотрено. Всё, что вы можете зафиксировать, происходит на вашем сервере до того, как файл ушёл на устройство читателя.

Как разделить статистику по каналам?

Сделайте отдельный адрес файла для каждого канала: рассылки, соцсети, страницы сайта. В журнале они разойдутся сами, без всякой разметки внутри документа.

Рядом

Частые задачи с этим инструментом