Симптом
Меряете задержку между своими серверами — нода к ноде, управляющий сервер к ноде — стабильно чисто и быстро: условно 64–88 мс между странами, ноль потерь. А пользователь на своём канале жалуется на большой пинг и рывки. Цифры «с наших серверов» противоречат жалобе.
Причина
Замер между двумя дата-центрами идёт по магистрали ДЦ↔ДЦ — она почти всегда чистая и быстрая и не отражает путь реального пользователя. Клиент идёт со своего Wi-Fi или мобильного канала через бытового провайдера: совершенно другой маршрут, другие потери, другая буферизация и качество последней мили. Управляющий сервер — тоже дата-центр, поэтому «замер отсюда» — снова ДЦ↔ДЦ, а не картина клиента.
Расхождение вроде «клиентский пинг 1000 мс при ICMP ДЦ↔ДЦ 88 мс» — норма, и причина лежит на стороне клиентского канала и установки соединения (медленный старт, режим подключения, цепочка параметров), а не на магистрали.
Решение
- ДЦ-замеры годятся, чтобы исключить мёртвую ноду или полную потерю связности. Для оценки реальной клиентской латентности — нет.
- Истинную задержку и «моросит» мерить с реального потребительского канала: телефон или ноутбук в типичной пользовательской сети, не из дата-центра.
- Для сквозной проверки самого тракта полезен headless-клиент, поднятый на пользовательской стороне сети.
Вывод. Точка измерения определяет, что вы измеряете. Тесты изнутри своей инфраструктуры систематически оптимистичнее пользовательского опыта, потому что не включают последнюю милю. Не опровергайте жалобу клиента замером с сервера — это разные пути. Оценивайте клиентский опыт с позиции, максимально близкой к клиенту.