глоссарий

Observability

Observability

Наблюдаемость (observability) — свойство системы, позволяющее по внешним сигналам (логам, метрикам, трейсам) понять внутреннее состояние без остановки и вскрытия. Это степень прозрачности сервиса для инженера, отвечающего на вопрос «почему оно так себя ведёт?».

Термин стал критичен с приходом микросервисов и облаков: десятки компонентов обмениваются сообщениями, сбой может возникнуть в любом звене. Без наблюдаемости видна лишь вершина айсберга — ошибка в интерфейсе или задержка. С ней можно проследить путь запроса от пользователя до БД и обратно, найти тормозящий узел. Поиск причины превращается из гадания в методичный процесс.

Наблюдаемость похожа на диагностику автомобиля. Лампа «CHECK ENGINE» — минимум: известно, что что-то не так, но неясно, где именно. Полная картина — приборная панель с датчиками и картой ошибок. В коде это сбор трёх типов данных: логи (что случилось), метрики (сколько раз и как долго), трейсы (порядок прохождения запроса по сервисам). Сопоставляя их, инженер восстанавливает целостную картину.

Пример: интернет-магазин теряет заказы. Наблюдаемость показывает рост времени ответа корзины с 200 мс до 3 секунд. Логи фиксируют таймауты платежного шлюза. Трейс вскрывает узкое место — пул соединений БД исчерпан из-за скачка трафика. Без этих данных пришлось бы перезапускать всё подряд.

Вывод: наблюдаемость — не просто логирование, а системный подход к пониманию сложных систем. Она даёт контроль и предсказуемость вместо хаоса, позволяет точечно чинить поломки, не нарушая работу целого.