SYSTEM ATLASЗагрузка материала

Калибровка: SLO

SLO Calibration

Для «SLO» это сопоставление порогов и ожиданий с фактическим поведением сервиса, чтобы сигнал отражал реальный пользовательский риск.

Простыми словами

Команда заранее определяет, как «калибровка» должен работать для «SLO», а затем проверяет это до выпуска и в аварийном сценарии. Так правило проверяется на деле, а не остаётся только в документации.

Пример от @Vibeclakr

Пример при разработке

В проекте практика «Калибровка: SLO» оформляется как проверяемое правило: автоматический тест или метрика фиксирует соблюдение границы, а нарушение блокирует выпуск либо включает безопасный режим.

Это редакционный пример применения, а не часть определения или доказательство концепции.

Формальное определение

Для «SLO» это сопоставление порогов и ожиданий с фактическим поведением сервиса, чтобы сигнал отражал реальный пользовательский риск.

Механизм действия

Для «Калибровка: SLO» назначают ответственного, задают границы и понятный признак нарушения. В тесты, выпуск или эксплуатационный контроль.

Пример в работе

Нерабочий подход

Повторять термин «Калибровка: SLO», не объяснив, где он применяется, кто отвечает и по какому признаку видно результат.

Системный подход

Для «Калибровка: SLO» назвать конкретный риск, добавить проверку и заранее определить, когда правило нужно пересмотреть.

Ограничения

Практика «Калибровка: SLO» закрывает один конкретный риск и не заменяет проверку соседних отказов, безопасности, данных и пользовательских последствий.

Источник

Google, «Site Reliability Engineering», 2016.

Первоисточник