Простыми словами
Команда заранее определяет, как «калибровка» должен работать для «управление инцидентом», а затем проверяет это до выпуска и в аварийном сценарии. Так правило проверяется на деле, а не остаётся только в документации.
Пример при разработке
В проекте практика «Калибровка: управление инцидентом» оформляется как проверяемое правило: автоматический тест или метрика фиксирует соблюдение границы, а нарушение блокирует выпуск либо включает безопасный режим.
Это редакционный пример применения, а не часть определения или доказательство концепции.Формальное определение
Для «управление инцидентом» это сопоставление порогов и ожиданий с фактическим поведением сервиса, чтобы сигнал отражал реальный пользовательский риск.
Механизм действия
Для «Калибровка: управление инцидентом» назначают ответственного, задают границы и понятный признак нарушения. В тесты, выпуск или эксплуатационный контроль.
Пример в работе
Повторять термин «Калибровка: управление инцидентом», не объяснив, где он применяется, кто отвечает и по какому признаку видно результат.
Для «Калибровка: управление инцидентом» назвать конкретный риск, добавить проверку и заранее определить, когда правило нужно пересмотреть.
Ограничения
Практика «Калибровка: управление инцидентом» закрывает один конкретный риск и не заменяет проверку соседних отказов, безопасности, данных и пользовательских последствий.
Источник
Google, «Site Reliability Engineering», 2016.