SYSTEM ATLASЗагрузка материала

SLI

Service Level Indicator

Наблюдаемый показатель измеряет конкретный аспект качества сервиса.

Простыми словами

Непосредственно измеряемый показатель качества сервиса, например доля успешных запросов или задержка. Например, для поиска SLI может быть доля запросов, завершившихся быстрее 400 мс. Это измерение, а не обещание и не желаемый процент. Поэтому заранее определяют границы ожидания и поведение при отказе - иначе один медленный компонент начинает удерживать ресурсы и распространять проблему дальше.

Пример от @Vibeclakr

Пример при разработке

Для поиска SLI может быть доля запросов, завершившихся быстрее 400 мс. Это измерение, а не обещание и не желаемый процент.

Это редакционный пример применения, а не часть определения или доказательство концепции.

Механизм действия

Сначала проверяют, есть ли исходное условие из определения. Затем смотрят, как оно влияет на структуру компонентов, потоки данных, ограничения и действия участников. Если эту связь не удаётся наблюдать, принцип не стоит использовать как готовое объяснение.

Пример в работе

Нерабочий подход

Решение принимают без учета механизма «SLI», оценивая только ближайший эффект.

Системный подход

Перед изменением проверяют, как «SLI» влияет на ограничения, стимулы, зависимости и вторичные последствия.

Ограничения

«SLI» объясняет только часть происходящего в области «Надежность и SRE». Сам принцип не говорит, насколько сильным будет эффект в вашем случае, и не заменяет измерения. При другом масштабе, среде или временном горизонте результат может отличаться.

Источник

Betsy Beyer, Chris Jones, Jennifer Petoff, Niall Richard Murphy. Site Reliability Engineering: Service Level Objectives. 2016. ISBN 9781491929124.

Первоисточник