SYSTEM ATLASЗагрузка материала

MTTF — среднее время до отказа

Mean Time to Failure (MTTF)

Оценивает ожидаемую продолжительность работы до следующего сбоя.

Простыми словами

Представьте лампочки одной модели: часть перегорит раньше, часть позже, а среднее время даст ориентир по сроку службы. MTTF оценивает ожидаемую работу неремонтируемого компонента до отказа, поэтому полезен для планирования замены и запасов.

Пример от @Vibeclakr

Пример при разработке

Если одинаковые worker-процессы в среднем работают 30 дней до отказа, MTTF помогает оценить частоту замен, но не говорит, сколько займёт восстановление.

Это редакционный пример применения, а не часть определения или доказательство концепции.

Механизм действия

Сначала проверяют, есть ли исходное условие из определения. Затем смотрят, как оно влияет на структуру компонентов, потоки данных, ограничения и действия участников. Если эту связь не удаётся наблюдать, принцип не стоит использовать как готовое объяснение.

Пример в работе

Нерабочий подход

Применять локальное решение без проверки контекста, ограничений и вторичных последствий.

Системный подход

Сначала определить механизм, затем выбрать минимальное изменение и измерить результат.

Ограничения

«MTTF — среднее время до отказа» объясняет только часть происходящего в области «Надежность и SRE». Сам принцип не говорит, насколько сильным будет эффект в вашем случае, и не заменяет измерения. При другом масштабе, среде или временном горизонте результат может отличаться.

Источник

National Institute of Standards and Technology. Contingency Planning Guide for Federal Information Systems. 2010. NIST SP 800-34 Rev. 1.

Первоисточник