# Бесплатная экспертная база знаний по управлению ИТ

Никакого пересказа ITIL, COBIT, ISO 20000, PRINCE2, TOGAF и прочего. Только сведения от консультантов и тренеров Cleverics. Включает ответы на **несколько тысяч вопросов** из **сотен источников**, а также детальный глоссарий с примерами, объяснениями и нюансами

# Среднее время наработки на отказ

[Метрика](https://cleverics.ru/digital/kb-glossary/metric/) того, как часто происходит [сбой](https://cleverics.ru/digital/kb-glossary/failure/) в работе [услуги](https://cleverics.ru/digital/kb-glossary/service/) или [конфигурационной единицы](https://cleverics.ru/digital/kb-glossary/configuration-item/)

Синонимы: MTBF

## Оригинальный английский термин

mean time between failures, MTBF

## Подробности

[Среднее время наработки на отказ](https://cleverics.ru/digital/kb-glossary/mean-time-between-failures/) ([MTBF](https://cleverics.ru/digital/kb-glossary/mean-time-between-failures/)) используется для количественной [оценки](https://cleverics.ru/digital/kb-glossary/assessment/)[надёжности](https://cleverics.ru/digital/kb-glossary/reliability/) услуги или конфигурационной единицы [в эксплуатации](https://cleverics.ru/digital/kb-glossary/live/). По смыслу это показатель «как часто ломается» в среднем: чем выше MTBF, тем реже происходят сбои. В [управлении услугами](https://cleverics.ru/digital/kb-glossary/service-management/) MTBF применяют для [анализа трендов](https://cleverics.ru/digital/kb-glossary/trend-analysis/)[доступности](https://cleverics.ru/digital/kb-glossary/availability/) и надёжности, сравнения альтернативных [архитектур](https://cleverics.ru/digital/kb-glossary/architecture/), обоснования инвестиций в модернизацию, а также для постановки ожиданий к [поставщикам](https://cleverics.ru/digital/kb-glossary/supplier/) и внутренним [командам поддержки](https://cleverics.ru/digital/kb-glossary/support-team/). На [практике](https://cleverics.ru/digital/kb-glossary/practice/) MTBF считают по данным [мониторинга](https://cleverics.ru/digital/kb-glossary/monitoring/) и истории [инцидентов](https://cleverics.ru/digital/kb-glossary/incident/), сопоставляя моменты [отказов](https://cleverics.ru/digital/kb-glossary/failure/) и период нормальной работы между ними; важно договориться, что именно считается отказом и для какого уровня — для услуги целиком, для конкретной конфигурационной единицы, или для [компонента](https://cleverics.ru/digital/kb-glossary/component/) в составе [сервисной архитектуры](https://cleverics.ru/digital/kb-glossary/service-architecture/). Термин не описывает скорость [восстановления](https://cleverics.ru/digital/kb-glossary/recovery/) и не заменяет метрики, отражающие восстановление и устранение последствий; он про частоту отказов, а не про время ремонта, длительность простоя или качество обработки инцидентов.## Нюансы

Частая [ошибка](https://cleverics.ru/digital/kb-glossary/error/) — воспринимать среднее время наработки на отказ как «[гарантию](https://cleverics.ru/digital/kb-glossary/warranty/)», что отказ произойдёт ровно через это время. Это статистическая метрика, и реальное распределение отказов может быть неравномерным: после [изменения](https://cleverics.ru/digital/kb-glossary/change/), [релиза](https://cleverics.ru/digital/kb-glossary/release/) или [развёртывания](https://cleverics.ru/digital/kb-glossary/deployment/) частота сбоев может резко вырасти, даже если долгосрочный MTBF выглядит приемлемо. Также MTBF регулярно путают со [средним временем восстановления услуги](https://cleverics.ru/digital/kb-glossary/mean-time-to-restore-service/) ([MTRS](https://cleverics.ru/digital/kb-glossary/mean-time-to-restore-service/)): MTBF отвечает на вопрос «как часто ломается», а MTRS — «как быстро восстанавливаем». Ещё один подводный камень — смешивание уровней измерения: если считать MTBF для услуги, но фиксировать отказы на уровне конфигурационных единиц без учёта [избыточности](https://cleverics.ru/digital/kb-glossary/fault-tolerance/), можно получить завышенную частоту «отказов», которые фактически не повлияли на [потребление услуги](https://cleverics.ru/digital/kb-glossary/service-consumption/). Наконец, некорректные определения отказа и неполные данные мониторинга приводят к несопоставимым значениям: кратковременные деградации, плановые [операции](https://cleverics.ru/digital/kb-glossary/operation/) и отключения из-за [катастрофы](https://cleverics.ru/digital/kb-glossary/disaster/) должны быть заранее классифицированы, иначе метрика будет искажать выводы и провоцировать неверные управленческие решения.## Примеры

- MTBF для ИТ-услуги «Корпоративная почта» рассчитывается по числу отказов, при которых пользователи не могли отправлять или получать письма, за квартал
- MTBF для конфигурационной единицы «маршрутизатор филиала» оценивается по истории событий и инцидентов, связанных с потерей связи
- MTBF для кластера базы данных считается по отказам, приводящим к недоступности записи транзакций, с учётом переключения на резервный узел
- MTBF для сервиса CI/CD в рабочей среде измеряется по числу падений пайплайна, которые блокировали развёртывание релизов

## Рекомендуемые продукты по этой теме

- [VAP: Управление поддержкой ИТ-услуг](https://edu.cleverics.ru/vap-support?utm_source=knowledgebase&utm_medium=article&utm_content=banner&utm_term=VAP-SUPPORT) — Учебный курс: интенсив с тренером. Строим эффективную ИТ-поддержку. Оптимизируем существующую.
- [Apollo 13 — ITSM на практике](https://edu.cleverics.ru/apollo?utm_source=knowledgebase&utm_medium=article&utm_content=banner&utm_term=APOLLO) — Деловая игра. Service Desk, управление инцидентами, проблемами, изменениями
- [Altevics](https://cleverics.ru/solutions/altevics?utm_source=knowledgebase&utm_medium=article&utm_content=banner&utm_term=altevics) — Современная ITSM/ESM-система