в прошлую пятницу в 11:00

Что такое uptime и как его считать: формулы и значения 99%, 99.9%, 99.99%

«У нас аптайм 99.9%» — фраза, которая звучит солидно и встречается в маркетинговых материалах почти каждого сервиса. Но за ней скрывается конкретная математика, и далеко не все, кто называет эти цифры, понимают, что они означают на практике. Разница между 99% и 99.9% кажется незначительной — всего десятая доля процента, — но в переводе на реальное время простоя она огромна.

Uptime (доступность) — фундаментальная метрика надёжности, и умение её правильно считать и интерпретировать необходимо всем, кто отвечает за сервис или выбирает поставщика. В этой статье разберём, что такое uptime, по каким формулам он вычисляется, что на самом деле означают знаменитые «девятки», сколько простоя допускает каждый уровень и какие подводные камни скрываются за красивыми процентами.

Что такое uptime

Uptime — это доля времени, в течение которого сервис был доступен и работал штатно, выраженная в процентах от общего времени за период. Обратная величина — downtime (время простоя), доля времени недоступности.

Если за месяц сервис был доступен 99.9% времени, значит 0.1% месяца он не работал. Эти проценты и есть uptime и downtime.

Важно сразу понять: uptime всегда привязан к периоду. «99.9%» само по себе неполно — нужно уточнять, за какой период: за месяц, квартал или год. От периода зависит, сколько именно простоя стоит за процентом.

Формула расчёта uptime

Базовая формула проста:

Uptime (%) = (Общее время − Время простоя) / Общее время × 100%

Или через доступное время:

Uptime (%) = Время работы / Общее время × 100%

Пример расчёта

Возьмём период в один месяц (30 дней = 43 200 минут). Допустим, сервис был недоступен суммарно 43 минуты.

Uptime = (43 20043) / 43 200 × 100% = 99.9%

То есть 43 минуты простоя в месяц соответствуют доступности 99.9%.

Что считать простоем

Здесь начинаются нюансы. Что именно считается «простоем»?

  • Полная недоступность — очевидно, да.
  • Частичная деградация (работает, но медленно) — спорно, зависит от определения.
  • Недоступность для части пользователей — считать ли простоем для всех?
  • Плановые работы — включать или исключать из расчёта?

От ответов на эти вопросы зависит итоговая цифра. Поэтому одинаковые «99.9%» у двух сервисов могут означать разное, если они по-разному определяют простой.

Что означают «девятки»

Уровни доступности принято называть по числу девяток. Вот что каждый из них означает в переводе на реальное время простоя.

99% («две девятки»)

  • В год: ~3 дня 15 часов простоя
  • В месяц: ~7 часов 12 минут
  • В неделю: ~1 час 40 минут

99% звучит неплохо, но три с лишним дня недоступности в год — это много для большинства серьёзных сервисов. Такой уровень допустим для некритичных систем.

99.9% («три девятки»)

  • В год: ~8 часов 45 минут простоя
  • В месяц: ~43 минуты
  • В неделю: ~10 минут

Это распространённый стандарт для SaaS-сервисов. Около 43 минут простоя в месяц — заметно, но терпимо для большинства бизнес-приложений.

99.99% («четыре девятки»)

  • В год: ~52 минуты простоя
  • В месяц: ~4.3 минуты
  • В неделю: ~1 минута

Высокий уровень, требующий серьёзной инженерии: резервирование, автоматическое восстановление, отсутствие единых точек отказа. Характерен для критичной инфраструктуры и платёжных систем.

99.999% («пять девяток»)

  • В год: ~5 минут 15 секунд простоя
  • В месяц: ~26 секунд

Легендарные «пять девяток» — крайне высокий уровень, достижимый только при значительных инвестициях в отказоустойчивость. Свойственен телеком-инфраструктуре и критичным системам. Для большинства бизнесов избыточен и неоправданно дорог.

Почему каждая девятка дорожает экспоненциально

Ключевая закономерность: переход к каждому следующему уровню надёжности стоит непропорционально дороже предыдущего.

Перейти от 99% к 99.9% относительно несложно — это вопрос базовой инженерной аккуратности. Перейти от 99.9% к 99.99% — уже серьёзная задача: нужно резервирование, устранение единых точек отказа, автоматическое восстановление. А переход к 99.999% требует кратно больших вложений ради сокращения простоя на считанные минуты в год.

Поэтому выбор целевого уровня доступности — это не «чем выше, тем лучше», а экономическое решение: сколько стоит дополнительная девятка и оправдывают ли её клиенты и бизнес-модель.

Подводные камни в расчётах и обещаниях

Период имеет значение

99.9% в месяц и 99.9% в год — разные обязательства. Месячный расчёт строже: один длинный сбой сильнее бьёт по месячной цифре, чем размывается в годовой. Всегда уточняйте период.

Что включается в простой

Сервис, исключающий плановые работы из расчёта uptime, покажет более красивую цифру, чем тот, кто их учитывает. При сравнении важно понимать методику.

Среднее скрывает распределение

99.9% можно набрать одним сбоем на 43 минуты или сорока сбоями по минуте. Для клиента это очень разный опыт, хотя цифра одинаковая. Средний uptime не показывает частоту и характер сбоев.

Региональная и частичная доступность

Если сервис недоступен в одном регионе, но работает в других, как считать uptime? Усреднённая цифра может скрывать, что для части клиентов всё лежало.

Как измерять и показывать uptime честно

Честный подход к uptime включает:

  • Чёткое определение простоя — что считается недоступностью.
  • Указание периода — за месяц, квартал, год.
  • Прозрачность методики — включаются ли плановые работы, как учитывается частичная доступность.
  • Публикацию истории, а не только средней цифры — чтобы видны были частота и характер сбоев.

Статус-страница — естественное место для честного отображения uptime. Платформы вроде StatusMate показывают доступность по каждому компоненту с историей по дням, что даёт клиентам не только итоговый процент, но и наглядную картину того, как и когда случались сбои — куда более честное представление, чем одна усреднённая цифра.

Лучшие практики

  • Выбирайте целевой uptime осознанно, исходя из потребностей клиентов и стоимости каждой девятки, а не из стремления к максимуму.
  • Всегда указывайте период при упоминании уровня доступности.
  • Чётко определите, что считается простоем, и придерживайтесь этого определения.
  • Показывайте историю, а не только среднее. Распределение сбоев важнее усреднённой цифры.
  • Измеряйте uptime по опыту клиента, учитывая региональную и частичную доступность.
  • Делайте метрики публичными — это укрепляет доверие и дисциплинирует команду.

Частые ошибки

  • Называть uptime без периода. «99.9%» без указания «за месяц/год» — неполная и потому вводящая в заблуждение цифра.
  • Манипулировать определением простоя. Исключение плановых работ или частичных сбоев ради красивой цифры подрывает доверие при разоблачении.
  • Гнаться за лишними девятками. Стремление к 99.999% без реальной потребности — пустая трата ресурсов.
  • Показывать только среднее. Усреднённый uptime скрывает частоту и характер сбоев, важные для клиента.
  • Игнорировать региональную доступность. Усреднение по регионам прячет, что для части клиентов сервис лежал.
  • Путать заявленный и фактический uptime. Обещание в SLA и реальная измеренная доступность — разные вещи; меряйте факт.

Часто задаваемые вопросы

Сколько простоя в месяц допускает 99.9%?
Около 43 минут. За год это примерно 8 часов 45 минут. Каждая дополнительная девятка сокращает допустимый простой примерно в десять раз.

В чём разница между 99.9% и 99.99%?
Десятая доля процента на бумаге, но на практике огромная: 99.9% — это ~43 минуты простоя в месяц, а 99.99% — всего ~4.3 минуты. Достижение 99.99% требует кратно больших инженерных вложений.

Какой uptime считается хорошим?
Для большинства SaaS-сервисов стандарт — 99.9%. Критичная инфраструктура и платёжные системы стремятся к 99.99% и выше. «Хороший» уровень зависит от потребностей клиентов и цены простоя.

Нужно ли стремиться к 99.999%?
В большинстве случаев нет. «Пять девяток» крайне дороги и оправданы только для критичной инфраструктуры. Для обычного бизнеса они избыточны.

Включать ли плановые работы в расчёт uptime?
Это вопрос методики. Честнее их учитывать или явно указывать, что они исключены. Скрытое исключение ради красивой цифры подрывает доверие.

Почему средний uptime может вводить в заблуждение?
Потому что одна цифра не показывает распределение сбоев. 99.9% можно набрать одним длинным сбоем или множеством коротких — для клиента это совершенно разный опыт.

Заключение

Uptime — простая по формуле, но обманчиво глубокая по интерпретации метрика. Базовый расчёт сводится к доле времени работы от общего времени, но за красивыми процентами скрываются важные нюансы: период расчёта, определение простоя, распределение сбоев и региональная доступность. Знаменитые «девятки» переводятся в конкретное время простоя, и разница между ними экспоненциальна — как по эффекту, так и по стоимости достижения.

Главный практический вывод: выбирайте целевой уровень доступности осознанно, исходя из реальных потребностей и стоимости каждой девятки, и показывайте uptime честно — с указанием периода, чёткой методикой и публичной историей, а не одной усреднённой цифрой. Статус-страница с прозрачными метриками доступности превращает uptime из маркетингового лозунга в проверяемое обязательство, которому клиенты могут доверять.

🎉 Готовы получить вашу страницу?

Занимает 15 секунд

Не требуется карта

Бесплатно