SYSTEM ATLASЗагрузка материала

SLO — цель уровня сервиса

Service Level Objective (SLO)

Задает целевой диапазон надежности для выбранного индикатора.

Простыми словами

Представьте обещание внутри команды: не «работать идеально», а доставлять вовремя не меньше 99 из 100 заказов. SLO задаёт приемлемую цель для выбранного показателя, поэтому помогает решать, когда улучшать надёжность, а когда можно быстрее выпускать изменения.

Пример от @Vibeclakr

Пример при разработке

Команда ставит цель: 99,95% корректных запросов к API за 28 дней. Цель связывает пользовательское ожидание с решениями о релизах.

Это редакционный пример применения, а не часть определения или доказательство концепции.

Механизм действия

Сначала проверяют, есть ли исходное условие из определения. Затем смотрят, как оно влияет на структуру компонентов, потоки данных, ограничения и действия участников. Если эту связь не удаётся наблюдать, принцип не стоит использовать как готовое объяснение.

Пример в работе

Нерабочий подход

Применять локальное решение без проверки контекста, ограничений и вторичных последствий.

Системный подход

Сначала определить механизм, затем выбрать минимальное изменение и измерить результат.

Ограничения

«SLO — цель уровня сервиса» объясняет только часть происходящего в области «Надежность и SRE». Сам принцип не говорит, насколько сильным будет эффект в вашем случае, и не заменяет измерения. При другом масштабе, среде или временном горизонте результат может отличаться.

Источник

Betsy Beyer, Chris Jones, Jennifer Petoff, Niall Richard Murphy. Site Reliability Engineering: Service Level Objectives. 2016. ISBN 9781491929124.

Первоисточник