Перейти к содержимому

SLA для критичных систем и обычных задач

В договоре написано «оперативно», и при каждом сбое начинается спор: авария это или обычная заявка. Соглашение об уровне сервиса — Service Level Agreement (SLA) — снимает спор заранее: называет системы, без которых работа встаёт, разводит классы событий и отдельно фиксирует, когда начинается работа и что считается её завершением. Услуги по SLA — техническая поддержка пользователей и систем, наблюдение, выезды — описываются составом, режимом и сроками.

Первый звонок инженера — около 30 минут в рабочее время. Разбираем вашу ситуацию — без презентации.

  • Реакция до 15 минут — это начало работы по аварии, а не её решение
  • Четыре класса событий: остановка важного процесса, серьёзный сбой, обычная заявка, плановая задача
  • Доступность 99,9% — отдельный показатель, а не обещание отсутствия сбоев
  • Выполнение SLA за 2025 год — 99,2%

Когда «оперативно» в договоре перестаёт работать

Каждый сбой начинается со спора о срочности, руководитель не может проверить качество поддержки, а исполнители по-разному понимают, что считать аварией.

Пока критичные системы не названы, спор повторится при следующей поломке.

Четыре класса событий и что они означают

Класс события определяется влиянием на работу компании, а не громкостью обращения.

Классы событий — это и есть уровни технической поддержки: для каждого записаны канал, порядок передачи дальше и сроки. Состав поддерживаемых систем, режим и исключения стороны фиксируют до старта, когда договариваются об уровне обслуживания.

01Остановка важного процессаКритичная бизнес-функция или согласованный критичный сервис не работает, и стабильная работа компании прерывается. Реакция — до 15 минут: столько проходит до начала работы, а учёт времени простоя ведётся отдельно от времени реакции.
02Серьёзный сбойВажная система работает с деградацией или задета значительная часть пользователей. Сроки реакции и решения задаёт договор.
03Обычная заявкаКлючевой процесс не остановлен: первый звонок инженера — около 30 минут в рабочее время, остальные сроки задаёт договор.
04Плановая задачаИзменение, консультация или развитие: выполняется по согласованному плану и регламенту, со своими сроками и окнами работ.
05Проверка качестваПятый пункт — контроль поверх четырёх классов: канал, время, класс, статус и итог остаются в истории обращения, а ежемесячный отчёт показывает, как соблюдались сроки и стандарты обслуживания.

Что меняется, когда сроки записаны

Спор о срочности происходит один раз — в спокойном разговоре до подписания договора.

Сотрудники понимают, куда обращаться и чего ждать, инженеры видят класс и порядок передачи дальше, а руководитель проверяет по данным отчёта, как работает техническая поддержка.

Сейчас
С услугой
В договоре написано «оперативно», и каждый сбой начинается с разговора о том, насколько он срочный.

Класс события определён заранее по влиянию на работу: остановка важного процесса, серьёзный сбой, обычная заявка и плановая задача идут разными маршрутами.

Время реакции принимают за срок полного решения, поэтому ожидания расходятся с тем, что происходит на деле.

Реакция до 15 минут по аварии означает начало работы. Восстановление и окончательное устранение причины — отдельные величины со своими условиями, и мы называем их раздельно.

Критичным объявляют всё сразу, поэтому короткие сроки перестают что-либо значить.

Критичность определяет бизнес-функция: платежи, отгрузка, валютный контроль, станок. Критичным может быть и один компьютер — если от него зависит такая функция и это записано до старта.

Короткие сроки обещаны, но копий нет, наблюдения нет, а половина систем никому не известна.

До подписания смотрим, хватает ли инфраструктуре зрелости: резервные копии, наблюдение, регламентная эксплуатация и обязанности сторон. Что нужно исправить сразу, отделяем от того, что уйдёт в план работ.

Качество поддержки оценивают по отдельным жалобам, а причины повторов не видит никто.

Оценка становится проверяемой: ежемесячные отчёты доступны всем абонентским клиентам, и в каждом видны обращения по классам, соблюдение сроков, повторяющиеся причины и предложения по устранению.

Ответственность описана общими словами, и при простое стороны спорят уже о самом факте инцидента.

Порядок фиксации инцидента, границы, исключения и внешние зависимости записываем до старта. Финансовую ответственность обсуждаем уже на этих согласованных условиях.

Покажем, какие классы событий и сроки имеет смысл записать. Расскажите, что останавливает работу компании и на сколько.

Как собирается соглашение

Сначала называем функции, остановка которых стоит денег, и системы, от которых они зависят.

Затем разводим классы событий, разделяем начало работы и её завершение и проверяем, хватает ли инфраструктуре зрелости для выбранных сроков. Условия SLA — какие услуги в SLA входят, режим, сроки и исключения — фиксируются в соглашении об уровне сервиса (Service Level Agreement) и в договоре, а их соблюдение видно в ежемесячном отчёте.

  1. 01

    Называем критичные функции

    Что именно останавливает работу компании и что требует бесперебойной работы: платежи, отгрузка, касса, производственная линия, конкретная база или рабочее место.

  2. 02

    Разводим классы событий

    Остановка важного процесса, серьёзный сбой, обычная заявка и плановая задача получают свои маршруты, контакты и сроки.

  3. 03

    Разделяем начало и завершение работы

    Для каждого класса отдельно записываем время реакции, время восстановления и то, что считается полным решением.

  4. 04

    Проверяем зрелость инфраструктуры

    Резервные копии, мониторинг, регламентная эксплуатация и обязанности сторон: без них не бывает ни коротких сроков, ни бесперебойной работы.

  5. 05

    Фиксируем в договоре и измеряем

    Состав систем, режим, исключения и порядок фиксации инцидента, а затем ежемесячный отчёт: ключевые метрики соблюдения сроков.

Сроки и границы

Что записано в договоре, а что — нет

Реакция, восстановление, полное решение и доступность — четыре разные величины: соглашение называет их раздельно, и разговор об уровне обслуживания становится предметным.

Что фиксируем в договоре

  • Реакция до 15 минут на остановку критичной бизнес-функции или согласованного критичного сервиса — начало работы, а не полное решение за то же время.
  • Сроки остальных классов записаны в соглашении об уровне обслуживания: о каждом классе стороны договариваются до старта.
  • Доступность 99,9% — отдельный показатель работы согласованных систем.

Что согласуем отдельно

  • Компенсация любого простоя и обещание отсутствия простоев вовсе.
  • Финансовая ответственность до согласования критичных сервисов, отказоустойчивости, резервного копирования, наблюдения, регламентной эксплуатации и обязанностей клиента.
  • до 15 минутреакция на критичную аварию
  • 99,9%целевая доступность по договору

Реакция и решение измеряются раздельно

Критичные системы названы поимённо до старта

Ежемесячный отчёт — всем клиентам на сопровождении

Доступность 99,9% не означает отсутствия отдельных сбоев.

Что остаётся у компании

Список критичных систем с владельцами, понятные классы событий, разведённые сроки начала и завершения работы, порядок фиксации инцидента и ежемесячная картина по соблюдению сроков — то, на чём держится стабильная работа согласованных систем.

Перечень критичных системКритичные функции, их зависимость от информационных систем и владельцы со стороны компании названы заранее — до первой аварии.
Понятные классы событийОстановка важного процесса, серьёзный сбой, обычная заявка и плановая задача разделены и не претендуют на один срок.
Разведённые срокиНачало работы, время восстановления и полное решение измеряются раздельно и по своим правилам.
Порядок при инцидентеКонтакты, последовательность шагов и способ фиксации известны заранее обеим сторонам.
Ежемесячный отчётВидно, как соблюдались сроки, что повторяется и какие исключения сработали.
Записанные границыПоддерживаемые системы, режим, исключения, внешние зависимости и зоны ответственности сторон описаны в договоре.

Стоимость

От чего зависит цена

После обследования считаем ежемесячный платёж. На него влияют режим работы и требования к срокам реакции, число пользователей и площадок, состав критичных систем и наблюдения, условия выездов. Стартовые работы по подготовке инфраструктуры считаем отдельно. Подготовим предварительное предложение в течение 48 часов после того, как получим достаточно данных о вашей ИТ-инфраструктуре и задачах.

Как считаем стоимость

Стоимость считаем после обследования

Ежемесячный платёж зависит от состава критичных систем и выбранных сроков реакции. Стартовые работы по подготовке инфраструктуры считаем отдельно.

Все цены и условия

Кто держит уровень сервиса

Обеспечиваем техническую поддержку по соглашению всей командой: первая линия принимает обращение и определяет класс, профильные инженеры восстанавливают работу, руководитель сервиса отвечает за сроки и отчёт, технический руководитель — за системные изменения.

В команде 20 штатных инженеров, без фриланса и ИТ-субподряда.

Первая линия

Принимает обращение, выясняет, что именно остановилось, и определяет класс события по согласованным правилам.

Профильные инженеры

Решение технических задач доводят до конца: восстанавливают работу систем и устраняют причину, а не ограничиваются временным обходом.

Руководитель сервиса

Отвечает за соблюдение сроков, разбор нарушений, исключения и содержание ежемесячного отчёта.

Технический руководитель

Проверяет системные изменения и риски, из-за которых короткие сроки могут стать невыполнимыми.

«Компания видит один сервис, а внутри у каждого класса события есть свой маршрут, ответственный и срок»
Иванов Николай Владимирович — основатель и руководитель Визард-АйТи

Материалы о сроках и уровне сервиса

Статьи помогут отличить начало работы от её завершения, разобраться, из чего складывается уровень сервиса (Service Level), подготовить перечень критичных функций и собрать вопросы к договору до его подписания.

Связанные материалы блога

Вопросы об уровне сервиса

Разбираем, что такое SLA (Service Level Agreement), что считается критичным, чем реакция отличается от решения, как классифицируются события, какая зрелость нужна для коротких сроков, что попадает в отчёт и где заканчивается ответственность исполнителя.

Какие бизнес-функции считаются критичными?
Те, остановка которых сразу бьёт по деньгам или обязательствам: платежи, отгрузка, касса, валютный контроль, производственная линия, закрытие периода. Критичной может оказаться и одна система, и один компьютер — если от него зависит такая функция. Повышенный уровень поддержки, сроки и отдельные регламенты начинают действовать только после того, как эта система названа и записана в соглашении.
Чем время реакции отличается от времени решения?
Реакция — момент, когда обращение принято и работа началась: по аварии — до 15 минут, по обычной заявке первый звонок инженера — около 30 минут в рабочее время. Решение — это восстановление работы и устранение причины, и оно зависит от того, что именно сломалось. Полное решение за время реакции мы не обещаем: это разные величины, и в отчёте они тоже стоят раздельно.
Как классифицируются события?
Четыре класса. Остановка важного процесса: критичная бизнес-функция или согласованный критичный сервис не работает — реакция до 15 минут. Серьёзный сбой: важная система работает с деградацией или задета значительная часть пользователей, сроки задаёт договор. Обычная заявка: ключевой процесс не остановлен. Плановая задача: изменение, консультация или развитие — идут по согласованному плану. Класс задаётся влиянием события на работу компании.
Какие условия зрелости нужны для коротких сроков?
Согласованные критичные сервисы, работающее резервное копирование, наблюдение за системами, регламентная эксплуатация, понятные обязанности клиента и — для самых критичных случаев — отказоустойчивость. Если ради выбранных сроков инфраструктуру сначала нужно привести в порядок, обязательные стартовые работы оцениваются и согласуются отдельно от ежемесячного платежа. Это же условие открывает разговор о финансовой ответственности.
Что попадает в отчётность?
Ежемесячный отчёт доступен всем клиентам на сопровождении: обращения по классам, соблюдение сроков, повторяющиеся причины, сработавшие исключения и предложения по устранению. Внутри мы разбираем время реакции и решения, работу групп сопровождения и повторяющиеся проблемы — и приносим на встречу готовые выводы.
Как соглашение связано с доступностью 99,9%?
Сроки реакции относятся к обработке обращения, а доступность — к работе согласованных систем за период. Это разные показатели, и складывать их нельзя: 99,9% не означает отсутствия отдельных инцидентов, а быстрая реакция не отменяет простоя. Границы и порядок расчёта доступности записываются в соглашении. Для справки: выполнение SLA за 2025 год составило 99,2%.
Где заканчивается ответственность исполнителя?
Записанные сроки действуют для поддерживаемых систем и согласованного режима. Договор перечисляет исключения, внешние зависимости — провайдер, вендор, поставщик оборудования, — окна работ и порядок согласования новых задач. Новые задачи оплачиваются отдельно от ежемесячного платежа. Отсутствия сбоев и компенсации любого простоя мы не обещаем.
Кто отвечает за приоритет заявки — мы или вы?
Обе стороны, но за разное. Вы оцениваете влияние на работу: что остановилось и у скольких людей — это знает только постановщик, поэтому поле «влияние» заполняется при регистрации. Мы переводим влияние и срочность в класс события, срок и маршрут и при необходимости повышаем класс сами — по числу затронутых пользователей. Матрицу «влияние × срочность» можно скачать в разделе материалов на этой странице.
От чего зависит стоимость сопровождения по SLA?
От режима работы и требований к срокам реакции, числа пользователей и площадок, состава критичных систем и наблюдения, условий выездов. Стартовые работы по подготовке инфраструктуры считаем отдельно. Подготовим предварительное предложение в течение 48 часов после того, как получим достаточно данных о вашей ИТ-инфраструктуре и задачах.

Смежные услуги направления

Соглашение об уровне сервиса опирается на повседневную техническую поддержку и мониторинг ИТ-инфраструктуры: без них короткие сроки остаются на бумаге.

Подберём SLA под ваши критичные функции

Опишите критичные процессы, режим работы и допустимое влияние сбоя. Инженер предложит классы событий, сроки и границы сервиса — то есть условия SLA под вашу ситуацию.

Информация о порядке обработки данных приведена в Политике обработки персональных данных.

Первый звонок инженера — около 30 минут в рабочее время. Разбираем вашу ситуацию — без презентации.

Информация о порядке обработки данных приведена в Политике обработки персональных данных.

Первый звонок инженера — около 30 минут в рабочее время. NDA подписываем по первому требованию, обращение ни к чему не обязывает.

Начните вводить запрос

Поиск по услугам, статьям и страницам