Какова средняя цена SLA для поддержки AI-систем в 2026 году?

· ·

PrimeCoder · 2026 · спека

Средняя цена SLA для поддержки AI-систем в 2026 году в России — это 45–90 тысяч рублей в месяц за контур из 3–5 моделей. Диапазон широкий, потому что «поддержка AI» в договоре может означать всё что угодно: от перезапуска упавшего эндпоинта до дообучения модели на новых данных. Второе стоит как отдельный проект, и если подрядчик зашил это в абонентскую плату, готовьтесь к чеку на 300+ тысяч. Ниже — спецификация того, что должно быть в договоре за эти деньги, как считать справедливую цену и где подрядчики разводят на деньги.

Что входит в SLA для AI-систем в 2026 году

Классический SLA из ITIL описывает доступность сервиса, время реакции и ответственность сторон. Для AI-систем этого мало. Модель может быть доступна, но выдавать мусор после изменения входных данных. Поэтому в договоре на поддержку AI в 2026 году должно быть три контура:

  • Инфраструктурный контур. Сервер, GPU, API-шлюз, база данных. Тут работает обычный SLA: аптайм 99.5–99.9%, время реакции на инцидент P1 — 15–30 минут, P2 — 2–4 часа.
  • Контур качества модели. Это метрики: точность, полнота, доля отказов от генерации. Если модель начала «галлюцинировать» или качество упало на N процентов — это инцидент, а не «так получилось». В 2026 году это обязательный пункт, без него SLA — фикция.
  • Контур изменений. Обновление модели, добавление новых данных в промпт, смена провайдера API. Это не поддержка, это развитие. Должно быть вынесено в отдельный прайс или в пакет часов.

Если подрядчик предлагает SLA только по аптайму — это мусор. Модель может работать 99.9% времени, но отвечать ерундой. Вы платите за результат, а не за то, что процесс не упал.

Сколько стоит: разбор по контурам

Цена SLA складывается из трёх составляющих. Не дайте себя запутать.

Базовая поддержка (инфраструктура)

Это 30–50 тысяч рублей в месяц для малого бизнеса. Включает мониторинг, реакцию на инциденты, перезапуск сервисов, обновление зависимостей. По сути — тот же SLA, что для обычного сайта, но с поправкой на GPU-нагрузку и специфику ML-стека.

Поддержка качества модели

Это 20–40 тысяч рублей дополнительно. Сюда входит мониторинг метрик, разбор инцидентов с «плохими ответами», корректировка промптов, работа с датасетами для дообучения. Именно этот контур отличает AI-поддержку от обычной техподдержки.

Развитие и дообучение

Отдельная статья. Если вы хотите, чтобы модель училась на новых данных каждый месяц, это не поддержка, это разработка. Бюджет — от 100 тысяч рублей за итерацию. Не верьте подрядчикам, которые обещают «постоянное улучшение модели» в рамках абонентской платы за 60 тысяч. Это либо некачественная работа, либо скрытые доплаты.

Итого: реалистичный бюджет на поддержку AI-системы в 2026 году — 50–90 тысяч рублей в месяц. Всё, что дешевле 40 тысяч — это просто мониторинг доступности с человеческим лицом. Всё, что дороже 150 тысяч — либо enterprise-масштаб с выделенной командой, либо вас разводят.

Как проверить адекватность цены: таблица «было → стало»

Параметр Типичный договор 2023–2024 Что писать в 2026
Предмет договора «Поддержка программного обеспечения» «Поддержка ML-моделей и инфраструктуры их исполнения»
Критерий качества Аптайм 99.5% Аптайм 99.5% + точность модели не ниже X% + доля отказов не выше Y%
Инцидент Сервер недоступен Сервер недоступен ИЛИ качество ответов упало ниже порога
Время реакции P1 — 30 минут, P2 — 4 часа P1 — 15 минут, P2 — 2 часа, P3 (качество) — 1 рабочий день
Изменения Не описаны Отдельный пакет часов или прайс на дообучение
Отчётность Нет или «по запросу» Ежемесячный отчёт: аптайм, метрики, инциденты, изменения

Если в договоре, который вам предлагают, нет строки про качество модели — это не SLA для AI, это обычный договор на поддержку сервера. Цена должна быть ниже.

Ночной инцидент: как это работает на практике

Сценарий, который стоит показать подрядчику до подписания договора. Пример для сайта среднего бизнеса в РФ с чат-ботом на базе YandexGPT или GigaChat.

02:14. Чат-бот на сайте начинает отвечать невпопад. Клиенты жалуются, но вы спите. Система мониторинга фиксирует: доля отказов выросла с 2% до 40% за 10 минут. Это P1-инцидент, хотя сервер работает.

Что должен сделать подрядчик по нормальному SLA:

  1. 02:15 — автоматическая алерт-система уведомляет дежурного инженера.
  2. 02:20 — инженер подтверждает инцидент в Telegram-чате (FRT — 5 минут, это время первого ответа человека, не бота).
  3. 02:35 — инженер откатывает модель на предыдущую стабильную версию. Качество восстановлено.
  4. 09:00 — утром вы получаете разбор: причина (изменился формат входных данных от стороннего API), что сделано, что нужно изменить, чтобы не повторилось.

Это стоит 60–90 тысяч в месяц. Если подрядчик предлагает «дежурного, который посмотрит утром» — это не SLA, это 20 тысяч рублей за иллюзию безопасности.

Что писать в договоре: формулировки для вставки

Возьмите эти абзацы и вставьте в свой договор или ТЗ. Они закрывают основные споры.

3.1. Исполнитель обеспечивает доступность Сервиса на уровне не менее 99.5% времени в месяц. Доступность измеряется как отношение времени, когда Сервис отвечал на запросы, к общему времени в отчётном периоде.

3.2. Исполнитель обеспечивает контроль качества ответов Модели. Критерий качества: доля отказов (ответов, не соответствующих заданному формату или отклонённых автоматической валидацией) не должна превышать 5% от общего числа запросов. При превышении порога в течение 15 минут фиксируется инцидент уровня P1.

3.3. Время реакции на инцидент: P1 (сервис недоступен или качество ниже порога) — 15 минут в рабочее и нерабочее время; P2 (частичная деградация) — 2 часа в рабочее время; P3 (вопросы, не влияющие на работу) — 1 рабочий день.

3.4. Изменения, не связанные с восстановлением работоспособности (дообучение модели, изменение промптов, добавление новых функций), не входят в абонентскую плату и оплачиваются отдельно по согласованной смете.

3.5. Ежемесячно, не позднее 5 числа следующего месяца, Исполнитель предоставляет отчёт: аптайм, динамика метрик качества, перечень инцидентов и время их устранения, перечень изменений.

Эти формулировки — минимум. Если подрядчик отказывается включать пункт 3.2 про качество — бегите. Он не умеет работать с AI и хочет продать вам обычную поддержку серверов по цене AI-поддержки.

Где подрядчики разводят на деньги

Три типичные схемы, которые стоит знать.

Схема 1: «Аптайм вместо качества». В договоре только доступность сервера. Модель генерирует мусор — это не инцидент по договору. Вы платите за то, что процесс работает, а не за результат. Решение: требуйте пункт про метрики качества, как в блоке выше.

Схема 2: «Бесплатное дообучение». Подрядчик обещает «постоянное улучшение модели» в рамках абонентской платы. Через месяц выясняется, что дообучение — это отдельный проект за 200 тысяч. Решение: сразу разделяйте поддержку и развитие. В договоре должно быть написано, что входит, а что нет.

Схема 3: «Человек вместо автоматизации». Вам продают «выделенного инженера» за 150 тысяч в месяц. По факту это фрилансер, который отвечает в рабочее время и не имеет доступа к ночным дежурствам. Решение: проверяйте, кто реально будет дежурить. Спросите имя и график. Если «команда» — попросите список людей и их роли.

Как считать справедливую цену: формула

Не хотите переплачивать — посчитайте сами. Формула простая:

Базовая ставка инженера (в 2026 году — 150–250 тысяч рублей в месяц за senior ML-инженера) × доля времени, которую он реально тратит на ваш проект + накладные расходы подрядчика (20–30%) + инфраструктура мониторинга (5–15 тысяч).

Пример: если ваш проект требует 20% времени инженера (это примерно 1 день в неделю), то справедливая цена — 30–50 тысяч за инженера + 10 тысяч за мониторинг + накладные. Итого 40–70 тысяч. Всё, что выше 90 тысяч — либо вы занимаете 50% времени команды, либо вас разводят.

Проверьте себя: сколько инцидентов у вас было за последние полгода? Если 2–3, и все решались за час — вам не нужен выделенный инженер. Вам нужен хороший мониторинг и подрядчик на подхвате. Это 30–40 тысяч.

Что не входит в SLA и за что не платите

Чёткие границы, чтобы не было споров.

  • Дообучение на новых данных. Это разработка. Если вы хотите, чтобы модель учитывала новые товары, новые вопросы клиентов — это отдельный проект.
  • Изменение архитектуры. Переход с одной модели на другую, смена провайдера, оптимизация скорости — это не поддержка.
  • Работа с данными. Сбор, разметка, очистка датасетов — это отдельная услуга, часто дороже самой поддержки.
  • Интеграция с новыми системами. Подключение к новой CRM, телефонии, мессенджеру — это разработка.

Если подрядчик пытается включить эти пункты в абонентскую плату — либо цена будет неадекватной, либо качество пострадает. Разделяйте.

FAQ: скрытые вопросы про цену SLA

Почему цены так различаются у разных подрядчиков?

Потому что под словом «поддержка AI» одни понимают перезапуск сервера, а другие — контроль качества модели и работу с промптами. Уточняйте, что входит в договор. Разница в 2–3 раза часто объясняется не качеством, а составом услуг.

Можно ли сэкономить и взять поддержку без ночных дежурств?

Можно, если ваш сервис работает с 9 до 18 и ночные сбои некритичны. Но для клиентских сервисов это риск. Один ночной инцидент с ботом, который отвечает ерундой, может стоить дороже годовой экономии. Решайте по критичности.

Что будет, если срезать пункт про качество модели?

Вы сэкономите 10–20 тысяч в месяц. Но получите ситуацию, когда модель «работает», но отвечает не то. Формально подрядчик выполнил свои обязательства. Фактически — вы платите за бесполезный сервис. Не рекомендую.

Как проверить, что подрядчик реально мониторит качество?

Попросите скриншот дашборда с метриками за прошлый месяц. Если дашборда нет — мониторинга нет. Если есть, но метрики «идеальные» — попросите показать, как фиксируются инциденты. Прозрачный подрядчик покажет и то, и другое.

Стоит ли брать SLA у вендора модели (OpenAI, YandexGPT)?

У вендора вы получаете SLA на API — доступность и скорость. Но вендор не отвечает за то, как модель ведёт себя в вашем сценарии. Вам всё равно нужен кто-то, кто настраивает промпты, следит за качеством и интегрирует. Обычно это разные подрядчики.

Как часто нужно пересматривать SLA?

Раз в год — обязательно. Модели меняются, провайдеры меняют условия, ваш бизнес меняется. Если подрядчик не предлагает пересмотр — это плохой знак. Значит, ему выгоден текущий договор, а не ваши результаты.

На этой неделе: три действия

  1. Возьмите текущий договор на поддержку и проверьте, есть ли в нём пункт про качество модели. Если нет — запросите у подрядчика коммерческое предложение с этим пунктом. Сравните цену.
  2. Посчитайте, сколько инцидентов было за последние 6 месяцев и сколько времени они заняли. Если меньше 5 — вам не нужен выделенный инженер, нужен хороший мониторинг.
  3. Напишите подрядчику письмо с формулировками из раздела «Что писать в договоре» и попросите подтвердить, что они готовы на таких условиях. Ответ покажет, кто перед вами.

Средняя цена SLA для AI-систем в 2026 году — 50–90 тысяч рублей. Но правильная цена — та, которая закрывает ваши риски, а не та, что написана в прайсе. Считайте по формуле, проверяйте договор и не платите за «аптайм», когда вам нужен результат.

Комментарии (4)

  • PrimeCoder Team · Официальный ответ · PrimeCoder

    Пришлите формат отчётности (дашборд / таблица / «на глаз») — подскажем минимальный набор метрик на старт.

  • Зоя · Операционный менеджер

    Как вы измеряете долю решённых с первого касания после внедрения сценариев?

  • Арсений · CEO

    Какой горизонт вы закладываете на стабилизацию процесса после go-live?

  • Камилла · Customer Success

    Как вы связываете NPS/CSAT с изменениями в сценариях, а не только с «настроением» клиентов?

Обсудить на сайте