Какова средняя цена SLA для поддержки AI-систем в 2026 году?
PrimeCoder · 2026 · спека
Средняя цена SLA для поддержки AI-систем в 2026 году в России — это 45–90 тысяч рублей в месяц за контур из 3–5 моделей. Диапазон широкий, потому что «поддержка AI» в договоре может означать всё что угодно: от перезапуска упавшего эндпоинта до дообучения модели на новых данных. Второе стоит как отдельный проект, и если подрядчик зашил это в абонентскую плату, готовьтесь к чеку на 300+ тысяч. Ниже — спецификация того, что должно быть в договоре за эти деньги, как считать справедливую цену и где подрядчики разводят на деньги.
Что входит в SLA для AI-систем в 2026 году
Классический SLA из ITIL описывает доступность сервиса, время реакции и ответственность сторон. Для AI-систем этого мало. Модель может быть доступна, но выдавать мусор после изменения входных данных. Поэтому в договоре на поддержку AI в 2026 году должно быть три контура:
- Инфраструктурный контур. Сервер, GPU, API-шлюз, база данных. Тут работает обычный SLA: аптайм 99.5–99.9%, время реакции на инцидент P1 — 15–30 минут, P2 — 2–4 часа.
- Контур качества модели. Это метрики: точность, полнота, доля отказов от генерации. Если модель начала «галлюцинировать» или качество упало на N процентов — это инцидент, а не «так получилось». В 2026 году это обязательный пункт, без него SLA — фикция.
- Контур изменений. Обновление модели, добавление новых данных в промпт, смена провайдера API. Это не поддержка, это развитие. Должно быть вынесено в отдельный прайс или в пакет часов.
Если подрядчик предлагает SLA только по аптайму — это мусор. Модель может работать 99.9% времени, но отвечать ерундой. Вы платите за результат, а не за то, что процесс не упал.
Сколько стоит: разбор по контурам
Цена SLA складывается из трёх составляющих. Не дайте себя запутать.
Базовая поддержка (инфраструктура)
Это 30–50 тысяч рублей в месяц для малого бизнеса. Включает мониторинг, реакцию на инциденты, перезапуск сервисов, обновление зависимостей. По сути — тот же SLA, что для обычного сайта, но с поправкой на GPU-нагрузку и специфику ML-стека.
Поддержка качества модели
Это 20–40 тысяч рублей дополнительно. Сюда входит мониторинг метрик, разбор инцидентов с «плохими ответами», корректировка промптов, работа с датасетами для дообучения. Именно этот контур отличает AI-поддержку от обычной техподдержки.
Развитие и дообучение
Отдельная статья. Если вы хотите, чтобы модель училась на новых данных каждый месяц, это не поддержка, это разработка. Бюджет — от 100 тысяч рублей за итерацию. Не верьте подрядчикам, которые обещают «постоянное улучшение модели» в рамках абонентской платы за 60 тысяч. Это либо некачественная работа, либо скрытые доплаты.
Итого: реалистичный бюджет на поддержку AI-системы в 2026 году — 50–90 тысяч рублей в месяц. Всё, что дешевле 40 тысяч — это просто мониторинг доступности с человеческим лицом. Всё, что дороже 150 тысяч — либо enterprise-масштаб с выделенной командой, либо вас разводят.
Как проверить адекватность цены: таблица «было → стало»
| Параметр | Типичный договор 2023–2024 | Что писать в 2026 |
|---|---|---|
| Предмет договора | «Поддержка программного обеспечения» | «Поддержка ML-моделей и инфраструктуры их исполнения» |
| Критерий качества | Аптайм 99.5% | Аптайм 99.5% + точность модели не ниже X% + доля отказов не выше Y% |
| Инцидент | Сервер недоступен | Сервер недоступен ИЛИ качество ответов упало ниже порога |
| Время реакции | P1 — 30 минут, P2 — 4 часа | P1 — 15 минут, P2 — 2 часа, P3 (качество) — 1 рабочий день |
| Изменения | Не описаны | Отдельный пакет часов или прайс на дообучение |
| Отчётность | Нет или «по запросу» | Ежемесячный отчёт: аптайм, метрики, инциденты, изменения |
Если в договоре, который вам предлагают, нет строки про качество модели — это не SLA для AI, это обычный договор на поддержку сервера. Цена должна быть ниже.
Ночной инцидент: как это работает на практике
Сценарий, который стоит показать подрядчику до подписания договора. Пример для сайта среднего бизнеса в РФ с чат-ботом на базе YandexGPT или GigaChat.
02:14. Чат-бот на сайте начинает отвечать невпопад. Клиенты жалуются, но вы спите. Система мониторинга фиксирует: доля отказов выросла с 2% до 40% за 10 минут. Это P1-инцидент, хотя сервер работает.
Что должен сделать подрядчик по нормальному SLA:
- 02:15 — автоматическая алерт-система уведомляет дежурного инженера.
- 02:20 — инженер подтверждает инцидент в Telegram-чате (FRT — 5 минут, это время первого ответа человека, не бота).
- 02:35 — инженер откатывает модель на предыдущую стабильную версию. Качество восстановлено.
- 09:00 — утром вы получаете разбор: причина (изменился формат входных данных от стороннего API), что сделано, что нужно изменить, чтобы не повторилось.
Это стоит 60–90 тысяч в месяц. Если подрядчик предлагает «дежурного, который посмотрит утром» — это не SLA, это 20 тысяч рублей за иллюзию безопасности.
Что писать в договоре: формулировки для вставки
Возьмите эти абзацы и вставьте в свой договор или ТЗ. Они закрывают основные споры.
3.1. Исполнитель обеспечивает доступность Сервиса на уровне не менее 99.5% времени в месяц. Доступность измеряется как отношение времени, когда Сервис отвечал на запросы, к общему времени в отчётном периоде.
3.2. Исполнитель обеспечивает контроль качества ответов Модели. Критерий качества: доля отказов (ответов, не соответствующих заданному формату или отклонённых автоматической валидацией) не должна превышать 5% от общего числа запросов. При превышении порога в течение 15 минут фиксируется инцидент уровня P1.
3.3. Время реакции на инцидент: P1 (сервис недоступен или качество ниже порога) — 15 минут в рабочее и нерабочее время; P2 (частичная деградация) — 2 часа в рабочее время; P3 (вопросы, не влияющие на работу) — 1 рабочий день.
3.4. Изменения, не связанные с восстановлением работоспособности (дообучение модели, изменение промптов, добавление новых функций), не входят в абонентскую плату и оплачиваются отдельно по согласованной смете.
3.5. Ежемесячно, не позднее 5 числа следующего месяца, Исполнитель предоставляет отчёт: аптайм, динамика метрик качества, перечень инцидентов и время их устранения, перечень изменений.
Эти формулировки — минимум. Если подрядчик отказывается включать пункт 3.2 про качество — бегите. Он не умеет работать с AI и хочет продать вам обычную поддержку серверов по цене AI-поддержки.
Где подрядчики разводят на деньги
Три типичные схемы, которые стоит знать.
Схема 1: «Аптайм вместо качества». В договоре только доступность сервера. Модель генерирует мусор — это не инцидент по договору. Вы платите за то, что процесс работает, а не за результат. Решение: требуйте пункт про метрики качества, как в блоке выше.
Схема 2: «Бесплатное дообучение». Подрядчик обещает «постоянное улучшение модели» в рамках абонентской платы. Через месяц выясняется, что дообучение — это отдельный проект за 200 тысяч. Решение: сразу разделяйте поддержку и развитие. В договоре должно быть написано, что входит, а что нет.
Схема 3: «Человек вместо автоматизации». Вам продают «выделенного инженера» за 150 тысяч в месяц. По факту это фрилансер, который отвечает в рабочее время и не имеет доступа к ночным дежурствам. Решение: проверяйте, кто реально будет дежурить. Спросите имя и график. Если «команда» — попросите список людей и их роли.
Как считать справедливую цену: формула
Не хотите переплачивать — посчитайте сами. Формула простая:
Базовая ставка инженера (в 2026 году — 150–250 тысяч рублей в месяц за senior ML-инженера) × доля времени, которую он реально тратит на ваш проект + накладные расходы подрядчика (20–30%) + инфраструктура мониторинга (5–15 тысяч).
Пример: если ваш проект требует 20% времени инженера (это примерно 1 день в неделю), то справедливая цена — 30–50 тысяч за инженера + 10 тысяч за мониторинг + накладные. Итого 40–70 тысяч. Всё, что выше 90 тысяч — либо вы занимаете 50% времени команды, либо вас разводят.
Проверьте себя: сколько инцидентов у вас было за последние полгода? Если 2–3, и все решались за час — вам не нужен выделенный инженер. Вам нужен хороший мониторинг и подрядчик на подхвате. Это 30–40 тысяч.
Что не входит в SLA и за что не платите
Чёткие границы, чтобы не было споров.
- Дообучение на новых данных. Это разработка. Если вы хотите, чтобы модель учитывала новые товары, новые вопросы клиентов — это отдельный проект.
- Изменение архитектуры. Переход с одной модели на другую, смена провайдера, оптимизация скорости — это не поддержка.
- Работа с данными. Сбор, разметка, очистка датасетов — это отдельная услуга, часто дороже самой поддержки.
- Интеграция с новыми системами. Подключение к новой CRM, телефонии, мессенджеру — это разработка.
Если подрядчик пытается включить эти пункты в абонентскую плату — либо цена будет неадекватной, либо качество пострадает. Разделяйте.
FAQ: скрытые вопросы про цену SLA
Почему цены так различаются у разных подрядчиков?
Потому что под словом «поддержка AI» одни понимают перезапуск сервера, а другие — контроль качества модели и работу с промптами. Уточняйте, что входит в договор. Разница в 2–3 раза часто объясняется не качеством, а составом услуг.
Можно ли сэкономить и взять поддержку без ночных дежурств?
Можно, если ваш сервис работает с 9 до 18 и ночные сбои некритичны. Но для клиентских сервисов это риск. Один ночной инцидент с ботом, который отвечает ерундой, может стоить дороже годовой экономии. Решайте по критичности.
Что будет, если срезать пункт про качество модели?
Вы сэкономите 10–20 тысяч в месяц. Но получите ситуацию, когда модель «работает», но отвечает не то. Формально подрядчик выполнил свои обязательства. Фактически — вы платите за бесполезный сервис. Не рекомендую.
Как проверить, что подрядчик реально мониторит качество?
Попросите скриншот дашборда с метриками за прошлый месяц. Если дашборда нет — мониторинга нет. Если есть, но метрики «идеальные» — попросите показать, как фиксируются инциденты. Прозрачный подрядчик покажет и то, и другое.
Стоит ли брать SLA у вендора модели (OpenAI, YandexGPT)?
У вендора вы получаете SLA на API — доступность и скорость. Но вендор не отвечает за то, как модель ведёт себя в вашем сценарии. Вам всё равно нужен кто-то, кто настраивает промпты, следит за качеством и интегрирует. Обычно это разные подрядчики.
Как часто нужно пересматривать SLA?
Раз в год — обязательно. Модели меняются, провайдеры меняют условия, ваш бизнес меняется. Если подрядчик не предлагает пересмотр — это плохой знак. Значит, ему выгоден текущий договор, а не ваши результаты.
На этой неделе: три действия
- Возьмите текущий договор на поддержку и проверьте, есть ли в нём пункт про качество модели. Если нет — запросите у подрядчика коммерческое предложение с этим пунктом. Сравните цену.
- Посчитайте, сколько инцидентов было за последние 6 месяцев и сколько времени они заняли. Если меньше 5 — вам не нужен выделенный инженер, нужен хороший мониторинг.
- Напишите подрядчику письмо с формулировками из раздела «Что писать в договоре» и попросите подтвердить, что они готовы на таких условиях. Ответ покажет, кто перед вами.
Средняя цена SLA для AI-систем в 2026 году — 50–90 тысяч рублей. Но правильная цена — та, которая закрывает ваши риски, а не та, что написана в прайсе. Считайте по формуле, проверяйте договор и не платите за «аптайм», когда вам нужен результат.
PrimeCoder Team · Официальный ответ · PrimeCoder
Пришлите формат отчётности (дашборд / таблица / «на глаз») — подскажем минимальный набор метрик на старт.
Зоя · Операционный менеджер
Как вы измеряете долю решённых с первого касания после внедрения сценариев?
Арсений · CEO
Какой горизонт вы закладываете на стабилизацию процесса после go-live?
Камилла · Customer Success
Как вы связываете NPS/CSAT с изменениями в сценариях, а не только с «настроением» клиентов?