MOSCONE +7 967 552-15-55 Обсудить
AI и автоматизация

AI-агент для бизнеса: из чего складывается стоимость

7 минут чтения

Компании часто планируют бюджет на AI-агента так же, как на обычную фичу: посчитали разработку — успокоились. Но у AI-агента, в отличие от обычного модуля, есть постоянная статья расходов, которая появляется только после запуска и растёт вместе с использованием — счёт за обращения к модели. Разбираем, из чего на самом деле складывается полная стоимость.

Прежде чем разработать AI-агента на заказ, стоит понять реальную стоимость владения — не только разовую разработку.

Два вида затрат: разовые и постоянные

Статья расходовТипЧто входит
Разработка и интеграцияРазоваяЛогика агента, подключение к вашим системам (CRM, 1С, документооборот), тестирование
Инференс (обращения к модели)Постоянная, растёт с использованиемПлата за каждый запрос к модели — пропорционально объёму текста и числу обращений
Хостинг и инфраструктураПостояннаяСерверы, очереди, хранилище логов и истории диалогов
Мониторинг и доработкаПостояннаяОтслеживание качества ответов, обновление инструкций и контекста, реакция на новые сценарии

Ошибка, которая обходится дороже всего — планировать бюджет только по первой строке. Разработка агента, который проходит демо на пяти тестовых вопросах, стоит сильно дешевле, чем система, которая стабильно работает на тысячах реальных обращений в месяц — а разница в основном именно в постоянных расходах, а не в первоначальной разработке.

Соотношение затрат на разработку и эксплуатацию AI-агента во времени Затраты на разработку — разовые, происходят в начале и не растут. Затраты на инференс, хостинг и поддержку накапливаются со временем и на длинном горизонте превышают стоимость разработки. запуск 12 месяцев Накопленные затраты Разработка — разовая, фиксированная Инференс, хостинг, поддержка — растут с использованием
Разработка — это фиксированная сумма в начале. Эксплуатация — переменные расходы, которые накапливаются пропорционально тому, насколько активно агент используется.
Почему это делаем мы
То же самое, что мы говорим на первом созвоне — здесь коротко.
100% защищённость и гарантия
Вернём деньги, если не устроит процесс сотрудничества и результат в первый месяц.
Скорость и качество
Без срыва сроков и в 2 раза быстрее большинства студий. Багов практически нет, а те, что есть, чиним быстро.
100% прозрачность — личный кабинет
Доска, сроки, часы, счета и доступы в одном месте. Заполняется сам из наших рабочих систем.
Фикс-цена
Оговорённая цена не меняется в процессе. Фиксируем договорённости — без скрытых платежей.
Быстрый MVP — через месяц
Не презентация и не прототип: кусок системы, которым уже пользуются сотрудники.
Поддержка после запуска — 0₽
2 месяца бесплатной поддержки после запуска. Всегда на связи в рабочее время.

Что сильнее всего разгоняет расходы на инференс

Как снизить постоянные расходы, не теряя качество

Управлять стоимостью инференса можно осознанно, а не только смириться с ней:

Как выбрать подрядчика

Разработчика для такой задачи стоит выбирать по конкретным признакам, а не по общему впечатлению от презентации:

Частые вопросы

Что дороже — разработка AI-агента или его эксплуатация?

На коротком горизонте дороже разработка — это разовая работа с понятным объёмом. На горизонте года и дольше суммарные расходы на инференс (обращения к модели), хостинг и поддержку у активно используемого агента почти всегда обгоняют стоимость первоначальной разработки — особенно если агент обрабатывает много обращений или работает с длинным контекстом.

От чего зависит стоимость инференса — обращений к модели?

От трёх переменных: сколько обращений в единицу времени, сколько текста передаётся модели за один запрос (контекст — история диалога, документы, инструкции) и какая модель используется — более мощные и точные модели дороже за единицу текста, чем компактные. Длинный контекст на каждый запрос — самый частый источник неожиданно высоких счетов.

Можно ли снизить расходы на инференс без потери качества?

Да, несколькими способами: кешировать повторяющиеся ответы, направлять простые запросы на более дешёвую модель и оставлять мощную только для сложных случаев (маршрутизация по сложности), ограничивать контекст только действительно нужной информацией вместо передачи всей истории целиком, использовать собственную развёрнутую модель для высокочастотных простых задач вместо оплаты по счётчику за каждый запрос.

Нужно ли платить за модель отдельно от разработки?

Да, почти всегда это отдельная статья расходов — плата провайдеру модели за каждый запрос (или инфраструктура для собственной развёрнутой модели), независимо от того, кто и когда написал код агента. Стоимость разработки не включает будущие расходы на использование модели — это разные бюджетные линии, и их стоит планировать отдельно с самого начала.

Как оценить бюджет на AI-агента, если непонятно, сколько будет обращений?

Начать с пилота на ограниченном сценарии и реальном, но небольшом потоке обращений — это даёт фактическую цифру стоимости одного обращения, которую дальше можно умножить на ожидаемый объём при масштабировании, вместо того чтобы гадать заранее по абстрактным прогнозам.

Расскажите, какую задачу должен закрывать AI-агент — на созвоне за 40 минут прикинем не только стоимость разработки, но и реалистичный бюджет на эксплуатацию.

Обсудить проект