ИИ-агенты

Сколько стоит ИИ-агент: цена разработки и цена работы

У ИИ-агента две цены. Разовая — разработка от 20 000 ₽: разбор задачи, промпт, база знаний, подключение канала. Ежемесячная — расход токенов: сколько агент потратил на ответы, столько и стоила его работа. Фиксированной ставки за месяц нет, потому что расход зависит от потока обращений и длины запроса. Данные агентства ЭТОБОТ на 16 сентября 2026 года.

16 мин чтения Дмитрий Киселев, основатель ЭТОБОТ и ЭТОЧАТБОТ

«Сколько стоит ИИ-агент» — вопрос с двумя ответами, и в смете обычно виден только первый. Разработка считается один раз, работа агента — каждый месяц, потому что каждый ответ тратит токены. Ниже — из чего складывается и то и другое, что раздувает счёт и когда агент не нужен вовсе.

Короткий ответ

  1. Разовая часть — разработка от 20 000 ₽. Сюда входит разбор задачи, промпт, база знаний, подключение канала и правило, по которому агент передаёт разговор человеку. Точная цифра называется после разбора задачи и до начала работ.
  2. Ежемесячная часть — расход токенов. Стоимость работы агента равна стоимости токенов, которые он потратил. Фиксированной ставки за месяц у агента нет: месяц с десятью обращениями и месяц с тысячей стоят по-разному.
  3. Поддержка — от 5 000 ₽ в месяц. Отдельная строка: наблюдение, правки промпта, реакция на изменения в мессенджерах.
  4. Расход считается как «число обращений × длина запроса × цена модели». В журнале сервиса ЭТОЧАТБОТ на 445 524 сообщения приходится 85 905 диалогов — около пяти сообщений на диалог. Считать расход надо по таким коротким диалогам, а не по воображаемым длинным беседам.
  5. Счёт сильно зависит от настройки. В замере кэш промпта отдал 8 064 токена входа из 8 202 — 98 %. А тот же по сути ответ без режима рассуждения стоил 126 токенов выхода вместо 1 133.

Из чего складывается цена ИИ-агента: четыре уровня

Словом «ИИ-агент» называют четыре разные работы. Разница не в модели — модель у них может быть одна и та же. Разница в том, сколько в агенте мест, которые надо описать, проверить и потом чинить.

УровеньЧто умеетЧто определяет цену
Автоответчик по частым вопросамотвечает на 10–20 типовых вопросов по короткому промптучисло вопросов и число каналов
Агент с базой знанийотвечает по вашим материалам: условия, прайс, страницы сайтаобъём материалов и то, в каком виде они пришли
Агент внутри сценарияразговаривает словами, а заявку, запись и оплату отдаёт сценариючисло точек стыковки со сценарием
Агент с инструментамисмотрит наличие, статус заказа, пишет данные в вашу системуесть ли у системы открытый API и что делать при её отказе

Вилок по уровням в таблице нет намеренно. Опубликованных цен у нас две: от 20 000 ₽ за разработку и от 5 000 ₽ в месяц за поддержку. Любые другие цифры по уровням были бы взяты с потолка — смету считают по задаче, а не по строке из статьи. Общий разбор по типам подрядчиков есть в статье про то, сколько стоит разработка чат-бота.

Разовую часть двигают вверх число каналов, объём материалов и требование к точности формулировок. Последнее дороже всего: если ответ нельзя перефразировать — в нём цена или условие возврата, — свободу агента приходится жёстко ограничивать и проверять каждый случай руками.

Откуда берётся месячный расход токенов

Расход считается по одной формуле:

число обращений × длина одного запроса × цена токена у выбранной модели

Длина запроса — это не только вопрос клиента. В модель уходит всё сразу: системный промпт, выдержки из базы знаний, история переписки, описания доступных агенту инструментов и сам ответ. Клиент написал восемь слов, а запрос получился на несколько тысяч токенов.

Четыре вещи, которые двигают счёт:

  1. Длина системного промпта. Он уходит в каждый запрос целиком. Промпт на восемь тысяч токенов при сотне обращений — это восемьсот тысяч токенов только на инструкции, без единого слова клиента.
  2. База знаний. Под каждый вопрос подмешиваются подходящие куски материалов. Чем шире тема и чем хуже материалы нарезаны, тем больше кусков уходит в запрос «на всякий случай».
  3. История переписки. Если агент учитывает предыдущие сообщения, каждый следующий ответ в диалоге дороже предыдущего. Это нужная настройка, но она платная.
  4. Модель. Цена за токен у разных моделей различается кратно. Самая частая переплата — дорогая модель на вопросе «а вы работаете в субботу».

Чтобы прикинуть порядок, нужен свой поток обращений. Дальше — снимок нашей базы на 16 сентября 2026 года, по нему видно, из каких диалогов состоит реальная переписка.

КаналБотов на движкеИз них активных
Instagram*325176
Telegram7054
Вебчат на сайте1616
МАКС118
ВКонтакте44

Всего в системе 323 кабинета, 366 сценариев, 85 905 диалогов и 445 524 сообщения с апреля 2026 года. Важная оговорка, без которой цифры читаются неправильно: это боты пользователей сервиса ЭТОЧАТБОТ, созданные ими на нашем движке, а не заказные проекты агентства. Мы сделали инструмент и видим его журналы — больше эти числа ни о чём не говорят.

Вывод для расчёта один: типовой диалог короткий — около пяти сообщений, считая оба голоса. Значит и вызовов модели в одном диалоге единицы, а не десятки. Точную цифру по вашему потоку даёт только первый месяц работы, прикидка до запуска её не заменяет.

Как ошибка в справочнике цен завысила счёт: разобранный случай

История из нашего движка, которая объясняет, почему за списаниями надо смотреть.

Цена ответа берётся из каталога моделей по ключу модели. Провайдер в ответе возвращает не тот ключ, который мы отправили, а снимок версии — например, gpt-4o-mini-2024-07-18 вместо gpt-4o-mini. Такого ключа в каталоге нет, поиск цены не находил совпадения и уходил в дорогой запасной вариант. В итоге за ответ списывалось шесть единиц вместо одной. Модель работала правильно, ответы были нормальные, ошибок в журнале не было — просто счёт шёл не по той цене. Ошибка была наша: пришла жалоба на счёт, нашли причину по журналу списаний и починили.

Что из этого следует для заказчика:

  • спрашивайте, по какому справочнику считается расход и что происходит, когда провайдер возвращает неизвестное имя модели;
  • просите показать журнал списаний хотя бы за первую неделю, а не только итог месяца;
  • сверяйте число вызовов модели с числом диалогов: двадцать вызовов на диалог из пяти сообщений — это вопрос к логике агента, а не к цене токенов.

Это же причина, по которой мы не называем ставку за месяц: в ставке не видно, сколько потратил агент, а проверить можно только то, что видно в журнале.

Что снижает месячный счёт

Здесь работают не уговоры, а замеры. Ниже — что дало эффект у нас.

Кэш промпта. Провайдеры считают повторно отправленное начало запроса дешевле. В нашем замере из 8 202 токенов входа 8 064 пришли из кэша — 98 %. Условий два: начало запроса не должно меняться, и оно должно быть длиннее примерно тысячи токенов — короткий промпт не кэшируется вообще. Если в первой строке промпта стоит текущее время или имя клиента, кэш не сработает ни разу, и полная цена будет платиться за одни и те же инструкции. Честная деталь: первый наш замер показал ноль кэша, и нулём оказался не кэш, а запрос к журналу — колонки в нём были перечислены не полностью. Пока не проверен измеритель, его цифрам верить рано.

Отказ от режима рассуждения. Режим, в котором модель «думает» перед ответом, стоит токенов и времени. Один и тот же вопрос: без рассуждения ответ пришёл за 2,6 секунды и 126 токенов выхода. С рассуждением на среднем уровне размышления съели все 400 токенов лимита за 6,1 секунды — до ответа дело не дошло. С лимитом 2 000 ответ появился, но стоил 1 133 токена выхода, 960 из них на размышления, и оказался тем же самым. Размышления считаются по цене выхода, которая дороже входа, и в кэш не попадают. На первой линии поддержки рассуждение почти всегда лишнее.

Модель под задачу, а не одна на всё. Разбор фотографии и ответ про часы работы — разные задачи. Держать всё на одной дорогой модели проще, но тогда каждый ответ стоит как самый сложный.

Короткая история. Учитывать всю переписку нужно не всегда: часто хватает последних сообщений — вход сокращается, качество не падает.

А теперь то, чего делать нельзя. Резать промпт «на глаз», чтобы сэкономить, — плохая идея. Мы один раз сократили промпт разумно, как казалось, и слепое сравнение ответов до и после дало счёт 12:5 не в пользу новой версии. Экономия на входе была, качество упало. Правка промпта без замера — не экономия, а лотерея.

Чем ИИ-агент отличается от сценарного бота

Сравнение нужно не ради интереса: от него зависит, платите вы фиксированную сумму один раз или каждый месяц.

Что сравниваемСценарный ботИИ-агент
Как отвечаетзаранее написанным текстом по нажатой кнопкеформулирует ответ сам по вашим материалам
Вопрос не по сценариюмолчит или ведёт в тупикотвечает, если ответ есть в базе знаний
Цена работыот числа обращений почти не зависитрасход токенов растёт вместе с обращениями
Предсказуемостьответ известен до запускаответ каждый раз новый, нужен выборочный контроль
Что нужно от заказчикакарта диалога и тексты кнопокматериалы: условия, прайс, правила, частые вопросы
Как ошибаетсяуходит не той веткой, это видно сразуотвечает уверенно и неверно, это заметно не сразу
Чем чинитсяправка кнопки или веткиправка промпта и базы знаний, с замером до и после

На деле в рабочем боте стоят оба. Сценарий отвечает за деньги и данные — заявку, запись, оплату. Агент отвечает за слова — вопросы, которых в меню нет. Связка дешевле агента на всё: дорогую модель не спрашивают о том, что показывает кнопка. Что делает у нас ИИ-агент на первой линии, описано на главной.

Ограничения каналов, которые агент не обходит

Ни одна модель не меняет правила мессенджеров. Умный агент в канале, где нельзя писать первым, всё равно не напишет первым.

КаналКто делает первый шагЧто это значит для агента
Telegramчеловек нажимает «Запустить»без точки входа агенту не с кем разговаривать
ВКонтактесообщество пишет подписчику первым, бессрочноагент может вернуться к старому диалогу без окон и ограничений по времени
МАКСчеловек начинает диалогнужна верификация профиля и доверенный российский корневой сертификат
Instagram*комментарий, реакция на сторис или кодовое слово в личных сообщенияхпервый директ уходит как Private Reply, и попытка одна

Про Instagram* подробнее, потому что там больше всего ботов на нашем движке. Написать первым нельзя — официальный API такой возможности не даёт. Легальных входов три: ответ на комментарий, реакция на сторис и кодовое слово в личных сообщениях. Первый директ после комментария уходит как Private Reply, и попытка ровно одна: отказ сжигает слот, повтор не помогает, помогает публичная подсказка в комментариях. Разбор по четырём каналам — в статье про то, кто может написать клиенту первым. WhatsApp в России мы не продаём.

Отдельная техническая мина в МАКС: обращения к его API требуют доверенного российского корневого сертификата. Без него запросы не проходят, и со стороны это выглядит как «агент молчит, а ошибок нет». Ещё в МАКС бота может завести только организация, ИП или самозанятый — резидент РФ, и профиль проходит верификацию. Она занимает несколько рабочих дней и от подрядчика не зависит.

Когда ИИ-агент не нужен

Честный ответ дешевле для обеих сторон, поэтому вот случаи, когда мы отговариваем.

  • Обращений единицы в неделю. Расход токенов будет копеечный, но разработка не окупится. Меню из пяти кнопок закроет задачу.
  • Почти все вопросы одинаковые. Если четыре пятых переписки — «сколько стоит», «где вы находитесь», «во сколько работаете», то сценарий отвечает быстрее, точнее и без расхода токенов.
  • Нет материалов. Агент отвечает по вашим текстам. Если текстов нет, он честно скажет, что не знает, и никакая модель этого не исправит.
  • Ответ нельзя перефразировать. Юридические формулировки, дозировки, условия возврата — тут нужен заранее написанный текст, а не пересказ.
  • Некому передать разговор. Агент обязан уметь позвать человека. Если человека нет, агент лишь быстрее доведёт клиента до момента, когда ему никто не отвечает.
  • Рассылка по базе телефонов в Telegram. Такой возможности нет ни у бота, ни у агента: бот пишет только тому, кто нажал «Запустить», и по номеру телефона человека не находит.

Как считаем мы

Порядок работы простой.

  1. Разбираем переписку: какие вопросы приходят, сколько их, какие закрываются кнопкой, а какие требуют слов.
  2. Делим задачу на две части — что отдаём сценарию, что агенту, — и считаем разовую смету от 20 000 ₽. Смета называется до начала работ.
  3. Собираем промпт и базу знаний, ставим правило «зову человека», замеряем ответы до и после каждой правки. Без замера правка не считается сделанной.
  4. После запуска приводим расход в порядок по журналу: кэш, модель по задаче, длина истории. Стоимость работы агента — стоимость его токенов, она видна в цифрах, а не в тарифе.
  5. Поддержка — от 5 000 ₽ в месяц. Отдельно помогаем оплачивать зарубежные ИИ-сервисы иностранными картами: часть моделей из России картой не оплачивается, и в разработку это не входит.

Сроков мы не обещаем: они зависят от того, как быстро приходят доступы, материалы и правки. Единственный известный срок — верификация профиля в МАКС, несколько рабочих дней, и она от нас не зависит. Наши цены на разработку и поддержку есть на главной, а задачу можно обсудить в нашем боте в Telegram.

Что запомнить

  1. У ИИ-агента две цены: разработка от 20 000 ₽ один раз и расход токенов каждый месяц; поддержка — от 5 000 ₽ в месяц отдельной строкой.
  2. Ставки за месяц у работы агента нет: платите за токены, которые агент потратил, и цифра меняется вместе с потоком обращений.
  3. Расход считается как «обращения × длина запроса × цена модели»; типовой диалог в журнале сервиса ЭТОЧАТБОТ — около пяти сообщений.
  4. Кэш промпта снимает почти весь вход: в замере 8 064 токена из 8 202, то есть 98 %, — но только если начало запроса не меняется и само по себе длиннее тысячи токенов.
  5. Режим рассуждения на первой линии обычно лишний: тот же ответ обошёлся в 126 токенов выхода вместо 1 133.
  6. Ошибка в справочнике цен дороже любой модели: снимок версии от провайдера не совпал с каталожным ключом, и списывалось шесть единиц вместо одной.
  7. Резать промпт без замера нельзя: «разумное» сокращение дало при слепом сравнении 12:5 не в пользу новой версии.

Частые вопросы

Сколько стоит ИИ-бот?

Разработка ИИ-бота в агентстве ЭТОБОТ — от 20 000 ₽, поддержка — от 5 000 ₽ в месяц. Работа самого агента считается отдельно, по расходу токенов: сколько агент потратил на ответы, столько и стоила его работа. Одной цифры за месяц не существует: чем больше обращений и чем длиннее запрос, тем больше расход. Точную смету называем после разбора задачи.

Какая стоимость ИИ-чат-бота в месяц?

Месячная стоимость складывается из двух строк: расход токенов и поддержка от 5 000 ₽ в месяц. Расход токенов зависит от числа обращений, длины промпта и выбранной модели, поэтому одной цифры для всех нет. В журнале сервиса ЭТОЧАТБОТ типовой диалог — около пяти сообщений, и считать месячный расход надо от такого объёма, а не от долгих бесед.

Где купить ИИ-чат-бота и на что смотреть в смете?

Купить ИИ-чат-бота можно у агентства или собрать в конструкторе самостоятельно. В смете смотрите на три вещи: входит ли база знаний и её подготовка, как считается расход токенов и есть ли правило передачи разговора человеку. Если расход токенов в смете заменён фиксированной ставкой за месяц, спросите, что произойдёт при росте обращений вдвое.

Можно ли заказать ИИ-агента для бизнеса под ключ?

Да, но «под ключ» стоит разложить на части: промпт, база знаний, подключение канала, правило «зову человека» и наблюдение после запуска. Разработка — от 20 000 ₽, поддержка — от 5 000 ₽ в месяц, работа агента — по расходу токенов. Сроков не обещаем: они зависят от того, как быстро с вашей стороны приходят материалы и доступы.

От чего зависит расход токенов ИИ-агента?

От четырёх вещей: числа обращений, длины системного промпта, объёма подмешанной базы знаний и цены выбранной модели. Промпт уходит в модель при каждом запросе целиком, поэтому промпт на восемь тысяч токенов при сотне обращений — это восемьсот тысяч токенов только на инструкции. Кэш промпта снижает этот расход: в нашем замере 98 % входа пришли из кэша.

Чем ИИ-агент отличается от чат-бота по сценарию?

Сценарный бот отвечает заранее написанным текстом по нажатой кнопке, и его работа не зависит от числа обращений. ИИ-агент формулирует ответ сам по вашим материалам, и каждый ответ тратит токены. В рабочем боте обычно стоят оба: сценарий отвечает за заявку, запись и оплату, агент — за вопросы, которых в меню нет.

Может ли ИИ-агент писать клиентам первым?

Зависит от канала, а не от агента. Во ВКонтакте сообщество пишет подписчику первым бессрочно — никакого окна 24 часа у ВК нет. В Telegram бот пишет только тому, кто нажал «Запустить», в МАКС — только после того, как человек сам начал диалог. В Instagram* написать первым нельзя совсем: остаются ответ на комментарий, реакция на сторис и кодовое слово в личных сообщениях.

Как оплатить зарубежные ИИ-сервисы из России?

Часть ИИ-сервисов российской картой не оплачивается. Мы помогаем провести оплату иностранными картами — это отдельные деньги, а не часть разработки и не часть поддержки. Планируя бюджет ИИ-агента, закладывайте три строки: разовую разработку от 20 000 ₽, расход токенов и оплату зарубежного сервиса, если выбранная модель работает только так.

Сколько стоит поддержка ИИ-агента в месяц?

От 5 000 ₽ в месяц. В поддержку входит наблюдение за ответами, правки промпта и базы знаний с замером до и после, реакция на изменения в мессенджерах. Расход токенов в эту сумму не входит и считается отдельно. Агент без наблюдения портится незаметно: ответы остаются гладкими, а верными быть перестают.

Нужен бот, который делает это у вас?

Читать дальше