ИИ-агенты

ИИ-агент или кнопочный бот: что выбрать под свою задачу

ИИ-агент или кнопочный бот — выбор не между старым и новым, а между двумя видами расходов. Кнопки стоят денег один раз и работают на любом потоке одинаково. Агент считается по токенам: каждый ответ тратит деньги. В рабочем боте обычно стоят оба — кнопки держат заявку и оплату, агент отвечает словами. Разработка — от 20 000 ₽.

14 мин чтения Дмитрий Киселев, основатель ЭТОБОТ и ЭТОЧАТБОТ

Вопрос «ИИ-агент или чат-бот» задают как выбор одного из двух. На практике выбор другой: какую часть разговора отдать заранее написанному сценарию, а какую — модели. Ниже — цена в обоих случаях, где кто ломается и по какой границе мы делим задачу.

Короткий ответ

  1. Кнопочный бот — расход один раз. Разработка от 20 000 ₽, дальше цена работы от числа обращений почти не зависит: сто диалогов и три тысячи стоят одинаково.
  2. ИИ-агент — расход каждый месяц. Стоимость его работы равна стоимости потраченных токенов. Фиксированной ставки за месяц нет: месяц с десятью обращениями и месяц с тысячей стоят по-разному.
  3. Ошибаются они по-разному. Кнопочный бот упирается в тупик, и это видно сразу. Агент отвечает гладко и неверно, и это заметно не сразу.
  4. Граница проходит по деньгам и данным. Заявку, запись и оплату ведёт сценарий. Вопросы, которых нет в меню, ведёт агент.
  5. Поддержка — от 5 000 ₽ в месяц в любом из двух вариантов. Точная смета называется после разбора задачи и до начала работ.

ИИ-агент или чат-бот: в чём разница на самом деле

Разница не в уме и не в модели. Разница в том, кто написал ответ и когда.

Кнопочный бот отвечает текстом, который написали вы до запуска. Человек нажимает кнопку, бот отдаёт заготовленный текст и ведёт по нарисованной заранее ветке. Ошибиться в формулировке он не может: формулировка всегда одна и та же.

ИИ-агент формулирует ответ в момент разговора, опираясь на ваши материалы: условия, прайс, правила, частые вопросы. Он читает вопрос словами и отвечает словами. Поэтому закрывает вопросы, которых в меню нет, — и поэтому его ответ каждый раз немного новый.

Отсюда и разница в цене: за кнопки платят один раз, за слова — каждый раз.

Одна задача, два исполнения: где кто уместен

Возьмём обычный разговор с клиентом по шагам. В последней колонке — кому шаг отдаём.

Шаг разговораКнопочный ботИИ-агентКому отдаём
Приветствие и менючетыре–шесть кнопок, ответ мгновенныйсправится, но тратит токены на то, что показывает кнопкакнопкам
«Сколько стоит»работает, если вариантов немногоработает, если прайс есть в базе знанийкнопкам, пока прайс короткий
Вопрос своими словамитупик или «выберите пункт меню»основная работаагенту
Сбор заявки: имя, телефонстрогие поля, ничего не теряетсяможет переспросить или исказитькнопкам
Запись на конкретное времясписок свободных слотовпридумать слот нельзя ни при каких настройкахкнопкам
Оплатассылка или счёт из сценарияне касается денег вообщекнопкам
«Позовите человека»отдельная кнопкадолжен узнать просьбу по словамобоим

Колонки не конкурируют. Кнопки надёжны там, где список вариантов конечный. Агент нужен там, где он бесконечный, — то есть в свободном тексте.

Что дешевле: кнопки или ИИ

Сравнивать надо не цену разработки, а структуру расхода. Разработка в обоих случаях считается от 20 000 ₽ по объёму работы, а дальше расходы расходятся.

Строка расходаКнопочный ботИИ-агент
Разработкаот 20 000 ₽, разовоот 20 000 ₽, разово
Работа при сотне обращенийотдельной строкой нетрасход токенов
Работа при трёх тысячах обращенийотдельной строкой нетрасход токенов, заметно больше
Поддержкаот 5 000 ₽ в месяцот 5 000 ₽ в месяц
Оплата зарубежного ИИ-сервисане нужнаиногда нужна, иностранной картой
Что нужно от заказчикакарта диалога и тексты кнопокматериалы: условия, прайс, правила, частые вопросы
Что происходит при росте потокацена не меняетсяцена растёт вместе с обращениями

Вывод из таблицы: у кнопочного бота расход предсказуем, у агента переменный. Это не недостаток, а свойство, которое надо заложить в бюджет. Разбор двух цен — разовой и токенной — в статье про то, сколько стоит ИИ-агент.

Отдельная строка, о которой забывают: часть ИИ-сервисов российской картой не оплачивается. Мы помогаем провести оплату иностранными картами, но в разработку и поддержку она не входит — это третьи деньги.

Кнопочный бот или нейросеть: где кто ошибается

Надёжность мерится не процентами, а тем, как выглядит отказ.

Кнопочный бот ошибается громко. Уводит не той веткой, показывает пустой список или молчит на вопрос вне меню. Это видит клиент, видите вы, видно в журнале. Чинится правкой кнопки или ветки — без замеров и сюрпризов.

ИИ-агент ошибается тихо. Ответ остаётся вежливым и уверенным, а факт в нём неверный. Ошибки в журнале нет: с точки зрения системы агент отработал штатно. Поэтому без наблюдения его не оставляют — приёмы, которыми ограничивают свободу модели, разобраны отдельно, чтобы ИИ-агент не придумывал.

Три случая из нашей практики, которые объясняют, почему тихие ошибки опасны.

  • Измеритель врёт в сторону «всё хорошо». Накопитель неотвеченных вопросов писался у нас в одном исходе — «не знал и ничего не сделал». Случай «и не уверен, и зову человека» проходил мимо: разговор уезжал оператору, вопрос считался обработанным. Список пробелов выглядел короче, чем был. Спрашивать подрядчика надо не «есть ли накопитель», а в каких именно исходах вопрос туда попадает.
  • Правка промпта на глаз даёт регресс. Наше «разумное» сокращение промпта слепое сравнение забраковало: вход стал короче, а ответы хуже. С тех пор правка промпта без замера у нас не считается сделанной.
  • Режим рассуждения на первой линии обычно лишний. Модель «думает» перед ответом, размышления считаются по цене выхода и в кэш не попадают, а клиент получает тот же ответ, который та же модель без рассуждения выдаёт быстрее и дешевле.

У кнопок таких историй не бывает: там нечему рассуждать и нечего придумывать.

Почему в рабочем сценарии обычно стоят оба

Связка дешевле и надёжнее любой из частей по отдельности. Правило деления простое.

  • Сценарий отвечает за деньги и данные. Заявка, запись, оплата, выдача доступа — всё, где ошибка стоит денег и где нужен строгий формат.
  • Агент отвечает за слова. Вопросы не из меню, уточнения, переформулировки, «а можно вот так».
  • Агент передаёт разговор сценарию. Понял, что человек хочет записаться, — отдал ветке записи, а не собирает данные сам.
  • Сценарий зовёт агента. Кнопка «другой вопрос» ведёт не в тупик, а в свободный разговор.

Побочный эффект связки — экономия: дорогую модель не спрашивают о том, что показывает кнопка. «Во сколько работаете» закрывается без расхода токенов. Как устроен у нас ИИ-агент на первой линии, описано в разделе на главной.

Где проходит граница: что нельзя отдавать агенту

Дело не в недоверии к моделям, а в цене ошибки. Перечисленное ниже всегда остаётся за сценарием.

  1. Цена и условия возврата. Ответ, который нельзя перефразировать, пишется заранее: пересказ здесь — новый смысл.
  2. Запись на конкретное время. Слот берётся из расписания или не берётся вовсе: если разрешить модели отвечать самой, она может сочинить время.
  3. Оплата. Ссылку на оплату и сумму отдаёт сценарий, а не текст ответа.
  4. Персональные данные. Там, где человек диктует телефон или адрес, начинаются требования к обработке данных: строгие поля сценария удобнее свободного текста.
  5. Юридические и медицинские формулировки. Дозировки, условия договора, правила обслуживания — только заранее написанный текст.
  6. Сроки. Ни сценарию, ни агенту нельзя разрешать обещать дату, которой у вас нет.

Всё остальное агент закрывает тем лучше, чем лучше подготовлены материалы: первая работа при запуске — не промпт, а база знаний ИИ-агента.

Что выбрать: бот или ИИ — четыре замера по своей переписке

Решение принимается по вашим диалогам, а не по описаниям. Порядок такой.

  1. Возьмите последние сто обращений — выгрузку из мессенджера или CRM, а не воспоминания.
  2. Посчитайте, сколько закрывается пятью кнопками: часы работы, адрес, цена, «как заказать», «где заказ». Если таких четыре из пяти, нужен сценарий, а не модель.
  3. Посчитайте уникальные вопросы — те, что встретились один раз и своими словами. Если их каждое второе обращение, кнопки будут упираться в тупик, а агент окупится.
  4. Посчитайте шаги до денег. Если между первым сообщением и оплатой три-четыре шага, вкладываться надо в шаги, а не в красоту ответов.

Ограничения каналов, которые не снимает ни кнопка, ни модель

Ни сценарий, ни агент не меняют правил мессенджеров: умный агент в канале, где нельзя писать первым, первым не напишет.

КаналКто делает первый шагЧто это значит для бота
Telegramчеловек нажимает «Запустить»без точки входа разговаривать не с кем; рассылки по базе телефонов нет
ВКонтактесообщество пишет подписчику первым, бессрочноможно вернуться к старому диалогу; никакого окна 24 часа у ВК нет
МАКСчеловек начинает диалогнужна верификация профиля и доверенный российский корневой сертификат
Instagram*комментарий, реакция на сторис или кодовое слово в личных сообщенияхпервый директ уходит как Private Reply, и попытка одна

Три уточнения, которые меняют смету чаще всего.

  • Telegram. Бот пишет только тому, кто нажал «Запустить», и по номеру телефона человека не находит: рассылки по базе телефонов не существует ни у сценария, ни у агента.
  • Instagram*. Написать первым нельзя: официальный API такой возможности не даёт. Легальных входов три — ответ на комментарий, реакция на сторис и кодовое слово в личных сообщениях. Первый директ после комментария уходит как Private Reply, и попытка ровно одна: отказ сжигает слот, повтор не помогает, помогает публичная подсказка в комментариях. Разбор по всем четырём каналам — в статье о том, кто может написать клиенту первым.
  • МАКС. Завести бота может организация, ИП или самозанятый — резидент РФ. Профиль проходит верификацию, она занимает несколько рабочих дней и от подрядчика не зависит. Обращения к API МАКС требуют доверенного российского корневого сертификата: без него запросы не проходят, и выглядит это как «бот молчит, а ошибок нет». Кабинет — business.max.ru.

WhatsApp в России мы не продаём.

Когда ИИ-агент не нужен

Честный отказ дешевле для обеих сторон, поэтому вот случаи, когда мы отговариваем.

  • Обращений единицы в неделю. Расход токенов будет копеечный, но разработка не окупится: меню из пяти кнопок закроет задачу.
  • Почти все вопросы одинаковые. Если четыре пятых переписки — «сколько стоит», «где вы», «во сколько работаете», сценарий отвечает быстрее, точнее и без расхода токенов.
  • Нет материалов. Агент отвечает по вашим текстам. Если текстов нет, он честно скажет, что не знает, и никакая модель этого не исправит.
  • Ответ нельзя перефразировать. Юридические формулировки, дозировки, условия возврата — только заранее написанный текст.
  • Некому передать разговор. Агент обязан уметь позвать человека. Если человека нет, агент лишь быстрее доведёт клиента до момента, когда ему никто не отвечает.

Когда кнопок недостаточно

Обратная сторона той же честности: бывает, что меню уже не спасает.

  • Меню разрослось. Больше восьми пунктов в первом экране и подменю третьего уровня — человек перестаёт искать и пишет словами.
  • Половина обращений начинается свободным текстом. Клиенты не читают кнопки, а сразу спрашивают, и кнопочный бот работает как заслонка.
  • Оператор отвечает одно и то же разными словами. Ответ есть, но в кнопку он не формализуется.

Как считаем мы

  1. Разбираем переписку: какие вопросы приходят, сколько их, какие закрываются кнопкой, какие требуют слов.
  2. Делим задачу на две части — что отдаём сценарию, что агенту — и собираем сценарную часть первой. Она работает без расхода токенов и снимает основную массу обращений.
  3. Подключаем агента на вторую линию, ставим правило «не знаю — зову человека» и замеряем ответы до и после каждой правки промпта. Без замера правка не считается сделанной.
  4. После запуска приводим расход в порядок по журналу: модель под задачу, длина истории переписки, что уходит в кэш.
  5. Разработка — от 20 000 ₽, поддержка — от 5 000 ₽ в месяц. Точную смету называем после разбора задачи и до начала работ; цены на разработку и поддержку есть на главной.

Сроков мы не обещаем: они зависят от того, как быстро приходят доступы, материалы и правки. Единственный известный срок — верификация профиля в МАКС, несколько рабочих дней, и она от нас не зависит. Задачу можно обсудить в нашем боте в Telegram.

Что запомнить

  1. Спор идёт не между старым и новым, а между разовым расходом и переменным: кнопки оплачиваются один раз, слова агента — на каждом ответе.
  2. Разработка считается от 20 000 ₽ в обоих случаях, поддержка — от 5 000 ₽ в месяц, и ни то ни другое не заменяет расход токенов. Точная смета — после разбора задачи.
  3. Отказ кнопочного бота виден сразу; ошибка агента остаётся гладкой формулировкой с неверным фактом, и в журнале её нет.
  4. Измерителю агента нельзя верить, пока не проверено, в каких исходах он записывает неотвеченный вопрос. Короткий список пробелов чаще означает дырявый учёт, а не полную базу знаний.
  5. Деньги и данные — заявка, запись, оплата, персональные данные, юридические формулировки — остаются за сценарием всегда, даже когда агент отвечает хорошо.
  6. Решение принимается по выгрузке последних ста обращений: доля вопросов, которые закрываются пятью кнопками, и есть ответ.
  7. Правила каналов от наличия модели не меняются: в Telegram и МАКС бот вступает в разговор только после старта, во ВКонтакте сообщество пишет первым и бессрочно, в Instagram* первым написать нельзя.

Частые вопросы

ИИ-агент или чат-бот — что выбрать?

Выбирают по типу вопросов. Если обращения типовые и закрываются пятью кнопками, хватит кнопочного бота: разработка от 20 000 ₽, дальше расход почти не зависит от потока. Если люди пишут своими словами и вопросы каждый раз разные, нужен ИИ-агент, а его работа считается по расходу токенов. В рабочем боте обычно стоят оба.

Что выбрать: бот или ИИ для ответов клиентам?

Начинать разумнее со сценария, а ИИ добавлять на вторую линию. Сценарий закрывает часы работы, адрес, прайс и заявку без расхода токенов, агент разбирает остальное. Обратный порядок дороже: дорогая модель отвечает на вопрос, на который хватало кнопки. Разработка — от 20 000 ₽, поддержка — от 5 000 ₽ в месяц.

Кнопочный бот или нейросеть: что надёжнее?

Кнопочный бот предсказуем: ответ написан заранее и не меняется, а ошибка выглядит как тупик и видна сразу. ИИ-агент отвечает на вопросы вне меню, но ошибается тихо — формулировка остаётся гладкой, а факт неверным, и в журнале это не отражается. Поэтому деньги и данные мы оставляем сценарию, а агента держим под наблюдением.

Сколько стоит ИИ-агент по сравнению с кнопочным ботом?

Разработка в обоих случаях считается от 20 000 ₽ и зависит от объёма задачи. Разница дальше: у кнопочного бота отдельной строки за работу нет, у ИИ-агента есть — расход токенов, который растёт вместе с числом обращений. Поддержка — от 5 000 ₽ в месяц в любом варианте. Точная смета называется после разбора задачи.

Можно ли заменить все кнопки одним ИИ-агентом?

Технически можно, практически не стоит. Запись на конкретное время, оплата, сбор телефона и адреса требуют строгого формата: модель может переспросить, исказить или сочинить. Такие шаги остаются за сценарием. Плюс каждый ответ агента тратит токены, поэтому отдавать ему вопрос «во сколько работаете» — переплата за то, что показывает кнопка.

Может ли ИИ-агент писать клиентам первым?

Зависит от канала, а не от агента. Во ВКонтакте сообщество пишет подписчику первым бессрочно — окна 24 часа у ВК нет. В Telegram бот пишет только тому, кто нажал «Запустить», в МАКС — после того, как человек начал диалог. В Instagram* написать первым нельзя: остаются комментарий, реакция на сторис и кодовое слово в личных сообщениях.

Что делает ИИ-агент, когда не знает ответа?

Правильно настроенный агент говорит, что не знает, и передаёт разговор человеку. Это правило задаётся при разработке, само оно не появляется: без него модель отвечает наугад, и ответ выглядит уверенным. Проверять надо не наличие списка неотвеченных вопросов, а то, в каких исходах вопрос в него попадает: у нас он однажды пропускал случай «и не уверен, и зову человека».

Нужен ли ИИ-агент, если обращений мало?

При единицах обращений в неделю расход токенов будет копеечным, но разработка не окупится: меню из пяти кнопок закроет задачу дешевле. Агент имеет смысл, когда поток постоянный и заметная доля вопросов приходит свободным текстом. Считать надо по выгрузке последних ста обращений, а не по ощущению, что «клиенты всё время что-то спрашивают».

Нужен бот, который делает это у вас?

Читать дальше