Сбер
GigaChat
0,2 ₽ / 1000 токенов
Единая ставка за генерацию текста. Минимальный платёж — 600 ₽ в месяц с НДС.
- Оплата в рублях, договор с российским юрлицом
- Подходит для типовых вопросов и FAQ
- Проверять на своих формулировках
Telegram · ИИ · база знаний
ИИ-бот отвечает на вопросы своими словами по вашей базе знаний, а не по дереву кнопок. Это единственный формат бота, у которого есть постоянная стоимость эксплуатации — и её надо посчитать до разработки, а не после первого счёта.
Коротко
Сценарный бот распознаёт заранее описанные варианты и отвечает заготовленным текстом. ИИ-бот получает вопрос как есть, вместе с вашей базой знаний, и формулирует ответ сам. Клиенту не нужно угадывать формулировку, а вам — заранее описывать все ветки.
Плата за это — три вещи, которых у сценарного бота нет: постоянные расходы на модель, вероятность уверенно сказанной неправды и задержка в несколько секунд перед ответом. Всё три управляемы, но их надо закладывать в проект с самого начала.
Экономика
Главный вопрос, который почти никто не считает до запуска. Считается он просто, и цифра получается неожиданно чувствительной к выбору модели.
| Что оплачивается | Токены на входе и на выходе. Вход — это ваш промпт, база знаний и вся история диалога, которые модель читает заново на каждом ответе. Выход — сгенерированный текст. Токен примерно равен половине русского слова. |
|---|---|
| Пример расчёта | База знаний и промпт — около 4 000 токенов. Диалог из десяти сообщений: 10 × 4 000 ≈ 40 000 входных токенов и около 2 000 выходных. Это один разговор с одним клиентом. |
| На дешёвой модели | При тарифе 0,2 ₽ за тысячу входных и 0,4 ₽ за тысячу выходных: 40 × 0,2 + 2 × 0,4 ≈ 8,8 ₽ за диалог. Тысяча диалогов в месяц — около 8 800 ₽. |
| На старшей модели | При тарифе 2 ₽ и 6 ₽ за тысячу: 40 × 2 + 2 × 6 ≈ 92 ₽ за диалог. Та же тысяча диалогов — около 92 000 ₽ в месяц. Код бота при этом одинаковый. |
| Что это значит | Разница между младшей и старшей моделью — примерно десятикратная. Поэтому модель выбирают по качеству ответов на ваших реальных вопросах, а не по позиции в маркетинговых сравнениях. Часто младшая справляется. |
Расчёт условный и нужен, чтобы показать порядок величин и как он устроен. Точная цифра зависит от размера вашей базы знаний, длины диалогов и доли обращений, которые бот закрывает сам.
Модели
Цены за тысячу токенов по открытым тарифам на 2026 год. Тарифы провайдеры пересматривают — перед стартом проверяйте актуальные.
Сбер
0,2 ₽ / 1000 токенов
Единая ставка за генерацию текста. Минимальный платёж — 600 ₽ в месяц с НДС.
Яндекс · младшая
0,2 ₽ вход / 0,4 ₽ выход
Рабочая лошадка для ботов поддержки и квалификации заявок.
Яндекс · старшие
1 / 2 ₽ и 2 / 6 ₽
Берут, когда младшая модель заметно хуже отвечает на реальных вопросах.
Официальные тарифы: GigaChat API. Тарифы YandexGPT приведены по открытым публикациям на 2026 год — перед стартом сверяйте с прайсом Яндекса. Зарубежные модели считают за миллион токенов и в долларах — например, у Anthropic это 5 $ за миллион входных и 25 $ за миллион выходных у старшей модели, 1 $ и 5 $ у младшей. Порядок величин сопоставим с российскими, но доступ и оплата из России — отдельный вопрос, который решают до проектирования.
Рычаги
Порядок — по величине эффекта. Первые два пункта дают кратную экономию, остальные — десятки процентов.
| 1. Кэширование префикса | Промпт и база знаний одинаковы во всех запросах — это повторяющийся префикс. Провайдеры, которые умеют его кэшировать, считают повторное чтение примерно по десятой доле цены. В примере выше 40 000 входных токенов превращаются в 7 600 по стоимости. Механизм есть не у всех — наличие проверяют до выбора модели. |
|---|---|
| 2. Выбор модели под задачу | Разница между младшей и старшей — десятикратная. Правильный порядок: собрать 30–50 реальных вопросов клиентов, прогнать через обе, сравнить ответы. Часто младшая отвечает не хуже, а стоит в десять раз меньше. |
| 3. Обрезка истории диалога | Если слать модели всю переписку, каждое следующее сообщение дороже предыдущего. Рабочий приём — держать последние несколько реплик плюс короткое резюме предыдущих, а не всю ленту. |
| 4. Подмешивать не всю базу | Вместо того чтобы класть в запрос весь регламент, ищут в нём 2–3 подходящих фрагмента и отправляют только их. Это и дешевле, и точнее: модели не приходится выбирать нужное из сотни страниц. |
| 5. Развилка до модели | Часть обращений — «здравствуйте», «спасибо», «а вы работаете сегодня». На них отвечает обычный код без обращения к модели. Это бесплатно и мгновенно. |
Качество ответов
Модель по устройству продолжает текст правдоподобным образом, а не сверяется с фактами. Поэтому она может уверенно назвать несуществующую цену или придумать условие доставки. Полностью убрать это нельзя — можно сузить пространство, в котором бот вообще говорит.
Бот получает вопрос вместе с фрагментами вашего регламента и отвечает по ним, а не по общим знаниям модели. Чего нет в базе — того он не знает. Это же делает ответы проверяемыми: видно, из какого куска он их взял.
Цены, сроки, гарантии, юридические условия — то, где ошибка стоит дорого. Их либо берут из базы дословно, либо бот говорит, что уточнит у специалиста. Формулировать «на глаз» он не должен.
Самое важное правило и его чаще всего забывают. Если подходящего фрагмента в базе нет, бот обязан передать диалог человеку, а не сочинить правдоподобный ответ. Это настройка, а не свойство модели.
Соберите 30–50 настоящих вопросов из переписки — включая неудобные и с опечатками — и прогоните через бота до того, как он увидит клиентов. Это единственный способ узнать, где он врёт, до того как это увидит покупатель.
Скорость и данные
Два практических вопроса, которые всплывают после запуска, если о них не подумали до.
Текст обращения уходит провайдеру модели — это внешняя обработка, и её место в политике обработки персональных данных. Практическое правило: телефон, адрес и номер заказа обрабатывает ваш код и хранит ваша база, а модель получает только формулировку вопроса.
У ботов с ИИ бывает всплеск обращений или зацикливание. Нужен потолок расходов в сутки и оповещение при его превышении — иначе счёт узнаётся постфактум.
История вопросов и ответов нужна не для отчётности, а чтобы видеть, на чём бот ошибается, и дописывать базу знаний.
Главная метрика качества. Если бот отдаёт человеку почти всё — база знаний слабая. Если почти ничего — стоит проверить, не выдумывает ли он.
Деньги
Здесь две суммы, и их важно не смешивать: разовая за бота и ежемесячная за модель.
| ИИ-менеджер с базой знаний — 19 990 ₽ | Мой формат: разово, срок 3–5 дней, установка на ваш сервер входит в цену, абонентской платы за самого бота нет. Для сравнения: автоответчик — 9 990 ₽, бот со сценариями и сбором заявки — 14 990 ₽. |
|---|---|
| Расходы на модель — отдельно | Ежемесячно, по факту трафика, оплачиваются напрямую провайдеру с вашего аккаунта. Порядок величин — в разделе про стоимость диалога. Это не скрытая доплата, а другая статья: разработка разовая, модель работает постоянно. |
| Рынок: 10 000 – 40 000 ₽ · простые | FAQ-бот с базовой интеграцией — 10 000–30 000 ₽ разово. Минимальный ИИ-бот — 15 000–40 000 ₽ плюс 3 000–8 000 ₽ в месяц за API и хостинг. |
| Рынок: от 250 000 ₽ · с базой знаний | Решения с базой знаний, историей диалога и ограничениями ответов профильные студии оценивают от 250 000 ₽; AI-платформы с обучением и SLA — от 700 000 ₽. |
| Интеграции — после оценки | Передача заявок в CRM, оплата, учётные системы считаются отдельно, когда понятны поля, права и API. |
Рыночные ориентиры собраны из открытых прайсов и обзоров в июле 2026 года и приведены для сравнения, а не как моё предложение. Мои цены разовые и действуют на дату публикации.
Честные границы
ИИ сейчас продают почти в каждый бот. Три случая, где сценарный дешевле и лучше.
Если клиенты спрашивают одно и то же десятком формулировок, сценарный бот ответит точнее, предсказуемее и без платы за каждый ответ. ИИ здесь — дороже и с риском ошибки.
Юридические условия, медицинские рекомендации, финансовые расчёты. Здесь нужен либо дословный текст из базы, либо человек — свободная формулировка недопустима.
ИИ-боту нечем отвечать, если ответы нигде не записаны. Без базы он начнёт сочинять. Сначала собирают регламент и прайс — это и есть основная работа перед запуском.
Дальше по теме
Форматы ботов, обработка обращений и передача заявок дальше по воронке.
Форматы
Обработка обращений
FAQ
Считается так: возьмите объём промпта с базой знаний, умножьте на число сообщений в диалоге и умножьте на тариф модели. Для диалога из десяти сообщений с базой знаний около 4 000 токенов выходит порядка 40 000 входных токенов. На тарифе 0,2 ₽ за тысячу токенов это примерно 8–9 ₽ за диалог, на тарифе 2 ₽ — уже около 90 ₽. Тысяча диалогов в месяц: от 8 тысяч до 90 тысяч рублей при одном и том же коде бота.
Обычный бот после запуска стоит только сервера. У ИИ-бота каждый ответ — платный запрос к модели, поэтому счёт растёт вместе с числом обращений. Причём модель на каждом ответе читает заново весь промпт, базу знаний и историю диалога: чем длиннее разговор, тем дороже каждое следующее сообщение.
Полностью убрать нельзя — модель по устройству продолжает текст, а не проверяет факты. Ограничивают тремя приёмами: бот отвечает только по вашей базе знаний, а не по общим знаниям модели; ему запрещено называть цены, сроки и условия, которых в базе нет; при неуверенности он передаёт диалог человеку вместо того, чтобы придумывать. Проверять надо на реальных вопросах клиентов до запуска, а не после.
По открытым тарифам 2026 года: GigaChat — 0,2 ₽ за тысячу токенов при минимальном платеже 600 ₽ в месяц; YandexGPT Lite — 0,2 ₽ за тысячу входных и 0,4 ₽ за тысячу выходных; YandexGPT Pro — 1 и 2 ₽; YandexGPT 5 Pro — 2 и 6 ₽. Разница между младшей и старшей моделью в стоимости диалога — примерно десятикратная, поэтому выбор делают по качеству ответов на ваших вопросах, а не по названию.
Секунды, а не мгновенно: модель генерирует текст постепенно, и чем длиннее ответ и больше база знаний, тем дольше. Пауза в чате читается как «бот завис», поэтому в боте включают индикатор набора текста и отправляют ответ по мере готовности. При этом Telegram принимает от бота примерно одно сообщение в секунду в один чат — частить всё равно не выйдет.
Текст запроса уходит провайдеру модели — это внешняя обработка, и её нужно учитывать в политике обработки персональных данных. Практическое правило: в модель не отправляют то, что ей не нужно для ответа. Телефон, адрес и номер заказа обрабатывает ваш код и хранит ваша база, а модель получает только формулировку вопроса.
У меня ИИ-менеджер с базой знаний — 19 990 ₽ разово, срок 3–5 дней, установка на ваш сервер входит в цену. Расходы на саму модель — отдельно и ежемесячно, по факту трафика. По рынку: FAQ-бот с базовой интеграцией 10 000–30 000 ₽, минимальный ИИ-бот 15 000–40 000 ₽ плюс 3 000–8 000 ₽ в месяц за API и хостинг, решение с базой знаний и ограничениями — от 250 000 ₽.
Когда вопросы клиентов повторяются десятком формулировок — сценарный бот ответит на них точнее, предсказуемее и без платы за каждый ответ. Когда ошибка в ответе стоит дорого — юридические, медицинские и финансовые условия. И когда база знаний ещё не написана: ИИ-боту нечем отвечать, а без базы он начнёт сочинять.
Следующий шаг
По потоку обращений и объёму базы знаний считается стоимость месяца ещё до разработки. Заодно станет видно, нужен ли ИИ вообще или задача решается сценарием вдвое дешевле.
AI в клиентском сервисе
База знаний, RAG, порог уверенности, эскалация сотруднику и метрики качества.
Открыть руководствоПодключение к аккаунту
Проверка режима, business updates, прав и connection ID перед подключением нейросети.
Открыть инструкцию