Урок 8. Выбор AI-модели и стоимость сообщения
Факты боту ты уже дал. Теперь его «мозг»: модель. Их несколько, и выбор влияет на кошелёк. Большинству менять ничего не нужно, дефолт уже оптимальный. Разберём, почему, и из чего складывается цена ответа.
Цель урока
После урока ты знаешь, какую модель оставить (обычно, дефолтную) и из чего складывается цена ответа, чтобы не переплачивать за флагман «на всякий случай» и не удивляться, куда уходит баланс.
Простыми словами
Не уверен, какую модель выбрать? Оставь дефолтную gpt-5.4-mini и переходи дальше: она подходит большинству бизнесов. Всё остальное в этом уроке нужно, чтобы ты понимал цену, а не чтобы обязательно что-то менял.
Модель это «мозг», который придумывает ответы. В DOS AI доступно 11 моделей от OpenAI, от простых и дешёвых до «умных, но прожорливых». По умолчанию стоит gpt-5.4-mini, быстрая и универсальная, подходит большинству бизнесов.
Каждый ответ бота тратит баланс токенов: это «топливо». Чем «умнее» модель и чем длиннее разговор, тем больше топлива уходит.
Слайды урока
Непонятные слова: на пальцах
- Модель: «мозг» бота, готовый движок, который придумывает ответы. Как двигатель у машины: бывает экономичный, бывает мощный и прожорливый.
gpt-5.4-mini: экономичный и шустрый, подходит почти всем. - Токен: маленький кусочек текста (примерно слог или короткое слово), которым меряют расход. Как литры бензина, чем длиннее поездка (разговор), тем больше «литров» сгорело. Ответ бота = столько-то токенов = столько-то денег.
- «Вход» и «выход»: две цены модели, которые видно в таблице на скриншоте. «Вход»: за то, что бот читает (твой промпт + вся история переписки + сообщение клиента). «Выход»: за то, что бот пишет в ответ. Из них и складывается цена одного сообщения: её же показывает калькулятор.
- Флагман: самая мощная и самая дорогая модель. Как спорткар: быстрее не поедешь по городу, а бензина ест втрое. Нужен редко.
- Калькулятор токенов: прикидка в кабинете, сколько будет стоить один диалог при твоём промпте и модели. Как счётчик такси заранее: видишь примерную цену поездки.
- Буферизация: склейка нескольких быстрых сообщений клиента в один ответ. Клиент пишет тремя строчками подряд: бот ждёт пару секунд и отвечает один раз, а не трижды. Экономит топливо. Подробно, Урок 11.
Зачем в это вникать
Потому что можно по привычке включить самую дорогую модель и удивляться, куда уходит баланс. А для обычных задач (ответить на вопрос, записать, выставить счёт) отлично хватает недорогой модели. Правильный выбор экономит деньги без потери качества.
Какую модель выбрать
| Категория | Примеры | Когда брать |
|---|---|---|
| Универсальная (дефолт) | gpt-5.4-mini | Старт для почти любого бизнеса: быстрая, умная, недорогая |
| Самая дешёвая | gpt-4.1-nano | Простые сценарии: ответы на типовые вопросы, запись |
| Флагманы (дорогие) | gpt-5.5 и т.п. | Только если реально нужна сложная логика/рассуждения, едят баланс быстро |
📍 Где менять: меню проекта → группа «Бот» → «Настройки бота» → раскрой блок «Расширенные настройки» → выбор модели. Там же калькулятор: «ваш промпт X токенов, модель Y, ~Z ₸ за диалог».
Из чего складывается цена сообщения
- Длина диалога. Чем длиннее история переписки, тем дороже каждый следующий ответ (бот перечитывает контекст).
- Модель. Флагман дороже мини в несколько раз.
- Доп-действия. Поиск по базе знаний, распознавание голоса/фото/PDF: добавляют к стоимости.
Пример
Образовательный центр поставил флагман gpt-5.5 «чтобы поумнее». Бот отвечает так же, как на gpt-5.4-mini, но баланс тает втрое быстрее. Переключили на gpt-5.4-mini: качество то же, расход упал. Вывод: флагман нужен редко.
Как экономить / чего не делать
- Начинай с
gpt-5.4-miniилиnano. - Короткая «Информация о компании» + объёмное в базу знаний.
- Включи буферизацию: несколько сообщений клиента склеиваются в один ответ.
- Не держи флагман без реальной необходимости.
Частые ошибки
- «Возьму самую дорогую, будет лучше»: чаще всего разницы для клиента нет, а расход выше.
- Огромный промпт/прайс в поведении: каждый ответ дорожает. Раскладывай факты правильно (Урок 7).
Вопросы новичка
- Какую модель поставить, если не разбираюсь? Оставь дефолт
gpt-5.4-mini. Он универсальный и недорогой: менять есть смысл, только если увидишь конкретную причину. - Дорогая модель = умнее ответы клиенту? Обычно клиент разницы не замечает, а баланс тает быстрее. Флагман нужен для сложной логики, не «на всякий случай».
- Почему длинные диалоги дороже? Бот перечитывает всю переписку перед каждым ответом, чем она длиннее, тем больше токенов. Можно ограничить глубину в продвинутых настройках.
- Как узнать, во сколько мне обходится один разговор? Открой тест-чат, он показывает стоимость ответа в реальных деньгах, или глянь калькулятор в настройках модели.
Проверь себя
- Какую модель оставить, если не хочешь вникать? Почему её хватает большинству?
- Назови три вещи, от которых растёт цена одного ответа.
- Где увидеть реальную стоимость ответа в деньгах?
Что дальше
Мозг выбран. Дальше, что бот сам собирает о клиенте и заносит в карточку: Урок 9. Что бот узнаёт о клиенте.

