Урок 9. Выбор AI-модели и стоимость сообщения
«Мозг» бота — это модель. Их несколько, и выбор напрямую влияет на кошелёк. Разберём, какую брать и из чего складывается цена ответа.
💡 Простыми словами
Модель — это «мозг», который придумывает ответы. В DOS AI доступно 11 моделей от OpenAI: от простых и дешёвых до «умных, но прожорливых». По умолчанию стоит gpt-5.4-mini — быстрая и универсальная, подходит большинству бизнесов.
Каждый ответ бота тратит баланс токенов — это «топливо». Чем «умнее» модель и чем длиннее разговор, тем больше топлива уходит.
🎞️ Слайды урока
📖 Непонятные слова — на пальцах
- Модель — «мозг» бота, готовый движок, который придумывает ответы. Как двигатель у машины: бывает экономичный, бывает мощный и прожорливый.
gpt-5.4-mini— экономичный и шустрый, подходит почти всем. - Токен — маленький кусочек текста (примерно слог или короткое слово), которым меряют расход. Как литры бензина: чем длиннее поездка (разговор), тем больше «литров» сгорело. Ответ бота = столько-то токенов = столько-то денег.
- Флагман — самая мощная и самая дорогая модель. Как спорткар: быстрее не поедешь по городу, а бензина ест втрое. Нужен редко.
- Калькулятор токенов — прикидка в кабинете, сколько будет стоить один диалог при твоём промпте и модели. Как счётчик такси заранее: видишь примерную цену поездки.
- Буферизация — склейка нескольких быстрых сообщений клиента в один ответ. Клиент пишет тремя строчками подряд — бот ждёт пару секунд и отвечает один раз, а не трижды. Экономит топливо. Подробно — Урок 11.
🎯 Зачем в это вникать
Потому что можно по привычке включить самую дорогую модель и удивляться, куда уходит баланс. А для 90% задач (ответить на вопрос, записать, посчитать) отлично хватает недорогой модели. Правильный выбор экономит деньги без потери качества.
🧠 Какую модель выбрать
| Категория | Примеры | Когда брать |
|---|---|---|
| Универсальная (дефолт) | gpt-5.4-mini | Старт для почти любого бизнеса — быстрая, умная, недорогая |
| Самая дешёвая | gpt-4.1-nano | Простые сценарии: ответы на типовые вопросы, запись |
| Флагманы (дорогие) | gpt-5.5 и т.п. | Только если реально нужна сложная логика/рассуждения — едят баланс быстро |
📍 Где менять: меню проекта → «Бот» → выбор модели. Там же калькулятор: «ваш промпт X токенов, модель Y, ~Z ₸ за диалог».
🛠️ Из чего складывается цена сообщения
- Длина диалога. Чем длиннее история переписки, тем дороже каждый следующий ответ (бот перечитывает контекст).
- Модель. Флагман дороже мини в разы.
- Доп-действия. Поиск по базе знаний, распознавание голоса/фото/PDF — добавляют к стоимости.
📌 Пример
Автосервис поставил флагман gpt-5.5 «чтобы поумнее». Бот отвечает так же, как на gpt-5.4-mini, но баланс тает втрое быстрее. Переключили на gpt-5.4-mini — качество то же, расход упал. Вывод: флагман нужен редко.
✅ Как экономить / 🚫 чего не делать
- ✅ Начинай с
gpt-5.4-miniилиnano. - ✅ Короткая «Информация о компании» + объёмное в базу знаний.
- ✅ Включи буферизацию — несколько сообщений клиента склеиваются в один ответ.
- 🚫 Не держи флагман без реальной необходимости.
⚠️ Частые ошибки
- «Возьму самую дорогую, будет лучше» — чаще всего разницы для клиента нет, а расход выше.
- Огромный промпт/прайс в поведении — каждый ответ дорожает. Раскладывай факты правильно (Урок 8).
❓ Вопросы новичка
- Какую модель поставить, если не разбираюсь? Оставь дефолт
gpt-5.4-mini. Он универсальный и недорогой — менять есть смысл, только если увидишь конкретную причину. - Дорогая модель = умнее ответы клиенту? Обычно клиент разницы не замечает, а баланс тает быстрее. Флагман нужен для сложной логики, не «на всякий случай».
- Почему длинные диалоги дороже? Бот перечитывает всю переписку перед каждым ответом — чем она длиннее, тем больше токенов. Можно ограничить глубину в продвинутых настройках.
- Как узнать, во сколько мне обходится один разговор? Открой тест-чат — он показывает стоимость ответа в реальных деньгах, или глянь калькулятор в настройках модели.
🚀 Что дальше
Выбрал модель → проверь в тест-чате: он показывает стоимость ответа в реальных деньгах.

