DOS AI/ ДокументацияВойти →
🎬Видео скоро появится
Нажми, когда разберёшься с уроком. Галочка появится в меню слева.

Урок 9. Выбор AI-модели и стоимость сообщения

«Мозг» бота — это модель. Их несколько, и выбор напрямую влияет на кошелёк. Разберём, какую брать и из чего складывается цена ответа.

💡 Простыми словами

Модель — это «мозг», который придумывает ответы. В DOS AI доступно 11 моделей от OpenAI: от простых и дешёвых до «умных, но прожорливых». По умолчанию стоит gpt-5.4-mini — быстрая и универсальная, подходит большинству бизнесов.

Каждый ответ бота тратит баланс токенов — это «топливо». Чем «умнее» модель и чем длиннее разговор, тем больше топлива уходит.

🎞️ Слайды урока

Урок 9
Модель и стоимость ответа
«Мозг» бота — это модель. Их 11; выбор напрямую влияет на кошелёк.
1 / 7

📖 Непонятные слова — на пальцах

  • Модель — «мозг» бота, готовый движок, который придумывает ответы. Как двигатель у машины: бывает экономичный, бывает мощный и прожорливый. gpt-5.4-mini — экономичный и шустрый, подходит почти всем.
  • Токен — маленький кусочек текста (примерно слог или короткое слово), которым меряют расход. Как литры бензина: чем длиннее поездка (разговор), тем больше «литров» сгорело. Ответ бота = столько-то токенов = столько-то денег.
  • Флагман — самая мощная и самая дорогая модель. Как спорткар: быстрее не поедешь по городу, а бензина ест втрое. Нужен редко.
  • Калькулятор токенов — прикидка в кабинете, сколько будет стоить один диалог при твоём промпте и модели. Как счётчик такси заранее: видишь примерную цену поездки.
  • Буферизация — склейка нескольких быстрых сообщений клиента в один ответ. Клиент пишет тремя строчками подряд — бот ждёт пару секунд и отвечает один раз, а не трижды. Экономит топливо. Подробно — Урок 11.

🎯 Зачем в это вникать

Потому что можно по привычке включить самую дорогую модель и удивляться, куда уходит баланс. А для 90% задач (ответить на вопрос, записать, посчитать) отлично хватает недорогой модели. Правильный выбор экономит деньги без потери качества.

🧠 Какую модель выбрать

КатегорияПримерыКогда брать
Универсальная (дефолт)gpt-5.4-miniСтарт для почти любого бизнеса — быстрая, умная, недорогая
Самая дешёваяgpt-4.1-nanoПростые сценарии: ответы на типовые вопросы, запись
Флагманы (дорогие)gpt-5.5 и т.п.Только если реально нужна сложная логика/рассуждения — едят баланс быстро

📍 Где менять: меню проекта → «Бот» → выбор модели. Там же калькулятор: «ваш промпт X токенов, модель Y, ~Z ₸ за диалог».

🛠️ Из чего складывается цена сообщения

  • Длина диалога. Чем длиннее история переписки, тем дороже каждый следующий ответ (бот перечитывает контекст).
  • Модель. Флагман дороже мини в разы.
  • Доп-действия. Поиск по базе знаний, распознавание голоса/фото/PDF — добавляют к стоимости.

📌 Пример

Автосервис поставил флагман gpt-5.5 «чтобы поумнее». Бот отвечает так же, как на gpt-5.4-mini, но баланс тает втрое быстрее. Переключили на gpt-5.4-mini — качество то же, расход упал. Вывод: флагман нужен редко.

✅ Как экономить / 🚫 чего не делать

⚠️ Частые ошибки

  • «Возьму самую дорогую, будет лучше» — чаще всего разницы для клиента нет, а расход выше.
  • Огромный промпт/прайс в поведении — каждый ответ дорожает. Раскладывай факты правильно (Урок 8).

❓ Вопросы новичка

  • Какую модель поставить, если не разбираюсь? Оставь дефолт gpt-5.4-mini. Он универсальный и недорогой — менять есть смысл, только если увидишь конкретную причину.
  • Дорогая модель = умнее ответы клиенту? Обычно клиент разницы не замечает, а баланс тает быстрее. Флагман нужен для сложной логики, не «на всякий случай».
  • Почему длинные диалоги дороже? Бот перечитывает всю переписку перед каждым ответом — чем она длиннее, тем больше токенов. Можно ограничить глубину в продвинутых настройках.
  • Как узнать, во сколько мне обходится один разговор? Открой тест-чат — он показывает стоимость ответа в реальных деньгах, или глянь калькулятор в настройках модели.

🚀 Что дальше

Выбрал модель → проверь в тест-чате: он показывает стоимость ответа в реальных деньгах.

🔗 Подробнее (техническая документация)