Документация › Проект и бот › Выбор AI-модели
Выбор AI-модели
Бот работает на одной из моделей OpenAI. По умолчанию: быстрая и недорогая, её хватает 90% бизнесов. Можно поставить «умнее», но каждое сообщение будет дороже.
⏱ 6 мин · 👤 для владельца · 🟢 live
За 30 секунд:
- Модель выбирается на проект (не на каждый чат).
- По умолчанию,
gpt-5.4-mini: быстрая, недорогая, для большинства задач достаточно.- Есть модели мощнее (лучше рассуждают на сложных диалогах) и легче (ещё дешевле/быстрее).
- Чем мощнее модель, тем дороже каждое сообщение (быстрее тратится баланс). См. Сколько стоит сообщение.
📍 Где найти. В проекте → «Настройки бота» → блок «Выбор модели», в основных настройках. Сразу видны три модели: рекомендованная, та что умнее и дороже, и та что дешевле. Остальные восемь и таблица сравнения лежат под ссылкой «Все модели»: они нужны редко, но никуда не делись.

Как это работает
У проекта есть настройка модели (projects.openai_model). Если не менял, действует модель по умолчанию gpt-5.4-mini. Менять стоит осознанно: модель влияет на качество ответов и на стоимость каждого сообщения.
Доступны 11 моделей четырёх семейств OpenAI: GPT-5.5 (gpt-5.5), GPT-5.4 (gpt-5.4-mini, gpt-5.4, gpt-5.4-nano), GPT-5 (gpt-5-mini, gpt-5, gpt-5.1, gpt-5.2) и GPT-4.1 (gpt-4.1-mini, gpt-4.1, gpt-4.1-nano), от самой лёгкой nano до флагмана. Помечены как популярные две: gpt-5.4-mini (по умолчанию) и gpt-4.1-mini (самая экономная из рабочих). Модели отличаются по трём осям:
- Ум: насколько хорошо держит сложный диалог, следует инструкциям, рассуждает.
- Скорость, как быстро отвечает.
- Цена за сообщение: сколько баланса уходит на один ответ.
| Класс модели | Когда брать |
|---|---|
самая лёгкая (gpt-4.1-nano) | простейшие боты: FAQ, базовые ответы, маршрутизация. Минимальная цена из всех |
nano / mini (напр. gpt-5.4-mini, по умолчанию) | большинство задач: запись, ответы по базе знаний, типовые вопросы. Дёшево и быстро |
полные (напр. gpt-5.4, gpt-4.1) | сложные диалоги, тонкие переговоры, длинный контекст. Умнее, но дороже |
флагман (gpt-5.5) | ⚠️ самая дорогая: предельно сложные задачи, тонкий reasoning. Быстро ест баланс, бери только когда gpt-5.4 реально не вывозит |
💡 Не гонись за самой мощной моделью «на всякий случай». Для записи в барбершоп или ответов по прайсуminiсправляется не хуже, а баланс тратит в разы медленнее. Бери мощную, только если видишь, что бот реально «тупит» на твоих диалогах в тест-чате.
⚠️ Стоимость. Более мощная модель = больше списание за каждое сообщение. На потоке (сотни диалогов) разница в балансе ощутима. Прежде чем переключать весь проект, прогони сложные кейсы в тест-чате и реши, стоит ли качество денег.
Глубина размышления
Под выбором модели, в том же блоке, стоит вторая настройка: «Глубина размышления». Это скрытая работа модели перед ответом: она проверяет расписание, цифры и свои же выводы, и только потом пишет. Четыре положения:
| Положение | Ответ | Цена ответа | Что даёт |
|---|---|---|---|
| Выкл | 2-3 секунды | дешевле всего | отвечает сразу, без проверки: может назвать занятое время или не открыть таблицу |
| Лёгкая | около +2 секунд | почти как «Выкл» | чуть внимательнее, на сложных запросах ошибки остаются |
| Обычная (рекомендуем) | около +3-4 секунд | примерно +0,1 цента | проверяет расписание и цифры перед ответом; в наших замерах ни одной ошибки |
| Глубокая | вдвое дольше обычной | примерно +0,2 цента | для сложных сценариев с несколькими функциями подряд |
Стоит ли ставить «Глубокую». Мы прогнали восемь боевых вопросов (возврат части пакета, «сколько всего выйдет», сроки, условия рассрочки) на «Обычной» и «Глубокой». Ошибок не было ни у той, ни у другой. Разница вышла в другом: «Глубокая» отвечала в среднем 8 секунд против 4,6 и стоила на 13% дороже, а на самом сложном вопросе думала 15 секунд. Поэтому по умолчанию стоит «Обычная», а «Глубокую» имеет смысл включать точечно: если видишь в тест-чате, что бот путается в многошаговых расчётах.
Работает для моделей семейства gpt-5 (кроме o-серии, она думает всегда по-своему). Пока положение не выбрано, под кнопками написано, что применяет платформа. Та же настройка есть в тест-чате, чтобы сравнить положения на своих диалогах перед тем, как менять для клиентов.
Модель для дожимов отдельно
Для дожимов можно задать свою модель (обычно дешевле основной: дожимы проще). Если не задана, наследуется модель проекта.
Простыми словами
«Модель» это мозг бота. Их несколько: попроще-побыстрее-подешевле и поумнее-помедленнее-подороже. По умолчанию стоит средне-лёгкая (gpt-5.4-mini), и для большинства задач: записать клиента, ответить по прайсу, снять простое возражение, её за глаза.
Включать самую мощную «чтобы наверняка» не надо: она будет отвечать так же, но баланс съест заметно быстрее. А вот «Глубину размышления» на «Обычной» держать стоит: это несколько секунд ожидания, зато бот не предложит клиенту занятое время. Менять модель есть смысл, только если ты в тест-чате видишь, что бот реально не вывозит сложные разговоры. Тогда поставь мощнее, но имей в виду, что каждое сообщение станет дороже.
Дальше: → Тестовый чат
Связано: Системный промпт · Продвинутые настройки · Сколько стоит сообщение
Не получилось? → Бот не отвечает