Температура в чате: зачем она и как её крутить
Температура это ползунок от 0 до 1, который решает, насколько модель держится фактов или даёт волю фантазии. В VEGA его можно поменять в настройках чата. Низкие значения дают точные, предсказуемые ответы. Высокие приносят неожиданные формулировки и креатив, но с риском, что модель уйдёт от фактов.
В интерфейсе три диапазона:
- 0.0–0.4, консервативный. Преимущественно факты, точные ответы.
- 0.5–0.7, сбалансированный. Баланс между точностью и креативностью.
- 0.8–1.0, креативный. Высокая креативность, факты могут искажаться.
Разберём на трёх задачах, когда какой диапазон включать.
Кейс 1. Технический вопрос — 0.2
Вы спрашиваете: «Какие заголовки HTTP нужны для CORS-запроса с авторизацией?» Здесь важна точность. Модель должна выдать ровно те заголовки, которые работают, без отсебятины.
Ставьте 0.2 или около того. Модель будет выбирать самые вероятные токены, поэтому ответ получится сухим и предсказуемым. Для документации, кода, справочных вопросов это то, что нужно.
То же касается режимов Веб-поиск и Исследование: там температура зафиксирована на 0.4 независимо от ваших настроек, потому что эти режимы работают с фактами и источниками. Креатив там только мешает.
Кейс 2. Письмо или пересказ — 0.6
Вы просите: «Напиши вежливый ответ клиенту, который недоволен доставкой» или «Перескажи эту статью в трёх абзацах». Тут нужна не железная точность, а нормальный, живой текст. Слишком низкая температура даст деревянные формулировки. Слишком высокая — модель начнёт добавлять детали, которых в задаче не было.
0.6 работает в большинстве повседневных задач: письма, пересказы, объяснения, мозговой штурм списком. Текст остаётся связным, но не выглядит как шаблон.
Кейс 3. Сторителлинг и креатив — 0.9
Вы просите: «Придумай короткую историю про кота, который работает ночным сторожем» или «Напиши слоган для кофейни в стиле нуар». Здесь нужна свобода. Низкая температура выдаст скучный, шаблонный текст. Высокая даст неожиданные образы, метафоры, повороты.
Ставьте 0.8–1.0. Модель будет реже выбирать самый очевидный токен и чаще уходить в сторону. Платите за это риском: фактические детали могут искажаться, поэтому для креативных задач это нормально, а для справочных — нет.
Коротко
Температура не делает модель умнее или глупее. Она меняет разброс ответов. Низкая — узкий коридор, высокая — широкий. Под задачу: факты и код на низкую, обычный текст на среднюю, истории и слоганы на высокую.