Рассуждающие модели: когда нужна пошаговая логика

Рассуждающая модель отличается тем, что перед ответом строит внутреннюю цепочку рассуждений — разбирает условие, проверяет промежуточные шаги, иногда отбрасывает неверный путь и начинает заново. Пользователю показывается итог, а иногда и выжимка хода мысли.
Кто в классе
- DeepSeek-R1 — самая известная открытая рассуждающая модель, сильна в математике и логических задачах.
- GPT-OSS-120B — сочетает рассуждение с работой над кодом.
- Nemotron 3 Nano — компактный вариант с настраиваемой глубиной рассуждений.
Где прирост реальный
| Задача | Эффект |
|---|---|
| Математика, расчёты в несколько действий | Большой: обычная модель ошибается заметно чаще |
| Логические головоломки, условия с исключениями | Большой |
| Анализ документа с противоречиями | Средний: находит несостыковки, которые обычная модель пропускает |
| Планирование многошаговой работы | Средний |
| Пересказ, стилистика, короткие ответы | Нулевой или отрицательный |
Три особенности, о которых надо знать
Первая: ответ идёт дольше. Иногда в разы. Для диалога в реальном времени это ощутимо, для фоновой задачи — неважно.
Вторая: рассуждения тратят токены. Внутренние размышления расходуют тот же лимит, что и видимый ответ. Если поставить max_tokens маленьким, модель может израсходовать бюджет на размышления и оборвать ответ на полуслове. Для рассуждающих моделей лимит закладывайте с запасом — вдвое-втрое больше ожидаемой длины ответа.
Третья: просить «думай пошагово» не нужно. Модель и так это делает. Инструкция в лучшем случае избыточна, в худшем сбивает её собственную схему.
Как формулировать запрос
Рассуждающей модели полезнее не указания «как думать», а полнота условия:
- Перечислите все ограничения явно, включая очевидные для вас.
- Скажите, что делать при недостатке данных: «если данных не хватает — скажи, каких именно, и не выдумывай».
- Задайте формат итога отдельно: «итоговый ответ дай последней строкой после слова ИТОГ».
Проверка рассуждений
Ценная особенность класса — возможность попросить показать ход мысли и проверить его. Ошибка в рассуждении видна человеку, ошибка в готовом ответе — нет. Для задач, где цена ошибки высока, это главный аргумент в пользу этого класса моделей.
Когда не брать
Если задача решается в одно действие, рассуждающая модель — лишние секунды и лишние токены. Простое правило: сначала пробуйте универсальную; если она стабильно ошибается на этом типе задач, переходите на рассуждающую.