Reasoning — модели, которые думают дольше
Модели, которые перед ответом строят внутреннюю цепочку рассуждений. Лучше в логике и коде, но дороже и медленнее обычных.
Также встречается как: рассуждающие модели, chain of thought, мышление модели
Коротко. Reasoning-модели тратят дополнительные вычисления перед ответом: разбивают задачу на шаги, проверяют себя и только потом выдают результат. Раньше этого добивались приёмом «рассуждай пошагово» в промпте, теперь это встроенный режим.
Где они дают выигрыш
Задачи с несколькими шагами и проверяемым ответом: математика, разбор сложной логики, написание и отладка кода, планирование действий агента, анализ противоречивых документов.
Там, где ответ короткий и фактический — извлечение полей, классификация, ответ по документу, — выигрыша почти нет, а цена и задержка вырастают.
Зачем фаундеру
Это вопрос себестоимости. Рассуждение расходует дополнительные токены, которые оплачиваются, но пользователю не показываются, а ответ приходит заметно медленнее.
Разумная схема для продукта — маршрутизация: простые запросы уходят обычной модели, сложные — рассуждающей. Разница в расходах на большом потоке получается кратной.
Где ошибаются
Ставят рассуждающую модель везде «на всякий случай». Самый быстрый способ испортить экономику и скорость продукта.
Показывают рассуждения пользователю как ответ. Это черновик, а не результат.
Не проверяют выигрыш. Прежде чем переходить, прогоните обе модели на своём наборе evals — разница часто оказывается меньше ожидаемой.
Разобрать это на своём проекте
Мы доводим идеи фаундеров до работающего MVP за долю в компании. Расскажите про свою — посмотрим на цифры вместе.