Рассуждающая модель (Reasoning Model)

Рассуждающая модель — это LLM, обученная (обычно с помощью обучения с подкреплением на проверяемых задачах) тратить дополнительные вычисления на «размышление» перед ответом. Вместо того чтобы сразу выдать результат, она строит цепочку промежуточных шагов, проверяет саму себя и возвращается назад, когда заходит в тупик. Примеры — серия o от OpenAI, DeepSeek-R1 и режим расширенного мышления у Claude. По сравнению с обычными чат-моделями они заметно сильнее в математике, коде, многошаговой логике и планировании, но стоят дороже и отвечают медленнее, поскольку генерируют гораздо больше токенов. Для SaaS-разработчиков правило простое: направляйте на рассуждающую модель только действительно сложные задачи — сложную генерацию кода, анализ данных, планирование агентов, — а классификацию и простые запросы оставляйте дешёвым и быстрым моделям. Многие API позволяют регулировать «бюджет на размышление» для каждого запроса, обменивая скорость и деньги на точность. Не хватайтесь за рассуждающую модель рефлекторно: на простых задачах извлечения она лишь медленнее и дороже без выигрыша в качестве.

Похожие термины

Ещё термины: Основы ИИ