Адаптивное мышление

Тема дорожной карты · Claude от Anthropic

Адаптивное мышление (adaptive thinking) — современный режим рассуждения Claude, включаемый параметром thinking: {"type": "adaptive"}. В отличие от устаревшего расширенного мышления с фиксированным бюджетом токенов, здесь модель сама решает, когда и как долго ей думать над конкретным запросом: простой вопрос получает ответ сразу, а сложная задача — этап внутреннего рассуждения нужной глубины. Настраивать budget_tokens больше не нужно. На Opus 4.7, Opus 4.8 и Fable 5 адаптивный режим — единственный способ включить мышление: старый вариант {"type": "enabled", "budget_tokens": N} на этих моделях возвращает ошибку HTTP 400. Важный нюанс: адаптивное мышление не включено по умолчанию — если параметр thinking не передан, запрос выполняется вообще без рассуждений.

Как это работает

Вы добавляете thinking: {"type": "adaptive"} в запрос к Messages API, и Claude на каждом запросе оценивает, требуется ли рассуждение и какой глубины. Адаптивный режим автоматически включает interleaved thinking — рассуждения между вызовами инструментов, что критично для агентных сценариев: модель осмысливает результат каждого вызова, прежде чем планировать следующий. Общую глубину рассуждений и расход токенов регулирует параметр effort в output_config. Отдельно про отображение: на Opus 4.7+ и Fable 5 блоки мышления по-прежнему приходят в ответе и в стриме, но их текст по умолчанию пуст (display: "omitted"). Если вы показываете рассуждения пользователям, явно запросите thinking: {"type": "adaptive", "display": "summarized"}. Ещё одна особенность Fable 5: явное {"type": "disabled"} возвращает 400 — чтобы отключить мышление, просто не передавайте параметр.

Когда применять

Включайте адаптивное мышление там, где качество рассуждения важнее скорости: проектирование архитектуры, отладка запутанных багов, математические задачи, многошаговое планирование и особенно агентные циклы с инструментами — за счёт автоматического interleaved thinking. Для рутинных задач вроде классификации или короткой суммаризации параметр можно опустить и сэкономить токены. При миграции кода со старых моделей замените связку enabled + budget_tokens на адаптивный режим и при необходимости донастройте effort — это рекомендуемый путь для всех новых интеграций.

Типичные ошибки

Самая частая ошибка — считать, что адаптивное мышление работает «из коробки»: без явного поля thinking модель не рассуждает вовсе. Вторая — отправка budget_tokens на Opus 4.7/4.8 или Fable 5: там параметр полностью удалён и запрос падает с 400. Третья — явное thinking: {"type": "disabled"} на Fable 5, которое тоже возвращает 400 (на Opus 4.7/4.8 оно допустимо). Наконец, разработчики забывают про display: по умолчанию текст блоков мышления пуст, и интерфейс выглядит «зависшим» на долгой паузе перед ответом — для пользовательских UI включайте display: "summarized".

Связанные понятия

Полезные ресурсы

Проверить знания (2)

Загрузка вопросов…