Выбор Правильной Модели
Тема дорожной карты · Claude от Anthropic
Выбор модели Claude — это баланс интеллекта, скорости и цены под конкретную задачу. Линейка 2026 года даёт четыре уровня: Haiku 4.5 (claude-haiku-4-5, $1/$5 за 1M токенов) — быстрая дешёвая рутина; Sonnet 4.6 (claude-sonnet-4-6, $3/$15) — лучший баланс и дефолт для чата и кода; Opus 4.8 (claude-opus-4-8, $5/$25) — длинные агентные сценарии и самые сложные задачи; Fable 5 (claude-fable-5, $10/$50) — верхний уровень, когда максимальный интеллект важнее стоимости. Базовая стратегия: начните с Sonnet 4.6 и двигайтесь по лестнице только по результатам измерений, а не по ощущениям.
Как это работает
Правило выбора — «самая дешёвая модель, стабильно решающая задачу». Постройте небольшой eval-набор из реальных запросов и прогоните его по уровням: если Haiku 4.5 даёт нужное качество на классификации или извлечении — незачем платить втрое за Sonnet. Возможности моделей сверяйте не по памяти, а через Models API: GET /v1/models и GET /v1/models/{id} возвращают context window (1M у Fable/Opus/Sonnet 4.6, 200K у Haiku), max output (128K у Fable/Opus, 64K у Sonnet/Haiku) и дерево capabilities — vision, adaptive thinking, effort, structured outputs. Пиньте алиасы без датных суффиксов (claude-opus-4-8) и следите за датами deprecation: Sonnet 3.7 и Haiku 3.5 retired в феврале 2026, миграция описана в официальном гайде.
Когда применять
Haiku 4.5 — high-volume рутина: классификация, извлечение, роутинг. Sonnet 4.6 — дефолт для ассистентов, генерации кода, RAG. Opus 4.8 — long-horizon агентные циклы и задачи, где Sonnet стабильно недотягивает. Fable 5 — точечные критичные запросы с максимальными требованиями к качеству. Продвинутый вариант — мультимодельный роутинг: дешёвый классификатор на Haiku решает, какой уровень нужен каждому запросу, а в агентных системах основной цикл живёт на Opus/Fable с fan-out сабагентами на Haiku.
Типичные ошибки
Выбор «самой умной модели на всякий случай» — Fable 5 для тривиальных задач умножает счёт без прироста качества. Обратная крайность — экономия на Haiku там, где ошибки классификации стоят дороже токенов. Отсутствие замера стоимости на запрос: LLM-счета удивляют именно на масштабе. Перенос кода между уровнями без проверки параметров: budget_tokens и temperature работают на легаси-моделях, но возвращают HTTP 400 на Fable 5 и Opus 4.8/4.7. И жёсткая привязка к одной модели в коде — выносите идентификатор в конфиг, чтобы миграция на новую версию была заменой строки, а не рефакторингом.
Связанные понятия
Полезные ресурсы
Проверить знания (2)
Загрузка вопросов…