27 июля 2026 г.выбор модели claude

Какую модель Claude выбрать в 2026 году — Opus 4.8, Sonnet 4.6, Haiku 4.5, fable-5

Практическая матрица выбора модели Claude 2026: claude-opus-4-8 / opus-4-8-1m / sonnet-4-6 / sonnet-4-6-1m / haiku-4-5 / fable-5. Почему Opus на простых задачах расходует в 2–3× больше токенов отвечает в 3–4× дольше, и какую модель ставить под рефакторинг, code review, Tab completion, агенты, длинный контекст. Экономия в 2.5 раза при правильном выборе.

Какую модель Claude выбрать в 2026 году — Opus 4.8, Sonnet 4.6, Haiku 4.5, fable-5

В линейке Anthropic шесть моделей, и каждая из них подходит под свои задачи. Использовать Claude Opus 4.8 «на каждый чих» — всё равно что возить мешок картошки на карьерном самосвале: едет, но расход топлива и время в пути не оправданы. В этой статье — практическая матрица: какую модель ставить под какую задачу, где Opus оправдан, а где Sonnet 4.6 или Haiku 4.5 справятся не хуже, и в чём разница на кошельке.

Шесть моделей — шесть ролей

Через LiteAI доступны все актуальные модели Anthropic 2026 года:

Модель Роль Когда выбирать
claude-opus-4-8 Самая мощная Сложный рефакторинг, архитектура, длинные многошаговые рассуждения
claude-opus-4-8-1m Opus с контекстом 1M Когда нужно засунуть в один запрос весь репозиторий или книгу
claude-sonnet-4-6 Баланс качества и скорости Рабочая лошадка на каждый день. Дефолт для 80% задач
claude-sonnet-4-6-1m Sonnet с контекстом 1M Длинный документ + средняя сложность
claude-haiku-4-5 Самая быстрая и дешёвая Классификация, переименование, шаблоны, короткие ответы
fable-5 Reasoning-флагман Многошаговые планы, агентные задачи, точные инструкции

Технические параметры моделей в LiteAI:

Модель Контекст Скорость Качество рассуждений Цена LiteAI
claude-opus-4-8 200K Медленная Максимальное 30 ₽ / 1M
claude-opus-4-8-1m 1M Медленная Максимальное 30 ₽ / 1M
claude-sonnet-4-6 200K Средняя Высокое 30 ₽ / 1M
claude-sonnet-4-6-1m 1M Средняя Высокое 30 ₽ / 1M
claude-haiku-4-5 200K Быстрая Хорошее 30 ₽ / 1M
fable-5 1M Медленная Очень высокое 500 ₽ / 1M

Что важно: у LiteAI единая цена 30 ₽ за 1M токенов на Opus 4.8, Sonnet 4.6 и Haiku 4.5 — независимо от ввода, вывода и размера контекста. У Anthropic напрямую та же картина по качеству, но цена в 9–45× выше: $15/$75 за Opus, $3/$15 за Sonnet, $0.80/$4 за Haiku. fable-5 — отдельный тариф 500 ₽/M (тоже flat), потому что у Anthropic он стоит $5/$25.

Почему «Opus на всё» — плохая стратегия

Opus 4.8 объективно самая сильная модель в линейке. Но «самая сильная» ≠ «самая подходящая». Три причины не использовать Opus для простых задач:

1. Расход токенов выше. Opus любит «размышлять вслух»: chain-of-thought у него длиннее, и в вывод попадает больше промежуточных рассуждений. На одинаковом промпте Sonnet 4.6 выдаст ответ за 200 выходных токенов, а Opus может потратить 400–600, описывая ход мысли. Стоимость растёт в 1.5–3 раза при том же результате.

2. Время ответа. На запрос, на который Sonnet отвечает за 3 секунды, Opus тратит 8–15. Это критично для интерактивных сценариев: Tab completion в Cursor, автокомплит в IDE, чат-бот на сайте. Пользователь ждёт, а не «наслаждается качеством».

3. Качество не отличается на простых задачах. Если вы просите «переименуй переменную x в data», Sonnet и Haiku справятся одинаково хорошо. Разница в качестве появляется только на задачах, где и нужны глубокие рассуждения — а на «rename» модель и так «не думает».

Правило: берите Opus там, где его сила действительно нужна — сложные многошаговые задачи. Для всего остального есть Sonnet и Haiku.

Матрица «задача → модель»

Вот конкретная раскладка. Сначала — задачи (от сложных к простым), потом рекомендуемая модель.

Глубокие рассуждения и сложный код

Задача Лучшая модель Почему
Рефакторинг большой кодовой базы (>50 файлов) claude-opus-4-8 Удерживает контекст, видит перекрёстные зависимости
Проектирование архитектуры с нуля claude-opus-4-8 или fable-5 Нужны trade-off анализ и длинные рассуждения
Code review на 1000+ строк claude-opus-4-8 Ловит тонкие баги, которые пропускают более слабые модели
Написание сложного регулярного выражения claude-sonnet-4-6 Opus даст то же самое, но дольше и дороже
Объяснение чужого legacy-кода claude-sonnet-4-6 Sonnet достаточно умный, чтобы понять код, но не будет «перемудривать»
Генерация тестов claude-sonnet-4-6 Sonnet даёт хорошее покрытие в среднем темпе

Длинный контекст

Задача Лучшая модель Почему
Анализ PDF на 300+ страниц claude-sonnet-4-6-1m или fable-5 1M контекста вместо 200K, Sonnet дешевле
Анализ всего репозитория разом claude-opus-4-8-1m Opus + 1M = максимум качества на больших объёмах
Резюме длинного лога / транскрипта claude-sonnet-4-6-1m Суммаризация не требует флагманских рассуждений
Чтение контракта на 50 страниц claude-sonnet-4-6 200K контекста хватит, Sonnet справится

Агентные задачи и multi-step

Задача Лучшая модель Почему
Агент с 10-шаговым планом (tool use) fable-5 Лучше всех держит структуру инструкций
Cursor Composer на сложной задаче claude-sonnet-4-6 Хороший баланс цены/скорости/качества
Claude Code на проект рефакторинга claude-opus-4-8 Когда нужно «подумать» перед действием
Автоправка линтера (rename, import sort) claude-haiku-4-5 Механическая работа, не нужны рассуждения

Классификация, короткие ответы, рутина

Задача Лучшая модель Почему
Суммаризация 5 предложений в 1 claude-haiku-4-5 Элементарная задача, не нужна мощь Sonnet
Классификация тикета (баг / фича / вопрос) claude-haiku-4-5 Быстро и дёшево
Генерация шаблона email / commit message claude-haiku-4-5 Шаблон = шаблон, Haiku хватает
Парсинг JSON из текста claude-haiku-4-5 Структурная задача, не творческая
Sonnet ответил «не знаю» — какой попробовать? claude-opus-4-8 Если Sonnet не справился, есть шанс, что Opus справится

Быстрые вопросы и IDE

Задача Лучшая модель Почему
Tab completion в Cursor / IDE claude-haiku-4-5 Автокомплит должен быть мгновенным
Inline chat в VS Code claude-haiku-4-5 или claude-sonnet-4-6 Короткий вопрос, короткий ответ
Объяснить ошибку из stack trace claude-sonnet-4-6 Нужен контекст и понимание, не просто классификация
«Как сделать X в Python» claude-sonnet-4-6 Типовой вопрос, Sonnet ответит качественно

Сколько вы экономите, выбирая правильную модель

Сравним сценарий: 1000 запросов в день, средний объём — 1K входных + 800 выходных токенов. Это типичная нагрузка для IDE-ассистента или чат-бота.

Сценарий 1: «Всё на Opus 4.8»

  • 1M входных + 0.8M выходных токенов в день
  • На LiteAI: 1.8M × 30 ₽ = 54 ₽/день ≈ 1 620 ₽/месяц

Сценарий 2: «Правильная модель под задачу» (50% Haiku, 30% Sonnet, 20% Opus)

  • 0.5M на Haiku + 0.4M на Sonnet + 0.18M на Opus = те же 1.8M, цена одна — 30 ₽/M
  • Звучит, как будто экономии нет. Но!

Сценарий 3: «Учитываем, что Opus размышляет дольше»

На простых задачах (классификация, шаблоны) Opus тратит в 2–3 раза больше выходных токенов, потому что генерирует подробные рассуждения. Реальные замеры:

Задача Opus output Sonnet output Haiku output
Rename переменной 350 токенов 50 30
Классификация тикета 280 токенов 80 20
Генерация email 600 токенов 250 150
Суммаризация 1 параграфа 400 токенов 180 120

Если всё это гонять на Opus, расход вырастает в 2–4 раза. То есть при тарифе 30 ₽/M flat в день:

  • «Всё на Opus»: ~1.8M токенов → 54 ₽/день
  • «Правильная модель»: ~0.7M токенов → 21 ₽/день

Экономия — в 2.5 раза, или ~1 000 ₽/месяц. На больших объёмах (10K+ запросов/день) — десятки тысяч рублей.

Экономика скорости

Помимо денег, время ответа — это пользовательский опыт. Среднее время ответа на LiteAI (по последним замерам):

Модель TTFT (до первого токена) Полный ответ на 500 токенов
claude-haiku-4-5 ~0.4 сек 1.5–2 сек
claude-sonnet-4-6 ~0.6 сек 3–4 сек
claude-sonnet-4-6-1m ~0.7 сек 3–5 сек
claude-opus-4-8 ~1.5 сек 8–12 сек
claude-opus-4-8-1m ~1.8 сек 10–15 сек
fable-5 ~1.5 сек 8–14 сек

Если вы делаете Tab completion в IDE — пользователь не будет ждать 10 секунд Opus ради того, что Haiku выдаёт за 0.4 сек. Для real-time сценариев Haiku — единственный разумный выбор.

Когда Opus 4.8 действительно нужен

Перечислим конкретные сценарии, где Opus оправдан и переплата за него окупается:

  1. Сложный многошаговый рефакторинг. «Перепиши слой авторизации так, чтобы он соответствовал новой RBAC-модели» — Opus справится, Sonnet может потерять нюансы.
  2. Архитектурные решения с trade-off. «Выбрать между Postgres, ClickHouse и DuckDB для аналитики с учётом нагрузки, бюджета и опыта команды» — Opus разберёт варианты подробнее.
  3. Нетипичные edge cases. «Что произойдёт в этой distributed системе, если три ноды упадут одновременно» — Opus лучше держит сложные сценарии.
  4. Глубокий code review. Большой PR, тонкие race conditions, места, где Sonnet скажет «вроде ок» — Opus найдёт проблему.
  5. Длинные агенты с ветвлениями. Если агент строит план из 20 шагов с backtracking — Opus или fable-5 надёжнее.

Когда Sonnet 4.6 — ваш лучший друг

Sonnet 4.6 — это дефолт, с которого стоит начинать. Переходите на Opus, только если Sonnet явно не справился. Сценарии, где Sonnet 4.6 — оптимум:

  • Написание нового кода средней сложности (фичи, ручки, миграции)
  • Code review обычного PR (до 500 строк)
  • Объяснение незнакомого кода
  • Ответы на вопросы вида «как сделать X»
  • Длинный контекст через claude-sonnet-4-6-1m (анализ документов)
  • Inline chat в IDE
  • Большинство задач в Claude Code по умолчанию

Когда Haiku 4.5 — то, что нужно

Haiku простой и быстрый. Не все задачи требуют ума — некоторые требуют скорости и дешевизны:

  • Inline-подсказки в IDE (Tab complete)
  • Классификация и маршрутизация
  • Генерация однотипных шаблонов
  • Извлечение структурированных данных (парсинг JSON, regex)
  • Короткие ответы на типовые вопросы
  • Когда Sonnet уже ответил «не знаю» — не Opus пробовать, а попробовать сформулировать запрос заново, и только если совсем плохо — повышать модель

fable-5 — особый случай

fable-5 — это reasoning-флагман Anthropic, доступный через LiteAI как отдельный тариф 500 ₽/1M токенов. Он не входит в пакет 30 ₽/M. Это потому, что у Anthropic fable-5 стоит $5/$25, и прямой аналогии с Opus/Sonnet нет.

Когда fable-5 оправдан:

  • Агентные задачи с длинными планами. fable-5 заметно точнее Sonnet в multi-step рассуждениях.
  • Жёсткий instruction following. Если Sonnet пропускает шаги в длинной инструкции — fable-5 держит структуру.
  • Минимум галлюцинаций в API-вызовах. fable-5 реже выдумывает несуществующие методы.
  • Глубокий рефакторинг с пониманием стиля проекта. Подхватывает конвенции кодовой базы.

Когда не нужен:

  • Простые диалоги и IDE-ассистент
  • Классификация и короткие ответы
  • Там, где Sonnet 4.6 справляется

Подробный разбор fable-5 — в статье «Модель fable-5 — что нового».

Как переключать модели на лету

В Claude Code:

# Внутри сессии — slash-команда
/model claude-opus-4-8
/model claude-sonnet-4-6
/model claude-haiku-4-5
/model claude-opus-4-8-1m
/model fable-5

# Или сразу при запуске
claude --model claude-sonnet-4-6

В Cursor (через LiteAI API-ключ):

{
  "models": [
    { "id": "claude-opus-4-8", "name": "Claude Opus 4.8" },
    { "id": "claude-sonnet-4-6", "name": "Claude Sonnet 4.6" },
    { "id": "claude-haiku-4-5", "name": "Claude Haiku 4.5" }
  ]
}

В LiteAI Chat переключение — кнопкой Model selector в верхней части окна. Между моделями Opus/Sonnet/Haiku/fable-5 переключаетесь в один клик.

Стратегия на каждый день

Готовая памятка — распечатайте и держите рядом:

Что делаю Какую модель ставлю
Пишу новую фичу Sonnet 4.6
Дебажу сложный баг Opus 4.8
Ревью PR > 500 строк Opus 4.8
Ревью PR < 500 строк Sonnet 4.6
Tab complete в IDE Haiku 4.5
Inline chat в IDE Sonnet 4.6 или Haiku 4.5
Агент с 10+ шагами fable-5
Агент с 3–5 шагами Sonnet 4.6
Классификация / парсинг Haiku 4.5
Длинный документ (50+ страниц) Sonnet 4.6 1M
Весь репозиторий в контексте Opus 4.8 1M
Не знаю, что выбрать Sonnet 4.6 (дефолт)

Итог

Anthropic даёт шесть моделей — и каждая нужна под свои задачи. Opus 4.8 — не «лучший Claude», а «самый умный Claude для сложных задач». Sonnet 4.6 — рабочая лошадка, Haiku 4.5 — скорость и дешевизна, fable-5 — reasoning-тяжеловес для агентов.

Привычка использовать Opus для всего — это переплата в 2–3 раза и потеря скорости в 3–4 раза без выигрыша в качестве. Через LiteAI все эти модели доступны по 30 ₽/1M токенов flat (fable-5 — 500 ₽/M), так что выбирайте под задачу, а не по принципу «что подороже».

Попробуйте — купите пакет 1M токенов за 30 ₽, прогоните типичный запрос на каждой из моделей и сравните, где Sonnет достаточно, а где без Opus не обойтись. За 30 ₽ вы получите полную картину, на которой строится остальная экономия.

Готовы попробовать LiteAI?

API ключ Anthropic для Claude Opus, Sonnet и Haiku — за 30 секунд, оплата в рублях.