Какую модель Claude выбрать в 2026 году — Opus 4.8, Sonnet 4.6, Haiku 4.5, fable-5
Практическая матрица выбора модели Claude 2026: claude-opus-4-8 / opus-4-8-1m / sonnet-4-6 / sonnet-4-6-1m / haiku-4-5 / fable-5. Почему Opus на простых задачах расходует в 2–3× больше токенов отвечает в 3–4× дольше, и какую модель ставить под рефакторинг, code review, Tab completion, агенты, длинный контекст. Экономия в 2.5 раза при правильном выборе.
Какую модель Claude выбрать в 2026 году — Opus 4.8, Sonnet 4.6, Haiku 4.5, fable-5
В линейке Anthropic шесть моделей, и каждая из них подходит под свои задачи. Использовать Claude Opus 4.8 «на каждый чих» — всё равно что возить мешок картошки на карьерном самосвале: едет, но расход топлива и время в пути не оправданы. В этой статье — практическая матрица: какую модель ставить под какую задачу, где Opus оправдан, а где Sonnet 4.6 или Haiku 4.5 справятся не хуже, и в чём разница на кошельке.
Шесть моделей — шесть ролей
Через LiteAI доступны все актуальные модели Anthropic 2026 года:
| Модель | Роль | Когда выбирать |
|---|---|---|
| claude-opus-4-8 | Самая мощная | Сложный рефакторинг, архитектура, длинные многошаговые рассуждения |
| claude-opus-4-8-1m | Opus с контекстом 1M | Когда нужно засунуть в один запрос весь репозиторий или книгу |
| claude-sonnet-4-6 | Баланс качества и скорости | Рабочая лошадка на каждый день. Дефолт для 80% задач |
| claude-sonnet-4-6-1m | Sonnet с контекстом 1M | Длинный документ + средняя сложность |
| claude-haiku-4-5 | Самая быстрая и дешёвая | Классификация, переименование, шаблоны, короткие ответы |
| fable-5 | Reasoning-флагман | Многошаговые планы, агентные задачи, точные инструкции |
Технические параметры моделей в LiteAI:
| Модель | Контекст | Скорость | Качество рассуждений | Цена LiteAI |
|---|---|---|---|---|
claude-opus-4-8 |
200K | Медленная | Максимальное | 30 ₽ / 1M |
claude-opus-4-8-1m |
1M | Медленная | Максимальное | 30 ₽ / 1M |
claude-sonnet-4-6 |
200K | Средняя | Высокое | 30 ₽ / 1M |
claude-sonnet-4-6-1m |
1M | Средняя | Высокое | 30 ₽ / 1M |
claude-haiku-4-5 |
200K | Быстрая | Хорошее | 30 ₽ / 1M |
fable-5 |
1M | Медленная | Очень высокое | 500 ₽ / 1M |
Что важно: у LiteAI единая цена 30 ₽ за 1M токенов на Opus 4.8, Sonnet 4.6 и Haiku 4.5 — независимо от ввода, вывода и размера контекста. У Anthropic напрямую та же картина по качеству, но цена в 9–45× выше: $15/$75 за Opus, $3/$15 за Sonnet, $0.80/$4 за Haiku. fable-5 — отдельный тариф 500 ₽/M (тоже flat), потому что у Anthropic он стоит $5/$25.
Почему «Opus на всё» — плохая стратегия
Opus 4.8 объективно самая сильная модель в линейке. Но «самая сильная» ≠ «самая подходящая». Три причины не использовать Opus для простых задач:
1. Расход токенов выше. Opus любит «размышлять вслух»: chain-of-thought у него длиннее, и в вывод попадает больше промежуточных рассуждений. На одинаковом промпте Sonnet 4.6 выдаст ответ за 200 выходных токенов, а Opus может потратить 400–600, описывая ход мысли. Стоимость растёт в 1.5–3 раза при том же результате.
2. Время ответа. На запрос, на который Sonnet отвечает за 3 секунды, Opus тратит 8–15. Это критично для интерактивных сценариев: Tab completion в Cursor, автокомплит в IDE, чат-бот на сайте. Пользователь ждёт, а не «наслаждается качеством».
3. Качество не отличается на простых задачах. Если вы просите «переименуй переменную x в data», Sonnet и Haiku справятся одинаково хорошо. Разница в качестве появляется только на задачах, где и нужны глубокие рассуждения — а на «rename» модель и так «не думает».
Правило: берите Opus там, где его сила действительно нужна — сложные многошаговые задачи. Для всего остального есть Sonnet и Haiku.
Матрица «задача → модель»
Вот конкретная раскладка. Сначала — задачи (от сложных к простым), потом рекомендуемая модель.
Глубокие рассуждения и сложный код
| Задача | Лучшая модель | Почему |
|---|---|---|
| Рефакторинг большой кодовой базы (>50 файлов) | claude-opus-4-8 |
Удерживает контекст, видит перекрёстные зависимости |
| Проектирование архитектуры с нуля | claude-opus-4-8 или fable-5 |
Нужны trade-off анализ и длинные рассуждения |
| Code review на 1000+ строк | claude-opus-4-8 |
Ловит тонкие баги, которые пропускают более слабые модели |
| Написание сложного регулярного выражения | claude-sonnet-4-6 |
Opus даст то же самое, но дольше и дороже |
| Объяснение чужого legacy-кода | claude-sonnet-4-6 |
Sonnet достаточно умный, чтобы понять код, но не будет «перемудривать» |
| Генерация тестов | claude-sonnet-4-6 |
Sonnet даёт хорошее покрытие в среднем темпе |
Длинный контекст
| Задача | Лучшая модель | Почему |
|---|---|---|
| Анализ PDF на 300+ страниц | claude-sonnet-4-6-1m или fable-5 |
1M контекста вместо 200K, Sonnet дешевле |
| Анализ всего репозитория разом | claude-opus-4-8-1m |
Opus + 1M = максимум качества на больших объёмах |
| Резюме длинного лога / транскрипта | claude-sonnet-4-6-1m |
Суммаризация не требует флагманских рассуждений |
| Чтение контракта на 50 страниц | claude-sonnet-4-6 |
200K контекста хватит, Sonnet справится |
Агентные задачи и multi-step
| Задача | Лучшая модель | Почему |
|---|---|---|
| Агент с 10-шаговым планом (tool use) | fable-5 |
Лучше всех держит структуру инструкций |
| Cursor Composer на сложной задаче | claude-sonnet-4-6 |
Хороший баланс цены/скорости/качества |
| Claude Code на проект рефакторинга | claude-opus-4-8 |
Когда нужно «подумать» перед действием |
| Автоправка линтера (rename, import sort) | claude-haiku-4-5 |
Механическая работа, не нужны рассуждения |
Классификация, короткие ответы, рутина
| Задача | Лучшая модель | Почему |
|---|---|---|
| Суммаризация 5 предложений в 1 | claude-haiku-4-5 |
Элементарная задача, не нужна мощь Sonnet |
| Классификация тикета (баг / фича / вопрос) | claude-haiku-4-5 |
Быстро и дёшево |
| Генерация шаблона email / commit message | claude-haiku-4-5 |
Шаблон = шаблон, Haiku хватает |
| Парсинг JSON из текста | claude-haiku-4-5 |
Структурная задача, не творческая |
| Sonnet ответил «не знаю» — какой попробовать? | claude-opus-4-8 |
Если Sonnet не справился, есть шанс, что Opus справится |
Быстрые вопросы и IDE
| Задача | Лучшая модель | Почему |
|---|---|---|
| Tab completion в Cursor / IDE | claude-haiku-4-5 |
Автокомплит должен быть мгновенным |
| Inline chat в VS Code | claude-haiku-4-5 или claude-sonnet-4-6 |
Короткий вопрос, короткий ответ |
| Объяснить ошибку из stack trace | claude-sonnet-4-6 |
Нужен контекст и понимание, не просто классификация |
| «Как сделать X в Python» | claude-sonnet-4-6 |
Типовой вопрос, Sonnet ответит качественно |
Сколько вы экономите, выбирая правильную модель
Сравним сценарий: 1000 запросов в день, средний объём — 1K входных + 800 выходных токенов. Это типичная нагрузка для IDE-ассистента или чат-бота.
Сценарий 1: «Всё на Opus 4.8»
- 1M входных + 0.8M выходных токенов в день
- На LiteAI: 1.8M × 30 ₽ = 54 ₽/день ≈ 1 620 ₽/месяц
Сценарий 2: «Правильная модель под задачу» (50% Haiku, 30% Sonnet, 20% Opus)
- 0.5M на Haiku + 0.4M на Sonnet + 0.18M на Opus = те же 1.8M, цена одна — 30 ₽/M
- Звучит, как будто экономии нет. Но!
Сценарий 3: «Учитываем, что Opus размышляет дольше»
На простых задачах (классификация, шаблоны) Opus тратит в 2–3 раза больше выходных токенов, потому что генерирует подробные рассуждения. Реальные замеры:
| Задача | Opus output | Sonnet output | Haiku output |
|---|---|---|---|
| Rename переменной | 350 токенов | 50 | 30 |
| Классификация тикета | 280 токенов | 80 | 20 |
| Генерация email | 600 токенов | 250 | 150 |
| Суммаризация 1 параграфа | 400 токенов | 180 | 120 |
Если всё это гонять на Opus, расход вырастает в 2–4 раза. То есть при тарифе 30 ₽/M flat в день:
- «Всё на Opus»: ~1.8M токенов → 54 ₽/день
- «Правильная модель»: ~0.7M токенов → 21 ₽/день
Экономия — в 2.5 раза, или ~1 000 ₽/месяц. На больших объёмах (10K+ запросов/день) — десятки тысяч рублей.
Экономика скорости
Помимо денег, время ответа — это пользовательский опыт. Среднее время ответа на LiteAI (по последним замерам):
| Модель | TTFT (до первого токена) | Полный ответ на 500 токенов |
|---|---|---|
claude-haiku-4-5 |
~0.4 сек | 1.5–2 сек |
claude-sonnet-4-6 |
~0.6 сек | 3–4 сек |
claude-sonnet-4-6-1m |
~0.7 сек | 3–5 сек |
claude-opus-4-8 |
~1.5 сек | 8–12 сек |
claude-opus-4-8-1m |
~1.8 сек | 10–15 сек |
fable-5 |
~1.5 сек | 8–14 сек |
Если вы делаете Tab completion в IDE — пользователь не будет ждать 10 секунд Opus ради того, что Haiku выдаёт за 0.4 сек. Для real-time сценариев Haiku — единственный разумный выбор.
Когда Opus 4.8 действительно нужен
Перечислим конкретные сценарии, где Opus оправдан и переплата за него окупается:
- Сложный многошаговый рефакторинг. «Перепиши слой авторизации так, чтобы он соответствовал новой RBAC-модели» — Opus справится, Sonnet может потерять нюансы.
- Архитектурные решения с trade-off. «Выбрать между Postgres, ClickHouse и DuckDB для аналитики с учётом нагрузки, бюджета и опыта команды» — Opus разберёт варианты подробнее.
- Нетипичные edge cases. «Что произойдёт в этой distributed системе, если три ноды упадут одновременно» — Opus лучше держит сложные сценарии.
- Глубокий code review. Большой PR, тонкие race conditions, места, где Sonnet скажет «вроде ок» — Opus найдёт проблему.
- Длинные агенты с ветвлениями. Если агент строит план из 20 шагов с backtracking — Opus или fable-5 надёжнее.
Когда Sonnet 4.6 — ваш лучший друг
Sonnet 4.6 — это дефолт, с которого стоит начинать. Переходите на Opus, только если Sonnet явно не справился. Сценарии, где Sonnet 4.6 — оптимум:
- Написание нового кода средней сложности (фичи, ручки, миграции)
- Code review обычного PR (до 500 строк)
- Объяснение незнакомого кода
- Ответы на вопросы вида «как сделать X»
- Длинный контекст через
claude-sonnet-4-6-1m(анализ документов) - Inline chat в IDE
- Большинство задач в Claude Code по умолчанию
Когда Haiku 4.5 — то, что нужно
Haiku простой и быстрый. Не все задачи требуют ума — некоторые требуют скорости и дешевизны:
- Inline-подсказки в IDE (Tab complete)
- Классификация и маршрутизация
- Генерация однотипных шаблонов
- Извлечение структурированных данных (парсинг JSON, regex)
- Короткие ответы на типовые вопросы
- Когда Sonnet уже ответил «не знаю» — не Opus пробовать, а попробовать сформулировать запрос заново, и только если совсем плохо — повышать модель
fable-5 — особый случай
fable-5 — это reasoning-флагман Anthropic, доступный через LiteAI как отдельный тариф 500 ₽/1M токенов. Он не входит в пакет 30 ₽/M. Это потому, что у Anthropic fable-5 стоит $5/$25, и прямой аналогии с Opus/Sonnet нет.
Когда fable-5 оправдан:
- Агентные задачи с длинными планами. fable-5 заметно точнее Sonnet в multi-step рассуждениях.
- Жёсткий instruction following. Если Sonnet пропускает шаги в длинной инструкции — fable-5 держит структуру.
- Минимум галлюцинаций в API-вызовах. fable-5 реже выдумывает несуществующие методы.
- Глубокий рефакторинг с пониманием стиля проекта. Подхватывает конвенции кодовой базы.
Когда не нужен:
- Простые диалоги и IDE-ассистент
- Классификация и короткие ответы
- Там, где Sonnet 4.6 справляется
Подробный разбор fable-5 — в статье «Модель fable-5 — что нового».
Как переключать модели на лету
В Claude Code:
# Внутри сессии — slash-команда
/model claude-opus-4-8
/model claude-sonnet-4-6
/model claude-haiku-4-5
/model claude-opus-4-8-1m
/model fable-5
# Или сразу при запуске
claude --model claude-sonnet-4-6
В Cursor (через LiteAI API-ключ):
{
"models": [
{ "id": "claude-opus-4-8", "name": "Claude Opus 4.8" },
{ "id": "claude-sonnet-4-6", "name": "Claude Sonnet 4.6" },
{ "id": "claude-haiku-4-5", "name": "Claude Haiku 4.5" }
]
}
В LiteAI Chat переключение — кнопкой Model selector в верхней части окна. Между моделями Opus/Sonnet/Haiku/fable-5 переключаетесь в один клик.
Стратегия на каждый день
Готовая памятка — распечатайте и держите рядом:
| Что делаю | Какую модель ставлю |
|---|---|
| Пишу новую фичу | Sonnet 4.6 |
| Дебажу сложный баг | Opus 4.8 |
| Ревью PR > 500 строк | Opus 4.8 |
| Ревью PR < 500 строк | Sonnet 4.6 |
| Tab complete в IDE | Haiku 4.5 |
| Inline chat в IDE | Sonnet 4.6 или Haiku 4.5 |
| Агент с 10+ шагами | fable-5 |
| Агент с 3–5 шагами | Sonnet 4.6 |
| Классификация / парсинг | Haiku 4.5 |
| Длинный документ (50+ страниц) | Sonnet 4.6 1M |
| Весь репозиторий в контексте | Opus 4.8 1M |
| Не знаю, что выбрать | Sonnet 4.6 (дефолт) |
Итог
Anthropic даёт шесть моделей — и каждая нужна под свои задачи. Opus 4.8 — не «лучший Claude», а «самый умный Claude для сложных задач». Sonnet 4.6 — рабочая лошадка, Haiku 4.5 — скорость и дешевизна, fable-5 — reasoning-тяжеловес для агентов.
Привычка использовать Opus для всего — это переплата в 2–3 раза и потеря скорости в 3–4 раза без выигрыша в качестве. Через LiteAI все эти модели доступны по 30 ₽/1M токенов flat (fable-5 — 500 ₽/M), так что выбирайте под задачу, а не по принципу «что подороже».
Попробуйте — купите пакет 1M токенов за 30 ₽, прогоните типичный запрос на каждой из моделей и сравните, где Sonnет достаточно, а где без Opus не обойтись. За 30 ₽ вы получите полную картину, на которой строится остальная экономия.
Готовы попробовать LiteAI?
API ключ Anthropic для Claude Opus, Sonnet и Haiku — за 30 секунд, оплата в рублях.