Содержание
Цены и состав линейки актуальны на 24 июня 2026. Это движущаяся мишень: перед бюджетированием сверяйтесь с официальной страницей цен Anthropic.
Зачем разбираться в линейке
Если вы зовёте Claude из кода, выбор модели это не косметика, а прямой множитель счёта и латентности. Разница в цене между крайними уровнями примерно пятикратная по токенам, а по эффективной стоимости запроса может расходиться на порядок. Поэтому стоит понимать, что вообще есть на полке.
Три рабочих уровня
Текущее поколение это три модели, выстроенные по оси «скорость и цена против интеллекта».
Claude Haiku 4.5 — самая быстрая модель с почти фронтирным интеллектом. Контекст 200K токенов. Её место: классификация, маршрутизация, извлечение данных, суммаризация, модерация, подзадачи внутри агентов. Всё, где нужен большой поток и низкая задержка.
Claude Sonnet 4.6 — лучший баланс скорости и интеллекта, дефолт для большинства продакшен-задач. Контекст 1M токенов, максимум вывода 128K. Тянет основную массу работы: генерация кода, анализ данных, контент, работа с инструментами.
Claude Opus 4.8 — самая способная модель Opus-уровня для сложных рассуждений и агентного кодинга. Контекст 1M токенов. Сюда идут многочасовые автономные агенты, крупный рефакторинг, системная инженерия, исследовательские задачи, где точность важнее цены.
Грубый ориентир по пропорциям цены: Sonnet примерно втрое дороже Haiku, а Opus примерно в 1.67 раза дороже Sonnet. Разрыв Opus к Sonnet меньше, чем многие ждут по названиям.
Что стоит над тройкой
Claude Fable 5 — самая способная широко доступная модель, для самых тяжёлых рассуждений и долгих агентных задач. Контекст 1M, всегда включённое адаптивное мышление. Цена заметно выше Opus: 10 долларов за миллион входных токенов и 50 за миллион выходных.
Есть ещё Claude Mythos 5 в рамках программы Project Glasswing: доступ по приглашению, не для самостоятельного подключения. Для типичного разработчика это пока вне практической плоскости, так что в серии я держусь тройки плюс Fable.
Effort: новый рычаг внутри модели
У свежих Opus и Sonnet появился параметр effort. Он меняет, сколько модель «думает», то есть торгует интеллект против латентности и стоимости, не меняя саму модель.
На Opus 4.8 уровень по умолчанию high на всех поверхностях, включая API и Claude Code. Доступны low, high, xhigh, max. Для кодинга и высокоавтономной работы официально рекомендуют xhigh — это золотая середина между high и max.
Практический вывод: прежде чем прыгать на модель уровнем выше, попробуйте поднять effort на текущей. Часто это дешевле и достаточно.
Почему ID модели это «снимок»
Важная для продакшена деталь: каждый ID модели в Claude это закреплённый снимок конкретного релиза, а не вечный указатель на «последнюю» версию.
import anthropic
client = anthropic.Anthropic()
# Каждый из этих ID привязан к конкретному релизу
OPUS = "claude-opus-4-8"
SONNET = "claude-sonnet-4-6"
HAIKU = "claude-haiku-4-5-20251001" # алиас: claude-haiku-4-5
resp = client.messages.create(
model=SONNET,
max_tokens=1024,
messages=[{"role": "user", "content": "Привет"}],
)
print(resp.content[0].text)
Раньше у моделей в ID была дата (например, 20250929). С поколения 4.6 формат стал бездатным (claude-sonnet-4-6), но это по-прежнему закреплённый снимок, а не автоматически обновляемый указатель. Для воспроизводимости это плюс: ваш прод не «переедет» на новую версию сам по себе. Минус: апгрейд это всегда осознанное действие через смену ID.
Что дальше
В следующей части разберём, как выбирать модель под конкретную задачу: два стартовых подхода (снизу вверх и сверху вниз), матрицу выбора и как принимать решение об апгрейде на бенчмарках, а не на ощущениях.
Обсуждение
Пока нет комментариев. Будьте первым.