Содержание

Цены и состав линейки актуальны на 24 июня 2026. Это движущаяся мишень: перед бюджетированием сверяйтесь с официальной страницей цен Anthropic.

Зачем разбираться в линейке

Если вы зовёте Claude из кода, выбор модели это не косметика, а прямой множитель счёта и латентности. Разница в цене между крайними уровнями примерно пятикратная по токенам, а по эффективной стоимости запроса может расходиться на порядок. Поэтому стоит понимать, что вообще есть на полке.

Три рабочих уровня

Текущее поколение это три модели, выстроенные по оси «скорость и цена против интеллекта».

Claude Haiku 4.5 — самая быстрая модель с почти фронтирным интеллектом. Контекст 200K токенов. Её место: классификация, маршрутизация, извлечение данных, суммаризация, модерация, подзадачи внутри агентов. Всё, где нужен большой поток и низкая задержка.

Claude Sonnet 4.6 — лучший баланс скорости и интеллекта, дефолт для большинства продакшен-задач. Контекст 1M токенов, максимум вывода 128K. Тянет основную массу работы: генерация кода, анализ данных, контент, работа с инструментами.

Claude Opus 4.8 — самая способная модель Opus-уровня для сложных рассуждений и агентного кодинга. Контекст 1M токенов. Сюда идут многочасовые автономные агенты, крупный рефакторинг, системная инженерия, исследовательские задачи, где точность важнее цены.

Грубый ориентир по пропорциям цены: Sonnet примерно втрое дороже Haiku, а Opus примерно в 1.67 раза дороже Sonnet. Разрыв Opus к Sonnet меньше, чем многие ждут по названиям.

Что стоит над тройкой

Claude Fable 5 — самая способная широко доступная модель, для самых тяжёлых рассуждений и долгих агентных задач. Контекст 1M, всегда включённое адаптивное мышление. Цена заметно выше Opus: 10 долларов за миллион входных токенов и 50 за миллион выходных.

Есть ещё Claude Mythos 5 в рамках программы Project Glasswing: доступ по приглашению, не для самостоятельного подключения. Для типичного разработчика это пока вне практической плоскости, так что в серии я держусь тройки плюс Fable.

Effort: новый рычаг внутри модели

У свежих Opus и Sonnet появился параметр effort. Он меняет, сколько модель «думает», то есть торгует интеллект против латентности и стоимости, не меняя саму модель.

На Opus 4.8 уровень по умолчанию high на всех поверхностях, включая API и Claude Code. Доступны low, high, xhigh, max. Для кодинга и высокоавтономной работы официально рекомендуют xhigh — это золотая середина между high и max.

Практический вывод: прежде чем прыгать на модель уровнем выше, попробуйте поднять effort на текущей. Часто это дешевле и достаточно.

Почему ID модели это «снимок»

Важная для продакшена деталь: каждый ID модели в Claude это закреплённый снимок конкретного релиза, а не вечный указатель на «последнюю» версию.

import anthropic

client = anthropic.Anthropic()

# Каждый из этих ID привязан к конкретному релизу
OPUS   = "claude-opus-4-8"
SONNET = "claude-sonnet-4-6"
HAIKU  = "claude-haiku-4-5-20251001"  # алиас: claude-haiku-4-5

resp = client.messages.create(
    model=SONNET,
    max_tokens=1024,
    messages=[{"role": "user", "content": "Привет"}],
)
print(resp.content[0].text)

Раньше у моделей в ID была дата (например, 20250929). С поколения 4.6 формат стал бездатным (claude-sonnet-4-6), но это по-прежнему закреплённый снимок, а не автоматически обновляемый указатель. Для воспроизводимости это плюс: ваш прод не «переедет» на новую версию сам по себе. Минус: апгрейд это всегда осознанное действие через смену ID.

Что дальше

В следующей части разберём, как выбирать модель под конкретную задачу: два стартовых подхода (снизу вверх и сверху вниз), матрицу выбора и как принимать решение об апгрейде на бенчмарках, а не на ощущениях.

Поделиться: