Перейти к содержимому
Команда ClaudexiaМОДЕЛИ

Opus 5 vs 4.8 vs 4.7 vs 4.6: сравнение ревизий по цене одинаковой

Все четыре ревизии Opus стоят у нас одинаково, 0.4 доллара за миллион токенов на вход и выход. Разбираем, чем они отличаются на практике и как выбрать.

В лайнапе Claudexia сейчас четыре ревизии Opus: 5, 4.8, 4.7 и 4.6. Обычно выбор модели начинается с цены, но здесь этот аргумент не работает: цена одна и та же у всех четырёх. Значит выбирать приходится по поведению и стабильности, а не по счёту.

Все четыре ревизии рядом

МодельВход, $/1MВыход, $/1MРоль в лайнапе
claude-opus-50.40.4флагман, дефолт для сложных задач
claude-opus-4.80.40.4цель отката для 5, крепкий workhorse
claude-opus-4.70.40.4ранняя ревизия, для пиннинга
claude-opus-4.60.40.4ранняя ревизия, для пиннинга

Для сравнения: у Anthropic напрямую Opus 5 стоит 5 долларов за миллион входных токенов и 25 за миллион выходных. Через Claudexia все четыре ревизии Opus идут по 0.4 и 0.4, независимо от того, какую именно вы вызываете.

Раз цена одинаковая, при чём тут выбор

Если бы цена росла с номером ревизии, выбор был бы компромиссом между качеством и бюджетом. У нас этой оси нет, поэтому решение сводится к трём вопросам: нужна ли вам скорость и новые возможности флагмана, нужна ли предсказуемость уже настроенного поведения, или нужна воспроизводимость зафиксированной версии для evals и аудита.

Когда брать самую новую

Opus 5 принёс два конкретных улучшения: заметно быстрее отвечает на длинных агентных прогонах и умеет менять набор инструментов посреди диалога, не начиная сессию заново. Плюс встроенный откат на 4.8, если классификатор безопасности пометил запрос, так что даже вызывая 5 напрямую, вы получаете страховку без лишнего кода.

Берите 5 по умолчанию для новых проектов, если нет причины держаться за конкретную старую ревизию.

Когда стабильность важнее новизны

  • Прод уже настроен под конкретную ревизию. Промпты, few-shot примеры, парсинг ответа, всё это калибруется под поведение модели. Смена ревизии без тестов, риск регрессии, который вы получаете бесплатно и без предупреждения.
  • Есть зафиксированный eval-датасет. Пин фиксирует базу сравнения во времени. Если метрика pass rate должна быть сравнима месяц к месяцу, менять модель под капотом нельзя.
  • Нужна документальная воспроизводимость. В аудите или регуляторных процессах иногда важно точно знать, какая версия модели обработала конкретный запрос.

Для этих сценариев 4.8, 4.7 или 4.6 подходят ровно так же хорошо, как и раньше, и не приносят никакого штрафа по цене за то, что они не флагман.

Как переключаться между ревизиями в коде

Меняется одна строка, model, остальной код не трогается:

from openai import OpenAI

client = OpenAI(api_key="sk_cdx_...", base_url="https://api.claudexia.tech/v1")

for model in ["claude-opus-5", "claude-opus-4.8", "claude-opus-4.7", "claude-opus-4.6"]:
    resp = client.chat.completions.create(
        model=model,
        messages=[{"role": "user", "content": "Сформулируй план миграции сервиса"}],
    )
    print(model, "->", resp.choices[0].message.content[:80])

Прогнать один и тот же кейс по всем четырём ревизиям, самый честный способ увидеть разницу в поведении на своей задаче, а не на чужом описании.

Практическая схема выбора

  1. Новый проект без legacy-ограничений, берите claude-opus-5.
  2. Прод уже настроен и работает, оставляйте текущую ревизию, пока не появится причина мигрировать.
  3. Идёт сравнение перед миграцией, держите прод на старой ревизии и параллельно гоняйте eval-датасет на новой.
  4. Нужна документальная фиксация версии, пиньтесь на конкретный id и заведите задачу на регулярную проверку статуса ревизии у Anthropic.

Считать разницу в деньгах между вариантами не нужно, её здесь просто нет. Расход по каждому ключу и по каждой модели виден в дашборде, а прикинуть сумму под свой объём токенов можно калькулятором на сайте.

Коротко

Все четыре ревизии Opus стоят у нас одинаково: 0.4 доллара на вход и 0.4 на выход за миллион токенов. Opus 5 быстрее и умеет менять инструменты на лету, 4.8 держит роль отката и workhorse, 4.6 и 4.7 остаются для тех, кому нужна воспроизводимость. Выбирайте по задаче, а не по счёту, счёт тут не меняется.