В лайнапе Claudexia сейчас четыре ревизии Opus: 5, 4.8, 4.7 и 4.6. Обычно выбор модели начинается с цены, но здесь этот аргумент не работает: цена одна и та же у всех четырёх. Значит выбирать приходится по поведению и стабильности, а не по счёту.
Все четыре ревизии рядом
| Модель | Вход, $/1M | Выход, $/1M | Роль в лайнапе |
|---|---|---|---|
claude-opus-5 | 0.4 | 0.4 | флагман, дефолт для сложных задач |
claude-opus-4.8 | 0.4 | 0.4 | цель отката для 5, крепкий workhorse |
claude-opus-4.7 | 0.4 | 0.4 | ранняя ревизия, для пиннинга |
claude-opus-4.6 | 0.4 | 0.4 | ранняя ревизия, для пиннинга |
Для сравнения: у Anthropic напрямую Opus 5 стоит 5 долларов за миллион входных токенов и 25 за миллион выходных. Через Claudexia все четыре ревизии Opus идут по 0.4 и 0.4, независимо от того, какую именно вы вызываете.
Раз цена одинаковая, при чём тут выбор
Если бы цена росла с номером ревизии, выбор был бы компромиссом между качеством и бюджетом. У нас этой оси нет, поэтому решение сводится к трём вопросам: нужна ли вам скорость и новые возможности флагмана, нужна ли предсказуемость уже настроенного поведения, или нужна воспроизводимость зафиксированной версии для evals и аудита.
Когда брать самую новую
Opus 5 принёс два конкретных улучшения: заметно быстрее отвечает на длинных агентных прогонах и умеет менять набор инструментов посреди диалога, не начиная сессию заново. Плюс встроенный откат на 4.8, если классификатор безопасности пометил запрос, так что даже вызывая 5 напрямую, вы получаете страховку без лишнего кода.
Берите 5 по умолчанию для новых проектов, если нет причины держаться за конкретную старую ревизию.
Когда стабильность важнее новизны
- Прод уже настроен под конкретную ревизию. Промпты, few-shot примеры, парсинг ответа, всё это калибруется под поведение модели. Смена ревизии без тестов, риск регрессии, который вы получаете бесплатно и без предупреждения.
- Есть зафиксированный eval-датасет. Пин фиксирует базу сравнения во времени. Если метрика pass rate должна быть сравнима месяц к месяцу, менять модель под капотом нельзя.
- Нужна документальная воспроизводимость. В аудите или регуляторных процессах иногда важно точно знать, какая версия модели обработала конкретный запрос.
Для этих сценариев 4.8, 4.7 или 4.6 подходят ровно так же хорошо, как и раньше, и не приносят никакого штрафа по цене за то, что они не флагман.
Как переключаться между ревизиями в коде
Меняется одна строка, model, остальной код не трогается:
from openai import OpenAI
client = OpenAI(api_key="sk_cdx_...", base_url="https://api.claudexia.tech/v1")
for model in ["claude-opus-5", "claude-opus-4.8", "claude-opus-4.7", "claude-opus-4.6"]:
resp = client.chat.completions.create(
model=model,
messages=[{"role": "user", "content": "Сформулируй план миграции сервиса"}],
)
print(model, "->", resp.choices[0].message.content[:80])
Прогнать один и тот же кейс по всем четырём ревизиям, самый честный способ увидеть разницу в поведении на своей задаче, а не на чужом описании.
Практическая схема выбора
- Новый проект без legacy-ограничений, берите
claude-opus-5. - Прод уже настроен и работает, оставляйте текущую ревизию, пока не появится причина мигрировать.
- Идёт сравнение перед миграцией, держите прод на старой ревизии и параллельно гоняйте eval-датасет на новой.
- Нужна документальная фиксация версии, пиньтесь на конкретный id и заведите задачу на регулярную проверку статуса ревизии у Anthropic.
Считать разницу в деньгах между вариантами не нужно, её здесь просто нет. Расход по каждому ключу и по каждой модели виден в дашборде, а прикинуть сумму под свой объём токенов можно калькулятором на сайте.
Коротко
Все четыре ревизии Opus стоят у нас одинаково: 0.4 доллара на вход и 0.4 на выход за миллион токенов. Opus 5 быстрее и умеет менять инструменты на лету, 4.8 держит роль отката и workhorse, 4.6 и 4.7 остаются для тех, кому нужна воспроизводимость. Выбирайте по задаче, а не по счёту, счёт тут не меняется.