Новые модели выходят, а старые не выключаются просто так. claude-sonnet-4.6 остаётся доступен по цене 0,3 доллара за миллион токенов на вход и выход, ровно как и Sonnet 5. Разберём, кому стоит держаться этой версии.
Что значит «стабильная ревизия»
4.6 прошёл через месяцы реального трафика. Его поведение на типовых промптах предсказуемо: если система работала полгода назад и работает сейчас, значит она продолжит работать так же завтра. Дело тут не в мощности модели, а в отсутствии сюрпризов.
Кто пинит версию и почему
Команды с настроенными промптами. Если system prompt и few-shot примеры вылизаны под конкретное поведение модели, переход на новую ревизию требует повторной калибровки. Иногда результат становится лучше, иногда просто другим, и это уже риск для продакшна.
Регулируемые отрасли. Там, где нужна воспроизводимость ответов для аудита или комплаенса, смена модели посреди отчётного периода создаёт вопросы, на которые лучше не отвечать постфактум.
Проекты с закреплённой оценкой качества. Если у вас есть eval-набор, откалиброванный под 4.6, и метрики подтверждают нужный уровень ошибок, менять модель без повторного прогона eval-ов не стоит.
Простое «не чинить то, что работает». Валидный довод сам по себе. Апгрейд ради апгрейда стоит времени на тестирование, а времени всегда не хватает.
Когда всё же стоит перейти
Если вы начинаете новый проект, пинить старую версию нет смысла: начинайте сразу с текущей. Если же 4.6 упирается в качество на конкретных задачах, разумно прогнать те же промпты на Sonnet 5 и сравнить результат, прежде чем переезжать полностью.
Пример вызова
from anthropic import Anthropic
client = Anthropic(
api_key="sk_cdx_your_key_here",
base_url="https://api.claudexia.tech",
)
message = client.messages.create(
model="claude-sonnet-4.6",
max_tokens=1024,
messages=[{"role": "user", "content": "Проверь этот SQL-запрос на N+1."}],
)
print(message.content[0].text)
Формат OpenAI Chat Completions работает на том же ключе и том же эндпоинте, менять model на claude-sonnet-4.6 достаточно.
Как переключаться без риска
Держите версию модели в конфиге, а не в коде. Тогда A/B-тест между 4.6 и 5 это смена одной строки, а не редеплой. На старте гоняйте оба варианта параллельно на теневом трафике и сравнивайте по вашей метрике, а не по общим впечатлениям.
Держать обе версии одновременно не накладно: ключ у вас один на всю линейку, а статистика на дашборде разбита по моделям, так что вы сразу видите, сколько ушло на 4.6, а сколько на пятёрку, без ручного сведения логов.
Про цену
У Sonnet 4.6 и Sonnet 5 одинаковый прайс: 0,3 доллара за миллион токенов на каждую сторону. Цена здесь не аргумент ни за, ни против. Решение чисто про стабильность поведения против свежести модели.
Коротко
Sonnet 4.6 остаётся в линейке не как пережиток, а как рабочий вариант для тех, кому важна предсказуемость. Цена не меняется при переходе на пятёрку, так что тестируйте на своих данных и переезжайте, когда будете готовы, а не потому что вышла новая цифра в номере версии.