Anthropic 28 сентября выпустила Claude Sonnet 5.5 — более быструю и дешёвую в работе замену Sonnet 5. Модель уже доступна в приложениях Claude, через API и облака Amazon, Google и Microsoft. Цена токенов не изменилась: миллион входных стоит $2, выходных — $10, чтение кэша — $0,20.

В двух тестах рабочих задач, которые Artificial Analysis провела на предрелизной версии, Sonnet 5.5 почти совпала с флагманом: 1844 балла против 1846 у Opus 5.5 на GDPval-AA и 1811 против 1822 на AA-Briefcase. Предыдущая Sonnet 5 получила 1449 и 1359 баллов. В Terminal-Bench 4.0 — испытании многошаговой работы в командной строке — новая модель набрала 70,6% против 10,3% у Sonnet 5 и 66,4% у Opus 5.5. Настройки усилия в этих сравнениях различались, поэтому отдельные цифры не означают универсального превосходства.

Токены Sonnet 5.5 стоят вдвое дешевле, чем у Opus 5.5, но это не обещание вдвое меньшей цены любой задачи: на высоких настройках усилия модели могут расходовать сопоставимые суммы. Anthropic заявляет, что Sonnet 5.5 выдаёт ответы более чем на 30% быстрее предшественницы и обходится до 30% дешевле на типичной задаче за счёт меньшего числа токенов и вызовов инструментов. Это измерения разработчика и ранних партнёров, а не независимая гарантия для каждой нагрузки.

Сама Anthropic не считает Sonnet 5.5 новым пределом способностей: Opus 5.5 остаётся сильнее в сложной открытой работе, требующей длительного суждения. При этом киберспособности Sonnet выросли настолько, что модель впервые в этой линейке получила защиту и переключение опасных запросов на Sonnet 5, а также классификаторы против извлечения рассуждений. Получился не новый флагман, а перенос большей части флагманского уровня в более дешёвый рабочий класс — с оговорками о тестах и тем, какая модель фактически ответит на чувствительный запрос.