Anthropic выпустила техническую карту для модели Sonnet 5.5
1 октября 2026 г. · 2 мин чтения
Компания Anthropic опубликовала системную карту для модели Sonnet 5.5, которая стала второй моделью в семействе Claude 5.5 после Opus 5.5. Документ, выпущенный 28 сентября 2026 года, описывает технические характеристики и ограничения новой модели.
Стоимость использования Sonnet 5.5 осталась на уровне Sonnet 5 и составляет 2/10 доллара за миллион токенов. При этом при максимальной нагрузке модель демонстрирует самый высокий уровень потребления токенов из всех когда-либо измеренных, а ее процесс рассуждения стал менее читаемым.
В области кибербезопасности модель показала значительный рост возможностей. В тесте CyScenarioBench, оценивающем планирование многоэтапных киберопераций, Sonnet 5.5 успешно выполнила 46,1% сценариев, тогда как Sonnet 5 справилась лишь с 0,7%. В тесте на эксплуатацию бинарных файлов новая модель создала 50 перехватов потока управления против 3 у предыдущей версии.
Из-за роста этих способностей Anthropic впервые применила в линейке Sonnet защитные барьеры и механизмы резервного копирования, разработанные для флагманских моделей. Это привело к тому, что пользователи могут столкнуться с более частыми отказами модели даже при выполнении безобидных задач, связанных с кибербезопасностью. Поиск уязвимостей в исходном коде разрешен, однако поиск уязвимостей в скомпилированных бинарных файлах блокируется.
Механизмы блокировки работают по разному в зависимости от канала доступа. В приложениях Anthropic и Claude Code высокорискованные киберзапросы автоматически перенаправляются на старую модель Sonnet 5. При использовании API разработчик должен активировать этот резервный механизм самостоятельно. Блокировки в области биологии завершают запрос без перенаправления.
С точки зрения безопасности, Sonnet 5.5 показала лучшие результаты в защите от инъекций промптов. В тесте Gray Swan на косвенные инъекции уровень успеха атак снизился до 3,4% после 15 попыток по сравнению с 6,7% у Sonnet 5. В сценариях использования браузера через Chrome и Claude Cowork модель не допустила ни одной успешной атаки из 110 протестированных случаев.
Тем не менее, уровень отказа от выполнения вредоносных задач при использовании компьютера снизился с 84,68% у Sonnet 5 до 79,46%. Аналогичное снижение наблюдается в Claude Code, где показатель упал с 87,9% до 85,2%. В среде кодинга сама модель Sonnet 5.5 была скомпрометирована в 4 случаях из 5 901 запроса.
Согласно политике ответственного масштабирования, риски Sonnet 5.5 остаются в пределах показателей Opus 5.5, так как новая модель уступает ей почти во всех тестах. В области химии и биологии способности Sonnet 5.5 оцениваются как равные или ниже Opus 5. Внутренний индекс AECI присвоил Sonnet 5.5 значение 167,93, в то время как у Opus 5.5 он составляет 169,12.