Anthropic представляет новую модель ИИ Claude Sonnet 5.5
Sonnet — это рабочая лошадка семейства моделей Claude от компании Anthropic для повседневного использования. Модель Sonnet 5.5 хорошо справляется с такими задачами, как генерация документов, составление отчетов, работа с электронными таблицами и исправление ошибок в коде. Компания добавила, что модель также «хорошо разбирается в дизайне», что позволяет ей улучшать пользовательские интерфейсы и создавать слайды по шаблонам, которые требуют минимального редактирования.
В этом релизе, вышедшем после недавнего запуска флагманской модели Claude Opus 5.5, используются более понятные стили написания текстов. Новая модель Sonnet 5.5 пишет более чётко и более похоже на человеческий текст, в который также добавляются невидимыми текстовые водяные знаки. Когда компания анонсировала новую технологию водяных знаков, то заявила, что это не повлияет на качество или общую читабельность текста, но повысит вероятность обнаружения текста, созданного искусственным интеллектом. Anthropic добавила эту возможность для соответствия мировым нормативным требованиям, включая Закон Европейского союза об искусственном интеллекте.
Благодаря ясности изложения и улучшенной коммуникации модель Sonnet 5.5 лучше подходит для совместной работы. Компания сообщила, что первые тестировщики охарактеризовали её как более быструю в плане итераций при решении менее сложных задач и более интеллектуальную, чем предыдущее поколение моделей. Цена модели такая же, как у Sonnet 5: 2 доллара за миллион входных токенов, 10 долларов за миллион выходных токенов и 20 центов за миллион операций чтения из кэша. По данным Anthropic, для выполнения той же работы модели обычно требуется гораздо меньше токенов, что делает её на 30% дешевле, по сравнению с предыдущим поколением.
«Мы обучили Claude Sonnet 5.5 на сотнях реальных примеров использования в сфере поддержки, включая ответы и запросы на повышение уровня обслуживания», — сказал Абхинай Катурия, директор по искусственному интеллекту в компании Zendesk Inc. «Модель принимала меньше ошибочных решений и решала заявки быстрее, чем модели Claude, которые мы используем в настоящее время. Обработка заявок происходила на 20% быстрее, что позволяло нашим клиентам получать необходимую помощь без задержек».
Что касается производительности, новая модель набрала 70,6% в тесте на агентное программирование Terminal-Bench 4.0, по сравнению с 10,3% у предыдущей модели. Она также набрала всего на два балла меньше, чем модель Opus 5.5, в тесте GDPval-AA, имитирующем реальную профессиональную работу и задачи. В Anthropic добавили, что это первая модель Sonnet, которая выиграла в Pokémon Red — видеоигру, обычно используемую для проверки способности модели работать с долгосрочными целями и оценки понимания ею изображений, представляющих собой скриншоты игры.
В Anthropic отметили, что модель Sonnet 5.5 более чем на 30% превосходит предыдущее поколение по скорости вывода данных, что делает ее самой быстрой моделью Sonnet на сегодняшний день. Компания также добавила, что в ближайшие недели планирует выпустить Haiku 5.5 — самую компактную, быструю и эффективную модель семейства Claude, предназначенную для крупномасштабных и экономичных приложений.
Поскольку модель Sonnet 5.5 построена на той же основе, что и Opus 5.5, она также является первой моделью Sonnet с заметными возможностями в области кибербезопасности. В результате, по словам представителей компании, это первая модель семейства, которая запускается с мерами киберзащиты и резервными вариантами, разработанными для более мощных моделей, таких как модели класса Mythos и Fable. Эти меры могут сработать, когда запросы пользователей касаются кибербезопасности, биологии или других деликатных тем, но в большинстве случаев они не влияют на разработку программного обеспечения и работу в сфере медико-биологических наук.



