Все о Цифровых системах - новости, статьи, обзоры, аналитика. Более 1000 компаний, товаров и услуг в каталоге.
Добавить компаниюПредложить публикацию

Anthropic выпускает Claude Opus 5 с улучшенными показателями эффективности и безопасности

Рубрика: «Искусственный интеллект (AI)»

Anthropic утверждает, что ее новая большая языковая модель (LLM) по многим параметрам приближается к топовому алгоритму компании Mythos 5, но при этом стоит значительно дешевле. Компания не предоставила Mythos 5 в открытый доступ, но предложила приобрести доступ к своей упрощенной версии языковой модели под названием Fable 5, которая имеет много общих функций, но представляет меньший риск кибербезопасности. Anthropic сравнила Fable 5 с Opus 5 по 13 тестам. По словам представителей компании, последний алгоритм показал более высокие результаты в восьми тестах, несмотря на то, что стоит примерно на 50% дешевле.

Преимущество Opus 5 особенно ярко проявилось в двух тестах производительности: Frontier-Bench и AutomationBench. Первый тест включает 74 задачи из таких областей, как физика, химия и криптография. Модель Opus 5 показала результат на 9,7% лучше, чем модель Fable 5. В тесте AutomationBench, который включает набор задач, требующих интеллектуальной работы, модель Opus 5  получила на 8,5% более высокий балл.

Одним из факторов, способствующих высокой производительности модели Opus 5, является проверка точности её работы. В бенчмарке Frontier-Bench модели требовалось сгенерировать трехмерную схему детали машины. Opus 5 не имела возможности просмотреть чертеж, что делало проверку его точности невозможной. Модель решила эту проблему, разработав «конвейер компьютерного зрения для извлечения геометрии из исходных пикселей».

Функция проверки результатов Opus 5 также хорошо подходит для биологических исследований. По данным Anthropic, модель превзошла более раннюю большую языковую модель под названием Opus 4.8 по всем внутренним тестам в области биологических наук. Opus 5 оказалась особенно эффективной в автоматизированном исследовании белков — важной области, которая была удостоена Нобелевской премии по химии 2024 года.

Компания Anthropic утверждает, что на сегодняшний день Opus 5 — это самая безопасная модель по многим показателям. По сравнению со своими предшественницами, эта языковая модель менее подвержена обманным действиям и трудно исправимым ошибкам.

Anthropic не предоставила свой флагманский продукт модель Mythos 5 в открытый доступ из-за опасений, что хакеры могут использовать её для кибератак. Модель способна не только обнаруживать уязвимости, но и разрабатывать алгоритмы для их эксплуатации. В отличие от неё, Opus 5 получил нулевой балл во внутреннем тесте Anthropic, оценивающем способность моделей LLM эксплуатировать уязвимости.

Также компания оснастила новую языковую модель более мягкими механизмами защиты, по сравнению с Fable 5. Клиенты могут использовать Opus 5 для поиска уязвимостей в коде, но она блокирует методы сканирования уязвимостей, которые часто используются хакерами. По оценкам Anthropic, частота срабатывания механизмов защиты будет на 85% ниже, чем в Fable 5. Теперь Opus 5 является моделью по умолчанию в Max - топовом тарифном плане сервиса чат-ботов Claude. Она также доступна в тарифном плане Pro среднего уровня.

Разработчики могут подключать Opus 5 к своему программному обеспечению через программный интерфейс приложений Anthropic. В рамках сегодняшнего обновления API получает функцию, позволяющую прерывать LLM-процесс в середине работы и менять используемые инструменты. Еще одна новая возможность — перенаправлять запросы, заблокированные защитными механизмами Anthropic, на другую модель.

Источник: