Anthropic выпускает компактную экономичную модель Claude Haiku 5.5
Спустя две недели после запуска 22 сентября языковой модели Opus 5.5, компания Anthropic представляет модель Haiku 5.5, которая ориентирована на выполнение повторяющихся задач. Основная цель — создание больших сводных отчетов и классификация данных. Кроме того, команды разработчиков могут использовать эту модель в качестве субагента, которому модели Opus 5.5 или Sonnet 5.5 передают более мелкие задачи
Снижение текущих затрат Anthropic легло в основу снижения прейскурантных цен. Haiku 4.5, выпущенная в октябре прошлого года, стоит 1 доллар за миллион входных токенов и 5 долларов за миллион выходных. Для запросов длиной до 100’000 токенов, которые, по словам представителей Anthropic, покрывают около 90% запросов к более старой модели, Haiku 5.5 на 90% дешевле как по входным, так и по выходным данным — 10 и 50 центов за миллион токенов соответственно. Для более длинных запросов скидка составляет 50%. Средняя экономия в 75% достигается за счёт нового токенизатора, который использует немного больше токенов на задачу. Стоимость можно дополнительно оптимизировать, поскольку Haiku 5.5 — первая модель Haiku с настраиваемым уровнем трудозатрат.
Тарифы в 10 и 50 центов соответствуют ценам, которые компания OpenAI Group PBC взимает за GPT-6 Luna - недорогую модель, выпущенную в прошлом месяце. Опубликованные Anthropic результаты тестов показывают, что Haiku 5.5 опережает Luna во всех шести бенчмарках, через которые прошли модели. В OSWorld 2.1 - тесте агентов, управляющих реальным компьютером при выполнении длительных многоэтапных задач, новая модель набрала 72,4% в автономном режиме против 48,9% у Luna. Модель Luna набрала 16,4% в тесте на программирование агентов Terminal-Bench 4.0, что менее чем вдвое меньше, по сравнению с 39,2% у новой модели. Для сложного программирования агентов Anthropic по-прежнему рекомендует клиентам модели Sonnet 5.5 и Opus 5.5.

Компания Asana Inc. была в числе клиентов, тестировавших модель Haiku 5.5 до её релиза. Компания запустила модель в рамках оценочного пакета для своего агента AI Teammates. Задержка при выполнении задач сократилась более чем на 30% по сравнению с моделью, которую Asana использует сегодня, а вывод данных на каждом этапе работы агента стал в 2,5 раза быстрее.
«Мы очень впечатлены Claude Haiku 5.5, особенно его скоростью. Мы протестировали его в рамках нашего оценочного пакета для AI Teammates, нашего продукта на основе ИИ-агентов, охватив такие сценарии использования, как сортировка ошибок, настройка проектов и поиск в больших портфелях для выявления задач высокого риска или просроченных работ. По сравнению с моделью, которую мы используем сегодня, мы увидели более чем 30% снижение задержки при выполнении задач и до 2,5 раз более быстрое выполнение вывода за один ход агента. Это заметно более быстрая работа», — сказал Аарон Винь, штатный инженер-программист компании Asana Inc.
Что касается безопасности, то, по словам представителей Anthropic, тестирование на согласованность выявило гораздо меньше случаев несогласованного поведения, чем в случае с Haiku 4.5. Меры кибербезопасности, реализованные в модели, позволяют проводить больше защитных работ, чем в случае с Sonnet 5.5. Тестирование на проникновение по-прежнему заблокировано, как и другие методы, которые с большей вероятностью могут использовать злоумышленники. Организации, которым нужен более широкий доступ, могут подать заявку на участие в программе Cyber Verification Program, которую Anthropic запустила во вторник.
Запуск Haiku также сопровождался снижением цены на модель Anthropic среднего размера Sonnet 5.5. Стоимость чтения из кэша в модели Sonnet 5.5, снизилась с 20 центов за миллион токенов до 10 центов. Поскольку кэшированные токены составляют значительную часть потребления моделей, Anthropic ожидает, что снижение цены позволит сократить стоимость большей части работы ИИ-агентов в модели примерно на 20%.
Haiku 5.5 уже доступен на платформе Claude под названием claude-haiku-5-5, а также через Amazon Web Services Inc., Google Cloud и Microsoft Azure.



