Все о Цифровых системах - новости, статьи, обзоры, аналитика. Более 1000 компаний, товаров и услуг в каталоге.
Добавить компаниюПредложить публикацию

Google выпускает две модели Gemini 3.8 с передовыми возможностями логического мышления

Рубрики: «Искусственный интеллект (AI)», «Языковые модели (LLM)»

Обе большие языковые модели основаны на одной и той же технической базе. Основное различие заключается в том, что Gemini 3.8 Flash — это модель общего назначения, а Gemini 3.8 Flash Cyber ​​предназначена для исследователей в области кибербезопасности. Последний алгоритм доступен в рамках новой инициативы раннего доступа, программы Fairwind.

Компания Google протестировала модель Gemini 3.8 Flash, предложив ей пройти 16 тестов на проверку возможностей искусственного интеллекта. По данным Google, она превзошела языковые модели Claude Opus 5 и GPT 5.6 Sol в девяти из этих тестов. Один из тестов, который модель выполнила более точно, — это бенчмарк Terminal-Bench 1.1, измеряющий способность больших языковых моделей решать многоэтапные задачи программирования. Другие тесты охватывали такие сценарии использования, как анализ финансовых данных и интерпретация диаграмм.

Модель Gemini 3.8 Flash также показала конкурентоспособные результаты в тестах, которые конкурирующие языковые модели выполнили лучше. Так, например, она набрала 73,7% в тесте DeepSWE-1.1, который оценивает способность моделей искусственного интеллекта автоматизировать долгосрочные задачи кодирования. Это позволило Gemini 3.8 Flash опередить модель GPT-5.6 Sol на 1% и отстать от модели Opus 5 всего на доли процента.

«Эти улучшения производительности обусловлены ключевым проектным решением: Flash 3.8 работает интенсивнее», — написали в блоге руководители Google Тулси Доши и Ралука Ада Попа. «В сложных задачах модель проявляет большую внимательность — выполняет дополнительные шаги рассуждения и итеративно вызывает инструменты. Иногда модель может использовать больше токенов для максимизации производительности, особенно при более высоких уровнях усилий».

Gemini 3.8 Flash Cyber, еще одна большая языковая модель, представленная Google, также продемонстрировала конкурентоспособную производительность. Она набрала 86,2% в бенчмарке CyberGym, который проверяет способность языковых моделей обнаруживать уязвимости в коде C и C++. Для сравнения, модель Claude Mythos 5 набрала 83,8%, а GPT-5.6 Sol — 83,6%.

Языковая модель Gemini 3.8 Flash Cyber ​​доступна в рамках программы раннего доступа Fairwind Program. Она открыта для государственных учреждений, операторов критической инфраструктуры и технологических компаний, ответственных за «обеспечение безопасности широко распространенных программных платформ». По данным Google, на момент запуска в проекте участвуют более 650 компаний. В группу входят Snowflake Inc., CrowdStrike Holdings Inc., Datadog Inc. и другие крупные компании-разработчики программного обеспечения.

Участники программы Fairwind могут использовать Gemini 3.8 Flash Cyber ​​с технологией CodeMender. Это набор инструментов, включающий подсказки, файлы кода и другие технические ресурсы. CodeMender был создан компанией Google DeepMind для повышения способности больших языковых моделей находить уязвимости, оценивать их серьезность и разрабатывать исправления.

Инженеры Google уже используют модель Gemini 3.8 Flash Cyber для ускорения своей работы.  По данным компании, разработчики Chrome обнаружили, что с помощью этой языковой модели можно создать «в 2,6 раза больше корректных патчей» для устранения уязвимостей в браузере, чем с помощью конкурирующих моделей.  Другая команда Google использовала Gemini 3.8 Flash Cyber для поиска «критической фундаментальной уязвимости», на обнаружение которой вручную ушло бы несколько месяцев.

Источник: