Google запускает функцию Live Avatar для Gemini 3.8 Live
![]()
«Разговор по своей природе мультимодален: мы слушаем, смотрим, говорим и используем мимику для общения», — объяснили Шуо-инь Чанг, научный сотрудник Google DeepMind, и Си Джей Чжэн, инженер-программист Gemini, в своем блоге . «Live Avatar предоставляет эти возможности корпоративным агентам. Обрабатывая визуальные и звуковые данные одновременно, он генерирует содержательные диалоги для более полного взаимодействия».
Пять лет назад компания DeepMind предупреждала о различных рисках, связанных с использованием больших языковых моделей, среди которых упоминался вред для взаимодействия с человеком, например, «антропоморфизм» моделей ИИ, то есть приписывание им человеческих характеристик. Антропоморфизм здесь широко применяется как к визуальной имитации человека, так и к человекоподобной речи и тексту.
«Антропоморфизм языковых моделей может завышать оценки пользователями компетенций разговорного агента», — отмечают более 20 авторов статьи DeepMind. «Возникают этические и социальные риски причинения вреда языковыми моделями».
Например, пользователи могут ошибочно предположить, что разговорный агент, который кажется похожим на человека по манере речи, также обладает другими человеческими характеристиками, такими как сохранение целостной идентичности во времени или способность к эмпатии, пониманию чужой точки зрения и рациональному мышлению. В результате они могут проявлять чрезмерное доверие к таким агентам. Например, в августе 2025 года риски, связанные с гуманизацией искусственного интеллекта, дошли до суда, когда родители Адама Рейна подали в суд на OpenAI, утверждая, что ChatGPT способствовал самоубийству их сына. Среди прочего, в иске вина возлагалась на «антропоморфные манеры, настроенные на передачу человекоподобной эмпатии».
В статье под названием «Как работники ИТ-сферы справляются с опасностями, связанными с человекоподобием в генеративном искусственном интеллекте», Марк Диас, Рене Шелби, Эрик Корбетт и Эндрю Смарт из Google Research сообщили, что работники ИТ-сферы, участвовавшие в фокус-группах, выразили аналогичные опасения, которые были отмечены в предыдущих исследованиях компании.
«Технологические специалисты выразили серьёзную обеспокоенность тем, что человекоподобие искусственного интеллекта порождает ложное чувство надёжности и доверия, формируя их опасения как пользователей и разработчиков, поскольку это человекоподобие связано с гибким, естественным языком и тоном, которые могут скрывать ошибки», — написали они.
Таким образом, несмотря на то, что исследователи Google в области искусственного интеллекта подчёркивают необходимость понимания того, как «человекоподобие» ИИ соотносится с предполагаемыми опасностями и ответственным развитием ИИ, Google переходит непосредственно к внедрению Gemini Enterprise.
«Живые аватары» (Live Avatars) могут быть выбраны из готовой библиотеки персонажей или можно использовать пользовательский аватар, если включён корпоративный список разрешений. Помимо этого «живые аватары» могут вызывать инструменты и получать данные в фоновом режиме, а также общаться на 97 языках, что делает их подходящими для таких сценариев, как, например, регистрация гостей в отеле. При этом Чанг и Чжэн настаивают на том, что Google создал этих персонажей, руководствуясь принципами доверия и безопасности.
«Мы создали Live Avatar со строгими мерами безопасности, призванными уважать личность и обеспечивать прозрачность контента, генерируемого искусственным интеллектом», — заявили они.



