Все о Цифровых системах - новости, статьи, обзоры, аналитика. Более 1000 компаний, товаров и услуг в каталоге.
Добавить компаниюПредложить публикацию

OpenAI внедряет водяные знаки для текста, созданного с помощью ИИ

Рубрика: «Искусственный интеллект (AI)»

OpenAI внедряет водяные знаки для текста, созданного с помощью ИИ

В отличие от своего конкурента Anthropic, компания OpenAI не применяет технологию водяных знаков к контенту, созданному за пределами Европы, хотя клиенты, которые используют API, могут выбрать нанесение знаков на контент, созданный в любой точке мира. Более того, OpenAI использует технологию, которая пропускает довольно много случаев текста, сгенерированного с помощью ИИ, и её легко обмануть.

Закон ЕС об искусственном интеллекте требует от поставщиков услуг генеративного ИИ, чтобы выходные данные модели можно было идентифицировать с помощью машинного кода. Anthropic стала первой крупной компанией в сфере ИИ, которая объявила о своем подходе к соблюдению Закона об искусственном интеллекте, предполагающем использование алгоритма SynthID-Text от Google. SynthID-Text — это технология цифровой маркировки от Google DeepMind, которая встраивает невидимые водяные знаки прямо в текст при его генерации большой языковой моделью. Anthropic применяет этот подход по всему миру.

Корпорация Microsoft работает над аналогичной технологией искусственного интеллекта для изображений, поскольку ЕС — не единственный рынок, где люди обеспокоены происхождением и возможностью использования контента, созданного ИИ, для распространения дезинформации. OpenAI уже применяет некоторые сигналы, говорящие о происхождении контента, к изображениям, аудио и видео материалам, созданным с помощью искусственного интеллекта.

В соответствии с буквой Закона об искусственном интеллекте, OpenAI теперь предлагает подход к нанесению водяных знаков на текст под названием textGrain, который добавляет невидимый статистический сигнал к выбору слов моделью. Специальный детектор ищет этот сигнал, чтобы оценить, содержит ли отрывок водяной знак OpenAI. Крупные языковые модели предсказывают слова по одному, исходя из вероятностного распределения потенциальных слов. Периодически выбирая другое слово — в идеале синоним — результирующий текст отклоняется от статистического шаблона, создаваемого непредвзятой моделью. Детектор водяных знаков, который OpenAI предоставляет только подтвержденным исследователям и организациям, должен выявлять это расхождение в словарном запасе.

Такова теория, но на практике результаты бывают разными. Целевой уровень ошибок составляет один процент, но в коротких отрывках из 200 слов детектор может выявить только 80 процентов водяных знаков по сравнению с 95 процентами в отрывке из 400 слов. Результаты также хуже в текстах функционального характера, таких как отрывки по математике или программированию, поскольку замены с большей вероятностью приводят к ошибкам. В статье о textGrain не рассматривается вероятность того, что статистически измененный выбор слов может повлиять на смысл конкретного отрывка. Это возможно, если алгоритм изменит какой-то важный факт или цифру. Подход Anthropic, который также заменяет определенные слова, но с помощью другого алгоритма, сопряжен с аналогичными рисками.

В любом случае водяной знак OpenAI легко обойти с помощью замены слов. В тестах на фрагментах текста из 400 токенов замена 10 процентов слов синонимами снизила вероятность обнаружения водяного знака с 92 процентов до 66 процентов. А при замене 25 процентов слов сигнал водяного знака удалось обнаружить только в 17 процентах случаев.

Источник: