OpenAI объявила о внедрении textGrain в ChatGPT и Codex. Эта технология функционирует как незаметная водяная метка в текстах, помогая идентифицировать контент, созданный искусственным интеллектом.
Первоначально эта функция доступна только пользователям, находящимся в Европейском союзе. Хотя OpenAI уже анонсировала метод водяного знака в 2024 году, он не был широко принят до настоящего момента.
Решение о внедрении textGrain было продиктовано необходимостью соответствия Закону ЕС об искусственном интеллекте (EU AI Act). Этот регламент требует, чтобы организации, предоставляющие услуги генеративного ИИ — охватывающие текст, изображения, аудио или видео — включали механизмы для обозначения контента как синтетического с помощью инструментов проверки.
Хотя ранее существовала аналогичная функция для медиаконтента в ChatGPT, теперь она применяется к текстовому контенту. Важно отметить, что невидимая водяная метка не является юридическим требованием, а скорее методом, выбранным OpenAI для соблюдения европейского законодательства.
Сама OpenAI определяет textGrain как «невидимый статистический сигнал». Это означает, что генерируемый материал не получает скрытых символов или лишних пробелов, а подвергается дискретным корректировкам, которые статистически изменяют способ выбора слов моделью ИИ в тексте, и все это без ущерба для конечного качества результата.
В ближайшие дни эта технология будет применяться по умолчанию ко всем текстам, созданным ChatGPT и Codex, для всех планов пользователей, базирующихся в Европейском союзе.
Кроме того, даже при региональных ограничениях этого начального этапа, разработчики по всему миру могут активировать водяной знак в определенных моделях API OpenAI для использования в собственных приложениях.
Однако OpenAI предупреждает о ограничениях системы: водяной знак может быть ослаблен путем редактирования или определенных типов текста, а его точность может быть скомпрометирована в коротком контенте. Организация также уточняет, что textGrain не идентифицирует того, кто запросил текст, не может подтвердить истинность или ложность результата, а также не количественно оценивает вклад человека в измененный контент.
