Эксперты усомнились в эффективности водяных знаков для ИИ-контента

Автор

В Евросоюзе обязали разработчиков ИИ внедрять незаметные водяные знаки в созданный нейросетями контент, однако эксперт сомневаются в эффективности этой меры. Об этом пишет New Scientist.
Новые требования вступили в силу 2 августа. ChatGPT уже маркирует изображения и аудио, а OpenAI планирует добавить такую возможность для текста. Anthropic также намерена использовать водяные знаки в текстах новых версий Claude.
При этом эксперты считают, что подобная маркировка текста может оказаться малоэффективной. Один из методов предполагает изменение статистической последовательности слов, однако даже небольшая правка способна разрушить такой паттерн. Инженер компании NOPE Джеймс Падолси отмечает, что созданный им инструмент deClaude уже позволяет менять ИИ-тексты так, чтобы детекторы переставали их распознавать.
Дополнительной проблемой специалисты называют открытые ИИ-модели, которые не контролируются корпорациями и не обязаны соблюдать правила ЕС. Психолог Питер Скарф также предупреждает о риске ложных срабатываний, когда написанный человеком текст могут ошибочно принять за созданный нейросетью. По его мнению, водяные знаки вряд ли станут универсальным решением, хотя специалист по кибербезопасности Эрман Айдей допускает, что они способны хотя бы немного усложнить массовое создание опасного контента. К 2 декабря требования должны распространяться на все модели.