Ведущие ИИ-модели внедряют невидимые водяные знаки
Ведущие разработчики искусственного интеллекта, включая Anthropic, OpenAI и Google, внедряют систему невидимых водяных знаков для контента, генерируемого их моделями. Это решение направлено на повышение прозрачности и соблюдение новых нормативных требований, особенно в Европейском союзе.
Anthropic лидирует в инициативе по прозрачности ИИ
Компания Anthropic, разработчик семейства моделей Claude, объявила о начале добавления машиночитаемых водяных знаков в тексты и файлы, созданные её ИИ. Это изменение вступило в силу со 2 августа и распространяется на все модели Claude, включая более ранние версии. Цель инициативы — обеспечить соответствие европейским правилам прозрачности ИИ.
- Встраиваемые водяные знаки: Сгенерированный текст будет содержать невидимые встроенные водяные знаки.
- Метаданные о происхождении: Сгенерированные файлы будут включать цифровую подпись с метаданными о происхождении, где это поддерживается.
- Невидимость для человека: Эти изменения остаются незаметными для пользователей.
Данная мера вызвана новыми регуляторными требованиями ЕС, которые обязывают разработчиков ИИ предоставлять средства для идентификации контента, созданного искусственным интеллектом. Хотя конкретные детали о механизмах водяных знаков от OpenAI и Google не были раскрыты в данном контексте, ожидается, что они последуют аналогичным путем для обеспечения прозрачности и соответствия нормативным актам.
Идея невидимых водяных знаков, конечно, звучит многообещающе для прозрачности, но насколько это будет эффективно на практике? Всегда есть риск, что такие метки можно будет обойти или удалить, особенно при активной обработке текста. К тому же, неясно, как это повлияет на производительность моделей и не создаст ли дополнительных сложностей для разработчиков, которые интегрируют эти ИИ в свои системы. Хотелось бы увидеть более детальное объяснение механизмов защиты от подделки.