Американская компания Anthropic внедрила невидимые водяные знаки в тексты, которые генерирует нейросеть Claude. Разработчики запустили нововведение для выполнения требования Европейского закона об искусственном интеллекте. Преобразование повлияет на работу нейросети для пользователей со всего мира, передаёт издание Business Insider.
Теперь в тексты от нейросети будут добавлены скрытые водяные знаки:
«Мы планируем встроить едва заметный сигнал прямо в текст, созданный Claude. Пользователи не увидят метку при обычном чтении. Водяной знак останется частью текста при копировании и вставке ответов и, как мы ожидаем, сможет пережить редактирование», — пояснили в компании.
Алгоритм автоматически маркирует контент в ИИ-моделях, выпущенных после 2 августа. Разработчики планируют добавить водяные знаки и в более ранние версии языковой модели. Защиту хотят внедрить во все продукты Anthropic и облачные платформы AWS, Google Cloud и Microsoft Foundry. Точные принципы работы системы авторы не раскрывают, но обещают опубликовать технические детали и передать третьим сторонам инструменты для поиска скрытых маркеров.
«Цель, помимо прочего, состоит в том, чтобы, например, преподавателю было легко проверить, сгенерирован ли текст или написан студентом или школьником самостоятельно. Правда, если очень захотеть, сгенерированную работу можно просто переписать вручную и никаких меток не останется. Ну, зато так может хоть в голове что-то отложится», — отмечают в telegram-канале «ПроСМИсь».
Водные знаки могут исчезать при изменении форматов, создании скриншотов или пересохранении документов. В компании заявили, что создатели работают над устранением этой проблемы.
Напомним, в начале августа вступили в силу новые требования ЕС к прозрачности использования ИИ. Теперь весь нейросетевой контент должен отдельно маркироваться. За несоблюдение требований компании рискуют получить крупные штрафы.
