Anthropic внедрит скрытые «водяные знаки» в будущие модели Claude
Коротко- Claude будет незаметно маркировать генерируемый текст.
- Метки позволяют оценить вероятность ИИ‑создания без визуальных изменений.
- Технология соответствует требованиям EU AI Act и не повышает стоимость запросов.
На этой неделе разработчик искусственного интеллекта Anthropic сообщил о планах интегрировать в будущие версии своего чат‑бота Claude невидимые метки, часто называют «водяными знаками». Эти метки будут сохраняться при копировании, вставке и в ряде случаев даже после редактирования текста.
Зачем нужны скрытые метки
Главная цель – дать возможность сторонним системам оценивать вероятность участия Claude в написании конкретного фрагмента. Такой механизм стал частью усилий по соблюдению требований Европейского закона об искусственном интеллекте, который требует прозрачности при использовании генеративных моделей.
Технически «водяные знаки» реализуются изменением малозначимых решений при выборе слов. Когда модель сталкивается с несколькими почти одинаковыми вариантами, она использует иной источник случайности, формируя статистически проверяемый шаблон. При этом в текст не добавляются специальные символы, скрытые теги или другие дополнительные данные, поэтому визуально он полностью совпадает с обычным выводом.
Для обнаружения такой метки нужен специализированный анализатор, оснащённый соответствующим ключом. Инструмент сравнивает распределение выбранных токенов с характерным паттерном Claude и выдаёт оценку вероятности, что текст был сгенерирован этой моделью.
Эффективность метода зависит от объёма текста. На длинных отрывках статистический сигнал становится заметнее, тогда как в коротких фразах или в фактических выдержках возможности анализа ограничены. Если Claude лишь дорабатывает уже написанный человеком материал, метка может практически исчезнуть. В программном коде система работает менее надёжно, поскольку выбор слов ограничен строгими синтаксическими требованиями.
Важно отметить, что «водяные знаки» не содержат персональных данных: они не позволяют установить, кто именно пользовался Claude, в каком чате или от имени какой организации был создан текст. Метка привязана только к модели и служит для внешних проверок, а не для слежки.
Для обычных пользователей изменения почти незаметны. Claude продолжит генерировать ответы и редактировать тексты так же, как и раньше, а стоимость запросов останется прежней, поскольку внедрение меток не требует дополнительных токенов.
Anthropic не единственная компания, работающая над подобными решениями. Крупные игроки отрасли также разрабатывают методы маркировки, чтобы соответствовать требованиям нового регулирования и снизить риски злоупотребления генеративным ИИ.
Таким образом, внедрение скрытых «водяных знаков» в Claude представляет собой технический ответ на растущий запрос общества и законодателей о прозрачности ИИ, позволяя проверять происхождение текста без ущерба для качества и стоимости сервисов.
Источник: 3DNews