models
Как работает водяной знак текста Claude
Будущие модели Claude будут генерировать текст с встроенным водяным знаком, что поможет определить вероятность участия Claude в создании текста. В статье подробно описывается принцип работы водяных знаков, их влияние на качество и ограничения метода.
AS1 NewsИсточник: anthropic.com
Будущие модели Claude будут включать в себя встроенный водяной знак, что позволит определить вероятность того, что текст был создан именно этой моделью. Этот подход является частью усилий по соблюдению требований Европейского Союза к регулированию искусственного интеллекта.
Водяной знак в моделях Claude основан на изменении источника случайности при выборе слов. Обычно модели используют генератор случайных чисел для определения следующего слова, однако при использовании водяных знаков выбор основывается на ключе и предыдущих словах, что создает скрытую закономерность, обнаруживаемую только при наличии специального ключа.
Важно подчеркнуть, что водяной знак не влияет на качество или креативность текста. Внутренние тесты и исследования показывают, что качество и читаемость ответов Claude остаются неизменными. Водяной знак не виден для читателя и не влияет на смысл текста.
Пример, приведенный в статье, сравнивает использование водяных знаков с игрой в Монополию, где вместо броска кубика используют последовательность цифр числа пи. Такой подход позволяет определить, использовалась ли эта последовательность для определения ходов, что аналогично определению, был ли текст создан Claude.
Методика основана на публикации Google DeepMind, которая использовала подобный подход в исследовании Gemini. Ограничения метода включают невозможность подтверждения, что текст написан человеком, или определения, какая именно модель его создала, если используется другая система с собственным ключом.
В целом, водяные знаки позволяют повысить прозрачность использования AI, не ухудшая качество создаваемого текста, и являются важной частью соответствия новым регуляциям в области искусственного интеллекта.
Обеспечивает прозрачность и возможность идентификации текста, созданного моделями Claude, что важно для соблюдения нормативных требований и повышения доверия к AI.