Anthropic розкрила деталі щодо системи водяних знаків для текстів, які генеруватиме Claude. Компанія впроваджує технологію відповідно до Кодексу практики ЄС у межах AI Act, який передбачає механізми для визначення контенту, створеного за допомогою ШІ.
Водяний знак не буде видимою позначкою в тексті. Claude формуватиме статистичний шаблон через вибір слів у тих випадках, коли кілька варіантів однаково добре підходять за змістом. Для читача такий текст виглядатиме як звичайна відповідь Claude, а перевірити наявність водяного знака можна буде за допомогою спеціального інструмента.
Anthropic планує використовувати технологію SynthID-Text, яку команда Google DeepMind представила у 2024 році. Компанія також планує відкрити API для перевірки текстів на водяні знаки.
За словами Anthropic, технологія не повинна впливати на якість відповідей Claude. Вона також відрізняється від сервісів, які намагаються визначити ШІ-текст за характерними словами, фразами або структурою речень. У випадку з водяним знаком система шукатиме закладений під час генерації шаблон.
Для текстів, які людина написала самостійно та передала Claude лише на перевірку або незначне редагування, ситуація буде іншою. Якщо більшість слів залишаться авторськими, система може не виявити водяний знак. Результат залежатиме від довжини матеріалу та кількості змін, які внесе Claude.
У програмному коді водяні знаки працюватимуть слабше. Під час написання коду Claude має менше свободи у виборі формулювань, оскільки результат повинен працювати правильно. Водночас система зможе залишати водяний знак там, де можливі різні варіанти написання, зокрема в коментарях до коду.
Anthropic зазначає, що подібні механізми мають запровадити й інші великі розробники ШІ, які приєдналися до Кодексу практики ЄС. Походження ШІ-текстів поступово можна буде перевіряти не лише за непрямими ознаками стилю, а й за технічною позначкою, яку модель додає під час генерації.
Джерело: TechCrunch