Anthropic пояснила, як працюватимуть водяні знаки у текстах Claude

Anthropic пояснила, як працюватимуть водяні знаки у текстах Claude

Anthropic розкрила деталі щодо системи водяних знаків для текстів, які генеруватиме Claude. Компанія впроваджує технологію відповідно до Кодексу практики ЄС у межах AI Act, який передбачає механізми для визначення контенту, створеного за допомогою ШІ.

Водяний знак не буде видимою позначкою в тексті. Claude формуватиме статистичний шаблон через вибір слів у тих випадках, коли кілька варіантів однаково добре підходять за змістом. Для читача такий текст виглядатиме як звичайна відповідь Claude, а перевірити наявність водяного знака можна буде за допомогою спеціального інструмента.

Anthropic планує використовувати технологію SynthID-Text, яку команда Google DeepMind представила у 2024 році. Компанія також планує відкрити API для перевірки текстів на водяні знаки.

За словами Anthropic, технологія не повинна впливати на якість відповідей Claude. Вона також відрізняється від сервісів, які намагаються визначити ШІ-текст за характерними словами, фразами або структурою речень. У випадку з водяним знаком система шукатиме закладений під час генерації шаблон.

Видалити такий водяний знак редагуванням буде можливо, але результат залежатиме від масштабу змін. Незначні правки, за оцінкою Anthropic, найімовірніше, не приберуть його повністю. Якщо ж переписати весь текст іншими словами, водяний знак зникне.

Для текстів, які людина написала самостійно та передала Claude лише на перевірку або незначне редагування, ситуація буде іншою. Якщо більшість слів залишаться авторськими, система може не виявити водяний знак. Результат залежатиме від довжини матеріалу та кількості змін, які внесе Claude.

У програмному коді водяні знаки працюватимуть слабше. Під час написання коду Claude має менше свободи у виборі формулювань, оскільки результат повинен працювати правильно. Водночас система зможе залишати водяний знак там, де можливі різні варіанти написання, зокрема в коментарях до коду.

Anthropic зазначає, що подібні механізми мають запровадити й інші великі розробники ШІ, які приєдналися до Кодексу практики ЄС. Походження ШІ-текстів поступово можна буде перевіряти не лише за непрямими ознаками стилю, а й за технічною позначкою, яку модель додає під час генерації.

Джерело: TechCrunch

Читайте також
  • Новини
    Netflix розширює використання штучного інтелекту у виробництві фільмів і серіалів
    Гнатюк Дмитро
  • Новини
    Google запустив глосарій для Merchant Center Next
    Яна Поліщук
  • Новини
    WhatsApp тепер генерує відповіді в чатах за допомогою ШІ
    Гнатюк Дмитро
  • Новини
    Ліна Костенко стала почесною амбасадоркою бренду GASANOVA
    Яна Поліщук
  • Новини
    Бренд засобів для догляду за зубами Splash випустив пасту зі смаком борщу
    Яна Поліщук
  • Новини
    В аеропорту Гонконгу встановили інтерактивного гігантського кота для пасажирів
    Гнатюк Дмитро