Anthropic представила систему водяних знаків для текстів Claude

Компанія Anthropic розкрила деталі нової системи водяних знаків для текстів, створених чатботом Claude. Ця технологія, за словами компанії, не вплине на якість відповідей і буде непомітною для звичайного читача, проте спеціальна система з ключем зможе визначити наявність водяного знака.

Вимоги Кодексу прозорості ЄС

Водяні знаки впроваджуються для дотримання Кодексу прозорості ЄС щодо штучного інтелекту, що передбачає ідентифікацію контенту, створеного ШІ. Anthropic використовуватиме підхід SynthID-Text, розроблений Google DeepMind, представлений у 2024 році.

Функціонування системи

Компанія планує випустити API для перевірки текстів на наявність водяних знаків. Механізм працює на основі закономірностей у тексті. Наприклад, Claude може використовувати «низькоризикові» вибори слів для формування прихованого шаблону, що не буде помітним для читача.

Редагування та виявлення водяних знаків

Водяний знак можна частково або повністю видалити редагуванням. Легке редагування, ймовірно, не прибере його повністю, тоді як повне переписування тексту дозволить позбутися знака. Якщо Claude лише трохи редагує текст, виявити водяний знак стає складніше.

Водяні знаки в програмному коді

У програмному коді водяний знак буде менш вираженим через обмежену свободу вибору слів. Однак маркування може застосовуватися до коментарів у коді.

Реакція користувачів

Не всі користувачі позитивно сприйняли нововведення. Деякі висловили занепокоєння на Reddit, вважаючи водяні знаки способом стеження за користувачами. Інші вважають таке маркування лицемірним, оскільки Claude використовує технології, розроблені іншими компаніями.


Джерело: Mezha (Технології) (https://mezha.ua/news/anthropic-rozkrila-sekret-vodyanih-znakiv-claude-legke-redaguvannya-jih-ne-pribere-314236/)

Exit mobile version