

Мирослав Трінько Випусковий редактор новин на "Межі". Geek, програміст за спеціальністю, але журналіст за професією. Вершник, тенісист та фанат Формули-1. Пишу про технології, бізнес, ШІ, смартфони та електромобілі. 17 серпня, 09:10 0
Anthropic представила подробиці щодо своєї нової системи маркування контенту, створеного чат-ботом Claude. Компанія стверджує, що ця технологія не позначиться на якості відповідей і буде непомітною для звичайного читача, однак спеціальний інструмент зможе виявити присутність такого маркування.
Anthropic впроваджує водяні знаки для дотримання вимог Європейського кодексу прозорості щодо ШІ. Цей кодекс передбачає застосування технологій, які дають змогу ідентифікувати контент, згенерований штучним інтелектом.
Компанія планує використовувати підхід SynthID-Text, розроблений командою Google DeepMind і представлений цього року. Anthropic також анонсувала випуск API, який дозволить верифікувати тексти на наявність прихованого маркування.
Принцип дії буде базуватися на певних закономірностях у тексті. Наприклад, коли Claude має вибір між декількома словами з однаковим лексичним значенням, система може робити ці “малоймовірнісні” вибори, щоб сформувати прихований патерн. Для читача текст із таким маркуванням виглядатиме ідентично до звичайного.
Водночас, таке маркування може бути частково або повністю усунене шляхом редагування. Anthropic зазначає, що незначні зміни, ймовірно, не зможуть повністю прибрати маркування. Однак повне переписування тексту, із заміною майже кожного слова, дозволить уникнути його присутності.
Якщо Claude лише незначно відредагує контент, написаний людиною, виявлення маркування стане складнішим. Згідно з поясненнями компанії, у такому разі переважна більшість слів залишаться авторськими, що ускладнює нанесення позначки системою.
Для програмного коду маркування буде менш помітним. Це пояснюється тим, що під час генерації коду модель має обмеженішу свободу вибору між еквівалентними опціями. Проте, маркування може застосовуватися до таких елементів, як коментарі.
Anthropic також наголосила, що Claude не буде єдиним чат-ботом зі штучним інтелектом, який використовуватиме водяні знаки. Інші провідні розробники моделей, які підписали відповідний європейський кодекс, також планують запроваджувати власні системи маркування.
Цікаво, що нововведення викликало неоднозначну реакцію користувачів. Деякі з них висловили незадоволення на Reddit, назвавши нові водяні знаки інструментом для стеження за користувачами та необґрунтованих підозр. Інші вважають таке маркування нещирим, особливо враховуючи, що сам Claude генерує контент, використовуючи технології, розроблені іншими компаніями.