Anthropic почала вбудовувати невидимий водяний знак у текст, створений її моделлю Claude AI. Компанія заявляє, що цей крок може допомогти перевіряти автентичність контенту та відповідати вимогам регуляторів. Водяний знак розроблений так, щоб бути непомітним для людського ока, але відстежуваним за допомогою технічного аналізу.
Як працює водяний знак
Водяний знак вбудований у сам текст, ймовірно, через тонкі статистичні закономірності у виборі слів і структурі речень. Він не змінює читабельність або значення результату, але дає Anthropic спосіб визначити, чи був певний фрагмент тексту згенерований Claude. Це може бути корисним для платформ, які намагаються маркувати AI-контент, або для організацій, яким потрібно підтвердити походження своїх документів.
Компанія не розкрила точний метод, тому зовнішні дослідники поки що не можуть перевірити його надійність. Але основна ідея проста: залишити відбиток, який зберігається при звичайному читанні та копіюванні, але може бути виявлений за допомогою відповідних інструментів.
Чому автентичність і відповідність вимогам важливі
Оскільки інструменти для написання текстів на основі AI стають дедалі поширенішими, здатність відрізняти машинний текст від людського стала пріоритетом для видавців, регуляторів і технологічних компаній. Водяні знаки пропонують спосіб маркувати контент у джерелі, не вимагаючи від користувачів змінювати свій робочий процес. Для Anthropic це може допомогти клієнтам дотримуватися правил розкриття інформації або внутрішніх політик, які вимагають прозорості щодо використання AI.
Для компаній, які використовують Claude для створення звітів, маркетингових текстів або юридичних документів, водяний знак може слугувати записом про походження. Це може бути корисно під час аудитів або суперечок щодо авторства. Цей крок також відбувається на тлі того, як уряди та платформи дедалі частіше вимагають способів ідентифікації AI-контенту. Водяний знак не вирішує всіх проблем, але дає компаніям відправну точку для підтвердження походження тексту.
Проблема редагування
Водяні знаки не є безвідмовними. Якщо хтось перефразовує, переписує або перекладає текст, закономірність може бути порушена. Компанія визнає, що виявлення та стійкість до редагування залишаються викликами. Сильно відредагований уривок може повністю втратити водяний знак, або він може стати надто слабким для надійного виявлення. Існує також можливість, що хтось із достатнім технічним рівнем зможе повністю видалити водяний знак, хоча Anthropic не повідомила, наскільки стійка ця техніка до такого роду атак.
Це реальне занепокоєння для тих, хто покладається на водяний знак як на доказ походження. Просте копіювання та вставлення не видалить його, але рішучий редактор потенційно може його обійти.
Що ще невідомо
Anthropic не оголосила графік впровадження водяного знака для всіх користувачів Claude, а також не уточнила, чи буде він застосовуватися до кожного результату чи лише до певних версій моделі. Компанія також не повідомила, як вона оброблятиме запити на видалення водяного знака або чи запропонує публічний інструмент для виявлення. Ці деталі визначатимуть, наскільки корисною буде ця функція на практиці.
Наразі водяний знак є кроком до підзвітності, але не повним рішенням. Компанії доведеться продовжувати вдосконалювати підхід у міру розвитку інструментів редагування та методів виявлення.



