Claude позначить свої тексти та код водяними знаками

Фото до статті

Компанія Anthropic оголосила, що вбудовуватиме водяні знаки в текст та файли, згенеровані майбутніми моделями Claude, які випускатимуться в Євросоюзі. Крок пояснюють необхідністю дотримання вимог щодо прозорості контенту, передбачених європейським Актом про штучний інтелект (AI Act).

Claude буде генерувати текст і код лише з водяними знаками

Як зазначено в довідковому документі компанії, опублікованому в понеділок, згенерований текст міститиме вбудовані водяні знаки, а згенеровані файли — цифрово підписані метадані про походження. Маркування працюватиме всюди, де використовується Claude.

Моделі Claude, запущені в ЄС 2 серпня 2026 року або пізніше, підтримуватимуть машинозчитуване маркування вже з моменту релізу. Що стосується вже випущених моделей, компанія працює над додаванням маркування протягом перехідного періоду, передбаченого європейським законодавством.

Важливий нюанс — географія застосування. Маркування поширюватиметься на виведення підтримуваних моделей Claude через Claude Platform (API), Claude, Claude Code, Claude Cowork і Claude Tag, і діятиме всюди, де пропонується Claude, — у всьому світі. Тобто обмежувати нововведення лише європейськими користувачами компанія не планує.

Як працює маркування тексту

За описом Anthropic, коли підтримувана модель Claude генерує текст, вона вплітає непомітний водяний знак безпосередньо в самі речення. Користувач його не побачить, а сенс, якість чи читабельність відповіді не зміняться. Оскільки знак є частиною тексту, він подорожуватиме разом із текстом при копіюванні в інші місця і може зберігатися навіть після певного редагування. Маркування застосовується на рівні моделі — тобто присутнє незалежно від того, через який продукт чи інтерфейс отримано текст.

Для файлів, які створює Claude, компанія покладається на цифрово підписані метадані про походження за стандартом C2PA (Coalition for Content Provenance and Authenticity).

Охоплення поширюється й на сторонніх постачальників, які пропонують доступ до моделей Anthropic, — зокрема AWS, Google Cloud та Microsoft Foundry. Детальну документацію про те, як саме користувачі та треті сторони зможуть виявляти ці позначки (що вимагає законодавство ЄС), компанія обіцяє опублікувати пізніше.

Наскільки це надійно

Технічні деталі поки що відсутні, і залишається незрозумілим, як Anthropic захищатиме водяні знаки від видалення. Дослідники вже неодноразово демонстрували, що подібні системи маркування зображень можна обійти. Показово, що самі формулювання Anthropic про незмінність «сенсу» тексту фактично виключають використання специфічного підбору слів чи побудови речень як маркера походження — техніку, яку, за повідомленнями, застосовувала Apple для виявлення витоків від співробітників.

Що стосується файлових позначок за стандартом C2PA — для цього формату вже існують відкриті інструменти видалення метаданих.

Показово й те, що сама Anthropic обережно оцінює ефективність власної схеми: компанія прямо визнає, що виявлений водяний знак не є остаточним доказом того, що контент створив саме Claude, а відсутність знаку не гарантує, що штучний інтелект взагалі не брав участі у створенні тексту.

Реакція спільноти

Новина викликала неоднозначну реакцію користувачів. У профільній спільноті r/ClaudeAI на Reddit тема отримала промовисту, доволі саркастичну назву — «Claude буде маркувати згенерований контент, дякую» (тон обговорення передає скепсис щодо доцільності нововведення). Користувачі сумніваються, що текстове маркування взагалі спрацює на практиці, згадуючи, що подібні схеми для зображень уже неодноразово вдавалося обійти.

На Hacker News розробники висловили більш практичне занепокоєння: якщо користувач просить Claude відредагувати конкретну функцію в коді в кількох місцях, він очікує точного, передбачуваного результату — і йому категорично не сподобається, якщо в текст буде вплетено якийсь прихований патерн, що діє як водяний знак, потенційно впливаючи на вихідні дані.

Загалом ситуація накладається на й без того напружені стосунки частини спільноти Claude з Anthropic — користувачі раніше вже висловлювали невдоволення змінами ціноутворення, проблемами зі стабільністю сервісу та надмірно обережними запобіжниками моделі, які, на їхню думку, заважають легітимній роботі. Втім, зважаючи на юридичні вимоги Кодексу практик ЄС щодо прозорості ШІ-контенту, у Anthropic могло просто не бути іншого виходу, окрім впровадження такої системи — питання лише в тому, чи достатньо цього для формального дотримання закону.

Нагадаємо, вчора стало відомо, що Anthropic вимикає ручні підтвердження в Claude Code. Це несе переваги та ризики для розробників.

Джерело

No votes yet.
Please wait...

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *