Wireva

Claude отримає невидимі watermark для текстів

Нові моделі Claude після 2 серпня маркують контент від запуску. Старі ще переходять на систему; файли також отримують підписані дані походження.

Anthropic вводит скрытую маркировку для контента Claude

Зображення: символ Claude / Wikimedia Commons, CC0 · Public domain · rights

Матеріал підготовлено за допомогою ШІ під редакційною відповідальністю Haydamax OU.

Anthropic вводить машинозчитуване маркування для Claude. Підтримувані моделі вбудовуватимуть у текст непомітний watermark, а підтримувані файли отримуватимуть цифрово підписані provenance-метадані. Для читача відповідь має виглядати звичайно, але для систем перевірки в ній з’явиться додатковий технічний сигнал.

Важливе уточнення: 2 серпня 2026 року не всі старі моделі Claude одномоментно почали ставити мітки. Цього дня в ЄС почали діяти вимоги статті 50 AI Act щодо прозорості генеративного контенту. Моделі, випущені 2 серпня або пізніше, мають підтримувати маркування від запуску. Для раніше випущених систем Anthropic ще додає підтримку, а обмежений перехідний період щодо маркування триває до 2 грудня.

Текстовий watermark має бути невидимим для людини. Anthropic заявляє, що він не змінює сенс, якість або читабельність відповіді та вбудовується на рівні моделі. Через це сигнал може переноситися разом із текстом після копіювання й вставлення в документ, пост, лист або інший сервіс і зберігатися після частини правок.

Це відрізняє його від звичайних метаданих файла. Якщо користувач просто копіює абзац із чату, окремий документ із технічною історією може не передаватися. Модельний watermark задуманий так, щоб частина інформації про походження залишалася разом із самими словами.

Компанія поки не розкрила точний технічний метод. Тому твердження, що Claude вставляє конкретні невидимі Unicode-символи, не підтверджене. Anthropic не назвала алгоритм і ще готує документацію та інструменти, з якими сторонні сервіси зможуть шукати watermark.

Для файлів схема інша. У підтримуваних форматах додаються цифрово підписані дані про походження. Для відповідних медіафайлів використовується стандарт C2PA: він дозволяє зберігати криптографічно перевірюваний запис provenance та передавати його між сумісними інструментами.

Проте C2PA не робить файл невразливим. Метадані можуть зникнути під час конвертації, повторного збереження або обробки на платформі, яка їх не зберігає. І навіть справжній цифровий запис походження не означає, що зміст файла правдивий — він показує історію активу, а не перевіряє його твердження.

Текстова мітка теж не абсолютна. Значне перефразування, переклад, перестановка фрагментів або змішування з іншим текстом може послабити виявлення. Тому відсутність сигналу не доводить, що AI не використовували: мітки могло не бути в конкретній старій моделі або вона могла стати невиявною після переробки.

Наявність watermark теж не означає, що Claude написав усе. Модель могла лише відредагувати готовий людський текст, перекласти його або переписати один фрагмент. Для шкіл, роботодавців, редакцій і платформ це ключова межа: технічний сигнал говорить про участь інструмента, але не визначає автоматично частку його авторства.

Anthropic планує застосовувати маркування глобально для підтримуваних моделей, включно з API та підтримуваними хмарними каналами. Отже, зміна стосуватиметься не лише користувачів ЄС і не лише тих, хто відкриває Claude напряму. Мітка може з’являтися в тексті стороннього застосунку, якщо він працює на сумісній моделі Claude.

Головний наступний крок — поява доступних детекторів. Anthropic ще готує інструменти для третіх сторін, і саме реальні тести покажуть, наскільки добре watermark витримує звичайне редагування. До цього його варто сприймати як додатковий сигнал походження, а не як універсальний тест «людина чи AI».

Для користувача зміна майже непомітна на екрані, але може мати великі наслідки після публікації. Якщо платформи навчаться коректно читати й пояснювати такі сигнали, provenance стане звичною частиною цифрового контенту. Якщо ж мітку трактуватимуть як безпомилковий вирок про авторство, нова технологія швидко створить нові суперечки замість простих відповідей.

Same event, other desks

Story file →