Тексти Claude матимуть невидимий маркер для інших ШІ-систем

Anthropic розробляє систему, яка допоможе відрізняти матеріали, створені або оброблені Claude, від контенту без участі штучного інтелекту. Вона охоплюватиме як текстові відповіді, так і файли зображень чи графіки.

        Claude залишатиме невидимий слід у текстах: його зможуть розпізнати інші системи

Водночас цифрове маркування не має стати безпомилковим доказом авторства — його слід сприймати лише як один із технічних індикаторів.

Як Anthropic планує маркувати контент

Для ідентифікації матеріалів компанія використовує два різні, але взаємодоповнювальні підходи: приховані водяні знаки для тексту та цифрові підписи метаданих для файлів.

Прихований водяний знак у тексті

Під час генерації відповіді алгоритм може вбудовувати в текст невидимий для читача цифровий сигнал. Він не повинен впливати на зміст, стиль або зручність читання матеріалу.

За задумом Anthropic, такий знак зберігатиметься навіть після копіювання, вставлення та незначного редагування тексту. Це дасть змогу спеціальним інструментам перевіряти, чи взаємодіяла з матеріалом модель Claude.

Підпис метаданих для файлів

Для створених або оброблених файлів, зокрема у форматах .svg, .png та .jpg, компанія застосовує стандарт C2PA. Він дає змогу додавати до файлу захищені метадані про його походження та подальші зміни.

Такий запис може підтвердити, що файл проходив обробку через Claude, а також допомогти виявити внесені до нього зміни. Водночас результат перевірки залежить від того, чи збереглися метадані під час передавання, редагування або конвертації файлу.

Anthropic також працює над інструментами, за допомогою яких користувачі та сторонні платформи зможуть перевіряти тексти й файли на наявність маркування компанії.

Чому цифрова позначка не доводить авторство

Anthropic окремо наголошує: наявність маркування Claude не означає автоматично, що весь матеріал написала штучна інтелектуальна модель. Так само відсутність знака не гарантує, що текст або файл створила людина.

Наприклад, користувач міг самостійно підготувати матеріал, а потім використати Claude лише для перекладу, стислого викладу, перевірки граматики чи стилістичного редагування. У такому випадку позначка свідчитиме про факт обробки моделлю, а не про походження початкових ідей.

Коли маркування може зникнути

Надійність перевірки залежить від того, наскільки сильно змінювали текст або файл після створення. Цифровий знак може стати непомітним чи втратити чинність після:

  • глибокого переписування тексту;
  • перекладу іншою мовою;
  • значного скорочення матеріалу;
  • конвертації файлу в інший формат;
  • створення знімка екрана;
  • видалення або очищення метаданих;
  • повторного експорту з графічного чи текстового редактора.

Тому результати автоматичної перевірки варто оцінювати разом із контекстом: історією редагування, даними про файл і поясненнями автора. Одного цифрового сигналу недостатньо, щоб робити остаточні висновки щодо авторства.

Читайте також:  Anthropic звинувачують у знищенні книжок для навчання Claude

Що це означає для розробників

Розробникам, які створюють власні сервіси на основі Claude API, Anthropic планує надати додаткові технічні рекомендації. Вони мають допомогти правильно впроваджувати маркування та виконувати вимоги прозорості, передбачені європейським законодавством про штучний інтелект, зокрема EU AI Act.

Отже, система Anthropic має спростити виявлення участі Claude у створенні або редагуванні контенту, але не замінить повноцінну перевірку походження матеріалів. Маркування може бути корисним технічним доказом, проте його слід трактувати обережно з огляду на можливу втрату знака та змішане авторство людини й ШІ.