虎嗅

Из-за невидимой водянки от AI компания Anthropic снова стала главным злодеем.

原文:因为一枚看不见的AI水印,Anthropic又成了大反派

Краткое содержание анализа

Компания Anthropic (материнская компания Claude) добавила к всем текстам, изображениям и файлам, созданным с помощью Claude, невидимые AI-водяные знаки в ответ на требования европейского регулирования и для завоевания дискуссионного пространства в отрасли. Однако уже через три дня эти водяные знаки были устранены с помощью открытого инструмента watermarks-remover, доступного на GitHub. Этот инструмент позволяет удалить статистические закономерности из текста, метаданные из файлов и даже заменить пиксельные водяные знаки на изображениях. За этой «битвой водяных знаков» стоят противоречивые потребности пользователей: с одной стороны, они хотят распознавать контент, созданный с помощью AI, чтобы предотвратить мошенничество, с другой — боятся, что их работы, в которых использованы AI-технологии, будут отнесены к категории «полностью созданные AI», что приведет к отрицанию их труда.

I. Водяные знаки Claude: «невидимые татуировки», скрытые в контенте

Водяные знаки Claude не представляют собой видимых логотипов или текстов; они заключаются в статистических закономерностях, возникающих в процессе создания контента.

При создании текста с помощью AI используется подобие игры «передача слова другому»: для каждого слова выбирается наиболее вероятный вариант из списка возможных (например, для выражения «скорость роста очень XX» список может включать такие варианты, как «быстрая», «сверхбыстрая», «удивительная». После добавления водяных знаков Anthropic незаметно изменяет вероятность выбора определенных слов (например, увеличивает вероятность использования слова «быстрая» и уменьшает — «сверхбыстрая»). При создании длинного текста такие изменения накапливаются, формируя код, понятный только для машин.

Для изображений и файлов используются более прямые методы: к изображениям добавляется цифровая подпись в виде метаданных, а в PDF-файлах и Word-документах встроены скрытые указатели источника создания. Компания Anthropic заявляла, что эти водяные знаки невозможно скопировать или удалить при легкой обработке, однако это утверждение было опровергнуто.

II. Инструмент watermarks-remover: удаляет водяные знаки из AI-контента

Инструмент watermarks-remover покрывает все сценарии использования:

1. Удаление текстовых водяных знаков: либо простое удаление скрытых символов (например, Unicode-пустых символов), либо перепись текста с помощью другой AI-модели с целью нарушения статистических закономерностей (что может привести к потере эмоционального оттенка и стиля оригинального текста);

2. Удаление изображений: инструмент использует алгоритм CtrlRegen для пересоздания изображения, сохраняя его содержимое, но заменяя пиксели, так что водяные знаки полностью исчезают;

3. Удаление метаданных из файлов: удаляется информация типа EXIF/XMP из PDF-файлов и Word-документов (это эквивалентно удалению «идентификационных документов» файла);

4. Функция самопроверки: инструмент подключается к системе проверки от Китайского университета Цинхуа, позволяющей убедиться в эффективности удаления водяных знаков.

Самое ironичное то, что сама компания Claude отказывается работать с этим инструментом — даже если пользователь утверждает, что контент был создан им самостоятельно и он хочет удалить водяные знаки, система не реагирует на это.

III. Причины начала этой битвы

Эта битва не случайна:

1. Регулировательное давление: более 190 компаний-разработчиков AI подписали Европейские стандарты прозрачности для контента, созданного с помощью AI, требующие наличия маркеров, понятных для машин. Anthropic была первой компанией, отреагировавшей на эти требования (стремясь завоевать дискуссионное пространство в области безопасности AI);

2. Корпоративные интересы: компания, первой разработавшая эффективные методы удаления водяных знаков, получает преимущество при формировании будущих отраслевых правил (Anthropic использовала технологию SynthID от Google DeepMind, демонстрируя свои возможности);

3 Протесты пользователей: водяные знаки рассматриваются как символ греха AI-технологий; пользователи считают несправедливым, что их работы, созданные с участием AI, получают одинаковые маркеры, как и работы, полностью созданные AI. Они боятся, что их труд будет игнорирован.

IV. Главные причины недовольства пользователей

Пользователи возмущены тем, что водяные знаки стали универсальным признаком AI-контента, что считают несправедливым:

  • Смазывание границ: контент, созданный с использованием AI (например, при редактировании текста или поиске информации), и полностью автоматически созданный контент неотличимы друг от друга из-за водяных знаков;
  • Отрицание ценности труда: пользователи опасаются, что их работа будет оцениваться ниже из-за наличия водяных знаков;
  • Отсутствие выбора: компания Claude обязательно добавляет водяные знаки ко всем пользователям, независимо от их желания, что приводит к утрате контроля над своим контентом.

V. Будет ли эта битва продолжаться? Нужны более разумные правила

Борьба между водяными знаками и инструментами их удаления будет продолжаться: компания Anthropic будет улучшать свои технологии, а сообщество разработчиков — создавать более эффективные инструменты для удаления водяных знаков. Однако основная проблема не в технологиях, а в том, как достичь баланса между необходимостью распознавания AI-контента и защитой прав создателей:

  • Можно ли разработать систему дифференцированных маркеров (например, для обозначения контента, созданного с помощью AI или с участием человека);
  • Могут ли пользователи самостоятельно решать, нужны ли им водяные знаки (например, платить за их удаление);
  • Могут ли регулирующие органы быть более гибкими (например, требовать добавления водяных знаков только к контенту высокого риска, такому как новости или реклама, а не к обычному контенту)?

Если мы продолжим цикл «добавляем водяные знаки — удаляем их — снова добавляем», пострадают обычные пользователи: они могут стать жертвами мошенничества или будут ошибочно обвиняться в использовании AI-технологий. Возможно, водяные знаки перестанут быть актуальными, когда контент, созданный с помощью AI, станет неотличим от человеческого. Однако до этого дня еще далеко.

По сути, эта битва является вопросом идентичности в эпоху AI: нам необходимо предотвратить использование AI для обмана людей и одновременно обеспечить признание результатов работы с помощью AI. Текущие технологии водяных знаков пока не позволяют найти подход, учитывающий эти аспекты.