Автор Администратор Сайта

МОСКВА, 14 августа /Новости науки/. Anthropic начала добавлять невидимые водяные знаки в тексты новых моделей Claude. Об этом сообщил журнал Nature со ссылкой на разработчика системы искусственного интеллекта.

Маркировка должна сделать контент, созданный нейросетями, более узнаваемым и помочь бороться с массовым распространением низкокачественных текстов, изображений и научных работ, созданных при помощи ИИ. Однако специалисты сомневаются, что технология станет надежным способом установить происхождение любого текста: водяной знак можно ослабить или удалить при переработке материала.

В текстах Claude используется не скрытый символ или код, а статистический след. Специальный алгоритм слегка изменяет то, какие слова модель выбирает при генерации ответа. В результате в достаточно длинном фрагменте возникает характерная последовательность, которую можно выявить при помощи специального детектора. Anthropic утверждает, что такая маркировка не влияет на смысл, качество и читаемость текста и может сохраняться после некоторых видов редактирования.

При этом сама компания предупреждает, что наличие водяного знака еще не доказывает, что весь материал написал искусственный интеллект. Claude мог, например, только перевести или кратко пересказать созданный человеком текст. И наоборот, отсутствие метки не означает, что ИИ не использовался: статистический след может исчезнуть в коротком фрагменте, после существенной правки или перефразирования другим языковым ИИ.

Для изображений Anthropic применяет другой подход. В большинстве случаев файлы, обработанные Claude, будут получать метаданные с цифровой подписью, позволяющей установить участие модели в создании или изменении изображения.

Решение связано с вступлением в действие требований европейского Акта об искусственном интеллекте. С 2 августа 2026 года поставщики наиболее мощных моделей ИИ должны обеспечивать возможность обнаружения сгенерированного ими контента. Для новых моделей требования действуют сразу, а уже существующие системы должны соответствовать им к 2 декабря. За нарушение предусмотрены штрафы до €15 млн или 3% годового мирового оборота компании. Anthropic намерена применять маркировку Claude не только в Евросоюзе, но и по всему миру.

Исследователи, опрошенные Nature, считают возможности такой защиты ограниченными. Метаспециалист Северо-Западного университета Риз Ричардсон отметил, что мотивированный пользователь сможет сравнительно легко удалить статистический след, например пропустив текст через другую нейросеть. Поэтому водяные знаки вряд ли сами по себе остановят создание поддельных или низкокачественных научных публикаций с помощью ИИ.

В то же время технология может оказаться полезной там, где пользователи просто копируют готовый ответ нейросети. Компьютерный ученый Нихар Шах из Университета Карнеги — Меллона напомнил об эксперименте на конференции ICML 2026: организаторы специально встроили в статьи скрытую маркировку, которая проявлялась при использовании ИИ для подготовки рецензий. Так удалось выявить 506 рецензентов, нарушивших запрет на применение нейросетей.

Практическая ценность водяных знаков во многом будет зависеть от качества инструментов их обнаружения и частоты ложных срабатываний. Anthropic заявила, что планирует предоставить средства, с помощью которых сторонние пользователи смогут проверять тексты на наличие ее маркировки.