Как работает скрытая маркировка текстов Claude
17 августа в 10:30 Anthropic опубликовала официальное разъяснение о том, как устроена незаметная метка, которую модель Claude оставляет в сгенерированных текстах. Решение позволяет распознавать материалы, созданные ИИ, и соответствует требованиям Закона ЕС об искусственном интеллекте. Для пользователя маркер незаметен — он формируется за счёт статистического выбора определённых токенов во время генерации контента.
Токены — это небольшие фрагменты текста, из которых модель выстраивает ответ. Если предложение можно продолжить несколькими способами, система с повышенной частотой применяет определённые токены, руководствуясь секретным ключом Anthropic. К примеру, говоря о погоде, модель может выбирать между словами «серый» и «пасмурный». Но в случае фразы «Париж — столица…» сделать это значительно сложнее. Каждый отдельный выбор токена не бросается в глаза, однако в объёмном тексте специальный детектор может определить, что материал, вероятно, был создан с помощью Claude.
Запуск детектора и реакция пользователей
Anthropic также планирует предоставить инструмент для обнаружения этой метки через API. Процесс маркировки почти не сказывается на скорости генерации и расходе токенов. В коротких текстах и в программном коде выявить происхождение контента сложнее, поскольку там меньше неоднозначных вариантов. Система может определять участие Claude даже в тех случаях, когда модель использовалась только для редактирования написанного человеком текста; заметность метки зависит от длины материала и интенсивности внесённых правок.
Технология маркировки основана на подходе, описанном в исследовании SynthID 2024 года. Похожая система пометки контента используется и в Google. В то же время часть подписчиков Claude написала в соцсети X о желании отменить свои платные подписки: некоторые не хотят, чтобы клиенты, преподаватели или другие люди могли заметить использование ИИ. В ответ на это Anthropic сообщила Business Insider, что после анонса роста отказов от подписок не наблюдается.
«Пометка материалов, созданных Claude, — важный этап на пути к открытому и честному использованию искусственного интеллекта», — считает Business Insider.
Введение скрытой маркировки у Claude — заметный шаг к большей прозрачности в сфере генеративного ИИ. Для русскоязычной аудитории это повод учитывать, что крупные зарубежные сервисы уже внедряют средства детекции ИИ-контента, а требования регуляторов к этичности таких технологий продолжают усиливаться. Резкая реакция части пользователей показывает, что вопросы приватности и контроля над собственной цифровой деятельностью остаются чувствительными. Как новая технология повлияет на дальнейшее использование нейросетей, покажет время.
Важно отметить, что новая система маркировки текстов от Anthropic не является единственной в своем роде. Аналогичные методы применяются и в других крупных компаниях, таких как Google. Более подробно о том, как незаметные сигналы работают в текстах Claude и какие преимущества они могут предоставить пользователям, можно узнать в нашем материале о невидимых маркерах в контенте.