Найпопулярніше зараз

Anthropic пояснила принцип невидимого водяного знака Claude

Принцип невидимого водяного знака Клода
Компанія Anthropic розкрила секрети технології прихованої ідентифікації в Claude. Фото: НВ — Техно

Роз'яснення компанії Anthropic щодо водяного знака

Як повідомляє НВ — Техно: 17 серпня о 10:30 компанія Anthropic опублікувала роз'яснення щодо роботи невидимого водяного знака у текстах своєї моделі Claude. Ця система розроблена для визначення текстів, створених штучним інтелектом, та відповідає вимогам Закону ЄС про штучний інтелект. Водяний знак, який не помітний для читача, формується шляхом статистичного вибору певних токенів у процесі генерації тексту.

Токени - це невеликі частини тексту, які модель використовує для створення відповіді. У ситуаціях, де можливі різні варіанти продовження речення, система може частіше обирати певні токени згідно з принципом вибору, який визначає секретний ключ Anthropic. Наприклад, у реченні про погоду модель може обирати між словами «сірий» і «похмурий». Однак у реченні «Париж - столиця…» застосувати водяний знак складніше. Окремі вибори токенів є непомітними, але в довгому тексті спеціальний детектор може визначити, що матеріал, ймовірно, був створений Claude.

План компанії Anthropic та реакція користувачів

Anthropic також планує надавати інструмент виявлення водяного знака через API. Створення водяного знака майже не впливає на швидкість генерації та витрати токенів. Варто зазначити, що у коротких текстах і програмному коді визначити походження тексту складніше через меншу кількість неоднозначних варіантів. Система може спрацьовувати навіть у випадках, коли Claude використовують лише для редагування тексту, написаного людиною. Помітність сліду залежить від обсягу тексту та ступеня змін.

Технологія водяного знака базується на підході, описаному в дослідженні SynthID 2024 року. Варто також зазначити, що Google використовує схожу систему для маркування контенту. Проте частина користувачів Claude у соцмережі X висловила намір скасувати платні підписки через нововведення, оскільки деякі не бажають, щоб клієнти, викладачі чи інші особи могли визначити використання штучного інтелекту. Anthropic, у свою чергу, заявила виданню Business Insider, що після оголошення про водяні знаки не зафіксувала зростання кількості скасувань підписок.

«Запровадження водяного знака в текстах, створених за допомогою Claude, є важливим кроком у контексті підвищення прозорості використання штучного інтелекту.» - Business Insider

Запровадження водяного знака в текстах, створених за допомогою Claude, є важливим кроком у контексті підвищення прозорості використання штучного інтелекту. Це також відповідає зростаючим вимогам регуляторів щодо етики та відповідальності у сфері AI. Водночас реакція користувачів демонструє, що нововведення можуть викликати занепокоєння щодо конфіденційності та контролю над контентом, що створюється за допомогою штучного інтелекту. Залишається спостерігати, як ця технологія вплине на майбутнє використання AI у різних сферах.

На тлі нових роз'яснень Anthropic, варто згадати, що компанія також впроваджує невидимі водяні знаки для текстів, створених Claude. Це рішення дозволяє не лише ідентифікувати контент, а й підкреслює зусилля компанії у дотриманні стандартів безпеки. Більше про цю технологію та її особливості можна дізнатися у нашій статті про мітки текстів Claude.

Читайте також

Реклама