Anthropic · Claude · Искусственный интеллект · Регулирование ЕС · SynthID · Технологии · Прозрачность ИИ17 августа в 14:31 · 3 мин

Anthropic внедряет невидимые водяные знаки в тексты Claude для соблюдения регламента ЕС

Компания Anthropic официально сообщила о внедрении системы невидимых водяных знаков в генерируемый текст своей модели Claude. Данная технология, основанная на модифицированном подходе Google DeepMind (SynthID-Text), призвана обеспечить прозрачность создания контурных алгоритмами, требуемую новым законодательством Европейского союза. По утверждению разработчиков, эти изменения не повлияют на стоимость подписки или языковые способности модели.

# Невидимый след: как Anthropic маркирует тексты Claude

В последние месяцы регуляторные органы Европейского союза активно внедряют нормативные акты, обязывающие искусственный интеллект быть прозрачным. Теперь одна из ведущих компаний на этом поприще, Anthropic, представила конкретный механизм, который будет маркировать тексты, созданные её языковой моделью Claude.

В пятницу компания объявила, что внедряемая система маркировки текста представляет собой «версию» открытого источника кода SynthID-Text, разработанного Google DeepMind. Цель данной инициативы — выполнить обязательства, установленные Актом об искусственном интеллекте ЕС. Закон требует, чтобы синтетический контент, будь то аудио, изображения, видео или текст, содержал машинно-читаемые метки, позволяющие идентифицировать его как произведение машин.

*«Система маркировки текстов Claude не увеличит стоимость для пользователей и не окажет никакого практического влияния на качество или содержание выводов модели»,* — отметили в Anthropic.

Механизм работы водяных знаков

Техническая суть метода, который использует Anthropic, заключается в использовании низкой вероятности выбора слов, чтобы создать невидимый паттерн. В обычной работе языковой модели выбор следующего слова зависит от контекста и вероятностей. Например, если предложение звучит так: «Погода сегодня была холодной и…», то следующее слово, вероятнее всего, будет «пасмурной» или «серой». Смысл предложения от выбора одного или другого слова практически не пострадает.

В обычных условиях модель выбирает между этими вариантами случайным образом. Маркировка же встраивается в этот процесс случайности. Когда активирована функция водяного знака, модель всё ещё принимает случайные решения, но источник этой случайности меняется. Вместо простого генератора случайных чисел, модель использует криптографический ключ (который доступен только проверенным детекторам) и несколько предыдущих слов, чтобы определить, какое именно слово выбрать из множества вероятных вариантов. Этот ключ позволяет верифицировать наличие паттерна.

Для обычного читателя разница между обычным текстом и маркированным невидима. Однако для системы, обладающей соответствующим ключом, паттерн выбора слов становится обнаруживаемым.

Контекст рынка и конкуренты

Это не единственный шаг в сторону регулировки. Компания Anthropic также внедряет поддержку стандарта C2PA для изображений, прошедших обработку через Claude, что является ещё одним шагом к прозрачности. Однако стоит учитывать, что требование законодателя затрагивает всех крупных игроков.

Внедрение подобных технологий происходит и у других разработчиков. Бот Google Gemini уже поддерживает решение SynthID Text с 2024 года. Хотя OpenAI не раскрывала конкретные планы по текстовым водяным знакам в своём дорожной карте по соблюдению Акта об ИИ, её решения также попадут под действие закона и, вероятно, будут обязаны маркировать контент в ближайшем будущем. Таким образом, прозрачность становится общепринятым стандартом индустрии, вынужденным регуляторным давлением.

Глоссарий терминов

* Водяной знак (Watermark): Специфическая последовательность данных, незаметная для человека, но распознаваемая алгоритмом для подтверждения источника или подлинности. В контексте ИИ это не визуальный штрих на картинке, а статистическая аномалия в структуре текста. * Синтетический контент: Материалы, созданные с помощью искусственного интеллекта (тексты, изображения, видео) вместо людей. * Open-source (Открытый источник): Программное обеспечение или технология, исходный код которой доступен для изучения, изменения и использования общественностью. * Цифровая подпись (в контексте C2PA): Метод подтверждения происхождения цифрового файла, который гарантирует, что файл не был изменен с момента создания и указывает на инструмент, использованный для его генерации.

Первоисточники

The Verge AI
← Вернуться в эфир