Искусственный интеллект · EU AI Act · SynthID · Anthropic · Google · OpenAI · Цифровая прозрачность · Водяные знаки11 августа в 18:31 · 4 мин

Гиганты ИИ внедряют невидимые водяные знаки: что значит новый стандарт маркировки для Claude, Gemini и ChatGPT

На фоне вступления в силу статьи 50 европейского ИИ-акта (EU AI Act) лидеры рынка генеративного искусственного интеллекта, включая Anthropic, OpenAI и Google, переходят к обязательной маркировке своих созданий. На уровне модели в тексты, изображения и аудио будет внедряться криптографически стойкая информация, позволяющая различить человеческое творчество и синтетический контент. Данная мера направлена не на ограничение пользователей, а на обеспечение прозрачности в цифровой среде и выполнение жестких регуляторных требований.

# Невидимый след: как ИИ-гиганты маркируют свои тексты

Регуляторный стимул и глобальное распространение

10 августа компания Anthropic опубликовала обновление документации, в котором подробно описан механизм маркировки контента, создаваемого моделью Claude. В отличие от традиционных метаданных, скрытых в файлах, новые водяные знаки вплетаются непосредственно в текст на уровне нейросети. Этот подход гарантирует, что маркер выживет при копировании, перепечатывании или редактировании текста. Аналогичные решения применяются для аудио- и видеоматериалов.

Согласно обновленным планам, все модели Claude, запускаемые с 2 августа 2026 года и позже, будут получать такую маркировку автоматически. Для текущих версий моделей предусмотрен переходный период, сроки которого пока не определены официально. Важно отметить, что охват действия этих правил не ограничивается территорией Европейского Союза. Несмотря на то, что драйвером изменений служит именно европейское законодательство, платформы размещают контент глобально, и метки будут присутствовать во всех доступных вариантах сервиса.

Статья 50 AI Act и обязательства провайдеров

Центральным элементом этой трансформации стала статья 50 европейского ИИ-акта, вступившая в силу со 2 августа 2026 года. Она требует от провайдеров генеративного искусственного интеллекта обеспечивать машиночитаемую и достоверную маркировку синтетического контента. От тех, кто публикует такую информацию, в свою очередь, требуется раскрывать информацию о дипфейках и сгенерированных материалах на общественно значимые темы.

Для реализации этих целей Еврокомиссия разработала кодекс практик, состоящий из двух разделов: один для провайдеров технологий, другой — для компаний, разворачивающих эти системы. Подписание кодекса является добровольным, однако соблюдение требований статьи 50 носит принудительный характер. Нарушение норм грозит штрафами до 15 миллионов евро или 3% от глобального годового оборота компании. К концу июля 2024 года список подписавшихся организаций насчитывал около 190 компаний. В число провайдеров вошли Google, Microsoft, OpenAI, Anthropic, Mistral и Meta. В списке деплойеров (компаний-использователей) находятся Getty Images, Lufthansa, Bulgari и ряд греческих новостных изданий.

Несмотря на то, что законодательство носит европейский характер, основные технологические гиганты, включая OpenAI и Google, вписались в требования добровольно, осознавая риски и необходимость соблюдения международных стандартов прозрачности.

Технологии маркировки и поиск правды

Важно понимать, что настоящий детектор, способный проверить текстовое написание на наличие вотермарки, пока отсутствует в открытом доступе. Anthropic обещает предоставить инструкции по проверке в будущей документации. OpenAI запустила публичный верификатор API, однако на данный момент он эффективно работает только с изображениями и аудио. Текстовые генерации ChatGPT пока не несут маркировки, хотя компания заявляет о намерениях начать внедрение такого механизма.

Google является пионером в этой области: платформа Gemini помечает текст с использованием технологии SynthID еще с 2024 года. Сама технология выложена в открытый доступ, а детекторы предоставляются избранным СМИ и исследователям. Сторонние сервисы, подобные GPTZero, работают на основе анализа паттернов — длины тире, ритма повторов и частотности оборотов. Такой метод ненадежен, так как алгоритмы моделируют стилистику людей, а не ищут криптографические метки.

Логика регулирования строится на ответственности. Если текст был отредактирован человеком и подписан юристом или редактором, ответственность за содержание берет на себя человек, а не алгоритм. Маркировка же нужна для верификации источника и подтверждения того, что контент не является результатом автоматической генерации без контроля.

Google использует подход, при котором бизнес-модель строится на поиске: система должна различать полезный сигнал от шума. В социальных сетях, таких как X, уже внедрена автоматическая пометка «Made with AI», а LinkedIn заменил кнопку генерации поста на опцию «Выглядит как ИИ-слоп».

Технически маркировка SynthID зашифровывается так, что ее невозможно удалить простым редактированием текста. Она считывается по наличию определенных слов, встроенных в структуру, а не через скрытые символы. Это создает надежный барьер против полного удаления метки при ретрансляции контента.

Итоги для пользователей и рынка

Парадокс заключается в том, что определить наличие вотермарки на глаз невозможно. Пользователи продолжат читать текст как обычно, не замечая изменений. Однако за кулисами происходит фундаментальное изменение в экосистеме искусственного интеллекта: становится возможным техническое различение человеческих написаний и машинных генераций, что ранее было задачей крайне высокой сложности.

Это шаг к созданию среды, где цифровая информация будет носить атрибут происхождения, аналогично тому, как в фотографии используется метаданные EXIF. Для потребителей это означает повышение доверия к контенту, а для регуляторов — наличие инструментов контроля. Для самих ИИ-компаний это путь к легитимизации технологий в глазах глобального общества и избежание санкций со стороны европейских законодателей.

В ближайшем будущем мы, скорее всего, увидим расширение практики верификации и появление специализированных инструментов для журналистов и правоохранительных органов, которые смогут быстро проверять подлинность материалов в потоке информации.

Первоисточники

Habr AI
← Вернуться в эфир