Тимофей Петрищенко

Текст перестаёт быть синтетическим, когда вы можете взять за него ответственность

Как работают новые правила прозрачности ИИ. И как они повлияют на работу медиа?

2 августа 2026 года Еврокомиссия ввела новые требования к прозрачности использования ИИ. Они касаются не только разработчиков, но и организаций, в том числе и медиа, которые применяют искусственный интеллект.

Что это значит для медиа и как новые требования отразятся на их работе? Мы пообщались с юристом Александром Зайцем и попытались разобраться в самом главном.

Что изменилось?

Новые правила обязывают ИИ-разработчиков маркировать синтетический контент. Теперь девелоперы добавляют метки, благодаря которым можно выяснить происхождение материала.

Как ИИ-разработчики маркируют контент?

Чтобы ИИ-контент можно было распознать, разработчики используют метаданные и водяные знаки. Компании часто применяют обе технологии, потому что каждая имеет ограничения.

Водяные знаки

Google использует технологию SynthID. Она добавляет в контент водяные знаки. А при работе с текстом подталкивает языковую модель выбирать определённые слова, вместо случайных – так при анализе детекторы могут распознать ИИ.

Ту же технологию использует OpenAI, но пока компания помечает с её помощью лишь визуальный контент.

– Мы добавляем водяные знаки с помощью SynthID от Google DeepMind в изображения, созданные через ChatGPT, Codex или OpenAI API. SynthID встраивает невидимый слой, который дополняет подходы на основе метаданных C2PA, – пишет компания на сайте. – Мы готовились к этому уже некоторое время. В Sora мы использовали видимые водяные знаки, а в Voice Engine — аудиоводяной знак.

Чтобы найти следы ИИ в контенте, Google запустил бесплатный портал SynthID Detector. Он сейчас находятся в закрытом доступе, но журналисты могут подать заявку, чтобы получить доступ.

Anthropic также маркирует тексты модели Claude. При этом водяные знаки сохраняются, даже если пользователь копирует и вставляет материал в другие приложения.

Можно ли удалить водяной знак?

После заявления Anthropic о том, что Claude будет помечать весь сгенерированный контент, сторонние девелоперы начали выпускать программы, которые стирают маркировку.

Один из таких инструментов – Watermarks Remove. Он удаляет скрытые символы и метаданные, а затем переписывает текст. Проект уже получил больше 16 тысяч положительных оценок на GitHub (платформа для IT-проектов и совместной работы разработчиков).

Ещё один инструмент MarkScrub появился в день, когда Anthropic выпустил заявление. По словам разработчика Анш Анежа, сервисом уже воспользовались 8,5 тысяч человек.

Оба инструмента лежат в открытом доступе, и ими может воспользоваться любой человек бесплатно. При этом они не дают 100% гарантии того, что водяные знаки полностью исчезнут.

Метаданные

Ещё один подход к маркировке контента – это C2PA, открытый стандарт метаданных, который прикрепляется к файлу и содержит информацию о его происхождении.

OpenAI пользуется C2PA для изображений, которые генерируют модели DALL·E, ImageGen и Sora. Anthropic применяет его для файлов .svg, .png и .jpg, созданных Claude.

Но метаданные могут исчезнуть после скачивания и повторной загрузки файла, изменения его формата или размера или если кто-то сделал скриншот картинки. Поэтому многие компании сочетают две технологии.

Проверка происхождения

Чтобы определить «подлинность» контента, нужен инструмент, который сможет найти следы искусственного интеллекта. OpenAI уже запустил пробную версию такого сервиса. С ним можно проверить изображение на наличие сигналов C2PA и SynthID.

Также разработчик открыл доступ к проверке через API. С его помощью, редакция может встроить распознавание контента OpenAI в собственную систему и автоматически анализировать загруженные файлы. Но компания предупреждает, что если инструмент не нашёл водяных знаков или метаданных, это ещё не значит, что изображение сделал человек.

Google предупреждает о другой проблеме. Компания считает, что большое количество маркировок может запутать пользователей.

«Если онлайн-контент будет переполнен пересекающимися маркировками ИИ и юридическими предупреждениями, людям будет сложнее получить понятный контекст, который им нужен», – заявила Карен Массин, руководитель направления Government Affairs and Public Policy в ЕС в Google.

Что это значит для медиа?

Новые правила касаются не только производителей ИИ-контента, но и тех, кто его использует. В СМИ и соцсетях креаторы и редакции должны сообщать об участии искусственного интеллекта в создании материалов.

Meta уже использует отметку «AI Info» для публикаций в Facebook и Instagram. А TikTok требует от креаторов сообщать пользователям о синтетическом происхождении их видео, аудио или изображений.

Медиа также теперь обязаны уведомлять об использовании ИИ в их контенте. Редакциям нужно предупреждать аудиторию о дипфейках (реалистичных изображениях, видео и аудио, которые могут выглядеть как настоящие – прим.).

Также с маркировкой должен быть и синтетический текст, если он представляет «общественный интерес». Это может быть политическая новость, информация о здравоохранении или общественной безопасности. Но также им может стать и новость о погоде. То есть это любая информация, которая может повлиять на поведение аудитории, спровоцировать её на действие или бездействие.

Какой контент считается синтетическим?

В новых правилах есть важная пометка про «редакторскую проверку». Если вы использовали искусственный интеллект, но после убедились в достоверности информации, отредактировали, дополнили и готовы нести ответственность за контент, он перестаёт быть синтетическим и становится вашим, то есть человеческим.

«Можно зайти на Википедию и получить информацию, можно зайти в ChatGPT, задать вопрос, получить какой-то кусок информации, – говорит юрист Александр Заяц. – Ответственность редактора или человека, который публикует текст на сайте или в печатном издании как раз в том, чтобы он обработал всю информацию, полученную из разных источников».

Одной замены слов или исправления пунктуации недостаточно. Нужна именно существенная проработка материала, а ИИ в данном случае может выступать как первый источник информации, но не как автор.

В случае с визуальным контентом играет роль реалистичность и важность материала. Изображение персоны, места или события, которое может ввести человека в заблуждение, – нужно помечать. Если вы только внесли мелкие правки, например, размыли фон на фотографии, это не будет считаться синтетическим контентом. Но когда в кадре с помощью ИИ появляется реальный человек или какое-то событие, которого на самом деле не было, ситуация меняется. Фантастические картинки, например, дракон или летающий человек, под определение дипфейка не попадают и их не нужно маркировать.

Как должна выглядеть маркировка?

Быть читаемой и очевидной. Читатель или зритель должен увидеть информацию сразу, к примеру, в самом начале видео или аудио. Пометку нельзя спрятать в самом низу сайта, написать её мелким шрифтом или показать на пару миллисекунд в видео.

Для разного типа контента рекомендации похожи. Для визуального материала – это видимый значок. Еврокомиссия поделилась макетами таких плашек.

Для аудио предлагают использовать понятное голосовое предупреждение или специальный звуковой сигнал.

С синтетическим текстом иначе. Плашку нужно перевести и маркировать ИИ-контент на том языке, на котором его написали. Например, в немецком языке это будет «KI», а во французском – «IA».

Как именно это делать, требований нет, но есть предложения, которые опциональны. Кроме того, нужно оставлять пометки, где текст полностью синтетический, а где ИИ использовали частично. Главная идея таких маркировок, и для текстового, и для визуального контента в том, чтобы человеку было легко понять, какой именно материал перед ним.

«Медиаорганизация несёт полную ответственность за публикацию контента, который сгенерирован с помощью ИИ, – считает Александр Заяц. – Это законодательство создано для того, чтобы быть другом для журналиста, а не врагом. Это очень важно с точки зрения противодействия дезинформации и различного рода дипфейкам».

Что делать, если редакция не знала, что перед ней ИИ-контент, но опубликовала его без маркировки?

Здесь нет чёткой границы, по словам юриста. Если журналист или редакция могут показать, что проверяли материал, искали информацию и проводили фактчекинг, ситуация отличается от простой публикации непроверенного контента.

«Если вы сможете доказать, что вы не просто перепостили материал, который был сгенерирован на другой платформе с помощью ИИ, а провели свой фактчекинг, но, к сожалению, вам с помощью ваших средств не удалось установить, что это дипфейк, законодатель не будет суров в данной ситуации», – считает Александр.

При этом санкции, как прописано в новых требованиях, могут быть серьёзными. За несоблюдение правил грозят штрафы до 15 млн евро или до 3% от годового оборота компании. Но эксперт советует не воспринимать максимальный штраф как автоматическое наказание за любую пропущенную плашку. По его словам, во время изучения нарушения будут учитывать общественную значимость и возможный социальный вред контента.

Что стоит изменить в работе редакции?

Александр советует редакциям заранее прописать правила работы с ИИ. В них, по его мнению, нужно отметить:

  • Кто отвечает за публикацию материалов и принимает последнее решение о том, публиковать их или нет.
  • Какие ИИ-инструменты использует редакция. Если журналисты используют ChatGPT для ресёрча, эту информацию можно разместить на сайте или в отдельном документе о работе редакции с ИИ.
  • Кто проверяет материалы на ИИ перед публикацией. Это должна быть отдельная процедура, которая отличается от обычного фактчекинга;
  • Как редакция проверяет изображения на дипфейки. Особое внимание, по словам эксперта, стоит уделять изображениям политиков, публичных людей и других известных персон.

Актуальное

Лучшее на Соли