OpenAI маркирует тексты ChatGPT в ЕС по требованию закона об ИИ

OpenAI внедряет в странах Евросоюза невидимую маркировку текстов, созданных ChatGPT и Codex, — этого требует европейский закон об искусственном интеллекте. Технология textGrain меняет статистику выбора слов, а не добавляет скрытые символы. Детектор распознаёт около 80% фрагментов на 200 токенов, но при замене четверти слов обнаружение падает примерно до 17%.
OpenAI начала внедрять невидимую маркировку текстов, созданных в ChatGPT, в странах Евросоюза. Причина — требования европейского закона об искусственном интеллекте: он предусматривает возможность машинного определения контента, созданного генеративными моделями.
Маркировка строится на технологии textGrain. Скрытые символы, лишние пробелы или необычные знаки в текст не добавляются — вместо этого по заданному алгоритму меняется статистический выбор слов и токенов. Специальный детектор по этим изменениям определяет вероятное происхождение текста.
Похожую систему OpenAI разрабатывала и раньше, но массово не запускала: опасалась ошибочных выводов, например при проверке студенческих работ. Теперь маркировка постепенно появляется в текстах ChatGPT и Codex, которые создают пользователи в ЕС.
К редактированию технология остаётся уязвимой. Внутренние тесты OpenAI показали, что детектор распознавал около 80% маркированных фрагментов объёмом 200 токенов и до 95% текстов на 400 токенов. Если заменить четверть слов, показатель обнаружения снижается примерно до 17%.
OpenAI подчёркивает, что наличие маркировки не доказывает полное копирование текста из ChatGPT: система не показывает, какую часть материала создал ИИ и сколько текста затем изменил человек. Аналогичный подход к маркировке для соблюдения требований ЕС уже использует Anthropic в некоторых моделях Claude.
iXBT · права на исходный материал принадлежат автору.
Материал носит информационный характер и не является индивидуальной инвестиционной рекомендацией. Операции с криптовалютами связаны с риском полной потери вложенных средств. Подробнее — «Отказ от ответственности».
Разборы событий, итоги дня и то, что двигает рынок. Без сигналов и обещаний — только факты и что они значат.
Читать в Telegram →По теме
- ▪arXiv ограничил подачу препринтов до двух в месяц из-за статей, сгенерированных ИИ3DNews · 5 октября
- ▪ФСТЭК предупредила о критической уязвимости 9,8 в TrueConf ServerTAdviser · 5 октября
- ▪Anthropic передала полиции Флориды данные о планах стрельбы у пользовательницы Claude3DNews · 5 октября
- ▪Глава OpenAI Альтман заявил, что риски ИИ не повод ограничивать к нему доступ3DNews · 5 октября