ииiXBT

OpenAI заявила о более 16 000 запросов с 4000 аккаунтов при попытке скопировать логику её моделей

OpenAI заявила о более 16 000 запросов с 4000 аккаунтов при попытке скопировать логику её моделей

OpenAI сообщила, что в июле пресекла скоординированную кампанию по извлечению скрытых рассуждений из своих моделей. Пик пришёлся на двое суток, за которые было зафиксировано 16 000 запросов с более чем 4000 учётных записей. Основной очаг активности компания связывает с людьми, аффилированными с китайским стартапом Moonshot AI, создателем ассистента Kimi.

OpenAI заявила, что выявила и остановила скоординированную кампанию по извлечению защищённых логических рассуждений из своих моделей. Основной очаг активности компания связывает с китайским стартапом Moonshot AI, который разрабатывает ИИ-ассистента Kimi.

Кампания началась в первых числах июля. В пиковый период за двое суток было зафиксировано 16 000 запросов, отправленных с более чем 4000 учётных записей. Вся связанная активность шла через кластер, в котором насчитывалось более 15 000 пользователей. К 28 июля OpenAI полностью подавила кампанию.

Свою операцию в OpenAI классифицировали как состязательную дистилляцию (adversarial distillation) — метод, при котором выходные данные или цепочки рассуждений одной модели используются для обучения или улучшения другой. Доступ к скрытым ответам и рассуждениям позволяет конкурентам воспроизводить продвинутые способности без дорогостоящей разработки и без создания собственных механизмов безопасности. В компании считают, что это несёт риски для национальной безопасности и контроля над мощными ИИ-системами.

Злоумышленники не взламывали шифрование, базы данных или хранилища диалогов OpenAI. Вместо этого они манипулировали взаимодействием с моделями так, чтобы скрытые внутренние рассуждения проявлялись в видимой для запрашивающего форме.

В OpenAI подчеркнули, что не уверены, действовал ли во всех случаях один и тот же субъект. Однако основной очаг активности приписан лицам, аффилированным с Moonshot AI.

Разоблачение состоялось спустя считанные недели после того, как конкурент OpenAI, компания Anthropic, обвинила ряд китайских разработчиков, включая Moonshot AI и Alibaba, в тайном использовании её модели Claude для обучения собственных систем. Информацией о нынешней атаке OpenAI поделилась с другими разработчиками через Frontier Model Forum и правительственные каналы обмена данными.

Источник

iXBT · права на исходный материал принадлежат автору.

Материал носит информационный характер и не является индивидуальной инвестиционной рекомендацией. Операции с криптовалютами связаны с риском полной потери вложенных средств. Подробнее — «Отказ от ответственности».

Bittalk в Telegram

Разборы событий, итоги дня и то, что двигает рынок. Без сигналов и обещаний — только факты и что они значат.

Читать в Telegram →

По теме