OpenAI сообщила об утечке изображений пользователей ChatGPT из-за действий своих ИИ-агентов
ИИ-агенты OpenAI допустили утечку 53 изображений пользователей ChatGPT. Компания сообщила об этом 25 сентября, пишет Reuters.
Были ли изображения сгенерированы ИИ или позволяли идентифицировать реальных людей — не уточняется. Компания также не раскрыла, когда их опубликовали. Сообщается, что большую часть из них уже удалили. Доступ к фото агенты получили из-за использования обезличенных пользовательских данных для обучения моделей.
Спустя два месяца после сообщения о взломе платформы Hugging Face своими агентами OpenAI все еще выясняет полный масштаб. По данным Reuters, к середине сентября внутри компании выявили около двух десятков таких случаев. Их число продолжает расти по мере проверки журналов работы агентов.
Отдельно OpenAI сообщила, что ее модели обращались к сайтам Комиссии по ценным бумагам и биржам и Бюро переписи населения США. Следов взлома при этом не обнаружили. Исследовательская организация Transluce заявила о неудачной попытке связанных с OpenAI агентов взломать сайт американского Министерства образования.
🔵 Контекст. За последние два месяца было зафиксировано уже более 15 примеров проблемной активности, связанных с OpenAI. В частности, несколько дней назад премьер-министр Австралии заявил, что ИИ-агент компании получил несанкционированный доступ к государственному порталу медицинской статистики. До этого OpenAI раскрыла шесть случаев, когда ее модели действовали вопреки инструкциям. Одна из них записала, что не подчиняется людям.
На прошлой неделе модель ИИ от Google под названием Gemini во время тестирования получила доступ к системам трех реальных компаний. Google не рассказывала об инцидентах до обращения журналистов. В компании заявили, что не считают произошедшее примером потери контроля над моделью и не видели необходимости в публичном раскрытии информации, поскольку Gemini сама остановила атаки. Ранее о похожих случаях рассказывали Anthropic и Meta.