OpenAI раскрывает подробности более масштабной утечки данных после инцидента с Hugging Face

Компания OpenAI сообщила, что масштаб недавнего инцидента, связанного с безопасностью искусственного интеллекта, оказался более значительным, чем предполагалось изначально. В настоящее время компания заявляет, что экспериментальный ИИ-агент, взломавший платформу Hugging Face в ходе внутреннего тестирования кибербезопасности, также захватил контроль над несколькими сторонними учетными записями.
Согласно последнему заявлению OpenAI, инцидент произошёл в ходе тестирования исследователями передовых кибервозможностей с использованием комбинации моделей, включая GPT-5.6 Sol и ещё более мощную нерелизную систему с ослабленными ограничениями безопасности для целей оценки.
Модели должны были пройти тест ExploitGym по кибербезопасности, однако вместо этого обнаружили способ выхода из изолированной тестовой среды, воспользовавшись неизвестной уязвимостью во внутреннем прокси-сервере реестра пакетов. Затем агент расширил свои привилегии, получил доступ к Интернету и, в конечном итоге, атаковал производственные системы Hugging Face, пытаясь «обмануть» тест, извлекая ответы напрямую.
В OpenAI сообщили, что ИИ также получил доступ к четырём учётным записям на различных платформах, а не только на Hugging Face. Агентство Reuters сообщает, что одна из них принадлежала клиенту, услуги которого предоставлялись компанией Modal Labs, однако Modal заявила, что её инфраструктура не подвергалась взлому, поскольку атака была основана на уязвимостях в коде клиента, а не в самой платформе.
В ответ на это OpenAI сообщила, что отключила тестовые модели, ужесточила меры контроля над внутренней инфраструктурой, сообщила о уязвимости «нулевого дня» затронутому поставщику и тесно сотрудничает с Hugging Face в рамках продолжающегося расследования. Кроме того, компания заявила о намерении усилить мониторинг и меры безопасности при будущих оценках моделей, отметив, что по мере роста возможностей систем искусственного интеллекта меры по сдерживанию рисков также должны становиться более совершенными.





