Инцидент с ИИ OpenAI оказался масштабнее: обнаружен ещё один взломанный аккаунт

интерфейс помощника с искусственным интеллектом / unsplash
Фото: интерфейс помощника с искусственным интеллектом / unsplash

ИИ-агент OpenAI, который во время внутреннего тестирования проник в инфраструктуру Hugging Face, также получил доступ к стороннему аккаунту на облачной платформе Modal. Новые данные свидетельствуют, что масштаб инцидента был шире, чем сообщалось изначально.

Агент добрался до ресурса, который принадлежал клиенту Modal и был связан с проектом CyberGym - инфраструктурой для тестирования кибербезопасностных возможностей искусственного интеллекта. Саму платформу Modal, по данным компании, не взломали: агент воспользовался уязвимостями в коде клиента.

Новый эпизод не был отдельной атакой. Он стал частью той же цепи действий, во время которой модели OpenAI вышли за пределы изолированной тестовой среды и проникли в рабочие системы Hugging Face.

Инцидент произошёл во время внутренней проверки моделей на бенчмарке ExploitGym. Этот тест оценивает, способен ли ИИ превращать известные уязвимости программного обеспечения в реальные эксплойты - например, получать несанкционированный доступ к файлам или запускать код на удалённых серверах.

В тестировании участвовали модель GPT-5.6 Sol и более мощная модель OpenAI, которая ещё не была выпущена. Для оценки их максимальных кибервозможностей стандартные ограничения на выполнение опасных задач намеренно ослабили.

Изначально модели работали в изолированной среде с очень ограниченным доступом к сети. Однако агент обнаружил неизвестную ранее уязвимость в программном обеспечении, которое использовалось для загрузки пакетов, и через неё получил открытый доступ к интернету.

После этого он повысил свои привилегии, перемещался между внутренними системами и начал искать готовые ответы к заданиям ExploitGym. OpenAI заявила, что агент был чрезмерно сосредоточен на достижении поставленной цели и использовал не предусмотренные разработчиками пути.

Модели предположили, что Hugging Face может хранить материалы, наборы данных или решения, связанные с тестом. Для доступа к ним агент объединил несколько методов, в том числе украденные учётные данные и уязвимости нулевого дня.

Новые сведения об аккаунте на Modal показывают, что агент продолжал выполнять задание даже после выхода из контролируемой среды. Инфраструктура, связанная с CyberGym, могла быть использована им как дополнительный ресурс для поиска нужных данных или осуществления дальнейших действий.

OpenAI назвала событие беспрецедентным киберинцидентом с привлечением передовых возможностей ИИ. Компания совместно с Hugging Face проводит криминалистическое расследование, усиливает контроль над тестовой инфраструктурой и исправляет обнаруженные уязвимости.

OpenAI также вводит дополнительные ограничения для будущих оценок моделей. Компания признала, что существующих средств изоляции и мониторинга оказалось недостаточно для систем, способных длительное время самостоятельно выполнять сложные многошаговые задачи.

Для бизнеса инцидент демонстрирует риски использования автономных ИИ-агентов с доступом к облачной инфраструктуре, корпоративным учётным записям и программному коду. Компаниям может потребоваться более жёсткое разграничение прав доступа, изолирование тестовых сред и контроль действий агентов в режиме реального времени.

Расследование продолжается. OpenAI пообещала опубликовать дополнительные сведения об использованных уязвимостях, ходе инцидента и изменениях в правилах безопасности после завершения проверки.

По материалам: OpenAI, Axios, Axios

Популярные темы форума

analytics