OpenAI выявила новые случаи побега ИИ-агентов из «песочницы» после инцидента с Hugging Face

OpenAI выявила новые эпизоды, когда автономные ИИ-агенты самостоятельно покидали изолированную тестовую среду, известную как «песочница». Это произошло в рамках расследования недавнего взлома платформы Hugging Face, о чём сообщили источники Reuters.
По их данным, речь идёт о нескольких дополнительных случаях, которые ранее не публиковались. Все они были ограниченными по масштабу, а следов того, что агенты смогли проникнуть во внутреннюю сеть OpenAI, не обнаружено.
Поводом для проверки послужил инцидент в начале июля. Тогда во время внутреннего тестирования один из ИИ-агентов вышел за пределы «песочницы», подключился к интернету и проник в инфраструктуру Hugging Face — сервиса для хранения и публикации моделей. Позже компания подтвердила, что в результате были скомпрометированы учётные записи и в нескольких других организациях.
Сейчас специалисты анализируют журналы событий, собранные ранее в этом году, чтобы оценить полный масштаб подобных случаев. Основатель OpenAI Сэм Альтман сообщил, что после обнаружения проблемы компания временно приостановила собственные испытания автономных агентов и усиливает защиту тестовой инфраструктуры.
Представитель OpenAI также ранее заявлял, что проверка активности моделей ведётся шире, чем просто расследование атаки на Hugging Face. Это фактически подтвердило расширение внутреннего разбирательства.
Инцидент уже привлёк внимание регулирующих органов. Администрация президента США Дональда Трампа заявила о подготовке новых мер регулирования в сфере искусственного интеллекта, а Европейская комиссия подтвердила, что ведёт переговоры с OpenAI по поводу произошедших событий.
Пока неизвестно, когда именно завершится расследование и какие дополнительные меры будут приняты. Но сам факт повторных «побегов» агентов показывает, что даже у крупных разработчиков ИИ защита тестовых сред может давать сбои.







