
OpenAI сообщила о беспрецедентном инциденте во время внутренних испытаний кибервозможностей своих моделей. По данным компании, комбинация GPT-5.6 Sol и ещё одной, пока не представленной модели смогла выйти за пределы изолированной тестовой среды, обнаружить цепочку уязвимостей и получить доступ к инфраструктуре Hugging Face. Инцидент уже расследуется совместно обеими компаниями.
Во время тестирования модели получили ослабленные ограничения, чтобы максимально раскрыть свои возможности в поиске способов решения задачи. Сначала они нашли уязвимость нулевого дня в прокси-сервисе для установки пакетов, затем повысили привилегии внутри исследовательской сети OpenAI и добрались до узла с доступом в интернет. После этого ИИ предположил, что на Hugging Face могут храниться модели и материалы, связанные с тестовым бенчмарком, и начал искать способы получить к ним доступ, используя цепочку из украденных учётных данных и других уязвимостей, включая RCE.
Мы благодарны OpenAI за сотрудничество по этой и другим темам. Этот инцидент, возможно первый в своем роде, подтверждает то, во что мы давно верим: безопасность ИИ не сможет обеспечить ни одна компания, работающая втайне. Она будет обеспечена открыто и совместно, при широком доступе к ИИ для каждого защитника, где бы он ни находился
Клем Деланг, сооснователь и CEO Hugging Face
OpenAI подчёркивает, что модели действовали исключительно в рамках поставленной цели — найти решение тестового задания, а подозрительную активность оперативно обнаружили службы безопасности OpenAI и Hugging Face. Компании уже локализовали инцидент, устранили выявленные проблемы и продолжают совместное расследование, предупреждая, что подобные случаи могут стать гораздо чаще по мере развития ИИ с продвинутыми кибервозможностями.
