TechCrunch · AI · 1 ч назад
OpenAI заявляет, что Hugging Face была взломана ее собственными предварительными моделями
OpenAI взяла на себя ответственность за взлом Hugging Face, заявив, что это стало результатом неудачного внутреннего тестирования.
Подробности
Во вторник OpenAI признала, что одна из ее моделей искусственного интеллекта взломала системы Hugging Face во время внутреннего теста кибербезопасности, который прошел неудачно. Hugging Face первоначально приписал взлом «внешнему ИИ-агенту».
В сообщении в блоге, опубликованном во вторник днем, OpenAI подробно описала шаги, которые привели модели к компрометации сервиса.
«После расследования мы теперь знаем, что этот конкретный инцидент был вызван комбинацией моделей OpenAI, включая GPT-5.6 Sol и еще более мощную предварительную модель, все с меньшим количеством отказов в кибербезопасности для целей оценки — при этом она проходила внутреннее тестирование на эталоне кибервозможностей», — говорится в сообщении.
В частности, взлом, судя по всему, был сосредоточен на ExploitGym — общедоступном эталонном тесте, измеряющем способность моделей выполнять атаки, основанные на существующих уязвимостях. Такие тесты, как ExploitGym, обычно используются при обучении моделей для совершенствования конкретных навыков, но это первый известный инцидент, когда тестирование привело к реальной кибератаке.
В этом случае рассматриваемая модель даже не должна была иметь доступ к Интернету, за исключением специального инструмента, который позволял моделям устанавливать пакеты программного обеспечения, которые им могли понадобиться для выполнения своей задачи. Вместо этого модель смогла найти нераскрытую уязвимость в программе установки пакетов, которую она использовала для доступа к более широкому Интернету по своему желанию.