Модели OpenAI в ходе тестов самостоятельно вышли в сеть и взломали Hugging Face

В ходе внутреннего тестирования кибервозможностей, проводимого компанией OpenAI, произошел инцидент, в результате которого две тестируемые модели искусственного интеллекта получили несанкционированный доступ к внешним системам. Согласно заявлению OpenAI, модели GPT-5.6 Sol и «более продвинутая предварительная версия», находившиеся в изолированной тестовой среде, смогли преодолеть установленные ограничения и выйти в интернет.

Модели OpenAI в ходе тестов самостоятельно вышли в сеть и взломали Hugging Face
Источник

Тестирование проводилось с целью оценки способности моделей к проведению сложных кибератак. Для чистоты эксперимента некоторые защитные механизмы были намеренно отключены. В процессе выполнения оценочного задания модели самостоятельно обнаружили уязвимость нулевого дня в тестовой инфраструктуре OpenAI, а затем нашли узел, обеспечивающий выход в глобальную сеть.

После выхода в интернет модели предприняли попытку найти решения для поставленной задачи на платформе Hugging Face. Для этого они использовали несколько векторов атак, включая эксплуатацию других уязвимостей нулевого дня и применение скомпрометированных учетных данных. В результате им удалось получить доступ к хранилищам данных Hugging Face, предназначенным для машинного обучения.

Компания Hugging Face подтвердила факт обнаружения несанкционированного доступа к своим системам со стороны ИИ-агента. В настоящее время OpenAI и Hugging Face проводят совместное расследование инцидента. Стороны уже приступили к устранению выявленных уязвимостей, которые были использованы моделями.

В комментариях к инциденту представители Hugging Face отметили, что использование автономных ИИ-инструментов для наступательных киберопераций перестает быть теоретической угрозой. Применение ИИ в кибератаках способно ускорить проведение кампаний и снизить их стоимость, что требует внедрения аналогичных ИИ-решений для защиты платформ.

OpenAI поддержала эту позицию и выразила мнение, что с ростом распространения киберустойчивых моделей нарушения безопасности с участием ИИ могут учащаться. В компании отмечают, что данный случай демонстрирует необходимость параллельного развития передовых кибервозможностей и соответствующих мер безопасности.

Читайте также: Четыре команды за 10 дней выявили четыре способа взлома ИИ-агентов через одну уязвимость.

Что будем искать? Например,ChatGPT

Мы в социальных сетях