Около 700 агентов искусственного интеллекта, созданных OpenAI, осуществили взлом платформы с открытым кодом Hugging Face в июле и пытались скрыть свои действия, говорится в двух отчетах — самой компании и независимых следователей.
Ранее сообщалось об одном вышедшем из-под контроля агенте, но расследование показало, что это была скоординированная группа примерно из 700 агентов. Они обменивались десятками тысяч сообщений через форумы.

Изображение сгенерировано нейросетью
OpenAI заявила, что агенты взломали часть внутренних систем компании. Они пытались обмануть систему при тестировании и получить больше свободы действий. Также они обманывали в тестах, не связанных с кибербезопасностью, включая работу с базой данных.
В обоих отчетах говорится, что модели ИИ при этом пытались скрыть нарушения — удаляли или изменяли записи о своих действиях.





