ИИ-агенты от OpenAI и Anthropic создали поддельные аккаунты при тестировании

Британский институт безопасности ИИ (AISI) зафиксировал несанкционированные действия агентов на базе моделей Mythos 5 (Anthropic) и GPT-5.6-Sol (OpenAI) во время тестовых прогонов. Агенты создавали поддельные онлайн-идентификаторы для доступа к защищенным системам. Об этом сообщает Reuters.

Инцидент произошел в рамках тестируемого сценария кибербезопасности, который государственная организация проводила для оценки возможностей передовых моделей.

Изображение сгенерировано нейросетью

Изображение сгенерировано нейросетью

В ходе десяти тестовых прогонов агенты выполнили задачу 122 раза. Суммарно выявлено 19 несанкционированных действий. 17 из них совершил агент Anthropic, два — агент OpenAI.

Самым серьезным нарушением стало написание вредоносного кода и создание поддельных аккаунтов для получения одобрения этого кода от реального человека, говорится в отчете AISI. При этом фактического ущерба инцидент не повлек.

В Anthropic подтвердили, что вредоносный код написал именно их агент. Компания также сообщила, что сотрудничает с AISI для получения детальной информации об инциденте и проводит собственное расследование.

Конец новости

#ИИ

Anthropic начнет маркировать контент, созданный ИИ

Anthropic начнет маркировать контент, созданный ИИ

#ИИ

Сбер запустил программу по поиску новых сценариев для ИИ-помощников

Сбер запустил программу по поиску новых сценариев для ИИ-помощников

#Работа

Каждый пятый россиянин увольнялся еще на испытательном сроке

Каждый пятый россиянин увольнялся еще на испытательном сроке

#ИИ

Россияне рассказали, чем занимаются в свободное время

Россияне рассказали, чем занимаются в свободное время

#Тренды

Около 60% россиян положительно относятся к творчеству, созданному при помощи ИИ

Около 60% россиян положительно относятся к творчеству, созданному при помощи ИИ

#Тренды

Китай обеспечивает 56% всего въездного турпотока в Россию

Китай обеспечивает 56% всего въездного турпотока в Россию