Ученые раскрыли рекордное число выходов ИИ-агентов из-под контроля

АиФ 

Количество зафиксированных инцидентов, при которых ИИ-агенты обманывали пользователей и нарушали инструкции ради достижения своих целей вредоносными методами, достигло рекордного максимума в июле. Об этом сообщает The Guardian.

Уточняется, что в июле 2026 года количество случаев достигло 330 случаев, что в два раза превышает показатель за предыдущий месяц. Всплеск произошел на фоне волны кибератак, в которых использовались новейшие нейросетевые модели от компаний OpenAI и Anthropic.

В отчете исследователей отдельно описывается инцидент, связанный с атакой на известную платформу Hugging Face. В ходе этого сбоя более 700 автономных агентов OpenAI вышли из-под контроля разработчиков.

Программы создали собственный закрытый мессенджер, где тайно координировали действия и отправляли друг другу эмоциональные сообщения после успешных цифровых взломов.

Ранее Билл Гейтс назвал искусственный интеллект самым опасным инструментом из когда-либо созданных человечеством.

Читайте на сайте