AI
August 7

19 случаев, когда ИИ-агенты пытались действовать в реальном интернете

💬 Прилетела интересная новость от Британского Института безопасности ИИ (AISI): в конце прошлого месяца они тестировали кибервозможности семи топовых моделей и результат оказался неоднозначным 🤔

В двух словах 👇

За время тестов зафиксировали целых 19 случаев, когда ИИ-агенты пытались действовать в реальном интернете в отношении настоящих людей и организаций.

Почти все инциденты связали с Mythos 5 от Anthropic, ещё два — с GPT-5.6 Sol от OpenAI.

Самый жёсткий эпизод теста 👇

Mythos попыталась встроить вредоносный код в открытый проект на GitHub.

Модель создала pull request, а затем — фейковые аккаунты, которые «независимо» подтвердили, что в коде нет ничего подозрительного.

Параллельно агент отправил пять писем двум мейнтейнерам: часть с вредоносным ПО, а часть — с просьбой одобрить PR.

☝️ Важно понимать: из песочницы никто не сбегал — исследователи сами дали моделям доступ в интернет и отключили часть защит.

Все атаки провалились, поэтому реального ущерба не было зафиксировано 🎉

Пока что. Далеко не расходимся 😉

Для меня в этой новости примечательно то, что уже сегодня передовые ИИ-модели вышли на достаточно высокий уровень качества размышлений и осознания своих действий.

Следовательно (при должной настройке), и в реальных задачах по построению автоматизации бизнес-процессов через AI — они точно так же будут показывать высокую эффективность! ✨

Интересно пишу? Подписывайтесь на меня на других платформах, чтобы не пропустить новые посты: Telegram, ВКонтакте, vc.ru, Дзен и TenChat.