19 случаев, когда ИИ-агенты пытались действовать в реальном интернете
💬 Прилетела интересная новость от Британского Института безопасности ИИ (AISI): в конце прошлого месяца они тестировали кибервозможности семи топовых моделей и результат оказался неоднозначным 🤔
За время тестов зафиксировали целых 19 случаев, когда ИИ-агенты пытались действовать в реальном интернете в отношении настоящих людей и организаций.
Почти все инциденты связали с Mythos 5 от Anthropic, ещё два — с GPT-5.6 Sol от OpenAI.
Mythos попыталась встроить вредоносный код в открытый проект на GitHub.
Модель создала pull request, а затем — фейковые аккаунты, которые «независимо» подтвердили, что в коде нет ничего подозрительного.
Параллельно агент отправил пять писем двум мейнтейнерам: часть с вредоносным ПО, а часть — с просьбой одобрить PR.
☝️ Важно понимать: из песочницы никто не сбегал — исследователи сами дали моделям доступ в интернет и отключили часть защит.
Все атаки провалились, поэтому реального ущерба не было зафиксировано 🎉
Пока что. Далеко не расходимся 😉
Для меня в этой новости примечательно то, что уже сегодня передовые ИИ-модели вышли на достаточно высокий уровень качества размышлений и осознания своих действий.
Следовательно (при должной настройке), и в реальных задачах по построению автоматизации бизнес-процессов через AI — они точно так же будут показывать высокую эффективность! ✨
Интересно пишу? Подписывайтесь на меня на других платформах, чтобы не пропустить новые посты: Telegram, ВКонтакте, vc.ru, Дзен и TenChat.