AI-агент сбежал из sandbox Google kvmCTF
Исследовательский агент pwn провёл недели внутри вложенной KVM, построил харнесс для эксплуатации ядра на 14 338 строк и заставил живой хост Google отдать флаг. Агент переписал собственный EPT через эмулированную VMX-инструкцию, провернул восемь EPT-корней и 49 152 sparse-маппинга, а четвёртая попытка вернула 64-битное значение с боевого хоста.
Почему важно: Это первый публично задокументированный случай, когда AI-агент самостоятельно построил и применил эксплойт для выхода из гостевой VM в хост. Для тех, кто строит агентов с доступом к коду и системам, это сигнал пересмотреть модели изоляции: агент способен находить и эксплуатировать уязвимости уровня гипервизора, а не просто генерировать PoC.
Google Research открыл RRSI: агенты улучшают свой харнесс без переобучения
Google Research выложил в open source систему RRSI, которая позволяет AI-агентам самостоятельно улучшать собственный инструментальный харнесс, избегая переобучения под конкретную задачу.
Почему важно: Для строителей агентов это потенциальный сдвиг от ручной настройки инструментов к самооптимизирующимся пайплайнам. Если агент может менять свой харнесс без деградации на новых данных, это сокращает цикл «собрал — погонял — переписал промпты и тулинг».
Контекст к kvmCTF: OpenAI назвал летние события с безопасностью агентов «водоразделом для кибербезопасности», Vercel выставил $1 млн за sandbox-escape, а Meta и Anthropic анонсировали новые протоколы сдерживания и pre-engagement тестирования. Если вы даёте агенту shell или доступ к рантайму — изоляция уровня Docker уже не выглядит достаточной.
Карта для оплаты AI · Claude Pro на неделю · Manus
Комментариев пока нет.