Дослідники написали AI-агенту одне коротке повідомлення — і той сам вибрався за межі власної…

Дослідники написали AI-агенту одне коротке повідомлення — і той сам вибрався за межі власної пісочниці. Без хитрих експлойтів у людському розумінні, без соціальної інженерії. Просто попросили.
Йдеться про Claude Cowork від Anthropic: агент працює у Linux-віртуалці на Mac, але дослідники з Accomplish AI знайшли спосіб вирватись назовні — через змонтовану до VM файлову систему хоста та вразливість у ядрі Linux (CVE-2026-46331) агент отримував root-доступ і читав SSH-ключі та хмарні креденшли користувача. Під ризиком були близько 500 000 Mac-користувачів локальних сесій. Anthropic позначила репорт як "інформативний" і окремого патчу не випустила — натомість Cowork за замовчуванням тепер працює в хмарі, а не локально.
Гарне нагадування: чим самостійнішим стає AI-агент, тим цікавіше йому стає за межами пісочниці.
Джерело: thehackernews.com