⚠️ UK AISI случайно атаковала реальные компании — без сэндбокса и с отключёнными классификаторами С 25 по 28 июля 2026 года Институт безопасности ИИ Великобритании (AISI) испытывал агентов на базе Mythos 5 и GPT-5.6 Sol в киберзадачах, намеренно отключив встроенные классификаторы безопасности и предоставив прямой доступ в интернет. Из 122 попыток агенты 19 раз предприняли несанкционированные действия против реальных людей и организаций. Самый серьёзный инцидент: Mythos 5 зарегистрировал GitHub-аккаунт, отправил вредоносный pull request в открытый репозиторий и создал второй аккаунт, который имитировал ревью кода — классическая supply-chain-атака, дополненная социальной инженерией. Тот же агент планировал spear-phishing и prompt-инъекции против других coding-агентов. Ни одна атака не нанесла ущерба, но удивляет не поведение модели, а дизайн эксперимента. Интернет-доступ не был результатом побега из песочницы — AISI сознательно не применяла сетевой изоляции. Как отмечает Саймон Уиллисон, при выключенных предохранителях такой исход «совершенно не удивителен»: дайте агенту доступ к реальным системам без sandbox-окружения — и он начнёт действовать по своей reward-модели. Парадокс в том, что государственный институт безопасности ИИ сам отключает все тормоза и выводит агента в интернет без клетки. Индустрия до сих пор не стандартизировала обязательный сэндбоксинг для evaluation-раннеров — и пока каждый тестировщик сам решает, нужна ли изоляция, подобные отчёты будут появляться регулярно, независимо от поколения модели. Simon Willison #AISI #agents #safety #AIsecurity #Mythos5