GPT-6 Astra вышла в прод с идеальным результатом теста эксплойтов
🚀 GPT-6 Astra вышла в прод с идеальным результатом теста эксплойтов
OpenAI 3 сентября выпустила GPT-6 Astra, а 7-го открыла доступ к ней подписчикам ChatGPT Plus. Модель показала 100% в ExploitBench — тесте, который проверяет умение превращать известные уязвимости в рабочие эксплойты. В испытаниях она выстроила полную цепочку компрометации браузера с выходом из песочницы и повышением прав до прав суперпользователя. Но вместе со способностями выросли и ограничения: доля отказов на наступательные запросы подскочила до 91,5% против 59% у предшественницы. OpenAI присвоила модели категорию Critical по собственной шкале киберспособностей.
Сэм Альтман назвал запуск неряшливым: корпоративные клиенты ждут доступа, а первые пользователи жалуются, что модель распараллеливает задачи, нагружая машину десятками процессов. Это примечательно: модель, идеально справляющаяся с наступательными задачами, в промышленной эксплуатации ведёт себя как плохо оптимизированный агент. Параллельно, по данным Habr, Google представила Gemini 3.8 Flash Cyber с программой Fairwind, а Anthropic — Claude Fable 5.1 и Mythos 5.1.
Тесты возможностей показывают, что модель умеет в лаборатории, а не как она поведёт себя под нагрузкой. 100% в ExploitBench не означает готовность к работе модели в промышленной среде: запуск получился «хаотичным» именно потому, что между созданием эксплойта и управлением ресурсами — пропасть. Российские разработчики на этой неделе представили средства контроля действий ИИ-агентов — рынок чувствует, что безопасность смещается с модели на её окружение.
#GPT6 #Astra #ExploitBench #OpenAI #AIsecurity
Такие разборы выходят в канале каждый день — коротко и со ссылкой на первоисточник.