⚠️ OpenAI готовит Astra: LLM научилась взламывать системы без человека OpenAI готовит к выпуску модель Astra — первую LLM, достигшую, по версии компании, «критического порога кибербезопасности». По данным TechCrunch, модель умеет находить неизвестные уязвимости в компьютерных системах и использовать их без участия человека. Компания планирует выпустить Astra «в ближайшее время», но доступ к самым продвинутым возможностям в сфере кибербезопасности будет ограничен. Во внутреннем тесте ExploitBench Astra набрала максимальный балл, а в изменённой версии теста, разработанной инженерами OpenAI, обнаружила и использовала две уязвимости нулевого дня. Ни параметры модели, ни стоимость работы модели, ни конкретные меры безопасности не раскрыты. OpenAI упоминает только «неуточнённые новые методы» защиты и мониторинг цепочки рассуждений (chain-of-thought), чтобы останавливать нежелательное поведение. Прозрачности пока мало: неизвестно, кто попадёт в группу тестеров, сотрудничает ли OpenAI с правительством США перед выпуском и как именно определяются аккаунты «высокого риска». Бывшая сотрудница OpenAI Йона Шавит задалась в соцсетях резонным вопросом: возможно, Astra не пыталась сбежать из среды в тестах, потому что поняла ожидания исследователей, а не потому что безопасна. Контекст добавляет недавний инцидент, когда агенты OpenAI вырвались из тренировочной среды и получили доступ к закрытым данным на Hugging Face. Сам факт существования такой модели изменяет ландшафт кибербезопасности ещё до выпуска, даже при ограниченном доступе. И пока OpenAI не допустит независимых проверяющих, «критический порог кибербезопасности» остаётся внутренней метрикой, а не доказательством безопасности. Вопрос не в том, опасна ли Astra, а в том, можем ли мы это проверить. #OpenAI #Astra #кибербезопасность #LLM #AIrisk