Opus 5 от Anthropic показала рекордную защиту от инъекций
🧠 Opus 5 от Anthropic показала рекордную защиту от инъекций
Борис Черни из Anthropic назвал Opus 5 самой трудной для prompt injection моделью компании — несмотря на то, что факт спрятан на 73-й странице system card. По данным Simon Willison, в ходе тестирования на устойчивость к инъекциям и красных командных тестов успешно внедрить вредоносную инструкцию оказалось почти невозможно.
Конкретные цифры не раскрыты, но формулировка «очень трудно» — не маркетинговая метафора, а вывод внутреннего аудита, на который редко кто обращает внимание. Для контекста: большинство моделей до сих пор пробиваются с вероятностью от 5 до 30% в зависимости от сложности атаки.
Такая устойчивость критична для агентов, которые по цепочке передают документы, и для корпоративных контрактов, где промпт-инъекции превращаются из лабораторной гипотезы в аудиторский риск.
Пока индустрия меряет MMLU-очки, реальная конкурентная плоскость смещается в безопасность. Устойчивость к инъекциям скоро станет для корпоративных клиентов аргументом весомее, чем лишний процент на бенчмарке.
#Anthropic #Opus5 #promptinjection #LLMsafety
Такие разборы выходят в канале каждый день — коротко и со ссылкой на первоисточник.