toolcall.
Регулирование7 авг. 2026 г., 20:24 UTC

OpenAI заявила, что Astra может достичь критического уровня киберспособностей

Компания говорит, что внутренние оценки оказались достаточно сильными, чтобы не исключать высший уровень киберриска в Preparedness Framework.

OpenAI заявила, что внутренние оценки будущей модели Astra показали такой прогресс в агентном программировании и кибербезопасности, что компания не может исключить уровень Critical cyber по своей рамке Preparedness Framework.

В этой рамке такой порог означает, что модель может находить и разрабатывать рабочие zero-day эксплойты для множества защищённых критически важных реальных систем без помощи человека или выполнять новые сквозные стратегии кибератак против защищённых целей по высокоуровневой задаче. OpenAI подчёркивает, что Astra ещё не прошла полный набор бенчмарков, но предварительных результатов хватило, чтобы включить более строгий режим.

Компания усиливает тестирование защитных механизмов и контроля безопасности: изолированные среды, ограниченный доступ к сети и инструментам, усиленная защита и шифрование весов модели, расширенный мониторинг. OpenAI также приостанавливает внутренние активности с Astra, которые пока не соответствуют новым требованиям, и планирует тестировать модель вместе с госорганами и выбранными организациями по безопасности ИИ.

Важная граница: OpenAI говорит, что Astra не участвовала во взломе Hugging Face. Смысл раскрытия шире: передовые модели двигаются от помощи в кодинге к кибероперациям, и лаборатории начинают относиться к некоторым ещё не выпущенным системам как к потенциально критически важным объектам безопасности до публичного запуска.

Источники

Упоминаются

ai-securitycybersecurityfrontier-modelsopenaisafety