OpenAI впервые не исключает «критический» уровень киберспособностей у своей модели
Внутренние оценки готовящейся модели Astra показали такой прогресс в агентном программировании и кибербезопасности, что компания не смогла исключить высший порог собственной системы оценки рисков.
OpenAI сообщила, что предварительные внутренние оценки Astra — одной из готовящихся моделей — показали значительный прогресс в агентном программировании и кибербезопасности. По итогам этих оценок и экспертных заключений компания пришла к выводу, что не может исключить «критический» уровень киберспособностей по собственной системе оценки рисков Preparedness Framework.
Это первый такой случай: предыдущие модели компании, включая GPT-5.6 Sol, оценивались по этому направлению как «высокие», но не «критические».
Что означает «критический» порог
Формулировка в Preparedness Framework конкретная. Модель достигает критического уровня в кибербезопасности, если она способна на одно из двух:
- находить и разрабатывать работающие эксплойты нулевого дня любой степени серьёзности во многих защищённых реальных системах — без участия человека;
- самостоятельно придумывать и выполнять новые сценарии кибератак на защищённые цели, получив на входе только общую формулировку задачи.
Компания подчёркивает, что оценки предварительные и бенчмаркинг продолжается: речь идёт о невозможности исключить этот уровень, а не о подтверждённом факте.
Что предпринято
OpenAI сообщает, что усилила тестирование устойчивости своих защитных механизмов и контролей безопасности — чтобы они соответствовали развёртыванию модели с такими возможностями. Компания также приняла внутренние меры для дальнейшей разработки модели в защищённом контуре.
Сама Preparedness Framework была опубликована в декабре 2023 года — заметно раньше, чем модели приблизились к нынешнему уровню в биологии, химии, кибербезопасности и самоулучшении. Публикация нынешних результатов подаётся как обязательство перед сообществом безопасности: раскрывать смену уровня возможностей, а не молчать о ней.
Что это значит на практике
Прямых последствий для пользователя сегодня нет: Astra не выпущена, а речь идёт о внутренних оценках. Но сигнал важен по двум причинам.
Во-первых, компании начали публично признавать пороги, за которыми их собственные правила требуют дополнительных ограничений. Раньше такие оценки оставались внутри.
Во-вторых, это ориентир для тех, кто строит процессы на моделях: возможности в агентном программировании растут быстрее, чем регуляторная рамка вокруг них. Для бизнеса это значит, что вопрос «что модель сможет сделать с доступом к нашим системам» перестаёт быть теоретическим, а разграничение прав у ИИ-агентов становится такой же гигиеной, как разграничение прав у сотрудников.
Возможности и тарифы самого доступного сегодня сервиса компании собраны в карточке ChatGPT.
Источник: OpenAI




Комментарий опубликован.