Новости

OpenAI впервые не исключает «критический» уровень киберспособностей у своей модели

Внутренние оценки готовящейся модели Astra показали такой прогресс в агентном программировании и кибербезопасности, что компания не смогла исключить высший порог собственной системы оценки рисков.

Дэми Авалонов основатель NeiroAI 2 мин чтения
OpenAI впервые не исключает «критический» уровень киберспособностей у своей модели

OpenAI сообщила, что предварительные внутренние оценки Astra — одной из готовящихся моделей — показали значительный прогресс в агентном программировании и кибербезопасности. По итогам этих оценок и экспертных заключений компания пришла к выводу, что не может исключить «критический» уровень киберспособностей по собственной системе оценки рисков Preparedness Framework.

Это первый такой случай: предыдущие модели компании, включая GPT-5.6 Sol, оценивались по этому направлению как «высокие», но не «критические».

Что означает «критический» порог

Формулировка в Preparedness Framework конкретная. Модель достигает критического уровня в кибербезопасности, если она способна на одно из двух:

  • находить и разрабатывать работающие эксплойты нулевого дня любой степени серьёзности во многих защищённых реальных системах — без участия человека;
  • самостоятельно придумывать и выполнять новые сценарии кибератак на защищённые цели, получив на входе только общую формулировку задачи.

Компания подчёркивает, что оценки предварительные и бенчмаркинг продолжается: речь идёт о невозможности исключить этот уровень, а не о подтверждённом факте.

Что предпринято

OpenAI сообщает, что усилила тестирование устойчивости своих защитных механизмов и контролей безопасности — чтобы они соответствовали развёртыванию модели с такими возможностями. Компания также приняла внутренние меры для дальнейшей разработки модели в защищённом контуре.

Сама Preparedness Framework была опубликована в декабре 2023 года — заметно раньше, чем модели приблизились к нынешнему уровню в биологии, химии, кибербезопасности и самоулучшении. Публикация нынешних результатов подаётся как обязательство перед сообществом безопасности: раскрывать смену уровня возможностей, а не молчать о ней.

Что это значит на практике

Прямых последствий для пользователя сегодня нет: Astra не выпущена, а речь идёт о внутренних оценках. Но сигнал важен по двум причинам.

Во-первых, компании начали публично признавать пороги, за которыми их собственные правила требуют дополнительных ограничений. Раньше такие оценки оставались внутри.

Во-вторых, это ориентир для тех, кто строит процессы на моделях: возможности в агентном программировании растут быстрее, чем регуляторная рамка вокруг них. Для бизнеса это значит, что вопрос «что модель сможет сделать с доступом к нашим системам» перестаёт быть теоретическим, а разграничение прав у ИИ-агентов становится такой же гигиеной, как разграничение прав у сотрудников.

Возможности и тарифы самого доступного сегодня сервиса компании собраны в карточке ChatGPT.

Источник: OpenAI

Упомянутые инструменты

Не пропускать важное

Заведите кабинет: добавьте нейросети, которыми пользуетесь, — и получайте только то, что касается именно их. Цены, тарифы, доступность из России, письмо перед списанием. Бесплатно.

Создать кабинет Войти

Читать дальше

Новости сегодня OpenAI показала цифры: ИИ-агенты внутри компании уже делают 3,1 «рабочего дня» на каждый день человека OpenAI опубликовала внутреннюю статистику по использованию ИИ-агентов собственными исследователями: за год траты на инференс агентов выросли в разы, а число экспериментов на… Новости вчера H Company выпустила NeoMME — открытый ИИ-поиск по документам со сжатием индекса в 255 раз Стартап H Company опубликовал на Hugging Face NeoMME — семейство компактных моделей-кодировщиков для мультиязычного поиска по тексту и изображениям одновременно. Модели на… Новости вчера OpenAI выпустила GPT-6 Astra — первую свою модель с «критическим» уровнем киберспособностей 3 сентября OpenAI начала раскатку GPT-6 Astra. Модель стоит в 2,5 раза дороже прежнего флагмана, первыми доступ получили участники закрытой программы по… Новости 5 сентября 2026 Google DeepMind выпустила WeatherNext 3: прогноз погоды точнее и в 5 раз детальнее Новая модель прогноза погоды от Google DeepMind считает прогноз по разрешению в 5 раз детальнее прежней версии и точнее предсказывает осадки. С…

Оставить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *