Новости

OpenAI впервые не исключает «критический» уровень киберспособностей у своей модели

Внутренние оценки готовящейся модели Astra показали такой прогресс в агентном программировании и кибербезопасности, что компания не смогла исключить высший порог собственной системы оценки рисков.

Дэми Авалонов основатель NeiroAI 2 мин чтения
OpenAI впервые не исключает «критический» уровень киберспособностей у своей модели

OpenAI сообщила, что предварительные внутренние оценки Astra — одной из готовящихся моделей — показали значительный прогресс в агентном программировании и кибербезопасности. По итогам этих оценок и экспертных заключений компания пришла к выводу, что не может исключить «критический» уровень киберспособностей по собственной системе оценки рисков Preparedness Framework.

Это первый такой случай: предыдущие модели компании, включая GPT-5.6 Sol, оценивались по этому направлению как «высокие», но не «критические».

Что означает «критический» порог

Формулировка в Preparedness Framework конкретная. Модель достигает критического уровня в кибербезопасности, если она способна на одно из двух:

  • находить и разрабатывать работающие эксплойты нулевого дня любой степени серьёзности во многих защищённых реальных системах — без участия человека;
  • самостоятельно придумывать и выполнять новые сценарии кибератак на защищённые цели, получив на входе только общую формулировку задачи.

Компания подчёркивает, что оценки предварительные и бенчмаркинг продолжается: речь идёт о невозможности исключить этот уровень, а не о подтверждённом факте.

Что предпринято

OpenAI сообщает, что усилила тестирование устойчивости своих защитных механизмов и контролей безопасности — чтобы они соответствовали развёртыванию модели с такими возможностями. Компания также приняла внутренние меры для дальнейшей разработки модели в защищённом контуре.

Сама Preparedness Framework была опубликована в декабре 2023 года — заметно раньше, чем модели приблизились к нынешнему уровню в биологии, химии, кибербезопасности и самоулучшении. Публикация нынешних результатов подаётся как обязательство перед сообществом безопасности: раскрывать смену уровня возможностей, а не молчать о ней.

Что это значит на практике

Прямых последствий для пользователя сегодня нет: Astra не выпущена, а речь идёт о внутренних оценках. Но сигнал важен по двум причинам.

Во-первых, компании начали публично признавать пороги, за которыми их собственные правила требуют дополнительных ограничений. Раньше такие оценки оставались внутри.

Во-вторых, это ориентир для тех, кто строит процессы на моделях: возможности в агентном программировании растут быстрее, чем регуляторная рамка вокруг них. Для бизнеса это значит, что вопрос «что модель сможет сделать с доступом к нашим системам» перестаёт быть теоретическим, а разграничение прав у ИИ-агентов становится такой же гигиеной, как разграничение прав у сотрудников.

Возможности и тарифы самого доступного сегодня сервиса компании собраны в карточке ChatGPT.

Источник: OpenAI

Упомянутые инструменты

Дэми Авалонов основатель NeiroAI

Материал подготовлен редакцией NeiroAI. Факты проверяются по официальным источникам, мнение редакции отделено от фактов.

Читать дальше

Новости 14 августа 2026 Google выпустил Gemini 3.7 Flash — рост качества в кодинге и агентных задачах Google обновила рабочую модель для разработчиков: Gemini 3.7 Flash вышла всего через три недели после версии 3.6 и заметно прибавила в бенчмарках… Новости 14 августа 2026 Google запустила Sheets canvas — Gemini собирает из таблиц дашборды без кода В Google Таблицах появилась функция Sheets canvas: Gemini превращает строки данных в интерактивный дашборд одним запросом на естественном языке. Доступна с 13… Новости 14 августа 2026 Google научил Gboard переводить жестовый язык в текст Google представила модель SL2T, которая переводит американский жестовый язык в текст прямо на смартфоне — без отдельного приложения и без обращения к… Новости 7 августа 2026 OpenAI впервые раскрыла статистику по странам: ChatGPT перестают спрашивать и начинают им работать На работе люди вдвое чаще используют ChatGPT для выполнения задачи, а не для вопроса. Самый быстрорастущий сценарий в мире — мультимедиа.

Оставить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *