Новости

OpenAI встроила GPT-5.6 в AWS-агента Kiro — код стал дешевле на 82%

OpenAI и AWS подключили семейство моделей GPT-5.6 (Sol, Terra, Luna) к Kiro — агенту для разработки, который превращает задачу в требования, дизайн и исполняемые шаги. По итогам совместной оптимизации на бенчмарке Terminal-Bench 2.1 модель Terra стала выполнять задачи в Kiro примерно на 82% дешевле.

Дэми Авалонов основатель NeiroAI 2 мин чтения
OpenAI встроила GPT-5.6 в AWS-агента Kiro — код стал дешевле на 82%

OpenAI и AWS объявили о партнёрстве: линейка моделей GPT-5.6 — Sol, Terra и Luna — теперь доступна в Kiro, агенте для разработки, который встраивается в рабочий процесс планирования, написания, ревью и тестирования кода. Раньше в Kiro уже можно было работать с моделями OpenAI, но именно с GPT-5.6 компании вместе занялись оптимизацией под конкретный сценарий — не общий чат, а долгие многошаговые задачи по кодовой базе.

Kiro построен на принципе spec-driven development: идея пользователя сначала превращается в понятные требования и технический дизайн, а уже потом — в исполняемые задачи. Такой явный контекст помогает модели точнее понимать, что именно строит команда и как должна работать система, вместо того чтобы угадывать по обрывочному промпту.

Что это значит на практике

Главный измеримый результат — не про качество ответов, а про экономику. На тесте Terminal-Bench 2.1 модель GPT-5.6 Terra в связке с Kiro стала доводить задачи до успешного результата примерно на 82% дешевле по итоговой стоимости токенов. OpenAI объясняет это тем, что структура Kiro — чёткие требования и технический дизайн с самого начала — сокращает число ошибочных попыток модели: она реже уходит не в ту сторону и реже переделывает уже сделанное.

−82%снижение стоимости задачи GPT-5.6 Terra на Terminal-Bench 2.1 внутри Kiro, по данным OpenAI и AWS

Для разработчиков это означает, что тот же объём работы — от постановки задачи до готового и протестированного изменения — обходится заметно дешевле в токенах, при этом ключевые точки (ревью плана, проверка корректности через property-based тесты) остаются под контролем человека. Похожий подход к «дорогим, но надёжным» агентам для кода использует и GitHub Copilot — конкуренция здесь идёт не только за качество кода, но и за цену часа работы модели. Сама линейка GPT-5.6, лежащая в основе Kiro, — та же, что питает и потребительский ChatGPT, только развёрнутая под задачи разработки, а не диалог.

Источник: OpenAI

Упомянутые инструменты

Не пропускать важное

Заведите кабинет: добавьте нейросети, которыми пользуетесь, — и получайте только то, что касается именно их. Цены, тарифы, доступность из России, письмо перед списанием. Бесплатно.

Создать кабинет Войти

Читать дальше

Новости сегодня OpenAI показала цифры: ИИ-агенты внутри компании уже делают 3,1 «рабочего дня» на каждый день человека OpenAI опубликовала внутреннюю статистику по использованию ИИ-агентов собственными исследователями: за год траты на инференс агентов выросли в разы, а число экспериментов на… Новости вчера H Company выпустила NeoMME — открытый ИИ-поиск по документам со сжатием индекса в 255 раз Стартап H Company опубликовал на Hugging Face NeoMME — семейство компактных моделей-кодировщиков для мультиязычного поиска по тексту и изображениям одновременно. Модели на… Новости вчера OpenAI выпустила GPT-6 Astra — первую свою модель с «критическим» уровнем киберспособностей 3 сентября OpenAI начала раскатку GPT-6 Astra. Модель стоит в 2,5 раза дороже прежнего флагмана, первыми доступ получили участники закрытой программы по… Новости 5 сентября 2026 Google DeepMind выпустила WeatherNext 3: прогноз погоды точнее и в 5 раз детальнее Новая модель прогноза погоды от Google DeepMind считает прогноз по разрешению в 5 раз детальнее прежней версии и точнее предсказывает осадки. С…

Оставить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *