Разборы

Кто ведёт рынок ИИ-генерации изображений в 2026 году — и что из него доступно из России

OpenAI забрала первое место в независимом рейтинге предпочтений text-to-image, Google сделала свою модель генератором по умолчанию для 141 страны, а Black Forest Labs и xAI играют на поле открытых весов и своих движков. Разбираем, кто реально задаёт темп в генерации изображений и что из этой гонки работает из России без иностранной карты.

Дэми Авалонов основатель NeiroAI 5 мин чтения
Кто ведёт рынок ИИ-генерации изображений в 2026 году — и что из него доступно из России

Ещё в начале 2026 года генерация изображений была соревнованием по красоте картинки. К осени она стала соревнованием по точности: модели учат следовать сложной инструкции, сохранять лицо персонажа между кадрами, рисовать читаемый текст на вывеске и за один проход и генерировать, и редактировать — вместо отдельного инструмента под каждую задачу. У этой гонки неожиданный расклад: лидер независимого рейтинга предпочтений — не тот, у кого самый широкий охват.

OpenAI выигрывает голосование пользователей

OpenAI выпустила gpt-image-2 21 апреля 2026 года — первую свою модель, которая не просто рисует, а сначала «думает» над запросом: промежуточный шаг рассуждения перед генерацией улучшил точность текста на картинке и следование сложным инструкциям. 8 сентября модель обновилась до gpt-image-2.5 сразу в двух вариантах: Flare — для продакшена, где важна скорость, и Sunburst — для точного редактирования и финального качества. По данным независимого рейтинга предпочтений Text-to-Image Arena на конец сентября 2026 года, gpt-image-2.5 Sunburst занимает первое место с рейтингом 1424 балла, Flare — второе с 1401, а предыдущая gpt-image-2 — третье с 1383 баллами: OpenAI держит весь пьедестал. Цены в API считаются по токенам: у gpt-image-2.5 — 8 долларов за 1 млн токенов изображения на входе и 30 долларов на выходе.

Google ставит не на рейтinг, а на охват

Google пошла другим путём. 26 февраля 2026 года компания выпустила Nano Banana 2 — технически Gemini 3.1 Flash Image — и в тот же день сделала её генератором изображений по умолчанию в Gemini, Google Поиске, видеоплатформе Flow и рекламном кабинете Ads сразу в 141 стране — по собственному заявлению Google, это самый широкий единовременный запуск модели генерации изображений в истории компании. Модель рисует от 512 пикселей до полного 4K, держит узнаваемость до пяти персонажей в серии правок и доступна через Gemini API и Vertex AI. Все изображения помечаются видимым водяным знаком и невидимой меткой SynthID. Но в том же рейтинге предпочтений, где OpenAI забрала весь пьедестал, Gemini 3.1 Flash Image — только на девятом месте с 1261 баллом: модель, которую видят сотни миллионов людей каждый день, пользователи в прямом сравнении предпочитают реже, чем решения OpenAI.

1424gpt-image-2.5 Sunburst (OpenAI) — 1-е место в Text-to-Image Arena
1261Gemini 3.1 Flash Image (Google) — только 9-е место там же
141страна, где Nano Banana 2 стала генератором по умолчанию

Открытые веса и свои движки — отдельная лига

Black Forest Labs идёт третьим путём: не гонится за первым местом в рейтинге пользовательских предпочтений, а предлагает одну архитектуру FLUX.2 сразу и для генерации, и для редактирования — до 4 мегапикселей с опорой на 10 референсных изображений одновременно, с ценой по мегапикселям: от 3 центов за мегапиксель у версии pro. Модель klein с 4 млрд параметров распространяется по открытой лицензии Apache 2.0 — её можно развернуть у себя бесплатно; старшая dev на 32 млрд требует платной лицензии для деплоя. В том же рейтинге предпочтений Flux-2-max — только на 27-м месте с 1162 баллами: открытость и гибкость лицензии здесь важнее позиции в топе.

xAI выбрала третий вариант — не опираться на чужую диффузионную модель (раньше Grok использовал Flux от Black Forest Labs), а построить собственный движок Aurora — авторегрессивный трансформер с архитектурой mixture-of-experts. Grok Imagine Image 2.0, выпущенный 7 августа 2026 года, занял шестое место в том же рейтинге с 1301 баллом — и, по собственным данным xAI на дату релиза, второе место по скорости генерации среди всех моделей гонки.

Midjourney осталась вне гонки API

Midjourney принципиально не участвует в этой гонке бенчмарков: нет публичного API, модель доступна только через Discord и веб-интерфейс, а платят здесь не за токены или мегапиксели, а за часы GPU-времени — от 10 долларов в месяц за 3,3 часа на тарифе Basic до 120 долларов за 60 часов на тарифе Mega. Это осознанный выбор ниши: Midjourney остаётся инструментом для художников и дизайнеров, которым нужен конкретный визуальный стиль, а не платформой для встраивания генерации в чужой продукт.

Что реально доступно из России

У всей гонки выше есть практический потолок для российского пользователя: прямая оплата API OpenAI, платных тарифов Google, Midjourney и Grok требует иностранной карты и часто — иностранного юрлица для доступа к API. Рабочая альтернатива внутри страны — не отдельный сервис, а то, что уже встроено в существующие продукты. GigaChat от Сбера с 27 апреля 2026 года включает Kandinsky 6.0 Image — флагманскую модель с функциями профессионального редактирования (реставрация фото, смена фона и одежды, серии кадров с сохранением персонажа), доступную бесплатно и без ограничений на число генераций прямо в вебе, мобильном приложении и мессенджерах. У Яндекса похожая логика: модель YandexART 2.5 работает внутри приложения «Шедеврум», а не как отдельный продукт — часть функций бесплатна, за расширенные возможности нужна платная подписка Шедеврум Pro.

Что это значит на практике

Для тех, кто выбирает модель по чистому качеству и может работать через иностранную инфраструктуру, практический ориентир — gpt-image-2.5 Sunburst: первое место в независимом рейтинге предпочтений и точное редактирование с сохранением деталей. Для продакшена с высоким объёмом запросов и жёстким бюджетом на токены разумнее Flare — та же модель OpenAI, но быстрее и дешевле. Для тех, кому нужна гибкость открытой лицензии и свой контур без оплаты за каждый запрос, — FLUX.2 klein. А для бизнеса и частных пользователей в России, которым нужно решение здесь и сейчас без обхода ограничений, — Kandinsky 6.0 Image внутри GigaChat: бесплатно, без лимитов и без иностранной карты, пусть и без претензии на первое место в мировом рейтинге.

Источник: OpenAI, Google, Black Forest Labs, xAI, Сбер, Яндекс

Упомянутые инструменты

Не пропускать важное

Заведите кабинет: добавьте нейросети, которыми пользуетесь, — и получайте только то, что касается именно их. Цены, тарифы, доступность из России, письмо перед списанием. Бесплатно.

Создать кабинет Войти

Читать дальше

Разборы 24 сентября 2026 Кто ведёт гонку голосовых ИИ-агентов в реальном времени — и что из неё доступно из России Голосовые модели перестали быть чат-ботом с синтезом речи поверх текста: OpenAI и Google выпустили модели, которые слушают и говорят одним потоком без… Разборы 17 сентября 2026 Агенты ИИ делают втрое больше работы, чем люди, — и, по данным Anthropic, столько же атакуют OpenAI впервые раскрыла внутреннюю статистику: агенты уже делают в 3,1 раза больше работы, чем люди-исследователи компании. В том же отчёте — признание,… Разборы 8 сентября 2026 Цены флагманов сравнялись до цента — но счёт всё равно выходит разный За первую неделю сентября OpenAI и Anthropic с разницей в два дня открыли новый верхний ярус рынка — $10 за миллион входных… Разборы 20 августа 2026 Кто ведёт рынок ИИ-генерации видео в 2026 году — и почему Sora выбыла из гонки OpenAI полностью закрывает Sora — и веб-версию, и API, — оставляя нишу генерации видео другим вендорам. Разбираем, кто сейчас реально ведёт рынок…