Разборы

Цены флагманов сравнялись до цента — но счёт всё равно выходит разный

За первую неделю сентября OpenAI и Anthropic с разницей в два дня открыли новый верхний ярус рынка — $10 за миллион входных токенов и $50 за выходные. Цифры совпали до цента, но реальный счёт за одну и ту же работу различается втрое. Разбираем, откуда берётся разница и почему Google в этот ярус не пошёл.

Дэми Авалонов основатель NeiroAI 4 мин чтения
Цены флагманов сравнялись до цента — но счёт всё равно выходит разный

1 сентября Anthropic выпустила Claude Fable 5.1. 3 сентября OpenAI начала раскатку GPT-6 Astra. У обеих моделей одинаковая цена: $10 за миллион входных токенов и $50 за миллион выходных. Такого совпадения на этом рынке ещё не было — и оно не случайное: оба вендора одновременно решили, что верхний ярус стоит именно столько.

Но одинаковая цена токена не означает одинаковый счёт в конце месяца. На реальной агентной нагрузке разница между этими двумя моделями доходит до трёх раз — и она спрятана не в цене токена, а в том, как каждый вендор считает контекст.

Появился ярус, которого не было

До сентября верхняя планка рынка держалась около $5 за миллион входных токенов. Claude Opus 5 стоил $5 и $25, флагман ChatGPT — GPT-5.6 Sol — $4 и $20, причём за август он ещё и подешевел с прежних $5 и $30.

Теперь оба вендора надстроили сверху новый этаж вдвое дороже, а прежние флагманы никуда не делись — они просто стали средним классом. То есть выбор не «старая модель или новая по той же цене», а «доплатить вдвое за верхний ярус или остаться на прежнем». Для большинства задач второе по-прежнему разумно: Fable 5.1 и Astra оправданы там, где модель работает подолгу и сама, а не отвечает на разовый вопрос.

$10 / $50новый верхний ярус: одинаково у Claude Fable 5.1 и GPT-6 Astra
×4разница в цене кэш-чтения: $0,25 у Anthropic против $1,00 у OpenAI

Где прячется разница в счёте

В агентных сценариях основную часть счёта составляет не свежий текст запроса, а повторное чтение уже обработанного контекста — модель раз за разом перечитывает один и тот же проект, документ или историю диалога. Именно на этой строке вендоры разошлись.

Anthropic сделала кэш-чтение у Fable 5.1 стоящим 2,5% от цены входа — $0,25 за миллион токенов. У остальных моделей линейки, как и у большинства на рынке, это 10%. OpenAI осталась на стандартных 10%: кэш-чтение у Astra стоит $1,00, вчетверо дороже.

Вторая строка — длинный контекст. У Astra запрос длиннее 272 тысяч токенов тарифицируется с наценкой: вдвое по входу и кэшу, в полтора раза по выходу. Anthropic наценки не берёт вовсе — весь миллион токенов идёт по стандартной цене, и запрос на 900 тысяч токенов стоит столько же за токен, сколько запрос на девять тысяч.

Сложим это на конкретном примере. Агент работает с контекстом 500 тысяч токенов, из которых 450 тысяч приходят из кэша, а 50 тысяч — свежие. У Astra контекст превышает порог 272K, поэтому включается двойная наценка: кэш обходится в $0,90, свежий вход — в $1,00, итого $1,90 за запрос. У Fable 5.1 наценки нет: кэш стоит $0,11, вход $0,50, итого около $0,61. Разница — более чем втрое, при абсолютно одинаковой цене токена в прайсе.

Google в этот ярус не пошёл

Третий крупный вендор повёл себя иначе. Флагман Gemini 3.1 Pro стоит $2 за миллион входных токенов и $12 за выходные — впятеро дешевле нового верхнего яруса по входу. Самая дорогая позиция всего прайса Google, Gemini 3.8 Flash, обходится в $2,25 и $18. Модели за $10 у Google нет вообще.

Это не отставание, а другая ставка: Google держит линейку в диапазоне, где цена не мешает гонять модель на потоке, и зарабатывает объёмом внутри собственной экосистемы — Поиска, Workspace, облака. Наценка за длинный контекст у него, впрочем, тоже есть, и порог ниже: удвоение уже после 200 тысяч токенов.

Что это значит для тех, кто выбирает

Первое: сравнивать модели по цене за токен больше нельзя — это перестало быть показательной цифрой. Считать нужно по своему профилю нагрузки. Если сценарий — короткие разовые запросы, разница между вендорами почти не проявится. Если агент подолгу работает с большим общим контекстом, решают кэш и порог наценки, а не цена входа.

Второе: прежние флагманы стали выгоднее, чем были. Opus 5 за $5 и $25 и Sol за $4 и $20 никуда не исчезли и остаются разумным выбором для большинства задач — новый ярус нужен там, где модель ведёт многошаговую работу сама.

Третье: у верхнего яруса появились ограничения, которых не было у прежних флагманов. Astra — первая модель OpenAI, по которой компания не смогла исключить «критический» уровень киберспособностей: продвинутые возможности в этой области выдают только участникам закрытой программы, а массовая версия часть запросов по теме отклоняет. У Anthropic аналогичное ограничение вынесено в отдельную модель Mythos 5.1 с доступом по заявке.

Доступ из России

Ни один из двух новых флагманов официально из России не работает: Россия не входит в списки поддерживаемых территорий ни у OpenAI, ни у Anthropic, российской картой подписку и API не оплатить. Google формально мягче — прайс Gemini доступен для изучения, — но оплата так же идёт через зарубежный биллинг. Практический вывод для российской команды не изменился: работа с любым из трёх вендоров упирается в вопрос платёжного посредника раньше, чем в вопрос цены за токен.

Источник: Anthropic, OpenAI, Google

Упомянутые инструменты

Не пропускать важное

Заведите кабинет: добавьте нейросети, которыми пользуетесь, — и получайте только то, что касается именно их. Цены, тарифы, доступность из России, письмо перед списанием. Бесплатно.

Создать кабинет Войти

Читать дальше

Разборы 17 сентября 2026 Агенты ИИ делают втрое больше работы, чем люди, — и, по данным Anthropic, столько же атакуют OpenAI впервые раскрыла внутреннюю статистику: агенты уже делают в 3,1 раза больше работы, чем люди-исследователи компании. В том же отчёте — признание,… Разборы 20 августа 2026 Кто ведёт рынок ИИ-генерации видео в 2026 году — и почему Sora выбыла из гонки OpenAI полностью закрывает Sora — и веб-версию, и API, — оставляя нишу генерации видео другим вендорам. Разбираем, кто сейчас реально ведёт рынок… Разборы 14 августа 2026 Кто ведёт рынок ИИ-ассистентов для кода в 2026 году — и что из него доступно из России Рынок ИИ-помощников для разработчиков за полтора года прошёл путь от автодополнения строки до агентов, которые сами открывают задачу, пишут код и собирают… Разборы 8 августа 2026 Открытые модели догнали закрытые: что это меняет для тех, кто работает из России За одну неделю в открытый доступ ушли видеомодель со звуком и модель прогноза погоды уровня Nature. Разбираем, почему это важнее очередного релиза…