Цены флагманов сравнялись до цента — но счёт всё равно выходит разный
За первую неделю сентября OpenAI и Anthropic с разницей в два дня открыли новый верхний ярус рынка — $10 за миллион входных токенов и $50 за выходные. Цифры совпали до цента, но реальный счёт за одну и ту же работу различается втрое. Разбираем, откуда берётся разница и почему Google в этот ярус не пошёл.
1 сентября Anthropic выпустила Claude Fable 5.1. 3 сентября OpenAI начала раскатку GPT-6 Astra. У обеих моделей одинаковая цена: $10 за миллион входных токенов и $50 за миллион выходных. Такого совпадения на этом рынке ещё не было — и оно не случайное: оба вендора одновременно решили, что верхний ярус стоит именно столько.
Но одинаковая цена токена не означает одинаковый счёт в конце месяца. На реальной агентной нагрузке разница между этими двумя моделями доходит до трёх раз — и она спрятана не в цене токена, а в том, как каждый вендор считает контекст.
Появился ярус, которого не было
До сентября верхняя планка рынка держалась около $5 за миллион входных токенов. Claude Opus 5 стоил $5 и $25, флагман ChatGPT — GPT-5.6 Sol — $4 и $20, причём за август он ещё и подешевел с прежних $5 и $30.
Теперь оба вендора надстроили сверху новый этаж вдвое дороже, а прежние флагманы никуда не делись — они просто стали средним классом. То есть выбор не «старая модель или новая по той же цене», а «доплатить вдвое за верхний ярус или остаться на прежнем». Для большинства задач второе по-прежнему разумно: Fable 5.1 и Astra оправданы там, где модель работает подолгу и сама, а не отвечает на разовый вопрос.
Где прячется разница в счёте
В агентных сценариях основную часть счёта составляет не свежий текст запроса, а повторное чтение уже обработанного контекста — модель раз за разом перечитывает один и тот же проект, документ или историю диалога. Именно на этой строке вендоры разошлись.
Anthropic сделала кэш-чтение у Fable 5.1 стоящим 2,5% от цены входа — $0,25 за миллион токенов. У остальных моделей линейки, как и у большинства на рынке, это 10%. OpenAI осталась на стандартных 10%: кэш-чтение у Astra стоит $1,00, вчетверо дороже.
Вторая строка — длинный контекст. У Astra запрос длиннее 272 тысяч токенов тарифицируется с наценкой: вдвое по входу и кэшу, в полтора раза по выходу. Anthropic наценки не берёт вовсе — весь миллион токенов идёт по стандартной цене, и запрос на 900 тысяч токенов стоит столько же за токен, сколько запрос на девять тысяч.
Сложим это на конкретном примере. Агент работает с контекстом 500 тысяч токенов, из которых 450 тысяч приходят из кэша, а 50 тысяч — свежие. У Astra контекст превышает порог 272K, поэтому включается двойная наценка: кэш обходится в $0,90, свежий вход — в $1,00, итого $1,90 за запрос. У Fable 5.1 наценки нет: кэш стоит $0,11, вход $0,50, итого около $0,61. Разница — более чем втрое, при абсолютно одинаковой цене токена в прайсе.
Google в этот ярус не пошёл
Третий крупный вендор повёл себя иначе. Флагман Gemini 3.1 Pro стоит $2 за миллион входных токенов и $12 за выходные — впятеро дешевле нового верхнего яруса по входу. Самая дорогая позиция всего прайса Google, Gemini 3.8 Flash, обходится в $2,25 и $18. Модели за $10 у Google нет вообще.
Это не отставание, а другая ставка: Google держит линейку в диапазоне, где цена не мешает гонять модель на потоке, и зарабатывает объёмом внутри собственной экосистемы — Поиска, Workspace, облака. Наценка за длинный контекст у него, впрочем, тоже есть, и порог ниже: удвоение уже после 200 тысяч токенов.
Что это значит для тех, кто выбирает
Первое: сравнивать модели по цене за токен больше нельзя — это перестало быть показательной цифрой. Считать нужно по своему профилю нагрузки. Если сценарий — короткие разовые запросы, разница между вендорами почти не проявится. Если агент подолгу работает с большим общим контекстом, решают кэш и порог наценки, а не цена входа.
Второе: прежние флагманы стали выгоднее, чем были. Opus 5 за $5 и $25 и Sol за $4 и $20 никуда не исчезли и остаются разумным выбором для большинства задач — новый ярус нужен там, где модель ведёт многошаговую работу сама.
Третье: у верхнего яруса появились ограничения, которых не было у прежних флагманов. Astra — первая модель OpenAI, по которой компания не смогла исключить «критический» уровень киберспособностей: продвинутые возможности в этой области выдают только участникам закрытой программы, а массовая версия часть запросов по теме отклоняет. У Anthropic аналогичное ограничение вынесено в отдельную модель Mythos 5.1 с доступом по заявке.
Доступ из России
Ни один из двух новых флагманов официально из России не работает: Россия не входит в списки поддерживаемых территорий ни у OpenAI, ни у Anthropic, российской картой подписку и API не оплатить. Google формально мягче — прайс Gemini доступен для изучения, — но оплата так же идёт через зарубежный биллинг. Практический вывод для российской команды не изменился: работа с любым из трёх вендоров упирается в вопрос платёжного посредника раньше, чем в вопрос цены за токен.
Источник: Anthropic, OpenAI, Google
Упомянутые инструменты
Не пропускать важное
Заведите кабинет: добавьте нейросети, которыми пользуетесь, — и получайте только то, что касается именно их. Цены, тарифы, доступность из России, письмо перед списанием. Бесплатно.



