DeepSeek выпустила V4.1-Flash: MIT-лицензия и цены API вдвое ниже ночью
DeepSeek выпустила DeepSeek-V4.1-Flash — модель с открытыми весами под MIT, новой архитектурой Causal Encoder-Decoder и заметно более дешёвым API: с 10 сентября 2026 года ночные тарифы ровно вдвое ниже дневных.
DeepSeek выпустила DeepSeek-V4.1-Flash — новую модель линейки Flash с открытыми весами под лицензией MIT и заметно более дешёвым доступом через API. Модель уже доступна на Hugging Face и заменяет прежнюю DeepSeek-V4-Flash в облачном API компании.
Что изменилось в архитектуре
V4.1-Flash построена на архитектуре Causal Encoder-Decoder (CED) — 40 слоёв, разбитых на 20-слойный кодировщик и 20-слойный декодировщик, поверх MoE (Mixture-of-Experts). Модель нативно принимает изображения на входе через собственный визуальный энкодер DeepSeek-ViT и держит контекст до 1 млн токенов при выдаче до 384 тыс. токенов за ответ. Благодаря сжатию KV-кэша (техники CSA2 и FP4-кэширование) сам кэш стал примерно в 4 раза компактнее, чем у предыдущего поколения — это снижает стоимость обработки длинных контекстов и ускоряет инференс.
Цены API — и разница день/ночь
Новые тарифы вступили в силу 10 сентября 2026 года в 04:00 UTC. Для deepseek-flash (это и есть V4.1-Flash): входные токены при попадании в кэш — $0,003 за 1 млн вне пиковых часов и $0,006 в пик; токены без попадания в кэш — $0,15 / $0,30; исходящие токены — $0,60 / $1,20 за 1 млн. Для сравнения, старшая модель линейки, DeepSeek-V4-Pro (без поддержки изображений), стоит $0,66–$1,32 за входные токены без кэша и $1,98–$3,96 за исходящие — в 3–4 раза дороже нового Flash на сопоставимых тарифах.
Официальное объявление отдельно подчёркивает разницу пиковых и внепиковых часов: ночной тариф ровно вдвое ниже дневного, поэтому есть прямой смысл переносить фоновые и пакетные задачи (индексацию, батч-обработку) на офф-пик — это чистая экономия без потери качества ответов.
Что это значит на практике
MIT-лицензия и открытые веса — реальная бесплатная альтернатива подписке: модель можно развернуть у себя, не платя за облачный API вообще, если хватает железа под 552 млрд параметров (пусть и с 8–16 млрд активных). Для тех, кто работает через API, а не разворачивает модель сам, новая цена делает Flash-линейку одной из самых дешёвых среди топовых моделей с поддержкой изображений и контекстом в 1 млн токенов — заметно дешевле сопоставимых тарифов OpenAI, Anthropic и Google. Подробнее о сервисе — в карточке DeepSeek в каталоге NeiroAI.
Источник: DeepSeek
Упомянутые инструменты
Не пропускать важное
Заведите кабинет: добавьте нейросети, которыми пользуетесь, — и получайте только то, что касается именно их. Цены, тарифы, доступность из России, письмо перед списанием. Бесплатно.



