Китайская компания DeepSeek представила новую модель искусственного интеллекта V4.1 Flash с значительно более низкими тарифами на API, чем у конкурентов. Разработчики утверждают, что новинка превосходит предыдущую версию V4-Pro по ряду задач, сообщает Bloomberg.
Ставка на более дешевый ИИ
DeepSeek позиционирует V4.1 Flash как модель, сочетающую в себе более высокую скорость, более низкую стоимость и более эффективную архитектуру. По данным компании, она превосходит Kimi K3 от Moonshot и при этом остается дешевле решений конкурентов.
«V4.1-Flash позволяет нам обслуживать больше пользователей с меньшими затратами. Мы передаем эту экономию вам», — заявили в компании.
Чем отличается новая архитектура
Как сообщили разработчики, модель построена на архитектуре «каузального кодера-декодера» (causal encoder-decoder) и использует подход MoE («смесь экспертов»). В целом она имеет 552 миллиарда параметров, но при обработке запросов активирует только 8 миллиардов параметров для входных данных и 16 миллиардов — для выходных.
По данным DeepSeek, это позволило сократить потребление памяти: кэш KV требует лишь четверть объема HBM-памяти и восьмую часть SSD-хранилища по сравнению с предыдущим поколением. Поскольку затраты на кэширование составляют значительную часть стоимости работы ИИ-агентов, такое решение заметно снижает общую стоимость использования модели.
Компания также заявляет, что новые методы предварительного обучения и масштабное дообучение с подкреплением помогли V4.1 Flash превзойти V4-Pro в программировании и агентских задачах, хотя она по-прежнему уступает флагманским моделям американских компаний Anthropic и OpenAI.
DeepSeek отказывается от V4-Pro
С 14 сентября DeepSeek прекращает поддержку V4-Pro. Все запросы к модели deepseek-v4-pro будут автоматически перенаправляться на V4.1 Flash с более низкими тарифами до тех пор, пока не выйдет V4.1 Pro.
Одновременно компания прекратила поддержку моделей V4-Flash и V4-Flash-Vision-Exp. Запросы к ним временно также перенаправляются на новую версию.
Новинка поддерживает мультимодальность и уже доступна через API под названием deepseek-flash.
Ценовая война
DeepSeek ввела дифференцированную систему тарифов: в непиковые часы использование API обходится вдвое дешевле, чем в пиковые периоды. Такой подход должен более равномерно распределять нагрузку и позволяет разработчикам экономить при выполнении длительных агентских задач.
Аналитическая компания Artificial Analysis ранее назвала ситуацию на рынке «зоной смерти» DeepSeek. По её мнению, другие разработчики теперь вынуждены либо предлагать ещё более низкие цены, либо существенно превосходить китайские модели по функциональности.
OpenAI уже приступила к снижению тарифов на собственные модели на фоне обострения ценовой войны с Anthropic и усиления давления со стороны более дешёвых китайских разработок с открытыми весами. В частности, через три недели после презентации семейства GPT-5.6 компания снизила стоимость использования самой быстрой модели Luna примерно на 80%, а версий Terra — на 20%.


