
Коротко о главномРазвернутьСвернуть
- 10 сентября 2026 года DeepSeek представила V4.
- 1-Flash на новой асимметричной архитектуре Causal Encoder–Decoder.
- Это MoE-модель на 552 млрд параметров, у которой при обработке входных данных активно 8 млрд параметров, а при генерации ответа — 16 млрд.
10 сентября 2026 года DeepSeek представила V4.1-Flash на новой асимметричной архитектуре Causal Encoder–Decoder. Это MoE-модель на 552 млрд параметров, у которой при обработке входных данных активно 8 млрд параметров, а при генерации ответа — 16 млрд. Модель поддерживает изображения без отдельной экспериментальной версии и доступна в API под идентификатором deepseek-flash.
По заявлению DeepSeek, модель превосходит V4-Pro по производительности, стоимости, скорости и общему времени выполнения задач. Компания ссылается на тесты нескольких сторон, но в анонсе не приводит их список и методику, поэтому независимо оценить сравнение по опубликованному тексту нельзя.
Разработчикам потребуется проверить используемые идентификаторы моделей. V4-Flash и V4-Flash-Vision-Exp выведены из эксплуатации, а их прежние API-имена пока перенаправляются на V4.1-Flash. С 04:00 UTC 14 сентября такой же временный маршрут включат для deepseek-v4-pro, он сохранится до выхода V4.1-Pro.
Компания также заявляет о сокращении KV-кэша относительно прошлого поколения: ему требуется четверть прежнего объёма HBM и одна восьмая объёма SSD. DeepSeek снизила тарифы API с 10 сентября, однако конкретные суммы в анонсе не указаны. Вне пиковых часов действует скидка 50%. Лимиты API и условия доступности сервиса из России источник не уточняет.


