Выпуск новостей завершён 15 сентября 2026. Материалы сохранены на дату публикации. Перейти к инструкциям →

Архив · Полный материал · Tproger

DeepSeek выпустила мультимодальную модель V4.1-Flash и начала замену V4-Pro

DeepSeek запустила V4.1-Flash в API и выводит из эксплуатации прежние модели. С 14 сентября запросы к V4-Pro перенаправят на новинку. — Читать дальше « DeepSeek выпустила мультимодальную модель V4.1-Flash и начала замену V4-Pro »

Разработка · TprogerАнна Летова, Tproger1 минута
Перейти к тексту ↓
DeepSeek выпустила мультимодальную модель V4.1-Flash и начала замену V4-Pro
Tproger
Коротко о главномРазвернутьСвернуть
  1. 10 сентября 2026 года DeepSeek представила V4.
  2. 1-Flash на новой асимметричной архитектуре Causal Encoder–Decoder.
  3. Это MoE-модель на 552 млрд параметров, у которой при обработке входных данных активно 8 млрд параметров, а при генерации ответа — 16 млрд.

10 сентября 2026 года DeepSeek представила V4.1-Flash на новой асимметричной архитектуре Causal Encoder–Decoder. Это MoE-модель на 552 млрд параметров, у которой при обработке входных данных активно 8 млрд параметров, а при генерации ответа — 16 млрд. Модель поддерживает изображения без отдельной экспериментальной версии и доступна в API под идентификатором deepseek-flash.

По заявлению DeepSeek, модель превосходит V4-Pro по производительности, стоимости, скорости и общему времени выполнения задач. Компания ссылается на тесты нескольких сторон, но в анонсе не приводит их список и методику, поэтому независимо оценить сравнение по опубликованному тексту нельзя.

Разработчикам потребуется проверить используемые идентификаторы моделей. V4-Flash и V4-Flash-Vision-Exp выведены из эксплуатации, а их прежние API-имена пока перенаправляются на V4.1-Flash. С 04:00 UTC 14 сентября такой же временный маршрут включат для deepseek-v4-pro, он сохранится до выхода V4.1-Pro.

Компания также заявляет о сокращении KV-кэша относительно прошлого поколения: ему требуется четверть прежнего объёма HBM и одна восьмая объёма SSD. DeepSeek снизила тарифы API с 10 сентября, однако конкретные суммы в анонсе не указаны. Вне пиковых часов действует скидка 50%. Лимиты API и условия доступности сервиса из России источник не уточняет.

Источники