Китайская компания DeepSeek представила модель DeepSeek‑V4.1‑Flash с нативной мультимодальностью и объявила о поэтапном выводе версии V4‑Pro. В компании описывают новинку как разработанную для «расширения возможностей, ускорения вывода результатов, повышения пропускной способности и масштабирования до более крупных моделей». V4.1‑Flash названа самой компактной моделью в новом архитектурном семействе.
Что такое DeepSeek‑V4.1‑Flash
V4.1‑Flash — это нейросеть класса Mixture of Experts на 552 млрд параметров с архитектурой Causal Encoder‑Decoder. При этом в ходе инференса активными остаются 8 млрд параметров на входе и 16 млрд на выходе, что позволяет сочетать заявленную компактность и производительность. Нативная мультимодальность подразумевает работу модели с разными типами данных из коробки.
Переход к V4‑Pro
Параллельно DeepSeek запускает поэтапный вывод V4‑Pro. Детали дорожной карты и временные рамки не раскрываются, однако компания позиционирует линейку как ориентированную на масштабирование и повышение пропускной способности.
Курс на IPO в Шанхае
На фоне технологического релиза DeepSeek заявила о продвижении к IPO в Шанхае. Дополнительные параметры возможного размещения не уточняются.
