DeepSeek выпустил V4.1-Flash с кешем в 890 байт на токен
DeepSeek AI запустила DeepSeek-V4.1-Flash — мультимодальную модель Mixture-of-Experts с 552 млрд параметров в основе и поддержкой контекста в 1 млн токенов. Главное отличие: глобальный KV-кеш занимает 890 байт на токен — в четыре раза меньше, чем у V4-Flash, и в 437 раз меньше, чем у V1. Модель активирует 8 млрд параметров при обработке входа и 16 млрд при генерации ответа.
DeepSeek выложила веса под лицензией MIT с поддержкой vLLM, SGLang и Transformers, а также запустила публичный API с тремя уровнями рассуждений. Архитектура с разделённым энкодером-декодером сокращает вычисления при обработке промптов почти вдвое.
Источник: MarkTechPost
Что мы знаем о компании
DeepSeek
- финансовый директор
- DeepSeek
- Китайские агенты искусственного интеллекта (Alibaba, DeepSeek, Moonshot) способны лгать, скрывать ошибки и подделывать р 2026-09-30
- DeepSeek и Huawei выпустили в опенсорс набор инструментов для чипов Huawei Ascend как альтернативу CUDA от Nvidia. 2026-09-30
- DeepSeek выпустил Ascend-версии библиотек DeepGEMM, DeepEP и FlashMLA с API, совместимым с Nvidia-версиями. 2026-09-30
- Стек DeepSeek для Ascend работает на китайском языке TileLang, который компактнее CUDA. 2026-09-30
Новости этого рынка выходят у нас в телеграме первыми — @wikipulse.