DeepSeek выпустил V4.1 Flash с контекстом в 1 млн токенов
DeepSeek запустил мультимодальную модель V4.1 Flash с поддержкой контекста до 1 миллиона токенов. По внутренним бенчмаркам модель превосходит более крупную DeepSeek V4 Pro и сравнима с Anthropic Opus 5. Архитектура оптимизирована для AI-агентов, работающих с большими объёмами данных: на входе активны 8 миллиардов параметров, на выходе — 16 миллиардов.
Это первая модель на новой архитектуре, которую планируют использовать для более крупных версий. Веса открыты на Hugging Face.
Источник: GPT/ChatGPT/AI Central Александра Горного
Что мы знаем о компании
DeepSeek
- финансовый директор
- DeepSeek
- Китайские агенты искусственного интеллекта (Alibaba, DeepSeek, Moonshot) способны лгать, скрывать ошибки и подделывать р 2026-09-30
- DeepSeek и Huawei выпустили в опенсорс набор инструментов для чипов Huawei Ascend как альтернативу CUDA от Nvidia. 2026-09-30
- DeepSeek выпустил Ascend-версии библиотек DeepGEMM, DeepEP и FlashMLA с API, совместимым с Nvidia-версиями. 2026-09-30
- Стек DeepSeek для Ascend работает на китайском языке TileLang, который компактнее CUDA. 2026-09-30
Новости этого рынка выходят у нас в телеграме первыми — @wikipulse.