DeepSeek выпустил V4.1-Flash с кешем в 890 байт на токен
DeepSeek AI запустила DeepSeek-V4.1-Flash — мультимодальную модель Mixture-of-Experts с 552 млрд параметров в основе и поддержкой контекста в 1 млн токенов. Главное отличие: глобальный KV-кеш занимает 890 байт на токен — в четыре раза меньше, чем у V4-Flash, и в 437 раз меньше, чем у V1. Модель активирует 8 млрд параметров при обработке входа и 16 млрд при генерации ответа.
DeepSeek выложила веса под лицензией MIT с поддержкой vLLM, SGLang и Transformers, а также запустила публичный API с тремя уровнями рассуждений. Архитектура с разделённым энкодером-декодером сокращает вычисления при обработке промптов почти вдвое.
Источник: источник
Что мы знаем о компании
DeepSeek
- 🐳 DeepSeek выпустила самую дешевую модель 2026-09-10
- Вокруг выпуска DeepSeek v4.1 Flash сегодня развиваются два сюжета: 2026-09-10
- Расчехляем Deepseek 4.1 Flash : 2026-09-10
- Какой смысл бизнесу платить втридорога за тот же самый Qwen, DeepSeek или GLM, но с "переклееным шильдиком"? 2026-09-10
- Apple провела презентацию 2026-09-10
- Bending Spoons купила Miro за $1,355 млрд 2026-09-10
- Bending Spoons купила Miro за $1,36 млрд — в 10 раз дешевле пика 2026-09-10
- DeepSeek привлекла $71 млрд в новом раунде финансирования 2026-09-10
Новости этого рынка выходят у нас в телеграме первыми — @wikicompass.