2026-09-10 · DeepSeek · ИТ и разработка

DeepSeek выпустил V4.1-Flash с кешем в 890 байт на токен

DeepSeek выпустил V4.1-Flash с кешем в 890 байт на токен

DeepSeek AI запустила DeepSeek-V4.1-Flash — мультимодальную модель Mixture-of-Experts с 552 млрд параметров в основе и поддержкой контекста в 1 млн токенов. Главное отличие: глобальный KV-кеш занимает 890 байт на токен — в четыре раза меньше, чем у V4-Flash, и в 437 раз меньше, чем у V1. Модель активирует 8 млрд параметров при обработке входа и 16 млрд при генерации ответа.

DeepSeek выложила веса под лицензией MIT с поддержкой vLLM, SGLang и Transformers, а также запустила публичный API с тремя уровнями рассуждений. Архитектура с разделённым энкодером-декодером сокращает вычисления при обработке промптов почти вдвое.

Источник: источник

Что мы знаем о компании DeepSeek

Новости этого рынка выходят у нас в телеграме первыми — @adposium_ai.

Все новости