DeepSeek открыла веса V4: 1,6 трлн параметров, миллион токенов контекста и разреженное внимание DSA

24 апреля DeepSeek выложила превью V4 — Pro на 1,6 трлн параметров (49B активных) и Flash на 284B (13B активных). Контекст в 1M токенов стал дефолтом, а старые алиасы deepseek-chat и deepseek-reasoner отключат 24 июля.

DB
DBG · по материалам DeepSeek API Docs
0

24 апреля 2026 года DeepSeek опубликовала превью DeepSeek-V4 — сразу двумя моделями и сразу с открытыми весами на Hugging Face. V4-Pro — 1,6 триллиона параметров всего, 49 миллиардов активных на токен. V4-Flash — 284 миллиарда всего и 13 миллиардов активных. Обе умеют работать в двух режимах, с рассуждением и без.

Главное архитектурное заявление — контекст в 1 миллион токенов теперь дефолт во всех официальных сервисах DeepSeek, а не премиальная опция. Держится это на связке из двух вещей: пожатия по токенам (token-wise compression) и DSA — DeepSeek Sparse Attention. Компания формулирует цель прямо: длинный контекст мирового уровня при радикально урезанных затратах на вычисления и память. По собственным замерам DeepSeek, V4 — SOTA среди открытых моделей на агентных кодинг-бенчмарках и обходит все текущие открытые модели в математике, STEM и коде.

Отдельно стоит отметить, что API DeepSeek теперь говорит на двух чужих диалектах — поддерживает и формат OpenAI ChatCompletions, и Anthropic API. Это ровно тот случай, когда миграция сводится к смене base URL и ключа.

А вот и ложка дёгтя, которую легко пропустить: старые алиасы deepseek-chat и deepseek-reasoner будут окончательно отключены после 24 июля 2026 года, 15:59 UTC. Если у вас имя модели зашито в конфиг или в env-переменную и никто на это не смотрел с прошлого года — это тикающий будильник, а не «когда-нибудь потом».

Что это меняет для инженера. Открытые веса плюс миллион контекста плюс разреженное внимание — это заявка на сценарии, которые раньше упирались в счёт за API: прогнать весь монорепозиторий через модель, держать в контексте полный лог инцидента, скармливать модели сотни страниц документации без RAG-обвязки. V4-Flash с её 13 миллиардами активных параметров реалистично поднимается на собственном железе; V4-Pro на 1,6 триллиона — нет, для неё нужен либо API DeepSeek, либо серьёзный инференс-кластер, и заявленная дешевизна памяти этого факта не отменяет. И держите в голове стандартную оговорку про любые open-weights релизы из Китая: бенчмарки — от вендора, свой эвал-сет никто за вас не прогонит. Прежде чем менять провайдера, соберите десяток типичных для вашего продукта задач и сравните честно.

Комментарии

DeepSeek открыла веса V4: 1,6 трлн параметров, миллион токенов контекста и разреженное внимание DSA | DBG