НОВОСТЬ · MODELS · #504
DeepSeek выпустила открытый превью DeepSeek‑V4 с контекстом на 1 млн токенов
DeepSeek опубликовала открытое превью DeepSeek‑V4 с двумя вариантами: DeepSeek‑V4‑Pro (1,6T общих / 49B активных параметров) и DeepSeek‑V4‑Flash (284B общих / 13B активных параметров). Компания заявляет, что обе модели по умолчанию поддерживают контекст на 1 млн токенов, используют токенно‑ориентированную компрессию и DSA (DeepSeek Sparse Attention), претендуют на SOTA в агентных и рассуждательных задачах (по утверждению компании уступают только Gemini‑3.1‑Pro), доступны на chat.deepseek.com и через обновлённые API с поддержкой OpenAI ChatCompletions и Anthropic; старые модели deepseek-chat и deepseek-reasoner будут удалены 24 июля 2026 года в 15:59 UTC.
КЛЮЧЕВЫЕ ТЕЗИСЫ
- DeepSeek опубликовала открытое превью DeepSeek‑V4 с двумя вариантами: DeepSeek‑V4‑Pro (1,6T общих / 49B активных параметров) и DeepSeek‑V4‑Flash (284B общих / 13B активных параметров).
- Компания заявляет, что обе модели по умолчанию поддерживают контекст на 1 млн токенов, используют токенно‑ориентированную компрессию и DSA (DeepSeek Sparse Attention), претендуют на SOTA в агентных и рассуждательных задачах (по утверждению компании уступают только Gemini‑3.1‑Pro), доступны на chat.deepseek.com и через обновлённые API с поддержкой OpenAI ChatCompletions и Anthropic; старые модели deepseek-chat и deepseek-reasoner будут удалены 24 июля 2026 года в 15:59 UTC.
- Если утверждения верны, открытая модель с контекстом на 1 млн токенов и заявленными Pro‑уровнем рассуждений/агентных возможностей может существенно изменить длинно‑контекстные применения и снизить издержки для разработчиков.
ПОЧЕМУ ЭТО ВАЖНО
Если утверждения верны, открытая модель с контекстом на 1 млн токенов и заявленными Pro‑уровнем рассуждений/агентных возможностей может существенно изменить длинно‑контекстные применения и снизить издержки для разработчиков.