Tech Meridian ← К ЛЕНТЕ
EN

НОВОСТЬ · MODELS · #504

DeepSeek выпустила открытый превью DeepSeek‑V4 с контекстом на 1 млн токенов

DeepSeek опубликовала открытое превью DeepSeek‑V4 с двумя вариантами: DeepSeek‑V4‑Pro (1,6T общих / 49B активных параметров) и DeepSeek‑V4‑Flash (284B общих / 13B активных параметров). Компания заявляет, что обе модели по умолчанию поддерживают контекст на 1 млн токенов, используют токенно‑ориентированную компрессию и DSA (DeepSeek Sparse Attention), претендуют на SOTA в агентных и рассуждательных задачах (по утверждению компании уступают только Gemini‑3.1‑Pro), доступны на chat.deepseek.com и через обновлённые API с поддержкой OpenAI ChatCompletions и Anthropic; старые модели deepseek-chat и deepseek-reasoner будут удалены 24 июля 2026 года в 15:59 UTC.

КЛЮЧЕВЫЕ ТЕЗИСЫ

  1. DeepSeek опубликовала открытое превью DeepSeek‑V4 с двумя вариантами: DeepSeek‑V4‑Pro (1,6T общих / 49B активных параметров) и DeepSeek‑V4‑Flash (284B общих / 13B активных параметров).
  2. Компания заявляет, что обе модели по умолчанию поддерживают контекст на 1 млн токенов, используют токенно‑ориентированную компрессию и DSA (DeepSeek Sparse Attention), претендуют на SOTA в агентных и рассуждательных задачах (по утверждению компании уступают только Gemini‑3.1‑Pro), доступны на chat.deepseek.com и через обновлённые API с поддержкой OpenAI ChatCompletions и Anthropic; старые модели deepseek-chat и deepseek-reasoner будут удалены 24 июля 2026 года в 15:59 UTC.
  3. Если утверждения верны, открытая модель с контекстом на 1 млн токенов и заявленными Pro‑уровнем рассуждений/агентных возможностей может существенно изменить длинно‑контекстные применения и снизить издержки для разработчиков.

ПОЧЕМУ ЭТО ВАЖНО

Если утверждения верны, открытая модель с контекстом на 1 млн токенов и заявленными Pro‑уровнем рассуждений/агентных возможностей может существенно изменить длинно‑контекстные применения и снизить издержки для разработчиков.

ИСТОЧНИКИ И ХРОНОЛОГИЯ

1