Tech Meridian ← К СУЩНОСТЯМ
EN

МОДЕЛЬ · ENTITY #3484

DeepSeek-V4-Flash

Хронология связанных событий, источники и контекст из новостной базы.

ХРОНОЛОГИЯ СОБЫТИЙ

3

RESEARCH · 1 ИСТОЧН. · arXiv cs.AI

little m: ИИ-агент для формулирования моделей оптимизации промышленных процессов

Опубликована работа о 'little m' — ИИ-агенте, который сочетает специализированное хранилище знаний и взаимодействие на базе LLM для перевода разнородных промышленных спецификаций (текст и диаграммы процессов) в математические модели оптимизации. Авторы также представили IPC-Bench — набор из 50 мультимодальных сценариев для управления промышленными процессами; автоматические структурные проверки и слепая человеческая оценка показывают, что little m генерирует значительно более семантически корректные формулировки по сравнению с современными LLM, при этом работа не включает оценку применимости к решателям, физической корректности или замкнутой производственной производительности.

6.0

MODELS · 1 ИСТОЧН. · DeepSeek

DeepSeek представляет DeepSeek‑V4.1‑Flash с новой причинно‑кодировочной архитектурой и снижением стоимости

DeepSeek объявила DeepSeek‑V4.1‑Flash — меньшую модель с нативным пониманием изображений на новой Causal Encoder–Decoder архитектуре (8B активных параметров для входа, 16B для выхода), обновлённой предобучением и более крупным RL‑посттренингом, а также компрессией KV‑кеша. Компания выводит из эксплуатации варианты V4‑Flash, перенаправит запросы deepseek-v4-pro на V4.1‑Flash с 04:00 UTC 14 сентября 2026 года и вводит новые тарифы с 04:00 UTC 10 сентября 2026 года; партнёры WorkBuddy, CodeBuddy и OpenCode уже поддерживают модель.

8.0

MODELS · 1 ИСТОЧН. · DeepSeek

DeepSeek выпустила открытый превью DeepSeek‑V4 с контекстом на 1 млн токенов

DeepSeek опубликовала открытое превью DeepSeek‑V4 с двумя вариантами: DeepSeek‑V4‑Pro (1,6T общих / 49B активных параметров) и DeepSeek‑V4‑Flash (284B общих / 13B активных параметров). Компания заявляет, что обе модели по умолчанию поддерживают контекст на 1 млн токенов, используют токенно‑ориентированную компрессию и DSA (DeepSeek Sparse Attention), претендуют на SOTA в агентных и рассуждательных задачах (по утверждению компании уступают только Gemini‑3.1‑Pro), доступны на chat.deepseek.com и через обновлённые API с поддержкой OpenAI ChatCompletions и Anthropic; старые модели deepseek-chat и deepseek-reasoner будут удалены 24 июля 2026 года в 15:59 UTC.

8.0