Tech Meridian ← К ЛЕНТЕ
EN

РЕЛИЗ · MODELS · #505

DeepSeek представляет DeepSeek‑V4.1‑Flash с новой причинно‑кодировочной архитектурой и снижением стоимости

DeepSeek объявила DeepSeek‑V4.1‑Flash — меньшую модель с нативным пониманием изображений на новой Causal Encoder–Decoder архитектуре (8B активных параметров для входа, 16B для выхода), обновлённой предобучением и более крупным RL‑посттренингом, а также компрессией KV‑кеша. Компания выводит из эксплуатации варианты V4‑Flash, перенаправит запросы deepseek-v4-pro на V4.1‑Flash с 04:00 UTC 14 сентября 2026 года и вводит новые тарифы с 04:00 UTC 10 сентября 2026 года; партнёры WorkBuddy, CodeBuddy и OpenCode уже поддерживают модель.

КЛЮЧЕВЫЕ ТЕЗИСЫ

  1. DeepSeek объявила DeepSeek‑V4.1‑Flash — меньшую модель с нативным пониманием изображений на новой Causal Encoder–Decoder архитектуре (8B активных параметров для входа, 16B для выхода), обновлённой предобучением и более крупным RL‑посттренингом, а также компрессией KV‑кеша.
  2. Компания выводит из эксплуатации варианты V4‑Flash, перенаправит запросы deepseek-v4-pro на V4.1‑Flash с 04:00 UTC 14 сентября 2026 года и вводит новые тарифы с 04:00 UTC 10 сентября 2026 года; партнёры WorkBuddy, CodeBuddy и OpenCode уже поддерживают модель.
  3. Релиз обещает улучшенную производительность и заметное снижение стоимости инференса, одновременно меняя маршрутизацию и тарифы, что влияет на планы развертывания, расходы и совместимость пользователей и партнёров DeepSeek.

ПОЧЕМУ ЭТО ВАЖНО

Релиз обещает улучшенную производительность и заметное снижение стоимости инференса, одновременно меняя маршрутизацию и тарифы, что влияет на планы развертывания, расходы и совместимость пользователей и партнёров DeepSeek.

ИСТОЧНИКИ И ХРОНОЛОГИЯ

1