НОВОСТЬ · MODELS · #428
Mistral выпускает Small 4: 119B MoE мультимодальная модель с контекстом 256k (Apache 2.0)
Mistral объявила Mistral Small 4 — гибридную модель Mixture-of-Experts на 119 миллиардов параметров (128 экспертов, 4 активных), поддерживающую текст и изображения, с окном контекста 256k и настраиваемым параметром reasoning_effort; модель выпущена под лицензией Apache 2.0. Компания указывает, что Small 4 объединяет возможности Magistral, Pixtral и Devstral, нацелена на чаты, кодинг/агентов и сложное рассуждение, утверждает значительные улучшения задержки и пропускной способности по сравнению с Small 3 и доступна через vLLM, llama.cpp, SGLang, Transformers и другие среды.
КЛЮЧЕВЫЕ ТЕЗИСЫ
- Mistral объявила Mistral Small 4 — гибридную модель Mixture-of-Experts на 119 миллиардов параметров (128 экспертов, 4 активных), поддерживающую текст и изображения, с окном контекста 256k и настраиваемым параметром reasoning_effort; модель выпущена под лицензией Apache 2.0.
- Компания указывает, что Small 4 объединяет возможности Magistral, Pixtral и Devstral, нацелена на чаты, кодинг/агентов и сложное рассуждение, утверждает значительные улучшения задержки и пропускной способности по сравнению с Small 3 и доступна через vLLM, llama.cpp, SGLang, Transformers и другие среды.
- Это важно, потому что единая открытая MoE-модель с очень большим контекстом и настраиваемым режимом рассуждения может упростить развёртывания, снизить затраты на инференс и расширить доступ к мощным мультимодальным и рассуждающим моделям.
ПОЧЕМУ ЭТО ВАЖНО
Это важно, потому что единая открытая MoE-модель с очень большим контекстом и настраиваемым режимом рассуждения может упростить развёртывания, снизить затраты на инференс и расширить доступ к мощным мультимодальным и рассуждающим моделям.