Tech Meridian ← К ЛЕНТЕ
EN

РЕЛИЗ · MODELS · #582

PrismML выпустила Bonsai 2 27B — Qwen3.8 27B сжат в 9–10× (5,9 ГБ)

PrismML выпустила Bonsai 2 27B — сжатую версию открытой модели Qwen3.8 27B от Alibaba, уменьшенную примерно до 5,9 ГБ (снижение памяти в 9–10×) и показывающую около 98% от агрегированных бенчмарков Qwen. Стартап, основанный с участием исследователей Caltech, использует технику «тернарных» весов для сжатия, заявляет о минимальной потере качества по сравнению с оригиналом, ранее зафиксировал миллионы загрузок ранних релизов и планирует применить подход к гораздо большим моделям; компания привлекла сид-раунд на $22,25M при участии Khosla Ventures и Cerberus Capital.

КЛЮЧЕВЫЕ ТЕЗИСЫ

  1. PrismML выпустила Bonsai 2 27B — сжатую версию открытой модели Qwen3.8 27B от Alibaba, уменьшенную примерно до 5,9 ГБ (снижение памяти в 9–10×) и показывающую около 98% от агрегированных бенчмарков Qwen.
  2. Стартап, основанный с участием исследователей Caltech, использует технику «тернарных» весов для сжатия, заявляет о минимальной потере качества по сравнению с оригиналом, ранее зафиксировал миллионы загрузок ранних релизов и планирует применить подход к гораздо большим моделям; компания привлекла сид-раунд на $22,25M при участии Khosla Ventures и Cerberus Capital.
  3. Небольшие LLM с близкой к исходной производительностью, запускающиеся на ПК и смартфонах, могут изменить баланс развёртывания, стоимости, задержки и приватности для многих AI-приложений.

ПОЧЕМУ ЭТО ВАЖНО

Небольшие LLM с близкой к исходной производительностью, запускающиеся на ПК и смартфонах, могут изменить баланс развёртывания, стоимости, задержки и приватности для многих AI-приложений.

ИСТОЧНИКИ И ХРОНОЛОГИЯ

1