РЕЛИЗ · MODELS · #582
PrismML выпустила Bonsai 2 27B — Qwen3.8 27B сжат в 9–10× (5,9 ГБ)
PrismML выпустила Bonsai 2 27B — сжатую версию открытой модели Qwen3.8 27B от Alibaba, уменьшенную примерно до 5,9 ГБ (снижение памяти в 9–10×) и показывающую около 98% от агрегированных бенчмарков Qwen. Стартап, основанный с участием исследователей Caltech, использует технику «тернарных» весов для сжатия, заявляет о минимальной потере качества по сравнению с оригиналом, ранее зафиксировал миллионы загрузок ранних релизов и планирует применить подход к гораздо большим моделям; компания привлекла сид-раунд на $22,25M при участии Khosla Ventures и Cerberus Capital.
КЛЮЧЕВЫЕ ТЕЗИСЫ
- PrismML выпустила Bonsai 2 27B — сжатую версию открытой модели Qwen3.8 27B от Alibaba, уменьшенную примерно до 5,9 ГБ (снижение памяти в 9–10×) и показывающую около 98% от агрегированных бенчмарков Qwen.
- Стартап, основанный с участием исследователей Caltech, использует технику «тернарных» весов для сжатия, заявляет о минимальной потере качества по сравнению с оригиналом, ранее зафиксировал миллионы загрузок ранних релизов и планирует применить подход к гораздо большим моделям; компания привлекла сид-раунд на $22,25M при участии Khosla Ventures и Cerberus Capital.
- Небольшие LLM с близкой к исходной производительностью, запускающиеся на ПК и смартфонах, могут изменить баланс развёртывания, стоимости, задержки и приватности для многих AI-приложений.
ПОЧЕМУ ЭТО ВАЖНО
Небольшие LLM с близкой к исходной производительностью, запускающиеся на ПК и смартфонах, могут изменить баланс развёртывания, стоимости, задержки и приватности для многих AI-приложений.