Tech Meridian ← К СУЩНОСТЯМ
EN

МОДЕЛЬ · ENTITY #3692

Qwen 14B

Хронология связанных событий, источники и контекст из новостной базы.

ХРОНОЛОГИЯ СОБЫТИЙ

1

RESEARCH · 1 ИСТОЧН. · arXiv cs.AI

OBC-Prune: калибровка по результату улучшает прайнинг моделей рассуждения (arXiv:2609.17890v1)

В статье предложен OBC-Prune — метод калибровки прайнинга для крупных моделей рассуждения, который формирует пары сложность-совпадение корректных/ошибочных разверток и через интервенционный анализ оценивает причинную значимость предложений рассуждения. Полученные веса на уровне токенов масштабируют калибровочные активации для методов одношагового прайнинга (SparseGPT, Wanda, ALPS); на моделях DeepSeek-R1-Distill-Qwen 1.5B/7B/14B при 40% и 50% разреженности авторы сообщают стабильные улучшения по MATH500, LiveCodeBench и AIME 2025 по сравнению с базовыми калибровками.

7.0