ИССЛЕДОВАНИЕ · RESEARCH · #1645
MOTIVE: рамка мульти-перспективной само-проверки для визуально-языковых моделей
Предпринт на arXiv (arXiv:2610.07018v1) представляет MOTIVE — рамку мульти-перспективной само-проверки, которая оценивает варианты ответов по нескольким дополняющим критериям и обучает показатель надежности, выровненный с корректностью, для принятия решения «принять или пересмотреть». Эксперименты на различных мультимодальных бенчмарках и с разными VLM показывают, что MOTIVE превосходит сильные базовые методы само-проверки и самокоррекции, снижая ненужные шаги рассуждения и повышая надежность ответов.
КЛЮЧЕВЫЕ ТЕЗИСЫ
- Предпринт на arXiv (arXiv:2610.07018v1) представляет MOTIVE — рамку мульти-перспективной само-проверки, которая оценивает варианты ответов по нескольким дополняющим критериям и обучает показатель надежности, выровненный с корректностью, для принятия решения «принять или пересмотреть».
- Эксперименты на различных мультимодальных бенчмарках и с разными VLM показывают, что MOTIVE превосходит сильные базовые методы само-проверки и самокоррекции, снижая ненужные шаги рассуждения и повышая надежность ответов.
- MOTIVE решает проблему ненадежной одно-критериальной верификации сочетанием дополняющих перспектив и обученного показателя надежности, что делает мультимодальное рассуждение более надёжным и эффективным без внешних арбитров.
ПОЧЕМУ ЭТО ВАЖНО
MOTIVE решает проблему ненадежной одно-критериальной верификации сочетанием дополняющих перспектив и обученного показателя надежности, что делает мультимодальное рассуждение более надёжным и эффективным без внешних арбитров.