ИССЛЕДОВАНИЕ · RESEARCH · #1407
GAVA: Обоснованный арбитраж пользовательских исправлений для текстовых воплощённых агентов (arXiv:2610.00282v1)
В статье формулируется «обоснованный арбитраж исправлений» — механизм, позволяющий агенту принимать, отклонять, инспектировать или запрашивать уточнения при сомнительных пользовательских исправлениях — и представлен GAVA, использующий ограниченные наблюдения, юридические зондирования и одношаговое правило ожидаемых потерь. В текстовой среде ALFWorld GAVA достигает почти идеальной точности исправлений и снижает стоимость взаимодействия за счёт выборочной проверки с семантическим приором, но исследование ограничено символическими наблюдениями, контролируемыми говорящими и не включает людей, визуальные данные или роботов.
КЛЮЧЕВЫЕ ТЕЗИСЫ
- В статье формулируется «обоснованный арбитраж исправлений» — механизм, позволяющий агенту принимать, отклонять, инспектировать или запрашивать уточнения при сомнительных пользовательских исправлениях — и представлен GAVA, использующий ограниченные наблюдения, юридические зондирования и одношаговое правило ожидаемых потерь.
- В текстовой среде ALFWorld GAVA достигает почти идеальной точности исправлений и снижает стоимость взаимодействия за счёт выборочной проверки с семантическим приором, но исследование ограничено символическими наблюдениями, контролируемыми говорящими и не включает людей, визуальные данные или роботов.
- Работа демонстрирует, что выборочная проверка с семантическими приорами помогает агентам балансировать между доверием и затратами проверки, что важно для более эффективного и надёжного взаимодействия человек–агент.
ПОЧЕМУ ЭТО ВАЖНО
Работа демонстрирует, что выборочная проверка с семантическими приорами помогает агентам балансировать между доверием и затратами проверки, что важно для более эффективного и надёжного взаимодействия человек–агент.