ИССЛЕДОВАНИЕ · RESEARCH · #608
Характеристика веб-поиска в разговорных LLM-агентах на четырёх платформах
В препринте arXiv:2609.19244v1 представлено первое исследование агентного веб‑поиска на четырёх платформах (ChatGPT, Claude, Grok, DeepSeek) с сочетанием реальных пользовательских взаимодействий (in vivo) и контролируемых API‑экспериментов (in vitro). Авторы изучают решения об обращении к поиску, стратегии формирования запросов, доменные предпочтения в результатах и преобразование результатов в ответы, отмечая значительные различия между платформами, доменные смещения результатов и случаи ссылок на несконцентрированные/несцитируемые результаты.
КЛЮЧЕВЫЕ ТЕЗИСЫ
- В препринте arXiv:2609.19244v1 представлено первое исследование агентного веб‑поиска на четырёх платформах (ChatGPT, Claude, Grok, DeepSeek) с сочетанием реальных пользовательских взаимодействий (in vivo) и контролируемых API‑экспериментов (in vitro).
- Авторы изучают решения об обращении к поиску, стратегии формирования запросов, доменные предпочтения в результатах и преобразование результатов в ответы, отмечая значительные различия между платформами, доменные смещения результатов и случаи ссылок на несконцентрированные/несцитируемые результаты.
- Результаты важны для проектирования и оценки разговорных агентов и поисковых инструментов, поскольку выявляют платформенно‑зависимое поведение поиска, проблемы атрибуции и компромиссы между частотой поиска и качеством ответов.
ПОЧЕМУ ЭТО ВАЖНО
Результаты важны для проектирования и оценки разговорных агентов и поисковых инструментов, поскольку выявляют платформенно‑зависимое поведение поиска, проблемы атрибуции и компромиссы между частотой поиска и качеством ответов.