Tech Meridian ← К ЛЕНТЕ
EN

ИССЛЕДОВАНИЕ · RESEARCH · #608

Характеристика веб-поиска в разговорных LLM-агентах на четырёх платформах

В препринте arXiv:2609.19244v1 представлено первое исследование агентного веб‑поиска на четырёх платформах (ChatGPT, Claude, Grok, DeepSeek) с сочетанием реальных пользовательских взаимодействий (in vivo) и контролируемых API‑экспериментов (in vitro). Авторы изучают решения об обращении к поиску, стратегии формирования запросов, доменные предпочтения в результатах и преобразование результатов в ответы, отмечая значительные различия между платформами, доменные смещения результатов и случаи ссылок на несконцентрированные/несцитируемые результаты.

КЛЮЧЕВЫЕ ТЕЗИСЫ

  1. В препринте arXiv:2609.19244v1 представлено первое исследование агентного веб‑поиска на четырёх платформах (ChatGPT, Claude, Grok, DeepSeek) с сочетанием реальных пользовательских взаимодействий (in vivo) и контролируемых API‑экспериментов (in vitro).
  2. Авторы изучают решения об обращении к поиску, стратегии формирования запросов, доменные предпочтения в результатах и преобразование результатов в ответы, отмечая значительные различия между платформами, доменные смещения результатов и случаи ссылок на несконцентрированные/несцитируемые результаты.
  3. Результаты важны для проектирования и оценки разговорных агентов и поисковых инструментов, поскольку выявляют платформенно‑зависимое поведение поиска, проблемы атрибуции и компромиссы между частотой поиска и качеством ответов.

ПОЧЕМУ ЭТО ВАЖНО

Результаты важны для проектирования и оценки разговорных агентов и поисковых инструментов, поскольку выявляют платформенно‑зависимое поведение поиска, проблемы атрибуции и компромиссы между частотой поиска и качеством ответов.

ИСТОЧНИКИ И ХРОНОЛОГИЯ

1