arXiv cs.AI· Victor De Lima, Grace Hui Yang·· 3 小时前AI 评分42
11 款大语言模型在开放信息搜寻任务中的行为差异研究
On Open-Ended Information Seeking for Information Elicitation Agents
AI 摘要
该研究对比了 11 款跨越不同模型家族与参数规模的大语言模型,探究其在开放信息搜寻任务中如何评估信息价值并决定后续搜索方向。通过构建受控模拟环境隔离提问与回答行为,文章量化了各模型在“广度 - 深度”探索策略上的显著差异及其对交互历史变化的敏感度。相关项目代码、数据及轨迹文件已开源。
来源:arXiv cs.AI · arxiv.org