RecoAtlas: From Semantic Plausibility to Set-Level Utility in LLM Recommendation Agents
RecoAtlas: 从语义合理性到集级效用在LLM推荐代理中
机构 * Criteo AI Lab(Criteo人工智能实验室)
专题命中 Agent评测 :agentic(abstract,abstract_cn);tool-use(abstract);分类 cs.AI、cs.LG
AI总结 本文提出RecoAtlas,一个用于评估购物代理的基准和工具包,通过行为基础的度量标准来评估推荐代理的性能,揭示语义合理性并不一定代表行为基础的效用。
Comments Benchmark on LLM Recommendation Agents