Utility-Guided Agent Orchestration for Efficient LLM Tool Use
基于效用的代理协调以提高大语言模型工具使用效率
机构 * University of Science and Technology of China(科学技术大学)
AI总结 本文提出一种基于效用的代理协调策略,通过平衡收益、成本、不确定性及冗余性来优化大语言模型工具使用中的质量与成本权衡。实验表明显式协调信号显著影响代理行为。
高校专区
基于效用的代理协调以提高大语言模型工具使用效率
机构 * University of Science and Technology of China(科学技术大学)
AI总结 本文提出一种基于效用的代理协调策略,通过平衡收益、成本、不确定性及冗余性来优化大语言模型工具使用中的质量与成本权衡。实验表明显式协调信号显著影响代理行为。
RealUnify: 统一模型真的能从统一中受益吗?一个全面的基准测试
机构 * PKU(北京大学) ; Kling Team(Kling团队) ; NTU(国立台湾大学) ; CASIA(中国科学院自动化研究所) ; NUS(国立新加坡大学) ; USTC(中国科学技术大学) ; THU(清华大学) ; ZJU(浙江大学)
AI总结 RealUnify基准测试旨在评估统一模型中理解与生成能力的双向协同效应,通过10类32子任务的1000个人工标注实例,揭示现有统一模型在协同能力上的不足,强调需新的训练策略来提升统一建模潜力。
Comments Accepted by CVPR 2026
VERDICT: 可验证的演进推理与指令驱动的协作团队用于法律判断预测
机构 * University of Science and Technology of China(中国科学技术大学) ; Chinese Academy of Sciences(中国科学院) ; iFLYTEK AI Research(iFLYTEK人工智能研究院)
AI总结 VERDICT通过模拟虚拟合议庭,提出自反思协作多智能体框架,结合混合法理记忆实现法律推理的可验证性和适应性,提升法律预测的准确性和解释性。
Comments 15 pages,3 figures,4 tables