Institutional AI: A Governance Framework for Distributional AGI Safety
机构AI:分布式AGI安全的治理框架
专题命中 Agent评测 :agent(abstract);AI agent(abstract);agentic(abstract)
AI总结 机构AI通过治理框架解决分布式AGI安全问题,将对齐视为治理机制设计问题,通过运行时监控、激励塑造和规范执行来约束代理行为。
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
机构AI:分布式AGI安全的治理框架
专题命中 Agent评测 :agent(abstract);AI agent(abstract);agentic(abstract)
AI总结 机构AI通过治理框架解决分布式AGI安全问题,将对齐视为治理机制设计问题,通过运行时监控、激励塑造和规范执行来约束代理行为。
通过大语言模型代理实现自主量子模拟
专题命中 Agent评测 :agent(abstract);AI agent(abstract);multi-agent(abstract)
AI总结 本文提出利用大语言模型代理实现自主量子模拟,通过上下文学习和多代理架构提升模拟效率与准确性。
机构 * NAVER Cloud HyperCLOVA X Team(NAVER云HyperCLOVA X团队)
专题命中 Agent评测 :agent(abstract);agentic(abstract);分类 cs.AI、cs.CL、cs.LG
Comments Technical Report
幻觉与事实:大型语言模型中事实核查与事实性评估的综述
机构 * Department of Computer Science and Engineering, United International University, Dhaka 1212, Bangladesh(乌姆特国际大学计算机科学与工程系) ; Department of Computer Science and Engineering, Daffodil International University, Dhaka-1341, Bangladesh(达芙尼国际大学计算机科学与工程系) ; Faculty of Science and Technology, Charles Darwin University, Casuarina, NT 0909, Australia(查尔斯·达尔文大学科学与技术学院)
专题命中 Agent评测 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 本文综述了大型语言模型中事实核查与事实性评估的关键挑战及方法,强调了提升事实准确性的重要性。
Journal ref Artif. Intell. Rev. (2026)
IS-Bench:评估由视觉语言模型驱动的具身智能体在日常家务任务中的交互安全性
机构 * Xiaoya Lu 1, 2(某大学) ; Zeren Chen 2, 3(某大学) ; Xuhao Hu 2, 4(某大学) ; Yijin Zhou 2(某大学) ; Weichen Zhang 2(某大学) ; Dongrui Liu 2(某大学) ; Lu Sheng 3(某研究所) ; Jing Shao 2(某研究所)
专题命中 Agent评测 :agent(abstract);planning(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 IS-Bench通过多模态基准评估视觉语言模型驱动的具身智能体在日常家务任务中的交互安全性,揭示现有智能体缺乏安全意识的问题。
当拒绝失效时:长上下文LLM代理中的不稳定安全机制
专题命中 Agent评测 :agent(abstract);agentic(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 研究发现长上下文LLM代理在性能和拒绝率上存在不稳定安全问题,揭示了评估长多步骤任务代理安全性的挑战。
Comments 12 pages, 11 figures. Accepted at AAAI 2026 TrustAgent Workshop
RealWebAssist: 一个用于长周期网页协助的基准测试
专题命中 Agent评测 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 RealWebAssist是一个评估长周期网页协助中连续指令遵循能力的新基准测试,旨在解决现实世界中用户指令模糊性和动态性带来的挑战。
Comments Project Website: https://scai.cs.jhu.edu/projects/RealWebAssist/ Code: https://github.com/SCAI-JHU/RealWebAssist
OceanGym: 一个用于水下具身智能体的基准环境
专题命中 Agent评测 :agent(abstract);planning(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 OceanGym通过多模态大语言模型构建首个水下具身智能体基准,揭示水下环境感知与规划的挑战,推动水下自主系统发展。
Comments Work in progress
规范性主动推断:一种计算和经济法律分析方法用于AI治理的数值原理证明
专题命中 Agent评测 :agent(abstract);AI agent(abstract);autonomous agent(abstract)
AI总结 本文提出通过设计监管实现合法且规范敏感的AI行为,利用主动推断框架模拟自动驾驶场景,展示法律规范对AI代理决策的影响。
Comments 19 pages, 6 figures, 1 box
机构 * Waseda University(早稻田大学) ; CyberAgent, Inc.(CyberAgent公司) ; AI Shift, Inc.(AI Shift公司) ; Nara Institute of Science and Technology(奈良研究所)
专题命中 Agent评测 :agent(abstract);planning(abstract);分类 cs.AI、cs.CL、cs.LG
Comments AAAI 2026
机构 * Youtu-LLM Team, Tencent Youtu Lab(腾讯优设实验室) ; Sun Yat-sen University(中山大学) ; The Hong Kong Polytechnic University(香港理工大学)
专题命中 Agent评测 :agent(abstract);planning(abstract);分类 cs.AI、cs.CL、cs.SE
机构 * Algoverse ; Microsoft
专题命中 Agent评测 :agent(abstract);tool use(abstract);分类 cs.AI、cs.LG、cs.SE
Comments Accepted to 39th Conference on Neural Information Processing Systems (NeurIPS 2025) Workshop: Multi-Turn Interactions in Large Language Models
Journal ref Neural Information Processing Systems (NeurIPS 2025)
机构 * University of Minnesota(明尼苏达大学) ; Texas A&M University(德克萨斯农工大学) ; CISCO Research(思科研究)
专题命中 Agent评测 :agent(abstract);planning(abstract);分类 cs.AI、cs.CL、cs.LG
机构 * SKLCCSE, Beihang University(北京航空航天大学智能科学与技术研究中心) ; Zhongguancun Laboratory(中关村实验室) ; The University of Sydney(悉尼大学) ; Henan University of Science(河南科技大学)
专题命中 Agent评测 :agent(abstract);planning(abstract);workflow(abstract)
机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
专题命中 Agent评测 :agent(abstract);agentic(abstract);分类 cs.AI、cs.CL、cs.LG
机构 * Carnegie Mellon University(卡内基梅隆大学) ; Northeastern University(东北大学)
专题命中 Agent评测 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.CL、cs.LG
Comments 27 pages, 6 figures, 2 tables
机构 * Department of Electrical and Computer Engineering, University of Waterloo(电气与计算机工程系,滑铁卢大学)
专题命中 Agent评测 :agent(abstract);planning(abstract);multi-agent(abstract)
专题命中 Agent评测 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL、cs.LG
Comments 9 pages, 4 figures, 4 tables
机构 * McMaster University(麦斯特大学) ; McMaster Centre for Software Certification(麦斯特软件认证中心)
专题命中 Agent评测 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.LG、cs.SE
Comments Accepted for ACM/IEEE MODELS'25
机构 * Delft University of Technology(代尔夫特理工大学)
专题命中 Agent评测 :agent(abstract);planning(abstract);multi-agent(abstract)
Comments Manuscript under review
机构 * Meta ; University of Edinburgh(爱丁堡大学)
专题命中 Agent评测 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.CL、cs.LG
机构 * Intuit AI Research(Intuit AI研究院)
专题命中 Agent评测 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.CL、cs.LG
Comments ACL 2025; 18 pages, 8 figures
机构 * Industrial Systems Institute, Athena Research Center, Patras Science Park, Greece(工业系统研究所,阿提卡研究中心,帕特拉斯科学公园,希腊) ; AviSense.AI, Patras Science Park, Greece(AviSense.AI,帕特拉斯科学公园,希腊) ; Dpt. of Informatics & Telecom., University of Ioannina, Arta, Greece(信息与电信系,伊奥安妮亚大学,阿塔,希腊)
专题命中 Agent评测 :agent(abstract);planning(abstract);multi-agent(abstract)
Comments 2025 IEEE International Conference on Multimedia and Expo Workshops, 3DMM - 3D Multimedia Analytics, Search and Generation
机构 * LMU(慕尼黑大学) ; MIPT(莫斯科 Institute of Physics and Technology) ; AIRI(空气研究所)
专题命中 Agent评测 :agent(abstract);planning(abstract);分类 cs.AI、cs.CL、cs.LG
Comments ACL 2025 (Main Conference)
专题命中 Agent评测 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.CL、cs.LG
Journal ref ICML 2025 Spotlight
专题命中 Agent评测 :agent(abstract);agentic(abstract);分类 cs.AI、cs.CL、cs.LG
Comments 10 pages
机构 * Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所) ; University of Modena and Reggio Emilia(摩德纳和雷吉奥艾米利亚大学) ; University of Waterloo(滑铁卢大学) ; University of Pittsburgh(匹兹堡大学)
专题命中 Agent评测 :agent(abstract);planning(abstract);multi-agent(abstract)
Comments 8 pages. 5 figures. ICRA 2025
专题命中 Agent评测 :agent(abstract);agentic(abstract);分类 cs.AI、cs.CL、cs.LG
Comments Accepted at ICLR 2025
专题命中 Agent评测 :agent(abstract);autonomous agent(abstract);agentic(abstract)
专题命中 Agent评测 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL、cs.LG
Comments Published as a conference paper at ICLR 2025