arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-31 至 2026-07-31 共收录 57 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 1 篇

2510.25333 2026-07-31 cs.CL 版本更新 88%

CRMWeaver: Building Powerful Business Agent via Agentic RL and Shared Memories

CRMWeaver:通过智能体强化学习与共享记忆构建强大的商业智能体

Yilong Lai, Yipin Yang, Ting Liang, Jialong Wu, Zhenglin Wang, Jianguo Lin, Keping Yang

机构 * Taobao & Tmall Group of Alibaba(阿里巴巴淘宝与天猫集团) Southeast University(东南大学) University of Montreal(蒙特利尔大学)

专题命中 工具调用 :agent(title,abstract);agentic(title,abstract);分类 cs.CL

AI总结 针对商业智能体面临的数据复杂、任务异质问题,提出CRMWeaver方法,通过智能体强化学习训练与共享记忆机制提升性能,在CRMArena-Pro数据集的B2B、B2C场景中取得竞争力结果,实用价值显著。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 20 篇

2607.20891 2026-07-31 cs.AI 版本更新 84%

Is Deep Research Reliable? Misleading Knowledge Induces False Conclusions

深度研究可靠吗?误导性知识会导致错误结论

Pengyu Zhu, Lijun Li, Longju Yang, Sen Su, Jing Shao

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Chongqing University of Posts and Telecommunications(重庆邮电大学)

专题命中 规划决策 :agent(summary_cn,abstract);planning(abstract);分类 cs.AI

AI总结 研究深度研究代理在开放信息环境中的可靠性,引入MisKnow-Agent框架生成误导性实例,通过实验发现其易因误导知识得出错误结论,验证与实际证据使用脱节,评估防御措施效果,强调需提升模型和框架层面的证据验证及纠正能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21419 2026-07-31 cs.AI 版本更新 79%

PATS: Policy-Aware Training Scaffolding for Agentic Reinforcement Learning

PATS:用于智能体强化学习的策略感知训练框架

Yipeng Shi, Zhipeng Ma, Yue Wang, Qitai Tan, Yang Li, Peng Chen, Zhengzhou Zhu

专题命中 规划决策 :agentic(title);agent(abstract);分类 cs.AI

AI总结 研究针对长期语言模型智能体强化学习中弱策略问题,提出以策略为中心的训练范式Pats,将技能作为动态训练框架,通过转换展开组为证据卡、特定任务评估调整上下文等改进策略,在多个任务上取得良好效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16059 2026-07-31 cs.RO 版本更新 78%

Ultrafast Sampling-based Kinodynamic Planning via Differential Flatness

基于微分平坦性的超快采样动力学规划

Thai Duong, Clayton W. Ramsey, Zachary Kingston, Wil Thomason, Lydia E. Kavraki

机构 * Department of Computer Science, Rice University(计算机科学系,里士大学) Ken Kennedy Institute(肯尼迪研究所)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出FLASK框架,利用微分平坦性将运动规划问题从状态空间转换到平坦输出空间,通过并行计算实现快速、精确的动态可行性轨迹生成,适用于多种机器人系统。

Comments 20 pages, 10 figures, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26494 2026-07-31 cs.AI cs.CL cs.LG 版本更新 75%

The MiniMax-M2 Series: Mini Activations Unleashing Max Real-World Intelligence

MiniMax-M2系列:小激活释放最大现实智能

Aili Chen, Aonian Li, Baichuan Zhou, Bangwei Gong, Binyang Jiang, Boji Dan, Changhao Zhang, Changqing Yu, Chao Wang, Cheng Ma, Cheng Zhong, Cheng Zhu, Chengjun Xiao, Chengyi Yang, Chengyu Du, Chenyang Zhang, Chi Zhang, Chuangyi Huang, Chunhao Zhang, Chunhui Du, Chunyu Zhao, Congchao Guo, Da Chen, Deming Ding, Dianjun Sun, Dong Li, Dongyu Zhang, Enhui Yang, Fei Yu, Guang Zheng, Guodong Zheng, Guohong Li, Haichao Zhu, Haigang Zhou, Haimo Zhang, Han Ding, Hao Zhang, Haohai Sun, Haolin Lyu, Haonan Lu, Haoyu Wang, Huajie Shi, Huiyang Li, Jiacheng Chen, Jian Zhang, Jiaqi Zhuang, Jiaren Cai, Jiaxin Pan, Jiayao Li, Jiayuan Song, Jichuan Zhang, Jie Wang, Jihao Gu, Jin Zhu, Jingwei Dong, Jingyang Li, Jingyu Zhang, Jingze Zhuang, Jinhao Tian, Jinli Liu, Jinyi Hu, Jun Tao, Jun Zhang, Junbin Ruan, Junhao Xu, Junjie Yan, Junteng Liu, Junxian He, Kang Xu, Ke Ji, Ke Yang, Kecheng Xiao, Keyu Duan, Keyu Li, Le Han, Letian Ruan, Li Yuan, Lianfei Yu, Liheng Feng, Lijie Mo, Lin Li, Linge Du, Lingye Bao, Lingyu Yang, Lingyuan Zhou, Loki, Lu Chen, Lunbin Zeng, Ming Li, Ming Zhong, Mingliang Tao, Mingyuan Chi, Mujie Lin, Nan Hu, Ningxin Chen, Peiyin Zhu, Peng Gao, Pengcheng Gao, Pengfei Li, Penglin Li, Pengyu Zhao, Qibin Ren, Qibing Ren, Qidi Xu, Qihan Ren, Qile Li, Qin Wang, Quanliang Chen, Qunhong Zeng, Rong Tian, Rongxin Guo, Rui Dong, Ruitao Leng, Ruize Zhang, Shanqi Liu, Shaoxiang Chen, Shaoyu Chen, Sheng Jia, Shun Yao, Shuoran Zhao, Shuqi Yu, Sichen Li, Sicheng Pan, Songquan Zhu, Tengfei Li, Tian Xie, Tiancheng Qin, Tianle Li, Tianrun Liang, Wei Liu, Weiqi Xu, Weitao Li, Weixiang Chen, Weiyu Cheng, Weiyu Zhang, Wenhu Chen, Wenqian Zhao, Xiancai Chen, Xiangjun Song, Xiangyuan Wang, Xianzhen Luo, Xiao Luo, Xiao Su, Xiaobo Li, Xiaodong Han, Xiaojie Wu, Xihao Song, Xingyi Han, Xinyu Guan, Xuan Lu, Xun Zou, Xunhao Lai, Xutong Li, Xuyang Shen, Yan Gong, Yan Ma, Yang Jiao, Yang Wang, Yang Xu, Yangsen Wang, Ye Tang, Yicheng Chen, Yihang Wang, Yinran Qiu, Yiqi Shi, Yiting Guo, Yiwen Huang, Yixuan Wang, Yongyi Hu, Yu Gao, Yu Zhang, Yuan Li, Yuanxiang Ying, Yuanzhen Zhang, Yubo Wang, Yuchen Song, Yufeng Yang, Yuhang Meng, Yuhang Miao, Yuhao Li, Yujie Liu, Yulin Hu, Yunan Huang, Yunji Li, Yunyi Huang, Yusen Zhang, Yusu Hong, Yutao Xie, Yutong Zhang, Yuwen Liao, Yuxuan Shi, Yuze Wenren, Zebin Li, Zehan Li, Zejian Luo, Zeyu Jin, Zeyuan Sun, Zhanpeng Zhou, Zhaochen Su, Zhendong Li, Zhengmao Zhu, Zhengyuan Peng, Zhenhua Fan, Zhi Zhang, Zhichao Xu, Zhiheng Lv, Zhikang Xu, Zhitao He, Zhiwei He, Zhongyuan Li, Zibo Gao, Zijia Wu, Zijian Song, Zijian Zhou, Zijun Sun, Zishan Huang, Ziying Chen, Ziyue Ge

机构 * MiniMax

专题命中 规划决策 :agent(abstract);agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 提出MiniMax-M2系列混合专家语言模型,通过小激活参数实现前沿性能,核心包括智能体驱动数据管道、可扩展强化学习系统Forge及自进化检查点M2.7。

Comments Technical Report. 35 pages, 10 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.06494 2026-07-31 cs.CG cs.GR cs.RO 版本更新 71%

An Efficient Solution to the 2D Visibility Problem in Cartesian Grid Maps and its Application in Heuristic Path Planning

笛卡尔栅格地图中二维可见性问题的高效解决方案及其在启发式路径规划中的应用

Ibrahim Ibrahim, Joris Gillis, Wilm Decré, Jan Swevers

专题命中 规划决策 :planning(title)

AI总结 本文提出一种高效的二维栅格可见性求解方法,将其作为启发式函数实现无局部极小值的路径规划器,性能优于传统光线投射算法。

Comments 7 pages, 5 figures, IEEE ICRA 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04227 2026-07-31 cs.CV cs.LG 版本更新 70%

Continual Learning for VLMs: A Survey and Taxonomy Beyond Forgetting

视觉语言模型的持续学习:超越遗忘的综述与分类

Yuyang Liu, Qiuhe Hong, Linlan Huang, Alexandra Gomez-Villa, Dipam Goswami, Tiantian Peng, Xialei Liu, Joost van de Weijer, Yonghong Tian

专题命中 规划决策 :autonomous agent(abstract);agentic(abstract);分类 cs.LG

AI总结 本文综述了视觉语言模型的持续学习挑战,提出四种核心范式以解决跨模态特征漂移和灾难性遗忘问题,强调零样本学习和智能体生态系统的发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01427 2026-07-31 cs.AI 版本更新 70%

A Tale of LLMs and Induced Small Proxies: Scalable Small Language Models for Knowledge Mining

小型语言模型代理实现高效高质量的知识挖掘

Sipeng Zhang, Longfei Yun, Zilong Wang, Letian Peng, Jingbo Shang

机构 * University of California, San Diego(加州大学圣地亚哥分校) Carneigie Mellon University(卡内基梅隆大学) Georgia Institute of Technology(佐治亚理工学院)

专题命中 规划决策 :planning(abstract);agentic(abstract);分类 cs.AI

AI总结 提出Falconer框架,结合大语言模型的代理推理与轻量级代理模型,通过规划与标注实现可扩展的知识挖掘,在保持指令遵循精度的同时降低90%推理成本并加速20倍以上。

Comments Code available: https://github.com/LongfeiYun17/falconer

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.18124 2026-07-31 physics.ao-ph 版本更新 67%

Long-range near-surface wake signatures of offshore wind farm clusters revealed by satellite observations

卫星观测揭示海上风电场集群的远距离近地面尾流特征

Rui Li, Jincheng Zhang, Xiaowei Zhao

专题命中 规划决策 :planning(abstract);workflow(abstract)

AI总结 该研究利用7122幅Sentinel-1A/B SAR图像,揭示海上风电场近地面尾流可超100公里、平均降速0.990 m/s,还观测到跨国界尾流相互作用,为尾流特征提供大规模观测表征。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20145 2026-07-31 cs.CL cs.AI 版本更新 62%

SLAI T-Rex: Full-Parameter Post-training of the DeepSeek-V4 Family on Ascend SuperPOD

SLAI T-Rex:在升腾超级集群上对DeepSeek-V4系列进行全参数训练后优化

Dongfang Li, Xiaodong Luo, Ruoyu Sun, Xuhui Chen, Linyuan Qiu, Jian Meng, Zhengxuan Lu, Yiting Wang, Yucheng Xie, Tao Guo, Tianxiang Fang, Jing Li, Sihang Chen, Shihao Hong, Chang Liu, Weihua Dai, Zirong Zeng, Ziwei Zhu, Zhuohan Wang, Zhengjun Yue, Igor Vasilyev, Min Liu, Weijian Sun, Xin Chen, Yingmeng Gao, Jinhua Zhou, Taolue Chen, Chenwei Wu, Dong Zhang, Wenlong Jin, Jinmin Xiang, Barkova Maria, Ushakov Anton, Xianfei Jin, Tian Ding, Zhihang Lin, Qian Chen, Linxin Yang, Mingzhe Yang, Bingwei Zhang, Hongzhang Yang, Fangxue Zhang, Shijun Qin, Jie Yu, Cuihua Hu, Tolstykh Vasiliy, Nosov Ivan, Abdullin Amir, Zhicheng Zhou, Xin Zhang, Zhixiong Ning, Xutong Zhao, Junjie Huang, Jiajun Liu, Weiyan Kong, Zheng Zhang, Wenhan Luo, Lin Hu, Yangbo Guo, Li Zeng, Shihao Zhang, Baotian Hu, Min Zhang, Haizhou Li, Zhiquan Luo

专题命中 规划决策 :workflow(abstract);分类 cs.AI、cs.CL

AI总结 研究针对万亿参数规模MoE模型全参数训练后优化的系统挑战,在升腾NPU超级集群上以DeepSeek-V4为目标工作负载开发分层优化框架,建立CPT和SFT工作流程,提升模型性能,推动复杂推理前沿模型系统发展。

Comments 73 pages, 22 figures, 20 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13707 2026-07-31 cs.RO cs.AI cs.LG 版本更新 62%

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning

REFINE-DP:通过强化学习实现人形机器人的动态-操作协调政策微调

Zhaoyuan Gu, Yipu Chen, Zimeng Chai, Alfred Cueva, Thong Nguyen, Yifan Wu, Huishu Xue, Minji Kim, Isaac Legene, Fukang Liu, KyoungMok Kim, Ayan Barula, Yongxin Chen, Ye Zhao

机构 * The Institute for Robotics and Intelligent Machines(机器人与智能机械研究所)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出REFINE-DP框架,通过联合优化扩散政策高层规划器和基于强化学习的低层动态-操作控制器,提升人形机器人在复杂环境中的任务成功率与执行稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28421 2026-07-31 cs.AI 版本更新 57%

DenoiseRL: Bootstrapping Reasoning Models to Recover from Noisy Prefixes

DenoiseRL:引导推理模型从噪声前缀中恢复

Caijun Xu, Changyi Xiao, Zhongyuan Peng, Yixin Cao

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 规划决策 :agentic(abstract);分类 cs.AI

AI总结 提出DenoiseRL框架,通过强化学习从弱模型的错误推理中学习,无需外部监督或强教师模型,提升推理性能和训练效率。

Comments 17 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15297 2026-07-31 cs.CL 版本更新 57%

AfriEconQA: A Benchmark for Quantitative and Temporal Reasoning over World Bank Economic Reports

AfriEconQA:基于世界银行报告的非洲经济分析基准数据集

Edward Ajayi, Mustapha Alaba, David Stephen

机构 * Carnegie Mellon University Africa(卡内基梅隆大学非洲分校)

专题命中 规划决策 :agentic(abstract);分类 cs.CL

AI总结 AfriEconQA是一个基于世界银行报告的非洲经济分析基准数据集,旨在测试信息检索和RAG系统在处理复杂经济查询时的性能。

Comments Dataset Explorer: https://afrieconqa.pages.dev/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26774 2026-07-31 stat.ME stat.AP 版本更新 50%

End-to-end probabilistic hierarchical forecasting of large hierarchies via probabilistic top-down

大规模层次结构端到端概率层次预测:基于概率自上而下方法

Lorenzo Zambon, Dario Azzimonti, Giorgio Corani

专题命中 规划决策 :planning(abstract)

AI总结 提出e2eTD方法,仅预测少量聚合序列,通过概率自上而下采样传播到底层,实现大规模层次时间序列的快速、可扩展概率一致预测,在M5和Favorita数据集上取得最优加权缩放分位数损失。

Comments 32 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19846 2026-07-31 econ.GN q-fin.EC 版本更新 50%

What Capital After Labor? Forecasting the Talent ROI Transition in the Human-AI Era

劳动力之后是什么资本?预测人机时代的人才ROI转型

Kwan Soo Shin

专题命中 规划决策 :planning(abstract)

AI总结 针对AI增强打破劳动时间与贡献的会计关联,本文构建从时间到产出的人才ROI预测框架,核心定理为ROI反转,并利用韩国52小时工作制案例验证了前期压力信号,预测产出型企业在2032年TFP增长领先1.5-2.0个百分点。

Comments 86 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22078 2026-07-31 cs.RO 版本更新 50%

Do World Action Models Generalize Better than VLAs? A Robustness Study

世界动作模型是否比视觉语言动作模型表现更好?一项鲁棒性研究

Zhanguang Zhang, Zhiyuan Li, Behnam Rahmati, Rui Heng Yang, Yintao Ma, Amir Rasouli, Sajjad Pakdamansavoji, Yangzheng Wu, Lingfeng Zhang, Tongtong Cao, Feng Wen, Xinyu Wang, Xingyue Quan, Yingxue Zhang

机构 * Huawei Technologies(华为技术有限公司) University of Toronto(多伦多大学)

专题命中 规划决策 :planning(abstract)

AI总结 本文比较了最新状态的VLA策略和最近发布的WAMs,在不同视觉和语言扰动下评估其性能,发现WAMs在鲁棒性上表现更强,而VLA需要大量训练数据和多样化学习目标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19956 2026-07-31 econ.EM q-fin.TR 版本更新 50%

Intraday Gas Fee Heterogeneity on Ethereum: Evidence from Operational Firms

链上削峰

Irene Aldridge, Gavhar Annaeva, Leyla Beriker, Zhiheng Cai, Samyak Choudhary, Camila Godoy, Kaicheng Gong, Zitao Huang, Jonah Ji, Hetvi Kharvasiya, Heng Li, Yuxuan Li, Tianchi Ma, Qingcheng Meng, Ruiyang Shi, Ananya Shrivastava, Jiaqi Wang, Yifan Wang, Zihua Wu, Jiayang Xu, Yuheng Yan, Zijun Zeng, Bowen Zhang, Francesco Zhang

专题命中 规划决策 :planning(abstract)

AI总结 研究链上削峰策略,通过调度交易至低拥堵时段以降低Gas费用,揭示交易可延迟性和Gas强度对费用管理的影响。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14584 2026-07-31 cs.RO 版本更新 50%

A Robust Placeability Metric for Model-Free Unified Pick-and-Place Reasoning

一种针对无模型统一抓取放置推理的鲁棒放置性度量

Benno Wingender, Nils Dengler, Rohit Menon, Sicong Pan, Maren Bennewitz

机构 * Anonymous Authors(匿名作者) Benno Wingender(伯恩诺·温格德尔) Nils Dengler(尼尔·登格尔) Rohit Menon(罗希特·梅农) Sicong Pan(斯冰·潘) Maren Bennewitz(马伦·本内维茨)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出一种鲁棒的概率放置性度量,通过联合评估稳定性、抓取性和空隙,实现无模型的统一抓取放置推理,并在仿真和真实机器人实验中验证其有效性。

Comments IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03687 2026-07-31 cs.GT cs.MA 版本更新 50%

Fair and Efficient Investment in Public Transportation

多代理公共交通模型中的高效投资

Martin Bullinger, Edith Elkind, Kassian Köck

专题命中 规划决策 :agent(abstract)

AI总结 本文研究了多代理公共交通模型中的资源投资问题,发现近似最优解计算为NP完全,并提出多项式时间算法解决部分情况。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03085 2026-07-31 econ.TH 版本更新 50%

Optimal Taxation under Imperfect Trust

不完全信任下的最优税收

Emin Ablyatifov, Georgy Lukyanov

专题命中 规划决策 :agent(abstract)

AI总结 该研究在拉姆齐框架中引入公民对政府的信任因素,发现信任阈值决定最优税收政策,低信任时最优为零税收,高信任时按信任调整公共资金边际价值确定税率,为低信任环境的税收设计提供思路。

Comments This paper has been incorporated into and superseded by the substantially revised and expanded paper "Government Reputation and Fiscal Capacity," arXiv:2509.03087

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09325 2026-07-31 stat.ME 版本更新 50%

A Spectral Confounder Adjustment for Spatial Regression with Multiple Exposures and Outcomes

多暴露与多结局空间回归的谱混杂调整方法

Shih-Ni Prim, Yawen Guan, Shu Yang, Ana G Rappold, K. Lloyd Hill, Wei-Lun Tsai, Corinna Keeler, Brian J Reich

专题命中 规划决策 :planning(abstract)

AI总结 该研究针对多暴露多结局空间回归的混杂问题,提出张量回归模型,以局部无混杂假设替代严格因果假设,分析美国南部数据揭示经济韧性对慢性健康结局的效应,提供可解释的流行病学见解。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 多智能体 7 篇

2607.16745 2026-07-31 cs.AI cs.MA 版本更新 92%

RELIC: Revealed Principles for Learning Interpretable Composable Skills in Multi-Agent Planning

RELIC:多智能体规划中学习可解释可组合技能的揭示原则

Nguyen Viet Tuan Kiet, Bui Dinh Pham, Duong Quoc Chinh, Dao Van Tung, Tran Cong Dao, Huynh Thi Thanh Binh

专题命中 多智能体 :agent(title,abstract);planning(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 针对多智能体规划中隐私受限合作难题,提出RELIC框架,通过揭示原则学习可解释可组合技能,各智能体私用大语言模型引导搜索优化技能,协调器依团队性能评估更新,实现跨智能体转移,引入隐私保护技能学习新范式。

Comments v1 accepted at LM4Plan Workshop @ ICML 2026; v2 is the full paper version; Kiet, Pham, and Chinh contributed equally in v2

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25255 2026-07-31 cs.MA cs.CR 版本更新 90%

SafeFlow: Semantic Information-Flow Control for Blocking Malicious Propagation in Multi-Agent Systems

SafeFlow:用于多智能体系统中阻止恶意传播的语义信息流控制

Haowen Dai, Zonghao Ying, Wenfeng Li, Xiangfan Wu, Yisong Xiao, Tianyuan Zhang, Jiaye Lin, Lei Wei, Guangyuan Dong, Xitong Ling, Xixun Lin, Quanchen Zou, Xiangzheng Zhang

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);tool use(abstract);workflow(abstract)

AI总结 研究多智能体系统恶意传播问题,提出SafeFlow框架,将恶意跨智能体传播形式化为语义信息流问题,通过附加污点、传播及工作流级验证重建风险上下文,经测试降低攻击成功率,保持良性任务完成率,揭示系统缺乏跨委托边界保留风险语义机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24802 2026-07-31 cs.IR cs.CL 版本更新 89%

SourceMinds at CheckThat! 2026: NLI-Grounded Citation Auditing in a Multi-Agent Pipeline for Full Fact-Checking Article Generation

SourceMinds参与2026年CheckThat!:多智能体管道中基于自然语言推理的引用审核用于完整事实核查文章生成

Farhan Sharukh Hasan, Anirban Saha Anik, Eric Liu, Xiaoying Song, Mohotarema Rashid, Lingzi Hong

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract);分类 cs.CL

AI总结 针对CLEF 2026 CheckThat!实验室任务3,提出多智能体管道系统,结合证据检索、结构化规划、文章生成、自我批判及引用审核等方法,强调证据选择、结构化生成与生成后引用验证对事实核查文章生成的重要性。

Comments CLEF 2026 Working Notes / CheckThat! Lab at CLEF 2026, Jena, Germany

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22241 2026-07-31 cs.CV 版本更新 89%

AgentHOI: Multi-Agent Reasoning for Human-Object-Interaction Video Generation via Implicit Representation Alignment

AgentHOI:通过隐式表示对齐进行人类-物体交互视频生成的多智能体推理

Ziyao Huang, Shunkai Li, Juan Cao, Chenyu Li, Youliang Zhang, Zixiang Zhou, Cong Wang, Yuan Zhou, Qinglin Lu, Fan Tang

机构 * University of Chinese Academy of Sciences(中国科学院大学) Tencent HunYuan(腾讯混元)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract)

AI总结 研究针对HOI视频生成中现有方法依赖显式运动控制的问题,提出AgentHOI,通过多智能体推理和隐式文本-运动对齐策略,实现文本驱动的HOI视频生成,提升了交互自然性等,改进了复杂场景下的表现。

Comments Under review. The code is available at https://github.com/bone-11/agenthoi

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10600 2026-07-31 cs.MA cs.AI cs.GT cs.LG 版本更新 88%

Procedural Fairness in Multi-Agent Bandits

多智能体老虎机中的程序公平性

Joshua Caiata, Carter Blair, Kate Larson

机构 * University of Waterloo(滑铁卢大学) Harvard University(哈佛大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出程序公平性作为多智能体老虎机中的公平性目标,强调平等决策权和结果比例性,证明不同公平性观念优先不同价值观,主张加强程序公平性研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27744 2026-07-31 cs.AI 版本更新 83%

A Policy-Driven Runtime Layer for Agentic LLM Serving

一种面向智能体LLM服务的策略驱动运行时层

Rui Zhang, Chaeeun Kim, Liting Hu

机构 * University of California, Santa Cruz(加州大学圣克鲁兹分校)

专题命中 多智能体 :agentic(title);agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 针对多智能体LLM系统中跨层策略难以高效实现的问题,提出在框架与引擎之间插入智能体运行时层,通过四个原语支持任意智能体感知策略,并在KV缓存策略CacheSage上验证了有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13220 2026-07-31 cs.AI cs.CE cs.HC 版本更新 77%

Networked Intelligence: Active Shared Context Graphs for Human-AI Team Science

网络智能:用于人类-人工智能团队科学的主动共享上下文图

Sutanay Choudhury, Jeffrey J. Czajka, Lummy M. O. Monteiro, Erin Bredeweg, Jason McDermott, Katherine Wolf, Alex Beliaev, Josh Elmore, Paul Piehowski, Kylee Tate, Yuqian Gao, Aivett Bilbao, Kelly Stratton, Scott Baker, Jaydeep P. Bardhan, Kristin Burnum Johnson, Chris Oehmen, Robert Rallo

机构 * Pacific Northwest National Laboratory(太平洋西北国家实验室)

专题命中 多智能体 :agent(abstract);AI agent(abstract);agentic(abstract);分类 cs.AI

AI总结 研究旨在培养人类与AI系统间的网络智能。提出Mycelium主动共享工作区,能自动连接人员与智能体,捕获并路由重要信息。通过生物多组学活动测试,验证其可将局部发现转化为实验设计,还对网络智能进行了计算解释。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 工作流自动化 8 篇

2307.07191 2026-07-31 cs.LG stat.ML 版本更新 83%

Bridging AI and Energy Forecasting: An Autonomous Workflow with Customized Toolkit

连接AI与能源预测:一种带定制工具包的自主工作流

Zhixian Wang, Leandro Von Krannichfeldt, Qingsong Wen, Chaoli Zhang, Liang Sun, Shirui Pan, Yi Wang

专题命中 工作流自动化 :workflow(title,abstract);agent(abstract);分类 cs.LG

AI总结 该研究提出基于LLMs的自主能源预测工作流,整合含31种时间架构等的定制工具包,建立21个能源数据集基准,可实现电网需求适配的自动化预测与算法测试。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10579 2026-07-31 cs.CL 版本更新 70%

VISTA: A Controllable Platform for Generating and Auditing Egocentric Assistance Scenarios

VISTA:一种用于日常协助的生成性眼动视频框架

Yu-Hsiang Liu, Yu-Chien Tang, An-Zi Yen

机构 * Department of Computer Science, National Yang Ming Chiao Tung University(国立阳明交通大学计算机科学系)

专题命中 工作流自动化 :AI agent(abstract);workflow(abstract);分类 cs.CL

AI总结 VISTA通过生成高保真眼动视频为AI代理提供训练和评估数据,支持从日常家务到紧急安全情况的主动协助,包含反应性和前瞻性干预模式,提供可定制的视频基准测试。

Comments pre-print

详情

展开后加载摘要…

URL PDF HTML 收藏