arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-04-02 至 2026-04-02 共收录 141 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 59 篇

2508.07629 2026-04-02 cs.LG cs.AI cs.CL 67%

Klear-Reasoner: Advancing Reasoning Capability via Gradient-Preserving Clipping Policy Optimization

Klear-Reasoner: 通过梯度保持裁剪策略优化提升推理能力

Zhenpeng Su, Leiyu Pan, Xue Bai, Dening Liu, Guanting Dong, Jiaming Huang, Minxuan Lv, Wenping Hu, Fuzheng Zhang, Kun Gai, Guorui Zhou

机构 * Klear Team, Kuaishou Technology(快手科技Klear团队)

专题命中 规划决策 :workflow(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 Klear-Reasoner通过梯度保持裁剪策略优化提升推理能力,在数学和编程领域表现出色,达到多项基准测试的高分。

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.14295 2026-04-02 cs.CL cs.AI cs.LG 67%

Demystifying Chains, Trees, and Graphs of Thoughts

解开思维链、树和图的谜团

Maciej Besta, Florim Memedi, Zhenyu Zhang, Robert Gerstenberger, Guangyuan Piao, Nils Blach, Piotr Nyczyk, Marcin Copik, Grzegorz Kwaśniewski, Jürgen Müller, Lukas Gianinazzi, Ales Kubicek, Hubert Niewiadomski, Aidan O'Mahony, Onur Mutlu, Torsten Hoefler

机构 * ETH Zurich(苏黎世联邦理工学院) Dell(戴尔) Cledar BASF SE(巴斯夫欧洲公司)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文通过分析提示执行流程,构建了首个结构增强的大语言模型推理方案分类法,揭示了不同结构对推理性能和成本的影响,并探讨了提示工程与语言模型生态系统的理论基础。

Journal ref IEEE Transactions on Pattern Analysis and Machine Intelligence, Volume 47, Issue 12, pages 10967-10989 (December 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00977 2026-04-02 cs.LG cs.AI 62%

Flow-based Policy With Distributional Reinforcement Learning in Trajectory Optimization

基于分布强化学习的流式策略在轨迹优化中的应用

Ruijie Hao, Longfei Zhang, Yang Dai, Yang Ma, Xingxing Liang, Guangquan Cheng

机构 * College of Systems Engineering, National University of Defense Technology(国防科技大学系统工程学院) Aviation University of Air Force(空军航空大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种流式策略与分布强化学习结合的算法,以解决传统策略在多模态分布建模中的局限性,提升多解问题中的策略更新效率和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20209 2026-04-02 cs.CL cs.AI 62%

Children's Intelligence Tests Pose Challenges for MLLMs? KidGym: A 2D Grid-Based Reasoning Benchmark for MLLMs

儿童智力测试对大语言模型构成挑战?KidGym:一种基于二维网格的推理基准测试用于大语言模型

Hengwei Ye, Yuanting Guan, Yuxuan Ge, Tianying Zhu, Zhenhan Guan, Yijia Zhong, Yijing Zhang, Han Zhang, Yingna Wu, Zheng Tian

机构 * ShanghaiTech University(上海科技大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.CL

AI总结 本文提出KidGym,一种基于二维网格的推理基准测试,用于评估大语言模型的执行、感知推理、学习、记忆和规划能力,通过12个独特任务测试模型适应性和发展潜力,揭示当前模型的局限性。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00008 2026-04-02 cs.CL cs.AI 62%

How Trustworthy Are LLM-as-Judge Ratings for Interpretive Responses? Implications for Qualitative Research Workflows

大语言模型作为评判者对解释性回应的可信度如何?对定性研究工作流程的影响

Songhee Han, Jueun Shin, Jiyoon Han, Bung-Woo Jun, Hilal Ayan Karabatman

机构 * Florida State University(佛罗里达州立大学)

专题命中 规划决策 :workflow(abstract);分类 cs.AI、cs.CL

AI总结 本文探讨了大语言模型作为评判者在解释性回应评估中的可信度,通过比较模型表现与人类评判,指出其在筛选模型时的有效性,但不适合替代人类判断。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00005 2026-04-02 cs.AI cs.CL 62%

How Emotion Shapes the Behavior of LLMs and Agents: A Mechanistic Study

情绪如何塑造大语言模型和代理的行为:一种机制性研究

Moran Sun, Tianlin Li, Yuwei Zheng, Zhenhong Zhou, Aishan Liu, Xianglong Liu, Yang Liu

机构 * School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出E-STEER框架,通过在隐藏状态中嵌入情绪作为可控变量,研究情绪对推理、生成、安全性和多步代理行为的影响,揭示情绪与行为之间的非单调关系。

Comments 15 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01220 2026-04-02 cs.CL 57%

Universal YOCO for Efficient Depth Scaling

通用YOCO用于高效深度扩展

Yutao Sun, Li Dong, Tianzhu Ye, Shaohan Huang, Jianyong Wang, Furu Wei

机构 * Microsoft Research(微软研究院) Tsinghua University(清华大学)

专题命中 规划决策 :agentic(abstract);分类 cs.CL

AI总结 本文提出通用YOCO(YOCO-U),结合递归计算与YOCO解码器解码器架构,实现更高效的推理效率与深度扩展能力,通过参数共享和浅层高效注意力层提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00790 2026-04-02 cs.AI 57%

RefineRL: Advancing Competitive Programming with Self-Refinement Reinforcement Learning

RefineRL: 通过自我细化强化学习提升竞争性编程

Shaopeng Fu, Xingxing Zhang, Li Dong, Di Wang, Furu Wei

机构 * Microsoft Research(微软研究院)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 RefineRL通过引入自我细化代理和强化学习方法,提升大语言模型在竞争性编程中的性能,实验表明其在紧凑模型中表现优异,接近大模型单次尝试性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23459 2026-04-02 cs.LG 57%

On Global Convergence Rates for Federated Softmax Policy Gradient under Heterogeneous Environments

关于在异构环境中联邦Softmax策略梯度的全局收敛率

Safwan Labbi, Paul Mangold, Daniil Tiapkin, Eric Moulines

机构 * CMAP, CNRS, École Polytechnique, Institut Polytechnique de Paris(巴黎综合理工学院CMAP实验室,法国国家科学研究中心) Université Paris-Saclay, CNRS, LMO(巴黎萨克雷大学,法国国家科学研究中心,数学与建模实验室) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) LRE EPITA(EPITA 研究与工程实验室)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 本文研究了在异构环境中联邦Softmax策略梯度算法的收敛率,证明了其在平均代理价值方面的近优策略收敛,并通过投影类操作符获得了熵正则化策略梯度的首次明确常数收敛率。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13911 2026-04-02 eess.IV cs.AI cs.CV 57%

Bronchovascular Tree-Guided Weakly Supervised Learning Method for Pulmonary Segment Segmentation

基于支气管血管树的弱监督学习方法用于肺叶分割

Ruijie Zhao, Zuopeng Tan, Xiao Xue, Longfei Zhao, Bing Li, Zicheng Liao, Ying Ming, Jiaru Wang, Ran Xiao, Sirong Piao, Rui Zhao, Qiqi Xu, Wei Song

机构 * Department of Radiology, Peking Union Medical College Hospital, Chinese Academy of Medical Sciences and Peking Union Medical College(中国医学科学院北京协和医学院北京协和医院放射科) Canon Medical Systems (China)(佳能医疗系统(中国))

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文提出基于支气管血管树的弱监督学习方法,通过利用临床解剖定义进行肺叶分割,结合两阶段分割策略和一致性损失提升分割效果。

Journal ref J Digit Imaging. Inform. med. (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00281 2026-04-02 cs.AI 57%

Human-in-the-Loop Control of Objective Drift in LLM-Assisted Computer Science Education

人机协同控制LLM辅助计算机科学教育中的目标漂移

Mark Dranias, Adam Whitley

机构 * Asheville Institute for Memory and Longevity(阿什维尔记忆与长寿研究所) University of North Carolina Asheville(北卡罗来纳大学阿什维尔分校)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文提出一种人机协同的教学方法,通过分离规划与执行,训练学生在代码生成前指定接受标准和架构约束,以稳定AI辅助学习过程。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00264 2026-04-02 cs.LG 57%

Autonomous Adaptive Solver Selection for Chemistry Integration via Reinforcement Learning

自主适应求解器选择用于化学积分的强化学习

Eloghosa Ikponmwoba, Opeoluwa Owoyele

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 本文提出基于强化学习的自适应求解器选择方法,通过马尔可夫决策过程自主选择隐式BDF求解器和准稳态求解器,提升化学积分效率,同时保持精度约束。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00074 2026-04-02 cs.LG cs.CY 57%

PASM: Population Adaptive Symbolic Mixture-of-Experts Model for Cross-location Hurricane Evacuation Decision Prediction

PASM:用于跨地点飓风疏散决策预测的群体自适应符号混合专家模型

Xiao Qian, Shangjia Dong

机构 * University of Delaware(特拉华大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出PASM模型,通过符号回归与混合专家架构,解决跨地点疏散决策预测中的泛化问题,实现高准确率和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00043 2026-04-02 cs.PL cs.AI 57%

DriftScript: A Domain-Specific Language for Programming Non-Axiomatic Reasoning Agents

DriftScript: 一种用于编程非公理推理代理的领域特定语言

Seamus Brady

机构 * Independent Researcher(独立研究员)

专题命中 规划决策 :autonomous agent(abstract);分类 cs.AI

AI总结 DriftScript是一种Lisp-like领域特定语言,用于编译非公理推理系统NARS的Narsese,通过可读的关键词S表达式替代符号语法,提升程序的可读性、可写性和可维护性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13841 2026-04-02 cs.AI 57%

LocationReasoner: Evaluating LLMs on Real-World Site Selection Reasoning

LocationReasoner: 评估大语言模型在真实世界选址推理中的能力

Miho Koda, Yu Zheng, Ruixian Ma, Mingyang Sun, Devesh Pansare, Fabio Duarte, Paolo Santi

专题命中 规划决策 :agentic(abstract);分类 cs.AI

AI总结 本文提出LocationReasoner基准测试,评估大语言模型在复杂现实选址场景中的推理能力,发现先进模型在实际应用中表现有限,且代理策略常因过度推理而效果不佳。

Comments ICLR 2026 Workshop on Efficient Spatial Reasoning

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00969 2026-04-02 cs.CV 50%

DLWM: Dual Latent World Models enable Holistic Gaussian-centric Pre-training in Autonomous Driving

DLWM:双潜在世界模型实现自动驾驶中的整体高斯中心预训练

Yiyao Zhu, Ying Xue, Haiming Zhang, Guangfeng Jiang, Wending Zhou, Xu Yan, Jiantao Gao, Yingjie Cai, Bingbing Liu, Zhen Li, Shaojie Shen

机构 * HKUST(香港科技大学) CUHK-SZ(香港中文大学(深圳)) USTC(中国科学技术大学) Huawei Foundation Model Department(华为基础模型部门)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出DLWM,通过双潜在世界模型实现自动驾驶中的整体高斯中心预训练,提升3D占用感知、4D占用预测和运动规划性能。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00906 2026-04-02 hep-ex 50%

Site-specific ILC Detector Installation Plan

ILC探测器特定位置安装计划

Karsten Buesser, Thomas Schoerner

专题命中 规划决策 :planning(abstract)

AI总结 本文讨论了ILC探测器ILD和SiD的安装计划,强调了复杂性和前期规划的重要性,需考虑具体现场和项目条件。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00792 2026-04-02 cs.CV 50%

HICT: High-precision 3D CBCT reconstruction from a single X-ray

HICT: 从单张X射线实现高精度3D CBCT重建

Wen Ma, Jiaxiang Liu, Zikai Xiao, Ziyang Wang, Feng Yang, Zuozhu Liu

机构 * Zhejiang University(浙江大学) Angelalign Technology Inc.(时代天使科技有限公司)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出HICT框架,通过视频扩散模型生成多视角投影并结合动态注意力网络与X射线采样策略,实现高精度CBCT重建,实验表明其在临床应用中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00699 2026-04-02 physics.soc-ph 50%

Public transport in the 15-minute city

15分钟城市的公共交通

Zsófia Zádor, Gergő Pintér, Máté Mizsák, Bence Kovács, Imre Felde, Balázs Lengyel

专题命中 规划决策 :planning(abstract)

AI总结 本文提出将公共交通纳入15分钟城市模型的框架,通过比较赫尔辛基、马德里和布达佩斯,展示多模式交通如何提升对设施的可达性并增强社会空间整合。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00597 2026-04-02 cs.CV 50%

Towards Viewpoint-Robust End-to-End Autonomous Driving with 3D Foundation Model Priors

面向视角鲁棒的端到端自动驾驶与3D基础模型先验

Hiroki Hashimoto, Hiromichi Goto, Hiroyuki Sugai, Hiroshi Kera, Kazuhiko Kawamoto

机构 * Chiba University(千叶大学) National Institute of Informatics(国立信息学研究所)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出一种无需数据增强的端到端自动驾驶方法,利用3D基础模型的几何先验提升视角变化鲁棒性,实验显示在pitch和高度扰动下性能提升显著。

Comments Accepted at CVPR Workshop on Simulation for Autonomous Driving 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00430 2026-04-02 cs.MA cs.CR 50%

Secure Forgetting: A Framework for Privacy-Driven Unlearning in Large Language Model (LLM)-Based Agents

安全遗忘:一种隐私驱动的大型语言模型(LLM)基于代理的去学习框架

Dayong Ye, Tainqing Zhu, Congcong Zhu, Feng He, Qi He, Shang Wang, Bo Liu, Wanlei Zhou

专题命中 规划决策 :agent(abstract)

AI总结 本文提出了一种针对LLM基于代理的去学习框架,通过分类三种去学习场景,引入基于自然语言的去学习方法,提升隐私保护下的知识遗忘能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00348 2026-04-02 physics.ao-ph nlin.CD 50%

Gray Swan Factory: Making Extreme Events from Ordinary Cyclones

灰天鹅工厂:从普通气旋中制造极端事件

Gregory J. Hakim, Aishwarya Agrawal

专题命中 规划决策 :planning(abstract)

AI总结 本文提出通过梯度下降生成灰天鹅,即潜在但未观测到的极端事件,用于灾害研究和预测,但模型未解析飓风核心,影响未知。

Comments 14 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27317 2026-04-02 cs.RO 50%

Where-to-Learn: Analytical Policy Gradient Directed Exploration for On-Policy Robotic Reinforcement Learning

Where-to-Learn: 分析性策略梯度引导的在线机器人强化学习探索

Leixin Chang, Xinchen Yao, Ben Liu, Liangjing Yang, Hua Chen

专题命中 规划决策 :agent(abstract)

AI总结 本文提出利用可微动力学模型的分析性策略梯度,引导机器人强化学习探索更优轨迹,提升策略学习效率和质量。

Comments 8 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24506 2026-04-02 cs.CV 50%

Toward Physically Consistent Driving Video World Models under Challenging Trajectories

迈向在挑战性轨迹下物理一致的驾驶视频世界模型

Jiawei Zhou, Zhenxin Zhu, Lingyi Du, Linye Lyu, Lijun Zhou, Zhanqian Wu, Hongcheng Luo, Zhuotao Tian, Bing Wang, Guang Chen, Hangjun Ye, Haiyang Sun, Yu Li

机构 * Zhejiang University(浙江大学) Xiaomi EV(小米电动汽车) The Hong Kong Polytechnic University(香港理工大学) Shenzhen Loop Area Institute(深圳河套学院)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出PhyGenesis,通过物理条件生成器和物理增强视频生成器,解决挑战性轨迹下视频生成的物理不一致问题,实验表明其在复杂轨迹上表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10441 2026-04-02 cs.RO 50%

KnowDiffuser: A Knowledge-Guided Diffusion Planner with LLM Reasoning

KnowDiffuser: 一种基于知识的扩散规划器与大语言模型推理

Fan Ding, Xuewen Luo, Fengze Yang, Bo Yu, HwaHui Tew, Ganesh Krishnasamy, Junn Yong Loo

机构 * Monash University Malaysia(莫纳什大学马来西亚校区) University of Utah(犹他大学)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出KnowDiffuser,结合大语言模型的语义理解和扩散模型的生成能力,有效解决自动驾驶中语义到物理的鸿沟问题,实验表明其在开放环和闭环评估中表现优异。

Comments 10pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17312 2026-04-02 cs.CV 50%

CodeDance: A Dynamic Tool-integrated MLLM for Executable Visual Reasoning

CodeDance: 一种动态集成工具的多模态大语言模型用于可执行视觉推理

Qi Song, Honglin Li, Yingchen Yu, Haoyi Zhou, Lin Yang, Song Bai, Qi She, Zilong Huang, Yunqing Zhao

机构 * Beihang University(北京航空航天大学) Westlake University(西湖大学) ByteDance Singapore(字节跳动新加坡) ByteDance China(字节跳动中国)

专题命中 规划决策 :tool use(abstract)

AI总结 CodeDance通过可执行代码实现视觉推理,结合多工具协作与自检机制,提升复杂任务的灵活性和可解释性,实验显示其在多个基准测试中优于现有方法。

Comments CVPR 2026. Project page: https://codedance-vl.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11216 2026-04-02 math.NA cs.CV cs.NA 50%

Coupled Reconstruction of 2D Blood Flow and Vessel Geometry from Noisy Images via Physics-Informed Neural Networks and Quasi-Conformal Mapping

通过物理信息神经网络和准共形映射从噪声图像中耦合重建二维血流和血管几何

Han Zhang, Xue-Cheng Tai, Jean-Michel Morel, Raymond H. Chan

机构 * Department of Mathematics, City University of Hong Kong(香港城市大学数学系) Hong Kong Centre for Cerebro-Cardiovascular Health Engineering(香港心脑血管健康工程研究中心) Norwegian Research Centre (NORCE)(挪威研究中心) Department of Operations and Risk Management and the School of Data Science, Lingnan University(岭南大学运营与风险管理系及数据科学学院)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出利用物理信息神经网络和准共形映射从噪声图像中耦合重建二维血流和血管几何,通过交替高斯-塞德尔方法迭代优化,有效去除噪声并提升血流图像质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00202 2026-04-02 cs.RO 50%

DreamControl-v2: Simpler and Scalable Autonomous Humanoid Skills via Trainable Guided Diffusion Priors

DreamControl-v2:通过可训练引导扩散先验实现更简单且可扩展的自主人形技能

Sudarshan Harithas, Sangkyung Kwak, Pushkal Katara, Srujan Deolasee, Dvij Kalaria, Srinath Sridhar, Sai Vemprala, Ashish Kapoor, Jonathan Chung-Kuan Huang

机构 * General Robotics, USA(美国通用机器人公司) Brown University, USA(美国布朗大学) University of California, Berkeley, USA(美国加州大学伯克利分校)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出改进的DreamControl框架,通过在人形机器人运动空间中训练引导扩散模型,整合多样化的人类和机器人数据集,提升技能范围和自动化程度,验证了生成参考轨迹的扩展性对下游RL策略的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00162 2026-04-02 cs.RO 50%

Long-Horizon Geometry-Aware Navigation among Polytopes via MILP-MPC and Minkowski-Based CBFs

基于MILP-MPC和Minkowski基础CBF的多面体间长周期几何感知导航

Yi-Hsuan Chen, Salman Ghori, Ania Adil, Eric Feron, Calin Belta

机构 * University of Maryland, College Park(马里兰大学帕克分校) KAUST(阿卜杜拉国王科技大学)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出一种分层规划控制框架,结合MILP-MPC生成轨迹并利用Minkowski差空间的符号距离CBF确保几何安全,实验证明在复杂环境中实现安全实时导航。

Comments 8 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00075 2026-04-02 q-bio.GN 50%

Large Language Models for Variant-Centric Functional Evidence Mining

基于变体的函数证据挖掘的大型语言模型

Ali Saadat, Jacques Fellay

专题命中 规划决策 :agentic(abstract)

AI总结 本文提出利用大型语言模型挖掘变体功能证据,通过基准测试评估两种模型在文献筛选和证据提取中的表现,开发了AcmGENTIC管道以提升功能证据整理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏