arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-03-19 至 2026-03-19 共收录 142 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 9 篇

2509.21240 2026-03-19 cs.LG cs.AI 84%

Tree Search for LLM Agent Reinforcement Learning

基于树搜索的LLM代理强化学习

Yuxiang Ji, Ziyu Ma, Yong Wang, Guanhua Chen, Xiangxiang Chu, Liaoni Wu

机构 * Xiamen University(厦门大学) AMAP, Alibaba Group(阿里集团AMAP实验室) Southern University of Science and Technology(南方科技大学)

专题命中 工具调用 :agent(title,abstract);agentic(abstract);分类 cs.AI、cs.LG

AI总结 本文提出Tree-GRPO方法,通过树结构提升LLM代理在长期任务中的表现,利用树搜索共享前缀以增加rollout数量,并通过理论分析证明其与直接偏好学习等效。

Comments ICLR 2026, Code: https://github.com/AMAP-ML/Tree-GRPO

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17392 2026-03-19 cs.MA cs.IR q-bio.NC 82%

Agentic Cognitive Profiling: Realigning Automated Alzheimer's Disease Detection with Clinical Construct Validity

代理认知画像:重新对齐自动阿尔茨海默病检测与临床构念效度

Jiawen Kang, Kun Li, Dongrui Han, Jinchao Li, Junan Li, Lingwei Meng, Xixin Wu, Helen Meng

专题命中 工具调用 :agentic(title,abstract);function calling(abstract)

AI总结 本文提出Agentic Cognitive Profiling框架,通过分解标准化评估为原子认知任务,利用专门LLM代理提取可验证评分原语,提升自动筛查与临床协议逻辑的一致性,实现90.5%的任务匹配率和85.3%的AD预测准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11327 2026-03-19 cs.LG cs.CL 81%

Meta-Reinforcement Learning with Self-Reflection for Agentic Search

具有自我反思的元强化学习用于代理搜索

Teng Xiao, Yige Yuan, Hamish Ivison, Huaisheng Zhu, Faeze Brahman, Nathan Lambert, Pradeep Dasigi, Noah A. Smith, Hannaneh Hajishirzi

机构 * Allen Institute for AI(Allen人工智能研究所) University of Washington(华盛顿大学) Independent(独立)

专题命中 工具调用 :agentic(title,abstract);分类 cs.CL、cs.LG

AI总结 本文提出MR-Search,一种基于上下文的元强化学习框架,通过自我反思优化搜索策略,提升测试时探索效率,实验显示其在多个基准上表现优异。

Comments 23 pages, Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17239 2026-03-19 cs.CR 78%

LAAF: Logic-layer Automated Attack Framework A Systematic Red-Teaming Methodology for LPCI Vulnerabilities in Agentic Large Language Model Systems

LAAF:逻辑层自动攻击框架:一种针对代理大语言模型系统中LPCI漏洞的系统性红队方法

Hammad Atta, Ken Huang, Kyriakos Rock Lambros, Yasir Mehmood, Zeeshan Baig, Mohamed Abdur Rahman, Manish Bhatt, M. Aziz Ul Haq, Muhammad Aatif, Nadeem Shahzad, Kamal Noor, Vineeth Sai Narajala, Hazem Ali, Jamel Abed

专题命中 工具调用 :agentic(title,abstract)

AI总结 LAAF是首个结合特定技术分类和分阶段种子升级的自动化红队框架,通过49种技术分类生成大量独特负载,并通过持久化阶段突破器实现分阶段负载变异,有效提升阶段突破效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17055 2026-03-19 cs.CV 78%

PaAgent: Portrait-Aware Image Restoration Agent via Subjective-Objective Reinforcement Learning

PaAgent:通过主观-客观强化学习实现的面向人物图像修复代理

Yijian Wang, Qingsen Yan, Jiantao Zhou, Duwei Dai, Wei Dong

机构 * School of Computer Science, Northwestern Polytechnical University(西北工业大学计算机学院) Shenzhen Research Institute of Northwestern Polytechnical University(西北工业大学深圳研究院) State Key Laboratory of Internet of Things for Smart City, University of Macau(澳门大学智慧城市物联网国家重点实验室) National-Local Joint Engineering Research Center of Biodiagnosis and Biotherapy, the Second Affiliated Hospital of Xi’an Jiaotong University(西安交通大学生物诊断与生物治疗国家地方联合工程研究中心) College of Information and Control Engineering, Xi’an University of Architecture and Technology(西安建筑科技大学信息与控制工程学院)

专题命中 工具调用 :agent(title,abstract)

AI总结 PaAgent通过结合自进化的人物银行和检索增强生成技术,提升图像修复任务中对复杂场景的感知能力,通过主观-客观强化学习策略优化修复工具选择,实验验证其在多种修复基准上的优越性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16289 2026-03-19 cs.CV cs.AI 70%

VisBrowse-Bench: Benchmarking Visual-Native Search for Multimodal Browsing Agents

VisBrowse-Bench:多模态浏览代理的视觉原生搜索基准测试

Zhengbo Zhang, Jinbo Su, Zhaowen Zhou, Changtao Miao, Yuhan Hong, Qimeng Wu, Yumeng Liu, Feier Wu, Yihe Tian, Yuhao Liang, Zitong Shan, Wanke Xia, Yi-Fan Zhang, Bo Zhang, Zhe Li, Shiming Xiang, Ying Yan

机构 * CASIA Ant Digital Technologies Ant Group(蚂蚁集团数字技术部) RUC(清华大学) FZU(福建师范大学) THU(清华大学) USTB(北京科技大学) PKU(北京大学)

专题命中 工具调用 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 本文提出VisBrowse-Bench,用于评估多模态浏览代理的视觉推理能力,通过文本-图像检索和联合推理进行多模态证据交叉验证,验证了不同模型在搜索过程中的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17075 2026-03-19 cs.LG cs.AI cs.CC 62%

CircuitBuilder: From Polynomials to Circuits via Reinforcement Learning

CircuitBuilder: 通过强化学习从多项式到电路

Weikun K. Zhang, Rohan Pandey, Bhaumik Mehta, Kaijie Jin, Naomi Morato, Archit Ganapule, Michael Ruofan Zeng, Jarod Alper

机构 * University of Washington(华盛顿大学)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

AI总结 研究通过强化学习发现高效算术电路计算多项式的问题,比较PPO+MCTS和SAC方法,SAC在双变量目标上表现最佳,PPO+MCTS能扩展到三变量并提升更难实例性能。

Comments ICLR 2026 Workshop on AI with Recursive Self-Improvement

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16932 2026-03-19 cs.CV cs.AI 57%

Look Where It Matters: High-Resolution Crops Retrieval for Efficient VLMs

关注关键区域:为高效视觉语言模型的高分辨率作物检索

Nimrod Shabtay, Moshe Kimhi, Artem Spector, Sivan Haray, Ehud Rivlin, Chaim Baskin, Raja Giryes, Eli Schwartz

机构 * IBM Research(IBM研究院) Tel-Aviv University(特拉维夫大学) Technion(技术学院) Ben-Gurion University(本· Gurion大学)

专题命中 工具调用 :tool-use(abstract);分类 cs.AI

AI总结 AwaRes通过低分辨率全局视图和工具调用实现准确与效率的平衡,自动构建监督数据并结合复合奖励训练框架,提升视觉语言模型的检索效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17292 2026-03-19 cs.CR 50%

SEAL-Tag: Self-Tag Evidence Aggregation with Probabilistic Circuits for PII-Safe Retrieval-Augmented Generation

SEAL-Tag: 基于概率电路的自标签证据聚合用于PII安全检索增强生成

Jin Xie, Songze Li, Guang Cheng

专题命中 工具调用 :tool-use(abstract)

AI总结 SEAL-Tag通过概率电路和验证-路由范式,解决检索增强生成中隐私泄露问题,减少泄露8倍同时保持性能。

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 48 篇

2506.21982 2026-03-19 cs.RO cs.SY eess.SY 91%

A MILP-Based Solution to Multi-Agent Motion Planning and Collision Avoidance in Constrained Environments

基于混合整数线性规划的多智能体运动规划与碰撞避障方法

Akshay Jaitly, Jack Cline, Siavash Farzan

机构 * Robotics Engineering Department, Worcester Polytechnic Institute(沃斯特理工学院机器人工程系) Electrical Engineering Department, California Polytechnic State University(加州州立大学弗雷斯诺分校电子工程系)

专题命中 规划决策 :agent(title,abstract);planning(title,abstract);multi-agent(title,abstract)

AI总结 本文提出一种基于混合整数线性规划的多智能体运动规划方法,通过将多凸多边形动作规划嵌入序列-求解流程,利用大M超平面模型实现智能体间分离,并通过L1路径长度加加速度成本生成平滑轨迹。

Comments Accepted to 2025 IEEE International Conference on Automation Science and Engineering (CASE 2025). This arXiv version adds a supplementary appendix with figures not in the IEEE proceedings

Journal ref IEEE 21st International Conference on Automation Science and Engineering (CASE), 2025, pp. 2200-2207

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17626 2026-03-19 cs.CV 91%

A Multi-Agent System for Building-Age Cohort Mapping to Support Urban Energy Planning

一种多智能体系统用于建筑年龄队列映射以支持城市能源规划

Kundan Thota, Thorsten Schlachter, Veit Hagenmeyer

机构 * Institute for Automation(自动化研究所) Applied Informatics (IAI)(应用信息学(IAI)) Karlsruhe Institute of Technology (KIT)(卡尔斯鲁厄理工学院(KIT)) Karlsruhe, Germany(德国卡尔斯鲁厄)

专题命中 规划决策 :agent(title,abstract);planning(title,abstract);multi-agent(title,abstract)

AI总结 本文提出多智能体系统融合异构数据,通过BuildingAgeCNN实现建筑年龄分类,提升城市能源规划的准确性与可持续性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20991 2026-03-19 cs.AI cs.MA 90%

FinAgent: An Agentic AI Framework Integrating Personal Finance and Nutrition Planning

FinAgent:整合个人财务与营养规划的智能框架

Toqeer Ali Syed, Abdulaziz Alshahrani, Ali Ullah, Ali Akarma, Sohail Khan, Muhammad Nauman, Salman Jan

机构 * Faculty of Computer and Information System, Islamic University of Madinah, Saudi Arabia(麦加伊斯兰大学计算机与信息学院) Department of Computer Science, Effat College of Engineering, Effat University, Saudi Arabia(Effat大学工程学院计算机科学系) Arab Open University, Bahrain(巴林开放大学)

专题命中 规划决策 :planning(title,abstract);agentic(title,abstract);agent(abstract);multi-agent(abstract)

AI总结 本文提出一种价格敏感型智能系统,结合个人财务管理与饮食优化,通过模块化多智能体架构实现营养充足且价格合理的饮食计划,实验显示可减少12-18%的开支并提高营养充足率。

Comments This paper was presented at the IEEE International Conference on Computing and Applications (ICCA 2025), Bahrain

Journal ref Proceedings of the 2025 IEEE International Conference on Computing and Applications (ICCA), Bahrain, 2025, pp. 1-7

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17930 2026-03-19 cs.CV 82%

Interpretable Traffic Responsibility from Dashcam Video via Legal Multi Agent Reasoning

基于法律多智能体推理的可解释交通责任分析

Jingchun Yang, Jinchang Zhang

机构 * Northeast University(东北大学) SUNY Binghamton University(纽约州立大学布法罗分校)

专题命中 规划决策 :agent(title,abstract);multi-agent(abstract)

AI总结 本文提出C-TRAIL多模态数据集,结合视频与文本描述,通过两阶段框架实现交通责任判定,优于现有方法并提供透明法律推理过程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17459 2026-03-19 cs.RO 82%

P$^{3}$Nav: End-to-End Perception, Prediction and Planning for Vision-and-Language Navigation

P$^{3}$Nav: 端到端感知、预测与规划用于视觉-语言导航

Tianfu Li, Wenbo Chen, Haoxuan Xu, Xinhu Zheng, Haoang Li

机构 * HKUST(GZ)(香港科技大学(广州))

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 P$^{3}$Nav提出端到端框架,整合感知、预测与规划,提升视觉-语言导航agent的场景理解与导航成功率,实验显示在REVERIE、R2R-CE和RxR-CE基准上取得新状态-of-the-art性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14225 2026-03-19 cs.HC cs.AI cs.SE 81%

"I'm Not Reading All of That": Understanding Software Engineers' Level of Cognitive Engagement with Agentic Coding Assistants

我并非在读取所有内容:理解软件工程师对代理编码助手的认知参与度

Carlos Rafael Catalan, Lheane Marie Dizon, Patricia Nicole Monderin, Emily Kuang

机构 * York University(约克大学)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.SE

AI总结 研究探讨软件工程师在使用代理编码助手时的认知参与度变化,指出当前设计缺乏反思和验证机制,提出通过更丰富的交互方式和认知强制机制来提升深度思考。

Comments 7 pages, 5 figures, 2 tables, published and presented in CHI 2026 Workshop on Tools for Thought

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15797 2026-03-19 cs.LG cs.AI 81%

OMNIFLOW: A Physics-Grounded Multimodal Agent for Generalized Scientific Reasoning

OMNIFLOW:一种基于物理的多模态代理用于通用科学推理

Hao Wu, Yongheng Zhang, Yuan Gao, Fan Xu, Fan Zhang, Ruobing Xie, Ruijian Gou, Yuxuan Liang, Xiaomeng Huang, Xian Wu

机构 * Tsinghua University(清华大学) Tencent(腾讯) Shenzhen Loop Area Institute(深圳河套学院) Ocean University of China(海洋大学) HKUST (Guangzhou)(香港科技大学(广州))

专题命中 规划决策 :agent(title);workflow(abstract);分类 cs.AI、cs.LG

AI总结 OMNIFLOW通过引入语义-符号对齐机制和物理引导的推理流程,实现了多模态模型在物理定律下的科学推理,显著提升了零样本泛化和少样本适应能力,提供透明且物理一致的推理报告。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10492 2026-03-19 cs.CL 79%

Human-AI Co-reasoning for Clinical Diagnosis with Evidence-Integrated Language Agent

人机协同推理用于临床诊断:证据整合语言代理

Zhongzhen Huang, Yan Ling, Hong Chen, Ye Feng, Li Wu, Linjie Mu, Shaoting Zhang, Xiaofan Zhang, Kun Qian, Xiaomu Li

专题命中 规划决策 :agent(title,abstract);分类 cs.CL

AI总结 本文提出PULSE,结合领域调优的大语言模型与文献检索,支持复杂病例的诊断决策。实验显示PULSE在专家级准确度上表现优异,且在罕见病病例中保持稳定性能,揭示了语言模型在临床诊断中的潜力与局限。

Comments After further evaluation, we have decided to withdraw the current version of this manuscript for further revision. We plan to add new experiments, improve the writing and overall presentation for greater clarity and coherence, and re-examine the dataset and related descriptions to ensure rigor and reliability before submitting an updated version

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17583 2026-03-19 cs.CV cs.AI 79%

Edit-As-Act: Goal-Regressive Planning for Open-Vocabulary 3D Indoor Scene Editing

Edit-As-Act:面向开放词汇3D室内场景编辑的目标回归规划

Seongrae Noh, SeungWon Seo, Gyeong-Moon Park, HyeongYeop Kang

机构 * Korea University(韩国大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出Edit-As-Act框架,通过目标回归规划实现开放词汇3D室内场景编辑,解决传统方法在生成和物理一致性上的不足,实验表明其在多个编辑任务中表现优异。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16967 2026-03-19 cs.CV cs.AI 79%

MSRAMIE: Multimodal Structured Reasoning Agent for Multi-instruction Image Editing

MSRAMIE:多模态结构推理代理用于多指令图像编辑

Zhaoyuan Qiu, Ken Chen, Xiangwei Wang, Yu Xia, Sachith Seneviratne, Saman Halgamuge

机构 * University Of Melbourne(墨尔本大学)

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 MSRAMIE基于多模态大语言模型构建无需训练的代理框架,通过结构化多模态推理处理多指令图像编辑任务,提升复杂指令遵循度和完成概率,同时保持图像质量和一致性。

Comments 14 pages, 6 figures, 3 tables, appendix and references provided

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17895 2026-03-19 cs.CV 78%

A Creative Agent is Worth a 64-Token Template

一个创意代理值得一个64-token模板

Ruixiao Shi, Fu Feng, Yucheng Xie, Xu Yang, Jing Wang, Xin Geng

机构 * School of Computer Science and Engineering, Southeast University, Nanjing, China(1 南京大学计算机科学与工程学院) Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications (Southeast University), Ministry of Education, China(2 教育部新一代人工智能技术及其跨学科应用关键实验室(东南大学))

专题命中 规划决策 :agent(title,abstract)

AI总结 本文提出CAT框架,通过创意令牌化提升文本到图像生成的创造力,实现3.7倍速度提升和4.8倍计算成本降低,生成图像更受人类偏好。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15359 2026-03-19 cs.RO 78%

NavThinker: Action-Conditioned World Models for Coupled Prediction and Planning in Social Navigation

NavThinker: 用于社交导航中耦合预测与规划的行动条件世界模型

Tianshuai Hu, Zeying Gong, Lingdong Kong, XiaoDong Mei, Yiyi Ding, Qi Zeng, Ao Liang, Rong Li, Yangyi Zhong, Junwei Liang

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) National University of Singapore(新加坡国立大学) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 NavThinker通过结合行动条件世界模型与on-policy强化学习,解决社交导航中机器人动作与人类运动相互影响的耦合预测-规划问题,实现未来感知的导航状态对齐与路径规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14697 2026-03-19 cs.MA 78%

Forecast-Aware Cooperative Planning on Temporal Graphs under Stochastic Adversarial Risk

面向随机对抗风险的时序图上协作规划

Manshi Limbu, Xuan Wang, Gregory J. Stein, Daigo Shishika, Xuesu Xiao

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出一种面向随机对抗风险的时序图协作规划框架,通过整合随机风险预测与前瞻性支持分配,有效降低团队总预期成本,接近理想规划器性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.10924 2026-03-19 cs.RO 78%

PAAMP: Polytopic Action-Set And Motion Planning for Long Horizon Dynamic Motion Planning via Mixed Integer Linear Programming

PAAMP:基于多边形动作集和混合整数线性规划的长时间动态运动规划

Akshay Jaitly, Siavash Farzan

机构 * Robotics Engineering Department, Worcester Polytechnic Institute(沃斯特理工学院机器人工程系) Electrical Engineering Department, California Polytechnic State University(加州州立大学弗雷斯诺分校电子工程系)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出PAAMP方法,通过多边形动作集将长时间动态运动规划转化为混合整数线性规划问题,用于解决复杂动态系统中的运动规划与约束满足问题。

Comments Accepted to 2024 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2024). 8 pages, 10 figures

Journal ref IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), 2024, pp. 7617-7624

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17236 2026-03-19 cs.RO cs.CV 78%

Neural Radiance Maps for Extraterrestrial Navigation and Path Planning

神经辐射图用于外星导航和路径规划

Adam Dai, Shubh Gupta, Grace Gao

机构 * Stanford University(斯坦福大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出利用神经辐射场构建地图,用于自主导航中的路径规划,通过整合局部和全局信息,实现更高效的路径规划。

Comments Published in the Proceedings of the ION GNSS+ 2023 Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17232 2026-03-19 cs.RO 78%

Full Stack Navigation, Mapping, and Planning for the Lunar Autonomy Challenge

月球自主性挑战的全栈导航、制图与规划

Adam Dai, Asta Wu, Keidai Iiyama, Guillem Casadesus Vila, Kaila Coimbra, Thomas Deng, Grace Gao

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出了一种模块化全栈自主系统,用于月球表面导航与制图,在GNSS拒止和视觉挑战环境下,结合语义分割、立体视觉里程计、位图SLAM与分层规划控制,实现了厘米级定位精度和高保真制图。

Comments Published in the Proceedings of the ION GNSS+ 2025 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17022 2026-03-19 cs.RO cs.SY eess.SY 78%

Contingency-Aware Planning via Certified Neural Hamilton-Jacobi Reachability

通过认证的神经哈密顿-雅可比可达性进行 contingency 意识规划

Kasidit Muenprasitivej, Derya Aksaray

机构 * Department of Electrical and Computer Engineering, Northeastern University(电气与计算机工程系,东北大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出一种结合学习可达性与采样规划的多目标导航框架,利用FNO近似解算器解决高维HJ方程,提供理论安全保证并验证在Webots仿真中实时部署的性能。

Comments 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18945 2026-03-19 cs.CV cs.RO 78%

Echo Planning for Autonomous Driving: From Current Observations to Future Trajectories and Back

自动驾驶中的回声规划:从当前观测到未来轨迹及回溯

Jintao Sun, Hu Zhang, Gangyi Ding, Zhedong Zheng

机构 * School of Computer Science and Technology, Beijing Institute of Technology, China(北京理工大学计算机科学与技术学院) CSIRO DATA61, Australia(澳大利亚CSIRO DATA61) Faculty of Science and Technology and Institute of Collaborative Innovation, University of Macau, Macau SAR, China(澳门大学科学与技术学院及协同创新研究院)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出EchoP框架,通过建立当前-未来-当前循环,使轨迹预测与场景一致性协调。实验表明,该方法在nuScenes上减少L2误差并降低碰撞率,且在闭环评估中表现优异,无需额外监督。

Comments 12 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17155 2026-03-19 cs.SI cs.SY eess.SY 75%

On Online Control of Opinion Dynamics

关于在线控制意见动态

Sheryl Paul, Leslie Cruz Juarez, Jyotirmoy V. Deshmukh, Ketan Savla

专题命中 规划决策 :agent(abstract);planning(abstract);multi-agent(abstract)

AI总结 本文研究了在个体对影响的易感性未知的情况下,如何通过在线算法估计该参数并驱动意见向目标收敛,分析了在预算或时间约束下稳定性与收敛性的条件。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17425 2026-03-19 cs.AI 74%

Proactive Knowledge Inquiry in Doctor-Patient Dialogue: Stateful Extraction, Belief Updating, and Path-Aware Action Planning

医生-患者对话中的主动知识探究:状态提取、信念更新与路径感知的动作规划

Zhenhai Pan, Yan Liu, Jia You

机构 * The Hong Kong Polytechnic University(香港理工大学)

专题命中 规划决策 :planning(title);分类 cs.AI

AI总结 本文提出了一种基于部分可观测性的主动知识探究框架,通过状态提取、信念更新和路径感知动作规划,提升电子病历生成的覆盖性和准确性。

Comments 12 pages, 2 figures, 5 tables. Pilot concept demonstration under a controlled simulated setting

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17692 2026-03-19 cs.LG cs.AI q-fin.CP q-fin.PM 73%

Can Blindfolded LLMs Still Trade? An Anonymization-First Framework for Portfolio Optimization

盲folded LLMs仍能进行交易吗?一个以匿名化优先的资产组合优化框架

Joohyoung Jeon, Hongchul Lee

机构 * Korea University(韩国大学) Mirae Asset Securities(美亚证券)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种以匿名化为核心的资产组合优化框架,通过盲fold LLMs来验证市场信号的合法性,实验显示在2025年期间实现了1.40的夏普比率,并通过负控实验验证信号的有效性。

Comments Accepted at the ICLR 2026 Workshop on Advances in Financial AI (FinAI). 18 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏