arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-04-03 至 2026-04-03 共收录 105 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 8 篇

2604.02023 2026-04-03 cs.CR cs.AI 89%

APEX: Agent Payment Execution with Policy for Autonomous Agent API Access

APEX:基于策略的自主代理API访问支付执行

Mohd Safwan Uddin, Mohammed Mouzam, Mohammed Imran, Syed Badar Uddin Faizan

专题命中 工具调用 :agent(title,abstract);autonomous agent(title,abstract);agentic(abstract);分类 cs.AI

AI总结 APEX提出了一种适应法币系统的自主代理支付框架,通过HMAC签名短时令牌实现安全支付流程,实验显示政策控制可减少27.3%的总支出并保持52.8%的合法请求成功率。

Comments 13 pages, 4 figures, 8 tables. Includes implementation details, experimental evaluation with statistical analysis, and reproducible results. Code and data available upon request

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22862 2026-04-03 cs.SE cs.CL 86%

The Evolution of Tool Use in LLM Agents: From Single-Tool Call to Multi-Tool Orchestration

大语言模型代理中工具使用的演变:从单工具调用到多工具编排

Haoyuan Xu, Chang Li, Xinyan Ma, Xianhao Ou, Zihan Zhang, Tao He, Xiangyu Liu, Zixiang Wang, Jiafeng Liang, Zheng Chu, Runxuan Liu, Rongchuan Mu, Dandan Tu, Ming Liu, Bing Qin

机构 * Harbin Institute of Technology(哈尔滨工业大学) Harvard University(哈佛大学) Huawei Technologies Co., Ltd.(华为技术有限公司)

专题命中 工具调用 :tool use(title,abstract);agent(abstract);planning(abstract);分类 cs.CL、cs.SE

AI总结 本文探讨了大语言模型代理中工具使用从单次调用到长期编排的演变,分析了多工具代理的最新进展,涵盖任务规划、安全控制、效率优化及实际应用等领域。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23752 2026-04-03 cs.CV 80%

ThinkGeo: Evaluating Tool-Augmented Agents for Remote Sensing Tasks

ThinkGeo: 评估用于遥感任务的工具增强代理

Akashah Shabbir, Muhammad Akhtar Munir, Akshay Dudhane, Muhammad Umer Sheikh, Muhammad Haris Khan, Paolo Fraccaro, Juan Bernabe Moreno, Fahad Shahbaz Khan, Salman Khan

机构 * Mohamed bin Zayed University of AI(穆罕默德·本·扎耶德人工智能大学) IBM Research(IBM研究院) Linköping University(林雪平大学) Australian National University(澳大利亚国立大学)

专题命中 工具调用 :tool use(abstract);tool-use(abstract);planning(abstract);agentic(abstract)

AI总结 ThinkGeo是一个针对遥感任务设计的代理基准,评估LLM驱动代理在结构化工具使用和多步骤规划中的能力,通过人类 curated 查询和专家验证的推理步骤测试不同模型的工具准确性和规划一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02155 2026-04-03 cs.CL 77%

Brief Is Better: Non-Monotonic Chain-of-Thought Budget Effects in Function-Calling Language Agents

简洁即更好:函数调用语言代理中的非单调链式思维预算效应

Xuan Qi

机构 * IIIS, Tsinghua University(清华大学交叉信息研究院)

专题命中 工具调用 :agent(abstract);tool-use(abstract);function calling(abstract);分类 cs.CL

AI总结 研究探讨了链式思维预算对函数调用代理性能的影响,发现简短的链式思维显著提升准确性,而延长的链式思维反而降低性能,提出Function-Routing CoT方法提升可靠性。

Comments 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20755 2026-04-03 cs.LG cs.AI stat.ML 62%

Provable Benefits of In-Tool Learning for Large Language Models

大语言模型中工具学习的可证明优势

Sam Houliston, Ambroise Odonnat, Charles Arnal, Vivien Cabannes

机构 * ETH Zürich(苏黎世联邦理工学院) Inria, Univ. Rennes 2(法国国家信息与自动化研究所,雷恩第二大学) FAIR at Meta(Meta FAIR实验室)

专题命中 工具调用 :tool-use(abstract);分类 cs.AI、cs.LG

AI总结 本文探讨了工具学习在事实回忆中的优势,证明通过工具可实现无限制的事实回忆,优于单纯记忆。

Journal ref ICLR 2026 MemAgents Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.30031 2026-04-03 cs.AI 57%

Cognitive Friction: A Decision-Theoretic Framework for Bounded Deliberation in Tool-Using Agents

认知摩擦:一种决策理论框架,用于工具使用智能体的有限推理

Davide Di Gioia

专题命中 工具调用 :tool use(abstract);分类 cs.AI

AI总结 本文提出Triadic Cognitive Architecture框架,通过认知摩擦建模决策过程,提升资源利用效率和行动速度,实验显示在EMDG和NSTG环境中优于贪心基线。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29018 2026-04-03 math.NA cs.NA 50%

Discrete Poincare and Bogovskii operators on cochains and Whitney forms

离散的庞加莱和博戈维斯基算子在余链和惠特尼形式上

Johnny Guzmán, Anil N. Hirani, Bingyan Liu, Pratyush Potu

专题命中 工具调用 :tool use(abstract)

AI总结 本文构造了作用于余链和惠特尼形式的离散庞加莱算子,并探讨了其在不同域假设下的构造方法,同时提出了满足同伦恒等式的离散博戈维斯基算子。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07508 2026-04-03 cs.CE econ.GN q-fin.EC 50%

The Pandora's Box Problem with Sequential Inspections

潘多拉之盒问题与序列检查

Ali Aouad, Jingwei Ji, Yaron Shaposhnik

专题命中 工具调用 :agent(abstract)

AI总结 研究潘多拉之盒问题的扩展形式,探讨信息获取与成本效率的权衡,分析最优策略结构并提出近优解,通过数值研究比较不同策略性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 38 篇

2510.16082 2026-04-03 q-bio.QM cs.AI cs.LG 90%

BIOGEN: Evidence-Grounded Multi-Agent Reasoning Framework for Transcriptomic Interpretation in Antimicrobial Resistance

BIOGEN:基于证据的多智能体推理框架用于抗菌药物耐药性中的转录组解释

Elias Hossain, Mehrdad Shoeibi, Ivan Garibay, Niloofar Yousefi

机构 * College of Engineering and Computer Science, University of Central Florida(中佛罗里达大学工程与计算机科学学院)

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);agentic(abstract);分类 cs.AI、cs.LG

AI总结 BIOGEN通过结合生物信息检索、结构化推理和多批评验证,生成可追溯的转录组模块解释,其在抗菌药物耐药性研究中表现出强生物学基础和零幻觉率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01681 2026-04-03 cs.RO cs.AI 88%

Bridging Large-Model Reasoning and Real-Time Control via Agentic Fast-Slow Planning

通过代理快慢规划弥合大模型推理与实时控制

Jiayi Chen, Shuai Wang, Guangxu Zhu, Chengzhong Xu

机构 * Shenzhen Research Institute of Big Data, The Chinese University of Hong Kong (Shenzhen)(深圳市大数据研究院,香港中文大学(深圳)) Shenzhen Institutes of Advanced Technology (SIAT), Chinese Academy of Sciences(中国科学院深圳先进技术研究院) State Key Laboratory of Internet of Things for Smart City (SKL-IOTSC), University of Macau(澳门大学智慧城市物联网国家重点实验室)

专题命中 规划决策 :planning(title,abstract);agentic(title,abstract);分类 cs.AI

AI总结 本文提出一种分层框架,通过感知-决策-轨迹-控制的分离,提升自动驾驶系统在扰动下的鲁棒性,减少侧向偏移和完成时间。

Comments 8 pages, 12figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02279 2026-04-03 cs.AI cs.MA q-fin.GN q-fin.PM 85%

The Self Driving Portfolio: Agentic Architecture for Institutional Asset Management

自主驾驶型投资组合:面向机构资产管理部门的智能架构

Andrew Ang, Nazym Azimbayev, Andrey Kim

机构 * Tau Balance Columbia University(哥伦比亚大学) Altbridge

专题命中 规划决策 :agentic(title,abstract);agent(abstract);autonomous agent(abstract);分类 cs.AI

AI总结 本文提出一个智能架构,通过50个专门代理生成资本市场假设,使用20种竞争方法构建投资组合,并相互批评和投票。研究代理提出新方法,元代理比较历史预测与实际回报,优化代理代码和提示以提高未来表现。

Comments 31 pages, 11 exhibits

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01599 2026-04-03 cs.AI 83%

ByteRover: Agent-Native Memory Through LLM-Curated Hierarchical Context

ByteRover:通过LLM-curated分层上下文实现代理原生内存

Andy Nguyen, Danh Doan, Hoang Pham, Bao Ha, Dat Pham, Linh Nguyen, Hieu Nguyen, Thien Nguyen, Cuong Do, Phat Nguyen, Toan Nguyen

机构 * ByteRover

专题命中 规划决策 :agent(title,abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出ByteRover,一种代理原生内存架构,通过LLM-curated分层上下文实现知识的结构化存储与检索,实验显示其在LoCoMo和LongMemEval上表现优异,无需外部基础设施。

Comments 19 pages, 3 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02289 2026-04-03 cs.DB 82%

Multi-Objective Agentic Rewrites for Unstructured Data Processing

多目标代理重写用于无结构数据处理

Lindsey Linxi Wei, Shreya Shankar, Sepanta Zeighami, Yeounoh Chung, Fatma Ozcan, Aditya G. Parameswaran

专题命中 规划决策 :agentic(title,abstract);planning(abstract)

AI总结 MOAR通过引入新的指令类别和全局搜索算法,提升DocETL在准确性和成本上的优化能力,实现更高的准确性并匹配最佳成本。

Comments 24 pages, 8 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09219 2026-04-03 cs.LG 79%

Planning in Branch-and-Bound: Model-Based Reinforcement Learning for Exact Combinatorial Optimization

在分支定界中的规划:基于模型的强化学习用于精确组合优化

Paul Strang, Zacharie Alès, Côme Bissuel, Olivier Juan, Safia Kedad-Sidhoum, Emmanuel Rachelson

专题命中 规划决策 :planning(title);agent(abstract);分类 cs.LG

AI总结 本文提出PlanB&B,一种基于模型的强化学习方法,用于改进分支定界中的分支策略,通过在四个标准MILP基准上优于现有方法的实验验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02006 2026-04-03 cs.AI 79%

ProCeedRL: Process Critic with Exploratory Demonstration Reinforcement Learning for LLM Agentic Reasoning

ProCeedRL: 带探索演示的强化学习过程批评用于LLM代理推理

Jingyue Gao, Yanjiang Guo, Xiaoshuai Chen, Jianyu Chen

机构 * Institute for Interdisciplinary Information Sciences, Tsinghua University(清华大学交叉信息研究院) Independent Researcher(独立研究者) Shanghai Qizhi Institute(上海期智研究院)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 本文提出ProCeedRL,通过过程批评和探索性演示提升LLM在多轮代理任务中的推理能力,解决探索过程中错误累积问题,提高探索效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01765 2026-04-03 cs.CV cs.AI cs.RO 79%

DriveDreamer-Policy: A Geometry-Grounded World-Action Model for Unified Generation and Planning

DriveDreamer-Policy: 一种基于几何的世界-动作模型用于统一生成与规划

Yang Zhou, Xiaofeng Wang, Hao Shao, Letian Wang, Guosheng Zhao, Jiangnan Shao, Jiagang Zhu, Tingdong Yu, Zheng Zhu, Guan Huang, Steven L. Waslander

机构 * GigaAI University of Toronto(多伦多大学) CUHK MMLab(香港中文大学多媒体实验室)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出DriveDreamer-Policy,结合深度生成、未来视频生成与运动规划,通过几何感知的世界表示提升生成与规划的连贯性与准确性。

Comments 11 pages, 4 figures; Project Website: https://drivedreamer-policy.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01434 2026-04-03 cs.AI 79%

Leveraging the Value of Information in POMDP Planning

利用信息价值进行POMDP规划

Zakariya Laouar, Qi Heng Ho, Zachary Sunberg

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出基于信息价值的动态规划框架和VOIMCP算法,通过高效利用信息价值减少计算开销,提升POMDP规划性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02190 2026-04-03 cs.CV cs.RO 78%

UniDriveVLA: Unifying Understanding, Perception, and Action Planning for Autonomous Driving

UniDriveVLA: 联合理解、感知与行动规划以实现自动驾驶

Yongkang Li, Lijun Zhou, Sixu Yan, Bencheng Liao, Tianyi Yan, Kaixin Xiong, Long Chen, Hongwei Xie, Bing Wang, Guang Chen, Hangjun Ye, Wenyu Liu, Haiyang Sun, Xinggang Wang

机构 * Huazhong University of Science and Technology(华中科技大学) SKL-IOTSC, University of Macau(澳门大学智慧城市物联网国家重点实验室)

专题命中 规划决策 :planning(title,abstract)

AI总结 UniDriveVLA通过专家解耦和三阶段训练策略,解决自动驾驶中感知与推理的冲突,实现空间感知与语义推理的统一,取得nuScenes和Bench2Drive的优异性能。

Comments code has been released at https://github.com/xiaomi-research/unidrivevla

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07576 2026-04-03 math.OC 78%

Optimizing a Worldwide-Scale Shipper Transportation Planning in a Carmaker Inbound Supply Chain

优化全球规模的汽车制造商 inbound 供应链货运规划

Mathis Brichet, Maximilian Schiffer, Axel Parmentier

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出一种定制化的迭代局部搜索算法,解决大规模货运规划问题,实现70万商品和120万条弧的计算实验,展示23.2%的成本节约潜力,并在雷诺汽车部署,年节省约2000万欧元。

Comments 40 pages, 27 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01882 2026-04-03 cs.CV 78%

A3R: Agentic Affordance Reasoning via Cross-Dimensional Evidence in 3D Gaussian Scenes

A3R: 通过跨维度证据进行3D高斯场景中的代理 affordance 推理

Di Li, Jie Feng, Guanbin Li, Ronghua Shang, Yuhui Zheng, Weisheng Dong, Guangming Shi

机构 * Xidian University(西安电子科技大学) Sun Yat-sen University(中山大学) Qinghai Normal University(青海师范大学)

专题命中 规划决策 :agentic(title,abstract)

AI总结 本文提出A3R框架,通过跨维度证据获取提升复杂3D高斯场景中细粒度affordance推理的准确性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01428 2026-04-03 math.OC 78%

Rendezvous Planning from Sparse Observations of Optimally Controlled Targets

从最优控制目标的稀疏观测中进行会合规划

Thomas A. Scott, Lukas Taus, Yen-Hsi Richard Tsai, Tan Bui-Thanh, Justin G. R. Delva

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出一种概率框架,用于在稀疏、噪声观测下规划会合点,结合滤波方法和高斯过程校正,以估计目标轨迹并选择最优会合点,确保在不确定性下做出统计一致的决策。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15961 2026-04-03 cs.RO 78%

IA-TIGRIS: An Incremental and Adaptive Sampling-Based Planner for Online Informative Path Planning

IA-TIGRIS: 一种用于在线信息路径规划的增量和自适应采样规划器

Brady Moon, Nayana Suvarna, Andrew Jong, Satrajit Chatterjee, Junbin Yuan, Muqing Cao, Sebastian Scherer

机构 * Robotics Institute, School of Computer Science, Carnegie Mellon University(卡内基梅隆大学计算机科学学院机器人研究所) Department of Mechanical Engineering, Brigham Young University(杨百翰大学机械工程系)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出IA-TIGRIS,一种用于实时任务的增量和自适应采样路径规划方法,通过增量优化和动态更新信念地图,提升信息获取效率,实验证明其在无人机应用中信息增益提升达38%。

Comments Published in IEEE Transactions on Robotics, 19 pages, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01738 2026-04-03 cs.AI 70%

AeroTherm-GPT: A Verification-Centered LLM Framework for Thermal Protection System Engineering Workflows

AeroTherm-GPT:一种面向热防护系统工程工作流的验证中心LLM框架

Chuhan Qiao, Jinglai Zheng, Jie Huang, Buyue Zhao, Fan Li, Haiming Huang

机构 * School of Civil Engineering, Beijing Jiaotong University(北京交通大学土木工程学院) Beijing Research Institute of Telemetry(北京遥测技术研究所)

专题命中 规划决策 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 本文提出AeroTherm-GPT,一种专为热防护系统设计的LLM代理,通过约束闭环生成框架解决超音速热防护系统设计中生成可执行仿真工具时的约束冲突问题,实现高效率的根因修复。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02318 2026-04-03 cs.RO cs.CV 67%

Stop Wandering: Efficient Vision-Language Navigation via Metacognitive Reasoning

停止游荡:通过元认知推理实现高效的视觉-语言导航

Xueying Li, Feng Lyu, Hao Wu, Mingliu Liu, Jia-Nan Liu, Guozi Liu

机构 * Central South University(中南大学) Nanjing University(南京大学) State Grid Hubei Electric Power Research Institute(国网湖北省电力有限公司电力科学研究院) Dongguan University of Technology(东莞理工学院)

专题命中 规划决策 :agent(abstract);planning(abstract)

AI总结 本文提出MetaNav,通过整合空间记忆、历史感知规划和反思修正,提升视觉-语言导航的效率与鲁棒性,实验显示其在多个基准上表现优异,减少了20.7%的VLM查询。

Comments 10 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02226 2026-04-03 cs.AI cs.LG 62%

When to ASK: Uncertainty-Gated Language Assistance for Reinforcement Learning

何时提问:用于强化学习的不确定性门控语言帮助

Juarez Monteiro, Nathan Gavenski, Gianlucca Zuin, Adriano Veloso

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出ASK方法,通过结合小型语言模型和训练好的RL策略,提升模型在分布外任务中的泛化能力,通过不确定性门控机制选择性利用语言模型进行决策,实验显示其在迁移任务中表现稳健。

Comments In Proceedings of International Joint Conference on Neural Networks (IJCNN)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01264 2026-04-03 eess.IV cs.AI cs.IR cs.LG cs.NE 62%

OkanNet: A Lightweight Deep Learning Architecture for Classification of Brain Tumor from MRI Images

OkanNet:一种轻量级深度学习架构用于从MRI图像中分类脑肿瘤

Okan Uçar, Murat Kurt

机构 * Graduate School of Natural Applied Sciences Department of Computer Engineering Ege University Izmir, Turkey International Computer Institute Ege University Izmir, Turkey

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出OkanNet和基于ResNet-50的迁移学习方法,用于自动检测和分类脑肿瘤,OkanNet在计算效率上表现优异,训练时间较ResNet-50快3.2倍,准确率88.10%。

Comments 7 pages, 3 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25040 2026-04-03 cs.LG cs.CL cs.CV 62%

Intern-S1-Pro: Scientific Multimodal Foundation Model at Trillion Scale

Intern-S1-Pro:万亿参数科学多模态基础模型

Yicheng Zou, Dongsheng Zhu, Lin Zhu, Tong Zhu, Yunhua Zhou, Peiheng Zhou, Xinyu Zhou, Dongzhan Zhou, Zhiwang Zhou, Yuhao Zhou, Bowen Zhou, Zhanping Zhong, Zhijie Zhong, Haiteng Zhao, Penghao Zhao, Xiaomeng Zhao, Zhiyuan Zhao, Yechen Zhang, Jin Zhang, Wenwei Zhang, Hongjie Zhang, Zhuo Zhang, Wenlong Zhang, Bo Zhang, Chao Zhang, Chen Zhang, Yuhang Zang, Fei Yuan, Jiakang Yuan, Jiashuo Yu, Jinhui Yin, Haochen Ye, Qian Yao, Bowen Yang, Danni Yang, Kaichen Yang, Ziang Yan, Jun Xu, Yicheng Xu, Wanghan Xu, Xuenan Xu, Chao Xu, Ruiliang Xu, Shuhao Xing, Long Xing, Xinchen Xie, Ling-I Wu, Zijian Wu, Zhenyu Wu, Lijun Wu, Yue Wu, Jianyu Wu, Wen Wu, Fan Wu, Xilin Wei, Qi Wei, Bingli Wang, Rui Wang, Ziyi Wang, Zun Wang, Yi Wang, Haomin Wang, Yizhou Wang, Lintao Wang, Yiheng Wang, Longjiang Wang, Bin Wang, Jian Tong, Zhongbo Tian, Huanze Tang, Chen Tang, Shixiang Tang, Yu Sun, Qiushi Sun, Xuerui Su, Qisheng Su, Chenlin Su, Demin Song, Jin Shi, Fukai Shang, Yuchen Ren, Pengli Ren, Xiaoye Qu, Yuan Qu, Jiantao Qiu, Yu Qiao, Biqing Qi, Runyu Peng, Tianshuo Peng, Jiahui Peng, Qizhi Pei, Zhuoshi Pan, Linke Ouyang, Wenchang Ning, Yichuan Ma, Zerun Ma, Ningsheng Ma, Runyuan Ma, Chengqi Lyu, Haijun Lv, Han Lv, Lindong Lu, Kuikun Liu, Jiangning Liu, Yuhong Liu, Kai Liu, Hongwei Liu, Zhoumianze Liu, Mengjie Liu, Ziyu Liu, Wenran Liu, Yang Liu, Liwei Liu, Kaiwen Liu, Junyao Lin, Junming Lin, Tianyang Lin, Dahua Lin, Jianze Liang, Linyang Li, Peiji Li, Zonglin Li, Zehao Li, Pengze Li, Guoyan Li, Lingkai Kong, Linglin Jing, Zhenjiang Jin, Feifei Jiang, Qian Jiang, Junhao Huang, Zixian Huang, Haian Huang, Zhouqi Hua, Ermo Hua, Han Hu, Linfeng Hou, Yinan He, Conghui He, Tianyao He, Xu Guo, Qipeng Guo, Aijia Guo, Yuzhe Gu, Lixin Gu, Jingyang Gong, Qiming Ge, Jiaye Ge, Songyang Gao, Jianfei Gao, Xinyu Fang, Caihua fan, Yue Fan, Yanhui Duan, Zichen Ding, Shengyuan Ding, Ning Ding, Xuanlang Dai, Erfei Cui, Ganqu Cui, Pei Chu, Tao Chu, Guangran Cheng, Yu Cheng, Kai Chen, Yongkang Chen, Chiyu Chen, Guanzhou Chen, Qiaosheng Chen, Sitao Chen, Xin Chen, Haojiong Chen, Yicheng Chen, Weihan Cao, Yuhang Cao, Qinglong Cao, Lei Bai

机构 * Shanghai AI Laboratory(上海人工智能实验室)

专题命中 规划决策 :agent(abstract);分类 cs.CL、cs.LG

AI总结 Intern-S1-Pro是首个万亿参数科学多模态基础模型,具备跨通用与科学领域的能力提升,融合强推理、图像-文本理解及先进代理能力,专精于100余项科学任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08640 2026-04-03 cs.SE cs.AI 62%

Automating Android Build Repair: Bridging the Reasoning-Execution Gap in LLM Agents with Domain-Specific Tools

自动化Android构建修复:通过领域特定工具弥合LLM代理中的推理-执行差距

Ha Min Son, Huan Ren, Xin Liu, Zhe Zhao

机构 * University of California, Davis(加州大学戴维斯分校) CodeDroid LLC(CodeDroid有限责任公司)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.SE

AI总结 本文提出AndroidBuildBench基准和GradleFixer工具,通过领域特定抽象提升LLM修复Android构建错误的效率,解决LLM在低层执行中的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02097 2026-04-03 cs.CV cs.LG 57%

LatentUM: Unleashing the Potential of Interleaved Cross-Modal Reasoning via a Latent-Space Unified Model

LatentUM:通过潜在空间统一模型释放交错跨模态推理的潜力

Jiachun Jin, Zetong Zhou, Xiao Yang, Hao Zhang, Pengfei Liu, Jun Zhu, Zhijie Deng

机构 * Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出LatentUM,通过共享语义潜在空间实现跨模态推理与生成,提升计算效率并减少编码器偏差,取得视觉空间规划基准的最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02035 2026-04-03 q-fin.MF cs.LG math.OC q-fin.CP q-fin.TR 57%

Reinforcement Learning for Speculative Trading under Exploratory Framework

在探索框架下用于投机交易的强化学习

Yun Zhao, Alex S. L. Tse, Harry Zheng

机构 * Imperial College(帝国理工学院) University College London(伦敦大学学院)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 本文研究了在探索强化学习框架下,基于一般效用函数和价格过程的连续最优停止问题,提出了一种基于Cox过程的跳跃时间模型,并通过熵正则化得到最优策略。

Comments 37 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏