arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-04-24 至 2026-04-24 共收录 92 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 9 篇

2604.21590 2026-04-24 cs.CL 89%

AgenticQwen: Training Small Agentic Language Models with Dual Data Flywheels for Industrial-Scale Tool Use

AgenticQwen:通过双数据飞轮训练小型代理语言模型以实现工业级工具使用

Yuanjie Lyu, Chengyu Wang, Haonan Zheng, Yuanhao Yue, Junbing Yan, Ming Wang, Jun Huang

机构 * Alibaba Group(阿里巴巴集团)

专题命中 工具调用 :tool use(title,abstract);agentic(title,abstract);agent(abstract);分类 cs.CL

AI总结 本文提出AgenticQwen模型,通过多轮强化学习在合成数据和有限开源数据上训练,结合推理强化学习和代理强化学习的双数据飞轮,提升工业场景下的多步骤推理和工具使用能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20994 2026-04-24 cs.CR cs.AI cs.CL 88%

Breaking MCP with Function Hijacking Attacks: Novel Threats for Function Calling and Agentic Models

打破MCP:函数劫持攻击:函数调用和代理模型的新威胁

Yannis Belkhiter, Giulio Zizzo, Sergio Maffeis, Seshu Tirupathi, John D. Kelleher

机构 * IBM Research Europe(IBM欧洲研究院) Trinity College Dublin(三一学院都柏林) Imperial College London(帝国理工学院伦敦) ADAPT Research Centre(ADAPT研究中心)

专题命中 工具调用 :function calling(title,abstract);agentic(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出了一种新的函数劫持攻击,通过操纵代理模型的工具选择过程,迫使调用特定攻击者选择的函数,展示了代理模型在函数调用接口上的新漏洞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21255 2026-04-24 cs.CL 83%

When Agents Look the Same: Quantifying Distillation-Induced Similarity in Tool-Use Behaviors

当代理看起来相同:量化蒸馏诱导的工具使用行为相似性

Chenghao Yang, Yuning Zhang, Zhoufutu Wen, Tao Gong, Jiaheng Liu, Qi Chu, Nenghai Yu

机构 * School of Cyber Science and Technology, USTC(USTC计算机科学与技术学院) Anhui Province Key Laboratory of Digital Security(安徽省数字安全重点实验室) M-A-P

专题命中 工具调用 :tool-use(title,abstract);agent(abstract);分类 cs.CL

AI总结 本文提出两种新指标RPS和AGS,用于区分任务成功必需行为与模型自主偏好,通过评估18个模型发现AGS能区分教师特定收敛与通用改进。

Comments Accepted by ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12867 2026-04-24 cs.AI 83%

QuarkMedSearch: A Long-Horizon Deep Search Agent for Exploring Medical Intelligence

QuarkMedSearch: 一种长Horizon深度搜索代理用于探索医学智能

Zhichao Lin, Zhichao Liang, Gaoqiang Liu, Meng Xu, Baoyu Xiang, Shuxin Zhao, Yao Wu, Jian Xu, Guanjun Jiang

机构 * Qwen Applications Business Group, Alibaba(阿里巴巴文库应用事业部)

专题命中 工具调用 :agent(title);planning(abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出QuarkMedSearch,通过构建医疗多跳数据、训练策略和评估基准,提升垂直领域性能。采用两阶段SFT和RL训练策略,结合大规模医疗知识图谱和实时探索生成长Horizon训练数据,实验显示其在开源模型中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01493 2026-04-24 cs.LG cs.AI 62%

OpInf-LLM: Parametric PDE Solving with LLMs via Operator Inference

OpInf-LLM:通过算子推断实现基于LLM的参数PDE求解

Zhuoyuan Wang, Hanjiang Hu, Xiyu Deng, Saviz Mowlavi, Yorie Nakahira

机构 * Carnegie Mellon University(卡内基梅隆大学) Mitsubishi Electric Research Laboratories(三菱电机研究实验室)

专题命中 工具调用 :tool use(abstract);分类 cs.AI、cs.LG

AI总结 本文提出OpInf-LLM框架,利用少量解数据实现多样PDE实例的准确预测,支持自然语言任务指定和物理基础推理,降低计算需求并提高异构环境下的求解成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21073 2026-04-24 cond-mat.mtrl-sci cs.AI 57%

Generative Discovery of Magnetic Insulators under Competing Physical Constraints

在竞争物理约束下发现磁绝缘体的生成发现

Qiulin Zeng, Tahiya Chowdhury, Md Shafayat Hossain

机构 * Department of Math, University of Southern California(数学系,南加州大学) Department of Computer Science, Colby College(计算机科学系,科尔比学院) California NanoSystems Institute, University of California, Los Angeles(加州大学洛杉矶分校加州纳米系统研究所)

专题命中 工具调用 :workflow(abstract);分类 cs.AI

AI总结 本文提出MagMatLLM框架,通过生成和进化选择结合第一性原理验证,发现十二种新磁绝缘体,展示了在稀疏化学空间中多目标材料发现的通用方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18792 2026-04-24 cs.SE cs.SC 57%

Tractable Verification of Model Transformations: A Cutoff-Theorem Approach for DSLTrans

可验证的模型转换:基于截止定理的DSLTrans方法

Levi Lucio

专题命中 工具调用 :workflow(abstract);分类 cs.SE

AI总结 本文提出了一种可验证的DSLTrans转换验证流程,通过截止定理证明了有限模型检查的完备性,并结合优化方法和实现,提高了验证效率和准确性。

Comments 41 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21125 2026-04-24 cs.DC 50%

A Cloud-Native Architecture for Human-in-Control LLM-Assisted OpenSearch in Investigative Settings

面向调查场景的云原生架构:人类控制的LLM辅助OpenSearch

Benjamin Puhani, Kai Brehmer, Malte Prieß

专题命中 工具调用 :workflow(abstract)

AI总结 本文提出一种云原生微服务架构,用于在私有云环境中处理复杂犯罪调查中的非结构化证据和语言与技术搜索逻辑间的语义鸿沟,通过整合大语言模型实现自然语言查询到OpenSearch领域特定语言的转换,结合BM25和语义向量嵌入进行混合检索,建立系统基础架构以支持未来评估。

Journal ref Proceedings of the 17th International Conference on Cloud Computing, GRIDs, and Virtualization (CLOUD COMPUTING 2026), p. 62-65, Lisbon, Portugal, April 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08972 2026-04-24 cond-mat.mtrl-sci 50%

Selective Random Structure Search (SRSS): Unbiased Exploration of Polymorphs in Crystals

选择性随机结构搜索(SRSS):晶体多形体的无偏探索

Jiexi Song, Diwei Shi, Aixian She, Chongde Cao, Fengyuan Xuan

专题命中 工具调用 :workflow(abstract)

AI总结 SRSS通过结合对称约束随机生成与特征多样性选择,高效探索晶体材料的构型空间,发现多种新多形体,无需GPU加速即可实现无偏搜索。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 31 篇

2604.20869 2026-04-24 cs.CY cs.AI cs.HC cs.IR cs.LG 84%

Clinical Reasoning AI for Oncology Treatment Planning: A Multi-Specialty Case-Based Evaluation

肿瘤治疗规划的临床推理AI:多专科基于病例的评估

Philippe E. Spiess, Md Muntasir Zitu, Alison Walker, Daniel A. Anaya, Robert M. Wenham, Michael Vogelbaum, Daniel Grass, Ali-Musa Jaffer, Amod Sarnaik, Caitlin McMullen, Christine Sam, John V. Kiluk, Tianshi Liu, Tiago Biachi, Julio Powsang, Jing-Yi Chern, Roger Li, Seth Felder, Samuel Reynolds, Michael Shafique, Alison Sheehan, Ashley Layman, Cydney A. Warfield, Derrick Legoas, Jaclyn Parrinello, Jena Schmitz, Kevin Eaton, Mark Honor, Luis Felipe, Issam ElNaqa, Elier Delgado, Talia Berler, Rachael V. Phillips, Frantz Francisque, Carlos Garcia Fernandez, Gilmer Valdes

机构 * Moffitt Cancer Center and Research Institute(莫菲特癌症中心与研究学院) Innova Montréal Inc.(蒙特利尔创新公司) Oncobrain, Inc.(Oncobrain公司) Advanced Cancer Treatment Centers(先进癌症治疗中心)

专题命中 规划决策 :planning(title,abstract);workflow(abstract);分类 cs.AI、cs.LG

AI总结 本文评估了OncoBrain在多专科病例中的表现,展示了其在肿瘤治疗规划中的准确性、安全性和实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21453 2026-04-24 cs.CV 82%

Instance-level Visual Active Tracking with Occlusion-Aware Planning

实例级视觉主动跟踪与遮挡感知规划

Haowei Sun, Kai Zhou, Hao Gao, Shiteng Zhang, Jinwu Hu, Xutao Wen, Qixiang Ye, Mingkui Tan

机构 * South China University of Technology(南方科技大学) Pazhou Laboratory(Pazhou实验室) Key Laboratory of Big Data and Intelligent Robot, Ministry of Education(教育部大数据与智能机器人重点实验室) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出OA-VAT方法,通过实例感知原型初始化、在线原型增强跟踪和遮挡感知轨迹规划模块,解决遮挡和相似干扰问题,实现高精度实时跟踪。

Comments CVPR 2026 Poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17656 2026-04-24 cs.SD cs.AI cs.CL cs.CV cs.LG 82%

Video-Robin: Autoregressive Diffusion Planning for Intent-Grounded Video-to-Music Generation

Video-Robin:基于意图的视频到音乐生成的自回归扩散规划

Vaibhavi Lokegaonkar, Aryan Vijay Bhosale, Vishnu Raj, Gouthaman KV, Ramani Duraiswami, Lie Lu, Sreyan Ghosh, Dinesh Manocha

机构 * University of Maryland College Park(马里兰大学College Park分校) Dolby Laboratories(杜比实验室) NVIDIA(英伟达)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 Video-Robin通过结合自回归规划与扩散合成,实现高质量的语义对齐音乐生成,相比传统方法在速度和质量上均有显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07262 2026-04-24 cs.HC 82%

ColorBrowserAgent: Complex Long-Horizon Browser Agent with Adaptive Knowledge Evolution

ColorBrowserAgent:具有自适应知识演化的复杂长 horizon 浏览器代理

Jihong Wang, Jiamu Zhou, Weiming Zhang, Teng Wang, Weiwen Liu, Zhuosheng Zhang, Xingyu Lou, Weinan Zhang, Huarong Deng, Jun Wang

专题命中 规划决策 :agent(title,abstract);autonomous agent(abstract)

AI总结 本文提出ColorBrowserAgent,通过人类在环的知识适应和知识对齐的渐进总结机制,解决网页自动化中的长周期不稳定性与领域特定先验知识缺乏问题,实验表明其在WebArena和工业部署中均表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15468 2026-04-24 cs.SE cs.AI 82%

The Semi-Executable Stack: Agentic Software Engineering and the Expanding Scope of SE

半可执行堆栈:智能软件工程与SE范围的扩展

Robert Feldt, Per Lenberg, Julian Frattini, Dhasarathy Parthasarathy

机构 * Chalmers University of Technology(挑战者技术大学) Volvo Group(沃尔沃集团)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.SE

AI总结 本文探讨了软件工程领域因AI系统发展而扩展的范围,提出半可执行堆栈模型以分析可执行代码与非可执行 artifacts 的结合,通过三个案例研究重新定义工程目标,提供保留与净化的决策框架。

Comments This paper is the write-up of Robert Feldt's keynote "Agentic Software Engineering Will Eat the World: AI-Based Systems as the New Operating System of Society'' given at the Agentic Engineering 2026 workshop, Rio de Janeiro, Brazil, April 14, 2026. April 23 upload fixed the reference list to be more complete, and added a few additional citations; text essentially unchanged

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21253 2026-04-24 cs.CL cs.AI 81%

Planning Beyond Text: Graph-based Reasoning for Complex Narrative Generation

超越文本的规划:基于图的复杂叙事生成推理

Hanwen Gu, Chao Guo, Junle Wang, Wenda Xie, Yisheng Lv

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Tencent Turing Lab(腾讯人工智能实验室)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出PLOTTER框架,通过结构图进行叙事规划,提升LLM在复杂叙事生成中的长上下文推理能力。

Comments Accepted to Findings of the Association for Computational Linguistics: ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21354 2026-04-24 cs.LG 79%

Decoupled Travel Planning with Behavior Forest

解耦行为森林中的旅行计划

Duanyang Yuan, Sihang Zhou, Yanning Hou, Xiaoshu Chen, Haoyuan Chen, Ke Liang, Jiyuan Liu, Chuan Ma, Xinwang Liu, Jian Huang

机构 * College of Intelligence Science and Technology, National University of Defense Technology(智能科学与技术学院,国防科技大学) College of Computer Science and Technology, National University of Defense Technology(计算机科学与技术学院,国防科技大学) College of Systems Engineering, National University of Defense Technology(系统工程学院,国防科技大学) College of Computer Science, Chongqing University(计算机科学学院,重庆大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.LG

AI总结 本文提出行为森林方法,通过解耦复杂任务和约束到可管理的子空间,提升大语言模型在多约束旅行计划中的性能,实验表明在TravelPlanner和ChinaTravel基准上分别优于现有方法6.67%和11.82%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21138 2026-04-24 cs.RO cs.AI 79%

Navigating the Clutter: Waypoint-Based Bi-Level Planning for Multi-Robot Systems

在杂乱中导航:基于路标的目标级规划用于多机器人系统

Jiabao Ji, Yongchao Chen, Yang Zhang, Ramana Rao Kompella, Chuchu Fan, Gaowen Liu, Shiyu Chang

机构 * UC Santa Barbara(加州大学圣芭芭拉分校) Massachusetts Institute of Technology(麻省理工学院) Harvard University(哈佛大学) MIT-IBM Watson AI Lab(MIT-IBM沃森人工智能实验室) Cisco Research(思科研究)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出了一种混合多机器人控制框架,通过引入路标和课程训练策略,解决多机器人任务和运动规划的联合优化问题,提升了任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06498 2026-04-24 cs.CL astro-ph.IM 79%

Spec-o3: A Tool-Augmented Vision-Language Agent for Rare Celestial Object Candidate Vetting via Automated Spectral Inspection

Spec-o3:一种工具增强的视觉-语言代理,用于通过自动化光谱检查验证稀有天体候选体

Minghui Jia, Qichao Zhang, Ali Luo, Linjing Li, Shuo Ye, Hailing Lu, Wen Hou, Dongbin Zhao

机构 * SKL-MAIS, Institute of Automation, CAS(SKL-MAIS,自动化研究所,中国科学院) School of Advanced Interdisciplinary Sciences, UCAS(交叉科学学院,中国科学院大学) National Astronomical Observatories, CAS(国家天文台,中国科学院) School of Artificial Intelligence, UCAS(人工智能学院,中国科学院大学)

专题命中 规划决策 :agent(title,abstract);分类 cs.CL

AI总结 本文提出Spec-o3,一种工具增强的视觉-语言代理,通过多模态链式推理实现天文学家对稀有天体候选体的自动化光谱检查,提升验证效率和准确性。

Comments Accepted to ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21455 2026-04-24 cs.HC 78%

The Privacy Guardian Agent: Towards Trustworthy AI Privacy Agents

隐私守护代理:迈向可信AI隐私代理

Vincent Freiberger

专题命中 规划决策 :agent(title,abstract)

AI总结 本文提出隐私守护代理,通过用户资料和上下文感知自动化隐私同意选择,同时在不确定或高风险情况时通知用户,确保透明和用户自主权。

Comments Position paper for the CHI26 Workshop "Moving Beyond Clicks: Rethinking Consent and User Control in the Age of AI"

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21249 2026-04-24 cs.RO 78%

Reasoning About Traversability: Language-Guided Off-Road 3D Trajectory Planning

轨迹可 traversability 的推理:语言引导的越野3D轨迹规划

Byounggun Park, Soonmin Hwang

机构 * Department of Automotive Engineering, Hanyang University, Seoul, Republic of Korea(韩雅大学汽车工程系,首尔,大韩民国)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出语言精修框架与偏好优化策略,通过动作对齐监督和地形感知优化,提升越野3D轨迹规划的合规性与地形一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28758 2026-04-24 eess.SY cs.SY 78%

Distributionally Robust Planning with $\mathcal{L}_1$ Adaptive Control

具有$\mathcal{L}_1$自适应控制的分布鲁棒规划

Astghik Hakobyan, Amaras Nazarians, Aditya Gahlawat, Naira Hovakimyan, Ilya Kolmanovsky

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出DRP-$\mathcal{L}_1$AC框架,结合分布鲁棒模型预测控制与$\mathcal{L}_1$自适应控制,通过在线分布证书保证安全性和鲁棒性,无需分布样本即可处理系统和环境不确定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06283 2026-04-24 cs.RO 78%

Situationally-aware Path Planning Exploiting 3D Scene Graphs

基于3D场景图的情境感知路径规划

Saad Ejaz, Marco Giberna, Muhammad Shaheer, Jose Andres Millan-Romera, Ali Tourani, Paul Kremer, Holger Voos, Jose Luis Sanchez-Lopez

机构 * Automation and Robotics Research Group, Interdisciplinary Centre for Security, Reliability and Trust, University of Luxembourg(自动化与机器人研究组,安全、可靠与信任跨学科研究中心,卢森堡大学) Faculty of Science, Technology and Medicine, University of Luxembourg(科学、技术与医学学院,卢森堡大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出S-Path路径规划器,利用室内3D场景图的度量-语义结构提升规划效率,通过两阶段流程生成可理解的高层路径,并通过并行子问题分解和重计划机制提高复杂场景下的效率和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21489 2026-04-24 cs.RO cs.AI 74%

MISTY: High-Throughput Motion Planning via Mixer-based Single-step Drifting

MISTY:基于混合器的单步漂移高吞吐量运动规划

Yining Xing, Zehong Ke, Yiqian Tu, Zhiyuan Liu, Wenhao Yu, Jianqiang Wang

机构 * School of Vehicle and Mobility, Tsinghua University(清华大学车辆与移动系统学院) State Key Laboratory of Intelligent Green Vehicle and Mobility, Tsinghua University(清华大学智能绿色车辆与移动系统国家重点实验室)

专题命中 规划决策 :planning(title);分类 cs.AI

AI总结 MISTY通过混合器单步漂移方法实现高吞吐量运动规划,利用变分自编码器和轻量级MLP-Mixer解码器,结合隐空间漂移损失,提升轨迹生成效率与鲁棒性。

Comments 8 pages, 4 figures, 3 tables. Submitted to IEEE Robotics and Automation Letters (RA-L)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20505 2026-04-24 cs.CL cs.AI 73%

RELOOP: Recursive Retrieval with Multi-Hop Reasoner and Planners for Heterogeneous QA

RELOOP:基于多跳推理与规划器的异构问答递归检索

Ruiyi Yang, Hao Xue, Imran Razzak, Hakim Hacid, Flora D. Salim

机构 * University of New South Wales(新南威尔士大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Mohamed Bin Zayed University of Artificial Intelligence(莫扎伊德大学人工智能学院) Technology Innovation Institute(技术创新研究所)

专题命中 规划决策 :agent(abstract);agentic(abstract);分类 cs.AI、cs.CL

AI总结 RELOOP通过递归检索和结构感知迭代,提升多步问题和异构证据源的问答准确性,实现高效率的证据收集与答案生成。

Comments 19 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21399 2026-04-24 cs.DC cs.NI 71%

A Task Decomposition and Planning Framework for Efficient LLM Inference in AI-Enabled WiFi-Offload Networks

一种用于AI赋能Wi-Fi卸载网络中高效LLM推理的任务分解与规划框架

Mingqi Han, Xinghua Sun

专题命中 规划决策 :planning(title)

AI总结 本文提出一种用户-边缘协作框架,通过LLM规划器实现任务分解与子任务难度预测,优化多用户多边缘Wi-Fi网络中的子任务分配与执行,降低延迟并提升整体性能。

Comments 7 pages, 4 figures, conference version

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03248 2026-04-24 cs.CL 70%

STReasoner: Empowering LLMs for Spatio-Temporal Reasoning in Time Series via Spatial-Aware Reinforcement Learning

STReasoner: 通过空间感知强化学习赋能LLMs进行时间序列的时空推理

Juntong Ni, Shiyu Wang, Qi He, Ming Jin, Wei Jin

机构 * Emory University(埃默里大学) Microsoft(微软) Griffith University(格里菲斯大学)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.CL

AI总结 本文提出STReasoner,通过整合时间序列、图结构和文本,提升LLMs的时空推理能力,采用S-GRPO算法增强空间逻辑,实验显示在低成本下取得显著准确率提升。

Comments ACL 2026 Main, we release our code publicly at https://github.com/LingFengGold/STReasoner

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08927 2026-04-24 cs.MA 67%

Beyond the Individual: Virtualizing Multi-Disciplinary Reasoning for Clinical Intake via Collaborative Agents

超越个体:通过协作代理虚拟化多学科推理以实现临床摄入

Huangwei Chen, Wu Li, Junhao Jia, Yining Chen, Xiaotao Pang, YaLong Chen, Gonghui Li, Haishuai Wang, Jiajun Bu, Lei Wu

专题命中 规划决策 :agent(abstract);multi-agent(abstract)

AI总结 本文提出Aegle框架,通过图基多代理架构在门诊咨询中实现多学科推理,提升文档质量和诊断准确性。

Comments Accepted to ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04573 2026-04-24 cs.LG cs.AI cs.CL 67%

LaDiR: Latent Diffusion Enhances LLMs for Text Reasoning

LaDiR:潜在扩散增强大语言模型进行文本推理

Haoqiang Kang, Yizhe Zhang, Nikki Lijing Kuang, Nicklas Majamaki, Navdeep Jaitly, Yi-An Ma, Lianhui Qin

机构 * University of California, San Diego(加州大学圣迭戈分校) Apple(苹果公司)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 LaDiR通过结合连续潜在表示的表达力与潜在扩散模型的迭代精炼能力,提升大语言模型在文本推理中的准确性、多样性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21357 2026-04-24 cs.AI cs.CL 62%

ReaGeo: Reasoning-Enhanced End-to-End Geocoding with LLMs

ReaGeo:基于大语言模型的推理增强端到端地名编码

Jian Cui, Zhiyuan Ren, Desheng Weng, Yongqi Zhao, Gong Wenbin, Yu Lei, Zhenning Dong

机构 * Amap, Alibaba Group(阿里巴巴集团阿地图) Tsinghua University(清华大学)

专题命中 规划决策 :workflow(abstract);分类 cs.AI、cs.CL

AI总结 ReaGeo利用大语言模型解决传统多阶段方法在地理数据库中依赖文本或向量相似性检索的局限性,通过将坐标转换为geohash序列,引入链式推理机制提升空间关系推理能力,并通过距离偏差奖励的强化学习优化生成精度。

Comments 12 pages, 8 figures, submitted to ACM SIGSPATIAL 2024 (under review)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21092 2026-04-24 cs.AI cs.SE 62%

Mind the Prompt: Self-adaptive Generation of Task Plan Explanations via LLMs

注意提示:通过LLMs实现自我适应的任务计划解释生成

Gricel Vázquez, Alexandros Evangelidis, Sepeedeh Shahbeigi, Radu Calinescu, Simos Gerasimou

机构 * University of York, UK(英国约克大学) Cyprus University of Technology, Cyprus(塞浦路斯技术大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.SE

AI总结 本文提出COMPASS方法,通过将提示工程建模为认知和概率决策过程,实现复杂任务规划系统中自适应的解释生成和提示优化。

详情

展开后加载摘要…

URL PDF HTML 收藏