arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 11017 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 11017 篇

2607.01942 2026-07-03 cs.AI 新提交 79%

Atomic Task Graph: A Unified Framework for Agentic Planning and Execution

原子任务图:智能体规划与执行的统一框架

Yue Zhang, Sihan Chen, Ziwen Huang, Hanyun Cui, Kangye Ji, Zhi Wang

机构 * South China University of Technology(华南理工大学) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 提出原子任务图(ATG)框架,通过显式图结构暴露子任务依赖、支持并行执行和局部错误修复,在三个交互基准上使用7B-8B模型显著提升成功率和执行效率。

Comments 14 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01440 2026-07-03 cs.CL 新提交 79%

FaithMed: Training LLMs For Faithful Evidence-Based Medical Reasoning

FaithMed: 训练大语言模型进行忠实于证据的医学推理

Zhiyun Zhang, Liwen Sun, Xiang Qian, Chenyan Xiong

机构 * Carnegie Mellon University(卡内基梅隆大学) Stanford University School of Medicine(斯坦福大学医学院) Xlue

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL

AI总结 提出FaithMed框架,通过过程级奖励和优势分组强化学习,监督LLM在医学推理中忠实评估和应用检索证据,在7个基准上平均提升9%。

Comments 15 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15588 2026-07-03 cs.CL 版本更新 79%

YuFeng-XGuard: A Reasoning-Centric, Interpretable, and Flexible Guardrail Model for Large Language Models

YuFeng-XGuard:一种以推理为中心、可解释且灵活的大语言模型护栏模型

Junyu Lin, Meizhen Liu, Xiufeng Huang, Jinfeng Li, Haiwen Hong, Xiaohan Yuan, Yuefeng Chen, Longtao Huang, Hui Xue, Ranjie Duan, Zhikai Chen, Yuchuan Fu, Defeng Li, Lingyao Gao, Yitong Yang

机构 * Alibaba-AAIG(阿里云-阿里人工智能研究院)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL

AI总结 提出YuFeng-XGuard护栏模型系列,通过结构化风险预测(含风险类别、置信度分数及自然语言解释)实现可解释的多维风险感知,并采用分层推理范式平衡延迟与解释深度,同时引入动态策略机制解耦风险感知与策略执行。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00147 2026-07-02 cs.AI 新提交 79%

RareDxR1: Autonomous Medical Reasoning for Rare Disease Diagnosis Beyond Human Annotation

RareDxR1:超越人类标注的罕见病诊断自主医学推理

Deyang Jiang, Haoran Wu, Ziyi Wang, Yiming Rong, Yunlong Zhao, Ye Jin, Bo Xu

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 提出端到端推理大模型RareDxR1,通过知识内化与自主进化学习框架,结合反思增强推理采样和双级课程强化学习,直接从非结构化临床笔记诊断罕见病,无需依赖结构化表型或人类标注,在多个基准上达到最先进准确率。

Comments 7 pages, 3 figures. Accepted to IEEE International Conference on Multimedia and Expo (ICME) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31800 2026-07-01 cs.AI 新提交 79%

Evo-PI: Aligning Medical Reasoning via Evolving Principle-Guided Supervision

Evo-PI:通过演化原则引导的对齐医学推理

Xianda Zheng, Huan Gao, Meng-Fen Chiang, Michael Witbrock, Kaiqi Zhao, Shangyang Li

机构 * School of Computer Science, University of Auckland(奥克兰大学计算机科学学院) Beijing University of Posts and Telecommunications(北京邮电大学) Renyixun Health Technology Co., Ltd.(仁医讯健康科技有限公司) National Yang Ming Chiao Tung University(国立阳明交通大学) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 提出Evo-PI框架,将推理原则作为可演化的语言监督信号,通过协同进化循环动态调整模型推理,在医学视觉问答中提升准确率最高达24.6%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31599 2026-07-01 cs.CV cs.AI 新提交 79%

Token-Sparse Medical Multimodal Reasoning via Dual-Stream Reinforcement Learning

通过双流强化学习实现令牌稀疏的医学多模态推理

Kaitao Chen, Weiqian Zhao, Jiamin Wu, Qihao Zheng, Shangquan Sun, Chunfeng Song, Xiaosong Wang, Mu Zhou, Mianxin Liu

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 提出双流强化学习框架ViToS,通过主动视觉令牌剪枝实现令牌稀疏的医学多模态推理,在七个医学基准上减少77%令牌并提升性能。

Comments ICML2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31073 2026-07-01 cs.AI cs.MA cs.RO 新提交 79%

MultiUAV-Plat: An LLM-Oriented Platform, Benchmark and Framework for Multi-UAV Collaborative Task Planning

MultiUAV-Plat:面向多无人机协同任务规划的LLM平台、基准测试与框架

Sheng Zhang, Qinglin Li, Yuechao Zang, Xueqin Huang, Yijia Fu, Cheng Zhu

机构 * National Key Laboratory of Information Systems Engineering, National University of Defense Technology(国防科技大学信息系统工程国家重点实验室)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 提出MultiUAV-Plat平台与基准测试,以及Agent4Drone框架,通过LLM驱动的工具交互实现多无人机协同任务规划,在任务通过率等指标上显著优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30694 2026-07-01 cs.RO cs.AI 新提交 79%

DSIP: A Dynamic Coordination Planner for Signal-Free Intersections using Diffusion-Model-Based Multi-Agent Motion Planning

DSIP: 基于扩散模型的多智能体运动规划的无信号交叉口动态协调规划器

Qian Hu, Haoyang Peng, Songan Zhang, Ming Yang, Hongtei Eric Tseng

机构 * Global Institute of Future Technology, Shanghai Jiao Tong University(上海交通大学全球未来技术学院) School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(上海交通大学自动化与智能感知学院) Department of Electrical Engineering, The University of Texas at Arlington(德克萨斯大学阿灵顿分校电气工程系)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 提出DSIP框架,利用扩散模型生成多车连续轨迹优化,替代传统信号相位控制,在SUMO仿真中显著降低平均延误并提高平均速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29150 2026-06-30 cs.AI 79%

Flow Reasoning Models: Scaling Reasoning Through Iterative Self-Refinement

流推理模型:通过迭代自我精炼扩展推理能力

Alec Helbling, Andrey Bryutkin, Mauro Martino, Nima Dehmamy, Hendrik Strobelt

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 提出流推理模型(FRMs),利用去噪动态的稳定性作为验证器,通过测试时缩放和训练改进,高效解决数独和斑马谜题等结构化推理任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28751 2026-06-30 cs.LG cond-mat.stat-mech 79%

A Path-Space Formulation of Prediction in World Models: From a Single Action to Prediction, Planning, and Irreversibility

世界模型中预测的路径空间表述:从单一动作到预测、规划和不可逆性

Gunn Kim

机构 * Department of Physics, Sejong University, Seoul 05006, Republic of Korea(首尔大学物理系,首尔05006,韩国)

专题命中 规划推理 :planning(title,abstract);分类 cs.LG

AI总结 提出世界模型中预测的路径空间表述,将预测、规划和不确定性统一为作用泛函上的操作,并发现注意力不对称性编码了数据的不可逆性。

Comments 13 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28692 2026-06-30 cs.AI 79%

An AI agent for treatment reasoning over a biomedical tool universe

一个在生物医学工具宇宙中进行治疗推理的AI智能体

Shanghua Gao, Ayush Noori, Richard Zhu, Curtis Ginder, Zhenglun Kong, Xiaorui Su, Justin Kauffman, Benjamin S. Glicksberg, Joshua Lampert, Ankit Sakhuja, Ashwin Sawant, ATHENA-R1 Evaluation Consortium, David A. Clifton, Noa Dagan, Ran Balicer, Marinka Zitnik

机构 * Department of Biomedical Informatics, Harvard Medical School(哈佛医学院生物医学信息学系) Department of Engineering Science, University of Oxford(牛津大学工程科学系) The Ivan and Francesca Berkowitz Family Living Laboratory Collaboration at Harvard Medical School and Clalit Research Institute(哈佛医学院伊万和弗朗西斯卡·伯科维茨家族生活实验室合作与克莱利研究所) Cardiovascular Division, Department of Medicine, Brigham and Women’s Hospital, Harvard Medical School(哈佛医学院心脏病学部,布里格姆和妇女医院) The Windreich Department of Artificial Intelligence and Human Health, Icahn School of Medicine at Mount Sinai(西奈山伊坎医学院人工智能与人类健康系) The Hasso Plattner Institute for Digital Health at Mount Sinai, Icahn School of Medicine at Mount Sinai and Mount Sinai Health System(西奈山伊坎医学院和西奈山医疗系统数字健康研究所) Mindich Child Health and Development Institute and the Departments of Pediatrics and Genetics & Genomic Sciences, Icahn School of Medicine at Mount Sinai(西奈山伊坎医学院Mindich儿童健康与发展研究所及儿科学和遗传学与基因组科学系) Mount Sinai Fuster Heart Hospital, Icahn School of Medicine at Mount Sinai(西奈山伊坎医学院Fuster心脏医院) Mount Sinai AI Assurance Lab, Mount Sinai Health System(西奈山医疗系统AI保证实验室) Institute for Critical Care Medicine, Icahn School of Medicine at Mount Sinai(西奈山伊坎医学院重症监护医学研究所) Department of Medicine, Icahn School of Medicine at Mount Sinai(西奈山伊坎医学院医学系) ATHENA-R1 Evaluation Group(ATHENA-R1评估组)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 提出ATHENA-R1智能体,通过强化学习在212种生物医学工具上训练,实现迭代证据收集的治疗推理,在多个基准上超越现有模型,准确率达94.7%。

Comments Project page: https://athena.openscientist.ai Code: https://github.com/mims-harvard/ATHENA

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27960 2026-06-29 cs.SE cs.AI 新提交 79%

Reasoning Beyond Prediction: From Data-Driven to Causal Software Engineering

超越预测的推理:从数据驱动到因果软件工程

Roberto Pietrantuono, Luca Giamattei, Stefano Russo

机构 * University of Naples Federico II(那不勒斯费德里科二世大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文提出因果软件工程新范式,通过因果推理增强工程师的决策能力,超越传统数据驱动方法,以应对日益复杂的软件系统开发挑战。

Comments Accepted for publication in Communications of the ACM

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26463 2026-06-26 cs.LG 新提交 79%

Finding the Time to Think: Learning Planning Budgets in Real-Time RL

寻找思考时间:在实时强化学习中学习规划预算

Aneesh Muppidi, Firas Darwish, Dylan Cope, João F. Henriques, Jakob Nicolaus Foerster

机构 * British Open-ended Learning and Discovery Lab (BOLD)(英国开放性学习与探索实验室(BOLD)) University of Oxford(牛津大学) VGG(视觉信息小组)

专题命中 规划推理 :planning(title,abstract);分类 cs.LG

AI总结 针对环境在决策期间持续运行的实时强化学习,提出一种轻量级门控策略,根据状态选择规划预算,在多个实时游戏中优于固定预算和启发式基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25066 2026-06-25 cs.AI cs.CV 新提交 79%

Do vision-language models search like humans? Reasoning tokens as a reaction-time analog in classic visual-search paradigms

视觉-语言模型的搜索方式与人类相似吗?经典视觉搜索范式中推理标记作为反应时间类似物

Farahnaz Wick

机构 * Independent Researcher(独立研究者)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 研究视觉-语言模型(VLM)在经典视觉搜索任务中是否表现出类似人类的行为模式,通过推理标记数量作为搜索努力度的指标,发现模型复现了部分人类特征但也存在关键差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17070 2026-06-24 cs.RO cs.AI 版本更新 79%

MuTRAP: Multi-trigger Trojans Attacking Robot Task Planning Systems

MuTRAP: 攻击机器人任务规划系统的多触发器木马

Mohaiminul Al Nahian, Zainab Altaweel, David Reitano, Sabbir Ahmed, Shiqi Zhang, Adnan Siraj Rakin

机构 * Binghamton University (SUNY)(宾夕法尼亚州立大学布林顿分校)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 提出首个针对LLM辅助机器人任务规划器的多触发器木马攻击MuTRAP,通过少量任务特定参数注入后门,并优化触发器词以激活特定恶意行为,揭示当前基于LLM的规划器的安全漏洞。

Comments Accepted for publication at the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22126 2026-06-23 cs.CL 新提交 79%

From Recognition to Understanding: Unlocking Cognitive Time Series Reasoning with LLMs

从识别到理解:利用LLM解锁认知时间序列推理

Xin Qiu, Junlong Tong, Yao Zhang, Yunpu Ma, Wei Zhang, Xiaoyu Shen

机构 * Institute of Digital Twin, Eastern Institute of Technology(东方理工数字孪生研究所) Zhejiang University(浙江大学) Munich Center for Machine Learning, LMU(慕尼黑机器学习中心,慕尼黑大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL

AI总结 针对现有时间序列任务与LLM能力不匹配的问题,提出多模态基准TSCognition和统一框架TSAlign,通过认知推理任务和语义对齐提升LLM的时间序列推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21836 2026-06-23 cs.AR cs.AI 新提交 79%

AgentDSE: Reasoning-Augmented Architectural Design Space Exploration

AgentDSE:推理增强的架构设计空间探索

Chenyu Wang, Jiahe Caroline Shi, David Kong, Duane S. Boning, Zishen Wan, Yilun Du, Vijay Janapa Reddi

机构 * Harvard University(哈佛大学) Massachusetts Institute of Technology(麻省理工学院) Columbia University(哥伦比亚大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 提出AgentDSE,利用大语言模型编码代理自动进行架构推理,在DNN加速器映射、软硬件协同设计和CPU缓存层次优化中,以少两个数量级的评估次数达到竞争或更优的设计质量。

Comments Accepted to the Machine Learning for Architecture and Systems Workshop (MLArchSys), co-located with ISCA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21169 2026-06-23 cs.AI 新提交 79%

Trip+: Benchmarking Agents in Personalized Interactive Travel Planning

Trip+: 个性化交互式旅行规划中的智能体基准测试

Junle Chen, Wei Chen, Yehong Xu, Zhengjun Huang, Yuqian Wu, Zhoujin Tian, Kai Wang, Lei Wang, Xiaofang Zhou

机构 * HKUST(香港科技大学) Tencent Hy(腾讯Hy) HKUST(GZ)(香港科技大学(广州))

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 提出Trip+基准,通过多轮交互和分钟级行程生成与修订,评估智能体在个性化旅行规划中的可行性、偏好匹配及主观体验(如疲劳度),发现现有模型倾向于技术可行但耗时的行程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20686 2026-06-23 cs.RO cs.AI 新提交 79%

JPPD: Joint Prediction_Planning Diffusion with Differentiable Safety Guidance for Dynamic Obstacle Avoidance in Intelligent Transportation Systems

JPPD:具有可微安全引导的联合预测-规划扩散框架用于智能交通系统中的动态障碍物规避

Jiahao Wu, Shengwen Yu

机构 * The University of Hong Kong(香港大学) Guangzhou College of Commerce(广州商学院)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 提出联合预测-规划扩散框架,将参与者预测与机器人规划视为条件轨迹生成问题,通过可微安全势引导和条件流匹配提升共享空间中的安全性与效率。

Comments 12 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18954 2026-06-18 cs.CL 新提交 79%

GraphPO: Graph-based Policy Optimization for Reasoning Models

GraphPO:基于图的推理模型策略优化

Yuliang Zhan, Xinyu Tang, Jian Li, Dandan Zheng, Weilong Chai, Jingdong Chen, Jun Zhou, Ge Wu, Wenyue Tang, Hao Sun

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学北京校区人工智能学院) Ant Group(蚂蚁集团)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL

AI总结 提出GraphPO框架,将推理轨迹建模为有向无环图,通过合并语义等价路径减少冗余探索,并利用边级优势函数提高推理效率,在多个基准上优于链式和树式方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18105 2026-06-18 cs.NI cs.LG 新提交 79%

OmniPlan: An Adaptive Framework for Timely and Near-Optimal Network Planning Optimization

OmniPlan:一种用于及时且近乎最优的网络规划优化的自适应框架

Longlong Zhu, Jiashuo Yu, Zedi Chen, Yuhan Wu, Zhifan Jiang, Yuchen Xian, Yimeng Liu, Jiajie Su, Shaopeng Zhou, Xingyuan Li, Hongyan Liu, Xuan Liu, Dong Zhang, Chunming Wu, Xiang Chen

机构 * Zhejiang University(浙江大学) Fuzhou University(福州市大学) Yangzhou University(扬州大学) The State Key Laboratory of Blockchain and Data Security(区块链与数据安全国家重点实验室) College of Computer Science and Technology(计算机科学与技术学院)

专题命中 规划推理 :planning(title,abstract);分类 cs.LG

AI总结 提出OmniPlan自适应框架,利用大语言模型解析用户意图,通过混合专家架构动态选择MIP求解器、启发式算法或深度强化学习模型,实现网络规划优化的及时性与近乎最优性,在分布式机器学习推理卸载任务中延迟降低97.8%,资源消耗降低11.5%。

Comments Accepted by ACM KDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28251 2026-06-17 cs.CV cs.AI 版本更新 79%

DiffAttn: Diffusion-Based Drivers' Visual Attention Prediction with LLM-Enhanced Semantic Reasoning

DiffAttn: 基于扩散的驾驶员视觉注意力预测与LLM增强语义推理

Weimin Liu, Qingkun Li, Jiyuan Qiu, Wenjun Wang, Joshua H. Meng

机构 * School of vehicle and Mobility, Tsinghua University(清华大学车辆与移动性学院) Beijing Key Laboratory of Human-Computer Interaction, Institute of Software, Chinese Academy of Sciences(北京人机交互重点实验室,中国科学院软件研究所) Remote Sensing and Earth Observation Laboratory, University of Copenhagen(远程感知与地球观测实验室,哥本哈根大学) California PATH, University of California, Berkeley(加州PATH,加州大学伯克利分校)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 提出DiffAttn框架,将驾驶员视觉注意力预测建模为条件扩散去噪过程,结合Swin Transformer、特征融合金字塔和LLM增强语义推理,在四个数据集上达到最先进性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20985 2026-06-17 cs.AI cs.MA 79%

A Blockchain-Monitored Agentic AI Architecture for Trusted Perception-Reasoning-Action Pipelines

基于区块链监控的代理AI架构:可信感知-推理-行动流水线

Salman Jan, Hassan Ali Razzaqi, Ali Akarma, Mohammad Riyaz Belgaum

机构 * Faculty of Computer Studies, Arab Open University-Bahrain(巴林阿拉伯开放大学计算机科学学院) Faculty of Computer and Information System, Islamic University of Madinah, Saudi Arabia(沙特阿拉伯麦地那伊斯兰大学计算机与信息系统学院)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文提出一种结合区块链的代理AI架构,用于确保自主决策流程中的信任和可追溯性,通过区块链实现对行动的持续监控和审计,验证输入并记录执行结果。

Comments This paper was presented at the IEEE International Conference on Computing and Applications (ICCA 2025), Bahrain

Journal ref Proceedings of the 2025 IEEE International Conference on Computing and Applications (ICCA), Bahrain, 2025, pp. 1-7

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16478 2026-06-16 cs.AI 新提交 79%

Tensor-Coord: Algebraic Decomposition of Joint Plan Tensors for Conflict-Free Multi-Agent LLM Planning

Tensor-Coord:用于无冲突多智能体LLM规划的联合计划张量代数分解

Mudit Rastogi

机构 * University of Michigan(密歇根大学)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 提出Tensor-Coord框架,将多智能体联合计划表示为三阶张量,通过CP和Tucker分解识别协调结构,计算协调复杂度并定位冲突,实现无冲突规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15654 2026-06-16 cs.RO cs.AI 新提交 79%

PO-PDDL: Learning Symbolic POMDPs from Visual Demonstrations for Robot Planning Under Uncertainty

PO-PDDL: 从视觉演示中学习符号化POMDP以实现不确定性下的机器人规划

Wenjing Tang, Xuanjin Jin, Yuan Liu, Renming Huang, Cewu Lu, Panpan Cai

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 提出PO-PDDL符号化POMDP框架,通过从机器人执行视频中重建潜在状态轨迹、识别部分可观测性并学习随机转移与观测模型,实现不确定性下的鲁棒任务规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15231 2026-06-16 cs.AI 新提交 79%

Visual-Seeker: Towards Visual-Native Multimodal Agentic Search via Active Visual Reasoning

Visual-Seeker:通过主动视觉推理实现视觉原生多模态智能搜索

Zhengbo Zhang, Changtao Miao, Jinbo Su, Zhaowen Zhou, Chunxia Zhang, Xukai Wang, Ruiqi Liu, Kaiyuan Zheng, Jiansheng Cai, Bo Zhang, Zhe Li, Shiming Xiang, Ying Yan

机构 * School of Artificial Intelligence UCAS(中国科学院大学人工智能学院) Institute of Automation CAS(中国科学院自动化研究所) Ant Digital Technologies Ant Group(蚂蚁数字科技蚂蚁集团) RUC(中国人民大学) BIT(北京理工大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 提出Visual-Seeker,一种通过主动视觉推理进行视觉原生多模态深度搜索的智能体,在五个基准上达到最先进性能,甚至超越专有模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01613 2026-06-16 cs.IR cs.AI cs.MA 版本更新 79%

TechRAG: Evidence-Gated Multimodal Agentic RAG for Technical Literature Reasoning

TechGraphRAG:面向技术文献推理的智能图增强RAG框架

Kanwar Bharat Singh

机构 * Global Tire Intelligence and Solutions (GTIS)(全球轮胎智能与解决方案(GTIS)) The Goodyear Tire & Rubber Company(固特异轮胎与橡胶公司)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 提出一种13步自主流水线的智能检索增强生成框架,通过证据充分性评分、知识图谱遍历和自校正生成,支持领域特定技术文献推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05407 2026-06-15 cs.AI 版本更新 79%

PRISM: Perception Reasoning Interleaved for Sequential Decision Making

PRISM: 感知与推理交错用于序列决策

Mohamed Salim Aissi, Clemence Grislain, Clement Romac, Laure Soulier, Mohamed Chetouani, Olivier Sigaud, Nicolas Thome

机构 * Institut National de la Recherche Scientifique (INRS)(国家科学研究院)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 提出PRISM框架,通过动态问答流水线紧密耦合视觉语言模型(VLM)和语言模型(LLM),实现任务驱动的感知,在ALFWorld和R2R基准上显著超越现有图像模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13176 2026-06-12 cs.AI 新提交 79%

Mental-R1: Aligning LLM Reasoning for Mental Health Assessment

Mental-R1:面向心理健康评估的对齐LLM推理

Xin Wang, Boyan Gao, Yibo Yang, David A. Clifton

机构 * University of Oxford(牛津大学) Oxford Suzhou Centre for Advanced Research(牛津大学苏州高等研究院)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 提出认知相对策略优化(CRPO)框架,通过阶段依赖不确定性建模和熵正则化机制,使LLM推理对齐人类认知过程,在8个心理健康数据集上加权F1平均提升10.4个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12852 2026-06-12 cs.AI 新提交 79%

WISE: A Long-Horizon Agent in Minecraft with Why-Which Reasoning

WISE:具有Why-Which推理的Minecraft长时域智能体

Renmin Cheng, Changhao Chen

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 提出WISE框架,通过因果事件图增强情景记忆并解耦what-where-when与which-why推理,结合机会主义任务调度和多尺度探索,显著提升长时域稀疏任务的成功率和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏