arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-07-02 至 2026-07-02 共收录 78 信号源:cs.CL, cs.AI, cs.LG

1. 数学推理 4 篇

2607.00254 2026-07-02 cs.DB 新提交 67%

Query-Centric Optimization of AI Workflows via Approximate Query Processing and Proxy Models

基于近似查询处理和代理模型的AI工作流查询中心优化

Huayi Wang, Jun Xu, Gromit Yeuk-Yin Chan

专题命中 数学推理 :reasoning(abstract);math reasoning(abstract)

AI总结 提出将AI工作流视为声明式查询,利用近似查询处理(AQP)和代理模型(PM)过滤减少昂贵模型调用,在TPC-DS和LLM流水线上实现85-90%和60-70%的调用减少。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01002 2026-07-02 cs.CL cs.AI cs.LG 新提交 67%

Logit-Contribution Scoring Identifies Non-Literal Retrieval Heads

Logit贡献评分识别非字面检索头

Aryo Pradipta Gema, Beatrice Alex, Pasquale Minervini

机构 * University of Edinburgh(爱丁堡大学) Heriot-Watt University(赫瑞瓦特大学)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出Logit贡献评分(LOCOS),通过OV电路输出投影到答案标记方向,识别大语言模型中执行非字面检索的注意力头,消融实验显著降低ROUGE-L而保持其他能力。

Comments 41 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30789 2026-07-02 cs.LG stat.ML 新提交 57%

Predictable GRPO: A Closed-Form Model of Training Dynamics

可预测的GRPO:训练动力学的闭式模型

Rajat Ghosh, Datta Nimmaturi, Aryan Singhal, Vaishnavi Bhargava, Henry Wong, Johnu George, Debojyoti Dutta

机构 * Nutanix Unsloth

专题命中 数学推理 :reasoning(abstract);分类 cs.LG

AI总结 提出GRPO训练动力学的第一性原理降阶模型,揭示其指数饱和律的物理含义,预测群大小不变性、稳定性阈值和过阻尼-振荡转变,并在多个模型和基准上验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00820 2026-07-02 cs.SE 新提交 50%

Knowledge-Enhanced Agentic Vulnerability Repair

知识增强的智能体漏洞修复

Sicong Cao, Hao Ma, Le Yu, Kangyi Ding, Xiaolei Liu, Terry Yue Zhuo, Bo Wang, Xingwei Lin, Xiaobing Sun, Linzhang Wang, David Lo

专题命中 数学推理 :reasoning(abstract)

AI总结 提出KeaRepair,一种基于智能体的自动化漏洞修复方法,通过提取历史漏洞知识并利用工具增强的智能体进行诊断,生成并迭代优化补丁,在55个C/C++漏洞上修复率达83.64%。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 代码与定理证明 1 篇

2607.00972 2026-07-02 cs.AI 新提交 57%

Bayesian Uncertainty Propagation for Agentic RAG Pipelines: A Proof-of-Concept Study on Multi-Hop Question Answering

面向智能体RAG管道的贝叶斯不确定性传播:多跳问答的概念验证研究

Louis Donaldson, Connor Walker, Koorosh Aslansefat, Yiannis Papadopoulos

机构 * University of Hull(赫尔大学)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

AI总结 提出一种不确定性感知的智能体RAG框架,通过贝叶斯网络传播各阶段的不确定性信号,以估计系统级不确定性并定位潜在故障点,在HotpotQA上表现有效,但在StrategyQA上受限于校准问题。

Comments Submitted for 7th International Conference on Maintenance and Intelligent Asset Management (ICMIAM 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 逻辑推理 7 篇

2607.01138 2026-07-02 cs.CR 新提交 78%

Antaeus: Hunting Repository-Level Logic Vulnerabilities via Context-Grounded LLM Reasoning

Antaeus: 通过上下文锚定的LLM推理发现仓库级逻辑漏洞

Michele Armillotta, Nicolò Romandini, Rebecca Montanari, Lorenzo Cavallaro

专题命中 逻辑推理 :reasoning(title,abstract)

AI总结 提出Antaeus框架,通过仓库级代码上下文锚定LLM推理,结合函数优先级排序、上下文推理、比较验证和结构化报告,有效检测逻辑漏洞,在28个仓库中检测出15个漏洞,优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00544 2026-07-02 cs.CV 新提交 78%

GEAR-Seg: A Grounded Explainable Agent for Reasoning Segmentation and Data Engine

GEAR-Seg:用于推理分割和数据引擎的基于可解释智能体

Yanan Wang, Wen Li, Yibin Ying, Zhenghao Fei

机构 * College of Biosystems Engineering and Food Science, Zhejiang University(浙江大学生物系统工程与食品科学学院) ZJU-Hangzhou Global Scientific and Technological Innovation Center, Zhejiang University(浙江大学杭州国际科创中心)

专题命中 逻辑推理 :reasoning(title,abstract)

AI总结 提出GEAR-Seg,一种解耦的智能体框架,通过将像素转换为属性文本实现可解释推理分割,零样本性能优异,并可作为数据引擎构建大规模基准GEAR-131K。

Comments 21 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00342 2026-07-02 eess.SP 新提交 75%

Semantic-based Internet of Embodied Intelligence: Visions and Frontiers

基于语义的具身智能物联网:愿景与前沿

Yaheng Wang, Rui Meng, Xiaodong Xu, Yiming Liu, Feiliang Song, Linyuan Hu, Huishi Song, Lexi Xu, Tony Q. S. Quek, Ping Zhang

专题命中 逻辑推理 :reasoning(abstract);planning(abstract);logical reasoning(abstract)

AI总结 提出基于语义的具身智能物联网(SIoEI),通过语义信息统一度量解决多智能体网络中的多模态数据传输开销和逻辑推理与物理约束解耦问题,并验证其在信道鲁棒性和端到端延迟方面的优势。

Comments 7 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00447 2026-07-02 cs.CL 新提交 74%

Understanding Why Language Models Hallucinate: Testing Reasoning Against Priors

理解语言模型为何产生幻觉:针对先验知识的推理测试

Yangfan Hu, Xuhan Tong, Haoyue Bai, Xi Ding, Shashank Muralidhar Bharadwaj, Siyang Cao, Robert Nowak, Jiawei Zhang

机构 * University of Wisconsin–Madison(威斯康星大学麦迪逊分校)

专题命中 逻辑推理 :reasoning(title);分类 cs.CL

AI总结 本文提出推理错位假说,认为幻觉源于模型偏向统计显著的潜在关联而非遵循提示约束,并通过TrapQA测试集验证了两种偏差模式。

Comments Project page: https://neohughus.github.io/Understanding_Why_Language_Models_Hallucinate/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00924 2026-07-02 cs.AI cond-mat.mtrl-sci cs.CL cs.LG 新提交 67%

Graph-Native Reinforcement Learning Enables Traceable Scientific Hypothesis Generation through Conceptual Recombination

图原生强化学习通过概念重组实现可追溯的科学假设生成

Subhadeep Pal, Shashwat Sourav, Tirthankar Ghosal, Markus J. Buehler

机构 * Lawrence Berkeley National Laboratory(劳伦斯伯克利国家实验室)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出图原生推理模型Graph-PRefLexOR,结合GRPO强化学习将推理组织为显式阶段,在材料科学100个开放问题上推理可追溯性提升40-65%,语义多样性增加2-3倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01188 2026-07-02 cs.AI cond-mat.mtrl-sci 新提交 57%

Optimal Resource Utilization for Autonomous Laboratory Orchestrators

自主实验室协调器的最优资源利用

Austin McDannald, Julia Tisaranni, Howie Joress

机构 * National Institute of Standards and Technology(美国国家标准与技术研究院)

专题命中 逻辑推理 :planning(abstract);分类 cs.AI

AI总结 针对自主实验室中多仪器硬件约束下的资源利用问题,提出两步法:先用约束规划找到最小化总时间的最优调度,再通过状态依赖系统鲁棒执行调度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01006 2026-07-02 cs.CL 新提交 57%

Understanding Large Language Models

理解大型语言模型

Yannik Keller, Thomas Eisenmann

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL

AI总结 本文综述大型语言模型(LLM)的机制、涌现能力及与人类认知的关系,通过分析注意力机制、符号推理、心智理论等证据,探讨LLM是否真正理解语言,并反对过度简化的人机认知差异观点。

Comments 25 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 规划推理 15 篇

2607.00283 2026-07-02 cs.RO cs.AI cs.CV 新提交 83%

What's Hidden Matters: Identifying Planning-Critical Occluded Agents using Vision-Language Models

隐藏之物至关重要:使用视觉语言模型识别规划关键性的被遮挡智能体

Amirhosein Chahe, Tyler Naes, Jovin D'sa, Faizan M. Tariq, Sangjae Bae, Lifeng Zhou, David Isele

专题命中 规划推理 :planning(title,abstract);reasoning(abstract);分类 cs.AI

AI总结 提出利用视觉语言模型(VLM)识别对自车轨迹影响最大的被遮挡智能体,通过规划KL散度(PKL)度量进行排序,并微调VLM以提升性能,实验表明该方法比随机采样提升约30%。

Comments Accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026). 9 pages, 5 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00147 2026-07-02 cs.AI 新提交 79%

RareDxR1: Autonomous Medical Reasoning for Rare Disease Diagnosis Beyond Human Annotation

RareDxR1:超越人类标注的罕见病诊断自主医学推理

Deyang Jiang, Haoran Wu, Ziyi Wang, Yiming Rong, Yunlong Zhao, Ye Jin, Bo Xu

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 提出端到端推理大模型RareDxR1,通过知识内化与自主进化学习框架,结合反思增强推理采样和双级课程强化学习,直接从非结构化临床笔记诊断罕见病,无需依赖结构化表型或人类标注,在多个基准上达到最先进准确率。

Comments 7 pages, 3 figures. Accepted to IEEE International Conference on Multimedia and Expo (ICME) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00427 2026-07-02 cs.SE 新提交 75%

BT-APE: A Computationally Light Backtracking Approach to Automatic Prompt Engineering for Requirements Classification

BT-APE: 一种用于需求分类的轻量级回溯自动提示工程方法

Mohammad Amin Zadenoori, Waad Alhoshan, Jacek Dąbrowski, Liping Zhao, Alessio Ferrari

专题命中 规划推理 :CoT(abstract,abstract_cn);chain-of-thought(abstract)

AI总结 提出轻量级回溯自动提示工程方法BT-APE,通过LLM生成候选、回溯搜索和动态示例选择迭代优化提示,在需求分类任务中以更低计算成本达到与资源密集型方法相当的准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13148 2026-07-02 cs.AI 新提交 70%

TerraBench: Can Agents Reason Over Heterogeneous Earth-System Data?

TerraBench: 智能体能否对异构地球系统数据进行推理?

Dat Tien Nguyen, Thao Nguyen, Fadillah Adamsyah Maani, Huy M. Le, Muhammad Umer Sheikh, Numan Saeed, Muhammad Haris Khan, Salman Khan

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 提出TerraBench基准,基于TerraAgent框架,通过结合大语言模型规划与科学工具,实现跨网格数据、卫星图像、地理空间和模拟器的交互式推理,包含403个任务和24,500个执行步骤。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00537 2026-07-02 eess.SP 新提交 67%

B2X Networks: Joint Design of Communication and Control for Embodied Intelligence

B2X网络:具身智能的通信与控制联合设计

Yuanwei Liu, Xu Gan, Zhaolin Wang, Chongjun Ouyang, Hao Jiang, Zongyao Zhao, Kaibin Huang, Robert Schober

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 提出脑-体-万物(B2X)网络概念,通过分布式与集中式脑架构,重新设计上下行通信以平衡传输性能与控制质量,实现无线网络与具身智能的融合。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01179 2026-07-02 cs.LG cs.CL 新提交 62%

QuasiMoTTo: Quasi-Monte Carlo Test-Time Scaling

QuasiMoTTo: 准蒙特卡洛测试时扩展

Michael Y. Li, Anthony Zhan, Kanishk Gandhi, Noah D. Goodman, Emily B. Fox

机构 * Stanford University(斯坦福大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL、cs.LG

AI总结 提出QuasiMoTTo方法,利用准蒙特卡洛相关采样替代独立同分布采样,在推理和强化学习中减少冗余,以更少样本达到相同性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00871 2026-07-02 cs.AI cs.CL 新提交 62%

Self-Evolving Agents with Anytime-Valid Certificates

具有任意时间有效证书的自我进化智能体

Biswa Sengupta

机构 * LLM Suite Team, JPMorgan Chase & Co.(摩根大通LLM Suite团队)

专题命中 规划推理 :verifier(abstract);分类 cs.CL、cs.AI

AI总结 提出SEA架构,通过冻结基础模型和任意时间有效门控机制,在固定错误预算内实现可控自我修改,在SWE-bench验证集上提升性能并防止退化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00454 2026-07-02 cs.AI cs.MA 新提交 57%

Agri-SAGE: Simulation-Grounded Multi-Agent LLM for Context-Aware Agricultural Advisory Generation

Agri-SAGE:基于模拟的多智能体LLM用于上下文感知的农业咨询生成

Vedant Balasubramaniam, Geetha Charan, Manojkumar Patil, Rohit P Suresh, V Priyanka, Kodur Sai Vinay Sathvik, Y. Narahari

机构 * Indian Institute of Science, Bengaluru(印度科学理工学院,班加罗尔) BNM Institute of Technology, Bengaluru(BNM理工学院,班加罗尔)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 提出Agri-SAGE框架,结合检索增强的多智能体LLM推理与APSIM生物物理模拟,生成并验证农艺建议;通过十年回顾分析,三种推理方法均优于静态基线,其中思维树实现最高产量,反思法以较低计算成本达到相当效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00339 2026-07-02 cs.CL 新提交 57%

TRACE: State-Aware Query Processing over Temporal Evidence Graphs for Conversational Data

TRACE:面向对话数据的时间证据图状态感知查询处理

Maolin Wang, Yu Wang, Zichun Liu, Baiyuan Qiu, Chenbin Zhang, Jiguang Shen, Haoran Yang, Hao Miao

机构 * Hong Kong Institute of AI for Science, City University of Hong Kong(香港城市大学香港人工智能科学研究院) Independent Researcher(独立研究者) Central South University(中南大学) The Hong Kong Polytechnic University(香港理工大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL

AI总结 提出TRACE框架,通过构建时间证据图并维护有效性标注,实现对话数据中状态感知的查询处理,提升时间推理和多跳推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27669 2026-07-02 cs.CL 新提交 57%

When Search Agents Should Ask: DiscoBench for Clarification-Aware Deep Search

搜索代理何时应提问:面向澄清感知的深度搜索的DiscoBench基准

Yiling Tao, Shihan Deng, Meiling Tao, Pengzhi Wei, Zhichao Hu, Zhihao Zhu

机构 * Hunyuan, Tencent(腾讯混元) Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL

AI总结 提出DiscoBench基准,评估大语言模型搜索代理在深度搜索中主动识别歧义、提出有效澄清问题并恢复正确推理路径的能力,实验表明歧义检测与有效澄清是不同能力,且盲目搜索不如直接猜测。

Comments 26 pages, 7 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00622 2026-07-02 cs.CV 新提交 50%

Learning to Watch: Active Video Anomaly Understanding via Interleaved Policy Optimization

学习观察:通过交错策略优化的主动视频异常理解

Mengjingcheng Mo, Jiaxu Leng, Xinbo Gao

机构 * School of Computer Science and Technology, Chongqing University of Posts and Telecommunications, Chongqing, China(重庆邮电大学计算机科学与技术学院) School of Computer Science(计算机科学学院) Chongqing College of Artificial Intelligence, Chongqing, China(重庆人工智能学院)

专题命中 规划推理 :reasoning(abstract)

AI总结 提出Anom-π闭环框架,将视频异常理解建模为主动序列决策过程,通过交错策略统一内部推理与证据获取,并设计iDPO实现轨迹级策略对齐,仅2B参数即超越大规模模型。

Comments Accepted at ICML 2026; 25 pages, 8 figures, 15 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00440 2026-07-02 cs.CR 新提交 50%

Minos: A Multi-Agent Collaborative Framework for Provenance-Based Backward Tracking

Minos:一种基于溯源的反向追踪多智能体协作框架

Jiahui Wang, Zhenyuan Li, Zhengkai Wang, Xiangmin Shen, Fan Zhang

专题命中 规划推理 :reasoning(abstract)

AI总结 提出多智能体框架Minos,利用LLM驱动推理进行基于溯源的反向追踪,通过分层上下文管理、检索增强推理和有限状态机协调四个智能体,有效缓解依赖爆炸,在5个数据集上平均召回率0.92、精确率0.64,攻击子图压缩49%。

Comments 20 pages,7 figures, accepted by ESORICS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00420 2026-07-02 cs.HC 新提交 50%

A Simple Solution to Improving Human Supervision of Algorithms: Evidence from Smart Vending

改善人类对算法监督的简单解决方案:来自智能售货机的证据

Minda Zhao, Brian Rongqing Han, Xin Chen, Tao Zhu

专题命中 规划推理 :planning(abstract)

AI总结 通过限制人工干预次数,让工人优先选择高价值干预,在减少库存的同时不损害销售,为人类监督AI提供低成本可扩展方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00604 2026-07-02 math.OC 新提交 50%

Vehicle Routing Problem Meets Large Language Models: An Overview and Perspectives

车辆路径问题遇上大语言模型:综述与展望

Xianchao Xiu, Chong Shen, Yanjiao Zhu, Wanquan Liu

专题命中 规划推理 :reasoning(abstract)

AI总结 综述大语言模型在车辆路径问题中的应用,涵盖模型构建、算法设计、协调工具等角色,并讨论基准测试与实验。

Comments working in process

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31483 2026-07-02 cs.RO 新提交 50%

A Large-Language-Model Supported Personalized Driving Framework for Lane Change in Highway Scenarios

大语言模型支持的高速公路换道场景个性化驾驶框架

Dong Bi, Yongqi Zhao, Paul Kovacevic, Tomislav Mihalj, Ji Zhou, Jiayuan Gong, Arno Eichberger

机构 * Hubei University of Automotive Technology(湖北汽车工业学院) Graz University of Technology(格拉茨技术大学)

专题命中 规划推理 :planning(abstract)

AI总结 提出一种LLM支持的个性化驾驶框架,通过映射自然语言指令到Apollo规划参数,结合聚类和风格强度排序生成可区分的换道行为,并利用检索增强生成解释隐式指令。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 视觉空间推理 6 篇

2607.00491 2026-07-02 cs.CV cs.AI cs.CL 新提交 81%

MindEdit-Bench: Benchmarking Object-Level Counterfactual Spatial Reasoning in VLMs from In-the-Wild Photos

MindEdit-Bench:基于野外照片的VLM中对象级反事实空间推理基准

Leyuan Yu, Xiao Tang, Minghao Liu, Xinyuan Li, Xiaokai Bai, Sheng Zhou, Qunshu Lin, Weihao Xuan, Naoto Yokoya

机构 * ZODA Zhejiang University(浙江大学) Tongji University(同济大学) The University of Tokyo(东京大学)

专题命中 视觉空间推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 提出MindEdit-Bench基准,包含六项空间推理任务,其中两项新任务(L4和L5)测试对象级反事实推理,VLM平均准确率仅8%-31%,远低于人类的81%-97%。

Comments 18 pages, 7 figures. Dataset available at https://huggingface.co/datasets/ZODAOfficial/MindEdit-Bench

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31329 2026-07-02 cs.RO cs.AI 新提交 79%

3D HAMSTER: Bridging Planning and Control in Hierarchical Vision Language Action Models through 3D Trajectory Guidance

3D HAMSTER:通过3D轨迹引导在分层视觉语言动作模型中桥接规划与控制

Dongyoon Hwang, Byungkun Lee, Dongjin Kim, Hyojin Jang, Hoiyeong Jin, Jueun Mun, Minho Park, Hojoon Lee, Hyunseung Kim, Jaegul Choo

机构 * Kim Jaechul Graduate School of AI, KAIST(韩国科学技术院金载哲人工智能研究生院) Graduate School of Artificial Intelligence, POSTECH(浦项工业大学人工智能研究生院) KRAFTON AI

专题命中 视觉空间推理 :planning(title,abstract);分类 cs.AI

AI总结 提出3D HAMSTER框架,通过让规划器直接输出度量可靠的3D轨迹,弥合2D引导与3D低层策略之间的差距,在3D轨迹预测、仿真和真实操作中优于现有方法。

Comments Published in IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2026. Code: https://github.com/DAVIAN-Robotics/3D_HAMSTER. Project page: https://davian-robotics.github.io/3D_HAMSTER/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01191 2026-07-02 cs.CV 新提交 78%

Perceive-to-Reason: Decoupling Perception and Reasoning for Fine-Grained Visual Reasoning

感知到推理:解耦感知与推理用于细粒度视觉推理

Hongxing Li, Xiufeng Huang, Dingming Li, Wenjing Jiang, Zixuan Wang, Haolei Xu, Hanrong Zhang, Haiwen Hong, Longtao Huang, Hui Xue, Weiming Lu, Jun Xiao, Yueting Zhuang, Yongliang Shen

机构 * Zhejiang University(浙江大学) Alibaba Group(阿里巴巴集团)

专题命中 视觉空间推理 :reasoning(title,abstract)

AI总结 提出Perceive-to-Reason (P2R)框架,将细粒度视觉推理解耦为感知和推理两阶段,并引入PRA-GRPO强化学习策略,在多个高分辨率基准上显著提升性能。

Comments Code: https://github.com/ZJU-REAL/Perceive-to-Reason

详情

展开后加载摘要…

URL PDF HTML 收藏