arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-03-26 至 2026-03-26 共收录 77 信号源:cs.CL, cs.AI, cs.LG

1. 数学推理 9 篇

2505.16950 2026-03-26 cs.LG cs.AI cs.IT math.IT 84%

Bottlenecked Transformers: Periodic KV Cache Consolidation for Generalised Reasoning

瓶颈化Transformer:用于通用推理的周期性KV缓存整合

Adnan Oomerjee, Zafeirios Fountas, Haitham Bou-Ammar, Jun Wang

机构 * University College London(伦敦大学学院) Huawei Noah’s Ark(华为诺亚方舟)

专题命中 数学推理 :reasoning(title,abstract);math reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出瓶颈化Transformer,通过周期性非因果的KV重写提升推理能力,基于信息瓶颈理论分析其有效性,并在数学推理任务中验证性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16917 2026-03-26 cs.AI cs.CL cs.LG 82%

Generative Adversarial Reasoner: Enhancing LLM Reasoning with Adversarial Reinforcement Learning

生成对抗推理器:通过对抗性强化学习增强大语言模型推理

Qihao Liu, Luoxin Ye, Wufei Ma, Yu-Cheng Chou, Alan Yuille

机构 * Johns Hopkins University(约翰霍普金斯大学)

专题命中 数学推理 :reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出生成对抗推理器,通过对抗性强化学习联合训练LLM推理器和判别器,提升推理质量与准确性。

Comments Camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14751 2026-03-26 cs.LG cs.AI 73%

Beyond Multi-Token Prediction: Pretraining LLMs with Future Summaries

超越多令牌预测:通过未来摘要预训练语言模型

Divyat Mahajan, Sachin Goyal, Badr Youbi Idrissi, Mohammad Pezeshki, Ioannis Mitliagkas, David Lopez-Paz, Kartik Ahuja

机构 * Carnegie Mellon University(卡内基梅隆大学) FAIR at Meta(Meta的FAIR)

专题命中 数学推理 :reasoning(abstract);planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出未来摘要预测(FSP)方法,通过训练辅助头预测紧凑的长期未来表示,提升长形式生成能力,在数学、推理和编码基准测试中优于NTP和MTP。

Comments Proceedings of the Fourteenth International Conference on Learning Representations (ICLR) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16485 2026-03-26 cs.CL cs.AI cs.MA 62%

Team of Thoughts: Efficient Test-time Scaling of Agentic Systems through Orchestrated Tool Calling

思想团队:通过协调工具调用实现代理系统高效测试时扩展

Jeffrey T. H. Wong, Zixi Zhang, Junyi Liu, Yiren Zhao

机构 * Imperial College London(帝国学院伦敦) Microsoft Research(微软研究院)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文提出Team-of-Thoughts框架,通过协调工具调用实现异构代理系统在测试时的高效扩展,通过动态激活最兼容的代理提升数学推理和代码生成任务的性能。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23871 2026-03-26 cs.LG cs.AI 62%

HDPO: Hybrid Distillation Policy Optimization via Privileged Self-Distillation

HDPO:通过特权自蒸馏的混合蒸馏策略优化

Ken Ding

机构 * NVIDIA(英伟达)

专题命中 数学推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 HDPO通过结合强化学习与特权自蒸馏解决RL在数学推理中遇到的'悬崖'提示问题,提升覆盖指标并保持贪婪准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19345 2026-03-26 cs.LG cs.AI 62%

Smooth Gate Functions for Soft Advantage Policy Optimization

用于软优势策略优化的平滑门函数

Egor Denisov, Svetlana Glazyrina, Maksim Kryzhanovskiy, Roman Ischenko

机构 * Institute for Artificial Intelligence, Lomonosov Moscow State University(莫斯科罗蒙诺索夫莫斯科国立大学人工智能研究所) Lomonosov Moscow State University(莫斯科罗蒙诺索夫莫斯科国立大学)

专题命中 数学推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文探讨了通过平滑门函数提升策略优化稳定性和模型性能,分析了不同门函数在数学推理任务中的实验结果,为大语言模型训练提供指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09195 2026-03-26 cs.CL cs.AI 62%

ProFit: Leveraging High-Value Signals in SFT via Probability-Guided Token Selection

ProFit:通过概率引导的标记选择利用SFT中的高价值信号

Tao Liu, Taiqiang Wu, Runming Yang, Shaoning Sun, Junjie Wang, Yujiu Yang

机构 * Tsinghua University(清华大学) The University of Hong Kong(香港大学)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 ProFit通过概率引导的标记选择策略,有效缓解SFT中单参考答案导致的过拟合问题,提升模型在通用推理和数学任务中的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24375 2026-03-26 cs.CL 57%

Towards Reward Modeling for AI Tutors in Math Mistake Remediation

迈向数学错误纠正中的人工智能导师的奖励建模

Kseniia Petukhova, Ekaterina Kochmar

专题命中 数学推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出了一种基于人类偏好的人工智能导师奖励建模方法,通过合成数据和加权和数据提升模型准确性,达到0.74的配对准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23951 2026-03-26 cs.CL 57%

From AI Assistant to AI Scientist: Autonomous Discovery of LLM-RL Algorithms with LLM Agents

从AI助手到AI科学家:利用LLM代理自主发现LLM-RL算法

Sirui Xia, Yikai Zhang, Aili Chen, Siye Wu, Siyu Yuan, Yanghua Xiao

机构 * Shanghai Key Laboratory of Data Science, School of Computer Science, Fudan University(上海数据科学关键实验室,计算机科学学院,复旦大学) School of Data Science, Fudan University(数据科学学院,复旦大学)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出POISE框架,通过自动化发现语言模型的策略优化算法,改进了政策优化算法,提高了性能指标。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 逻辑推理 5 篇

2603.24004 2026-03-26 cs.CL 79%

Thinking with Tables: Enhancing Multi-Modal Tabular Understanding via Neuro-Symbolic Reasoning

基于表格的思考:通过神经符号推理增强多模态表格理解

Kun-Yang Yu, Zhi Zhou, Shi-Yu Tian, Xiao-Wen Yang, Zi-Yi Jia, Ming Yang, Zi-Jian Cheng, Lan-Zhe Guo, Yu-Feng Li

机构 * State Key Laboratory of Novel Software Technology, Nanjing University, China(新型软件技术国家重点实验室,南京大学,中国) School of Artificial Intelligence, Nanjing University, China(人工智能学院,南京大学,中国) School of Intelligence Science and Technology, Nanjing University, China(智能科学与技术学院,南京大学,中国)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL

AI总结 本文提出TWT框架,通过神经符号推理解决表格数据结构多样性、特征依赖复杂性及任务异质性问题,在八个数据集上验证了其在多模态表格理解任务中的优越性能。

Comments 20 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22460 2026-03-26 cs.AI 79%

GeoSketch: A Neural-Symbolic Approach to Geometric Multimodal Reasoning with Auxiliary Line Construction and Affine Transformation

GeoSketch: 一种基于神经符号的方法,用于几何多模态推理中的辅助线构造与仿射变换

Shichao Weng, Zhiqiang Wang, Yuhua Zhou, Rui Lu, Ting Liu, Zhiyang Teng, Xiaozhang Liu, Hanmeng Liu

机构 * Fudan University(复旦大学) IFLYTEK CO.LTD(若lytek有限公司) Zhejiang University(浙江大学) The Hong Kong University of Science and Technology(香港科学与技术大学) National University of Defense Technology(国防科技大学) Hainan University(海南大学)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

AI总结 GeoSketch通过整合感知、符号推理和绘图动作模块,实现动态几何推理,提升多模态推理的准确性和解决问题的成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23577 2026-03-26 cs.LG cs.CL cs.CY 73%

The Geometric Price of Discrete Logic: Context-driven Manifold Dynamics of Number Representations

离散逻辑的几何价格:数表示的上下文驱动流形动力学

Long Zhang, Dai-jun Lin, Wei-neng Chen

机构 * School of Computer Science and Engineering(计算机科学与工程学院)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.CL、cs.LG

AI总结 本研究通过分析语言模型中的流形动力学,揭示了离散逻辑形成所需的拓扑变形成本,提出了一种双调控机制以解释语义分类和逻辑边界生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21542 2026-03-26 cs.RO cs.AI cs.CV cs.LG 62%

E0: Enhancing Generalization and Fine-Grained Control in VLA Models via Tweedie Discrete Diffusion

E0: 通过 Tweedie 离散扩散增强 VLA 模型的泛化能力与细粒度控制

Zhihao Zhan, Jiaying Zhou, Likui Zhang, Qinhan Lv, Hao Liu, Jusheng Zhang, Weizheng Li, Ziliang Chen, Tianshui Chen, Ruifeng Zhai, Keze Wang, Liang Lin, Guangrun Wang

机构 * Sun Yat-sen University(中山大学) Guangdong Key Laboratory of Big Data Analysis(广东大数据分析与处理重点实验室) X-Era AI Lab(X-Era人工智能实验室) Guangdong University of Technology(广东工业大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出 E0 框架,通过离散扩散方法提升 VLA 模型在多任务和多视角下的泛化能力,并实现精细可控的动作生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.06819 2026-03-26 cs.RO cs.AI 57%

Dynamic Neural Potential Field: Online Trajectory Optimization in the Presence of Moving Obstacles

动态神经势场:在移动障碍物存在下的在线轨迹优化

Aleksei Staroverov, Muhammad Alhaddad, Aditya Narendra, Konstantin Mironov, Aleksandr Panov

机构 * Cognitive AI Systems Lab(认知人工智能系统实验室) National University of Science and Technology MISIS(科学与技术国立大学MISIS) Moscow Independent Research Institute of Artificial Intelligence(莫斯科独立人工智能研究 institutes) Ufa University of Science and Technology(乌fa科学与技术大学)

专题命中 逻辑推理 :planning(abstract);分类 cs.AI

AI总结 本文提出动态神经势场模型,结合传统优化与Transformer预测器,实现高效安全的轨迹优化,在动态环境中表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 规划推理 12 篇

2510.15259 2026-03-26 cs.AI 83%

SAG-Agent: Enabling Long-Horizon Reasoning in Strategy Games via Dynamic Knowledge Graphs

SAG-Agent:通过动态知识图谱实现策略游戏中长周期推理

Chenwei Tang, Lin Long, Xinyu Liu, Jingyu Xing, Zizhou Wang, Joey Tianyi Zhou, Jiawei Du, Liangli Zhen, Jiancheng Lv

机构 * College of Computer Science, Sichuan University(四川大学计算机学院) Engineering Research Center of Machine Learning and Industry Intelligence, Ministry of Education(教育部机器学习与工业智能工程研究中心) Institute of High Performance Computing, Agency for Science, Technology and Research (A*STAR)(科技研究局(A*STAR)高性能计算研究所) Centre for Frontier AI Research, Agency for Science, Technology and Research (A*STAR)(科技研究局(A*STAR)前沿人工智能研究中心)

专题命中 规划推理 :reasoning(title,abstract);planning(abstract);分类 cs.AI

AI总结 SAG-Agent通过构建持久化的状态-动作图,解决无API环境下自主代理的效率瓶颈,提升探索效率和战略深度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24558 2026-03-26 cs.CV cs.AI 79%

LensWalk: Agentic Video Understanding by Planning How You See in Videos

LensWalk: 通过规划如何在视频中观看实现代理视频理解

Keliang Li, Yansong Li, Hongze Shen, Mengdi Liu, Hong Chang, Shiguang Shan

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) Peng Cheng Laboratory(鹏城实验室) College of Computer Science and Electronic Engineering, Hunan University(湖南大学计算机科学与电子工程学院) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 规划推理 :planning(title);reasoning(abstract);分类 cs.AI

AI总结 LensWalk通过建立紧密的推理-计划-观察循环,使大语言模型能够主动控制视觉观察,提升视频理解的准确性和鲁棒性。

Comments To be published in CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23909 2026-03-26 cs.AI 79%

DUPLEX: Agentic Dual-System Planning via LLM-Driven Information Extraction

DUPLEX:基于LLM驱动信息提取的代理双系统规划

Keru Hua, Ding Wang, Yaoying Gu, Xiaoguang Ma

机构 * Midea Corporate Research Center(美的集团研发中心) Midea Group(美的集团) Northeastern University(东北大学) Engineering Department(工程部)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 DUPLEX通过限制LLM进行结构化语义 grounding,结合符号规划器实现可靠规划,优于现有端到端和混合LLM基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23838 2026-03-26 cs.AI cs.RO 79%

Learning-guided Prioritized Planning for Lifelong Multi-Agent Path Finding in Warehouse Automation

基于学习的优先规划在仓库自动化中的终身多智能体路径寻找

Han Zheng, Yining Ma, Brandon Araki, Jingkai Chen, Cathy Wu

机构 * Massachusetts Institute of Technology(麻省理工学院)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 本文提出RL-RH-PP框架,结合强化学习与搜索规划,提升仓库自动化中多智能体路径寻找的效率与适应性。

Journal ref Journal of Artificial Intelligence Research, Vol. 85, Article 28. Publication date: March 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24014 2026-03-26 cs.AI 74%

Language-Grounded Multi-Agent Planning for Personalized and Fair Participatory Urban Sensing

基于语言的多智能体规划用于个性化和公平的参与式城市传感

Xusen Guo, Mingxing Peng, Hongliang Lu, Hai Yang, Jun Ma, Yuxuan Liang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 规划推理 :planning(title);分类 cs.AI

AI总结 本文提出MAPUS框架,通过语言协商实现个性化和公平的参与式城市传感,提升参与度和可持续性。

Comments 19 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24382 2026-03-26 cs.LG cs.AI cs.CE 73%

MolEvolve: LLM-Guided Evolutionary Search for Interpretable Molecular Optimization

MolEvolve: 基于大语言模型的可解释分子优化进化搜索

Xiangsen Chen, Ruilong Wu, Yanyan Lan, Ting Ma, Yang Liu

机构 * Hong Kong University of Science(香港科技大学) Hong Kong Polytechnic University(香港理工大学) Tsinghua University(清华大学) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI、cs.LG

AI总结 MolEvolve通过大语言模型引导进化搜索,实现可解释的分子优化,优于传统方法在属性预测和分子优化任务中表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01853 2026-03-26 cs.CL 70%

Let the Agent Search: Autonomous Exploration Beats Rigid Workflows in Temporal Question Answering

让代理搜索:在时间问题回答中自主探索胜过固定工作流

Xufei Lv, Jiahui Yang, Haoyuan Sun, Xialin Su, Zhiliang Tian, Yifu Gao, Linbo Qiao, Houde Liu

机构 * National University of Defense Technology(国防科技大学) Tsinghua University(清华大学)

专题命中 规划推理 :reasoning(abstract);self-correction(abstract);分类 cs.CL

AI总结 本文提出AT2QA代理,通过自主探索和动态自我纠正提升时间知识图谱问题回答性能,实验表明其在三个基准测试中超越现有最佳基线。

Comments Revised version with three added authors and additional experiments

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23875 2026-03-26 cs.MA 67%

Self-Evolving Multi-Agent Framework for Efficient Decision Making in Real-Time Strategy Scenarios

自适应演化多智能体框架用于实时战略场景中的高效决策

Li Ma, Hao Peng, Yiming Wang, Hongbin Luo, Jie Liu, Kongjing Gu, Guanlin Wu, Hui Lin, Lei Ren

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 本文提出SEMA框架,通过自适应校准模型偏差和动态观察剪枝,提升实时战略场景中的决策效率与一致性,实验显示其在StarCraft II地图上胜率更高且决策延迟降低超过50%。

Comments 17 pages, 6 figures. Submitted to SCIS (Science China Information Science)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04607 2026-03-26 cs.OS cs.AI cs.LG 62%

From Imperative to Declarative: Towards LLM-friendly OS Interfaces for Boosted Computer-Use Agents

从命令式到声明式:面向提升计算机使用代理的LLM友好操作系统接口

Yuan Wang, Mingyu Li, Haibo Chen

机构 * Key Laboratory of System Software (Chinese Academy of Sciences)(中国科学院系统软件重点实验室) Institute of Software Chinese Academy of Sciences(中国科学院软件研究所) Shanghai Jiao Tong University(上海交通大学) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出Declarative Model Interface (DMI),通过将传统GUI转化为三种声明式原语,提升LLM驱动的计算机使用代理的任务成功率和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24442 2026-03-26 cs.MA 50%

Relaxing Constraints in Anonymous Multi Agent Path Finding for Large Agents

在大尺寸代理中放宽匿名多智能体路径寻找的约束

Stepan Dergachev, Dmitry Avdeev

专题命中 规划推理 :planning(abstract)

AI总结 本文针对匿名多智能体路径寻找问题,提出了一种在连续空间中放宽代理间最小分离约束的方法,将原本4倍半径的限制降低至2√3倍,同时保持路径安全性和无碰撞的理论性质。

Comments 14 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24361 2026-03-26 cs.RO 50%

LATS: Large Language Model Assisted Teacher-Student Framework for Multi-Agent Reinforcement Learning in Traffic Signal Control

LATS:基于多智能体强化学习的交通信号控制中的大语言模型辅助教师-学生框架

Yifeng Zhang, Peizhuo Li, Tingguang Zhou, Mingfeng Fan, Guillaume Sartoretti

机构 * Department of Mechanical Engineering, National University of Singapore(新加坡国立大学机械工程系)

专题命中 规划推理 :reasoning(abstract)

AI总结 本文提出LATS框架,结合大语言模型和多智能体强化学习,通过教师-学生模块提升交通信号控制的表示能力,实验表明其在多样交通场景中具有更高效和泛化性强的控制策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24005 2026-03-26 cs.CV 50%

DB SwinT: A Dual-Branch Swin Transformer Network for Road Extraction in Optical Remote Sensing Imagery

DB SwinT: 一种用于光学遥感图像道路提取的双分支Swin Transformer网络

Zongyang He, Xiangli Yang, Xian Gao, Zhiguo Wang

机构 * School of Information Science and Engineering(信息科学与工程学院) Chongqing Jiaotong University(重庆交通大学) College of Information Engineering(信息工程学院) Inner Mongolia University of Technology(内蒙古科技大学) Inner Mongolia Key Laboratory of Radar Technology and Application(内蒙古雷达技术与应用重点实验室)

专题命中 规划推理 :planning(abstract)

AI总结 本文提出DB SwinT网络,结合Swin Transformer的长距离依赖建模能力和U-Net的多尺度特征融合策略,通过双分支编码器学习互补的局部和全局表征,提升复杂环境中道路提取的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 视觉空间推理 4 篇

2603.23676 2026-03-26 cs.AI cs.RO 70%

Grounding Vision and Language to 3D Masks for Long-Horizon Box Rearrangement

将视觉与语言接地于3D遮罩以实现长周期箱子整理

Ashish Malik, Caleb Lowe, Aayam Shrestha, Stefan Lee, Fuxin Li, Alan Fern

专题命中 视觉空间推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 本文提出RAMP-3D模型,通过3D遮罩的序列预测实现长周期3D箱子整理任务,优于2D VLM基线,证明基于遮罩的反应策略在长周期规划中的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23523 2026-03-26 cs.CL cs.RO 57%

Do 3D Large Language Models Really Understand 3D Spatial Relationships?

三维大语言模型真的能理解三维空间关系吗?

Xianzheng Ma, Tao Sun, Shuai Chen, Yash Bhalgat, Jindong Gu, Angel X Chang, Iro Armeni, Iro Laina, Songyou Peng, Victor Adrian Prisacariu

机构 * VGG(视觉信息组) University of Oxford(牛津大学) Stanford University(斯坦福大学) Simon Fraser University(西蒙弗雷泽大学) Google DeepMind(谷歌DeepMind)

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.CL

AI总结 本文挑战了3D-LLM对三维空间关系的理解能力,提出Real-3DQA基准测试,发现现有模型在去除简单线索后表现不佳,并提出3D重加权训练目标以提升空间推理能力。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16371 2026-03-26 cs.CV 50%

Anchored Video Generation: Decoupling Scene Construction and Temporal Synthesis in Text-to-Video Diffusion Models

锚定视频生成:解耦场景构建与时间合成在文本到视频扩散模型中

Mariam Hassan, Bastien Van Delft, Wuyang Li, Alexandre Alahi

机构 * École Polytechnique Fédérale de Lausanne (EPFL)(瑞士联邦理工学院洛桑分校)

专题命中 视觉空间推理 :reasoning(abstract)

AI总结 本文提出锚定视频生成方法,通过解耦场景构建与时间合成任务,提升文本到视频扩散模型在复杂场景生成和时间逻辑遵循上的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23957 2026-03-26 cs.CV 50%

PointRFT: Explicit Reinforcement Fine-tuning for Point Cloud Few-shot Learning

PointRFT:针对点云少样本学习的显式强化微调

Yankai Wang, Yiding Sun, Qirui Wang, Pengbo Li, Chaoyi Lu, Dongxu Zhang

机构 * School of Software Engineering, Xi’an Jiaotong University(西安交通大学软件工程学院) International School, Beijing University of Posts and Telecommunications(北京邮电大学国际学院)

专题命中 视觉空间推理 :reasoning(abstract)

AI总结 本文提出PointRFT,一种专为点云表示学习设计的强化微调方法,通过定制奖励函数提升训练稳定性,实验表明其在多种基准上优于传统监督微调。

详情

展开后加载摘要…

URL PDF HTML 收藏