arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-03-19 至 2026-03-19 共收录 93 信号源:cs.CL, cs.AI, cs.LG

1. 数学推理 1 篇

2510.04072 2026-03-19 cs.LG cs.AI cs.CL stat.ML 85%

Slow-Fast Policy Optimization: Reposition-Before-Update for LLM Reasoning

慢-快策略优化:在更新前重新定位用于大语言模型推理

Ziyan Wang, Zheng Wang, Xingwei Qu, Qi Cheng, Jie Fu, Shengpu Tang, Minjia Zhang, Xiaoming Huo

机构 * Georgia Institute of Technology(佐治亚理工学院) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Manchester(曼彻斯特大学) NVIDIA Independent(独立) Emory University(埃默里大学)

专题命中 数学推理 :reasoning(title,abstract);math reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出慢-快策略优化框架,通过分解步骤为三个阶段,解决RL在早期训练中的稳定性与效率问题,实验表明其在推理任务中提升稳定性、减少rollouts数量并加速收敛。

Comments Published as a conference paper at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 代码与定理证明 3 篇

2603.15674 2026-03-19 cs.AI cs.IT cs.LG math.IT stat.ML 82%

Theoretical Foundations of Latent Posterior Factors: Formal Guarantees for Multi-Evidence Reasoning

潜在后验因子的理论基础:多证据推理的正式保证

Aliyu Agboola Alege

机构 * Epalea

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种理论框架,通过变分自编码器将多异质证据转换为高斯潜在后验,并利用Sum-Product网络或神经聚合器进行聚合,提供多证据推理的正式保证。

Comments 30 pages, 8 figures, 10 tables. Theoretical characterization of the Latent Posterior Factors (LPF) framework for multi-evidence probabilistic reasoning, with formal guarantees and empirical validation

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16975 2026-03-19 cs.SE cs.AI cs.CY cs.ET cs.HC 70%

The State of Generative AI in Software Development: Insights from Literature and a Developer Survey

生成式人工智能在软件开发中的现状:文献和开发者调查的洞察

Vincent Gurgul, Robin Gubela, Stefan Lessmann

机构 * Bucharest University of Economic Studies(布加勒斯特经济大学)

专题命中 代码与定理证明 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 研究通过文献综述和65名开发者的调查,发现生成式AI在设计、实现、测试和文档中影响最大,显著减少重复性任务时间,但早期SDLC阶段收益较低,需加强治理以应对风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17296 2026-03-19 cs.CY cs.AI 57%

GUIDE: GenAI Units In Digital Design Education

GUIDE:数字设计教育中的生成式人工智能单元

Weihua Xiao, Jason Blocklove, Matthew DeLorenzo, Johann Knechtel, Ozgur Sinanoglu, Kanad Basu, Jeyavijayan Rajendran, Siddharth Garg, Ramesh Karri

机构 * NYU Tandon(纽约大学Tandon学院) NYU Abu Dhabi(纽约大学阿布扎比分校) RPI(罗切斯特理工学院) Texas A&M(德克萨斯大学阿姆斯特朗分校)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

AI总结 GUIDE为数字设计教育提供可运行的Google Colab实验室和课程资料,通过标准化教学单元提升学习一致性与教学效率,包含三个代表单元和四门课程实例,涵盖RTL生成、测试bench生成及IP盗版检测等核心内容。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 逻辑推理 6 篇

2603.15797 2026-03-19 cs.LG cs.AI 88%

OMNIFLOW: A Physics-Grounded Multimodal Agent for Generalized Scientific Reasoning

OMNIFLOW:一种基于物理的多模态代理用于通用科学推理

Hao Wu, Yongheng Zhang, Yuan Gao, Fan Xu, Fan Zhang, Ruobing Xie, Ruijian Gou, Yuxuan Liang, Xiaomeng Huang, Xian Wu

机构 * Tsinghua University(清华大学) Tencent(腾讯) Shenzhen Loop Area Institute(深圳河套学院) Ocean University of China(海洋大学) HKUST (Guangzhou)(香港科技大学(广州))

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);logical reasoning(abstract)

AI总结 OMNIFLOW通过引入语义-符号对齐机制和物理引导的推理流程,实现了多模态模型在物理定律下的科学推理,显著提升了零样本泛化和少样本适应能力,提供透明且物理一致的推理报告。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17208 2026-03-19 cs.CL cs.PL 70%

SYMDIREC: A Neuro-Symbolic Divide-Retrieve-Conquer Framework for Enhanced RTL Synthesis and Summarization

SYMDIREC:一种用于增强RTL综合与摘要的神经符号分割-检索-解决框架

Prashanth Vijayaraghavan, Apoorva Nitsure, Luyao Shi, Charles Mackin, Ashutosh Jadhav, David Beymer, Ehsan Degan, Vandana Mukherjee

机构 * IBM Research(IBM研究院)

专题命中 逻辑推理 :reasoning(abstract);planning(abstract);分类 cs.CL

AI总结 SYMDIREC通过结合符号规划与LLM推理,提升RTL综合与摘要的准确性,实现比基线方法更高的Pass@1率和ROUGE-L分数。

Journal ref EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12797 2026-03-19 cs.LG cs.AI q-bio.GN 62%

Genomic Next-Token Predictors are In-Context Learners

基因组下一个标记预测器是上下文学习者

Nathan Breslow, Aayush Mishra, Mahler Revsine, Michael C. Schatz, Anqi Liu, Daniel Khashabi

机构 * Department of Computer Science, Johns Hopkins University(约翰霍普金斯大学计算机科学系)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 研究探讨基因组序列中是否能像语言模型一样通过大规模预测训练自发产生上下文学习能力,发现基因组模型在模式归纳中表现出对数线性增益。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17969 2026-03-19 cs.RO cs.AI 57%

Specification-Aware Distribution Shaping for Robotics Foundation Models

面向规范的机器人基础模型分布塑形

Sadık Bera Yüksel, Derya Aksaray

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出一种面向规范的机器人基础模型分布优化框架,通过在预训练模型执行中强制满足信号时序逻辑约束,提升机器人在复杂任务中的安全性和合规性。

Comments 8 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17170 2026-03-19 cs.CR cs.AI cs.PL 57%

PAuth - Precise Task-Scoped Authorization For Agents

PAuth - 精确任务范围授权 for 代理

Reshabh K Sharma, Linxi Jiang, Zhiqiang Lin, Shuo Chen

机构 * University of Washington(华盛顿大学) The Ohio State University(俄亥俄州立大学) Microsoft Research(微软研究院)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI

AI总结 PAuth通过隐式授权模型精确控制代理执行任务所需的操作权限,通过NL切片和信封结构确保操作合法性,实验表明其在安全和性能上均表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16448 2026-03-19 cs.AI 57%

TRUST-SQL: Tool-Integrated Multi-Turn Reinforcement Learning for Text-to-SQL over Unknown Schemas

TRUST-SQL:基于工具的多轮强化学习用于未知模式下的文本到SQL

Ai Jian, Xiaoyun Zhang, Wanrou Du, Jingqing Ruan, Jiangbo Pei, Weipeng Zhang, Ke Zeng, Xunliang Cai

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) State Key Lab of Processors, Institute of Computing Technology, CAS(中国科学院计算技术研究所处理器国家重点实验室) University of Chinese Academy of Sciences(中国科学院大学) Meituan(美团)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出TRUST-SQL,通过工具集成的多轮强化学习解决文本到SQL在未知模式下的问题,通过结构化四阶段协议和Dual-Track GRPO策略提升性能,实验表明在多个基准上取得显著改进。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 规划推理 17 篇

2603.17368 2026-03-19 cs.AI 89%

Towards Safer Large Reasoning Models by Promoting Safety Decision-Making before Chain-of-Thought Generation

通过在链式思考生成前促进安全决策来构建更安全的大推理模型

Jianan Chen, Zhifang Zhang, Shuo He, Linan Yue, Lei Feng, Minling Zhang

机构 * Southeast University, China(东南大学,中国) The University of Queensland, Australia(昆士兰大学,澳大利亚) Nanyang Technological University, Singapore(南洋理工大学,新加坡)

专题命中 规划推理 :reasoning(title,abstract);chain-of-thought(title,abstract);CoT(abstract);分类 cs.AI

AI总结 本文提出在链式思考生成前促进安全决策的方法,提升大推理模型的安全性同时保持推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17815 2026-03-19 cs.CL 88%

Process Supervision for Chain-of-Thought Reasoning via Monte Carlo Net Information Gain

通过蒙特卡洛网络信息增益实现链式推理过程监督

Corentin Royer, Debarun Bhattacharjya, Gaetano Rossiello, Andrea Giovannini, Mennatallah El-Assady

机构 * Department of Computer Science, ETH Zurich(苏黎世联邦理工学院计算机科学系) IBM Research(IBM研究院)

专题命中 规划推理 :reasoning(title,abstract);chain-of-thought(title,abstract);分类 cs.CL

AI总结 本文提出利用信息论自动生成推理步骤标签,提升大语言模型推理过程的监督效率与可靠性,适用于多种推理基准测试。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20991 2026-03-19 cs.AI cs.MA 79%

FinAgent: An Agentic AI Framework Integrating Personal Finance and Nutrition Planning

FinAgent:整合个人财务与营养规划的智能框架

Toqeer Ali Syed, Abdulaziz Alshahrani, Ali Ullah, Ali Akarma, Sohail Khan, Muhammad Nauman, Salman Jan

机构 * Faculty of Computer and Information System, Islamic University of Madinah, Saudi Arabia(麦加伊斯兰大学计算机与信息学院) Department of Computer Science, Effat College of Engineering, Effat University, Saudi Arabia(Effat大学工程学院计算机科学系) Arab Open University, Bahrain(巴林开放大学)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 本文提出一种价格敏感型智能系统,结合个人财务管理与饮食优化,通过模块化多智能体架构实现营养充足且价格合理的饮食计划,实验显示可减少12-18%的开支并提高营养充足率。

Comments This paper was presented at the IEEE International Conference on Computing and Applications (ICCA 2025), Bahrain

Journal ref Proceedings of the 2025 IEEE International Conference on Computing and Applications (ICCA), Bahrain, 2025, pp. 1-7

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17533 2026-03-19 cs.IR cs.LG 79%

A Unified Language Model for Large Scale Search, Recommendation, and Reasoning

大规模检索、推荐与推理的统一语言模型

Marco De Nadai, Edoardo D'Amico, Max Lefarov, Alexandre Tamborrino, Divita Vohra, Mark VanMiddlesworth, Shawn Lin, Jacqueline Wood, Jan Stypka, Eliza Klyce, Keshi Dai, Timothy Christopher Heath, Martin D. Gould, Yves Raimond, Sandeep Ghael, Tony Jebara, Andreas Damianou, Vladan Radosavljevic, Paul N. Bennett, Mounia Lalmas, Praveen Chandar

机构 * Spotify

专题命中 规划推理 :reasoning(title,abstract);分类 cs.LG

AI总结 本文提出NEO框架,通过将预训练解码器模型适应为工具无关的生成器,实现多领域实体、用户和语言的联合推理,展示了在大规模目录上的推荐、搜索和用户理解任务中的优越性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16967 2026-03-19 cs.CV cs.AI 79%

MSRAMIE: Multimodal Structured Reasoning Agent for Multi-instruction Image Editing

MSRAMIE:多模态结构推理代理用于多指令图像编辑

Zhaoyuan Qiu, Ken Chen, Xiangwei Wang, Yu Xia, Sachith Seneviratne, Saman Halgamuge

机构 * University Of Melbourne(墨尔本大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 MSRAMIE基于多模态大语言模型构建无需训练的代理框架,通过结构化多模态推理处理多指令图像编辑任务,提升复杂指令遵循度和完成概率,同时保持图像质量和一致性。

Comments 14 pages, 6 figures, 3 tables, appendix and references provided

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.21982 2026-03-19 cs.RO cs.SY eess.SY 78%

A MILP-Based Solution to Multi-Agent Motion Planning and Collision Avoidance in Constrained Environments

基于混合整数线性规划的多智能体运动规划与碰撞避障方法

Akshay Jaitly, Jack Cline, Siavash Farzan

机构 * Robotics Engineering Department, Worcester Polytechnic Institute(沃斯特理工学院机器人工程系) Electrical Engineering Department, California Polytechnic State University(加州州立大学弗雷斯诺分校电子工程系)

专题命中 规划推理 :planning(title,abstract)

AI总结 本文提出一种基于混合整数线性规划的多智能体运动规划方法,通过将多凸多边形动作规划嵌入序列-求解流程,利用大M超平面模型实现智能体间分离,并通过L1路径长度加加速度成本生成平滑轨迹。

Comments Accepted to 2025 IEEE International Conference on Automation Science and Engineering (CASE 2025). This arXiv version adds a supplementary appendix with figures not in the IEEE proceedings

Journal ref IEEE 21st International Conference on Automation Science and Engineering (CASE), 2025, pp. 2200-2207

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17626 2026-03-19 cs.CV 78%

A Multi-Agent System for Building-Age Cohort Mapping to Support Urban Energy Planning

一种多智能体系统用于建筑年龄队列映射以支持城市能源规划

Kundan Thota, Thorsten Schlachter, Veit Hagenmeyer

机构 * Institute for Automation(自动化研究所) Applied Informatics (IAI)(应用信息学(IAI)) Karlsruhe Institute of Technology (KIT)(卡尔斯鲁厄理工学院(KIT)) Karlsruhe, Germany(德国卡尔斯鲁厄)

专题命中 规划推理 :planning(title,abstract)

AI总结 本文提出多智能体系统融合异构数据,通过BuildingAgeCNN实现建筑年龄分类,提升城市能源规划的准确性与可持续性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17831 2026-03-19 cs.AI 74%

RPMS: Enhancing LLM-Based Embodied Planning through Rule-Augmented Memory Synergy

RPMS:通过规则增强的记忆协同提升基于LLM的具身规划

Zhenhang Yuan, Shenghai Yuan, Lihua Xie

机构 * School of Electrical & Electronic Engineering(电子与电气工程学院)

专题命中 规划推理 :planning(title);分类 cs.AI

AI总结 本文提出RPMS架构,通过结构化规则检索、轻量信念状态和规则优先仲裁解决LLM在封闭世界具身环境中的失效问题,显著提升任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20095 2026-03-19 cs.CV 67%

WPT: World-to-Policy Transfer via Online World Model Distillation

WPT: 通过在线世界模型蒸馏实现世界到策略的迁移

Guangfeng Jiang, Yueru Luo, Jun Liu, Yi Huang, Yiyao Zhu, Zhan Qu, Dave Zhenyu Chen, Bingbing Liu, Xu Yan

机构 * University of Science and Technology of China(科学技术大学) CUHK-SZ(香港中文大学(深圳)) HKUST(香港理工大学) Huawei Foundation Model Department(华为基金会模型部)

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 本文提出WPT方法,通过在线世界模型蒸馏实现策略迁移,提升规划性能并保持实时部署能力,实验表明其在开放环和闭合环基准上表现优异。

Comments CVPR2026 Accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17191 2026-03-19 cs.CL cs.LG q-bio.QM 62%

Tabular LLMs for Interpretable Few-Shot Alzheimer's Disease Prediction with Multimodal Biomedical Data

用于多模态生物医学数据的可解释少样本阿尔茨海默病预测的表格LLMs

Sophie Kearney, Shu Yang, Zixuan Wen, Weimin Lyu, Bojian Hou, Duy Duong-Tran, Tianlong Chen, Jason H. Moore, Marylyn D. Ritchie, Chao Chen, Li Shen

机构 * University of Pennsylvania(宾夕法尼亚大学) Stony Brook University(石溪大学) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) Medical University of South Carolina(南卡罗来纳医科大学) Cedars-Sinai Medical Center(西格拉姆山医疗中心)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL、cs.LG

AI总结 本文提出TAP-GPT框架,利用预训练的大语言模型进行少样本阿尔茨海默病分类,展示了其在多模态生物医学数据中的优越性能和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16901 2026-03-19 cs.LG cs.AI 62%

From Language to Action in Arabic: Reliable Structured Tool Calling via Data-Centric Fine-Tuning

从阿拉伯语到行动:通过数据驱动的微调实现可靠的结构化工具调用

Omer Nacar, Deema Alquffari, Saleh Alsharideh, Adeem AlOtaibi, Abdulaziz Alabdulkarim, Leen Alhazmi, Nada Alomar, Wareef Alzubaidi, Nada Alsultan, Ahmed Alrabghi, Demah Alhoshan, Rana Alsayyari, Hamed Alruwaili, Albaraa Jaafar, Khaled Alusmani, Abdulaziz Alsohimy, Munirah Alsubaie, Shahd Aldukhayil, Arwa Alali, Yazeed BinShihah, Razan Alsulaymi, Nourah Alhumaid, Razan Abdulsalam, Reem Alamoudi, Mohammed Alkhalifa

机构 * Tuwaiq Academy(图瓦伊克学院) Tahakom(塔哈科姆) Wakeb Company(沃克公司) Qatmeer Co.(卡提迈尔公司) NCGR Vision Bank(视觉银行)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出AISA-AR-FunctionCall框架,通过数据审计、模式修复和提示重构等方法,显著提升阿拉伯语函数调用模型的稳定性与准确性,减少解析失败率并提高功能名称识别精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16289 2026-03-19 cs.CV cs.AI 57%

VisBrowse-Bench: Benchmarking Visual-Native Search for Multimodal Browsing Agents

VisBrowse-Bench:多模态浏览代理的视觉原生搜索基准测试

Zhengbo Zhang, Jinbo Su, Zhaowen Zhou, Changtao Miao, Yuhan Hong, Qimeng Wu, Yumeng Liu, Feier Wu, Yihe Tian, Yuhao Liang, Zitong Shan, Wanke Xia, Yi-Fan Zhang, Bo Zhang, Zhe Li, Shiming Xiang, Ying Yan

机构 * CASIA Ant Digital Technologies Ant Group(蚂蚁集团数字技术部) RUC(清华大学) FZU(福建师范大学) THU(清华大学) USTB(北京科技大学) PKU(北京大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出VisBrowse-Bench,用于评估多模态浏览代理的视觉推理能力,通过文本-图像检索和联合推理进行多模态证据交叉验证,验证了不同模型在搜索过程中的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17420 2026-03-19 cs.AI 57%

From Digital Twins to World Models:Opportunities, Challenges, and Applications for Mobile Edge General Intelligence

从数字孪生到世界模型:移动边缘通用智能的机会、挑战与应用

Jie Zheng, Dusit Niyato, Changyuan Zhao, Jiawen Kang, Jiacheng Wang

机构 * State-Province Joint Engineering and Research Center of Advanced Networking and Intelligent Information Services, College of Computer, Northwest University(高级网络与智能信息服务省州联合工程研究中心,计算机学院,西北大学) College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学) Automation of School, Guangdong University of Technology(自动化学院,广东工业大学)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文探讨了从数字孪生到世界模型的转变,分析了其在移动边缘通用智能中的作用,涵盖概念差异、设计原则、关键组件及应用挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05904 2026-03-19 cs.AR cs.AI 57%

LUMINA: LLM-Guided GPU Architecture Exploration via Bottleneck Analysis

LUMINA: 通过瓶颈分析指导的LLM引导的GPU架构探索

Tao Zhang, Rui Ma, Shuotao Xu, Yongqiang Xiong, Peng Cheng

机构 * Microsoft Research(微软研究院)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 LUMINA利用AI提升GPU设计空间探索效率,通过自动编译DSE规则和基准测试,实现高效高质量的设计指导,比传统方法提升17.5倍效率和32.9%的设计效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25758 2026-03-19 cs.AI 57%

TheraMind: A Strategic and Adaptive Agent for Longitudinal Psychological Counseling

TheraMind:一种用于长期心理辅导的战略和自适应代理

He Hu, Chiyuan Ma, Qianning Wang, Lin Liu, Yucheng Zhou, Laizhong Cui, Fei Ma, Qi Tian

机构 * Shenzhen University(深圳大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Auckland University of Technology(奥克兰理工大学) University of Science and Technology of China(中国科学技术大学) SKL-IOTSC, CIS, University of Macau(澳门科技研究所、CIS、澳门大学) Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东人工智能与数字经济实验室(深圳))

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出TheraMind,一种用于可信在线长期心理辅导的战略和自适应代理,通过双循环架构提升对话管理和治疗规划能力,实验证明其在多会话指标上优于其他方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17339 2026-03-19 cs.DL 50%

citecheck: An MCP Server for Automated Bibliographic Verification and Repair in Scholarly Manuscripts

citecheck: 一种MCP服务器,用于学术手稿中的自动文献验证与修复

Junhyeok Lee

专题命中 规划推理 :planning(abstract)

AI总结 citecheck通过自动化验证和修复学术手稿中的文献错误,包括识别错误、元数据不完整、作者归属错误及预印本与发表版本不一致等问题,提供结构化修复建议和安全诊断。

Comments 6 pages, 1 figure. Software paper on bibliography verification and repair for scholarly manuscripts; includes MCP server implementation and evaluation on repository-backed tests

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17155 2026-03-19 cs.SI cs.SY eess.SY 50%

On Online Control of Opinion Dynamics

关于在线控制意见动态

Sheryl Paul, Leslie Cruz Juarez, Jyotirmoy V. Deshmukh, Ketan Savla

专题命中 规划推理 :planning(abstract)

AI总结 本文研究了在个体对影响的易感性未知的情况下,如何通过在线算法估计该参数并驱动意见向目标收敛,分析了在预算或时间约束下稳定性与收敛性的条件。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 视觉空间推理 14 篇

2603.18002 2026-03-19 cs.CV cs.AI cs.CL 81%

Loc3R-VLM: Language-based Localization and 3D Reasoning with Vision-Language Models

Loc3R-VLM:基于语言的定位与3D推理的视觉语言模型

Kevin Qu, Haozhe Qi, Mihai Dusmanu, Mahdi Rad, Rui Wang, Marc Pollefeys

机构 * Microsoft Spatial AI Lab(微软空间AI实验室) ETH Zurich(苏黎世联邦理工学院) EPFL(苏黎世联邦理工学院)

专题命中 视觉空间推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 Loc3R-VLM通过结合全局布局重建和显式情境建模,提升视觉语言模型的3D空间理解能力,在语言定位和3D问答任务中取得最优性能。

Comments Project Page: https://kevinqu7.github.io/loc3r-vlm

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17670 2026-03-19 cs.RO 80%

AgentVLN: Towards Agentic Vision-and-Language Navigation

AgentVLN:迈向具有代理能力的视觉-语言导航

Zihao Xin, Wentong Li, Yixuan Jiang, Ziyuan Huang, Bin Wang, Piji Li, Jianke Zhu, Jie Qin, Shengjun Huang

机构 * Nanjing University of Aeronautics and Astronautics(南京航空航天大学) Shandong University(山东大学) Zhejiang University(浙江大学)

专题命中 视觉空间推理 :reasoning(abstract);chain-of-thought(abstract);planning(abstract);self-correction(abstract)

AI总结 本文提出AgentVLN框架,通过部分可观测半马尔可夫决策过程建模视觉-语言导航,结合VLM-as-Brain范式和跨空间表示映射,解决多级表示不一致问题,实现高效轻量级导航部署。

Comments 19pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17333 2026-03-19 cs.CL 79%

Grid Spatial Understanding: A Dataset for Textual Spatial Reasoning over Grids, Embodied Settings, and Coordinate Structures

网格空间理解:一个用于文本空间推理、具身场景和坐标结构的数据集

Risham Sidhu, Julia Hockenmaier

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 视觉空间推理 :reasoning(title,abstract);分类 cs.CL

AI总结 本文提出GSU数据集,用于评估LLM在导航、物体定位和结构组合任务中的空间推理能力,发现模型在具身代理参考框架和坐标列表识别上存在困难,且微调小模型可能达到前沿模型性能。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏