arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-04-20 至 2026-04-20 共收录 116 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 23 篇

2512.05722 2026-04-20 cs.LG physics.chem-ph 70%

Teaching Language Models Mechanistic Explainability Through MechSMILES

通过MechSMILES教会语言模型机制性可解释性

Théo A. Neukomm, Zlatko Jončev, Philippe Schwaller

机构 * Laboratory of Artificial Chemical Intelligence (LIAC), Institut des Sciences et Ingénierie Chimiques, Ecole Polytechnique Fédérale de Lausanne (EPFL), Lausanne 1015, Switzerland(人工化学智能实验室(LIAC)、化学与工程学院、瑞士联邦理工学院(EPFL)、拉沃斯纳1015号)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.LG

AI总结 本文提出MechSMILES框架,通过箭头推导法教会语言模型预测化学反应机制,实现了反应路径验证、原子映射和催化剂识别等能力,展示了在复杂机制预测任务中的高准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10635 2026-04-20 cs.CV 67%

ChatENV: An Interactive Vision-Language Model for Sensor-Guided Environmental Monitoring and Scenario Simulation

ChatENV: 一种用于传感器引导的环境监测和场景模拟的交互式视觉-语言模型

Hosam Elgendy, Ahmed Sharshar, Ahmed Aboeitta, Mohsen Guizani

机构 * Mohamed bin Zayed University of Artificial Intelligence(莫扎德·本·扎耶德人工智能大学)

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 ChatENV通过整合卫星图像与真实传感器数据,实现环境变化的时序推理与假设验证,提升了环境监测的交互性和准确性。

Comments 11 pages, 5 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15710 2026-04-20 cs.SD 67%

VoxMind: An End-to-End Agentic Spoken Dialogue System

VoxMind:一个端到端的智能语音对话系统

Tianle Liang, Yifu Chen, Shengpeng Ji, Yijun Chen, Zhiyang Jia, Jingyu Lu, Fan Zhuo, Xueyi Pu, Yangzhuo Li, Zhou Zhao

机构 * Zhejiang University(浙江大学) China University of Petroleum-Beijing at Karamay(中国石油大学(北京)克拉玛依校区) Xiamen University(厦门大学)

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 本文提出VoxMind,通过引入智能代理能力,提升端到端语音对话系统在复杂任务中的表现,实验表明其任务完成率显著提高。

Comments Accepted to ACL 2026 Main Conference.Code and data available at https://github.com/MM-Speech/VoxMind

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04377 2026-04-20 cs.CL cs.AI cs.LG 67%

Disco-RAG: Discourse-Aware Retrieval-Augmented Generation

Disco-RAG: 语篇意识的检索增强生成

Dongqi Liu, Hang Ding, Qiming Feng, Xurong Xie, Zhucun Xue, Chengjie Wang, Jian Li, Jiangning Zhang, Yabiao Wang

机构 * Saarland University(萨尔兰大学) Shanghai Jiaotong University(上海交通大学) Fudan University(复旦大学) Zhejiang University(浙江大学) Tencent YouTu Lab(腾讯优图实验室)

专题命中 规划推理 :planning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 Discourse-aware RAG框架通过构建篇章内结构树和跨篇章修辞图,提升知识整合能力,在问答和长文档摘要任务中取得最佳效果。

Comments ACL 2026 Main & Long Conference Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15672 2026-04-20 cs.LG cs.CL 62%

Faster LLM Inference via Sequential Monte Carlo

通过序列蒙特卡洛方法加速大语言模型推理

Yahya Emara, Mauricio Barba da Costa, Chi-Chih Chang, Cameron Freer, Tim Vieira, Ryan Cotterell, Mohamed S. Abdelfattah

机构 * Cornell University(康奈尔大学) Makora(马科拉) MIT(麻省理工学院) ETH Zürich(苏黎世联邦理工学院)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL、cs.LG

AI总结 本文提出SMC-SD方法,通过重要性加权重采样替代传统拒绝采样,提升推理速度,实验证明在多个基准测试中保持高精度的同时,比推测解码和自回归解码分别快2.36倍和5.2倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15344 2026-04-20 cs.HC cs.AI cs.IR cs.LG 62%

To LLM, or Not to LLM: How Designers and Developers Navigate LLMs as Tools or Teammates

对LLM而言,是使用还是不使用:设计师和开发者如何将LLM视为工具或队友

Varad Vishwarupe, Ivan Flechais, Nigel Shadbolt, Marina Jirotka

机构 * Department of Computer Science, University of Oxford(牛津大学计算机科学系)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 研究探讨了设计师和开发者在系统设计过程中如何将LLM视为工具或队友,分析了角色框架对决策权、问责制、监督策略和组织接受度的影响。

Comments 6 pages, 2 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14967 2026-04-20 cs.CV cs.AI 57%

UniDoc-RL: Coarse-to-Fine Visual RAG with Hierarchical Actions and Dense Rewards

UniDoc-RL: 基于分层动作和密集奖励的粗到细视觉RAG

Jun Wang, Shuo Tan, Zelong Sun, Tiancheng Gu, Yongle Zhao, Ziyong Feng, Kaicheng Yang, Zhiwu Lu

机构 * DeepGlint-AI

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 UniDoc-RL通过分层动作空间和密集奖励方案,提升视觉RAG系统的细粒度视觉语义处理能力,实现端到端训练,实验显示优于现有方法。

Comments 17 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14646 2026-04-20 cs.AI 57%

Targeted Exploration via Unified Entropy Control for Reinforcement Learning

通过统一熵控制实现定向探索的强化学习

Chen Wang, Lai Wei, Yanzhi Zhang, Chenyang Shao, Zedong Dan, Weiran Huang, Ge Lan, Yue Wang

机构 * College of Software, Nankai University(南开大学软件学院) Zhongguancun Academy(中关村学院) Shanghai Jiao Tong University(上海交通大学) Chinese Academy of Sciences(中国科学院) Tsinghua University(清华大学) Sun Yat-sen Univeristy(中山大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出UEC-RL框架,通过定向探索机制和稳定器解决强化学习中的熵崩溃问题,提升大模型推理性能。

Comments Accepted for publication in Findings of the 64th Annual Meeting of the Association for Computational Linguistics (ACL 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14518 2026-04-20 cs.AI 57%

Mind DeepResearch Technical Report

Mind DeepResearch 技术报告

MindDR Team, Li Auto Inc

机构 * MindDR Team(MindDR团队) Li Auto Inc(Li Auto公司)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 MindDR通过高效多智能体深度研究框架,在仅30B参数模型下实现领先性能,采用精心设计的数据合成和多阶段训练流程,其核心创新为三智能体架构及四阶段智能体专用训练流程,展现竞争力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07043 2026-04-20 cs.LG 57%

COMPASS: Benchmarking Constrained Optimization in LLM Agents

COMPASS:评估LLM代理在约束优化中的表现

Tian Qin, Felix Bai, Ting-Yao Hu, Raviteja Vemulapalli, Hema Swetha Koppula, Zhiyang Xu, Bowen Jin, Mert Cemri, Jiarui Lu, Zirui Wang, Meng Cao

机构 * Harvard University(哈佛大学) Apple(苹果公司) Virginia Tech(弗吉尼亚理工学院) UIUC(伊利诺伊大学香槟分校) UC Berkeley(加州大学伯克利分校)

专题命中 规划推理 :planning(abstract);分类 cs.LG

AI总结 COMPASS基准测试评估LLM代理在真实旅行规划中的约束优化能力,揭示当前模型在可行性与最优性之间存在显著差距,表明搜索空间探索不足是核心限制,编码代理提供潜在解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15493 2026-04-20 physics.optics cs.ET 50%

End-to-End Physical Design Automation Flow for Yield-Optimized Inverse-Designed Large-Scale Electronic-Photonic Integrated Circuits

端到端的物理设计自动化流程用于优化良率的逆向设计大规模电子-光子集成电路

Hongjian Zhou, Haoyu Yang, Haoxing Ren, Joaquin Matres, Jiaqi Gu

专题命中 规划推理 :planning(abstract)

AI总结 本文提出OptoSynthesizer流程,通过整合逆向设计、布局和路由工具,实现大规模电子-光子集成电路的高良率和紧凑设计。

Comments 4 page. Accepted to DAC 2026 Special Research Session

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15393 2026-04-20 quant-ph 50%

Projected Dynamic Programming for Sequential Quantum State Discrimination

投影动态规划用于顺序量子态辨识

Jaehun Jeong, Donghwa Ji, Hyunjun Jang, Kabgyun Jeong

专题命中 规划推理 :planning(abstract)

AI总结 本文将顺序量子态辨识问题建模为静态隐藏状态部分可观测马尔可夫决策过程,通过网格离散化连续信念单纯形并分析误差和计算复杂性,验证了量子领域中的精度与复杂性权衡及维度诅咒。

Comments 54 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12659 2026-04-20 eess.SP 50%

Two-Layer Reinforcement Learning-Assisted Joint Beamforming and Trajectory Optimization for Multi-UAV Downlink Communications

双层强化学习辅助多无人机下行通信中的联合波束成形与轨迹优化

Ruiqi Wang, Essra M. Ghoura, Omar Alhussein, Yuzhi Yang, Jing Ren, Shizhong Xu, Sami Muhaidat

专题命中 规划推理 :planning(abstract)

AI总结 本文提出双层框架,结合图神经网络与多智能体强化学习,解决无人机波束成形与轨迹优化问题,提升系统速率和收敛速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24758 2026-04-20 eess.SY cs.CY cs.MA cs.SY 50%

A Digital Twin Framework for Decision-Support and Optimization of EV Charging Infrastructure in Localized Urban Systems

面向本地城市系统的电动车充电基础设施决策支持与优化的数字孪生框架

Bui Khanh Linh Do, Thanh H. Nguyen, Nghi Huynh Quang, Doanh Nguyen-Ngoc, Laurent El Ghaoui

专题命中 规划推理 :planning(abstract)

AI总结 本文提出一种整合基于代理的决策支持与嵌入式优化的数字孪生框架,用于动态模拟电动车充电行为、基础设施布局及政策响应,通过大学校园案例分析,展示了动态通知和优化策略在提升用户满意度和能源管理中的作用。

Comments 38 pages, 11 figures. Accepted for publication in CEUS. This version is made available under the CC-BY-NC-ND 4.0 license. Final version available at: https://doi.org/10.1016/j.compenvurbsys.2026.102422

Journal ref Computers, Environment and Urban Systems, Volume 127, 102422 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18142 2026-04-20 cs.HC cs.CY cs.IR 50%

Mirroring Users: Towards Building Preference-aligned User Simulator with User Feedback in Recommendation

镜像用户:构建基于用户反馈的偏好对齐用户模拟器

Tianjun Wei, Huizhong Guo, Yingpeng Du, Zhu Sun, Huang Chen, Dongxia Wang, Jie Zhang

专题命中 规划推理 :reasoning(abstract)

AI总结 本文提出一种基于用户反馈的用户模拟器构建框架,通过生成高质量模拟数据提升推荐系统与用户偏好的对齐能力,并通过实验验证其有效性。

Comments ACL 2026 Main. Github: https://github.com/Joinn99/UserMirrorer

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 视觉空间推理 7 篇

2604.16060 2026-04-20 cs.CV cs.AI 90%

Chain-of-Thought Degrades Visual Spatial Reasoning Capabilities of Multimodal LLMs

基于链式思维的多模态大语言模型视觉空间推理能力退化

Sai Srinivas Kancheti, Aditya Sanjiv Kanade, Vineeth N. Balasubramanian, Tanuja Ganu

机构 * Microsoft Research India(微软印度研究院)

专题命中 视觉空间推理 :reasoning(title,abstract);chain-of-thought(title,abstract);CoT(abstract,abstract_cn);分类 cs.AI

AI总结 研究发现链式思维范式在视觉空间推理任务中导致性能下降,通过实验揭示多模态模型在空间基准测试中的关键缺陷,并指出需转向以视觉为中心的推理方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16298 2026-04-20 cs.CV cs.RO 67%

FineCog-Nav: Integrating Fine-grained Cognitive Modules for Zero-shot Multimodal UAV Navigation

FineCog-Nav:整合细粒度认知模块以实现零样本多模态无人机导航

Dian Shao, Zhengzheng Xu, Peiyang Wang, Like Liu, Yule Wang, Jieqi Shi, Jing Huo

机构 * Northwestern Polytechnical University(西北工业大学) Nanjing University(南京大学)

专题命中 视觉空间推理 :reasoning(abstract);planning(abstract)

AI总结 本文提出FineCog-Nav框架,通过细粒度认知模块提升无人机零样本多模态导航性能,构建了AerialVLN-Fine基准测试集,实验表明其在指令遵循、长视距规划和环境泛化方面优于基线方法。

Comments Accepted by CVPR 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.10562 2026-04-20 cs.CV cs.AI cs.CL cs.CY 62%

Seeing the Intangible: Survey of Image Classification into High-Level and Abstract Categories

看见无形:图像分类到高级和抽象类别的调查

Delfina Sol Martinez Pandiani, Valentina Presutti

机构 * University of Bologna(博洛尼亚大学) University of Bologna Department of Computer Science(博洛尼亚大学计算机科学系) University of Bologna Department of Modern Languages, Literatures(博洛尼亚大学现代语言文学系) Centrum Wiskunde en Informatica(数学与信息学研究中心) Institute for Clarity in Documentation(文档清晰研究所) Inria Paris-Rocquencourt(巴黎-罗克奎恩特研究所) Rajiv Gandhi University(拉贾·甘地大学) Tsinghua University(清华大学) Palmer Research Laboratories(帕尔默研究实验室)

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文通过系统回顾高阶视觉理解的研究,探讨了抽象概念在自动图像分类中的处理,揭示了高阶视觉推理的挑战与机遇,强调了混合AI系统的重要性。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15350 2026-04-20 cs.LG 57%

The Spectral Geometry of Thought: Phase Transitions, Instruction Reversal, Token-Level Dynamics, and Perfect Correctness Prediction in How Transformers Reason

思维的谱几何:相变、指令反向、令牌级动态以及完美正确性预测在Transformer推理中的表现

Yi Liu

机构 * DeepSeek-R1(深Seek-R1) Qwen(通义千问) Pythia Llama

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.LG

AI总结 研究通过系统谱分析发现,大语言模型在推理与事实回忆时在隐藏激活空间中表现出谱相变现象,揭示了推理的谱压缩、指令调谐的谱反向等七种核心现象,建立了一套关于Transformer推理的谱理论。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15332 2026-04-20 cs.HC cs.AI cs.CV cs.SE 57%

Automating Crash Diagram Generation Using Vision-Language Models: A Case Study on Multi-Lane Roundabouts

利用视觉-语言模型自动化生成碰撞图:多车道环形交叉口的案例研究

Xiao Lu, Hao Zhen, Jidong J. Yang

机构 * Smart Mobility and Infrastructure Lab, College of Engineering University of Georgia Athens(智能移动与基础设施实验室,工程学院,佐治亚大学亚特兰大分校)

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI

AI总结 本文研究利用视觉-语言模型自动化生成碰撞图,针对多车道环形交叉口这一挑战性案例,提出三步提示框架和10项评估指标,发现GPT-4o在空间推理和数据对齐方面表现最佳,为生成式AI在工程可视化中的应用奠定基础。

Comments 16 pages, 5 figures, 3 tables

Journal ref Applied Computing and Intelligence, 2026, 6(1): 38-57

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16248 2026-04-20 cs.CV 50%

Where Do Vision-Language Models Fail? World Scale Analysis for Image Geolocalization

视觉-语言模型在何处失效?面向图像地理定位的世界尺度分析

Siddhant Bharadwaj, Ashish Vashist, Fahimul Aleem, Shruti Vyas

机构 * University of Central Florida(中央佛罗里达大学)

专题命中 视觉空间推理 :reasoning(abstract)

AI总结 本文评估了多种先进视觉-语言模型在国家层面图像地理定位中的表现,揭示了模型在粗粒度地理定位中的潜力及当前模型在细粒度地理线索捕捉上的局限。

Comments Accepted to the CVPR EarthVision 2026 Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15946 2026-04-20 cs.CV cs.RO 50%

SENSE: Stereo OpEN Vocabulary SEmantic Segmentation

SENSE:立体视图开放词汇语义分割

Thomas Campagnolo, Ezio Malis, Philippe Martinet, Gaétan Bahl

机构 * Centre Inria d’Universite Cote d’Azur, France(法国里莫纳大学信息科学研究中心) NXP Semiconductors, France(法国恩智科半导体公司)

专题命中 视觉空间推理 :reasoning(abstract)

AI总结 本文提出SENSE,通过立体视觉与视觉语言模型提升开放词汇语义分割的精度,实验显示在PhraseStereo数据集上平均精度提升2.9%,并在Cityscapes和KITTI上取得更好的结果。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 测试时计算 8 篇

2604.16004 2026-04-20 cs.CL cs.AI 89%

AgentV-RL: Scaling Reward Modeling with Agentic Verifier

AgentV-RL: 通过代理验证器扩展奖励建模

Jiazheng Zhang, Ziche Fu, Zhiheng Xi, Wenqing Jing, Mingxu Chai, Wei He, Guoqiang Zhang, Chenghao Fan, Chenxin An, Wenxiang Chen, Zhicheng Liu, Haojie Pan, Dingwei Zhu, Tao Gui, Qi Zhang, Xuanjing Huang

机构 * College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院) Huazhong University of Science and Technology(华中科技大学) The University of Hong Kong(香港大学) ByteDance Seed(字节跳动种子) Institute of Trustworthy Embodied AI, Fudan University(复旦大学可信具身人工智能研究院) Shanghai Key Laboratory of Multimodal Embodied AI(上海多模态具身人工智能重点实验室)

专题命中 测试时计算 :verifier(title,summary_cn);reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文提出Agentic Verifier框架,通过多轮工具增强的反思过程提升奖励建模效果,实验显示其在并行和顺序TTS任务中表现优异,4B变体超越现有最优ORMs 25.2%。

Comments ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15726 2026-04-20 cs.AI 87%

LLM Reasoning Is Latent, Not the Chain of Thought

大语言模型的推理是潜在的,而非思维链

Wenshuo Wang

机构 * School of Future Technology, South China University of Technology, China(未来技术学院,华南理工大学,中国)

专题命中 测试时计算 :reasoning(title,abstract);CoT(abstract,abstract_cn);chain-of-thought(abstract);分类 cs.AI

AI总结 本文提出大语言模型推理应研究为潜在状态轨迹形成而非表面思维链。研究指出,推理对象的定义影响了忠实性、可解释性、推理基准和推理时干预的主张。通过分离三个混淆因素,提出三种假设,发现当前证据更支持潜在状态轨迹作为默认假设。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15972 2026-04-20 cs.AI cs.CL cs.MA 81%

Weak-Link Optimization for Multi-Agent Reasoning and Collaboration

多智能体推理与协作中的弱链接优化

Haoyu Bian, Chaoning Zhang, Jiaquan Zhang, Xingyao Li, Yuanfang Guo, Wei Dong, Yang Yang

机构 * University of Electronic Science and Technology of China(电子科技大学) Beihang University(北航) Xi'an University of Architecture and Technology(西安建筑科技大学)

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文提出WORC框架,通过识别并强化性能瓶颈智能体,提升多智能体系统的稳定性和泛化能力。

Comments 13 pages, 4 figures. Submitted to CAAI Transactions on Intelligence Technology

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15614 2026-04-20 cs.LG 79%

Flexible Empowerment at Reasoning with Extended Best-of-N Sampling

灵活的推理赋能与扩展的Best-of-N采样

Taisuke Kobayashi

机构 * National Institute of Informatics and The Graduate University for Advanced Studies, SOKENDAI Japan(日本信息处理研究所和高级研究大学研究院(SOKENDAI))

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.LG

AI总结 本文提出一种结合赋能的推理方法,通过扩展Best-of-N采样解决探索-利用困境,改进了传统奖励函数中延迟学习的问题。

Comments 15 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16027 2026-04-20 cs.CL cs.AI cs.LG 75%

Where does output diversity collapse in post-training?

在微调后输出多样性为何会崩溃?

Constantinos Karouzos, Xingwei Tan, Nikolaos Aletras

机构 * School of Computer Science University of Sheffield(计算机科学学院 伦敦大学谢菲尔德分校)

专题命中 测试时计算 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究探讨了微调后输出多样性的崩溃原因,发现数据组成和训练方法共同影响多样性,揭示多样性崩溃发生在训练阶段而非推理阶段。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15369 2026-04-20 cs.CR 67%

An Agentic Workflow for Detecting Personally Identifiable Information in Crash Narratives

一种用于检测事故叙述中个人可识别信息的代理工作流

Junyi Ma, Pei Li, Rui Gan, Kai Cheng, Steven T. Parker, Bin Ran

专题命中 测试时计算 :reasoning(abstract);verifier(abstract)

AI总结 本文提出一种本地部署的代理工作流,利用大语言模型检测事故叙述中的个人可识别信息,通过混合提取器和验证器提升检测精度与召回率,实现隐私保护的可扩展数据处理。

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15621 2026-04-20 cs.IR cs.AI cs.CL 62%

Rethinking the Necessity of Adaptive Retrieval-Augmented Generation through the Lens of Adaptive Listwise Ranking

重新审视通过适应性列表排序视角的适应性检索增强生成的必要性

Jun Feng, Jiahui Tang, Zhicheng He, Hang Lv, Hongchao Gu, Hao Wang, Xuezhi Yang, Shuai Fang

机构 * Hefei University of Technology(合肥工业大学) University of Science and Technology of China(中国科学技术大学)

专题命中 测试时计算 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文通过适应性列表排序视角重新审视适应性检索增强生成的必要性,提出AdaRankLLM框架,通过零样本提示和段落dropout机制验证适应性排序的必要性,并通过两阶段渐进蒸馏提升小模型的精确排序与适应过滤能力。

Comments 7pages, 2figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16116 2026-04-20 cs.ET cs.AI cs.CY 57%

The Relic Condition: When Published Scholarship Becomes Material for Its Own Replacement

遗物条件:当已发表的学术成果成为自身替代的原材料

Lin Deng, Chang-bo Liu

机构 * University of New South Wales(新南威尔士大学) Independent Researcher(独立研究者)

专题命中 测试时计算 :reasoning(abstract);分类 cs.AI

AI总结 本文研究了通过提取学者的推理系统并将其转化为大语言模型的约束,测试学者机器人在学术功能中的表现,揭示了出版系统如何使推理架构成为可替代的原材料。

详情

展开后加载摘要…

URL PDF HTML 收藏