arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-04-03 至 2026-04-03 共收录 10 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 10 篇

2602.03380 2026-04-03 cs.CV 88%

Seeing Through the Chain: Mitigate Hallucination in Multimodal Reasoning Models via CoT Compression and Contrastive Preference Optimization

通过链看穿:通过CoT压缩和对比偏好优化缓解多模态推理模型的幻觉

Hao Fang, Jinyu Li, Jiawei Kong, Tianqu Zhuang, Kuofeng Gao, Bin Chen, Shu-Tao Xia

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))

专题命中 其他推理 :reasoning(title,abstract);CoT(title,abstract)

AI总结 本文提出C3PO框架,通过CoT压缩和对比偏好优化缓解多模态推理模型的幻觉问题,通过过滤冗余思考 token 提升信号效率,并利用高质量反馈和定制诱导器增强对比学习效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01302 2026-04-03 cs.CL 79%

Scaling Reasoning Tokens via RL and Parallel Thinking: Evidence From Competitive Programming

通过强化学习和并行思维扩展推理令牌:来自竞赛编程的证据

Qianfan Zhang, Tianyu Guo, Xuandi Ren, Jiale Chen, Ming Ding, Ran Xin, Xia Xiao

机构 * Princeton University(普林斯顿大学) Stanford University(斯坦福大学)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL

AI总结 本文通过强化学习和并行思维方法扩展竞赛编程中的推理令牌预算,展示了多轮并行思维流程在分配令牌预算方面的有效性,实验表明其在复杂编程问题上的优越性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16880 2026-04-03 eess.SP cs.CL cs.LG q-bio.NC 76%

NeuroNarrator: A Generalist EEG-to-Text Foundation Model for Clinical Interpretation via Spectro-Spatial Grounding and Temporal State-Space Reasoning

NeuroNarrator:一种通过频谱-空间定位和时间状态空间推理的通用EEG到文本基础模型,用于临床解释

Guoan Wang, Shihao Yang, Jun-en Ding, Hao Zhu, Feng Liu

机构 * Stevens Institute of Technology(史蒂文斯理工学院)

专题命中 其他推理 :reasoning(title);分类 cs.CL、cs.LG

AI总结 NeuroNarrator通过频谱-空间定位和时间状态空间推理,将EEG信号转化为临床文本,解决传统EEG分析方法在临床解释中的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01597 2026-04-03 cs.LG 70%

Learning from the Right Rollouts: Data Attribution for PPO-based LLM Post-Training

从正确的回放中学习:基于PPO的LLM后训练的数据归因

Dong Shu, Denghui Zhang, Jessica Hullman

机构 * Northwestern University(西北大学) Stevens Institute of Technology(史蒂文斯理工学院)

专题命中 其他推理 :reasoning(abstract);CoT(abstract);分类 cs.LG

AI总结 本文提出Influence-Guided PPO框架,通过计算影响分数筛选反向齐梯度的回放片段,提升PPO后训练效率并减少不忠实的推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25040 2026-04-03 cs.LG cs.CL cs.CV 62%

Intern-S1-Pro: Scientific Multimodal Foundation Model at Trillion Scale

Intern-S1-Pro:万亿参数科学多模态基础模型

Yicheng Zou, Dongsheng Zhu, Lin Zhu, Tong Zhu, Yunhua Zhou, Peiheng Zhou, Xinyu Zhou, Dongzhan Zhou, Zhiwang Zhou, Yuhao Zhou, Bowen Zhou, Zhanping Zhong, Zhijie Zhong, Haiteng Zhao, Penghao Zhao, Xiaomeng Zhao, Zhiyuan Zhao, Yechen Zhang, Jin Zhang, Wenwei Zhang, Hongjie Zhang, Zhuo Zhang, Wenlong Zhang, Bo Zhang, Chao Zhang, Chen Zhang, Yuhang Zang, Fei Yuan, Jiakang Yuan, Jiashuo Yu, Jinhui Yin, Haochen Ye, Qian Yao, Bowen Yang, Danni Yang, Kaichen Yang, Ziang Yan, Jun Xu, Yicheng Xu, Wanghan Xu, Xuenan Xu, Chao Xu, Ruiliang Xu, Shuhao Xing, Long Xing, Xinchen Xie, Ling-I Wu, Zijian Wu, Zhenyu Wu, Lijun Wu, Yue Wu, Jianyu Wu, Wen Wu, Fan Wu, Xilin Wei, Qi Wei, Bingli Wang, Rui Wang, Ziyi Wang, Zun Wang, Yi Wang, Haomin Wang, Yizhou Wang, Lintao Wang, Yiheng Wang, Longjiang Wang, Bin Wang, Jian Tong, Zhongbo Tian, Huanze Tang, Chen Tang, Shixiang Tang, Yu Sun, Qiushi Sun, Xuerui Su, Qisheng Su, Chenlin Su, Demin Song, Jin Shi, Fukai Shang, Yuchen Ren, Pengli Ren, Xiaoye Qu, Yuan Qu, Jiantao Qiu, Yu Qiao, Biqing Qi, Runyu Peng, Tianshuo Peng, Jiahui Peng, Qizhi Pei, Zhuoshi Pan, Linke Ouyang, Wenchang Ning, Yichuan Ma, Zerun Ma, Ningsheng Ma, Runyuan Ma, Chengqi Lyu, Haijun Lv, Han Lv, Lindong Lu, Kuikun Liu, Jiangning Liu, Yuhong Liu, Kai Liu, Hongwei Liu, Zhoumianze Liu, Mengjie Liu, Ziyu Liu, Wenran Liu, Yang Liu, Liwei Liu, Kaiwen Liu, Junyao Lin, Junming Lin, Tianyang Lin, Dahua Lin, Jianze Liang, Linyang Li, Peiji Li, Zonglin Li, Zehao Li, Pengze Li, Guoyan Li, Lingkai Kong, Linglin Jing, Zhenjiang Jin, Feifei Jiang, Qian Jiang, Junhao Huang, Zixian Huang, Haian Huang, Zhouqi Hua, Ermo Hua, Han Hu, Linfeng Hou, Yinan He, Conghui He, Tianyao He, Xu Guo, Qipeng Guo, Aijia Guo, Yuzhe Gu, Lixin Gu, Jingyang Gong, Qiming Ge, Jiaye Ge, Songyang Gao, Jianfei Gao, Xinyu Fang, Caihua fan, Yue Fan, Yanhui Duan, Zichen Ding, Shengyuan Ding, Ning Ding, Xuanlang Dai, Erfei Cui, Ganqu Cui, Pei Chu, Tao Chu, Guangran Cheng, Yu Cheng, Kai Chen, Yongkang Chen, Chiyu Chen, Guanzhou Chen, Qiaosheng Chen, Sitao Chen, Xin Chen, Haojiong Chen, Yicheng Chen, Weihan Cao, Yuhang Cao, Qinglong Cao, Lei Bai

机构 * Shanghai AI Laboratory(上海人工智能实验室)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.LG

AI总结 Intern-S1-Pro是首个万亿参数科学多模态基础模型,具备跨通用与科学领域的能力提升,融合强推理、图像-文本理解及先进代理能力,专精于100余项科学任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02280 2026-04-03 cs.AI cs.CV 57%

Novel Memory Forgetting Techniques for Autonomous AI Agents: Balancing Relevance and Efficiency

新颖的记忆遗忘技术用于自主AI代理:在相关性和效率之间平衡

Payal Fofadiya, Sunil Tiwari

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出一种自适应预算遗忘框架,通过相关性引导评分和有界优化,提升长周期对话任务的F1分数和记忆一致性,减少虚假记忆。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01599 2026-04-03 cs.AI 57%

ByteRover: Agent-Native Memory Through LLM-Curated Hierarchical Context

ByteRover:通过LLM-curated分层上下文实现代理原生内存

Andy Nguyen, Danh Doan, Hoang Pham, Bao Ha, Dat Pham, Linh Nguyen, Hieu Nguyen, Thien Nguyen, Cuong Do, Phat Nguyen, Toan Nguyen

机构 * ByteRover

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出ByteRover,一种代理原生内存架构,通过LLM-curated分层上下文实现知识的结构化存储与检索,实验显示其在LoCoMo和LongMemEval上表现优异,无需外部基础设施。

Comments 19 pages, 3 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01461 2026-04-03 cs.AI 57%

Reducing Hallucinations in LLM-based Scientific Literature Analysis Using Peer Context Outlier Detection

通过同侪上下文异常检测减少基于LLM的科学文献分析中的幻觉

Daniel Xie, Maxwell J. Jacobson, Adil Wazeer, Haiyan Wang, Xinghang Zhang, Yexiang Xue

专题命中 其他推理 :chain-of-thought(abstract);分类 cs.AI

AI总结 本文提出Peer Context Outlier Detection方法,通过文档间关系提升数据提取准确性,实验显示在6个科学领域达到98%的异常检测精度,减少幻觉并提高自动化系统可信度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00474 2026-04-03 cs.IT cs.LG eess.SP math.IT 57%

Wireless Power Control Based on Large Language Models

基于大语言模型的无线功率控制

Jiacheng Wang, Yucheng Sheng, Le Liang, Hao Ye, Shi Jin

机构 * School of Information Science and Engineering, Southeast University(东南大学信息科学与工程学院) Department of Electrical and Computer Engineering, University of California, Santa Cruz(加州大学圣克鲁兹分校电气与计算机工程系)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 本文提出PC-LLM框架,通过引入干扰感知注意力偏差,有效融合无线拓扑与预训练关系先验,实现高效无线网络功率控制,且在零样本环境下表现出色。

Comments 13 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01522 2026-04-03 cs.SE 50%

EpiDroid: Dependency-Guided Recomposition for Deep State Discovery in Mobile GUI Testing

EpiDroid:基于依赖的深度状态发现移动GUI测试中的重组

Jiahui Song, Jiaxin Zhi, Kangjia Zhao, Chen Zhi, Junxiao Han, Xinkui Zhao, Nan Wang, Shuiguang Deng, Jianwei Yin

专题命中 其他推理 :reasoning(abstract)

AI总结 EpiDroid通过语义状态依赖意识增强现有探索器,利用重组-回放范式和LLM进行影响推理,提升深度应用状态探索效率,实验证明其在代码覆盖率提升方面优于传统方法。

Comments 12 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏