arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-03-31 至 2026-03-31 共收录 158 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 22 篇

2603.27536 2026-03-31 cs.AI 57%

Dual-Stage LLM Framework for Scenario-Centric Semantic Interpretation in Driving Assistance

双阶段LLM框架用于驾驶辅助中的场景中心语义解释

Jean Douglas Carvalho, Hugo Taciro Kenji, Ahmad Mohammad Saber, Glaucia Melo, Max Mauro Dias Santos, Deepa Kundur

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出双阶段LLM框架,用于评估城市驾驶场景中基于LLM的风险推理可复现性。通过多模态驾驶数据构建确定性场景窗口,并在固定提示约束和闭合数字风险方案下评估,揭示模型间在风险等级分配、高风险升级、证据使用和因果归因上的系统性差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27116 2026-03-31 cs.AI cs.IR cs.NE 57%

The Price of Meaning: Why Every Semantic Memory System Forgets

意义的代价:为何每一个语义记忆系统都会遗忘

Sambartha Ray Barman, Andrey Starenky, Sofia Bodnar, Nikhil Narasimhan, Ashwin Gopinath

机构 * Sentra Massachusetts Institute of Technology(麻省理工学院)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文研究了语义记忆系统中意义与遗忘的权衡,证明了语义连续核阈值记忆系统中干扰和遗忘不可避免,通过四个结果揭示了语义表示的有效秩、局部维度、记忆增长对保留的影响以及联想诱饵的虚假回忆无法消除。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08482 2026-03-31 cs.DB cs.AI 57%

CLEAR: A Knowledge-Centric Vessel Trajectory Analysis Platform

CLEAR:一种以知识为中心的船舶轨迹分析平台

Hengyu Liu, Tianyi Li, Haoyu Wang, Kristian Torp, Yushuai Li, Tiancheng Zhang, Torben Bach Pedersen, Christian S. Jensen

机构 * Aalborg University(奥尔堡大学) Northeastern University(东北大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 CLEAR平台利用大语言模型生成能力,将不完整复杂的AIS数据转化为完整可解释的船舶轨迹,通过结构化数据知识图谱提升非专业用户分析能力。

Comments 4 pages, 5 figures. Accepted at SIGMOD 2026 Demo Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26904 2026-03-31 quant-ph cs.AI 57%

Are LLMs Good For Quantum Software, Architecture, and System Design?

大语言模型在量子软件、架构和系统设计中是否有效?

Sourish Wawdhane, Poulami Das

机构 * UT Austin(德克萨斯大学奥斯汀分校)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文探讨大语言模型在量子系统设计中的应用,评估了九种前沿模型与研究生在量子计算问题上的表现,提出未来研究方向。

Comments 2 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26797 2026-03-31 cs.LG 57%

MemGuard-Alpha: Detecting and Filtering Memorization-Contaminated Signals in LLM-Based Financial Forecasting via Membership Inference and Cross-Model Disagreement

MemGuard-Alpha:通过成员推断和跨模型分歧检测和过滤受记忆污染的信号在基于LLM的金融预测中

Anisha Roy, Dip Roy

机构 * Jaypee Institute of Information Technology(贾伊皮信息技术学院) Indian Institute of Technology Patna(印度理工学院巴特那分校)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 MemGuard-Alpha通过成员推断和跨模型分歧方法,检测并过滤LLM生成的受记忆污染的信号,提升金融预测的准确性与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28755 2026-03-31 cs.CY 50%

Graphilosophy: Graph-Based Digital Humanities Computing with The Four Books

图哲学:基于图的数字人文计算与四书

Minh-Thu Do, Quynh-Chau Le-Tran, Duc-Duy Nguyen-Mai, Thien-Trang Nguyen, Khanh-Duy Le, Minh-Triet Tran, Tam V. Nguyen, Trung-Nghia Le

专题命中 其他推理 :reasoning(abstract)

AI总结 本文提出图哲学框架,通过多层知识图谱整合自然语言处理与人文分析,将中越双语文本转化为可解释的资源,提升跨文化伦理概念理解与学习。

Comments AI & Society journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28686 2026-03-31 cs.SE 50%

C2RustXW: Program-Structure-Aware C-to-Rust Translation via Program Analysis and LLM

C2RustXW: 通过程序分析和LLM实现的程序结构感知的C到Rust翻译

Yanyan Yan, Yang Feng, Jiangshan Liu, Di Liu, Zixi Liu, Hao Teng, Baowen Xu

专题命中 其他推理 :reasoning(abstract)

AI总结 本文提出C2RustXW工具,通过程序分析与LLM结合,实现结构感知的C到Rust翻译,提高代码正确性和可维护性,实验显示在CodeNet和GitHub上达到高语法正确率和代码压缩效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27184 2026-03-31 cs.CV 50%

Incentivizing Temporal-Awareness in Egocentric Video Understanding Models

激励时间感知的自体视频理解模型

Zhiyang Xu, Tian Qin, Bowen Jin, Zhengfeng Lai, Meng Cao, Lifu Huang, Peng Zhang

机构 * Virginia Tech(弗吉尼亚理工大学) Apple(苹果公司) Harvard University(哈佛大学) UIUC(伊利诺伊大学厄巴纳-香槟分校) UC Davis(加州大学戴维斯分校)

专题命中 其他推理 :reasoning(abstract)

AI总结 本文提出TGPO算法,通过强化学习提升多模态大语言模型在自体视频理解中的时间感知能力,实验表明其在时间接地和因果连贯性方面优于现有方法。

Comments 11 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏