arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-04-17 至 2026-04-17 共收录 128 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 13 篇

2604.14362 2026-04-17 cs.CL cs.AI cs.IR 81%

APEX-MEM: Agentic Semi-Structured Memory with Temporal Reasoning for Long-Term Conversational AI

APEX-MEM: 基于时序推理的代理半结构化记忆用于长期对话AI

Pratyay Banerjee, Masud Moshtaghi, Shivashankar Subramanian, Amita Misra, Ankit Chadha

机构 * Amazon(亚马逊)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 APEX-MEM通过结合属性图、只追加存储和多工具检索代理,解决大语言模型在长期对话记忆中的可靠性问题,实现88.88%的LOCOMO问答准确率和86.2%的LongMemEval表现。

Comments Accepted to ACL 2026 Mains

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10846 2026-04-17 cs.LG cs.CR 79%

AutoRAN: Automated Hijacking of Safety Reasoning in Large Reasoning Models

AutoRAN:大型推理模型中安全推理的自动化劫持

Jiacheng Liang, Tanqiu Jiang, Yuhui Wang, Rongyi Zhu, Fenglong Ma, Ting Wang

机构 * Stony Brook University(石溪大学) Penn State University(宾夕法尼亚州立大学)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.LG

AI总结 AutoRAN通过执行模拟方法,利用较弱但对齐差的模型模拟初始劫持尝试,并通过目标LRM的拒绝泄露的推理模式迭代优化攻击,从而绕过安全防护并扩展有害指令。

Comments 10 pages, ACL 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14507 2026-04-17 cs.CV cs.LG 79%

H2VLR: Heterogeneous Hypergraph Vision-Language Reasoning for Few-Shot Anomaly Detection

H2VLR:异构超图视觉-语言推理用于少样本异常检测

Jianghong Huang, Luping Ji, Weiwei Duan, Mao Ye

机构 * School of Computer Science and Engineering, University of Electronic Science and Technology of China(电子科技大学计算机科学与工程学院)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.LG

AI总结 本文提出H2VLR框架,通过统一超图联合建模视觉区域和语义概念,将少样本异常检测转化为高阶推理问题,有效提升异常检测性能。

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07408 2026-04-17 cs.LG cs.AI cs.CV 62%

Maximal Brain Damage Without Data or Optimization: Disrupting Neural Networks via Sign-Bit Flips

最大脑损伤无数据或优化:通过符号位翻转破坏神经网络

Ido Galil, Moshe Kimhi, Ran El-Yaniv

机构 * NVIDIA Technion(技术学院) IBM Research(IBM研究院)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 研究通过符号位翻转破坏神经网络,展示了在多个领域中的脆弱性,并提出数据和优化无关的DNL方法及改进版本1P-DNL,提出保护关键符号位的防御策略。

Comments 10 pages, 5 figures. Accepted as a Featured Paper at Transactions on Machine Learning Research (TMLR)

Journal ref Transactions on Machine Learning Research (TMLR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14339 2026-04-17 cs.CL 57%

Shuffle the Context: RoPE-Perturbed Self-Distillation for Long-Context Adaptation

重组上下文:RoPE扰动的自我蒸馏用于长上下文适应

Zichong Li, Chen Liang, Liliang Ren, Tuo Zhao, Yelong Shen, Weizhu Chen

机构 * Georgia Institute of Technology(佐治亚理工学院) Microsoft(微软)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出RoPE扰动的自我蒸馏方法,通过扰动RoPE索引生成不同视角的训练序列,提升模型对位置变化的鲁棒性,实验显示在长上下文任务中表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15041 2026-04-17 cs.SE 50%

HintPilot: LLM-based Compiler Hint Synthesis for Code Optimization

HintPilot: 基于LLM的编译器提示合成用于代码优化

Hanyun Jiang, Peisen Yao, Kaiyue Li, Tingting Lin, Chengpeng Wang, Kui Ren

专题命中 其他推理 :reasoning(abstract)

AI总结 HintPilot通过合成编译器提示注解,结合LLM推理与传统编译器基础设施,提升代码优化效果,实现6.88倍速度提升且保持程序正确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06559 2026-04-17 cs.CV 50%

ArrowGEV: Grounding Events in Video via Learning the Arrow of Time

ArrowGEV:通过学习时间之箭来视频中接地事件

Fangxu Yu, Ziyao Lu, Liqiang Niu, Fandong Meng, Jie Zhou

机构 * School of Artificial Intelligence, Nanjing University, China(南京大学人工智能学院,中国) Pattern Recognition Center, WeChat AI, Tencent Inc, China(腾讯人工智能研究院,中国)

专题命中 其他推理 :reasoning(abstract)

AI总结 本文提出ArrowGEV框架,通过学习时间方向性提升视频中事件接地与时间理解能力,通过区分时间敏感和时间不敏感事件增强模型鲁棒性与泛化能力。

Comments Accepted to Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05541 2026-04-17 cs.CV 50%

EchoAgent: Towards Reliable Echocardiography Interpretation with "Eyes","Hands" and "Minds"

EchoAgent:迈向可靠超声心动图解读的“眼、手、脑”系统

Qin Wang, Zhiqing He, Yu Liu, Bowen Guo, Zeju Li, Miao Zhao, Wenhao Ju, Zhiling Luo, Xianhong Shu, Yi Guo, Yuanyuan Wang

机构 * Fudan University(复旦大学) Fudan Zhongshan Hospital(复旦中山医院) Fuwai Yunnan Hospital(阜外云南医院) Fuwai Beijing Hospital(阜外北京医院)

专题命中 其他推理 :reasoning(abstract)

AI总结 本文提出EchoAgent,通过整合视觉、手动操作与专家知识,实现端到端的超声心动图解读,提升临床可靠性与实用性。

Comments Accepted by CVPR 2026 CV4Clinical, 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏