arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Peking University(北京大学)

2026-04-17 至 2026-04-17 共收录 10
2604.14922 2026-04-17 cs.LG cs.CL

LongAct: Harnessing Intrinsic Activation Patterns for Long-Context Reinforcement Learning

LongAct:利用内在激活模式促进长上下文强化学习

Bowen Ping, Zijun Chen, Tingfeng Hui, Qize Yu, Chenxuan Li, Junchi Yan, Baobao Chang

机构 * Peking University(北京大学) Shanghai Jiao Tong University(上海交通大学) Beijing University of Posts and Telecommunications(北京邮电大学)

AI总结 本文提出LongAct方法,通过利用长上下文推理中的稀疏结构,改进大语言模型的训练,提升长上下文处理能力与泛化性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12389 2026-04-17 cs.AI cs.CL

Evolving Beyond Snapshots: Harmonizing Structure and Sequence via Entity State Tuning for Temporal Knowledge Graph Forecasting

超越快照:通过实体状态调谐实现结构与序列的和谐统一以进行时间知识图谱预测

Siyuan Li, Yunjia Wu, Yiyong Xiao, Pingyang Huang, Peize Li, Ruitong Liu, Yan Wen, Te Sun

机构 * Dalian University of Technology(大连理工大学) Shenzhen University of Advanced Technology(深圳先进技术大学) King’s College London(伦敦大学国王学院) Peking University(北京大学) Beijing Institute of Technology(北京理工大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出Entity State Tuning框架,通过维持全局状态缓冲区和闭环设计,实现时间知识图谱预测中的持久化和持续进化实体状态,提升长周期预测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08310 2026-04-17 cs.LG cs.AI

ORBIT: On-policy Exploration-Exploitation for Controllable Multi-Budget Reasoning

ORBIT:可控多预算推理的在线探索-利用

Kun Liang, Clive Bai, Xin Xu, Chenming Tang, Sanwoo Lee, Weijie Liu, Saiyong Yang, Yunfang Wu

机构 * School of Computer Science, Peking University(北京大学计算机科学学院) National Key Laboratory for Multimedia Information Processing, Peking University(北京大学多媒体信息处理国家重点实验室) LLM Department, Tencent(腾讯LLM部门) The Hong Kong University of Science and Technology(香港科技大学)

AI总结 ORBIT提出可控多预算推理框架,通过多阶段强化学习发现帕累托最优推理行为,并通过在线蒸馏融合行为,实现可控推理行为、高推理密度和统一模型集成。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07449 2026-04-17 cs.IR cs.AI

RLPO: Residual Listwise Preference Optimization for Long-Context Review Ranking

RLPO:长上下文评论排序的残差列表偏好优化

Hao Jiang, Zhi Yang, Annan Wang, Yichi Zhang, Weisi Lin

机构 * Nanyang Technological University(南洋理工大学) Peking University(北京大学) Independent Researcher(独立研究员)

AI总结 本文提出RLPO,通过残差列表级优化提升长上下文评论排序,解决传统方法在长上下文下的效率与准确性矛盾,实验显示其在NDCG@k上优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20214 2026-04-17 cs.AI

When Slower Isn't Truer: Inverse Scaling Law of Truthfulness in Multimodal Reasoning

当慢并非真:多模态推理中真理性的反比例定律

Sitong Fang, Wenjing Cao, Jiahao Li, Xuyao Wang, Juntao Dai, Chi-Min Chan, Sirui Han, Yike Guo, Yaodong Yang, Jiaming Ji

机构 * Institute for AI(人工智能研究院) Peking University(北京大学) Hong Kong University of Science and Technology(香港科技大学)

AI总结 研究探讨了多模态推理中慢思考模式的反比例定律,发现慢思考模型在面对不完整或误导性视觉输入时更易生成虚假细节,揭示了推理模型在处理模糊输入时的脆弱性。

Comments Accepted at ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14806 2026-04-17 cs.SD cs.MM

Listen, Pause, and Reason: Toward Perception-Grounded Hybrid Reasoning for Audio Understanding

倾听、暂停与推理:迈向基于感知的混合推理以实现音频理解

Jieyi Wang, Yazhe Niu, Dexuan Xu, Zhongyu Wei

机构 * Shanghai AI Laboratory(上海人工智能实验室) Peking University(北京大学) CUHK MMLab(香港中文大学多媒体实验室) Fudan University(复旦大学)

AI总结 本文提出HyPeR框架,通过感知-推理混合方法提升音频理解能力,通过PAQA数据集训练模型并引入PAUSE标记和一致性奖励,实验表明其在复杂音频场景中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14709 2026-04-17 cs.AI

HWE-Bench: Benchmarking LLM Agents on Real-World Hardware Bug Repair Tasks

HWE-Bench:在真实世界硬件Bug修复任务上评估LLM代理的基准测试

Fan Cui, Hongyuan Hou, Zizhang Luo, Chenyun Yin, Yun Liang

机构 * Peking University(北京大学)

AI总结 HWE-Bench是首个大规模仓库级基准,用于评估LLM代理在真实世界硬件Bug修复任务中的表现,通过417个任务实例验证代理在不同项目中的性能差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14632 2026-04-17 cs.CV

High-Speed Full-Color HDR Imaging via Unwrapping Modulo-Encoded Spike Streams

通过解调编码脉冲流实现高速全彩HDR成像

Chu Zhou, Siqi Yang, Kailong Zhang, Heng Guo, Zhaofei Yu, Boxin Shi, Imari Sato

机构 * Digital Content and Media Sciences Research Division, National Institute of Informatics(国家信息研究所数字内容与媒体科学研究中心) Pattern Recognition and Intelligent System Laboratory, School of Artificial Intelligence, Beijing University of Posts and Telecommunications(人工智能学院,北京邮电大学) State Key Laboratory of Multimedia Information Processing, School of Computer Science, the National Engineering Research Center of Visual Technology, School of Computer Science, and the PKU-AI 2 Robotics Joint Lab of Embodied AI, Peking University(多媒体信息处理国家重点实验室,计算机学院,视觉技术国家工程研究中心,计算机学院,北京大学PKU-AI 2机器人联合实验室) Institute for Artificial Intelligence, the State Key Laboratory of Multimedia Information Processing, School of Computer Science, and the National Engineering Research Center of Visual Technology, School of Computer Science, Peking University(人工智能研究院,多媒体信息处理国家重点实验室,计算机学院,视觉技术国家工程研究中心,计算机学院,北京大学) Institute for Artificial Intelligence, and the National Engineering Research Center of Visual Technology, School of Computer Science, Peking University(人工智能研究院,视觉技术国家工程研究中心,计算机学院,北京大学)

AI总结 本文提出一种基于模运算的HDR成像系统,通过改进传感模型和解调算法实现高速全彩HDR成像,有效克服了传统方法在运动伪影与信息损失之间的权衡问题。

Comments TPAMI under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14200 2026-04-17 q-bio.NC cs.AI

Retina gap junctions support the robust perception by warping neural representational geometries along the visual hierarchy

视网膜间隙连接支持通过视觉层级中神经表征几何的变形实现的鲁棒感知

Yang Yue, Shenjian Zhang, Yonghong Tian, Kai Du, Tiejun Huang

机构 * School of Computer Science, Peking University(北京大学计算机科学学院)

AI总结 本文通过结合视网膜间隙连接过滤器与DNN,构建生物混合模型,研究视网膜间隙连接的去噪功能及其对脑流形的影响,发现其具有更高的鲁棒性和非线性决策边界。

Comments 32 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12407 2026-04-17 cs.CR cs.CL cs.LG

De-Anonymization at Scale via Tournament-Style Attribution

通过竞赛式归因实现大规模去匿名化

Lirui Zhang, Huishuai Zhang

机构 * Beihang University(北京航空航天大学) Peking University(北京大学)

AI总结 研究利用LLM链接匿名文档与其作者,提出大规模去匿名化方法DAS,通过分组筛选和多数投票提升鲁棒性和精度,实验显示在匿名平台存在现实隐私风险。

Comments 14 pages, ACL 2026 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏