arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The Chinese University of Hong Kong(香港中文大学)

2026-05-13 至 2026-05-13 共收录 16
2605.12492 2026-05-13 cs.LG stat.ML

Pion: A Spectrum-Preserving Optimizer via Orthogonal Equivalence Transformation

Pion:通过正交等价变换实现的谱保持优化器

Kexuan Shi, Hanxuan Li, Zeju Qiu, Yandong Wen, Simon Buchholz, Weiyang Liu

机构 * The Chinese University of Hong Kong(香港中文大学) Max Planck Institute for Intelligent Systems(智能系统马克斯·普朗克研究所) Westlake University(西交利物浦大学)

AI总结 Pion通过正交等价变换实现谱保持优化,不同于Adam等加法优化器,其通过左右正交变换更新权重矩阵,保持奇异值不变,从而在保持谱范数的同时调节权重矩阵几何结构,实验表明其在LLM预训练和微调中具有稳定且竞争力的性能。

Comments Technical report v1 (30 pages, 19 figures, project page: https://spherelab.ai/pion/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12357 2026-05-13 cs.AI

$δ$-mem: Efficient Online Memory for Large Language Models

$δ$-mem: 高效的大型语言模型在线内存

Jingdi Lei, Di Zhang, Junxian Li, Weida Wang, Kaixuan Fan, Xiang Liu, Qihan Liu, Xiaoteng Ma, Baian Chen, Soujanya Poria

机构 * Nanyang Technological University(南洋理工大学) Fudan University(复旦大学) Mind Lab Shanghai Jiao Tong University(上海交通大学) The Chinese University of Hong Kong(香港中文大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

AI总结 本文提出$δ$-mem机制,通过紧凑的在线状态与注意力计算直接耦合,提升模型在长文本任务中的表现,无需全微调或替换backbone。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12289 2026-05-13 cs.LG cs.AI

PriorZero: Bridging Language Priors and World Models for Decision Making

PriorZero:连接语言先验与世界模型以实现决策制定

Junyu Xiong, Yuan Pu, Jia Tang, Yazhe Niu

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Nanjing University of Aeronautics and Astronautics(南京航空航天大学) The Chinese University of Hong Kong MMLab(香港中文大学MMLab)

AI总结 PriorZero通过解耦的rollout训练设计,将LLM生成的语义先验整合到基于世界模型的规划中,提升探索效率和长期性能,适用于文本冒险游戏和指令遵循任务。

Comments 30 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12161 2026-05-13 cs.LG cs.CY math.MG

Fused Gromov-Wasserstein Distance with Feature Selection

融合图瓦瑟斯坦距离与特征选择

Harlin Lee, Ying Yu, Mingxin Li, Ranthony Clark

机构 * School of Data Science and Society(数据科学与社会学院) Division of Computational Social Science(计算社会科学系) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Courant Institute(Courant研究所) Department of Mathematics(数学系) New York University(纽约大学) Duke University(杜克大学)

AI总结 本文提出融合图瓦瑟斯坦距离与特征选择方法,通过引入自适应特征抑制权重提升高维数据的可解释性和鲁棒性,采用正则化FGW和简单约束权重两种方法,并分析其理论性质与高效算法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12001 2026-05-13 cs.IT cs.AI math.IT

CR^2: Cost-Aware Risk-Controlled Routing for Wireless Device-Edge LLM Inference

CR²:面向无线设备-边缘LLM推断的成本感知风险控制路由

Nan Xue, Shengkang Chen, Zhiyong Chen, Jiangchao Yao, Yaping Sun, Zixia Hu, Meixia Tao

机构 * Cooperative Medianet Innovation Center, Shanghai Jiao Tong University(合作中位网创新中心,上海交通大学) Department of Broadband Communication, Pengcheng Laboratory(宽带通信部,鹏城实验室) Future Network of Intelligent Institute (FNii), the Chinese University of Hong Kong (Shenzhen)(智能网络研究所(FNii),香港中文大学(深圳)) Meta

AI总结 本文提出CR²框架,通过分离轻量级设备模型与边缘模型的决策机制,优化无线边缘环境下的推断效率与成本,提升部署准确性与能耗平衡。

Comments submitted to IEEE Journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02406 2026-05-13 stat.ML cs.LG

Provably Data-driven Multiple Hyper-parameter Tuning with Structured Loss Function

可证明的数据驱动多超参数调优与结构化损失函数

Tung Quoc Le, Anh Tuan Nguyen, Viet Anh Nguyen

机构 * Université Grenoble Alpes, LJK, CNRS, Grenoble INP(格拉诺布尔大学,LJK,CNRS,格拉诺布尔INP) Carnegie Mellon University, Machine Learning Department(卡内基梅隆大学,机器学习系) Chinese University of Hong Kong, Department of Systems Engineering and Engineering Management(香港中文大学,系统工程与工程管理系)

AI总结 本文提出首个通用框架,为数据驱动环境下多维超参数调优提供泛化保证,结合实代数几何工具,改进了半代数函数类的泛化保证,并扩展至验证损失下的超参数调优,推导出更优的界。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22663 2026-05-13 cs.CV

AIA: Rethinking Architecture Decoupling Strategy In Unified Multimodal Model

AIA: 重新思考统一多模态模型中的架构解耦策略

Dian Zheng, Manyuan Zhang, Hongyu Li, Kai Zou, Hongbo Liu, Ziyu Guo, Kaituo Feng, Yexin Liu, Ying Luo, Hongsheng Li

机构 * MMLab, CUHK(CUHK多媒体实验室) Meituan(美团) USTC(中国科学技术大学) TJU(天津大学)

AI总结 本文提出AIA损失函数,通过学习任务特定的多模态交互模式,缓解任务冲突而不依赖模型解耦,提升生成与理解性能。

Comments Project page: https://zhengdian1.github.io/AIA-project/ Code: https://github.com/zhengdian1/AIA

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.02011 2026-05-13 cs.CV

PointCaM: Cut-and-Mix for Open-Set Point Cloud Learning

PointCaM:用于开放集点云学习的Cut-and-Mix

Jie Hong, Shi Qiu, Weihao Li, Saeed Anwar, Mehrtash Harandi, Nick Barnes, Lars Petersson

机构 * The University of Hong Kong(香港大学) The Chinese University of Hong Kong(香港中文大学) Australian National University(澳大利亚国立大学) The University of Western Australia(西澳大学) Monash University(墨尔本大学)

AI总结 本文提出PointCaM方法,通过Unknown-Point Simulator和Estimator模块解决开放集点云学习问题,利用多级特征上下文提升未知对象识别性能。

Comments Accepted in CVIU

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11625 2026-05-13 cs.AI

Nice Fold or Hero Call: Learning Budget-Efficient Thinking for Adaptive Reasoning

好折叠还是英雄召唤:学习适应性推理的预算高效思考

Zhaomeng Zhou, Lan Zhang, Junyang Wang, Mu Yuan, Junda Lin

机构 * University of Science and Technology of China(中国科学技术大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 本文提出Budget-Efficient Thinking框架,通过结合行为冷启动与GRPO,在投资成本意识奖励下,学习短回答、早放弃和保留计算资源三种行为,提升推理效率与性能。

Comments 24 pages, 6 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11577 2026-05-13 cs.CL

BitLM: Unlocking Multi-Token Language Generation with Bitwise Continuous Diffusion

BitLM:通过位连续扩散解锁多令牌语言生成

Shaobin Zhuang, Yuang Ai, Jiaming Han, Xiaohui Li, Huaibo Huang, Xiangyu Yue, Xuefeng Hu, Kun Xu, Yali Wang, Hao Chen

机构 * Shanghai Jiao Tong University(上海交通大学) MMLab, The Chinese University of Hong Kong(中大香港机器学习实验室) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) SIAT, Chinese Academy of Sciences(中国科学院软件研究所)

AI总结 BitLM通过位连续扩散模型实现多令牌并行生成,结合因果注意力与联合词决策,提升预训练效率和推理速度,证明单令牌生成并非必要。

Comments 12 pages, 4figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11015 2026-05-13 cs.CR cs.AI

DCVD: Dual-Channel Cross-Modal Fusion for Joint Vulnerability Detection and Localization

DCVD:双通道跨模态融合用于联合漏洞检测与定位

Wenxin Tang, Wenbin Li, Junliang Liu, Jingyu Xiao, Xi Xiao, Mingzhe Liu, Jinlong Yang, Xuan Liu, Yuehe Ma, Wang Luo, Qing Li, Lei Wang, Peng Xiangli

机构 * Tsinghua University(清华大学) Hunan University(湖南大学) Dalian Maritime University(大连海事大学) The Chinese University of Hong Kong(香港中文大学) Shenzhen University(深圳大学) Northwestern Polytechnical University(西北工业大学) Shandong University(山东大学) BNU-HKBU United International College(北京师范大学-香港浸会大学联合国际学院) Sun Yat-sen University(中山大学) Peng Cheng Laboratory(鹏城实验室) Guangzhou Intelligence Communications Technology Co., Ltd.(广州智能通信技术有限公司) The Fifth Electronic Research Institute of MIIT(中华人民共和国信息产业部第五电子研究所)

AI总结 本文提出DCVD框架,通过双通道融合实现功能级检测与语句级定位的联合优化,有效解决单一信息源和缺乏显式监督的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11003 2026-05-13 cs.CR cs.AI

The Authorization-Execution Gap Is a Major Safety and Security Problem in Open-World Agents

授权-执行间隙是开放世界智能体中的主要安全和安全问题

Baoyuan Wu, Qingshan Liu, Adel Bibi, Irwin King, Siwei Lyu

机构 * Chinese University of Hong Kong, Shenzhen, China(香港中文大学(深圳)) Nanjing University of Posts and Telecommunications, China(南京邮电大学) University of Oxford, UK(牛津大学) Chinese University of Hong Kong, China(香港中文大学) State University of New York at Buffalo, USA(纽约州立大学布法罗分校)

AI总结 本文指出开放世界智能体中授权-执行间隙(AEG)是安全和安全的关键问题,其源于授权意图与实际执行的差异,需通过源导向的诊断和防御来解决,强调执行中需进行授权完整性检查。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10082 2026-05-13 cs.CL cs.LG

FERA: Uncertainty-Aware Federated Reasoning for Large Language Models

FERA:面向大语言模型的不确定性感知联邦推理

Ruhan Wang, Chengkai Huang, Zhiyong Wang, Junda Wu, Rui Wang, Tong Yu, Julian McAuley, Lina Yao, Dongruo Zhou

机构 * Indiana University(印第安纳大学) The University of New South Wales(新南威尔士大学) The Chinese University of Hong Kong(香港中文大学) University of California San Diego(加州大学圣地亚哥分校) Adobe Research(Adobe研究院)

AI总结 FERA通过迭代服务器-客户端协同细化,解决联邦推理中客户端可靠性依赖查询的问题,提升多步骤推理能力,实验表明其在多个推理基准上优于联邦训练和无训练基线。

Comments 44 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09461 2026-05-13 cs.AI

VulTriage: Triple-Path Context Augmentation for LLM-Based Vulnerability Detection

VulTriage:基于LLM的漏洞检测三路径上下文增强

Wenxin Tang, Xiang Zhang, Junliang Liu, Jingyu Xiao, Xi Xiao, Jinlong Yang, Yuehe Ma, Zhenyu Liu, Zhengheng Li, Zicheng Wang, Wang Luo, Qing Li, Lei Wang, Peng Xiangli

机构 * Tsinghua University(清华大学) Henan University(河南大学) Dalian Maritime University(大连海事大学) The Chinese University of Hong Kong(香港中文大学) Northwestern Polytechnical University(西北工业大学) BNU-HKBU United International College(北京理工大学-香港大学联合国际学院) Southeast University(东南大学) Jilin University(吉林大学) Sun Yat-sen University(中山大学) Peng Cheng Laboratory(鹏城实验室) Guangzhou Intelligence Communications Technology Co., Ltd.(广州智能通信技术有限公司) The Fifth Electronic Research Institute of MIIT(信息产业部第五电子研究所)

AI总结 本文提出VulTriage框架,通过三路径上下文增强提升LLM在漏洞检测中的性能,实验表明其在关键指标上优于现有方法,且在低资源和类别不平衡场景下具有良好的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15103 2026-05-13 cs.MA cs.AI

Vulnerable Agent Identification in Large-Scale Multi-Agent Reinforcement Learning

大规模多智能体强化学习中的脆弱智能体识别

Simin Li, Zihao Mao, Zheng Yuwei, Linhao Wang, Ruixiao Xu, Chengdong Ma, Zhiqian Liu, Xin Yu, Yuqing Ma, Xin Wang, Jie Luo, Bo An, Yaodong Yang, Weifeng Lv, Xianglong Liu

机构 * School of Computer Science and Engineering, Beihang University(北航计算机科学与工程学院) Department of Computer Science and Engineering, The Chinese University of Hong Kong(香港中文大学计算机科学与工程系) School of Artificial Intelligence, Beihang University(北航人工智能学院) Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院) Institute of Automation, Chinese Academy of Science(中国科学院自动化研究所) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院)

AI总结 本文研究大规模多智能体强化学习中的脆弱智能体识别问题,提出通过分层对抗性去中心化均值场控制框架,结合Fenchel-Rockafellar变换和强化学习算法,有效识别脆弱智能体并降低计算复杂度。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21159 2026-05-13 cs.AI cs.LG cs.MA

MAC: Masked Agent Collaboration Boosts Large Language Model Medical Decision-Making

MAC:掩码代理协作提升大语言模型医疗决策能力

Zhihao Peng, Liuxin Bao, Yixuan Yuan

机构 * School of Automation, Hangzhou Dianzi University(杭州电子大学自动化学院) Department of Electronic Engineering, Chinese University of Hong Kong(香港中文大学电子工程系)

AI总结 本文提出MAC框架,通过帕累托最优代理构建和交叉一致性最大化机制,提升医疗决策能力。

详情

展开后加载摘要…

URL PDF HTML 收藏