arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The Hong Kong University of Science and Technology(香港科技大学)

共收录 2796
2505.20214 2026-04-17 cs.AI

When Slower Isn't Truer: Inverse Scaling Law of Truthfulness in Multimodal Reasoning

当慢并非真:多模态推理中真理性的反比例定律

Sitong Fang, Wenjing Cao, Jiahao Li, Xuyao Wang, Juntao Dai, Chi-Min Chan, Sirui Han, Yike Guo, Yaodong Yang, Jiaming Ji

机构 * Institute for AI(人工智能研究院) Peking University(北京大学) Hong Kong University of Science and Technology(香港科技大学)

AI总结 研究探讨了多模态推理中慢思考模式的反比例定律,发现慢思考模型在面对不完整或误导性视觉输入时更易生成虚假细节,揭示了推理模型在处理模糊输入时的脆弱性。

Comments Accepted at ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14834 2026-04-17 cs.RO

Switch: Learning Agile Skills Switching for Humanoid Robots

Switch:为人类机器人学习敏捷技能切换

Yuen-Fui Lau, Qihan Zhao, Yinhuai Wang, Runyi Yu, Hok Wai Tsui, Qifeng Chen, Ping Tan

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学)

AI总结 本文提出Switch系统,通过技能图和强化学习实现人形机器人灵活的技能切换,提高运动模仿性能和任务完成效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14805 2026-04-17 cs.CV

From Boundaries to Semantics: Prompt-Guided Multi-Task Learning for Petrographic Thin-section Segmentation

从边界到语义:基于提示的多任务学习用于岩片分割

Yili Ren, Shiqi Wen, Li Hou, Dingwen Xiao, Weiming Zhang, Caleb Chen Cao, Lin Wang, Zilu Zheng, Qianxiao Su, Mingjun Zhao, Lei Chen

机构 * Research Institute of Petroleum Exploration and Development(石油勘探开发研究院) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Nanyang Technological University(南洋理工大学)

AI总结 本文提出Petro-SAM框架,通过整合多角度偏振视图和颜色熵先验,解决岩片分割中的领域差距和细粒边界问题,实现高精度的粒边分割和岩性语义分割。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14707 2026-04-17 cs.MM cs.SD

Geo2Sound: A Scalable Geo-Aligned Framework for Soundscape Generation from Satellite Imagery

Geo2Sound: 一种可扩展的地理对齐框架,用于从卫星图像生成声音景观

Kunlin Wu, Yanning Wang, Haofeng Tan, Boyi Chen, Teng Fei, Xianping Ma, Yang Yue, Zan Zhou, Xiaofeng Liu

机构 * The Hong Kong University of Science and Technology (Guangzhou), China(香港理工大学(广州)) University of South Carolina(南卡罗来纳大学) University of Canterbury(坎特伯雷大学) Southwest Jiaotong University(西南交通大学) Beijing University of Posts(北京邮电大学)

AI总结 本文提出Geo2Sound框架,通过结合地理空间属性建模、语义假设扩展和地理声学对齐,实现从卫星图像生成真实感声音景观,并建立首个包含20000+高质量配对数据的SatSound-Bench基准。

Comments 15 pages, 4 figures, 4 tables. Includes supplementary material and SatSound-Bench dataset details

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14622 2026-04-17 cs.CV

Multigrain-aware Semantic Prototype Scanning and Tri-Token Prompt Learning Embraced High-Order RWKV for Pan-Sharpening

多粒度感知语义原型扫描与三token提示学习融合高阶RWKV用于全分辨率融合

Junfeng Li, Wenyang Zhou, Xueheng Li, Xuanhua He, Jianhou Gan, Wenqi Ren

机构 * Shenzhen Campus of Sun Yat-sen University(中山大学深圳校区) Yunnan Normal University, Ministry of Education(云南师范大学教育部) Xidian University(西安电子科技大学) University of Science and Technology of China(中国科学技术大学) The Hong Kong University of Science and Technology(香港理工大学) MoE Key Laboratory of Information Technology(教育部信息科学技术重点实验室)

AI总结 本文提出基于高阶RWKV架构和三token提示机制的多粒度感知语义原型扫描方法,通过语义驱动扫描策略、三token提示学习和可逆Q-Shift操作提升全分辨率融合性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03307 2026-04-17 cs.CV cs.AI

V-Reflection: Transforming MLLMs from Passive Observers to Active Interrogators

V-Reflection:将多模态大语言模型从被动观察者转变为主动提问者

Jiazhou Zhou, Yucheng Chen, Hongyang Li, Qing Jiang, Hu Zhou, Ying-Cong Chen, Lei Zhang

机构 * AI Thrust, The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)人工智能方向) International Digital Economy Academy(国际数字经济学院) MedVisAI Lab, Lee Kong Chian School of Medicine, Nanyang Technological University, and Centre of AI in Medicine(医学视觉人工智能实验室,南洋理工大学Lee Kong Chian医学院,以及人工智能在医学中的中心) South China University of Technology(华南理工大学) Department of Electrical and Electronic Engineering, The Hong Kong Polytechnic University(香港理工大学电子与电气工程系)

AI总结 本文提出V-Reflection框架,通过'思考后再观察'的视觉反思机制,使多模态大语言模型能主动提问视觉特征空间,提升细粒度任务的感知能力。

Comments Main paper 14 pages with supplementary 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13933 2026-04-17 cs.CL

OmniCompliance-100K: A Multi-Domain, Rule-Grounded, Real-World Safety Compliance Dataset

OmniCompliance-100K:一个多领域、基于规则、现实世界安全合规数据集

Wenbin Hu, Huihao Jing, Haochen Shi, Changxuan Fan, Haoran Li, Yangqiu Song

机构 * Hong Kong University of Science and Technology(香港科技大学)

AI总结 本文构建了一个涵盖74项法规的多领域安全合规数据集,包含12,985条规则和106,009个现实案例,通过基准测试评估了不同规模LLM的安全合规能力。

Comments Accepted to ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21262 2026-04-17 cs.CL

CausalEmbed: Auto-Regressive Multi-Vector Generation in Latent Space for Visual Document Embedding

CausalEmbed: 在潜在空间中实现自动回归多向量生成用于视觉文档嵌入

Jiahao Huo, Yu Huang, Yibo Yan, Ye Pan, Kening Zheng, Wei-Chieh Huang, Yi Cao, Mingdong Ou, Philip S. Yu, Xuming Hu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Alibaba Cloud Computing(阿里云计算) University of Illinois Chicago(伊利诺伊大学芝加哥分校)

AI总结 本文提出CausalEmbed方法,通过对比训练中的迭代边际损失生成紧凑且结构良好的多向量嵌入,实现高效的视觉文档检索,减少30-155倍的token数量同时保持高性能。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01016 2026-04-17 cs.CL

Prompt-R1: Collaborative Automatic Prompting Framework via End-to-end Reinforcement Learning

Prompt-R1: 通过端到端强化学习实现的协作自动提示框架

Wenjin Liu, Haoran Luo, Xueyuan Lin, Haoming Liu, Tiesunlong Shen, Jiapu Wang, Rui Mao, Erik Cambria

机构 * Hainan University(海南大学) Nanyang Technological University(南洋理工大学) Hithink Research(慧思研究) HKUST (Guangzhou)(香港科技大学(广州)) IDEA Research(IDEA研究院) Tsinghua University(清华大学) National University of Singapore(新加坡国立大学) Nanjing University of Science and Technology(南京理工大学)

AI总结 本文提出Prompt-R1框架,通过小规模LLM与大规模LLM协作,利用强化学习提升复杂问题解决能力,实验表明其在多个数据集上表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15351 2026-04-17 cs.AI cs.ET cs.MA

One Step is Enough: Multi-Agent Reinforcement Learning based on One-Step Policy Optimization for Order Dispatch on Ride-Sharing Platforms

一步即可:基于一步策略优化的多智能体强化学习用于网约车平台订单调度

Zijian Zhao, Sen Li

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))

AI总结 本文提出基于一步策略优化的多智能体强化学习方法,通过消除价值函数估计误差,提升网约车平台订单调度效率,实验表明其在简化网络结构下表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14121 2026-04-16 cs.CL

Correct Prediction, Wrong Steps? Consensus Reasoning Knowledge Graph for Robust Chain-of-Thought Synthesis

正确预测,错误步骤?基于共识推理的知识图谱用于鲁棒的推理链合成

Zipeng Ling, Shuliang Liu, Shenghong Fu, Yuehao Tang, Seonil Son, Yao Wan, Xuming Hu

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) University of Pennsylvania(宾夕法尼亚大学) Huazhong University of Science and Technology(华中科技大学) Hong Kong Polytechnic University(香港理工大学) RLWRLD

AI总结 本文提出CRAFT框架,通过构建共识推理知识图谱缓解LLM推理中的内部和步骤性错误,提升推理链质量,实验显示其在逻辑和数学推理基准上表现优越。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20352 2026-04-16 cs.AI

AMA: Adaptive Memory via Multi-Agent Collaboration

AMA:通过多智能体协作实现自适应记忆

Weiquan Huang, Zixuan Wang, Hehai Lin, Sudong Wang, Bo Xu, Qian Li, Beier Zhu, Linyi Yang, Chengwei Qin

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Shandong University(山东大学) Nanyang Technological University(南洋理工大学) Southern University of Science and Technology(南方科技大学)

AI总结 本文提出AMA框架,通过多智能体协作实现自适应记忆管理,解决传统方法在记忆粒度和一致性维护上的不足,实验表明其在长上下文任务中表现优异,减少约80%的token消耗。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07019 2026-04-16 cs.CL cs.AI cs.LG

Native Hybrid Attention for Efficient Sequence Modeling

原生混合注意力机制用于高效序列建模

Jusen Du, Jiaxi Hu, Tao Zhang, Weigao Sun, Yu Cheng

机构 * Tsinghua University(清华大学) Shanghai AI Laboratory(上海人工智能实验室) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) The Chinese University of Hong Kong(香港中文大学)

AI总结 本文提出原生混合注意力机制,结合线性与全注意力,通过滑动窗口和线性RNN实现长上下文保留与短上下文增强,提升效率与召回率。

Comments Accepted by ACL 2026, 17 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10522 2026-04-16 cs.MM cs.CV cs.LG cs.SD eess.AS

AudioX: A Unified Framework for Anything-to-Audio Generation

AudioX:一种用于任意到音频生成的统一框架

Zeyue Tian, Zhaoyang Liu, Yizhu Jin, Ruibin Yuan, Liumeng Xue, Xu Tan, Qifeng Chen, Wei Xue, Yike Guo

机构 * Hong Kong University of Science and Technology(香港科技大学) Independent Researcher(独立研究者)

AI总结 本文提出AudioX框架,整合多种模态条件,通过多模态自适应融合模块提升生成质量,并构建大规模高质量数据集IF-caps,验证了其在文本到音频和文本到音乐生成中的优越性能。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13688 2026-04-16 cs.CV cs.AI

Beyond Voxel 3D Editing: Learning from 3D Masks and Self-Constructed Data

超越体素3D编辑:从3D掩码和自构造数据中学习

Yizhao Xu, Hongyuan Zhu, Caiyun Liu, Tianfu Wang, Keyu Chen, Sicheng Xu, Jiaolong Yang, Nicholas Jing Yuan, Qi Zhang

机构 * The Peking University(北京大学) HKUST(GZ)(香港科技大学(广州)) Microsoft AI(微软人工智能) Microsoft Research(微软研究院)

AI总结 本文提出BVE框架,通过自构造的大规模3D编辑数据集,结合轻量可训练模块,实现高效的文本语义注入,保留局部不变性,生成高质量的文本对齐3D资产。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13509 2026-04-16 cs.CV

DiT as Real-Time Rerenderer: Streaming Video Stylization with Autoregressive Diffusion Transformer

DiT作为实时重绘器:基于自回归扩散变换器的流式视频风格化

Hengye Lyu, Zisu Li, Yue Hong, Yueting Weng, Jiaxin Shi, Hanwang Zhang, Chen Liang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) The Hong Kong University of Science and Technology(香港科技大学) XMax.AI Ltd.(XMax人工智能有限公司) Nanyang Technological University(南洋理工大学)

AI总结 本文提出RTR-DiT框架,通过微调双向教师模型和知识蒸馏实现高效视频风格化,支持文本和参考图像引导,实现实时稳定处理长视频和风格切换。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13441 2026-04-16 cs.RO

Robust Energy-Aware Routing for Air-Ground Cooperative Multi-UAV Delivery in Wind-Uncertain Environments

鲁棒能耗感知路由:风不确定环境中的空地协同多无人机配送

Tianshun Li, Hongliang Lu, Yanggang Sheng, Zhongzhen Wang, Haoang Li, Xinhu Zheng

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) The Hong Kong University of Science and Technology(香港科技大学)

AI总结 本文提出BER框架,通过动态能耗图和风险感知路由提升无人机在风扰环境中的配送可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13060 2026-04-16 cs.CL cs.LG cs.MM

Dental-TriageBench: Benchmarking Multimodal Reasoning for Hierarchical Dental Triage

牙科分诊基准:用于分层牙科分诊的多模态推理基准

Ziyi He, Yushi Feng, Shuangyu Yang, Yinghao Zhu, Xichen Zhang, Pak Chuen Patrick Tai, Hei Yuet Lo, Songying Wu, Weifa Yang, Lequan Yu

机构 * School of Computing and Data Science, The University of Hong Kong(香港大学计算与数据科学学院) Faculty of Dentistry, The University of Hong Kong(香港大学牙科学院) The Prince Philip Dental Hospital(菲利普王子牙科医院) Li Ka Shing Faculty of Medicine, The University of Hong Kong(香港大学利滋医学学院) The Hong Kong University of Science and Technology(香港科学与技术大学)

AI总结 本文提出Dental-TriageBench,首个专家标注的多模态牙科分诊基准,通过246个脱敏案例评估19种模型在细粒度治疗层面分诊中的表现,揭示了人类与模型间的显著差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21823 2026-04-16 cs.AI

ProRe: A Proactive Reward System for GUI Agents via Reasoner-Actor Collaboration

ProRe:通过推理器-执行器协作的GUI代理前瞻性奖励系统

Gaole Dai, Shiqi Jiang, Ting Cao, Yuqing Yang, Yuanchun Li, Rui Tan, Mo Li, Lili Qiu

机构 * NTU(国立新加坡大学) Microsoft Research(微软研究院) Tsinghua University(清华大学) HKUST(香港理工大学)

AI总结 ProRe通过推理器与领域特定评估器协作,提升GUI代理奖励准确性与F1分数,实验显示奖励准确性和F1分数提升达5.3%和19.4%。

Comments 23 pages, 12 figures, ICLR'2026

Journal ref The Fourteenth International Conference on Learning Representations, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07464 2026-04-16 cs.RO cs.SY eess.SY

Safe and Nonconservative Contingency Planning for Autonomous Vehicles via Online Learning-Based Reachable Set Barriers

通过基于在线学习的可达集屏障实现自主车辆的安全非保守应急规划

Rui Yang, Lei Zheng, Shuzhi Sam Ge, Jun Ma

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) National University of Singapore(新加坡国立大学) Department of Electrical and Computer Engineering(电气与计算机工程系)

AI总结 本文提出基于在线学习的实时应急轨迹优化框架,通过动态量化多模态HV不确定性并逐步细化其可达集,确保安全性和效率,在不确定环境下提升驾驶效率和乘客舒适度。

Comments 16 pages, 13 figures

Journal ref IEEE Trans. Control Syst. Technol., 2026, pp.1-16

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00555 2026-04-16 cs.CR cs.AI cs.CL

Activation-Guided Local Editing for Jailbreaking Attacks

基于激活的局部编辑对抗攻击

Jiecong Wang, Haoran Li, Hao Peng, Ziqian Zeng, Zihao Wang, Haohua Du, Zhengtao Yu

机构 * Beihang University(北航) Hangzhou Innovation Institute(杭州创新研究院) HKUST(香港科技大学) South China University of Technology(华南理工大学) Nanyang Technological University(南洋理工大学) Kunming University of Science and Technology(昆明理工大学)

AI总结 本文提出一种两阶段框架,结合上下文生成与隐藏状态信息,有效提升对抗攻击的成功率和可迁移性,对抗当前防御机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12988 2026-04-15 cs.DB cs.AI

ROSE: An Intent-Centered Evaluation Metric for NL2SQL

ROSE: 一种以意图为中心的NL2SQL评估度量标准

Wenqi Pei, Shizheng Hou, Boyan Li, Han Chen, Zhichao Shi, Yuyu Luo

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) National University of Singapore(新加坡国立大学)

AI总结 ROSE通过对抗性Prover-Refuter流程评估NL2SQL解决方案的意图匹配度,优于现有指标24%,揭示了四个重要洞察,促进更可靠的NL2SQL研究。

Comments ACL 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12837 2026-04-15 cs.RO

GGD-SLAM: Monocular 3DGS SLAM Powered by Generalizable Motion Model for Dynamic Environments

GGD-SLAM:基于通用运动模型的单目3DGS SLAM用于动态环境

Yi Liu, Haoxuan Xu, Hongbo Duan, Keyu Fan, Zhengyang Zhang, Peiyu Zhuang, Pengting Luo, Houde Liu

机构 * Shenzhen International Graduate School, Tsinghua University(深圳国际研究生院,清华大学) Thrust of Robotics and Autonomous Systems, The Hong Kong University of Science and Technology (Guangzhou)(机器人与自主系统研究所,香港科技大学(广州)) School of Cyber Science and Technology, Sun Yat-sen University(网络安全科学与技术学院,中山大学) Central Media Technology Institute, Huawei Incorporated Company(中央媒体技术研究院,华为有限公司)

AI总结 GGD-SLAM通过通用运动模型解决动态环境下定位和密集建图问题,无需预定义语义标注或深度输入,采用FIFO队列和动态特征增强器提升鲁棒性。

Comments 8 pages, Accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12573 2026-04-15 cs.AI

IDEA: An Interpretable and Editable Decision-Making Framework for LLMs via Verbal-to-Numeric Calibration

IDEA: 一种通过语音到数值校准实现LLM可解释和可编辑决策框架

Yanji He, Yuxin Jiang, Yiwen Wu, Bo Huang, Jiaheng Wei, Wei Wang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Huawei Technologies Co.,Ltd(华为技术有限公司)

AI总结 IDEA通过EM联合学习、相关采样和数学保证的参数编辑,实现LLM决策的校准概率与量化人机协作,实验显示其在五个数据集上优于其他模型。

Comments Accepted to ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06794 2026-04-15 cs.AI

No More Stale Feedback: Co-Evolving Critics for Open-World Agent Learning

不再有陈旧的反馈:为开放世界智能体学习的共进化批评者

Zhicong Li, Lingjie Jiang, Yulan Hu, Xingchen Zeng, Yixia Li, Xiangwen Zhang, Guanhua Chen, Zheng Pan, Xin Li, Yong Liu

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学 赛洛岭人工智能学院) Amap, Alibaba Group(阿里巴巴集团 阿里地图) Peking University(北京大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Southern University of Science and Technology(南方科技大学)

AI总结 本文提出ECHO框架,通过同步共进化循环联合优化策略和批评者,解决开放世界环境中策略演变导致的反馈过时问题,提升长周期任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05206 2026-04-15 cs.CR cs.AI cs.CL cs.CV

Safety at Scale: A Comprehensive Survey of Large Model and Agent Safety

大规模安全:大型模型和智能体安全的全面综述

Xingjun Ma, Yifeng Gao, Yixu Wang, Ruofan Wang, Xin Wang, Ye Sun, Yifan Ding, Hengyuan Xu, Yunhao Chen, Yunhan Zhao, Hanxun Huang, Yige Li, Yutao Wu, Jiaming Zhang, Xiang Zheng, Yang Bai, Zuxuan Wu, Xipeng Qiu, Jingfeng Zhang, Yiming Li, Xudong Han, Haonan Li, Jun Sun, Cong Wang, Jindong Gu, Baoyuan Wu, Siheng Chen, Tianwei Zhang, Yang Liu, Mingming Gong, Tongliang Liu, Shirui Pan, Cihang Xie, Tianyu Pang, Yinpeng Dong, Ruoxi Jia, Yang Zhang, Shiqing Ma, Xiangyu Zhang, Neil Gong, Chaowei Xiao, Sarah Erfani, Tim Baldwin, Bo Li, Masashi Sugiyama, Dacheng Tao, James Bailey, Yu-Gang Jiang

机构 * Fudan University(复旦大学) The University of Melbourne(墨尔本大学) Singapore Management University(新加坡国立大学) Deakin University(德肯大学) Hong Kong University of Science and Technology(香港科学与技术大学) City University of Hong Kong(香港城市大学) University of Oxford(牛津大学) Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Shanghai Jiao Tong University(上海交通大学) Nanyang Technological University(南洋理工大学) The University of Sydney(悉尼大学) Griffith University(格里菲斯大学) University of California, Santa Cruz(加州大学圣克鲁兹分校) Sea AI Lab(Sea AI实验室) Tsinghua University(清华大学) Virginia Tech(弗吉尼亚理工大学) CISPA Helmholtz Center for Information Security(CISPA海德堡信息安全部) University of Massachusetts Amherst(马萨诸塞大学阿姆赫斯特分校) Purdue University(普渡大学) Duke University(杜克大学) University of Wisconsin - Madison(威斯康星大学麦迪逊分校) RIKEN(理化学研究所) The University of Tokyo(东京大学)

AI总结 本文综述了大型模型和智能体的安全性,分析了各类攻击威胁及防御策略,指出安全评估、防御机制和数据实践的重要性,强调研究社区和国际合作的必要性。

Comments 706 papers, 60 pages, 3 figures, 14 tables; GitHub: https://github.com/xingjunm/Awesome-Large-Model-Safety

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12424 2026-04-15 cs.CL cs.AI cs.CV

Decoding by Perturbation: Mitigating MLLM Hallucinations via Dynamic Textual Perturbation

解码中的扰动:通过动态文本扰动缓解多模态大语言模型的幻觉

Sihang Jia, Shuliang Liu, Songbo Yang, Yibo Yan, Xin Zou, Xuming Hu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港理工大学(广州))

AI总结 本文提出Decoding by Perturbation方法,通过动态文本扰动缓解多模态大语言模型的幻觉问题,通过控制文本干预减少语言先验的影响,提升解码稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12308 2026-04-15 cs.CL

ContextLens: Modeling Imperfect Privacy and Safety Context for Legal Compliance

ContextLens:建模不完美隐私和安全上下文以满足法律合规

Haoran Li, Yulin Chen, Huihao Jing, Wenbin Hu, Tsz Ho Li, Chanhou Lou, Hong Ting Tsang, Sirui Han, Yangqiu Song

机构 * Beihang University(北京航空航天大学) HKUST(香港科技大学) National University of Singapore(新加坡国立大学) Faculty of Law, University of Macau(澳门大学法学院)

AI总结 本文提出ContextLens框架,利用LLM建模法律领域上下文,识别已知和未知因素以提升合规评估,实验表明其能有效提升LLM合规性评估性能。

Comments Accepted by ACL 26

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12268 2026-04-15 cs.SE cs.CL

CodeSpecBench: Benchmarking LLMs for Executable Behavioral Specification Generation

CodeSpecBench: 用于可执行行为规范生成的LLM基准测试

Zaoyu Chen, Jianbo Dai, Boyu Zhu, Jingdong Wang, Huiming Wang, Xin Xu, Haoyang Yuan, Zhijiang Guo, Xiao-Ming Wu

机构 * The Hong Kong Polytechnic University(香港理工大学) University of Edinburgh(爱丁堡大学) UCL(伦敦大学学院) CUHK (SZ)(香港中文大学(深圳)) SUTD(新加坡科技设计大学) HKUST(香港科技大学) CUHK(香港中文大学) HKUST (GZ)(香港科技大学(广州))

AI总结 本文提出CodeSpecBench,一个基于执行评估协议的LLM可执行行为规范生成基准,评估了15种最新LLM在函数和仓库级任务中的表现,发现仓库级任务性能显著下降,且规范生成比代码生成更具挑战性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11810 2026-04-15 cs.DB cs.AI

GRACE: A Dynamic Coreset Selection Framework for Large Language Model Optimization

GRACE:一种用于大语言模型优化的动态聚类选择框架

Tianhao Tang, Haoyang Li, Lei Chen

机构 * CSE, HKUST(香港科技大学计算机科学与工程系) Computing, PolyU(PolyU计算机系) DSA, HKUST (GZ)&HKUST Guangzhou, China(香港科技大学(广州)数据科学与应用系)

AI总结 GRACE通过结合表示多样性与梯度重要性度量,动态构建和更新聚类,提升大语言模型训练效率和下游性能。

详情

展开后加载摘要…

URL PDF HTML 收藏