arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

University of Science and Technology of China(中国科学技术大学)

2026-03-26 至 2026-03-26 共收录 9
2603.22094 2026-03-26 cs.CV

Principled Steering via Null-space Projection for Jailbreak Defense in Vision-Language Models

通过空域投影实现原理化引导用于视觉-语言模型中的对抗防御

Xingyu Zhu, Beier Zhu, Shuo Wang, Junfeng Fang, Kesen Zhao, Hanwang Zhang, Xiangnan He

机构 * MoE Key Lab of BIPC, University of Science and Technology of China(北京信息科技大学MoE关键实验室,中国科学技术大学) National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学)

AI总结 本文提出NullSteer框架,通过线性变换在模型激活中构建拒绝方向,在良性子空间保持零扰动,动态诱导拒绝有害方向,提升安全性而不损害模型能力。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22070 2026-03-26 cs.CV

Adapting Point Cloud Analysis via Multimodal Bayesian Distribution Learning

通过多模态贝叶斯分布学习适应点云分析

Xingyu Zhu, Liang Yi, Shuo Wang, Wenbo Zhu, Yonglinag Wu, Beier Zhu, Hanwang Zhang

机构 * MoE Key Lab of BIPC, University of Science and Technology of China(脑信息处理实验室,中国科学技术大学) Opus AI Research(Opus AI研究院) Southeast University(东南大学) Nanyang Technological University(南洋理工大学)

AI总结 本文提出BayesMM框架,通过多模态贝叶斯分布学习实现测试时点云分析的持续适应,利用文本先验和流式视觉特征的高斯分布融合,提升在分布偏移下的鲁棒性。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21591 2026-03-26 cs.CV

CADC: Content Adaptive Diffusion-Based Generative Image Compression

CADC: 基于内容自适应的扩散生成图像压缩

Xihua Sheng, Lingyu Zhu, Tianyu Zhang, Dong Liu, Shiqi Wang, Jing Wang

机构 * City University of Hong Kong(香港城市大学) University of Science and Technology of China(中国科学技术大学) Central Media Technology Institute, Huawei(华为中央媒体技术研究院)

AI总结 本文提出CADC,通过三种创新方法解决现有图像压缩在内容自适应中的不足,实现动态对齐图像语义与结构特征。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05629 2026-03-26 cs.SE cs.CV

ROMAN: Reward-Orchestrated Multi-Head Attention Network for Autonomous Driving System Testing

ROMAN:基于奖励协调的多头注意力网络用于自动驾驶系统测试

Jianlei Chi, Yuzhen Wu, Jiaxuan Hou, Xiaodong Zhang, Ming Fan, Suhui Sun, Weijun Dai, Bo Li, Jianguo Sun, Jun Sun

机构 * IEEE Publication Technology Group(IEEE出版技术组) Hangzhou Institute of Technology, Xidian University(杭州科技学院,西安电子科技大学) Qingdao Port International Co., Ltd.(青岛港口国际有限公司) Shandong Port Qingdao Port Group Co., Ltd.(山东港口青岛港集团有限公司) University of Science and Technology of China(中国科学技术大学) Xi’an Jiaotong University(西安交通大学) Singapore Management University(新加坡管理大学)

AI总结 ROMAN通过结合多头注意力网络与交通法规加权机制,生成高风险违规场景,提升自动驾驶系统测试的全面性与针对性。

Comments The manuscript includes 13 pages, 8 tables, and 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24047 2026-03-26 cs.RO

PCHC: Enabling Preference Conditioned Humanoid Control via Multi-Objective Reinforcement Learning

PCHC:通过多目标强化学习实现基于偏好的人形机器人控制

Huanyu Li, Dewei Wang, Xinmiao Wang, Xinzhe Liu, Peng Liu, Chenjia Bai, Xuelong Li

机构 * Harbin Institute of Technology(哈尔滨工业大学) University of Science and Technology of China(中国科学技术大学) Harbin Engineering University(哈尔滨工程大学) ShanghaiTech University(上海科技大学) Institute of Artificial Intelligence (TeleAI), China Telecom(中国电信人工智能研究院(TeleAI))

AI总结 本文提出PCHC框架,利用多目标强化学习实现人形机器人基于偏好的控制,通过偏好向量调节专家混合模块,使单一策略能展现多样行为,实验证明机器人可实时调整优先级。

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23840 2026-03-26 cs.AI cs.CL

VehicleMemBench: An Executable Benchmark for Multi-User Long-Term Memory in In-Vehicle Agents

VehicleMemBench:多用户长期记忆的可执行基准

Yuhao Chen, Yi Xu, Xinyun Ding, Xiang Fang, Shuochen Liu, Luxi Lin, Qingyu Zhang, Ya Li, Quan Liu, Tong Xu

机构 * University of Science and Technology of China(中国科学技术大学) iFLYTEK Research(iFLYTEK研究院) Xiamen University(厦门大学) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 本文提出VehicleMemBench,用于评估车载代理的多用户长期记忆能力,通过可执行仿真环境比较行动后环境状态与目标状态,揭示强大模型在动态偏好变化场景中的不足,强调需更 robust 的记忆管理机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19900 2026-03-26 cs.CV cs.GR

ExpPortrait: Expressive Portrait Generation via Personalized Representation

ExpPortrait:通过个性化表示生成表现力强的肖像

Junyi Wang, Yudong Guo, Boyang Guo, Shengming Yang, Juyong Zhang

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 本文提出一种高保真个性化头部表示,用于生成具有高表现力的肖像视频,通过引入表达转移模块实现不同身份间的头部姿态和表情细节转移,实验表明在身份保持、表情准确性和时间稳定性方面优于现有方法。

Comments CVPR 2026, Project Page: https://ustc3dv.github.io/ExpPortrait/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18996 2026-03-26 cs.CV

Learning Cross-View Object Correspondence via Cycle-Consistent Mask Prediction

通过循环一致性掩码预测学习跨视角物体对应关系

Shannan Yan, Leqi Zheng, Keyu Lv, Jingchen Ni, Hongyang Wei, Jiajun Zhang, Guangting Wang, Jing Lyu, Chun Yuan, Fengyun Rao

机构 * Tsinghua University(清华大学) WeChat Vision, Tencent Inc.(腾讯微信视觉实验室) USTC(中国科学技术大学)

AI总结 本文提出基于条件二值分割的框架,通过循环一致性训练目标视角预测掩码并重建源视角掩码,实现无标注的自监督学习,提升跨视角物体对应性能。

Comments The paper has been accepted to CVPR 2026 main track

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12410 2026-03-26 cs.AI

Are LLMs Smarter Than Chimpanzees? An Evaluation on Perspective Taking and Knowledge State Estimation

LLMs比黑猩猩更聪明吗?对视角取和知识状态估计的评估

Dingyi Yang, Junqi Zhao, Xue Li, Ce Li, Boyang Li

机构 * College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院) University of Science and Technology of China(中国科学技术大学) China University of Mining and Technology(中国矿业大学)

AI总结 本文评估LLM在预测角色下一步行动及检测角色不应具备的知识能力,发现当前最先进的LLM在两项任务上表现接近随机,远低于人类。

Comments 23 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏