arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The University of Hong Kong(香港大学)

2026-04-21 至 2026-04-21 共收录 15
2604.18418 2026-04-21 cs.CV

MedProbeBench: Systematic Benchmarking at Deep Evidence Integration for Expert-level Medical Guideline

MedProbeBench: 在深度证据整合中的系统性基准测试用于专家级医疗指南

Jiyao Liu, Jianghan Shen, Sida Song, Tianbin Li, Xiaojia Liu, Rongbin Li, Ziyan Huang, Jiashi Lin, Junzhi Ning, Changkai Ji, Siqi Luo, Wenjie Li, Chenglong Ma, Ming Hu, Jing Xiong, Jin Ye, Bin Fu, Ningsheng Xu, Yirong Chen, Lei Jin, Hong Chen, Junjun He

机构 * Fudan University(复旦大学) Nanjing University(南京大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) University of Hong Kong(香港大学)

AI总结 本文提出MedProbeBench,首个利用高质量临床指南作为专家级参考的基准,通过1200+任务自适应评估标准和5130+原子性声明验证,评估17种LLM和深度研究代理在证据整合和指南生成中的能力差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18026 2026-04-21 cs.LG cs.AI

RASP-Tuner: Retrieval-Augmented Soft Prompts for Context-Aware Black-Box Optimization in Non-Stationary Environments

RAPSTuner:基于检索的软提示用于在非平稳环境中具有情境意识的黑盒优化

Enze Pan

机构 * Department of Computer Science, The University of Hong Kong(香港大学计算机科学系)

AI总结 本文提出RAPSTuner,通过检索相似历史情境来识别模式代理,利用混合专家代理预测短期损失,并在低维提示子空间中进行适应,以减少非平稳环境中黑盒优化的累积遗憾。

Comments Withdraw by ICML and prepare for NeurIPS or ICLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08364 2026-04-21 cs.CV

MegaStyle: Constructing Diverse and Scalable Style Dataset via Consistent Text-to-Image Style Mapping

MegaStyle: 通过一致的文本到图像风格映射构建多样化和可扩展的风格数据集

Junyao Gao, Sibo Liu, Jiaxing Li, Yanan Sun, Yuanpeng Tu, Fei Shen, Weidong Zhang, Cairong Zhao, Jun Zhang

机构 * Tencent(腾讯) Nanyang Technological University(南洋理工大学) Hong Kong University of Science and Technology(香港科技大学) Fuzhou University(福州大学) University of Hong Kong(香港大学) National University of Singapore(新加坡国立大学)

AI总结 本文提出MegaStyle数据集,通过现有大生成模型的一致文本到图像风格映射能力,构建了包含170k风格提示和400k内容提示的多样化数据集,并提出风格监督对比学习方法和FLUX风格迁移模型。

Comments project website https://jeoyal.github.io/MegaStyle/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04695 2026-04-21 cs.AI cs.LG

Tape: A Cellular Automata Benchmark for Evaluating Rule-Shift Generalization in Reinforcement Learning

Tape:一种用于评估强化学习中规则转移泛化能力的单元自动机基准

Enze Pan

机构 * The University of Hong Kong(香港大学)

AI总结 Tape通过隔离动态中的潜在规则转移,保持观测-动作接口不变,评估强化学习在分布外泛化中的表现,发现稳定/周期性/混沌规则间的显著异质性。

Comments ICML reject and seeking for NeurIPS

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19897 2026-04-21 cs.AI cs.CL cs.CV cs.HC

ScienceBoard: Evaluating Multimodal Autonomous Agents in Realistic Scientific Workflows

ScienceBoard: 评估多模态自主代理在真实科学工作流中的表现

Qiushi Sun, Zhoumianze Liu, Chang Ma, Zichen Ding, Fangzhi Xu, Zhangyue Yin, Haiteng Zhao, Zhenyu Wu, Kanzhi Cheng, Zhaoyang Liu, Jianing Wang, Qintong Li, Xiangru Tang, Tianbao Xie, Xiachong Feng, Xiang Li, Ben Kao, Wenhai Wang, Biqing Qi, Lingpeng Kong, Zhiyong Wu

机构 * The University of Hong Kong(香港大学) Shanghai AI Laboratory(上海人工智能实验室) Fudan University(复旦大学) Peking University(北京大学) Nanjing University(南京大学) East China Normal University(华东师范大学) Yale University(耶鲁大学)

AI总结 ScienceBoard通过真实多领域环境和169个高质量任务评估多模态自主代理在科学工作流中的能力,发现现有代理在复杂任务中仅达到15%的成功率,揭示了改进设计原则的必要性。

Comments ICLR 2026 Camera Ready Version

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15304 2026-04-21 cs.AI cs.CY

AI Agents and Hard Choices

AI代理与艰难抉择

Kangyu Wang

机构 * The University of Hong Kong(香港大学)

AI总结 本文探讨AI代理在面对多目标不可比情况下的局限性,提出识别与解决难题,并提出集体解决方案以增强自主决策能力。

Comments 20 pages. v2: Substantially revised and rewritten; now typeset in LaTeX. Reflects the version presented at ACM FAccT 2026 (non-archival track). A revised version is under submission to a journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.16476 2026-04-21 cs.CV cs.AI

SVGDreamer: Text Guided SVG Generation with Diffusion Model

SVGDreamer:基于扩散模型的文本引导SVG生成

Ximing Xing, Haitao Zhou, Chuang Wang, Jing Zhang, Dong Xu, Qian Yu

机构 * Beihang University(北航) The University of Hong Kong(香港大学)

AI总结 SVGDreamer提出一种基于扩散模型的文本引导SVG生成方法,通过引入语义驱动的图像向量化过程和向量粒子基于的分数蒸馏技术,提升生成的可编辑性、视觉质量和多样性。

Comments Accepted by CVPR 2024. Project Page: https://ximinng.github.io/SVGDreamer-project/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17696 2026-04-21 cs.AI

Stratagem: Learning Transferable Reasoning via Trajectory-Modulated Game Self-Play

战略:通过轨迹调节的游戏自我对战学习可转移的推理

Xiachong Feng, Deyi Yin, Xiaocheng Feng, Yi Jiang, Libo Qin, Yangfan Ye, Lei Huang, Weitao Ma, Qiming Li, Yuxuan Gu, Bing Qin, Lingpeng Kong

机构 * The University of Hong Kong(香港大学) Harbin Institute of Technology(哈尔滨工业大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))

AI总结 本文提出STRATAGEM,通过轨迹调节游戏自我对战学习可转移的推理,解决领域特定性和上下文停滞问题,提升数学推理和代码生成等任务的性能。

Comments ACL 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17691 2026-04-21 cs.LG cs.AI

SafeAnchor: Preventing Cumulative Safety Erosion in Continual Domain Adaptation of Large Language Models

SafeAnchor:在大语言模型连续领域适应中防止累积安全性侵蚀

Dongxin Guo, Jikun Wu, Siu Ming Yiu

机构 * The University of Hong Kong(香港大学) Brain Investing Limited

AI总结 SafeAnchor通过识别低秩安全子空间并约束梯度更新,有效防止连续领域适应中的安全性侵蚀,实验显示其在多个领域任务中保持了较高的安全性对齐度。

Comments 16 pages (12 main + 4 appendix), 2 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17245 2026-04-21 cs.RO

MM-Hand: A 21-DOF Multi-modal Modular Dexterous Robotic Hand with Remote Actuation

MM-Hand:一种21自由度多模态模块化灵活机械手 with 远程驱动

Zhuoheng Li, Qingquan Lin, Checheng Yu, Qiangyu Chen, Zhiqian Lan, Lutong Zhang, Hongyang Li, Ping Luo

机构 * The University of Hong Kong(香港大学) City University of Hong Kong(香港城市大学) XiFengGu Ltd.(西风谷有限公司)

AI总结 MM-Hand通过远程驱动技术实现21自由度多模态模块化机械手,集成了弹簧回弹腱驱动手指、3D打印模块化手指和手掌结构、快速腱连接器及多模态传感系统,验证了其轻量、传感丰富和可维护性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16940 2026-04-21 cs.LG cs.AI

D-QRELO: Training- and Data-Free Delta Compression for Large Language Models via Quantization and Residual Low-Rank Approximation

D-QRELO:通过量化和残差低秩近似实现大型语言模型的训练和数据无关的delta压缩

Junlin Li, Shuangyong Song, Guodong Du, Ngai Wong, Xuebo Liu, Yongxiang Li, Min Zhang, Jing Li, Xuelong Li

机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) TeleAI of China Telecom(中国电信TeleAI) The Hong Kong Polytechnic University(香港理工大学) The University of Hong Kong(香港大学)

AI总结 本文提出DQRELO方法,通过量化和残差低秩近似实现大型语言模型的delta压缩,解决大规模数据训练导致的压缩误差问题,提升压缩效果和实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16917 2026-04-21 cs.CL

x1: Learning to Think Adaptively Across Languages and Cultures

x1: 在多种语言和文化中学习适应性思考

Yangfan Ye, Xiaocheng Feng, Xiachong Feng, Yichong Huang, Zekun Yuan, Lei Huang, Weitao Ma, Qichen Hong, Yunfei Lu, Dandan Tu, Bing Qin

机构 * Harbin Institute of Technology(哈尔滨工业大学) Peng Cheng Laboratory(鹏城实验室) The University of Hong Kong(香港大学) Huawei Technologies Co., Ltd(华为技术有限公司)

AI总结 x1通过在实例层面选择有利语言进行推理,提升多语言数学推理和文化相关任务的性能,挑战了单纯扩大模型规模的假设。

Comments Findings of ACL2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16883 2026-04-21 cs.LG cs.AI

SinkRouter: Sink-Aware Routing for Efficient Long-Context Decoding in Large Language and Multimodal Models

SinkRouter: 为大语言和多模态模型高效长上下文解码的感知路由

Junnan Liu, Xinyan Liu, Peifeng Gao, Zhaobo Qi, Beichen Zhang, Weigang Zhang, Antoni Bert Chen

机构 * Harbin Institute of Technology (Weihai)(哈尔滨工业大学(威海)) University of Hong Kong(香港大学) City University of Hong Kong(城市大学)

AI总结 本文提出SinkRouter,通过感知路由机制提升长上下文解码效率,减少计算冗余,实现在512K上下文下的2.03倍加速,保持高精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16586 2026-04-21 cs.LG cs.AI q-bio.QM

A Systematic Survey and Benchmark of Deep Learning for Molecular Property Prediction in the Foundation Model Era

在基础模型时代对深度学习用于分子性质预测的系统调查和基准测试

Zongru Li, Xingsheng Chen, Honggang Wen, Regina Qianru Zhang, Ming Li, Xiaojin Zhang, Hongzhi Yin, Qiang Yang, Kwok-Yan Lam, Pietro Lio, Siu-Ming Yiu

机构 * The University of Hong Kong, Hong Kong SAR(香港大学) Nanyang Technological University, Singapore(南洋理工大学) University of Cambridge, United Kingdom(剑桥大学) Zhejiang Normal University, China(浙江师范大学) The Hong Kong University of Science and Technology, Hong Kong SAR(香港科学与技术大学) The University of Queensland(昆士兰大学) The Hong Kong Polytechnic University, Hong Kong SAR(香港理工大学)

AI总结 本文系统调查了深度学习在分子性质预测中的应用,探讨了四种互补范式,并提出了未来三个发展方向,包括物理感知学习、可信推理的基础模型和整合计算与实验数据的基准生态系统。

Comments 32 pages. It is just accepted by Journal of Chemical Theory and Computation 2026

Journal ref Journal of Chemical Theory and Computation 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11811 2026-04-21 cs.CL cs.AI cs.CV cs.CY

Enhancing Geo-localization for Crowdsourced Flood Imagery via LLM-Guided Attention

通过LLM引导注意力增强 crowdsourced 洪水影像的地理定位

Fengyi Xu, Jun Ma, Waishan Qiu, Cui Guo, Jack C. P. Cheng

机构 * Department of Urban Planning and Design, The University of Hong Kong(香港大学城市规划与设计系) Urban Systems Institute, The University of Hong Kong(香港大学都市系统研究所) Department of Civil and Environmental Engineering, The Hong Kong University of Science and Technology(香港理工大学土木与环境工程系)

AI总结 本文提出VPR-AttLLM框架,通过整合大语言模型的语义推理与地理知识,提升 crowdsourced 洪水影像的地理定位精度,实验表明在真实洪水影像上召回率提升1-3%,最高达8%。

Comments Updated author list to include additional contributor. Revised title and improved methodology section based on collaborative feedback

Journal ref Computers, Environment and Urban Systems, 127, 102434 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏