arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The Chinese University of Hong Kong(香港中文大学)

共收录 2402
2602.13332 2026-02-17 cs.CV cs.AI

MedScope: Incentivizing "Think with Videos" for Clinical Reasoning via Coarse-to-Fine Tool Calling

MedScope:通过粗到细的工具调用激励“通过视频思考”以进行临床推理

Wenjie Li, Yujie Zhang, Haoran Sun, Xingqi He, Hongcheng Gao, Chenglong Ma, Ming Hu, Guankun Wang, Shiyi Yao, Renhao Yang, Hongliang Ren, Lei Wang, Junjun He, Yankai Jiang

机构 * College of Health Science and Technology, Shanghai Jiao Tong University School of Medicine, Shanghai, China(上海交通大学医学院健康科学与技术学院) Fudan University, Shanghai, China(复旦大学) Shanghai Innovation Institute, Shanghai, China(上海创新研究院) Tsinghua University, Beijing, China(清华大学) Shanghai Artificial Intelligence Laboratory, Shanghai, China(上海人工智能实验室) The Chinese University of Hong Kong, Hong Kong, China(香港中文大学) Ruijin Hospital, Shanghai Jiaotong University, Shanghai, China(上海交通大学瑞金医院)

AI总结 MedScope通过粗到细的工具调用机制,提升临床视频推理的准确性与可信度,实现基于时间局部化视觉证据的医疗AI代理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14186 2026-02-17 cs.NI cs.AI cs.LG eess.SP

A Disentangled Representation Learning Framework for Low-altitude Network Coverage Prediction

一种用于低空网络覆盖预测的解耦表示学习框架

Xiaojie Li, Zhijie Cai, Nan Qi, Chao Dong, Guangxu Zhu, Haixia Ma, Qihui Wu, Shi Jin

机构 * School of Information Science and Engineering, Southeast University(东南大学信息科学与工程学院) College of Physics, Nanjing University of Aeronautics and Astronautics(南京航空航天大学物理学院) Shenzhen Research Institute of Big Data, The Chinese University of Hong Kong-Shenzhen(香港中文大学(深圳)大数据研究院) Key Laboratory of Dynamic Cognitive System of Electromagnetic Spectrum Space, Ministry of Industry and Information Technology, Nanjing University of Aeronautics and Astronautics(南京航空航天大学电磁频谱空间动态认知系统重点实验室)

AI总结 本文提出了一种结合专家知识和解耦表示学习的框架,用于低空网络覆盖预测,通过减少特征空间复杂性和提升模型泛化能力,有效降低了预测误差。

Comments This paper has been accepted for publication in IEEE Transactions on Mobile Computing

Journal ref IEEE Transactions on Mobile Computing, early access, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07667 2026-02-17 cs.CV

S2R-HDR: A Large-Scale Rendered Dataset for HDR Fusion

S2R-HDR:一个大规模渲染数据集用于HDR融合

Yujin Wang, Jiarui Wu, Yichen Bian, Fan Zhang, Tianfan Xue

机构 * Shanghai AI Laboratory(上海人工智能实验室) CUHK MMLab(香港中文大学多模态实验室) CPII under InnoHK(创新工场下的CPII) Shanghai Jiao Tong University(上海交通大学)

AI总结 S2R-HDR通过构建大规模合成HDR数据集和S2R-Adapter领域适应方法,提升了HDR融合的泛化能力和实验性能。

Comments Accepted by ICLR 2026. Project Page:https://openimaginglab.github.io/S2R-HDR

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.10746 2026-02-17 cs.DC cs.AI cs.LG cs.NI

Resource-Efficient Personal Large Language Models Fine-Tuning with Collaborative Edge Computing

基于协作边缘计算的资源高效个性化大语言模型微调

Shengyuan Ye, Bei Ouyang, Tianyi Qian, Liekang Zeng, Jingyi Li, Jiangsu Du, Xiaowen Chu, Guoliang Xing, Xu Chen

机构 * School of Computer Science and Engineering, Sun Yat-sen University(中山大学计算机科学与工程学院) Department of Information Engineering, The Chinese University of Hong Kong(香港中文大学信息工程系) The Hong Kong University of Science and Technology (Guangzhou)(香港理工大学(广州)) Shenzhen Institute of Artificial Intelligence and Robotics for Society(社会人工智能与机器人研究所(深圳))

AI总结 本文提出PAC框架,通过算法与系统协同设计,实现高效资源利用的个性化大语言模型微调,提升边缘计算性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.11797 2026-02-17 q-fin.PM cs.LG q-fin.CP

Data-Driven Merton's Strategies via Policy Randomization

基于策略随机化的数据驱动梅顿策略

Min Dai, Yuchao Dong, Yanwei Jia, Xun Yu Zhou

机构 * Department of Applied Mathematics and School of Accounting and Finance, The Hong Kong Polytechnic University(应用数学系和会计与金融学院,香港理工大学) Department of Systems Engineering and Engineering Management, The Chinese University of Hong Kong(系统工程与工程管理系,香港中文大学) Department of Industrial Engineering and Operations Research & Data Science Institute, Columbia University(工业工程与运筹学系及数据科学研究所,哥伦比亚大学)

AI总结 本文提出基于策略随机化的数据驱动方法,用于解决不完全市场中的梅顿期望效用最大化问题,通过强化学习算法实现优于传统方法的性能。

Comments 45 pages, 4 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13035 2026-02-16 cs.LG cs.AI cs.CL

Look Inward to Explore Outward: Learning Temperature Policy from LLM Internal States via Hierarchical RL

向内看,向外探:通过分层强化学习从LLM内部状态学习温度策略

Yixiao Zhou, Yang Li, Dongzhou Cheng, Hehe Fan, Yu Cheng

机构 * Zhejiang University(浙江大学) Southeast University(东南大学) The Chinese University of Hong Kong(香港中文大学) Shanghai Innovation Institute(上海创新研究院)

AI总结 Introspective LLM通过分层强化学习从LLM内部状态学习温度策略,提升数学推理任务中的探索效率与可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12982 2026-02-16 cs.LG

Multi-Dimensional Visual Data Recovery: Scale-Aware Tensor Modeling and Accelerated Randomized Computation

多维视觉数据恢复:尺度感知张量建模与加速随机计算

Wenjin Qin, Hailin Wang, Jiangjun Peng, Jianjun Wang, Tingwen Huang

机构 * School of Mathematics and Statistics, Southwest University(数学与统计学学院,西南大学) Department of Statistics and Data Science, The Chinese University of Hong Kong(统计与数据科学系,香港中文大学) School of Mathematics and Statistics, Northwestern Polytechnical University(数学与统计学学院,西北工业大学) Faculty of Computer Science and Control Engineering, Shenzhen University of Advanced Technology(计算机科学与控制工程学院,深圳先进技术大学)

AI总结 本文提出了一种基于FCTN的非凸正则化方法,通过改进的ADMM框架和随机压缩算法,实现了多维数据恢复的高效与高精度处理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12746 2026-02-16 cs.CL eess.AS

Lamer-SSL: Layer-aware Mixture of LoRA Experts for Continual Multilingual Expansion of Self-supervised Models without Forgetting

Lamer-SSL:基于层意识的LoRA专家混合用于无需遗忘的持续多语言自监督模型扩展

Jing Xu, Minglin Wu, Xueyuan Chen, Xixin Wu, Helen Meng

机构 * The Chinese University of Hong Kong(香港中文大学)

AI总结 Lamer-SSL通过层意识的LoRA专家混合与重放策略,实现持续多语言自监督模型扩展,保持性能并减少遗忘。

Comments Accepted by ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12135 2026-02-16 cs.CL

WavBench: Benchmarking Reasoning, Colloquialism, and Paralinguistics for End-to-End Spoken Dialogue Models

WavBench: 语音对话模型推理、口语化和副语言能力的基准测试

Yangzhuo Li, Shengpeng Ji, Yifu Chen, Tianle Liang, Haorong Ying, Yule Wang, Junbo Li, Jun Fang, Zhou Zhao

机构 * Xiamen University(厦门大学) Zhejiang University(浙江大学) CUHK-Shenzhen(香港中文大学(深圳))

AI总结 WavBench通过三重框架评估语音对话模型的推理、口语化和副语言能力,推动真实场景下的对话模型发展。

Comments Open-source at https://naruto-2024.github.io/wavbench.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07675 2026-02-16 cs.LG

Semantic Caching for Low-Cost LLM Serving: From Offline Learning to Online Adaptation

语义缓存用于低成本LLM服务:从离线学习到在线适应

Xutong Liu, Baran Atalar, Xiangxiang Dai, Jinhang Zuo, Siwei Wang, John C. S. Lui, Wei Chen, Carlee Joe-Wong

机构 * University of Washington(华盛顿大学) Carnegie Mellon University(卡内基梅隆大学) The Chinese University of Hong Kong(香港中文大学) City University of Hong Kong(香港城市大学) Microsoft Research(微软研究院)

AI总结 本文提出了一种基于学习的语义缓存框架,解决LLM服务中的缓存淘汰问题,通过离线优化和在线学习方法,在未知查询和成本分布下实现高效缓存管理。

Comments Accepted to INFOCOM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23266 2026-02-16 eess.AS cs.SD

CUHK-EE Systems for the vTAD Challenge at NCMMSC 2025

CUHK-EE系统参加2025年NCMMSC语音特性属性检测挑战赛

Aemon Yat Fei Chiu, Jingyu Li, Yusheng Tian, Guangyan Zhang, Tan Lee

机构 * Department of Electronic Engineering, The Chinese University of Hong Kong(电子工程系,香港中文大学)

AI总结 CUHK-EE团队开发了基于WavLM-Large和Diff-Net变体的vTAD系统,在不同设置下实现了高准确率和低错误率,揭示了模型复杂性与泛化能力的权衡。

Comments Accepted at the 20th National Conference on Man-Machine Speech Communication (NCMMSC 2025)

Journal ref In: Man-Machine Speech Communication. NCMMSC 2025. Communications in Computer and Information Science, vol 2662. Springer, Singapore (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12108 2026-02-13 cs.AI

The Pensieve Paradigm: Stateful Language Models Mastering Their Own Context

Pensieve范式:具备状态的语言模型掌握自身上下文

Xiaoyuan Liu, Tian Liang, Dongyang Ma, Deyu Zhou, Haitao Mi, Pinjia He, Yan Wang

机构 * Tencent AI Lab(腾讯人工智能实验室) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

AI总结 StateLM 通过内部推理循环和记忆工具,使语言模型具备状态管理能力,从而在长文档问答、聊天记忆和深度研究任务中取得显著性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11958 2026-02-13 cs.LG cs.CL

RAM-Net: Expressive Linear Attention with Selectively Addressable Memory

RAM-Net:具有可选地址记忆的表达性线性注意力

Kaicheng Xiao, Haotian Li, Liran Dong, Guoliang Xing

机构 * The Chinese University of Hong Kong(香港中文大学)

AI总结 RAM-Net通过可选地址记忆机制,在保持线性模型效率的同时提升长距离检索和复杂依赖捕捉能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11877 2026-02-13 cs.CL cs.AI

Towards Fair and Comprehensive Evaluation of Routers in Collaborative LLM Systems

迈向协作大语言模型系统中路由器的公平且全面评估

Wanxing Wu, He Zhu, Yixia Li, Lei Yang, Jiehui Zhao, Hongru Wang, Jian Yang, Benyou Wang, Bingyi Jing, Guanhua Chen

机构 * Southern University of Science and Technology(南方科技大学) Institut Polytechnique de Paris(巴黎政治学院) Peking University(北京大学) Deepexi Technology Co. Ltd.(深醒科技有限公司) University of Edinburgh(爱丁堡大学) Beihang University(北航) Chinese University of Hong Kong (Shenzhen)(香港中文大学(深圳))

AI总结 本文提出RouterXBench框架和ProbeDirichlet路由器,通过内部隐藏状态提升路由能力与跨领域鲁棒性,实现对协作大语言模型系统中路由器的公平全面评估。

Comments Our code is publicly available at https://github.com/zhuchichi56/RouterXBench

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11748 2026-02-13 cs.CL

Think Longer to Explore Deeper: Learn to Explore In-Context via Length-Incentivized Reinforcement Learning

思考更长以探索更深入:通过长度激励强化学习学习上下文中的探索

Futing Wang, Jianhao Yan, Yun Luo, Ganqu Cui, Zhi Wang, Xiaoye Qu, Yue Zhang, Yu Cheng, Tao Lin

机构 * Zhejiang University(浙江大学) Westlake University(西湖大学) Shanghai AI Laboratory(上海人工智能实验室) Nanjing University(南京大学) Institute of Advanced Technology, Westlake Institute for Advanced Study(西湖研究所以高级技术研究所) The Chinese University of Hong Kong(香港中文大学)

AI总结 通过长度激励强化学习,提升模型在上下文中的探索能力,从而在领域内和领域外任务中取得性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11514 2026-02-13 cs.SE cs.AI cs.CV cs.HC

How Smart Is Your GUI Agent? A Framework for the Future of Software Interaction

你的GUI代理有多智能?面向软件交互未来的框架

Sidong Feng, Chunyang Chen

机构 * The Chinese University of Hong Kong(香港中文大学) Technical University of Munich(慕尼黑工业大学)

AI总结 本文提出GUI代理自主级别框架,旨在明确自主性并评估软件交互的可信赖性进展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11440 2026-02-13 cs.CV

Ctrl&Shift: High-Quality Geometry-Aware Object Manipulation in Visual Generation

Ctrl&Shift: 视觉生成中高质量的几何感知物体操控

Penghui Ruan, Bojia Zi, Xianbiao Qi, Youze Huang, Rong Xiao, Pichao Wang, Jiannong Cao, Yuhui Shi

机构 * The Hong Kong Polytechnic University(香港理工大学) Southern University of Science and Technology(南方科技大学) The Chinese University of Hong Kong(香港中文大学) IntelliFusion Inc.(IntelliFusion公司) University of Electronic Science and Technology of China(电子科技大学) NVIDIA

AI总结 Ctrl&Shift通过端到端扩散框架实现高质量几何感知物体操控,无需显式3D建模,兼顾细粒度控制与现实泛化能力。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11215 2026-02-13 cs.LG

Charting Empirical Laws for LLM Fine-Tuning in Scientific Multi-Discipline Learning

绘制LLM微调的实证定律以用于科学多学科学习

Lintao Wang, Zhuqiang Lu, Yilin Zhu, Kun Hu, Zhenfei Yin, Shixiang Tang, Zhiyong Wang, Wanli Ouyang, Xinzhu Ma

机构 * The University of Sydney(悉尼大学) Shanghai AI Laboratory(上海人工智能实验室) Edith Cowan University(埃德温·考文大学) University of Oxford(牛津大学) The Chinese University of Hong Kong(香港中文大学) Beihang University(北航大学)

AI总结 本研究通过构建五学科语料库,揭示了多学科LLM微调的四个实证定律,为科学领域通用LLM的发展提供了可操作的指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11196 2026-02-13 eess.SP cs.AI cs.LG

Position-Aware Self-supervised Representation Learning for Cross-mode Radar Signal Recognition

基于位置感知的自监督表征学习用于跨模式雷达信号识别

Hongyang Zhang, Haitao Zhang, Yinhao Liu, Kunjie Lin, Yue Huang, Xinghao Ding

机构 * School of Science and Engineering, The Chinese University of Hong Kong, Shenzhen(科学与工程学院,香港中文大学(深圳))

AI总结 RadarPos通过位置感知自监督学习提升跨模式雷达信号识别的判别能力和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03507 2026-02-13 cs.CL

FaithRL: Learning to Reason Faithfully through Step-Level Faithfulness Maximization

FaithRL: 通过步骤级忠实性最大化学习合理推理

Runquan Gui, Yafu Li, Xiaoye Qu, Ziyan Liu, Yeqiu Cheng, Yu Cheng

机构 * Shanghai AI Laboratory(上海人工智能实验室) University of Science and Technology of China(中国科学技术大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 FaithRL通过步骤级忠实性最大化优化,减少大型语言模型的幻觉并提高推理准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04683 2026-02-12 cs.SD

UniAudio 2.0: A Unified Audio Language Model with Text-Aligned Factorized Audio Tokenization

UniAudio 2.0:一种具有文本对齐因子化音频标记化的统一音频语言模型

Dongchao Yang, Yuanyuan Wang, Dading Chong, Songxiang Liu, Xixin Wu, Helen Meng

机构 * The Chinese University of Hong Kong, China(香港中文大学)

AI总结 UniAudio 2.0通过引入ReasoningCodec和统一自回归架构,实现了文本对齐的因子化音频标记化,提升了音频理解和生成性能,并在多种任务中展现了强大的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01304 2026-02-12 cs.AI cs.CL

Agentic Jigsaw Interaction Learning for Enhancing Visual Perception and Reasoning in Vision-Language Models

代理拼图交互学习:提升视觉感知与推理能力在视觉-语言模型中

Yu Zeng, Wenxuan Huang, Shiting Huang, Xikun Bao, Yukun Qi, Yiming Zhao, Qiuchen Wang, Lin Chen, Zehui Chen, Huaian Chen, Wanli Ouyang, Feng Zhao

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai AI Laboratory(上海人工智能实验室) East China Normal University(华东师范大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 AGILE通过代理拼图交互学习提升视觉-语言模型的感知与推理能力,显著提高拼图任务性能并增强多模态模型的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10624 2026-02-12 cs.CV cs.AI

A Vision-Language Foundation Model for Zero-shot Clinical Collaboration and Automated Concept Discovery in Dermatology

一种用于零样本临床协作和皮肤病自动概念发现的视觉-语言基础模型

Siyuan Yan, Xieji Li, Dan Mo, Philipp Tschandl, Yiwen Jiang, Zhonghua Wang, Ming Hu, Lie Ju, Cristina Vico-Alonso, Yizhen Zheng, Jiahe Liu, Juexiao Zhou, Camilla Chello, Jen G. Cheung, Julien Anriot, Luc Thomas, Clare Primiero, Gin Tan, Aik Beng Ng, Simon See, Xiaoying Tang, Albert Ip, Xiaoyang Liao, Adrian Bowling, Martin Haskett, Shuang Zhao, Monika Janda, H. Peter Soyer, Victoria Mar, Harald Kittler, Zongyuan Ge

机构 * AIM for Health Lab(AIM for Health实验室) Faculty of Information Technology, Monash University(信息技术学院,墨尔本大学) Department of Dermatology, Medical University of Vienna(皮肤科,维也纳医学大学) Faculty of Engineering, Monash University(工程学院,墨尔本大学) Institute of Ophthalmology, University College London(眼科研究所,伦敦大学学院) Dermatology Department. Fundacion Hospital 12 de Octubre(皮肤科部门,12月12日基金会医院) School of Data Science, The Chinese University of Hong Kong, Shenzhen(数据科学学院,香港中文大学(深圳)) Frazer Institute, The University of Queensland(弗拉泽研究所,昆士兰大学) Dermatology Research Centre, Brisbane, Australia(皮肤科研究中心,澳大利亚布里斯班) Department of Medical and Cardiovascular Sciences, Sapienza University of Rome(医学与心血管科学系,罗马萨皮恩扎大学) Victorian Melanoma Service, Alfred Care Group, Bayside Health, Melbourne, Australia(维多利亚黑色素瘤服务,阿尔弗雷德护理集团,墨尔本布里斯班健康中心,澳大利亚) SkIIN Discovery Program, Monash University(SkIIN发现计划,墨尔本大学) Claude Bernard Lyon-1 University(克劳德·伯纳德里昂-1大学) Centre Léon Berard, Lyon, France(莱昂·贝拉德中心,法国里昂) Dermatology department, Hôpital Lyon Sud, Hospices Civils de Lyon, Lyons, France(皮肤科部门,里昂南医院,里昂民事医院,法国里昂) Cancer Research Center of Lyon, Lyons, France(里昂癌症研究中心,法国里昂) eResearch Centre, Monash University(eResearch研究中心,墨尔本大学) NVIDIA AI Techno(NVIDIA AI技术)

AI总结 DermFM-Zero是一种用于皮肤病零样本临床协作和自动概念发现的视觉-语言基础模型,通过掩码潜在建模和对比学习训练,实现了无需任务特定适应的高精度诊断和多模态检索能力。

Comments reports

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10575 2026-02-12 cs.CV cs.AI cs.CY

MetaphorStar: Image Metaphor Understanding and Reasoning with End-to-End Visual Reinforcement Learning

MetaphorStar: 基于端到端视觉强化学习的图像隐喻理解与推理

Chenhao Zhang, Yazhe Niu, Hongsheng Li

机构 * Shanghai AI Laboratory(上海人工智能实验室) Huazhong University of Science and Technology(华中科技大学) The Chinese University of Hong Kong MMLab(香港中文大学MMLab)

AI总结 MetaphorStar通过端到端视觉强化学习框架提升图像隐喻理解与推理能力,显著优于现有模型。

Comments 14 pages, 4 figures, 11 tables; Code: https://github.com/MING-ZCH/MetaphorStar, Model & Dataset: https://huggingface.co/collections/MING-ZCH/metaphorstar

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10561 2026-02-12 cs.RO

Morphogenetic Assembly and Adaptive Control for Heterogeneous Modular Robots

形态生成与自适应控制用于异构模块化机器人

Chongxi Meng, Da Zhao, Yifei Zhao, Minghao Zeng, Yanmin Zhou, Zhipeng Wang, Bin He

机构 * Shanghai Research Institute for Intelligent Autonomous Systems, Tongji University, Shanghai, China(上海智能自主系统研究院,同济大学,上海,中国) Department of Mechanical and Automation Engineering and T Stone Robotics Institute, The Chinese University of Hong Kong, Hong Kong(机械与自动化工程系和T Stone机器人研究院,香港中文大学,香港)

AI总结 本文提出了一种闭环自动化框架,用于异构模块化机器人,通过分层规划和退火-方差MPPI控制器实现高效动态组装与实时运动控制。

Comments Accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10483 2026-02-12 cs.GT cs.LG

Pricing Query Complexity of Multiplicative Revenue Approximation

乘法收益近似中的定价查询复杂性

Wei Tang, Yifan Wang, Mengxiao Zhang

机构 * Chinese University of Hong Kong(香港中文大学) Georgia Institute of Technology(佐治亚理工学院) University of Iowa(爱荷华大学)

AI总结 本文研究了在提供尺度提示的情况下,单买家收益最大化问题的定价查询复杂性,针对不同分布类型建立了紧的复杂性界限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10417 2026-02-12 eess.SP cs.RO

RadarEye: Robust Liquid Level Tracking Using mmWave Radar in Robotic Pouring

RadarEye: 使用毫米波雷达实现机器人倒液过程中的鲁棒液体水平跟踪

Hongyu Deng, He Chen

机构 * Department of Information Engineering, The Chinese University of Hong Kong, Hong Kong SAR, China(信息工程系,香港中文大学,香港特别行政区,中国)

AI总结 RadarEye通过毫米波雷达实现机器人倒液过程中液体水平的鲁棒跟踪,采用高分辨率波束成形和物理感知跟踪器,实现亚毫秒级延迟和优于视觉和超声波的精度。

Comments To appear in IEEE ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09653 2026-02-12 cs.AI

ClinAlign: Scaling Healthcare Alignment from Clinician Preference

ClinAlign: 从医生偏好扩展医疗对齐

Shiwei Lyu, Xidong Wang, Lei Liu, Hao Zhu, Chaohe Zhang, Jian Wang, Jinjie Gu, Benyou Wang, Yue Shen

机构 * Ant Group(蚂蚁集团) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Peking University(北京大学)

AI总结 ClinAlign通过HealthRubrics和HealthPrinciples实现医疗输出与医生偏好的高效对齐,验证了资源高效的临床对齐方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01330 2026-02-12 cs.AI

Beyond Gemini-3-Pro: Revisiting LLM Routing and Aggregation at Scale

超越Gemini-3-Pro:大规模LLM路由与聚合的再审视

Shengji Tang, Weihao Lin, Peng Ye, Jingqi Ye, Hao Li, Yiqun Zhang, Xiaosong Wang, Bo Zhang, Shuyue Hu, Tao Chen, Lei Bai, Wanli Ouyang

机构 * Shanghai AI Lab(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学) Fudan University(复旦大学) University of Science and Technology of China(中国科学技术大学) Northwestern Polytechnical University(西北工业大学) Northeastern University(东北大学)

AI总结 本文提出JiSi框架,通过混合路由、支持集聚合选择和自适应切换技术,实现开源LLM协作超越Gemini-3-Pro。

Comments 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09210 2026-02-12 cs.CV cs.AI

MME-Emotion: A Holistic Evaluation Benchmark for Emotional Intelligence in Multimodal Large Language Models

MME-Emotion:多模态大语言模型情感智能的综合评估基准

Fan Zhang, Zebang Cheng, Chong Deng, Haoxuan Li, Zheng Lian, Qian Chen, Huadai Liu, Wen Wang, Yi-Fan Zhang, Renrui Zhang, Ziyu Guo, Zhihong Zhu, Hao Wu, Haixin Wang, Yefeng Zheng, Xiaojiang Peng, Xian Wu, Kun Wang, Xiangang Li, Jieping Ye, Pheng-Ann Heng

机构 * The Chinese University of Hong Kong(香港中文大学) Tongyi Lab(通义实验室) SZTU(深圳技术大学) Peking University(北京大学) Tongji University(同济大学) CASIA(中国科学院自动化所) Tencent(腾讯) UCLA(加州大学洛杉矶分校) Westlake University(西湖大学) NTU(国立大学)

AI总结 MME-Emotion是首个评估多模态大语言模型情感智能的综合基准,揭示当前模型在情感识别和推理上的不足,并通过多智能体框架提供混合指标分析。

详情

展开后加载摘要…

URL PDF HTML 收藏