arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The Chinese University of Hong Kong(香港中文大学)

共收录 2407
2512.14619 2025-12-17 cs.LG

ParaFormer: A Generalized PageRank Graph Transformer for Graph Representation Learning

ParaFormer: 一种通用的PageRank图变换器用于图表示学习

Chaohao Yuan, Zhenjie Song, Ercan Engin Kuruoglu, Kangfei Zhao, Yang Liu, Deli Zhao, Hong Cheng, Yu Rong

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) The Chinese University of Hong Kong(香港中文大学) DAMO Academy, Alibaba Group, Hupan Lab(达摩院、阿里集团、乎盘实验室)

AI总结 ParaFormer通过PageRank增强的注意力模块缓解深度GNNs中的过平滑问题,实现节点和图分类任务的性能提升。

Comments Accepted by WSDM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01170 2025-12-17 cs.AI

DART: Difficulty-Adaptive Reasoning Truncation for Efficient Large Language Models

DART: 为高效大语言模型的难度自适应推理截断

Ruofan Zhang, Bin Xia, Zhen Cheng, Cairen Jian, Minglun Yang, Ngai Wong, Yuan Cheng

机构 * School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院) CSE Department, The Chinese University of Hong Kong(香港中文大学计算机科学与工程系) Research and Development Department, SIMMIR Tech(Simmir科技研发部) School of Information Science and Technology, Xiamen University Tan Kah Kee College(厦门大学信息科学与技术学院) The University of Hong Kong(香港大学)

AI总结 DART通过自适应调整推理长度提升大语言模型效率,实现81.2%的推理截断和5.33倍的计算加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14284 2025-12-17 cs.CV

SS4D: Native 4D Generative Model via Structured Spacetime Latents

SS4D:通过结构化时空潜在变量实现的原生4D生成模型

Zhibing Li, Mengchen Zhang, Tong Wu, Jing Tan, Jiaqi Wang, Dahua Lin

机构 * The Chinese University of Hong Kong(香港中文大学) Shanghai AI Laboratory(上海人工智能实验室) Zhejiang University(浙江大学) Stanford University(斯坦福大学)

AI总结 SS4D通过结构化时空潜在变量实现原生4D生成模型,直接从单目视频合成动态3D物体,提升时间一致性和结构一致性。

Comments ToG(Siggraph Asia 2025)

Journal ref ACM Transactions on Graphics, 44(6): Article 244, 12 pages, December 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14111 2025-12-17 cs.RO

Interactive Motion Planning for Human-Robot Collaboration Based on Human-Centric Configuration Space Ergonomic Field

基于以人为核心的配置空间人体工学场的人机协作交互运动规划

Chenzui Li, Yiming Chen, Xi Wu, Tao Teng, Sylvain Calinon, Darwin Caldwell, Fei Chen

机构 * Department of Mechanical and Automation Engineering, T-Stone Robotics Institute, The Chinese University of Hong Kong(机械与自动化工程系,T-Stone机器人研究所,香港中文大学) Idiap Research Institute(Idiap研究所) Department of Advanced Robotics, Istituto Italiano di Tecnologia(先进机器人系,意大利Istituto Italiano di Tecnologia)

AI总结 本文提出基于配置空间人体工学场的运动规划方法,通过高效算法构建人体工学场并集成到阻抗控制机器人中,实验表明其在协作任务中有效降低人体工学成本和肌肉激活,提升人机协作效率。

Comments 10 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13723 2025-12-17 cs.CY cs.AI

Made-in China, Thinking in America:U.S. Values Persist in Chinese LLMs

中国制造,思考在美国:美国价值观在中国的大型语言模型中持续存在

David Haslett, Linus Ta-Lun Huang, Leila Khalatbari, Janet Hui-wen Hsiao, Antoni B. Chan

机构 * Hong Kong University of Science and Technology(香港科学与技术大学) Sharif University of Technology(谢赫·穆吉贝尔谢赫·穆吉贝尔大学) Chinese University of Hong Kong(香港中文大学) City University of Hong Kong(香港城市大学)

AI总结 研究发现中国制作的大型语言模型在道德和价值观上更倾向于美国人的倾向,即使在提示或身份调整后也难以完全改变。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13701 2025-12-17 cs.AI cs.IT math.IT

Blind Radio Mapping via Spatially Regularized Bayesian Trajectory Inference

盲式无线电地图构建:基于空间正则化的贝叶斯轨迹推断

Zheng Xing, Junting Chen

机构 * School of Science(科学与工程学院) Shenzhen Future Network of Intelligence Institute (FNii-Shenzhen) The Chinese University of Hong Kong, Shenzhen, Guangdong 518172, China(深圳未来网络智能研究院(FNii-Shenzhen)香港中文大学(深圳))

AI总结 本文提出一种无需位置标签的盲式无线电地图构建方法,通过空间正则化的贝叶斯推断框架推断用户轨迹,实验显示定位误差低至0.68米。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00981 2025-12-17 cs.CV

VesSAM: Efficient Multi-Prompting for Segmenting Complex Vessel

VesSAM: 高效多提示分割复杂血管

Suzhong Fu, Rui Sun, Xuan Ding, Jingqi Dong, Yiming Yang, Yao Zhu, Min Chang Jordan Ren, Delin Deng, Angelica Aviles-Rivero, Shuguang Cui, Zhen Li

机构 * FNii-Shenzhen, CUHK-Shenzhen(FNii-Shenzhen,CUHK-Shenzhen) School of Science and Engineering, CUHK-Shenzhen(CUHK-Shenzhen科学与工程学院) Zhejiang University(浙江大学) Boston University(波士顿大学) Vanderbilt University(范德比大学) Tsinghua University(清华大学)

AI总结 VesSAM通过多提示编码器和轻量级解码器提升血管分割性能,实现比现有方法更高的Dice和IoU指标,同时参数更少且泛化能力更强。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11160 2025-12-17 cs.CV

A Unified Framework with Multimodal Fine-tuning for Remote Sensing Semantic Segmentation

多模态微调的统一框架用于遥感语义分割

Xianping Ma, Xiaokang Zhang, Man-On Pun, Bo Huang

机构 * School of Science and Engineering, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)科学与工程学院) School of Information Science and Engineering, Wuhan University of Science and Technology(武汉科技大学信息科学与工程学院) Department of Geography, The University of Hong Kong(香港大学地理系)

AI总结 本文提出了一种多模态微调的统一框架,用于改进遥感语义分割的性能,通过引入新的MFNet和DFM模块,显著提升了多模态数据的分割效果。

Comments 15 pages, 11 figures

Journal ref IEEE Transactions on Geoscience and Remote Sensing, vol. 63, pp. 1-15, 2025, Art no. 5405015

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13070 2025-12-16 cs.AI cs.CL

M-GRPO: Stabilizing Self-Supervised Reinforcement Learning for Large Language Models with Momentum-Anchored Policy Optimization

M-GRPO:通过动量锚定策略优化稳定大语言模型的自监督强化学习

Bizhe Bai, Hongming Wu, Peng Ye, Tao Chen

机构 * Shanghai Innovation Institute(上海创新研究院) College of Future Information Technology, Fudan(复旦大学未来信息技术学院) Shanghai AI Laboratory(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学)

AI总结 M-GRPO通过动量锚定策略优化和IQR过滤方法,稳定大语言模型的自监督强化学习训练,提升训练稳定性和性能。

Comments 7 pages, 5 figures,Accepted NeurIPS 2025 Workshop on Efficient Reasoning

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12578 2025-12-16 quant-ph cs.CC cs.LG

Scalable Quantum Error Mitigation with Neighbor-Informed Learning

可扩展的邻域感知学习量子误差缓解

Zhenyu Chen, Bin Cheng, Minbo Gao, Xiaodie Lin, Ruiqi Zhang, Zhaohui Wei, Zhengfeng Ji

机构 * Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) Centre for Quantum Technologies, National University of Singapore(新加坡国立大学量子技术中心) Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) University of Chinese Academy of Sciences(中国科学院大学) Department of Mechanical and Automation Engineering, The Chinese University of Hong Kong(香港中文大学机械与自动化工程系) College of Computer and Data Science, Fuzhou University(福州大学计算机与数据科学学院) Yau Mathematical Sciences Center, Tsinghua University(清华大学姚期 Banking 数学科学中心) Department of Mathematics, Tsinghua University(清华大学数学系) Yanqi Lake Beijing Institute of Mathematical Sciences and Applications(燕琦湖北京数学科学与应用研究院)

AI总结 本文提出邻域感知学习框架,通过灵活高效的训练方法提升量子误差缓解的性能,实现理论与实际的双重优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12552 2025-12-16 cs.AI

Large Language Newsvendor: Decision Biases and Cognitive Mechanisms

大语言新闻供应商:决策偏差与认知机制

Jifei Liu, Zhi Chen, Yuanguang Zhong

机构 * School of Business Administration, South China University of Technology(华南理工大学商学院) Department of Decisions, Operations and Technology, The Chinese University of Hong Kong(香港中文大学决策、运营与技术系)

AI总结 研究分析大语言模型在新闻供应商问题中的决策偏差,发现其放大人类认知偏差,提出通过结构化提示优化AI决策可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08648 2025-12-16 cs.CV

Repulsor: Accelerating Generative Modeling with a Contrastive Memory Bank

Repulsor:利用对比记忆库加速生成建模

Shaofeng Zhang, Xuanqi Chen, Ning Liao, Haoxiang Zhao, Xiaoxing Wang, Haoru Tan, Sitong Wu, Xiaosong Jia, Qi Fan, Junchi Yan

机构 * School of Artificial Intelligence and Data Science, University of Science and Technology of China(人工智能与数据科学学院,中国科学技术大学) Shanghai Jiao Tong University(上海交通大学) HKU(香港大学) CUHK(香港大学) Fudan University(复旦大学) Nanjing University(南京大学)

AI总结 Repulsor通过对比记忆库机制,无需外部编码器,实现高效的生成建模,显著提升收敛速度和生成质量。

Comments 19 pages, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27562 2025-12-16 stat.ML cs.LG math.ST stat.TH

Optimal Convergence Analysis of DDPM for General Distributions

DDPM在一般分布下的最优收敛性分析

Yuchen Jiao, Yuchen Zhou, Gen Li

机构 * Department of Statistics and Data Science, Chinese University of Hong Kong(香港中文大学统计与数据科学系) Department of Statistics, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校统计系)

AI总结 本文研究了DDPM在一般分布下的收敛性,通过引入放松光滑性条件,证明了其在KL散度中的收敛速率,并揭示了DDPM与DDIM在维度依赖上的相似性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12793 2025-12-16 cs.CV

ViCO: A Training Strategy towards Semantic Aware Dynamic High-Resolution

ViCO: 一种面向语义感知动态高分辨率的训练策略

Long Cui, Weiyun Wang, Jie Shao, Zichen Wen, Gen Luo, Linfeng Zhang, Yanting Zhang, Yu Qiao, Wenhai Wang

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Fudan University(复旦大学) Nanjing University(南京大学) Donghua University(东华大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 ViCO通过动态调整视觉标记数量以适应图像语义复杂度,有效降低推理成本的同时保持模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14502 2025-12-16 cs.LG

Learning to Integrate Diffusion ODEs by Averaging the Derivatives

通过平均导数学习整合扩散ODEs

Wenze Liu, Xiangyu Yue

机构 * MMLab, The Chinese University of Hong Kong(中国香港大学)

AI总结 本文提出割线损失方法,通过学习ODE整合来提升扩散模型的推断速度和稳定性,实验表明其在CIFAR-10和ImageNet-256×256上取得良好效果。

Comments Accepted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22140 2025-12-16 eess.IV cs.CV eess.SP

Score-Based Turbo Message Passing for Plug-and-Play Compressive Image Recovery

基于评分的turbo信息传递用于即插即用压缩图像恢复

Chang Cai, Xiaojun Yuan, Ying-Jun Angela Zhang

机构 * Department of Information Engineering, The Chinese University of Hong Kong, Shatin, N.T., Hong Kong SAR(信息工程系,香港中文大学(深圳校区)) National Key Lab. of Wireless Commun., Uni. of Electronic Sci. and Tech. of China, Chengdu, China(无线通信国家重点实验室,电子科技大学,成都,中国)

AI总结 本文提出了一种基于评分的turbo信息传递框架,利用评分建模与经验贝叶斯最优去噪的关系,提升压缩图像恢复的性能-复杂度权衡。

Comments IEEE SPAWC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13707 2025-12-16 cs.RO

Human-Like Robot Impedance Regulation Skill Learning from Human-Human Demonstrations

类人机器人阻抗调节技能从人与人示范中学习

Chenzui Li, Xi Wu, Yiming Chen, Tao Teng, Xuefeng Zhang, Sylvain Calinon, Darwin Caldwell, Fei Chen

机构 * Department of Mechanical and Automation Engineering, T-Stone Robotics Institute, The Chinese University of Hong Kong(机械与自动化工程系,T-Stone机器人研究院,香港中文大学) College of Science and Technology, Ningbo University(科学与技术学院,宁波大学) Idiap Research Institute(Idiap研究机构)

AI总结 本文提出HIImpRSL框架,通过模仿学习和LSTM模块实现机器人在多人协作任务中类人阻抗调节与适应能力。

Comments 13 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.14507 2025-12-16 cs.LG cs.AI cs.CL

From Pruning to Grafting: Dynamic Knowledge Redistribution via Learnable Layer Fusion

从剪枝到嫁接:通过可学习层融合实现动态知识再分配

Zehua Pei, Hui-Ling Zhen, Xianzhi Yu, Sinno Jialin Pan, Mingxuan Yuan, Bei Yu

机构 * The Chinese University of Hong Kong, Hong Kong SAR(香港中文大学) Noah’s Ark Lab, Huawei, Hong Kong SAR(华为诺亚实验室,香港)

AI总结 FuseGPT通过动态知识再分配和可学习层融合,实现更高效的模型压缩与性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02421 2025-12-16 cs.CV

TimeWalker: Personalized Neural Space for Lifelong Head Avatars

TimeWalker: 为终身头像的个性化神经空间

Dongwei Pan, Yang Li, Hongsheng Li, Kwan-Yee Lin

机构 * Shanghai AI Laboratory(上海人工智能实验室) CUHK(香港中文大学)

AI总结 TimeWalker通过个性化神经空间实现终身头像的重建与动画,结合动态神经基融合模块和2D高斯点散射技术,实现真实感的面部表情和年龄变化建模。

Comments Project Page: https://timewalker2025.github.io/timewalker.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11558 2025-12-15 cs.CV cs.AI cs.CL

DentalGPT: Incentivizing Multimodal Complex Reasoning in Dentistry

DentalGPT: 促进牙科多模态复杂推理的激励机制

Zhenyang Cai, Jiaming Zhang, Junjie Zhao, Ziyi Zeng, Yanchao Li, Jingyi Liang, Junying Chen, Yunjin Yang, Jiajun You, Shuzhi Deng, Tongfei Wang, Wanting Chen, Chunxiu Hao, Ruiqi Xie, Zhenwei Wen, Xiangyi Feng, Zou Ting, Jin Zou Lin, Jianquan Li, Guangjun Yu, Liangyi Chen, Junwen Wang, Shan Jiang, Benyou Wang

机构 * Shenzhen Stomatology Hospital (Pingshan) of Southern Medical University(南方医科大学深圳口腔医院(平山)) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) State Key Laboratory of Membrane Biology, Beijing Key Laboratory of Cardiometabolic Molecular Medicine, Institute of Molecular Medicine, National Biomedical Imaging Center, School of Future Technology, Peking University(北京大学膜生物学国家重点实验室、北京心代谢分子医学重点实验室、分子医学研究院、国家生物医学成像中心、未来技术学院) Freedom AI Division of Applied Oral Sciences & Community Dental Care Faculty of Dentistry, The University of Hong Kong(香港大学牙科学院应用口腔科学与社区牙科护理系) Beijing Institute of Collaborative Innovation(北京协同创新研究院) National Health Data Institute, Shenzhen(深圳国家健康数据研究院) Shenzhen Loop Area Institute(深圳河套学院) Shenzhen Institute of Big Data(深圳大数据研究院)

AI总结 DentalGPT通过高质量数据和强化学习提升牙科多模态推理能力,实现优于现有模型的诊断性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11525 2025-12-15 cs.LG cs.AI

NeuralOGCM: Differentiable Ocean Modeling with Learnable Physics

NeuralOGCM:可微海洋建模与可学习物理

Hao Wu, Yuan Gao, Fan Xu, Fan Zhang, Guangliang Liu, Yuxuan Liang, Xiaomeng Huang

机构 * Tsinghua University, Beijing, China(清华大学) University of Science and Technology of China, Hefei, China(中国科学技术大学) The Chinese University of Hong Kong, Hong Kong, China(香港中文大学) Hong Kong University of Science and Technology (Guangzhou), Guangzhou, China(香港科学与技术大学(广州))

AI总结 NeuralOGCM通过融合可微编程与深度学习,实现高效且物理合理的海洋建模,提升科学计算的精度与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11226 2025-12-15 cs.CV

FutureX: Enhance End-to-End Autonomous Driving via Latent Chain-of-Thought World Model

FutureX: 通过潜在链式思维世界模型增强端到端自动驾驶

Hongbin Lin, Yiming Yang, Yifan Zhang, Chaoda Zheng, Jie Feng, Sheng Wang, Zhennan Wang, Shijia Chen, Boyang Wang, Yu Zhang, Xianming Liu, Shuguang Cui, Zhen Li

机构 * FNii-Shenzhen(FNii深圳分部) SSE, CUHK-Shenzhen(SSE,CUHK深圳分校) Xpeng Motors(小鹏汽车) MiroMind AI(MiroMind人工智能) Xidian University(西安电子科技大学)

AI总结 FutureX通过链式思维世界模型增强端到端自动驾驶,提升复杂场景下的运动规划质量与安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10206 2025-12-15 cs.AI

CP-Env: Evaluating Large Language Models on Clinical Pathways in a Controllable Hospital Environment

CP-Env:在可控医院环境中评估大型语言模型在临床路径中的表现

Yakun Zhu, Zhongzhen Huang, Qianhan Feng, Linjie Mu, Yannian Gu, Shaoting Zhang, Qi Dou, Xiaofan Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) The Chinese University of Hong Kong(香港中文大学) SenseTime Research(商汤科技研究院)

AI总结 CP-Env通过可控医院环境评估大型语言模型在复杂临床路径中的表现,揭示其在决策和伦理方面的挑战,并推动医疗AI的发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10712 2025-12-15 cs.LG cs.AI

FuncGenFoil: Airfoil Generation and Editing Model in Function Space

FuncGenFoil:函数空间中的机翼生成与编辑模型

Jinouwen Zhang, Junjie Ren, Qianhong Ma, Jianyu Wu, Aobo Yang, Yan Lu, Lu Chen, Hairun Xie, Jing Wang, Miao Zhang, Wanli Ouyang, Shixiang Tang

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Fudan University(复旦大学) Hong Kong University of Science and Technology(香港科学与技术大学) The Chinese University of Hong Kong(香港中文大学) State Key Lab of CAD&CG, Zhejiang University(浙江大学CAD&CG国家重点实验室) Shanghai Aircraft Design and Research Institute(上海飞机设计与研究院) Innovation Academy for Microsatellites of CAS(中国科学院微卫星创新院) Shanghai Jiao Tong University(上海交通大学)

AI总结 FuncGenFoil通过函数空间建模实现机翼生成与编辑,提升生成精度与多样性,为高保真空气动力学设计提供新框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10863 2025-12-12 cs.CV cs.AI

MMSI-Video-Bench: A Holistic Benchmark for Video-Based Spatial Intelligence

MMSI-Video-Bench: 一个面向视频基于空间智能的综合基准

Jingli Lin, Runsen Xu, Shaohao Zhu, Sihan Yang, Peizhou Cao, Yunlong Ran, Miao Hu, Chenming Zhu, Yiman Xie, Yilin Long, Wenbo Hu, Dahua Lin, Tai Wang, Jiangmiao Pang

机构 * Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiaotong University(上海交通大学) The Chinese University of Hong Kong(香港中文大学) Zhejiang University(浙江大学) Beihang University(北京航空航天大学) Xi’an Jiaotong University(西安交通大学) University of Hong Kong(香港大学) Fudan University(复旦大学) University of California, Los Angeles(加州大学洛杉矶分校)

AI总结 MMSI-Video-Bench是一个综合评估视频基于空间智能的基准,通过多任务和多数据集评估25个MLLMs,揭示了人机推理差距和模型泛化不足的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10756 2025-12-12 cs.CL cs.LG

OPV: Outcome-based Process Verifier for Efficient Long Chain-of-Thought Verification

基于结果的过程验证器OPV用于高效长链式推理验证

Zijian Wu, Lingkai Kong, Wenwei Zhang, Songyang Gao, Yuzhe Gu, Zhongrui Cai, Tianyou Ma, Yuhong Liu, Zhi Wang, Runyuan Ma, Guangyu Wang, Wei Li, Conghui He, Dahua Lin, Kai Chen

机构 * Shanghai AI Laboratory(上海人工智能实验室) MMLab, The Chinese University of Hong Kong(香港中文大学机器学习实验室)

AI总结 OPV通过基于结果的过程验证方法,实现对长链式推理的高效准确验证,提升大规模注释效率并优于现有模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10382 2025-12-12 cs.SD

Investigating training objective for flow matching-based speech enhancement

研究流匹配基于的语音增强的训练目标

Liusha Yang, Ziru Ge, Gui Zhang, Junan Zhang, Zhizheng Wu

机构 * College of Big Data and Internet, Shenzhen Technology Universiy, China(大数据与互联网学院,深圳技术大学,中国) The Chinese University of Hong Kong, Shenzhen, China(香港中文大学(深圳))

AI总结 本文研究了流匹配在语音增强中的三种训练目标,通过引入感知和信号基于目标提升收敛效率和语音质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15365 2025-12-12 eess.SY cs.LG cs.MA cs.SY

TranSimHub:A Unified Air-Ground Simulation Platform for Multi-Modal Perception and Decision-Making

TranSimHub:一个多模态感知与决策的空地协同仿真平台

Maonan Wang, Yirong Chen, Yuxin Cai, Aoyu Pang, Yuejiao Xie, Zian Ma, Chengcheng Xu, Kemou Jiang, Ding Wang, Laurent Roullet, Chung Shue Chen, Zhiyong Cui, Yuheng Kan, Michael Lepech, Man-On Pun

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Shanghai AI Laboratory(上海人工智能实验室) Stanford University(斯坦福大学) Nanyang Technological University(南洋理工大学) SenseTime Group Ltd(商汤科技有限公司) Beihang University(北京航空航天大学) Nokia Bell Labs(诺基亚贝尔实验室)

AI总结 TranSimHub是一个用于空地协同智能的统一仿真平台,支持多模态感知与决策研究,提供同步渲染和可控场景编辑功能。

Comments 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00614 2025-12-12 cs.LG physics.chem-ph

RoFt-Mol: Benchmarking Robust Fine-Tuning with Molecular Graph Foundation Models

RoFt-Mol:基于分子图基础模型的鲁棒微调基准测试

Shikun Liu, Deyu Zou, Nima Shoghi, Victor Fung, Kai Liu, Pan Li

机构 * Georgia Institute of Technology(佐治亚理工学院) The Chinese University of Hong Kong(香港中文大学)

AI总结 RoFt-Mol通过结合简单权重插值与复杂权重集合微调方法,提升分子图基础模型在回归和分类任务中的鲁棒微调性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19486 2025-12-12 eess.SY cs.LG cs.MA cs.SY

VLMLight: Safety-Critical Traffic Signal Control via Vision-Language Meta-Control and Dual-Branch Reasoning Architecture

VLMLight:通过视觉-语言元控制与双分支推理架构实现安全关键的交通信号控制

Maonan Wang, Yirong Chen, Aoyu Pang, Yuxin Cai, Chung Shue Chen, Yuheng Kan, Man-On Pun

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Shanghai AI Laboratory(上海人工智能实验室) Nanyang Technological University(南洋理工大学) Nokia Bell Labs(诺基亚贝尔实验室) Fourier Intelligence(Fourier智能)

AI总结 VLMLight通过视觉-语言元控制与双分支推理架构,实现安全关键的交通信号控制,显著减少紧急车辆等待时间并提升系统安全性。

Comments 25 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏