BiEAR: A Human Auditory-Inspired Adaptive Binaural Front-end for Multi-Speaker Localisation and Distance Estimation
BiEAR: 一种受人类听觉启发的自适应双耳前端,用于多说话人定位和距离估计
Hanyu Meng, Eliathamby Ambikairajah, Vidhyasaharan Sethu, Qiquan Zhang, Haizhou Li
机构
*
The University of New South Wales(新南威尔士大学)
;
Tongyi Speech Lab, Alibaba Group(通义语音实验室,阿里巴巴集团)
;
School of Artificial Intelligence, The Chinese University of Hong Kong, Shenzhen(人工智能学院,香港中文大学(深圳))
机构
*
Shanghai Jiao Tong University(上海交通大学)
;
Xinjiang University(新疆大学)
;
University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
Independent Researcher(独立研究者)
;
The Chinese University of Hong Kong(香港中文大学)
Phonetic Error Analysis of Raw Waveform Acoustic Models
原始波形声学模型的音素错误分析
Erfan Loweimi, Zhengjun Yue, Andrea Carmantini, Zoran Cvetkovic, Steve Renals, Peter Bell
机构
*
Centre for Speech Technology Research (CSTR), University of Edinburgh, UK(语音技术研究中心(CSTR),爱丁堡大学,英国)
;
Cisco, UK(思科公司,英国)
;
SLAI & CUHK-SZ, China(SLAI与CUHK-SZ,中国)
;
King's College London, UK(伦敦国王学院,英国)
RASFT: Rollout-Adaptive Supervised Fine-Tuning for Reasoning
RASFT: 用于推理的滚动自适应监督微调
Yongliang Miao, Fengyuan Liu, Wei Shi, Yanguang Liu, Fei Sun, Na Zou, Mengnan Du
机构
*
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
New Jersey Institute of Technology(新泽西理工学院)
;
Institute of Computing Technology, CAS(中国科学院计算技术研究所)
机构
*
Shanghai Jiao Tong University(上海交通大学)
;
S-Lab, Nanyang Technological University(南洋理工大学S实验室)
;
Shanghai AI Laboratory(上海人工智能实验室)
;
University of Science and Technology of China(中国科学技术大学)
;
Stanford University(斯坦福大学)
;
Shanghai Innovation Institute(上海创新研究院)
;
The Chinese University of Hong Kong(香港中文大学)
;
Fudan University(复旦大学)
;
CPII under InnoHK(InnoHK下的CPII)
;
Adobe Research(Adobe研究)
IRAF: Interference-Resilient Adaptive Fusion for Noise-Robust End-to-End Full-Duplex Spoken Dialogue Systems
IRAF:面向噪声鲁棒的端到端全双工口语对话系统的抗干扰自适应融合
Tao Zhong, Jiajun Deng, Nikita Kuzmin, Yinke Zhu, Tianxiang Cao, Tristan Tsoi, Zhili Tan, Simon Lui, Xunying Liu
机构
*
The Chinese University of Hong Kong(香港中文大学)
;
AudioLab Hong Kong, Huawei Leibniz Research Center(香港AudioLab,华为Leibniz研究中心)
;
Nanyang Technological University(南洋理工大学)
M2S-AVSR: Modality-aware Multi-view Self-supervised Representation for Robust Audio-Visual Speech Recognition
M2S-AVSR:面向鲁棒视听语音识别的模态感知多视角自监督表示
Fei Su, Cancan Li, Ming Li, Juan Liu
机构
*
School of Artificial Intelligence and the School of Computer Science, Wuhan University, China(人工智能学院和计算机科学学院,武汉大学,中国)
;
School of Artificial Intelligence, The Chinese University of Hong Kong, Shenzhen, China(人工智能学院,香港中文大学(深圳),中国)
;
School of Artificial Intelligence, Wuhan University, China(人工智能学院,武汉大学,中国)
SubtleMemory: A Benchmark for Fine-Grained Relational Memory Discrimination in Long-Horizon AI Agents
SubtleMemory: 面向长时程AI智能体的细粒度关系记忆辨别基准
Wenxuan Wang, Haoyu Sun, Fukuan Hou, Mingyang Song, Weinan Zhang, Yu Cheng, Yang Yang
机构
*
Harbin Institute of Technology(哈尔滨工业大学)
;
Shanghai AI Laboratory(上海人工智能实验室)
;
Tongji University(同济大学)
;
Xiamen University(厦门大学)
;
Fudan University(复旦大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
The Chinese University of Hong Kong(香港中文大学)
Agent Planning Benchmark: A Diagnostic Framework for Planning Capabilities in LLM Agents
Agent规划基准:LLM Agent规划能力的诊断框架
Haoyu Sun, Wenxuan Wang, Mingyang Song, Jujie He, Weinan Zhang, Yang Liu, Yang Yang, Yu Cheng
机构
*
Tongji University(同济大学)
;
Shanghai AI Laboratory(上海人工智能实验室)
;
Harbin Institute of Technology(哈尔滨工业大学)
;
Fudan University(复旦大学)
;
Skywork AI
;
University of California, Santa Cruz(加州大学圣克鲁兹分校)
;
Shanghai Jiao Tong University(上海交通大学)
;
The Chinese University of Hong Kong(香港中文大学)
Towards On-Policy Data Evolution for Visual-Native Multimodal Deep Search Agents
面向视觉原生多模态深度搜索智能体的在策略数据演化
Shijue Huang, Hangyu Guo, Guanting Dong, Chenxin Li, Junting Lu, Xinyu Geng, Zhaochen Su, Zhenyu Li, Shuang Chen, Hongru Wang, Yi R. Fung
机构
*
Hong Kong University of Science and Technology(香港理工大学)
;
Renmin University of China(中国人民大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
Peking University(北京大学)
;
Tsinghua University(清华大学)
;
University of Edinburgh(爱丁堡大学)
InvEvolve: Evolving White-Box Inventory Policies via Large Language Models with Performance Guarantees
InvEvolve:通过具有性能保证的大语言模型进化白盒库存策略
Chenyu Huang, Jianghao Lin, Zhengyang Tang, Bo Jiang, Ruoqing Jiang, Benyou Wang, Lai Wei
机构
*
Shanghai University of Finance and Economics(上海财经大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
;
Tsinghua University(清华大学)
;
Boston College(波士顿大学)
机构
*
National University of Singapore(国立新加坡大学)
;
Fudan University(复旦大学)
;
Tsinghua University(清华大学)
;
Zhejiang University(浙江大学)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
Renmin University of China(中国人民大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
The Hong Kong University of Science and Technology(香港科技大学)
;
DeepWisdom(深智科技)
;
Nanjing University(南京大学)
;
Shanghai Jiatong University(上海交通大学)
;
Nanyang Technological University(南洋理工大学)
;
Tencent Hunyuan(腾讯文深)
;
QuantaAlpha(量子阿尔法)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Zhejiang Lab(浙江实验室)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
Sun Yat-sen University(中山大学)
机构
*
University of California, Berkeley(加州大学伯克利分校)
;
The Chinese University of Hong Kong(香港中文大学)
;
New York University(纽约大学)
;
The University of Hong Kong(香港大学)
Privacy Implies Stability: Information-Theoretic Generalization Bounds for Quantum Learning
隐私蕴含稳定性:量子学习的信息论泛化界
Ayanava Dasgupta, Naqueeb Ahmad Warsi, Masahito Hayashi
机构
*
Indian Statistical Institute, Kolkata(印度统计研究院,科希玛)
;
School of Data Science, The Chinese University of Hong Kong, Shenzhen(香港中文大学深圳校区数据科学学院)
;
International Quantum Academy, Futian District, Shenzhen(深圳未来科技学院)
;
Graduate School of Mathematics, Nagoya University(名古屋大学数学研究生院)
Comments36 pages, 3 figures; The introduction has been substantially rewritten to provide better context, and certain proofs have been relocated from the appendices to the main body of the paper; The core mathematical framework and technical results remain unchanged
机构
*
Brain and Mind institute, The Chinese University of Hong Kong(脑科学与智能技术研究所,香港中文大学)
;
Department of Linguistics and Modern Languages, The Chinese University of Hong Kong(语言学与现代语言系,香港中文大学)
;
Division of Otolaryngology, Ann & Robert H. Lurie Children's Hospital of Chicago(芝加哥安·罗伯特·H·卢里儿童医院耳鼻喉科)
;
Department of Otolaryngology Head & Neck Surgery, Feinberg School of Medicine, Northwestern University(费因伯格医学院耳鼻喉科与头颈外科部,西北大学)
;
Knowles Hearing Center, Department of Communication Sciences and Disorders, Northwestern University(诺里斯听力中心,西北大学沟通科学与障碍系)