Controllable Spoken Dialogue Generation: An LLM-Driven Grading System for K-12 Non-Native English Learners
可控的口语对话生成:一种基于LLM的评分系统用于K-12非母语英语学习者
Haidong Yuan, Haokun Zhao, Wanshi Xu, Songjun Cao, Qingyu Zhou, Long Ma, Hongjie Fan
机构
*
Peking University(北京大学)
;
Tencent(腾讯)
;
China University of Political Science and Law(中国政法大学)
;
Independent Researcher(独立研究者)
;
Fudan University(复旦大学)
View-Consistent 3D Scene Editing via Dual-Path Structural Correspondense and Semantic Continuity
通过双路径结构对应和语义连续性实现视图一致的3D场景编辑
Pufan Li, Bi'an Du, Shenghe Zheng, Junyi Yao, Wei Hu
机构
*
Wangxuan Institute of Computer Technology, Peking University(北京大学王萱计算机技术研究所)
;
Department of Computer Science and Engineering, The Hong Kong University of Science and Technology(香港科技大学计算机科学与工程系)
机构
*
State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,BIGAI)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Peking University(北京大学)
;
Beijing Institute of Technology(北京理工大学)
;
Tsinghua University(清华大学)
机构
*
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Beijing Key Laboratory of Network System and Network Culture(北京网络系统与网络文化重点实验室)
;
Peking University Third Hospital(北京大学第三医院)
Principled Evaluation with Human Labels: One Rater at a Time and Rater Equivalence
基于人类标签的原理性评估:逐个评估者与评估者等价性
Paul Resnick, Yuqing Kong, Grant Schoenebeck, Tim Weninger
机构
*
School of Information, University of Michigan(信息学院,密歇根大学)
;
Center on Frontiers of Computing Studies, Peking University(前沿计算研究中心,北京大学)
;
Department of Computer Science and Engineering, University of Notre Dame(计算机科学与工程系,诺特丹大学)
机构
*
Guanghua School of Management, Peking University(北京大学光华管理学院)
;
Department of Industrial Engineering and Decision Analytics, The Hong Kong University of Science and Technology(香港科技大学工业工程与决策分析系)
AdaTracker: Learning Adaptive In-Context Policy for Cross-Embodiment Active Visual Tracking
AdaTracker: 一种用于跨躯体主动视觉跟踪的自适应上下文策略学习方法
Kui Wu, Hao Chen, Jinzhu Han, Haijun Liu, Churan Wang, Yizhou Wang, Zhoujun Li, Si Liu, Fangwei Zhong
机构
*
Beihang University(北京航空航天大学)
;
City University of Macau(澳门城市大学)
;
School of Artificial Intelligence, Beijing Normal University(北京师范大学人工智能学院)
;
Minzu University of China(民族大学)
;
Center for Data Science in Clinical Medicine, Peking University Third Hospital(北京大学第三医院数据科学临床医学中心)
;
School of Computer Science, Peking University(北京大学计算机学院)
机构
*
School of Mathematical Science, Peking University(北京大学数学科学学院)
;
State Key Laboratory of Mathematical Sciences, Institute of Computational Mathematics and Scientific/Engineering Computing, Academy of Mathematics and Systems Science, Chinese Academy of Sciences(中国科学院数学与系统科学研究院数学科学国家重点实验室)
;
Beijing International Center for Mathematical Research, Peking University(北京大学北京国际数学研究中心)
机构
*
Eastern Institute of Technology(东部技术研究所)
;
Hong Kong Polytechnic University(香港理工大学)
;
Peking University(北京大学)
;
Commonwealth Scientific and Industrial Research Organization(澳大利亚联邦科学与工业研究组织)
;
University of Hong Kong(香港大学)
OmniUMI: Towards Physically Grounded Robot Learning via Human-Aligned Multimodal Interaction
OmniUMI: 通过人对齐的多模态交互实现物理基础的机器人学习
Shaqi Luo, Yuanyuan Li, Youhao Hu, Chenhao Yu, Chaoran Xu, Jiachen Zhang, Guocai Yao, Tiejun Huang, Ran He, Zhongyuan Wang
机构
*
Beijing Academy of Artificial Intelligence(北京人工智能研究院)
;
MAIS & NLPR, Institute of Automation, Chinese Academy of Sciences(自动化研究所,中国科学院)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
Beijing Institute of Technology(北京理工大学)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Peking University(北京大学)
Towards Reliable Human Evaluations in Gesture Generation: Insights from a Community-Driven State-of-the-Art Benchmark
迈向可靠的 gesture 生成人类评估:来自社区驱动的最新基准的见解
Rajmund Nagy, Hendric Voss, Thanh Hoang-Minh, Mihail Tsakov, Teodor Nikolov, Zeyi Zhang, Tenglong Ao, Sicheng Yang, Shaoli Huang, Yongkang Cheng, M. Hamza Mughal, Rishabh Dabral, Kiran Chhatre, Christian Theobalt, Libin Liu, Stefan Kopp, Rachel McDonnell, Michael Neff, Taras Kucherenko, Youngwoo Yoon, Gustav Eje Henter
机构
*
KTH Royal Institute of Technology(皇家理工学院)
;
Bielefeld University(比勒菲尔德大学)
;
University of Science – VNUHCM(越南胡志明市国家大学)
;
Independent Researcher(独立研究者)
;
Motorica AB(Motorica AB公司)
;
Peking University(北京大学)
;
Tsinghua University(清华大学)
;
Astribot(Astribot公司)
;
Max-Planck Institute for Informatics, SIC(马克斯·普朗克信息研究所,SIC)
;
Trinity College Dublin(都柏林大学)
;
University of California, Davis(加州大学戴维斯分校)
;
SEED – Electronic Arts(SEED–电子艺界)
;
Electronics and Telecommunications Research Institute (ETRI)(电子电信研究院)
Enhancing Agentic Textual Graph Retrieval with Synthetic Stepwise Supervision
通过合成的分步监督增强代理文本图检索
Ge Chang, Jinbo Su, Jiacheng Liu, Pengfei Yang, Yuhao Shang, Huiwen Zheng, Hongli Ma, Yan Liang, Yuanchun Li, Yunxin Liu
机构
*
Institute for AI Industry Research (AIR), Tsinghua University(人工智能产业研究院(AIR),清华大学)
;
Peking University(北京大学)
;
School of Information, Renmin University of China(中国人民大学信息学院)
;
Harbin Institute of Technology(哈尔滨工业大学)
;
North China Electric Power University(华北电力大学)
;
GDS Holdings Limited(GDS控股有限公司)
AdaMMS: Model Merging for Heterogeneous Multimodal Large Language Models with Unsupervised Coefficient Optimization
AdaMMS: 为异构多模态大语言模型设计的模型融合方法
Yiyang Du, Xiaochen Wang, Chi Chen, Jiabo Ye, Yiru Wang, Peng Li, Ming Yan, Ji Zhang, Fei Huang, Zhifang Sui, Maosong Sun, Yang Liu
机构
*
Dept. of Comp. Sci. & Tech., Institute for AI, Tsinghua University(计算机科学与技术系,人工智能研究院,清华大学)
;
Institute for AI Industry Research (AIR), Tsinghua University(人工智能产业研究院(AIR),清华大学)
;
State Key Laboratory of Multimedia Information Processing, Peking University(多媒体信息处理国家重点实验室,北京大学)
;
School of Software Microelectronics, Peking University(软件微电子学院,北京大学)
;
Institute of Intelligent Computing, Alibaba Group(智能计算研究院,阿里巴巴集团)
;
Shanghai Artificial Intelligence Laboratory, Shanghai, China(上海人工智能实验室,上海,中国)
;
Jiangsu Collaborative Innovation Center for Language Competence, Jiangsu, China(江苏省语言能力协同创新中心,江苏,中国)
;
ModelTC Open Source Organization, Beijing, China(ModelTC开源组织,北京,中国)
机构
*
Zhejiang University(浙江大学)
;
Peking University(北京大学)
;
Megvii(科大讯飞)
;
Om AI Research(Om人工智能研究院)
;
Binjiang Research Institute of Zhejiang University(浙江大学滨江研究院)
机构
*
Peking University, Beijing, China
;
State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University
;
Beijing Academy of Artificial Intelligence, Beijing, China
;
National University of Singapore, Singapore
;
The Hong Kong University of Science
;
Nanjing University, Nanjing, China
AI总结
本文提出Mask World Model,通过预测语义遮罩而非像素,提升机器人策略学习的鲁棒性与泛化能力,实验证明其在仿真和现实任务中均优于现有方法。
机构
*
School of Computer Science, Peking University(北京大学计算机科学系)
;
Tongyi Lab, Alibaba Group(阿里集团通义实验室)
;
School of Computer Science, Wuhan University(武汉大学计算机科学系)