MagicWorld: Towards Long-Horizon Stability for Interactive Video World Exploration
MagicWorld: 向交互视频世界探索的长时稳定迈进
Guangyuan Li, Bo Li, Jinwei Chen, Xiaobin Hu, Lei Zhao, Peng-Tao Jiang
机构
*
College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)
;
vivo BlueImage Lab, vivo Mobile Communication Co., Ltd.(vivo蓝影实验室,vivo移动通信有限公司)
;
National University of Singapore(新加坡国立大学)
HyperMotionX: The Dataset and Benchmark with DiT-Based Pose-Guided Human Image Animation of Complex Motions
HyperMotionX:基于DiT的Pose引导人体图像动画的Dataset和Benchmark
Shuolin Xu, Siming Zheng, Ziyi Wang, HC Yu, Jinwei Chen, Huaqi Zhang, Daquan Zhou, Tong-Yee Lee, Bo Li, Peng-Tao Jiang
机构
*
Bournemouth University(伯恩茅斯大学)
;
vivo BlueImage Lab, vivo Mobile Communication Co., Ltd(vivo 蓝影实验室,vivo 通信有限公司)
;
Peking University(北京大学)
;
National Cheng-Kung University(国立成功大学)
EditHF-1M: A Million-Scale Rich Human Preference Feedback for Image Editing
EditHF-1M: 一个百万级的丰富人类偏好反馈用于图像编辑
Zitong Xu, Huiyu Duan, Zhongpeng Ji, Xinyun Zhang, Yutao Liu, Xiongkuo Min, Ke Gu, Jian Zhang, Shusong Xu, Jinwei Chen, Bo Li, Guangtao Zhai
机构
*
Shanghai Jiao Tong University(上海交通大学)
;
Vivo Mobile Communication Co., Ltd(vivo移动通信有限公司)
;
University of Electronic and Science Technology of China(电子科技大学)
;
Ocean University of China(海洋大学)
;
Beijing University of Technology(北京理工大学)
AuthFace: Towards Authentic Blind Face Restoration with Face-oriented Generative Diffusion Prior
AuthFace: 向真实盲脸修复迈进的面向面部生成扩散先验
Guoqiang Liang, Qingnan Fan, Bingtao Fu, Jinwei Chen, Hong Gu, Lin Wang
机构
*
Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
vivo Mobile Communication Co., Ltd(vivo移动通信有限公司)
;
Nanyang Technological University(南洋理工大学)
VideoChat-M1: Collaborative Policy Planning for Video Understanding via Multi-Agent Reinforcement Learning
VideoChat-M1: 通过多智能体强化学习实现视频理解的协作策略规划
Boyu Chen, Zikang Wang, Zhengrong Yue, Kainan Yan, Chenyun Yu, Yi Huang, Zijun Liu, Yafei Wen, Xiaoxin Chen, Yang Liu, Peng Li, Yali Wang
机构
*
Shenzhen Key Lab of Computer Vision and Pattern Recognition(深圳计算机视觉与模式识别重点实验室)
;
Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
VIVO AI Lab(VIVO人工智能实验室)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
Shenzhen Campus of Sun Yat-sen University(孙逸仙大学深圳校区)
;
Shanghai Jiao Tong University(上海交通大学)
;
Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院)
;
Dept. of Comp. Sci. & Tech., Institute for AI, Tsinghua University(清华大学计算机科学与技术系,人工智能研究院)
BeautyGRPO: Aesthetic Alignment for Face Retouching via Dynamic Path Guidance and Fine-Grained Preference Modeling
BeautyGRPO: 通过动态路径引导和细粒度偏好建模实现面部修饰的美观对齐
Jiachen Yang, Xianhui Lin, Yi Dong, Zebiao Zheng, Xing Liu, Hong Gu, Yanmei Fang
机构
*
School of Cyber Science and Technology, Shenzhen Campus of Sun Yat-sen University, China(中山大学计算机科学与技术学院,深圳校区)
;
vivo BlueImage Lab, vivo Mobile Communication Co., Ltd., China(vivo蓝影实验室,vivo移动通信有限公司)
UI-Mem: Self-Evolving Experience Memory for Online Reinforcement Learning in Mobile GUI Agents
UI-Mem: 为移动GUI代理在线强化学习中的自演化经验记忆
Han Xiao, Guozhi Wang, Hao Wang, Shilong Liu, Yuxiang Chai, Yue Pan, Yufeng Zhou, Xiaoxin Chen, Yafei Wen, Hongsheng Li
机构
*
Multimedia Laboratory (MMLab), The Chinese University of Hong Kong(香港中文大学多媒体实验室)
;
Shenzhen Loop Area Institute(深圳河套学院)
;
Shanghai AI Lab(上海人工智能实验室)
;
vivo AI Lab(vivo人工智能实验室)
;
Princeton University(普林斯顿大学)
Bi-directional Bias Attribution: Debiasing Large Language Models without Modifying Prompts
双向偏见归因:无需修改提示的大型语言模型去偏方法
Yujie Lin, Kunquan Li, Yixuan Liao, Xiaoxin Chen, Jinsong Su
机构
*
School of Informatics, Xiamen University, China(厦门大学信息学院)
;
vivo AI Lab, China(vivo AI实验室)
;
Key Laboratory of Digital Protection and Intelligent Processing of Intangible Cultural Heritage of Fujian and Taiwan (Xiamen University), Ministry of Culture and Tourism, China(福建省和台湾非物质文化遗产数字化保护与智能处理重点实验室(厦门大学),文化部,中国)
OptiSQL: Executable SQL Generation from Optical Tokens
OptiSQL: 从光学令牌生成可执行SQL
Sifan Li, Hongkai Chen, Yujun Cai, Liyang Chen, Qingwen Ye, Yiwei Wang
机构
*
University of California, Merced(加州大学默塞德分校)
;
vivo Mobile Communication Co., Ltd.(vivo移动通信有限公司)
;
University of Queensland(昆士兰大学)
;
University of California, Los Angeles(加州大学洛杉矶分校)
Detecting and Mitigating Insertion Hallucination in Video-to-Audio Generation
检测并缓解视频到音频生成中的插入幻觉
Liyang Chen, Hongkai Chen, Yujun Cai, Sifan Li, Qingwen Ye, Yiwei Wang
机构
*
University of California, Los Angeles(加州大学洛杉矶分校)
;
The University of Queensland(昆士兰大学)
;
vivo Mobile Communication Co., Ltd.(vivo移动通信有限公司)
;
University of California, Merced(加州大学默塞德分校)
RealHiTBench: A Comprehensive Realistic Hierarchical Table Benchmark for Evaluating LLM-Based Table Analysis
RealHiTBench: 一个全面的现实感分层表格基准,用于评估基于LLM的表格分析
Pengzuo Wu, Yuhang Yang, Guangcheng Zhu, Chao Ye, Hong Gu, Xu Lu, Ruixuan Xiao, Bowen Bao, Yijing He, Liangyu Zha, Wentao Ye, Junbo Zhao, Haobo Wang
机构
*
Zhejiang University(浙江大学)
;
vivo Mobile Communication Co., Ltd(vivo移动通信有限公司)
;
Institute of Computing Innovation, Zhejiang University(浙江大学计算机创新研究院)
机构
*
Shanghai Engineering Research Center of AI & Robotics, Academy for Engineering & Technology, Fudan University, Shanghai 200433, China(上海人工智能与机器人工程研究中心,工程与技术学院,复旦大学,上海)
;
Engineering Research Center of Robotics, Ministry of Education, Academy for Engineering & Technology, Fudan University, Shanghai 200433, China(机器人工程研究中心,教育部,工程与技术学院,复旦大学,上海)
;
Youtu Lab, Tencent, Shanghai 200000, China(优衣库实验室,腾讯,上海)
;
vivo Mobile Communication Co., Ltd, Shanghai 200120, China(vivo移动通信有限公司,上海)
;
Shanghai Key Lab of Intelligent Information Processing, School of Computer Science, Fudan University, Shanghai 200433, China(上海智能信息处理重点实验室,计算机科学学院,复旦大学,上海)
UniPixel: Unified Object Referring and Segmentation for Pixel-Level Visual Reasoning
Ye Liu, Zongyang Ma, Junfu Pu, Zhongang Qi, Yang Wu, Ying Shan, Chang Wen Chen
机构
*
The Hong Kong Polytechnic University(香港理工大学)
;
ARC Lab, Tencent PCG(腾讯PCG ARC实验室)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
vivo Mobile Communication Co.(vivo移动通信公司)
;
MindWingman Technology (Shenzhen) Co., Ltd.(深圳MindWingman技术有限公司)