arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Shanghai Jiao Tong University(上海交通大学)

共收录 3178
2601.19726 2026-01-28 cs.CR cs.AI cs.CL

RvB: Automating AI System Hardening via Iterative Red-Blue Games

RvB: 通过迭代红蓝游戏自动化AI系统加固

Lige Huang, Zicheng Liu, Jie Zhang, Lewen Yan, Dongrui Liu, Jing Shao

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) Shanghai Jiao Tong University(上海交通大学)

AI总结 RvB通过迭代红蓝游戏自动化AI系统加固,有效提升防御性能并降低误报率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19613 2026-01-28 cs.CL cs.AI

Up to 36x Speedup: Mask-based Parallel Inference Paradigm for Key Information Extraction in MLLMs

最高36倍提速:面向MLLMs关键信息提取的基于掩码的并行推断范式

Xinzhong Wang, Ya Guo, Jing Li, Huan Chen, Yi Tu, Yijie Hong, Gongshen Liu, Huijia Zhu

机构 * Shanghai Jiao Tong University(上海交通大学) Ant Info Security Lab, Ant Group(蚂蚁集团信息安全部实验室) Inner Mongolia Research Institute, Shanghai Jiao Tong University(内蒙古研究院,上海交通大学)

AI总结 本文提出基于掩码的并行推断范式,通过并行生成提升MLLMs关键信息提取的效率,实现最高36倍的提速。

Comments Accepted by ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19552 2026-01-28 hep-lat cs.LG

Generalizable Equivariant Diffusion Models for Non-Abelian Lattice Gauge Theory

可推广的非阿贝尔晶格规范理论等价扩散模型

Gert Aarts, Diaa E. Habibi, Andreas Ipp, David I. Müller, Thomas R. Ranner, Lingxiao Wang, Wei Wang, Qianteng Zhu

机构 * Centre for Quantum Fields and Gravity, Department of Physics, Swansea University(量子场与引力中心,物理系,萨瑟兰大学) Institute for Theoretical Physics, TU Wien(理论物理研究所,维也纳技术大学) RIKEN Center for Interdisciplinary Theoretical and Mathematical Sciences (iTHEMS)(理化学研究所跨学科理论和数学科学中心(iTHEMS)) Institute for Physics of Intelligence, Graduate School of Science, The University of Tokyo(智能物理研究所,科学研究生院,东京大学) State Key Laboratory of Dark Matter Physics, Key Laboratory for Particle Astrophysics and Cosmology (MOE), Shanghai Key Laboratory for Particle Physics and Cosmology, Shanghai Jiao Tong University(暗物质物理国家重点实验室,粒子天体物理与宇宙学重点实验室(MOE),粒子物理与宇宙学上海重点实验室,上海交通大学) Southern Center for Nuclear-Science Theory (SCNT), Institute of Modern Physics, Chinese Academy of Sciences(南方核科学理论中心(SCNT),现代物理研究所,中国科学院)

AI总结 本文提出了一种可推广的非阿贝尔晶格规范理论等价扩散模型,利用MAALA算法在不同规模和耦合条件下保持高精度和接受率。

Comments 9 pages, 5 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19541 2026-01-28 cs.LG cs.CE

GenCP: Towards Generative Modeling Paradigm of Coupled Physics

GenCP:面向耦合物理的生成建模范式

Tianrun Gao, Haoren Zheng, Wenhao Deng, Haodong Feng, Tao Zhang, Ruiqi Feng, Qianyi Chen, Tailin Wu

机构 * School of Engineering, Westlake University(西lake大学工程学院) Department of Geotechnical Engineering, Tongji University(同济大学地质工程系) Global College, Shanghai Jiao Tong University(上海交通大学全球学院) State Key Laboratory of Advanced Nuclear Energy Technology, Nuclear Power Institute of China(中国核能技术研究院先进核能技术重点实验室)

AI总结 GenCP提出一种新颖的生成范式,通过概率建模与迭代多物理耦合结合,实现对耦合多物理场模拟的高效建模与推断。

Comments ICLR 2026 Accpeted

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19533 2026-01-28 cs.SD cs.AI

SLM-SS: Speech Language Model for Generative Speech Separation

SLM-SS:用于生成式语音分离的语音语言模型

Tianhua Li, Chenda Li, Wei Wang, Xin Zhou, Xihui Chen, Jianqing Gao, Yanmin Qian

机构 * Auditory Cognition and Computational Acoustics Lab(听觉认知与计算声学实验室) MoE Key Lab of Artificial Intelligence, AI Institute(人工智能MoE重点实验室,AI研究院) School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) VUI Labs(VUI实验室) AI research Institute, iFLYTEK Company Limited(AI研究院,iFLYTEK公司)

AI总结 SLM-SS通过应用语音语言模型提升生成式语音分离的语音可懂度和连贯性,实验显示其在语音可懂度和下游任务表现上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19325 2026-01-28 cs.CV cs.AI

Innovator-VL: A Multimodal Large Language Model for Scientific Discovery

Innovator-VL:一种用于科学发现的多模态大语言模型

Zichen Wen, Boxue Yang, Shuang Chen, Yaojie Zhang, Yuhang Han, Junlong Ke, Cong Wang, Yicheng Fu, Jiawang Zhao, Jiangchao Yao, Xi Fang, Zhen Wang, Henxing Cai, Lin Yao, Zhifeng Gao, Yanhui Hong, Nang Yuan, Yixuan Li, Guojiang Zhao, Haoyi Tao, Nan Wang, Han Lyu, Guolin Ke, Ning Liao, Xiaoxing Wang, Kai Chen, Zhiyu Li, Feiyu Xiong, Sihan Hu, Kun Chen, Yanfeng Wang, Weinan E, Linfeng Zhang, Linfeng Zhang

机构 * School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院) Institute of Theoretical Physics, Chinese Academy of Sciences(中国科学院理论物理研究所)

AI总结 Innovator-VL通过高效数据选择和透明训练方法,在科学发现中实现高性能多模态模型。

Comments Innovator-VL tech report

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18192 2026-01-28 cs.CV cs.HC cs.MM

MindCine: Multimodal EEG-to-Video Reconstruction with Large-Scale Pretrained Models

MindCine: 基于大规模预训练模型的多模态EEG到视频重建

Tian-Yi Zhou, Xuan-Hao Liu, Bao-Liang Lu, Wei-Long Zheng

机构 * School of Computer Science, Shanghai Jiao Tong University, 800 Dongchuan Road, Shanghai, China(计算机科学学院,上海交通大学)

AI总结 MindCine通过多模态联合学习和预训练大型EEG模型,实现有限数据下的高保真EEG到视频重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17171 2026-01-28 cs.CV

Generation then Reconstruction: Accelerating Masked Autoregressive Models via Two-Stage Sampling

生成然后重建:通过两阶段采样加速遮蔽自回归模型

Feihong Yan, Peiru Wang, Yao Zhu, Kaiyu Pang, Qingyan Wei, Huiqi Li, Linfeng Zhang

机构 * Beijing Institute of Technology(北京理工大学) EPIC Lab, SJTU(上海交通大学EPIC实验室) Tsinghua University(清华大学)

AI总结 GtR通过两阶段采样加速遮蔽自回归模型,实现3.72倍速度提升并保持高质量生成。

Comments 12 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15600 2026-01-28 cs.AI cs.CL

Unleashing Scientific Reasoning for Bio-experimental Protocol Generation via Structured Component-based Reward Mechanism

通过结构化组件奖励机制解锁生物实验协议生成中的科学推理

Haoran Sun, Yankai Jiang, Zhenyu Tang, Yaning Pan, Shuang Gu, Zekai Lin, Lilong Wang, Wenjie Lou, Lei Liu, Lei Bai, Xiaosong Wang

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Fudan University(复旦大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 通过结构化组件奖励机制,Thoth在多个基准测试中超越了现有LLMs,实现了更准确的生物实验协议生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11027 2026-01-28 cs.CV

Vlaser: Vision-Language-Action Model with Synergistic Embodied Reasoning

Vlaser:具有协同具身推理能力的视觉-语言-动作模型

Ganlin Yang, Tianyi Zhang, Haoran Hao, Weiyun Wang, Yibin Liu, Dehui Wang, Guanzhou Chen, Zijian Cai, Junting Chen, Weijie Su, Wengang Zhou, Yu Qiao, Jifeng Dai, Jiangmiao Pang, Gen Luo, Wenhai Wang, Yao Mu, Zhi Hou

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学) Nanjing University(南京大学) Fudan University(复旦大学) Tsinghua University(清华大学) NUS(新加坡国立大学) Northeastern University(东北大学) Shenzhen University(深圳大学)

AI总结 Vlaser通过整合高级推理与低级控制,解决了具身推理与VLA策略学习之间的关键差距,在多个基准测试中取得最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11001 2026-01-28 cs.CL cs.AI

DND: Boosting Large Language Models with Dynamic Nested Depth

DND: 通过动态嵌套深度提升大语言模型

Tieyuan Chen, Xiaodong Chen, Haoxing Chen, Zhenzhong Lan, Weiyao Lin, Jianguo Li

机构 * Shanghai Jiao Tong University(上海交通大学) ZhongguanCun Academy(中关村学院) Renmin University of China(中国人民大学) Westlake University(西湖大学)

AI总结 DND通过动态嵌套深度机制提升大语言模型性能,通过路由和阈值控制策略优化令牌选择,显著提升密集和MoE模型表现。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20772 2026-01-28 cs.AI cs.LG

Damper-B-PINN: Damper Characteristics-Based Bayesian Physics-Informed Neural Network for Vehicle State Estimation

基于阻尼特性的人工神经网络:用于车辆状态估计的贝叶斯物理信息神经网络

Tianyi Zeng, Tianyi Wang, Zimo Zeng, Feiyang Zhang, Jiseop Byeon, Yujin Wang, Yajie Zou, Yangyang Wang, Junfeng Jiao, Christian Claudel, Xinbo Chen

机构 * School of Automation and Intelligent Sensing, Shanghai Jiao Tong University, Shanghai 200240, China(上海交通大学自动化与智能感知学院) Department of Civil, Architectural, and Environmental Engineering, The University of Texas at Austin(德克萨斯大学奥斯汀分校土木、建筑与环境工程系) College of Electrical Engineering, Zhejiang University(浙江大学电气工程学院) School of Automotive Studies, Tongji University(同济大学汽车学院) Key Laboratory of Road and Traffic Engineering of Ministry of Education, Tongji University(同济大学交通工程教育部长三角交通工程重点实验室) School of Architecture, The University of Texas at Austin(德克萨斯大学奥斯汀分校建筑系)

AI总结 本文提出基于阻尼特性的贝叶斯物理信息神经网络,用于提高车辆动态车轮载荷估计的精度和鲁棒性。

Comments 8 pages, 8 figures, 3 tables, accepted for IEEE Intelligent Vehicles (IV) Symposium 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13126 2026-01-28 eess.IV cs.CV

Knowledge-enhanced Pretraining for Vision-language Pathology Foundation Model on Cancer Diagnosis

基于知识增强的视觉语言病理基础模型用于癌症诊断

Xiao Zhou, Luoyi Sun, Dexuan He, Wenbin Guan, Ge Wang, Ruifen Wang, Lifeng Wang, Xiaojun Yuan, Xin Sun, Ya Zhang, Kun Sun, Yanfeng Wang, Weidi Xie

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) Xinhua Hospital Affiliated to Shanghai Jiao Tong University School of Medicine(上海交通大学医学院附属新华医院) School of Artificial Intelligence(人工智能学院) Department of Pathology(病理学部) Department of Oral Pathology(口腔病理学部) Department of Pediatric Hematology/Oncology(儿科血液肿瘤科) Clinical Research and Innovation Unit(临床研究与创新单元) Department of Pediatric Cardiology(儿童心脏病科)

AI总结 本文提出KEEP模型,通过整合疾病知识图谱提升癌症诊断的视觉语言基础模型性能,显著优于现有方法。

Comments V2: fixed typos, updated experimental results, added ablation

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.01035 2026-01-28 cs.CL cs.CV cs.LG

Task-Specific Directions: Definition, Exploration, and Utilization in Parameter Efficient Fine-Tuning

任务特定方向:在参数高效微调中的定义、探索与利用

Chongjie Si, Zhiyi Shi, Shifan Zhang, Xiaokang Yang, Hanspeter Pfister, Wei Shen

机构 * MoE Key Lab of Artificial Intelligence, AI Institute, Shanghai Jiao Tong University(人工智能基础理论实验室,人工智能研究院,上海交通大学) School of Electronic Information and Electrical Engineering, Shanghai Jiao Tong University(电子信息与电气工程学院,上海交通大学) School of Engineering and Applied Sciences, Harvard University(工程与应用科学学院,哈佛大学)

AI总结 本文提出LoRA-TSD,通过任务特定方向优化LoRA初始化和微调,提升模型在目标任务上的性能。

Comments 2026, TPAMI, Codes in https://github.com/Chongjie-Si/Subspace-Tuning

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18733 2026-01-27 cs.RO cs.AI cs.CV

Advances and Innovations in the Multi-Agent Robotic System (MARS) Challenge

多智能体机器人系统(MARS)挑战的进展与创新

Li Kang, Heng Zhou, Xiufeng Song, Rui Li, Bruno N. Y. Chen, Ziye Wang, Ximeng Meng, Stone Tao, Yiran Qin, Xiaohong Liu, Ruimao Zhang, Lei Bai, Yilun Du, Hao Su, Philip Torr, Zhenfei Yin, Ruihao Gong, Yejun Zeng, Fengjun Zhong, Shenghao Jin, Jinyang Guo, Xianglong Liu, Xiaojun Jia, Tianqi Shan, Wenqi Ren, Simeng Qin, Jialing Yang, Xiaoyu Ma, Tianxing Chen, Zixuan Li, Zijian Cai, Yan Qin, Yusen Qin, Qiangyu Chen, Kaixuan Wang, Zhaoming Han, Yao Mu, Ping Luo, Yuanqi Yao, Haoming Song, Jan-Nico Zaech, Fabien Despinoy, Danda Pani Paudel, Luc Van Gool

机构 * SJTU(上海交通大学) Oxford(牛津大学) USTC(中国科学技术大学) Shanghai AI Lab(上海人工智能实验室) CMU(卡内基梅隆大学) HKU(香港大学) Tongji(同济大学) UC San Diego(南加州大学) CUHK-SZ(香港中文大学(深圳)) SYSU(华南理工大学) Harvard(哈佛大学)

AI总结 MARS挑战通过多智能体具身规划与控制任务,推动多智能体协作AI系统的发展。

Comments MARS Challenge @ NeurIPS 2025 Workshop on Space in Vision, Language, and Embodied AI. Challenge page: https://mars-eai.github.io/MARS-Challenge-Webpage/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18629 2026-01-27 cs.RO

ExoGS: A 4D Real-to-Sim-to-Real Framework for Scalable Manipulation Data Collection

ExoGS:一种用于可扩展操纵数据收集的4D真实到仿真到真实框架

Yiming Wang, Ruogu Zhang, Minyang Li, Hao Shi, Junbo Wang, Deyi Li, Jieji Ren, Wenhai Liu, Weiming Wang, Hao-Shu Fang

机构 * Shanghai Jiao Tong University(上海交通大学)

AI总结 ExoGS通过无需机器人的4D真实到仿真到真实框架,实现高精度动态交互捕捉与仿真转换,提升操控数据收集效率和策略泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18438 2026-01-27 cs.SD

UrgentMOS: Unified Multi-Metric and Preference Learning for Robust Speech Quality Assessment

UrgentMOS: 统一多指标和偏好学习用于鲁棒语音质量评估

Wei Wang, Wangyou Zhang, Chenda Li, Jiahe Wang, Samuele Cornell, Marvin Sach, Kohei Saijo, Yihui Fu, Zhaoheng Ni, Bing Han, Xun Gong, Mengxiao Bi, Tim Fingscheidt, Shinji Watanabe, Yanmin Qian

机构 * Shanghai Jiao Tong University(上海交通大学) Carnegie Mellon University(卡内基梅隆大学) Technische Universität Braunschweig(布拉unsch维格技术大学) Meta Waseda University(早稻田大学) VUI Labs(VUI实验室)

AI总结 UrgentMOS通过统一多指标和偏好学习,提升语音质量评估的鲁棒性和泛化能力,适用于多种语音质量评估场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18346 2026-01-27 cs.CV

Q-Bench-Portrait: Benchmarking Multimodal Large Language Models on Portrait Image Quality Perception

Q-Bench-Portrait:多模态大语言模型在肖像图像质量感知上的基准测试

Sijing Wu, Yunhao Li, Zicheng Zhang, Qi Jia, Xinyue Li, Huiyu Duan, Xiongkuo Min, Guangtao Zhai

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

AI总结 Q-Bench-Portrait首次提出用于评估多模态大语言模型在肖像图像质量感知上的能力,包含2765个三元组,涵盖多种图像来源和质量维度,评估20个模型后发现其表现有限,与人类判断存在差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18195 2026-01-27 cs.CV

QualiRAG: Retrieval-Augmented Generation for Visual Quality Understanding

QualiRAG:用于视觉质量理解的检索增强生成

Linhan Cao, Wei Sun, Weixia Zhang, Xiangyang Zhu, Kaiwei Zhang, Jun Jia, Dandan Zhu, Guangtao Zhai, Xiongkuo Min

机构 * Shanghai Jiao Tong University(上海交通大学) East China Normal University(华东师范大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

AI总结 QualiRAG通过检索增强生成框架,利用大模型的潜在感知知识,实现无需训练的视觉质量理解与比较。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18130 2026-01-27 cs.AI

RouteMoA: Dynamic Routing without Pre-Inference Boosts Efficient Mixture-of-Agents

RouteMoA: 动态路由无需预推断提升高效混合代理

Jize Wang, Han Wu, Zhiyuan You, Yiming Song, Yijun Wang, Zifei Shan, Yining Li, Songyang Zhang, Xinyi Le, Cailian Chen, Xinping Guan, Dacheng Tao

机构 * Shanghai Jiao Tong University(上海交通大学) CUHK(香港中文大学) Tencent(腾讯) Shanghai AI Laboratory(上海人工智能实验室) Nanyang Technological University(新加坡国立大学)

AI总结 RouteMoA通过动态路由机制无需预推断提升混合代理效率,显著降低推理成本和延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02103 2026-01-27 cs.CV

HeadLighter: Disentangling Illumination in Generative 3D Gaussian Heads via Lightstage Captures

HeadLighter: 通过Lightstage捕获在生成3D高斯头部中解耦照明

Yating Wang, Yuan Sun, Xuan Wang, Ran Yi, Boyao Zhou, Yipengjing Sun, Hongyu Liu, Yinuo Wang, Lizhuang Ma

机构 * Shanghai Jiao Tong University(上海交通大学) AntGroup Research(蚂蚁集团研究)

AI总结 HeadLighter通过Lightstage捕获提出了一种新的监督框架,用于解耦生成3D头部模型中的光照与外观,实现高质量生成和实时渲染,同时支持光照和视角编辑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17440 2026-01-27 cs.RO

PILOT: A Perceptive Integrated Low-level Controller for Loco-manipulation over Unstructured Scenes

PILOT:一种用于非结构化场景中人形机器人类人协作的感知式低层控制器

Xinru Cui, Linxi Feng, Yixuan Zhou, Haoqi Han, Zhe Liu, Hesheng Wang

机构 * School of Automation and Intelligent Sensing(自动化与智能感知学院) Shanghai Jiao Tong University(上海交通大学) Global College(全球学院) school of Computer Science(计算机科学学院) Shanghai Key Laboratory of Navigation and Location Based Services(导航与位置基于服务上海市重点实验室)

AI总结 PILOT通过统一的强化学习框架,实现了感知式人形机器人移动与操作的稳定控制,提升了在复杂非结构化环境中的任务执行能力。

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17126 2026-01-27 hep-ex cs.LG hep-ph

EveNet: A Foundation Model for Particle Collision Data Analysis

EveNet:粒子碰撞数据分析的基础模型

Ting-Hsiang Hsu, Bai-Hong Zhou, Qibin Liu, Yue Xu, Shu Li, George Wei-Shu Hou, Benjamin Nachman, Shih-Chieh Hsu, Vinicius Mikuni, Yuan-Tang Chou, Yulei Zhang

机构 * Department of Physics, National Taiwan University, Taipei, Taiwan(国立台湾大学物理系) Tsung-Dao Lee Institute, Shanghai Jiao Tong University, Shanghai, China(李政道研究所) Fundamental Physics Directorate, SLAC National Accelerator Laboratory, Menlo Park, USA(SLAC国家加速器实验室基础物理主任) Department of Physics, University of Washington, Seattle, Washington, USA(华盛顿大学物理系) Department of Particle Physics and Astrophysics, Stanford University, Stanford, USA(斯坦福大学粒子物理与天体物理学系) Kobayashi-Maskawa Institute, Nagoya University, Nagoya, Japan(小林信三研究所)

AI总结 EveNet通过预训练在大量模拟碰撞事件上,实现了对粒子碰撞数据分析的高效处理,展示了在多种任务上的优越性能和在低统计数据下的高效性。

Comments 26 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10461 2026-01-27 q-fin.ST cs.AI cs.LG

Momentum-integrated Multi-task Stock Recommendation with Converge-based Optimization

动量整合多任务股票推荐与基于收敛的优化

Hao Wang, Jingshu Peng, Yanyan Shen, Xujia Li, Quanqing Xu, Chuanhui Yang, Lei Chen

机构 * HKUST(GZ)(香港科技大学(广州)) HKUST(香港科技大学) Shanghai Jiao Tong University(上海交通大学) OceanBase, Ant Group(蚂蚁集团OceanBase)

AI总结 本文提出动量整合多任务股票推荐框架MiM-StocR,通过引入动量指标和自适应-k近似NDCG损失函数,提升股票推荐的短期趋势捕捉能力,并采用收敛四边平衡方法缓解过拟合问题,实验证明其在排名和盈利能力上优于现有基线。

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18624 2026-01-27 cs.CV

GeneMAN: Generalizable Single-Image 3D Human Reconstruction from Multi-Source Human Data

GeneMAN: 从多源人类数据中通用的单图像3D人体重建

Wentao Wang, Hang Ye, Fangzhou Hong, Xue Yang, Jianfu Zhang, Yizhou Wang, Ziwei Liu, Liang Pan

机构 * Shanghai AI Laboratory(上海人工智能实验室) Peking University(北京大学) Nanyang Technological University(南洋理工大学) SAIS & SCS, Shanghai Jiao Tong University(上海交通大学SAIS与SCS)

AI总结 GeneMAN通过多源高质量数据集和深度学习方法,实现从单张图像到高保真3D人体的通用重建。

Comments Accepted by NeurIPS 2025; Project page: https://roooooz.github.io/GeneMAN/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17058 2026-01-27 cs.DB cs.AI cs.CL cs.LG

Can LLMs Clean Up Your Mess? A Survey of Application-Ready Data Preparation with LLMs

大模型能帮你清理数据吗?基于大模型的应用级数据准备综述

Wei Zhou, Jun Zhou, Haoyu Wang, Zhenghao Li, Qikang He, Shaokun Han, Guoliang Li, Xuanhe Zhou, Yeye He, Chunwei Liu, Zirui Tang, Bin Wang, Shen Tang, Kai Zuo, Yuyu Luo, Zhenzhe Zheng, Conghui He, Jingren Zhou, Fan Wu

机构 * Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学) Microsoft Research(微软研究院) MIT CSAIL(麻省理工学院计算机科学与人工智能实验室) Shanghai AI Laboratory(上海人工智能实验室) Xiaohongshu Inc.(小红书公司) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Alibaba Group(阿里巴巴集团)

AI总结 本文综述了基于大语言模型的应用级数据准备方法,探讨了数据清洗、整合与丰富三大任务的技术、优势与局限,并提出了可扩展的大语言模型-数据系统和稳健评估协议的未来研究方向。

Comments Please refer to our repository for more details: https://github.com/weAIDB/awesome-data-llm

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17027 2026-01-27 cs.CV cs.AI

Scientific Image Synthesis: Benchmarking, Methodologies, and Downstream Utility

科学图像合成:基准测试、方法论与下游应用

Honglin Lin, Chonghan Qin, Zheng Liu, Qizhi Pei, Yu Li, Zhanping Zhong, Xin Gao, Yanfeng Wang, Conghui He, Lijun Wu

机构 * Shanghai Jiao Tong University(上海交通大学) OpenDataLab, Shanghai Artificial Intelligence Laboratory(OpenDataLab,上海人工智能实验室) The University of Hong Kong(香港大学) Peking University(北京大学)

AI总结 本文提出ImgCoder框架和SciGenBench基准,通过逻辑驱动方法提升科学图像生成的结构精度,并展示微调LMMs在科学图像上的效果,验证了高保真合成在多模态推理中的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10250 2026-01-26 cs.CV

GAMMA: Generalizable Alignment via Multi-task and Manipulation-Augmented Training for AI-Generated Image Detection

GAMMA: 通过多任务和操控增强训练实现通用对齐的AI生成图像检测

Haozhen Yan, Yan Hong, Suning Lang, Jiahui Zhan, Yikun Ji, Yujie Gao, Huijia Zhu, Jun Lan, Jianfu Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Ant Group(蚂蚁集团)

AI总结 GAMMA通过多任务和操控增强训练,提升AI生成图像检测的泛化能力与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05504 2026-01-26 hep-lat cs.LG

Physics-Conditioned Diffusion Models for Lattice Gauge Theory

用于格点规范理论的物理条件扩散模型

Qianteng Zhu, Gert Aarts, Wei Wang, Kai Zhou, Lingxiao Wang

机构 * State Key Laboratory of Dark Matter Physics, Key Laboratory for Particle Astrophysics and Cosmology (MOE)(暗物质物理国家重点实验室,粒子天体物理学与宇宙学重点实验室) Shanghai Key Laboratory for Particle Physics and Cosmology(粒子物理与宇宙学上海实验室) Shanghai Jiao Tong University(上海交通大学) Department of Physics, Swansea University(Swansea大学物理系) Southern Center for Nuclear-Science Theory (SCNT), Institute of Modern Physics, Chinese Academy of Sciences(核科学理论南方中心(SCNT),现代物理研究所,中国科学院) School of Science and Engineering, The Chinese University of Hong Kong (Shenzhen)(科学与工程学院,香港中文大学(深圳)) School of Artificial Intelligence, The Chinese University of Hong Kong (Shenzhen)(人工智能学院,香港中文大学(深圳)) Institute for Physics of Intelligence, The University of Tokyo(智能物理研究所,东京大学)

AI总结 本文提出了一种用于格点规范理论的物理条件扩散模型,通过整合Metropolis调整的 Langevin 动力学,实现了高效拓扑量采样,并在不同格点尺寸上无需重新训练即可应用。

Comments 28 pages, 10 figures, accepted in JHEP. Codes are available at: https://github.com/zzzqt/DM4U1

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15596 2026-01-23 cs.SD cs.AI eess.AS

DeepASMR: LLM-Based Zero-Shot ASMR Speech Generation for Anyone of Any Voice

DeepASMR: 基于LLM的零样本ASMR语音生成方法用于任何人任何声音

Leying Zhang, Tingxiao Zhou, Haiyang Sun, Mengxiao Bi, Yanmin Qian

机构 * Auditory Cognition and Computational Acoustics Lab, School of Computer Science& MoE Key Laboratory of Artificial Intelligence, AI Institute, Shanghai Jiao Tong University(计算机学院听力认知与计算声学实验室、教育部人工智能关键实验室、人工智能研究院,上海交通大学)

AI总结 DeepASMR通过LLM和流匹配解码器实现零样本ASMR语音生成,无需目标说话人无声数据,提升自然度和风格保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏