arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Science and Technology of China(中国科学技术大学)

共收录 2228
2508.00477 2025-12-24 cs.CV

LAMIC: Layout-Aware Multi-Image Composition via Scalability of Multimodal Diffusion Transformer

LAMIC:基于多模态扩散变换器可扩展性的布局感知多图像合成

Yuzhuo Chen, Zehua Ma, Jianhua Wang, Kai Kang, Shunyu Yao, Weiming Zhang

机构 * University of Science and Technology of China(中国科学技术大学) Onestory Team(Onestory团队) East China Normal University(华东师范大学)

AI总结 LAMIC通过无训练方式实现多参考图像合成,提升布局控制与背景一致性。

Comments 8 pages, 5 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18766 2025-12-23 cs.CV

MaskFocus: Focusing Policy Optimization on Critical Steps for Masked Image Generation

MaskFocus: 为掩码图像生成聚焦策略优化

Guohui Zhang, Hu Yu, Xiaoxiao Ma, Yaning Pan, Hang Xu, Feng Zhao

机构 * University of Science and Technology of China(中国科学技术大学) Fudan University(复旦大学)

AI总结 MaskFocus通过聚焦关键步骤优化策略,提升掩码图像生成模型的性能。

Comments Code is available at https://github.com/zghhui/MaskFocus

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23484 2025-12-23 cs.MM cs.CV eess.IV

TAG-WM: Tamper-Aware Generative Image Watermarking via Diffusion Inversion Sensitivity

TAG-WM: 通过扩散反向敏感性实现的抗篡改生成图像水印

Yuzhuo Chen, Zehua Ma, Han Fang, Weiming Zhang, Nenghai Yu

机构 * Anhui Province Key Laboratory of Digital Security, University of Science and Technology of China(安徽省数字安全重点实验室,中国科学技术大学) School of Computing, National University of Singapore(computing学院,新加坡国立大学)

AI总结 TAG-WM通过扩散反向敏感性实现抗篡改生成图像水印,提升篡改鲁棒性和定位能力,保持生成质量与水印容量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24511 2025-12-23 cs.LG cs.AI

Can Slow-thinking LLMs Reason Over Time? Empirical Studies in Time Series Forecasting

慢思考LLM能否在时间上进行推理?时间序列预测的实证研究

Mingyue Cheng, Jiahao Wang, Daoyu Wang, Xiaoyu Tao, Qi Liu, Enhong Chen

机构 * State Key Laboratory of Cognitive Intelligence, University of Science and Technology of China(认知智能国家重点实验室,中国科学技术大学)

AI总结 本文探讨慢思考LLM能否在时间序列预测中进行推理,通过实验证明其零样本预测能力,揭示LLM在时间动态上的潜力与局限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18312 2025-12-23 cs.CV

MatE: Material Extraction from Single-Image via Geometric Prior

MatE:通过几何先验从单张图像中提取材料

Zeyu Zhang, Wei Zhai, Jian Yang, Yang Cao

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 MatE通过几何先验从单张图像生成可拼接的PBR材料,实现对未知光照和透视的不变性,从而恢复真实世界材料属性。

Comments 8 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18266 2025-12-23 cs.LG

LeJOT: An Intelligent Job Cost Orchestration Solution for Databricks Platform

LeJOT:Databricks平台的智能作业成本编排解决方案

Lizhi Ma, Yi-Xiang Hu, Yuke Wang, Yifang Zhao, Yihui Ren, Jian-Xiang Liao, Feng Wu, Xiang-Yang Li

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 LeJOT通过机器学习预测和优化模型实现Databricks平台作业成本的智能编排,有效降低云计算成本。

Comments The 11th International Conference on Big Data Computing and Communications

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02366 2025-12-23 cs.CL

LiveSecBench: A Dynamic and Event-Driven Safety Benchmark for Chinese Language Model Applications

LiveSecBench: 一种动态且事件驱动的安全基准,用于中文语言模型应用

Yudong Li, Peiru Yang, Feng Huang, Zhongliang Yang, Kecheng Wang, Haitian Li, Baocheng Chen, Xingyu An, Ziyu Liu, Youdan Yang, Kejiang Chen, Sifang Wan, Xu Wang, Yufei Sun, Liyan Wu, Ruiqi Zhou, Wenya Wen, Xingchi Gu, Tianxin Zhang, Yue Gao, Yongfeng Huang

机构 * Tsinghua University(清华大学) Beijing University of Posts and Telecommunications(北京邮电大学) University of Science and Technology of China(中国科学技术大学) IntokenTech

AI总结 LiveSecBench通过动态更新和多维度评估,为中文大模型的安全性提供持续改进的标准和排行榜。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17650 2025-12-22 cs.CV cs.MM

Region-Constraint In-Context Generation for Instructional Video Editing

区域约束的上下文生成用于教学视频编辑

Zhongwei Zhang, Fuchen Long, Wei Li, Zhaofan Qiu, Wu Liu, Ting Yao, Tao Mei

机构 * University of Science and Technology of China(中国科学技术大学) HiDream.ai Inc.(HiDream.ai公司)

AI总结 ReCo通过引入区域约束建模,提升基于指令的视频编辑中编辑区域的准确性和去噪效果,提出新的正则化方法和大规模数据集。

Comments Project page: https://zhw-zhang.github.io/ReCo-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.18686 2025-12-22 cs.LG

Hierarchical Multimodal LLMs with Semantic Space Alignment for Enhanced Time Series Classification

具有语义空间对齐的层次多模态大语言模型用于增强的时间序列分类

Xiaoyu Tao, Tingyue Pan, Mingyue Cheng, Yucong Luo, Qi Liu, Enhong Chen

机构 * State Key Laboratory of Cognitive Intelligence, University of Science and Technology of China(认知智能国家重点实验室,中国科学技术大学)

AI总结 HiTime通过层次多模态大语言模型和语义空间对齐,提升时间序列分类的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16360 2025-12-19 cs.CV

EverybodyDance: Bipartite Graph-Based Identity Correspondence for Multi-Character Animation

EverybodyDance: 基于二分图的身份对应关系的多角色动画

Haotian Ling, Zequn Chen, Qiuying Chen, Donglin Di, Yongjia Ma, Hao Li, Chen Wei, Zhulin Tao, Xun Yang

机构 * University of Science and Technology of China(中国科学技术大学) Li Auto Communication University of China(通信大学) MoE Key Laboratory of Brain-inspired Intelligent Perception and Cognition, USTC(教育部脑科学与智能感知认知重点实验室,中国科学技术大学)

AI总结 EverybodyDance通过构建身份匹配图和多尺度匹配策略,有效提升了多角色动画中身份对应关系的正确性和视觉保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15524 2025-12-18 cs.CV

DeX-Portrait: Disentangled and Expressive Portrait Animation via Explicit and Latent Motion Representations

DeX-Portrait: 通过显式和潜在运动表示实现解耦且表达性的肖像动画

Yuxiang Shi, Zhe Li, Yanwen Wang, Hao Zhu, Xun Cao, Ligang Liu

机构 * University of Science and Technology of China(中国科学技术大学) Central Media Technology Institute, Huawei(华为中央媒体技术研究所) Nanjing University(南京大学)

AI总结 DeX-Portrait通过显式和潜在运动表示生成解耦且表达性的肖像动画,提升动画质量和可控性。

Comments Projectpage: https://syx132.github.io/DeX-Portrait/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15212 2025-12-18 cs.CV

From Camera to World: A Plug-and-Play Module for Human Mesh Transformation

从相机到世界:一种用于人体网格转换的即插即用模块

Changhai Ma, Ziyu Wu, Yunkang Zhang, Qijun Ying, Boyan Liu, Xiaohui Cai

机构 * University of Science and Technology of China(科学技术大学)

AI总结 本文提出Mesh-Plug模块,通过结合RGB图像和深度图估计相机旋转参数,实现从相机坐标到世界坐标的人体网格转换,提升了真实场景中3D人体重建的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14750 2025-12-18 q-bio.QM cs.AI

Multiscale Cross-Modal Mapping of Molecular, Pathologic, and Radiologic Phenotypes in Lipid-Deficient Clear Cell Renal CellCarcinoma

多尺度跨模态映射分子、病理和放射表型在脂质缺乏型清细胞癌肾癌中的应用

Ying Cui, Dongzhe Zheng, Ke Yu, Xiyin Zheng, Xiaorui Wang, Xinxiang Li, Yan Gu, Lin Fu, Xinyi Chen, Wenjie Mei, Xin-Gui Peng

机构 * Nurturing Center of Jiangsu Province for State Laboratory of AI Imaging & Interventional Radiology, Department of Radiology, Zhongda Hospital, School of Medicine, Southeast University(江苏省人工智能影像与介入放射学 state laboratory 育成中心,放射科,中大医院,东南大学) Department of Mechanical and Aerospace Engineering, Princeton University(机械与航空航天工程系,普林斯顿大学) School of Automation, Southeast University(自动化学院,东南大学) Department of Biomedical Engineering, Columbia University(生物医学工程系,哥伦比亚大学) Automation and Electrical Engineering College, Lanzhou University of Technology(自动化与电气工程学院,兰州理工大学) The First Affiliated Hospital of USTC, Division of Life Sciences and Medicine, University of Science and Technology of China(中国科学技术大学附属第一医院,生命科学与医学学院,中国科学技术大学) Lianyungang First People’s Hospital(连云港第一人民医院) School of Robotics and Automation, Suzhou Campus, Nanjing University(机器人与自动化学院,南京大学苏智校区)

AI总结 本研究提出多尺度跨模态框架,用于术前识别脂质缺乏型清细胞肾癌的分子、病理和放射表型,实现非侵入性分子表型分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17346 2025-12-18 cs.LG

Taming Latency and Bandwidth: A Theoretical Framework and Adaptive Algorithm for Communication-Constrained Training

驯服延迟与带宽:一种用于通信受限训练的理论框架和自适应算法

Rongwei Lu, Jingyan Jiang, Chunyang Li, Xingguang Wei, Zhi Wang

机构 * Tsinghua Shenzhen International Graduate School(清华大学深圳国际研究生院) Tsinghua University(清华大学) Shenzhen Technology University(深圳科技大学) University of Science and Technology of China(中国科学技术大学)

AI总结 DeCo-SGD通过动态调整压缩比率和陈旧性,解决了通信受限训练中的延迟与带宽问题,提升了分布式训练效率。

Comments This work has been submitted to the IEEE for possible publication. This is an extended version including the complete appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14692 2025-12-17 cs.CV cs.AI

Native and Compact Structured Latents for 3D Generation

原生且紧凑的结构化潜在变量用于3D生成

Jianfeng Xiang, Xiaoxue Chen, Sicheng Xu, Ruicheng Wang, Zelong Lv, Yu Deng, Hongyuan Zhu, Yue Dong, Hao Zhao, Nicholas Jing Yuan, Jiaolong Yang

机构 * Tsinghua University(清华大学) Microsoft Research(微软研究院) USTC(University of Science and Technology of China) Microsoft AI(微软人工智能)

AI总结 本文提出O-体素和稀疏压缩变分自编码器,通过高效生成高质量3D资产,推动3D生成建模的发展。

Comments Project Page: https://microsoft.github.io/TRELLIS.2/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14481 2025-12-17 cs.CL cs.AI

SASQ: Static Activation Scaling for Quantization-Aware Training in Large Language Models

SASQ:用于大语言模型量化感知训练的静态激活缩放

Shizhuo Mao, Song Chen, Yi Kang

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 SASQ通过优化激活量化因子,实现了大语言模型在量化感知训练中的高精度静态推理与高效部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14142 2025-12-17 cs.CL

Astraea: A State-Aware Scheduling Engine for LLM-Powered Agents

Astraea:一种面向LLM代理的基于状态的调度引擎

Hongqiu Ni, Jiabao Zhang, Guopeng Li, Zilong Wang, Ruiqi Wu, Chi Zhang, Haisheng Tan

机构 * University of Science and Technology of China(中国科学技术大学) Hefei University of Technology(合肥工业大学)

AI总结 Astraea通过基于状态的分层调度算法优化LLM代理的全局作业完成时间,减少端到端延迟并提升系统效率与公平性。

Comments 12 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14078 2025-12-17 cs.LG

FusAD: Time-Frequency Fusion with Adaptive Denoising for General Time Series Analysis

FusAD:基于自适应去噪的时间-频率融合用于通用时间序列分析

Da Zhang, Bingyu Li, Zhiyuan Zhao, Feiping Nie, Junyu Gao, Xuelong Li

机构 * School of Artificial Intelligence, OPtics and ElectroNics (iOPEN), Northwestern Polytechnical University(人工智能学院,光学电子研究所(iOPEN),西北工业大学) Institute of Artificial Intelligence (TeleAI), China Telecom(人工智能研究所(TeleAI),中国电信) Department of Electronic Engineering and Information Science, University of Science and Technology of China(电子工程与信息科学系,中国科学技术大学)

AI总结 FusAD通过自适应时间-频率融合和去噪机制,提升多任务时间序列分析的效率与泛化能力。

Comments Paper has been accepted by ICDE2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14069 2025-12-17 cs.AI

RADAR: Accelerating Large Language Model Inference With RL-Based Dynamic Draft Trees

RADAR: 通过基于强化学习的动态草稿树加速大语言模型推理

Junjie Ma, Jinlong Li

机构 * School of Computer Science(计算机科学学院) University of Science and Technology of China(中国科学技术大学)

AI总结 RADAR通过基于强化学习的动态草稿树方法,有效提升大语言模型推理速度,实现3.17至4.82倍的加速效果。

Comments 5 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11252 2025-12-17 cs.CV eess.IV

MFGDiffusion: Mask-Guided Smoke Synthesis for Enhanced Forest Fire Detection

MFGDiffusion:基于掩码的烟雾合成以提升森林火灾检测

Guanghao Wu, Yunqing Shang, Chen Xu, Hai Song, Chong Wang, Qixing Zhang

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 MFGDiffusion通过掩码引导的烟雾合成提升森林火灾检测性能

Comments 14 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19929 2025-12-16 physics.soc-ph cs.AI

DynamiX: Large-Scale Dynamic Social Network Simulator

DynamiX: 大规模动态社交网络模拟器

Yanhui Sun, Wu Liu, Wentao Wang, Hantao Yao, Jiebo Luo, Yongdong Zhang

机构 * School of Information Science and Technology, University of Science and Technology of China(信息科学与技术学院,中国科学技术大学) Department of Computer Science, University of Rochester(计算机科学系,罗切斯特大学)

AI总结 DynamiX通过动态层级模块和不同用户类型的社交关系建模策略,提升了大规模动态社交网络模拟的准确性与实用性。

Comments Social and Information Networks

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12809 2025-12-16 cs.NE cs.AI

OPAL: Operator-Programmed Algorithms for Landscape-Aware Black-Box Optimization

OPAL: 用于景观感知的黑盒优化运算符-程序算法

Junbo Jacob Lian, Mingyang Yu, Kaichen Ouyang, Shengwei Fu, Rui Zhong, Yujun Zhang, Jun Zhang, Huiling Chen

机构 * McCormick School of Engineering, Northwestern University(麦科姆ick工程学院,西北大学) College of Artificial Intelligence, Nankai University(南开大学人工智能学院) School of Mathematics, University of Science and Technology of China(中国科学技术大学数学系) Guizhou University(贵州大学) School of New Energy, Jingchu University of Technology(荆楚科技学院新能源学院) Information Initiative Center, Hokkaido University(北海道大学信息初始化中心) School of Computer Science and Artificial Intelligence, Wenzhou University(温州大学计算机科学与人工智能学院)

AI总结 OPAL通过运算符程序化和景观感知的方法,实现了在黑盒优化中的高效优化,优于传统方法。

Comments Source code, experiment scripts, and results are publicly available at https://github.com/junbolian/OPAL. The real-world application part hasn't been done yet

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12387 2025-12-16 cs.LG

Anchoring Values in Temporal and Group Dimensions for Flow Matching Model Alignment

在时间和群体维度上锚定值以实现流匹配模型对齐

Yawen Shao, Jie Xiao, Kai Zhu, Yu Liu, Wei Zhai, Yang Cao, Zheng-Jun Zha

机构 * University of Science and Technology of China(中国科学技术大学) Tongyi Lab(通义实验室)

AI总结 VGPO通过在时间和群体维度上锚定值,改进流匹配模型对齐,提升图像生成质量与任务准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10309 2025-12-16 q-bio.MN cs.LG physics.bio-ph

Tracking large chemical reaction networks and rare events by neural networks

通过神经网络追踪大规模化学反应网络和罕见事件

Jiayu Weng, Xinyi Zhu, Jing Liu, Linyuan Lü, Pan Zhang, Ying Tang

机构 * Institute of Data Science, University of Hong Kong, Hong Kong(数据科学研究所,香港大学) Department of Systems Science, Faculty of Arts and Sciences, Beijing Normal University, Zhuhai 519087, China(艺术与科学学院系统科学系,北京师范大学) School of Physics, University of Electronic Science and Technology of China, Chengdu 611731, China(电子科学与技术大学物理学院) School of Physical Science and Technology, Beijing University of Posts and Telecommunications, Beijing 102206, China(邮电大学物理科学与技术学院) Institute of Theoretical Physics, Chinese Academy of Sciences, Beijing 100190, China(中国科学院理论物理研究所) School of Cyber Science and Technology, University of Science and Technology of China, Hefei 230027, China(科学技术大学网络科学与技术学院) School of Fundamental Physics and Mathematical Sciences, Hangzhou Institute for Advanced Study, UCAS, Hangzhou 310024, China(杭州高等研究院基础物理与数学科学学院) Institute of Fundamental and Frontier Sciences, University of Electronic Science and Technology of China, Chengdu 611731, China(电子科学与技术大学基础与前沿科学研究所) Non-classical Information Science Basic Discipline Research Center of Sichuan Province, University of Electronic Science and Technology of China, Chengdu 611731, China(四川省非经典信息科学基础学科研究中心,电子科学与技术大学)

AI总结 本文提出通过神经网络高效追踪大规模化学反应网络及罕见事件的方法,结合优化算法和增强采样策略,实现显著加速和高精度建模。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08648 2025-12-16 cs.CV

Repulsor: Accelerating Generative Modeling with a Contrastive Memory Bank

Repulsor:利用对比记忆库加速生成建模

Shaofeng Zhang, Xuanqi Chen, Ning Liao, Haoxiang Zhao, Xiaoxing Wang, Haoru Tan, Sitong Wu, Xiaosong Jia, Qi Fan, Junchi Yan

机构 * School of Artificial Intelligence and Data Science, University of Science and Technology of China(人工智能与数据科学学院,中国科学技术大学) Shanghai Jiao Tong University(上海交通大学) HKU(香港大学) CUHK(香港大学) Fudan University(复旦大学) Nanjing University(南京大学)

AI总结 Repulsor通过对比记忆库机制,无需外部编码器,实现高效的生成建模,显著提升收敛速度和生成质量。

Comments 19 pages, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03738 2025-12-16 cs.CV

FACM: Flow-Anchored Consistency Models

FACM:基于流的一致性模型

Yansong Peng, Kai Zhu, Yu Liu, Pingyu Wu, Hebei Li, Xiaoyan Sun, Feng Wu

机构 * University of Science and Technology of China(中国科学技术大学) Tongyi Lab(通义实验室)

AI总结 FACM通过流锚定方法解决连续时间一致性模型的训练不稳定性问题,实现高效生成和稳定训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23583 2025-12-16 cs.LG

Improving Time Series Forecasting via Instance-aware Post-hoc Revision

通过实例感知的后处理修正提升时间序列预测

Zhiding Liu, Mingyue Cheng, Guanhao Zhao, Jiqian Yang, Qi Liu, Enhong Chen

机构 * State Key Laboratory of Cognitive Intelligence, University of Science and Technology of China(认知智能国家重点实验室,中国科学技术大学)

AI总结 本文提出PIR框架,通过后处理修正提升时间序列预测的实例可靠性。

Comments Accepted by NeurIPS 2025 as a poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19700 2025-12-16 cs.CL cs.AI

Leveraging Importance Sampling to Detach Alignment Modules from Large Language Models

利用重要性采样将对齐模块从大语言模型中分离出来

Yi Liu, Dianqing Liu, Mingye Zhu, Junbo Guo, Yongdong Zhang, Zhendong Mao

机构 * State Key Laboratory of Communication Content Cognition, People’s Daily Online(通信内容认知国家重点实验室,人民在线) University of Science and Technology of China(中国科学技术大学)

AI总结 本文提出残差对齐模型(RAM),通过重要性采样将对齐模块与大语言模型分离,提升灵活性和可扩展性,并在多种任务上优于基线模型。

Comments Accepted by NeurIPS 2025, 28 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15134 2025-12-16 cs.CV

Instance-Adaptive Keypoint Learning with Local-to-Global Geometric Aggregation for Category-Level Object Pose Estimation

实例自适应关键点学习与局部到全局几何聚合用于类别级物体姿态估计

Xiao Zhang, Lu Zou, Tao Lu, Yuan Yao, Zhangjin Huang, Guoping Wang

机构 * Wuhan Institute of Technology(武汉理工大学) University of Science and Technology of China(中国科学技术大学) Peking University(北京大学)

AI总结 INKL-Pose通过实例自适应关键点学习与局部到全局几何聚合,实现类别级物体姿态估计的高精度与高效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.17827 2025-12-16 eess.SP cs.LG

A Physics-Embedded Dual-Learning Imaging Framework for Electrical Impedance Tomography

一种嵌入物理的双学习成像框架用于电阻抗断层成像

Xuanxuan Yang, Yangming Zhang, Haofeng Chen, Gang Ma, Xiaojie Wang

机构 * Hefei Institutes of Physical Science, Chinese Academy of Sciences(合肥物理研究所,中国科学院) Department of Precision Instruments and Precision Machinery, University of Science and Technology of China(中国科学技术大学精密仪器与机械系) Department of Cybernetics, Faculty of Electrical Engineering, Czech Technical University in Prague(布拉格技术大学电子工程学院控制系)

AI总结 本文提出了一种嵌入物理的双学习框架,用于解决电阻抗断层成像中的逆问题,通过结合监督CNN和无监督PINN提高重建的鲁棒性和效率。

Comments 14 pages,11 figures

Journal ref Neural Networks, p. 108464, 2025/12/11/ 2025

详情

展开后加载摘要…

URL PDF HTML 收藏