arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Fudan University(复旦大学)

2026-02-27 至 2026-02-27 共收录 8
2602.23203 2026-02-27 cs.CV cs.AI

ColoDiff: Integrating Dynamic Consistency With Content Awareness for Colonoscopy Video Generation

ColoDiff:整合动态一致性与内容感知用于结肠镜视频生成

Junhu Fu, Shuyu Liang, Wutong Li, Chen Ma, Peng Huang, Kehao Wang, Ke Chen, Shengli Lin, Pinghong Zhou, Zeju Li, Yuanyuan Wang, Yi Guo

机构 * College of Biomedical Engineering, Fudan University(复旦大学生物医学工程学院) Fudan University Shanghai Cancer Center(复旦大学上海肿瘤中心) Endoscopy Center and Endoscopy Research Institute, Zhongshan Hospital, Fudan University(复旦大学中山医院内窥镜中心和内窥镜研究所) Shanghai Collaborative Innovation Center of Endoscopy(上海内窥镜协同创新中心)

AI总结 ColoDiff通过整合动态一致性与内容感知,生成高质量的结肠镜视频,以缓解数据短缺并辅助临床分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22785 2026-02-27 cs.CV

SceneTransporter: Optimal Transport-Guided Compositional Latent Diffusion for Single-Image Structured 3D Scene Generation

SceneTransporter: 基于最优传输的组合潜在扩散模型用于单图像结构化3D场景生成

Ling Wang, Hao-Xiang Guo, Xinzhou Wang, Fuchun Sun, Kai Sun, Pengkun Liu, Hang Xiao, Zhong Wang, Guangyuan Fu, Eric Li, Yang Liu, Yikai Wang

机构 * Xi’an Research Institute of Hi-Tech(西安高新技术研究院) Tsinghua University(清华大学) SkyWork AI Tongji University(同济大学) Fudan University(复旦大学) Beijing Normal University(北京师范大学)

AI总结 SceneTransporter通过最优传输引导的组合潜在扩散模型,提升单图像结构化3D场景生成的实例连贯性和几何保真度。

Comments published at iclr 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21058 2026-02-27 cs.CV

Beyond Pixel Simulation: Pathology Image Generation via Diagnostic Semantic Tokens and Prototype Control

超越像素模拟:通过诊断语义标记和原型控制生成病理图像

Minghao Han, Yichen Liu, Yizhou Liu, Zizhi Chen, Jingqun Tang, Xuecheng Wu, Dingkang Yang, Lihua Zhang

机构 * College of Intelligent Robotics and Advanced Manufacturing(智能机器人与先进制造学院) Fudan University(复旦大学) Fysics Intelligence Technologies Co., Ltd.(Fysics智能科技有限公司) University of Science and Technology Beijing(北京科技大学) ByteDance(字节跳动) School of Computer Science and Technology(计算机科学与技术学院) Xi’an Jiaotong University(西安交通大学)

AI总结 UniPath通过诊断语义标记和原型控制实现可控的病理图像生成,取得SOTA性能,包括Patho-FID 80.9和98.7%的细粒度语义控制。

Comments accepted by CVPR 2026; 32 pages, 17 figures, and 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03801 2026-02-27 cs.LG cs.AI

Large Language Model Compression with Global Rank and Sparsity Optimization

大型语言模型压缩与全局秩和稀疏性优化

Changhai Zhou, Qian Qiao, Yuhua Zhou, Yuxin Wu, Shichao Weng, Weizhong Zhang, Cheng Jin

机构 * Fudan University(复旦大学) Soul AILab, OpenWPLab(Soul AILab,OpenWPLab) Zhejiang University(浙江大学) Renmin University of China(中国人民大学)

AI总结 本文提出了一种两阶段LLM压缩方法,通过全局资源分配优化秩和稀疏性,有效提升模型压缩性能。

Comments 33 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02088 2026-02-27 cs.CV cs.AI

Dual-IPO: Dual-Iterative Preference Optimization for Text-to-Video Generation

Dual-IPO: 双迭代偏好优化用于文本到视频生成

Xiaomeng Yang, Mengping Yang, Jia Gong, Luozheng Qin, Zhiyu Tan, Hao Li

机构 * Fudan University(复旦大学) Shanghai Academy of AI for Science(上海人工智能科学研究院)

AI总结 Dual-IPO通过迭代优化奖励模型和视频生成模型,提升文本到视频生成的质量和人类偏好对齐,无需手动标注即可提高合成效果。

Comments To appear in ICLR 2026, GitHub Code: https://github.com/SAIS-FUXI/IPO

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22592 2026-02-27 cs.LG cs.CL

pQuant: Towards Effective Low-Bit Language Models via Decoupled Linear Quantization-Aware Training

pQuant:通过解耦线性量化感知训练实现有效的低比特语言模型

Wenzheng Zhang, Bingzheng Liu, Yang Hu, Xiaoying Bai, Wentao Zhang, Bin Cui

机构 * School of Computer Science, Peking University(北京大学计算机学院) College of Future Information Technology, Fudan University(复旦大学未来信息技术学院) Center for Information Research, Academy of Military Sciences(军事科学院信息研究所) Advanced Institute of Big Data(大数据高级研究所) Center of Machine Learning Research, Peking University(北京大学机器学习研究中心)

AI总结 pQuant通过解耦线性层为两个专门分支,提升低比特语言模型的精度与可扩展性。

Comments 10 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22298 2026-02-27 cs.LG cs.AI

AviaSafe: A Physics-Informed Data-Driven Model for Aviation Safety-Critical Cloud Forecasts

AviaSafe: 一种融合物理约束的数据驱动模型用于航空安全关键的云预报

Zijian Zhu, Qiusheng Huang, Anboyu Guo, Xiaohui Zhong, Hao Li

机构 * Artificial Intelligence Innovation and Incubation Institute, Fudan University(复旦大学人工智能创新与孵化院) Shanghai Innovation Institute(上海创新研究院) Shanghai Academy of Artificial Intelligence for Science(上海人工智能科学研究院) National Marine Environment Forecasting Center(国家海洋环境预报中心) Department of Atmospheric and Oceanic Sciences, Fudan University(复旦大学大气科学与海洋科学系)

AI总结 AviaSafe通过融合物理约束的神经网络,实现了对航空安全关键的云物种的7天预测,提升了航空路线优化和结冰风险评估能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22268 2026-02-27 cs.LG

AutoQRA: Joint Optimization of Mixed-Precision Quantization and Low-rank Adapters for Efficient LLM Fine-Tuning

AutoQRA:混合精度量化与低秩适配器的联合优化以实现高效大语言模型微调

Changhai Zhou, Shiyang Zhang, Yuhua Zhou, Qian Qiao, Jun Gao, Cheng Jin, Kaizhou Qin, Weizhong Zhang

机构 * Fudan University(复旦大学) Yale University(耶鲁大学) Zhejiang University(浙江大学) OpenWPLab

AI总结 AutoQRA通过联合优化混合精度量化与低秩适配器,实现高效大语言模型微调,提升性能并降低内存消耗。

Comments 15 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏