arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Fudan University(复旦大学)

2026-03-17 至 2026-03-17 共收录 13
2603.15616 2026-03-17 cs.CV

GlyphPrinter: Region-Grouped Direct Preference Optimization for Glyph-Accurate Visual Text Rendering

GlyphPrinter: 基于区域分组的直接偏好优化用于精确的视觉文本渲染

Xincheng Shuai, Ziye Li, Henghui Ding, Dacheng Tao

机构 * Institute of Big Data, College of Computer Science and Artificial Intelligence, Fudan University(大数据研究院,计算机科学与人工智能学院,复旦大学) Generative AI Lab, College of Computing and Data Science, Nanyang Technological University(生成式人工智能实验室,计算与数据科学学院,南洋理工大学)

AI总结 本文提出GlyphPrinter,通过区域分组直接偏好优化提升文本渲染的字形准确性,引入区域级字形偏好标注和区域优化目标,有效解决复杂或非领域字符的字形误差问题。

Comments CVPR 2026, Project Page: https://henghuiding.com/GlyphPrinter/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15542 2026-03-17 cs.CY cs.AI

InterveneBench: Benchmarking LLMs for Intervention Reasoning and Causal Study Design in Real Social Systems

InterveneBench:用于干预推理和真实社会系统因果研究设计的LLM基准测试

Shaojie Shi, Zhengyu Shi, Lingran Zheng, Xinyu Su, Anna Xie, Bohao Lv, Rui Xu, Zijian Chen, Zhichao Chen, Guolei Liu, Naifu Zhang, Mingjian Dong, Zhuo Quan, Bohao Chen, Teqi Hao, Yuan Qi, Yinghui Xu, Libo Wu

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院)

AI总结 InterveneBench通过真实社会科学研究评估LLM在干预推理和因果研究设计中的能力,发现现有模型表现不足,并提出STRIDES多智能体框架提升性能。

Comments 35pages,3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15358 2026-03-17 cs.LG cs.AI physics.ao-ph

FuXiWeather2: Learning accurate atmospheric state estimation for operational global weather forecasting

FuXiWeather2: 为操作性全球天气预报学习准确的大气状态估计

Xiaoze Xu, Xiuyu Sun, Songling Zhu, Xiaohui Zhong, Yuanqing Huang, Zijian Zhu, Jun Liu, Hao Li

机构 * Shanghai Academy of Artificial Intelligence for Science(上海人工智能科学研究院) Artificial Intelligence Innovation and Incubation Institute(人工智能创新与孵化院) Fudan University(复旦大学) FuXi Intelligent Computing Technology Co., Ltd.(FuXi智能计算技术有限公司)

AI总结 本文提出FuXiWeather2模型,通过结合真实观测和再分析数据,提升大气状态估计的精度与稳定性,实现分钟级高分辨率全球分析和10天预报,优于现有系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15226 2026-03-17 cs.AI

SCAN: Sparse Circuit Anchor Interpretable Neuron for Lifelong Knowledge Editing

SCAN:稀疏电路锚定神经元用于终身知识编辑

Yuhuan Liu, Haitian Zhong, Xinyuan Xia, Qiang Liu, Shu Wu, Liang Wang

机构 * New Laboratory of Pattern Recognition (NLPR), State Key Laboratory of Multimodal Artificial Intelligence Systems (MAIS), Institute of Automation, Chinese Academy of Sciences(模式识别新实验室(NLPR)、多模态人工智能系统国家重点实验室(MAIS)、自动化研究所、中国科学院) Cuiying Honors College, Lanzhou University(cuiying荣誉学院、兰州大学) Research Institute of Intelligent Complex Systems, Fudan University(智能复杂系统研究院、复旦大学) Zhongguancun Academy(中关村学院)

AI总结 SCAN通过构建稀疏电路实现知识编辑,有效解决连续编辑中的灾难性遗忘问题,保持模型完整性。

Comments 21pages, 7figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15179 2026-03-17 cs.RO

KiRAS: Keyframe Guided Self-Imitation for Robust and Adaptive Skill Learning in Quadruped Robots

KiRAS: 基于关键帧的自我模仿学习用于四足机器人鲁棒且适应性强的技能学习

Xiaoyi Wei, Peng Zhai, Jiaxin Tu, Yueqi Zhang, Yuqi Li, Zonghao Zhang, Hu Zhou, Lihua Zhang

机构 * College of Intelligent Robotics and Advanced Manufacturing, Fudan University, China(复旦大学智能机器人与先进制造学院)

AI总结 KiRAS通过关键帧引导的自我模仿学习,在复杂地形上实现多样技能的获取与过渡,无需专家数据集,提升机器人在无结构环境中的鲁棒性和适应性。

Comments Received by 2026 IEEE International Conference on Robotics and Automation (ICRA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15025 2026-03-17 cs.CV

One CT Unified Model Training Framework to Rule All Scanning Protocols

一种统一的CT模型训练框架以适用于所有扫描协议

Fengzhi Xu, Ziyuan Yang, Zexin Lu, Yingyu Chen, Fenglei Fan, Hongming Shan, Yi Zhang

机构 * Sichuan University(四川大学) City University of Hong Kong(香港城市大学) Fudan University(复旦大学)

AI总结 本文提出UMS框架,通过不确定性引导的流形平滑方法,解决不同扫描协议下特征空间的断续问题,提升重建性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14944 2026-03-17 cs.LG

Ultra-Early Prediction of Tipping Points: Integrating Dynamical Measures with Reservoir Computing

超早期预测临界点:整合动力学指标与回声计算

Xin Li, Qunxi Zhu, Chengli Zhao, Bolin Zhao, Xue Zhang, Xiaojun Duan, Wei Lin

机构 * College of Science, National University of Defense Technology(国防科技大学科学学院) Research Institute of Intelligent Complex Systems(智能复杂系统研究所) MOE Frontiers Center for Brain Science(教育部脑科学前沿中心) Fudan University(复旦大学) School of Mathematical Sciences, SCMS, SCAM, and CCSB(数学科学学院、SCMS、SCAM和CCSB) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

AI总结 本文提出一种无需模型的框架,结合动力学系统的稳定性与敏感性指标与回声计算,通过观测时间序列数据预测临界点,实验表明其在动态可解释性、预测稳定性及超早期预测能力上优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14886 2026-03-17 cs.CV

PASTE: Physics-Aware Scattering Topology Embedding Framework for SAR Object Detection

PASTE:面向SAR目标检测的物理感知散射拓扑嵌入框架

Jiacheng Chen, Yuxuan Xiong, Haipeng Wang

机构 * Key Laboratory for Information Science of Electromagnetic Waves (MoE), Fudan University(电磁波信息科学国家重点实验室(MoE),复旦大学)

AI总结 本文提出PASTE框架,通过整合散射物理机制,提升SAR目标检测性能,实验表明其在多种检测器上实现2.9%-11.3%的mAP提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14853 2026-03-17 cs.SD

WhispSynth: Scaling Multilingual Whisper Corpus through Real Data Curation and A Novel Pitch-free Generative Framework

WhispSynth:通过真实数据整理和一种新的无音高生成框架扩展多语言Whisper语料库

Tianyi Tan, Jiaxin Ye, Yuanming Zhang, Xiaohuai Le, Xianjun Xia, Chuanzeng Huang, Jing Lu

机构 * Key Laboratory of Modern Acoustics, Nanjing University(南京大学现代声学重点实验室) Fudan University(复旦大学) ByteDance(字节跳动)

AI总结 本文提出WhispSynth,通过新型高保真生成框架构建大规模多语言语料库,利用DDSP基于的无音高方法与TTS模型结合,生成118小时高质量whisper语音,提升文本到whisper研究的鲁棒性。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13676 2026-03-17 cs.AI

TheraAgent: Multi-Agent Framework with Self-Evolving Memory and Evidence-Calibrated Reasoning for PET Theranostics

TheraAgent:具有自我进化记忆和证据校准推理的多智能体框架用于PET治疗诊断

Zhihao Chen, Jiahui Wang, Yizhou Chen, Xiaozhong Ji, Xiaobin Hu, Jimin Hong, Wolfram Andreas Bosbach, Axel Rominger, Ali Afshar-Oromieh, Hongming Shan, Kuangyu Shi

机构 * Fudan University(复旦大学) University of Bern(伯尔尼大学) Nanjing University(南京大学) National University of Singapore(新加坡国立大学)

AI总结 TheraAgent通过自我进化记忆和证据校准推理,解决PET治疗诊断中数据稀缺、信息异构和证据推理的问题,实现75.7%的准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13466 2026-03-17 eess.IV cs.CV

Open World MRI Reconstruction with Bias-Calibrated Adaptation

开放世界MRI重建中的偏置校准适应

Jiyao Liu, Shangqi Gao, Lihao Liu, Junzhi Ning, Jinjie Wei, Junjun He, Xiahai Zhuang, Ningsheng Xu

机构 * Fudan University, Shanghai, China(复旦大学,上海,中国) University of Cambridge, Cambridge, United Kingdom(剑桥大学,剑桥,英国) Shanghai Artificial Intelligence Laboratory, Shanghai, China(上海人工智能实验室,上海,中国)

AI总结 本文提出BiasRecon框架,通过最小干预原则实现开放世界MRI重建,通过频率引导先验校准、基于分数的去噪和自适应正则化,实现鲁棒适应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13382 2026-03-17 cs.CV

DINOv3 with Test-Time Calibration for Automated Carotid Intima-Media Thickness Measurement on CUBS v1

DINOv3结合测试时间校准用于CUBS v1上自动颈动脉内膜中层厚度测量

Zhenpeng Zhang, Jinwei Lu, Yurui Dong, Bo Yuan

机构 * School of Basic Medical Sciences, Fudan University, Shanghai 200032, China(复旦大学基础医学学院,上海,中国) Institute of Medical Genetics and Genomics, Fudan University, Shanghai 200032, China(复旦大学医学遗传与基因组学研究院,上海,中国) Fudan University, Shanghai, China(复旦大学,上海,中国)

AI总结 本文提出基于DINOv3的框架,用于颈动脉内膜中层复杂分割及后续CIMT测量,通过测试时间校准提升测量精度,实验结果显示其在CUBS v1数据集上具有较高的Dice和IoU指标,且误差范围在临床相关范围内。

Comments 9 pages,3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13292 2026-03-17 cs.LG cs.AI

Pragma-VL: Towards a Pragmatic Arbitration of Safety and Helpfulness in MLLMs

Pragma-VL:迈向多模态大语言模型中安全与助人的务实仲裁

Ming Wen, Kun Yang, Xin Chen, Jingyu Zhang, Dingding Han, Shiwen Cui, Yuedong Xu

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) Ant Group(蚂蚁集团) Zhejiang University(浙江大学) UCLA(加州大学洛杉矶分校) Shenzhen Loop Area Institute(深圳河套学院)

AI总结 Pragma-VL通过引入一种端到端的对齐算法,解决了多模态大语言模型在安全与助人之间的平衡问题,通过增强视觉风险感知和理论保证的奖励模型,在多数多模态安全基准上提升了性能。

Comments 31 pages, ICLR2026

详情

展开后加载摘要…

URL PDF HTML 收藏