arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Fudan University(复旦大学)

共收录 1936
2601.18543 2026-01-29 cs.CV

GenAgent: Scaling Text-to-Image Generation via Agentic Multimodal Reasoning

GenAgent:通过代理多模态推理扩展文本到图像生成

Kaixun Jiang, Yuzheng Wang, Junjie Zhou, Pandeng Li, Zhihang Liu, Chen-Wei Xie, Zhaoyu Chen, Yun Zheng, Wenqiang Zhang

机构 * Fudan University(复旦大学) Tongyi Lab(通义实验室) Nanjing University(南京大学) University of Science and Technology of China(中国科学技术大学)

AI总结 GenAgent通过代理多模态推理提升文本到图像生成性能,采用两阶段训练策略实现自主多轮交互与任务自适应推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23565 2026-01-29 cs.CV cs.AI

RxnBench: A Multimodal Benchmark for Evaluating Large Language Models on Chemical Reaction Understanding from Scientific Literature

RxnBench: 一个用于评估大语言模型在科学文献中理解化学反应的多模态基准

Hanzheng Li, Xi Fang, Yixuan Li, Chaozheng Huang, Junjie Wang, Xi Wang, Hongzhe Bai, Bojun Hao, Shenyu Lin, Huiqi Liang, Linfeng Zhang, Guolin Ke

机构 * DP Technology(DP技术公司) Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学) Peking University(北京大学) New York University(纽约大学) Fudan University(复旦大学) Xiamen University(厦门大学) ShanghaiTech University(上海科技大学)

AI总结 RxnBench通过两个任务评估大语言模型在化学反应理解上的能力,揭示模型在深度化学逻辑和结构识别上的不足,强调需改进视觉编码和推理能力以推动AI化学发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19920 2026-01-29 cs.LG cs.AI

Mitigating LLM Hallucination via Behaviorally Calibrated Reinforcement Learning

通过行为校准强化学习缓解大语言模型幻觉

Jiayun Wu, Jiashuo Liu, Zhiyuan Zeng, Tianyang Zhan, Tianle Cai, Wenhao Huang

机构 * Carnegie Mellon University(卡内基梅隆大学) Fudan University(复旦大学)

AI总结 本文通过行为校准强化学习提升大语言模型的不确定性量化能力,使其在数学推理和事实问答任务中表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21789 2026-01-29 cs.MA cs.CV

Visual Multi-Agent System: Mitigating Hallucination Snowballing via Visual Flow

视觉多智能体系统:通过视觉流缓解幻觉雪球效应

Xinlei Yu, Chengming Xu, Guibin Zhang, Yongbo He, Zhangquan Chen, Zhucun Xue, Jiangning Zhang, Yue Liao, Xiaobin Hu, Yu-Gang Jiang, Shuicheng Yan

机构 * National University of Singapore(国立新加坡大学) Tencent Youtu Lab(腾讯优图实验室) Zhejiang University(浙江大学) Tsinghua University(清华大学) Fudan University(复旦大学)

AI总结 本文提出ViF方法,通过视觉流和注意力重新分配缓解多智能体系统中的视觉幻觉雪球效应,提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13332 2026-01-29 cs.CL

The Imitation Game: Turing Machine Imitator is Length Generalizable Reasoner

模仿游戏:图灵机模仿器是长度可推广的推理机

Zhouqi Hua, Wenwei Zhang, Chengqi Lyu, Yuzhe Gu, Songyang Gao, Kuikun Liu, Dahua Lin, Kai Chen

机构 * Fudan University(复旦大学) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) MMLab, The Chinese University of Hong Kong(香港中文大学MMLab)

AI总结 本文提出TAIL方法,通过合成图灵机执行过程的链式思维数据,提升LLM的长度泛化能力,超越现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04207 2026-01-29 cs.LG cs.AI cs.CL cs.CV

Advancing Multimodal Reasoning: From Optimized Cold Start to Staged Reinforcement Learning

推动多模态推理:从优化冷启动到分阶段强化学习

Shuang Chen, Yue Guo, Zhaochen Su, Yafu Li, Yulun Wu, Jiacheng Chen, Jiayu Chen, Weijie Wang, Xiaoye Qu, Yu Cheng

机构 * Zhejiang University(浙江大学) Fudan University(复旦大学) Soochow University(苏州大学) Shanghai AI Laboratory(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学)

AI总结 本文提出ReVisual-R1,通过优化冷启动和分阶段强化学习提升多模态推理能力,在多个挑战性基准测试中取得新突破。

Comments 19 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19773 2026-01-28 cs.CL

Strong Reasoning Isn't Enough: Evaluating Evidence Elicitation in Interactive Diagnosis

强推理并不足够:评估交互诊断中的证据获取

Zhuohan Long, Zhijie Bao, Zhongyu Wei

机构 * School of Data Science, Fudan University(复旦大学数据科学学院)

AI总结 本文提出REFINE策略,通过诊断验证引导代理主动解决不确定性,提升交互诊断中证据获取效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19611 2026-01-28 cs.LG cs.AI cs.CL

Explicit Multi-head Attention for Inter-head Interaction in Large Language Models

显式多头注意力机制用于大语言模型中头间的交互

Runyu Peng, Yunhua Zhou, Demin Song, Kai Lv, Bo Wang, Qipeng Guo, Xipeng Qiu

机构 * Shanghai AI Laboratory(上海人工智能实验室) Fudan University(复旦大学)

AI总结 本文提出显式多头注意力机制,通过显式建模头间交互提升注意力性能,实现更高效的参数利用和内存压缩,同时保持模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19578 2026-01-28 cs.CL

Yunque DeepResearch Technical Report

Yunque DeepResearch 技术报告

Yuxuan Cai, Xinyi Lai, Peng Yuan, Weiting Liu, Huajian Li, Mingda Li, Xinghua Wang, Shengxie Zheng, Yanchao Hao, Yuyang Yin, Zheng Wei

机构 * Tencent BAC(腾讯BAC) Tsinghua University(清华大学) Fudan University(复旦大学)

AI总结 Yunque DeepResearch提出了一种分层、模块化且稳健的框架,通过多代理协调、动态上下文管理和主动监督模块解决深度研究中的关键挑战,实现先进性能并开源支持社区发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19496 2026-01-28 cs.RO

Self-Reconfiguration Planning for Deformable Quadrilateral Modular Robots

可变形四边形模块化机器人的自重构规划

Jie Gu, Hongrun Gao, Zhihao Xia, Yirun Sun, Chunxu Tian, Dan Zhang

机构 * Institute of AI and Robotics, Academy for Engineering & Technology, Fudan University(人工智能与机器人研究所,工程与技术学院,复旦大学) Department of Mechanical Engineering, The Hong Kong Polytechnic University(机械工程系,香港理工大学)

AI总结 本文提出了一种针对可变形四边形模块化机器人的自重构规划算法,通过虚拟图和依赖性反树实现稳定连接,验证了其在效率和稳定性上的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15751 2026-01-28 cs.AI

Tabular Incremental Inference

表格增量推断

Xinda Chen, Zhen Xing, Hanyu Zhang, Weimin Tan, Bo Yan

机构 * Fudan University(复旦大学)

AI总结 本文提出表格增量推断任务,通过引入大语言模型占位符和预训练TabAdapter,使模型在推断阶段能动态融入新列,提升AI在动态表格场景中的实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15600 2026-01-28 cs.AI cs.CL

Unleashing Scientific Reasoning for Bio-experimental Protocol Generation via Structured Component-based Reward Mechanism

通过结构化组件奖励机制解锁生物实验协议生成中的科学推理

Haoran Sun, Yankai Jiang, Zhenyu Tang, Yaning Pan, Shuang Gu, Zekai Lin, Lilong Wang, Wenjie Lou, Lei Liu, Lei Bai, Xiaosong Wang

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Fudan University(复旦大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 通过结构化组件奖励机制,Thoth在多个基准测试中超越了现有LLMs,实现了更准确的生物实验协议生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13356 2026-01-28 cs.RO

MODUR: A Modular Dual-reconfigurable Robot

MODUR:一种模块化双级可重构机器人

Jie Gu, Tin Lun Lam, Chunxu Tian, Zhihao Xia, Yongheng Xing, Dan Zhang

机构 * Institute of AI and Robotics, Academy for Engineering & Technology, Fudan University(人工智能与机器人研究院,工程与技术学院,复旦大学) School of Science and Engineering, The Chinese University of Hong Kong, Shenzhen(科学与工程学院,香港中文大学(深圳)) Shenzhen Institute of Artificial Intelligence and Robotics for Society(深圳人工智能与机器人社会研究院) Department of Mechanical Engineering, The Hong Kong Polytechnic University(机械工程系,香港理工大学)

AI总结 MODUR是一种具备双级重构能力的模块化机器人,通过紧凑连接器和剪式连杆组实现模块自我重构与基本运动执行。

Journal ref Proceedings of the 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), pp. 10212-10219

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11027 2026-01-28 cs.CV

Vlaser: Vision-Language-Action Model with Synergistic Embodied Reasoning

Vlaser:具有协同具身推理能力的视觉-语言-动作模型

Ganlin Yang, Tianyi Zhang, Haoran Hao, Weiyun Wang, Yibin Liu, Dehui Wang, Guanzhou Chen, Zijian Cai, Junting Chen, Weijie Su, Wengang Zhou, Yu Qiao, Jifeng Dai, Jiangmiao Pang, Gen Luo, Wenhai Wang, Yao Mu, Zhi Hou

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学) Nanjing University(南京大学) Fudan University(复旦大学) Tsinghua University(清华大学) NUS(新加坡国立大学) Northeastern University(东北大学) Shenzhen University(深圳大学)

AI总结 Vlaser通过整合高级推理与低级控制,解决了具身推理与VLA策略学习之间的关键差距,在多个基准测试中取得最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18844 2026-01-28 cs.SE cs.AI

Reducing False Positives in Static Bug Detection with LLMs: An Empirical Study in Industry

利用大语言模型减少静态bug检测中的误报:一项行业内的实证研究

Xueying Du, Jiayi Feng, Yi Zou, Wei Xu, Jie Ma, Wei Zhang, Sisi Liu, Xin Peng, Yiling Lou

机构 * Fudan University(复旦大学) Tencent(腾讯)

AI总结 本研究利用大语言模型在腾讯企业环境中减少静态代码分析中的误报,通过实证研究展示LLM在工业场景下的高效性和成本效益。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18305 2026-01-27 cs.CV

SwipeGen: Bridging the Execution Gap in GUI Agents via Human-like Swipe Synthesis

SwipeGen: 通过类人滑动合成弥合GUI代理的执行差距

Xuan Wang, Siyuan Su, Quantong Fu, Yongxiang Hu, Yangfan Zhou

机构 * College of Computer Science and Artificial Intelligence, Fudan University(计算机科学与人工智能学院,复旦大学) Shanghai Key Laboratory of Intelligent Information Processing(上海智能信息处理重点实验室)

AI总结 SwipeGen通过合成类人滑动交互提升GUI代理的执行能力,实验显示其滑动执行准确率较基线提升214%。

Comments 15 pages, 3 figures. Under review. Code and dataset will be released upon acceptance

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15169 2026-01-27 cs.AI

SafeRBench: Dissecting the Reasoning Safety of Large Language Models

SafeRBench: 解析大语言模型推理安全性的本质

Xin Gao, Shaohan Yu, Zerui Chen, Yueming Lyu, Weichen Yu, Guanghao Li, Jiyao Liu, Jianxiong Gao, Jian Liang, Ziwei Liu, Chenyang Si

机构 * Nanjing University(南京大学) Fudan University(复旦大学) Carnegie Mellon University(卡内基梅隆大学) Chinese Academy of Sciences(中国科学院) Nanyang Technological University(南洋理工大学)

AI总结 SafeRBench通过端到端评估方法解析大语言模型推理过程中的安全性问题,提出风险分层探测、微思维分析和10项细粒度指标,揭示大模型在增强安全性的同时可能增加可操作风险的悖论。

Comments 29 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17743 2026-01-27 cs.CV

VideoPro: Adaptive Program Reasoning for Long Video Understanding

VideoPro: 针对长视频理解的自适应程序推理

Chenglin Li, Feng Han, Yikun Wang, Ruilin Li, Shuai Dong, Haowen Hou, Haitao Li, Qianglong Chen, Feng Tao, Jingqi Tong, Yin Zhang, Jiaqi Wang

机构 * Zhejiang University(浙江大学) Fudan University(复旦大学) Wuhan University(武汉大学) Shanghai Innovation Institute(上海创新研究院)

AI总结 VideoPro通过自适应程序推理框架提升长视频理解的效率和可靠性,利用快慢推理机制和参数优化在视觉任务中取得更高准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19005 2026-01-27 cs.AI cs.CL

Building Self-Evolving Agents via Experience-Driven Lifelong Learning: A Framework and Benchmark

通过经验驱动的终身学习构建自进化代理:一种框架和基准

Yuxuan Cai, Yipeng Hao, Jie Zhou, Hang Yan, Zhikai Lei, Rui Zhen, Zhenhua Han, Yutao Yang, Junsong Li, Qianjun Pan, Tianyu Huai, Qin Chen, Xin Li, Kai Chen, Bo Zhang, Xipeng Qiu, Liang He

机构 * School of Computer Science and Technology, East China Normal University(东华师范大学计算机科学与技术学院) Shanghai AI Laboratory(上海人工智能实验室) The Chinese University of HongKong(香港中文大学) Fudan University(复旦大学)

AI总结 本文提出经验驱动的终身学习框架和StuLife基准数据集,旨在构建能够持续学习和进化的自进化代理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16944 2026-01-27 cs.LG cs.AI

Pretrain Value, Not Reward: Decoupled Value Policy Optimization

预训练价值,而非奖励:解耦的价值策略优化

Chenghua Huang, Lu Wang, Fangkai Yang, Pu Zhao, Zhixu Li, Qingwei Lin, Dongmei Zhang, Saravan Rajmohan, Qi Zhang

机构 * School of Computer Science, Fudan University(复旦大学计算机学院) Microsoft(微软公司)

AI总结 本文提出了解耦的价值策略优化方法,通过预训练价值模型替代传统奖励模型,实现了更稳定高效的强化学习。

Comments 16 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17507 2026-01-27 cs.RO

MetaWorld: Skill Transfer and Composition in a Hierarchical World Model for Grounding High-Level Instructions

MetaWorld: 一个用于地面指令基础的分层世界模型中的技能迁移与组合

Yutong Shen, Hangxu Liu, Kailin Pei, Ruizhe Xia, Tongtong Feng

机构 * Beijing University of Technology(北京理工大学) Fudan University(复旦大学) Tsinghua University(清华大学)

AI总结 MetaWorld通过整合语义规划与物理控制,利用专家策略迁移提升人形机器人在定位-操作任务中的性能。

Comments 8 pages, 4 figures, Submitted to ICLR 2026 World Model Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17350 2026-01-27 cs.CV cs.AI

NeRF-MIR: Towards High-Quality Restoration of Masked Images with Neural Radiance Fields

NeRF-MIR:面向基于神经辐射场的遮挡图像高质量恢复

Xianliang Huang, Zhizhou Zhong, Shuhang Chen, Yi Xu, Juhong Guan, Shuigeng Zhou

机构 * Shanghai Key Lab of Intelligent Information Processing(上海智能信息处理重点实验室) College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院) School of Computer Science and Technology, Tongji University(同济大学计算机科学与技术学院)

AI总结 NeRF-MIR通过PERE和PIRE机制提升遮挡图像恢复质量,采用动态加权损失函数和多视角信息融合,实现更精确的3D场景重建。

Comments 14 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14054 2026-01-27 cs.CR cs.DC cs.LG

SecureSplit: Mitigating Backdoor Attacks in Split Learning

SecureSplit: 缓解分裂学习中的后门攻击

Zhihao Dou, Dongfei Cui, Weida Wang, Anjun Gao, Yueyang Quan, Mengyao Ma, Viet Vo, Guangdong Bai, Zhuqing Liu, Minghong Fang

机构 * Case Western Reserve University(凯斯西储大学) Northeast Electric Power University(东北电力大学) Fudan University(复旦大学) University of Louisville(路易斯维尔大学) University of North Texas(北德克萨斯大学) The University of Queensland(昆士兰大学) Swinburne University of Technology(斯威本科技大学) City University of Hong Kong(香港城市大学)

AI总结 SecureSplit通过维度变换和自适应过滤方法有效缓解分裂学习中的后门攻击问题。

Comments To appear in The Web Conference 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12323 2026-01-27 cs.AI

MARO: Learning Stronger Reasoning from Social Interaction

MARO:从社交互动中学习更强的推理能力

Yin Cai, Zhouhong Gu, Juntao Zhang, Ping Chen

机构 * College of Computer Science and Artificial Intelligence, Fudan University(计算机科学与人工智能学院,复旦大学)

AI总结 MARO通过多智能体社交环境提升大语言模型的推理能力,解决稀疏信号、角色分布不均和环境不稳定问题,实验显示其在社交推理和跨任务迁移上的显著效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17047 2026-01-27 cs.CV cs.LG eess.IV

A Contrastive Pre-trained Foundation Model for Deciphering Imaging Noisomics across Modalities

一种用于跨模态解码成像噪声组学的对比预训练基础模型

Yuanjie Gu, Yiqun Wang, Chaohui Yu, Ang Xuan, Fan Wang, Zhi Lu, Biqin Dong

机构 * College of Biomedical Engineering, Yiwu Research Institute, Fudan University, Shanghai, China(复旦大学生物医学工程学院) Department of Psychological and Cognitive Sciences, Tsinghua University, Beijing, China(清华大学心理学与认知科学系) Shanghai Innovation Institute, Shanghai, China(上海创新研究院) DAMO Academy, Alibaba Group, Beijing, China(阿里云达摩院) Hupan Laboratory, Hangzhou, Zhejiang, China(华平实验室)

AI总结 本文提出CoP基础模型,通过对比学习解码成像噪声,实现无需大量数据的高性能噪声分析,提升跨模态成像诊断的精度与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16486 2026-01-26 cs.CL cs.AI

Timely Machine: Awareness of Time Makes Test-Time Scaling Agentic

及时机器:时间意识使测试时间缩放成为代理

Yichuan Ma, Linyang Li, Yongkang chen, Peiji Li, Xiaozhe Li, Qipeng Guo, Dahua Lin, Kai Chen

机构 * Fudan University Shanghai AI Laboratory(复旦大学上海人工智能实验室) Shanghai AI Laboratory(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学)

AI总结 Timely Machine通过重新定义测试时间为实时时钟时间,提出Timely-RL方法提升时间预算意识,以应对高频工具调用和时间受限推理的挑战。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16480 2026-01-26 cs.CL

TL-GRPO: Turn-Level RL for Reasoning-Guided Iterative Optimization

TL-GRPO:基于回合的强化学习用于推理引导的迭代优化

Peiji Li, Linyang Li, Handa Sun, Wenjin Mai, Yongkang Chen, Xiaozhe Li, Yue Shen, Yichuan Ma, Yiliu Sun, Jiaxi Cao, Zhishu He, Bo Wang, Xiaoqing Zheng, Zhaori Bi, Xipeng Qiu, Qipeng Guo, Kai Chen, Dahua Lin

机构 * Fudan University(复旦大学) Shanghai AI Laboratory(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学)

AI总结 TL-GRPO通过回合级分组采样优化解决迭代优化任务中的轨迹级强化学习问题,实现更精细的优化效果。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16447 2026-01-26 cs.CL

Mixing Expert Knowledge: Bring Human Thoughts Back To the Game of Go

融合专家知识:将人类思维带回围棋游戏

Yichuan Ma, Linyang Li, Yongkang Chen, Peiji Li, Jiasheng Ye, Qipeng Guo, Dahua Lin, Kai Chen

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Fudan University(复旦大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 LoGos通过融合围棋专家知识与通用推理能力,实现了在围棋领域的专业水平表现,展示了自然语言推理和战略决策能力。

Comments Accepted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15876 2026-01-26 cs.AI

EvoCUA: Evolving Computer Use Agents via Learning from Scalable Synthetic Experience

EvoCUA:通过可扩展的合成经验学习来进化计算机使用代理

Taofeng Xue, Chong Peng, Mianqiu Huang, Linsen Guo, Tiancheng Han, Haozhe Wang, Jianing Wang, Xiaocheng Zhang, Xin Yang, Dengchang Zhao, Jinrui Ding, Xiandi Ma, Yuchen Xie, Peng Pei, Xunliang Cai, Xipeng Qiu

机构 * Meituan(美团) Fudan University(复旦大学) Tongji University(同济大学) The Hong Kong University of Science and Technology(香港理工大学)

AI总结 EvoCUA通过可扩展的合成经验学习进化计算机使用代理,实现更高性能和通用性。

Comments 26 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00505 2026-01-26 cs.CL

Zero-RAG: Towards Retrieval-Augmented Generation with Zero Redundant Knowledge

零冗余知识下的检索增强生成:Zero-RAG

Qi Luo, Xiaonan Li, Junqi Dai, Shuang Cheng, Xipeng Qiu

机构 * School of Computer Science, Fudan University(复旦大学计算机学院)

AI总结 Zero-RAG通过修剪冗余知识和优化检索流程,提升LLM在减少冗余信息下的生成性能。

Journal ref Frontiers of Computer Science (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏