arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Fudan University(复旦大学)

共收录 1936
2505.19097 2025-12-02 cs.LG stat.ML

Towards Robust Influence Functions with Flat Validation Minima

迈向具有平坦验证极小值的鲁棒影响函数

Xichen Ye, Yifan Wu, Weizhong Zhang, Cheng Jin, Yifan Chen

机构 * Fudan University(复旦大学) Hong Kong Baptist University(香港 Baptist 大学) Shanghai Key Laboratory of Intelligent Information Processing(上海智能信息处理关键实验室) Innovation Center of Calligraphy and Painting Creation Technology(书法和绘画创作技术创新中心)

AI总结 本文提出了一种针对平坦验证极小值的影响函数估计方法,解决了深度学习中因验证风险尖锐性导致的影响估计不准确问题。

Comments Accepted by ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19221 2025-12-01 cs.CV cs.RO

Percept-WAM: Perception-Enhanced World-Awareness-Action Model for Robust End-to-End Autonomous Driving

Percept-WAM:感知增强的环境感知-行动模型用于鲁棒的端到端自动驾驶

Jianhua Han, Meng Tian, Jiangtong Zhu, Fan He, Huixin Zhang, Sitong Guo, Dechang Zhu, Hao Tang, Pei Xu, Yuze Guo, Minzhe Niu, Haojie Zhu, Qichao Dong, Xuechao Yan, Siyuan Dong, Lu Hou, Qingqiu Huang, Xiaosong Jia, Hang Xu

机构 * Yinwang Intelligent Technology Co. Ltd.(亿网通智能科技有限公司) Fudan University(复旦大学)

AI总结 Percept-WAM通过整合2D/3D场景理解能力,提升自动驾驶的感知与行动决策,实现端到端鲁棒性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24693 2025-12-01 cs.SD cs.CL eess.AS

STAR-Bench: Probing Deep Spatio-Temporal Reasoning as Audio 4D Intelligence

STAR-Bench:探测深度时空推理作为音频4D智能

Zihan Liu, Zhikang Niu, Qiuyang Xiao, Zhisheng Zheng, Ruoqi Yuan, Yuhang Zang, Yuhang Cao, Xiaoyi Dong, Jianze Liang, Xie Chen, Leilei Sun, Dahua Lin, Jiaqi Wang

机构 * Fudan University(复旦大学) Shanghai AI Laboratory(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学) Shanghai Innovation Institute(上海创新研究院) Beihang University(北京航空航天大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 STAR-Bench通过测试音频4D智能,揭示了模型在细粒度感知和推理上的不足,为未来模型发展提供方向。

Comments Homepage: https://internlm.github.io/StarBench/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04327 2025-12-01 cs.LG stat.ML

Arithmetic-Mean $μ$P for Modern Architectures: A Unified Learning-Rate Scale for CNNs and ResNets

算术平均μP用于现代架构:CNN和ResNets的统一学习率缩放

Haosong Zhang, Shenxi Wu, Yichi Zhang, Xi Chen, Wei Lin

机构 * Fudan University(复旦大学) New York University(纽约大学)

AI总结 本文提出算术平均μP,通过统一学习率缩放方法,为CNN和ResNets提供稳健的深度定律,实现零样本学习率转移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02373 2025-12-01 cs.CV

Active Negative Loss: A Robust Framework for Learning with Noisy Labels

主动负损失:一种在噪声标签下学习的稳健框架

Xichen Ye, Yifan Wu, Yiqi Wang, Xiaoqiang Li, Weizhong Zhang, Yifan Chen

机构 * School of Computer Engineering and Science, Shanghai University(上海大学计算机工程与科学学院) School of Computer Science, Fudan University(复旦大学计算机科学学院) School of Data Science, Fudan University(复旦大学数据科学学院) Departments of Computer Science and Math, Hong Kong Baptist University(香港 Baptist 大学计算机科学与数学系)

AI总结 本文提出主动负损失框架,通过改进的损失函数增强在噪声标签下的学习鲁棒性。

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21444 2025-11-27 cs.AI physics.ao-ph

EWE: An Agentic Framework for Extreme Weather Analysis

EWE:极端天气分析的代理框架

Zhe Jiang, Jiong Wang, Xiaoyu Yue, Zijie Guo, Wenlong Zhang, Fenghua Ling, Wanli Ouyang, Lei Bai

机构 * Fudan University(复旦大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) The University of Sydney(悉尼大学)

AI总结 EWE是首个用于极端天气分析的智能代理框架,通过知识引导的规划和闭环推理实现自动化诊断,提供首个该领域基准测试,推动科学发现民主化进程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20716 2025-11-27 cs.CV eess.IV

Video Object Recognition in Mobile Edge Networks: Local Tracking or Edge Detection?

移动端边缘网络中的视频物体识别:局部跟踪还是边缘检测?

Kun Guo, Yun Shen, Xijun Wang, Chaoqun You, Yun Rui, Tony Q. S. Quek

机构 * School of Communications and Electronics Engineering, East China Normal University(电子信息工程学院,华东师范大学) School of Electronics and Information Technology, Sun Yat-sen University(电子信息技术学院,中山大学) School of Computer Science, Fudan University(计算机科学学院,复旦大学) Information Systems Technology and Design Pillar, Singapore University of Technology and Design(信息系统技术与设计学院,新加坡科技设计大学)

AI总结 本文提出LTED-Ada算法,结合深度强化学习和联邦学习,在移动端边缘网络中实现自适应的视频物体识别,通过本地跟踪与边缘检测的动态决策提升识别效率与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19218 2025-11-27 cs.CR cs.AI

Adversarial Attack-Defense Co-Evolution for LLM Safety Alignment via Tree-Group Dual-Aware Search and Optimization

对抗攻击-防御共演进用于LLM安全对齐的树组双感知搜索与优化

Xurui Li, Kaisong Song, Rui Zhu, Pin-Yu Chen, Haixu Tang

机构 * Fudan University(复旦大学) Alibaba Group(阿里巴巴集团) Yale University(耶鲁大学) IBM Research AI(IBM人工智能研究) Indiana University(印第安纳大学)

AI总结 ACE-Safety通过树组双感知搜索与优化,共同优化攻击与防御模型,提升LLM的安全对齐能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25628 2025-11-26 cs.CL

EHR-R1: A Reasoning-Enhanced Foundational Language Model for Electronic Health Record Analysis

EHR-R1: 一种增强推理能力的基础语言模型用于电子健康记录分析

Yusheng Liao, Chaoyi Wu, Junwei Liu, Shuyang Jiang, Pengcheng Qiu, Haowen Wang, Yun Yue, Shuai Zhen, Jian Wang, Qianrui Fan, Jinjie Gu, Ya Zhang, Yanfeng Wang, Yu Wang, Weidi Xie

机构 * Shanghai Jiao Tong University(上海交通大学) Intelligence Healthcare Department, AntGroup(智能医疗部,蚂蚁集团) Intelligence Computing and Sensing Laboratory, Peking University(智能计算与感知实验室,北京大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Fudan University(复旦大学)

AI总结 EHR-R1是一种针对电子健康记录分析设计的增强推理能力的基础语言模型,通过大规模推理数据集和多阶段训练方法提升了EHR分析的准确性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11895 2025-11-26 cs.CV

Adversarial Robustness for Unified Multi-Modal Encoders via Efficient Calibration

通过高效校准实现统一多模态编码器的对抗鲁棒性

Chih-Ting Liao, Zhangquan Chen, Chunlei Meng, Tzu-Yu Huang, Xin Cao, Xu Zheng

机构 * UNSW Sydney(新南威尔士大学悉尼分校) Tsinghua University(清华大学) Fudan University(复旦大学) UTS(澳大利亚UTS大学) HKUST(GZ)(香港理工大学(广州))

AI总结 本研究提出高效对抗校准框架,提升统一多模态编码器的对抗鲁棒性,同时保持清洁性能,提升47.3%的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19426 2025-11-25 cs.CV

Ref-SAM3D: Bridging SAM3D with Text for Reference 3D Reconstruction

Ref-SAM3D: 通过文本连接SAM3D与参考3D重建

Yun Zhou, Yaoting Wang, Guangquan Jie, Jinyu Liu, Henghui Ding

机构 * Institute of Big Data, College of Computer Science and Artificial Intelligence, Fudan University(大数据研究院,计算机科学与人工智能学院,复旦大学)

AI总结 Ref-SAM3D通过引入文本描述作为先验,实现基于单张图像的文本引导3D重建,提升零样本重建性能。

Comments Code: https://github.com/FudanCVL/Ref-SAM3D

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19368 2025-11-25 cs.LG cs.NI

LLM-Driven Stationarity-Aware Expert Demonstrations for Multi-Agent Reinforcement Learning in Mobile Systems

基于大语言模型的站稳意识专家示范的多智能体强化学习在移动系统中的应用

Tianyang Duan, Zongyuan Zhang, Zheng Lin, Songxiao Guo, Xiuxian Guan, Guangyu Wu, Zihan Fang, Haotian Meng, Xia Du, Ji-Zhe Zhou, Heming Cui, Jun Luo, Yue Gao

机构 * Division of Computer Science, The University of Hong Kong(计算机科学系,香港大学) Department of Electrical and Electronic Engineering, The University of Hong Kong(电气电子工程系,香港大学) Department of Computer Science and Technology, Peking University(计算机科学与技术系,北京大学) Department of Computer Science, City University of Hong Kong(计算机科学系,城市大学) China Unicom Digital Technology, China Unicom co.,Ltd(中国联合数字技术,中国联合有限公司) School of Computer and Information Engineering, Xiamen University of Technology(计算机与信息工程学院,厦门理工学院) School of Computer Science, Engineering Research Center of Machine Learning and Industry Intelligence, Sichuan University(计算机科学学院,机器学习与工业智能工程研究中心,四川大学) College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学) Institute of Space Internet, Fudan University(空间互联网研究院,复旦大学) School of Computer Science, Fudan University(计算机科学学院,复旦大学)

AI总结 本文提出RELED框架,通过大语言模型驱动的专家示范与自主探索相结合,提升多智能体强化学习在移动系统中的性能和稳定性。

Comments 15 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18934 2025-11-25 cs.CL cs.AI cs.DB

Skeletons Matter: Dynamic Data Augmentation for Text-to-Query

骨架很重要:面向文本到查询的动态数据增强

Yuchen Ji, Bo Xu, Jie Shi, Jiaqing Liang, Deqing Yang, Yu Mao, Hai Chen, Yanghua Xiao

机构 * School of Data Science, Fudan University(复旦大学数据科学学院) School of Computer Science and Technology, Donghua University(东华大学计算机科学与技术学院) College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院) Ant Group(蚂蚁集团) Shanghai Key Laboratory of Data Science(上海数据科学 key laboratory)

AI总结 本文提出一种动态数据增强框架,通过识别查询骨架作为共同优化目标,提升文本到查询任务的泛化能力和效率。

Comments Accepted at EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18921 2025-11-25 cs.CV

BackdoorVLM: A Benchmark for Backdoor Attacks on Vision-Language Models

BackdoorVLM:面向视觉-语言模型的后门攻击基准

Juncheng Li, Yige Li, Hanxun Huang, Yunhao Chen, Xin Wang, Yixu Wang, Xingjun Ma, Yu-Gang Jiang

机构 * Fudan University(复旦大学) Singapore Management University(新加坡管理学院) The University of Melbourne(墨尔本大学)

AI总结 BackdoorVLM提出首个评估视觉-语言模型后门攻击的基准,揭示VLMs对文本指令的高敏感性及多模后门的有效性

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03596 2025-11-25 cs.CV

ControlThinker: Unveiling Latent Semantics for Controllable Image Generation through Visual Reasoning

ControlThinker: 通过视觉推理揭示潜在语义以实现可控图像生成

Feng Han, Yang Jiao, Shaoxiang Chen, Junhao Xu, Jingjing Chen, Yu-Gang Jiang

机构 * Shanghai Key Lab of Intell. Info. Processing, School of CS, Fudan University(上海智能信息处理关键实验室,复旦大学计算机学院) Shanghai Collaborative Innovation Center on Intelligent Visual Computing(上海智能视觉计算协同创新中心) MiniMax

AI总结 ControlThinker通过视觉推理挖掘潜在语义,提升可控图像生成的语义一致性和视觉质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18450 2025-11-25 cs.AI

ORIGAMISPACE: Benchmarking Multimodal LLMs in Multi-Step Spatial Reasoning with Mathematical Constraints

ORIGAMISPACE:基于数学约束的多模态大语言模型多步空间推理基准测试

Rui Xu, Dakuan Lu, Zicheng Zhao, Xiaoyu Tan, Xintao Wang, Siyu Yuan, Jiangjie Chen, Yinghui Xu

机构 * Fudan University(复旦大学) SII INF Technology(INF技术)

AI总结 ORIGAMISPACE通过折纸任务评估多模态大语言模型在多步空间推理和数学约束处理中的能力,提出四个评估任务并探索强化学习训练方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18367 2025-11-25 cs.CV

Alias-free 4D Gaussian Splatting

无别名的4D高斯散射

Zilong Chen, Huan-ang Gao, Delin Qu, Haohan Chi, Hao Tang, Kai Zhang, Hao Zhao

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学) Institute for AI Industry Research (AIR), Tsinghua University(人工智能产业研究院(AIR),清华大学) Beijing Academy of Artificial Intelligence, BAAI(北京人工智能研究院,BAAI) Fudan University(复旦大学) Peking University(北京大学)

AI总结 本研究提出了一种无别名的4D高斯散射方法,通过引入最大采样频率公式和尺度自适应滤波器,有效减少渲染伪影并提升多视角视频重建效率。

Comments Project page: https://4d-alias-free.github.io/4D-Alias-free/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17941 2025-11-25 cs.CV

V2X-RECT: An Efficient V2X Trajectory Prediction Framework via Redundant Interaction Filtering and Tracking Error Correction

V2X-RECT: 一种通过冗余交互过滤和轨迹误差修正的高效V2X轨迹预测框架

Xiangyan Kong, Xuecheng Wu, Xiongwei Zhao, Xiaodong Li, Yunyun Shi, Gang Wang, Dingkang Yang, Yang Liu, Hong Chen, Yulong Gao

机构 * Communication Research Center, Harbin Institute of Technology(哈尔滨工业大学通信研究所) School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院) School of Electronics and Information Engineering, Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)电子与信息工程学院) College of Intelligent Robotics and Advanced Manufacturing, Fudan University(复旦大学智能机器人与先进制造学院) College of Electronic and Information Engineering, Tongji University(同济大学电子与信息工程学院)

AI总结 V2X-RECT通过冗余交互过滤和轨迹误差修正,提升高密度环境下的轨迹预测效率和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01982 2025-11-25 cs.LG cs.CV

Fine-Grained GRPO for Precise Preference Alignment in Flow Models

细粒度GRPO用于流模型中的精确偏好对齐

Yujie Zhou, Pengyang Ling, Jiazi Bu, Yibin Wang, Yuhang Zang, Jiaqi Wang, Li Niu, Guangtao Zhai

机构 * Shanghai Jiao Tong University(上海交通大学) University of Science and Technology of China(中国科学技术大学) Fudan University(复旦大学) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Innovation Institute(上海创新研究院)

AI总结 本文提出细粒度GRPO框架,通过细粒度评估和多粒度整合模块提升流模型中偏好对齐的精度与鲁棒性。

Comments Project Page: https://bujiazi.github.io/g2rpo.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19165 2025-11-25 eess.IV cs.CV

Extreme Cardiac MRI Analysis under Respiratory Motion: Results of the CMRxMotion Challenge

极端呼吸运动下的心脏MRI分析:CMRxMotion挑战结果

Kang Wang, Chen Qin, Zhang Shi, Haoran Wang, Xiwen Zhang, Chen Chen, Cheng Ouyang, Chengliang Dai, Yuanhan Mo, Chenchen Dai, Xutong Kuang, Ruizhe Li, Xin Chen, Xiuzheng Yue, Song Tian, Alejandro Mora-Rubio, Kumaradevan Punithakumar, Shizhan Gong, Qi Dou, Sina Amirrajab, Yasmina Al Khalil, Cian M. Scannell, Lexiaozi Fan, Huili Yang, Xiaowu Sun, Rob van der Geest, Tewodros Weldebirhan Arega, Fabrice Meriaudeau, Caner Özer, Amin Ranem, John Kalkhof, İlkay Öksüz, Anirban Mukhopadhyay, Abdul Qayyum, Moona Mazher, Steven A Niederer, Carles Garcia-Cabrera, Eric Arazo, Michal K. Grzeszczyk, Szymon Płotka, Wanqin Ma, Xiaomeng Li, Rongjun Ge, Yongqing Kou, Xinrong Chen, He Wang, Chengyan Wang, Wenjia Bai, Shuo Wang

机构 * Digital Medical Research Center, School of Basic Medical Sciences, Fudan University, Shanghai, Shanghai 200032, China Shanghai Key Laboratory of MICCAI, Fudan University, Shanghai, Shanghai 200032, China Department of Electrical Electronic Engineering \& I-X, Imperial College London, London, London SW7 2AZ, United Kingdom Department of Radiology, Zhongshan Hospital Affiliated to Fudan University, Shanghai, Shanghai 200032, China Department of Computing, Imperial College London, London, London SW7 2AZ, United Kingdom School of Computer Science, University of Sheffield, Sheffield, S1 4DP, United Kingdom Department of Engineering Science, University of Oxford, Oxford, OX2 0ES, United Kingdom Shanghai Pudong Hospital Human Phenome Institute, Fudan University, Shanghai, 201203, China School of Computer Science, University of Nottingham, Nottingham, NG8 1BB, United Kingdom Diagnostic Imaging, University of Alberta, Edmonton, AB T6G 1K4, Canada Department of Computer Science Engineering, The Chinese University of Hong Kong, Hong Kong, Hong Kong 000000, China The D-Lab, Department of Precision Medicine, GROW - Research Institute for Oncology Reproduction, Maastricht University, 6220 MD Maastricht, The Netherlands Department of Biomedical Engineering, Eindhoven University of Technology, Eindhoven 5612 AZ, The Netherlands Department of Radiology, Northwestern University, 737 N. Michigan Ave, Suite 1600, Chicago 60611, United States United Imaging Research, 393 Middle Huaxia Road, Pudong, Shanghai 201210, China Division of Image Processing, Department of Radiology, Leiden University Medical Center, PO Box 9600, Leiden 2300 RC, The Netherlands Université Bourgogne Europe, CNRS, ICMUB UMR 6302, 21000 Dijon, France Istanbul Technical University, Maslak, 34467, İstanbul, Türkiye Computer Science, Technical University of Darmstadt, Karolinenpl. 5, 64289 Darmstadt, Germany Lung Institute, Faculty of Medicine, Imperial College London, Guy Scadding Building, Cale Street, London, SW3 6LY,United Kingdom Hawkes Institute, Department of Computer Science, University College London, 66-72 Gower St, London, United Kingdom School of Medicine, University College Dublin, Belfield, Dublin, D04 V1W8, Ireland CeADAR: Ireland's Centre for AI, University College Dublin, Belfield, Dublin, D04 V1W8, Ireland Sano Centre for Computational Medicine, Czarnowiejska 36, 30-054, Krakow, Poland Faculty of Mathematics Computer Science, Jagiellonian University, S. Łojasiewicza 6, Krakow, Poland Department of Electronic Computer Engineering, The Hong Kong University of Science School of Instrument Science Engineering, Southeast University, Nanjing, Nanjing 210096, China College of Artificial Intelligence, Nanjing University of Aeronautics Academy for Engineering Technology, Fudan University, Shanghai, Shanghai 200433, China College of Biomedical Engineering, Fudan University, Shanghai, Shanghai 200433, China Institute of Science Technology for Brain-inspired Intelligence, Fudan University, Shanghai, Shanghai 200433, China Department of Brain Sciences, Imperial College London, London, London SW7 2AZ, United Kingdom Data Science Institute, Imperial College London, London, London SW7 2AZ, United Kingdom

AI总结 本文提出CMRxMotion挑战,通过公开数据集评估深度学习模型在呼吸运动干扰下的心脏MRI分析性能,并探讨运动伪影对临床生物标志物的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17501 2025-11-24 cs.CV cs.GR

Native 3D Editing with Full Attention

原生3D编辑与全关注

Weiwei Cai, Shuangkang Fang, Weicai Ye, Xin Dong, Yunhan Yang, Xuanyang Zhang, Wei Cheng, Yanpei Cao, Gang Yu, Tao Chen

机构 * Fudan University(复旦大学) StepFun, Inc.(StepFun公司) Zhejiang University(浙江大学) Tsinghua University(清华大学) VAST

AI总结 本文提出一种高效的原生3D编辑框架,通过多模态数据集和3D标记连接方法,提升3D编辑的效率和一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17225 2025-11-24 cs.RO cs.AI cs.CV

TP-MDDN: Task-Preferenced Multi-Demand-Driven Navigation with Autonomous Decision-Making

TP-MDDN:任务优先的多需求驱动导航与自主决策

Shanshan Li, Da Huang, Yu He, Yanwei Fu, Yu-Gang Jiang, Xiangyang Xue

机构 * Fudan University(复旦大学) Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institution(上海创新机构)

AI总结 TP-MDDN通过引入任务优先的多需求驱动导航与自主决策系统,提升复杂任务下的导航性能与环境理解能力。

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17052 2025-11-24 cs.CV

PathAgent: Toward Interpretable Analysis of Whole-slide Pathology Images via Large Language Model-based Agentic Reasoning

PathAgent: 通过基于大型语言模型的代理推理实现全切片病理图像的可解释分析

Jingyun Chen, Linghan Cai, Zhikang Wang, Yi Huang, Songhan Jiang, Shenjin Huang, Hongpeng Wang, Yongbing Zhang

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Fudan University(复旦大学) Sichuan University(四川大学)

AI总结 PathAgent通过基于大型语言模型的代理推理,实现全切片病理图像的可解释分析,展现出强大的零样本泛化能力和临床应用潜力。

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16709 2025-11-24 cs.CR cs.AI

AutoBackdoor: Automating Backdoor Attacks via LLM Agents

AutoBackdoor: 通过LLM代理自动化后门攻击

Yige Li, Zhe Li, Wei Zhao, Nay Myat Min, Hanxun Huang, Xingjun Ma, Jun Sun

机构 * Singapore Management University(新加坡管理大学) The University of Melbourne(墨尔本大学) Fudan University(复旦大学)

AI总结 AutoBackdoor通过LLM代理自动化后门攻击,实现高效触发器生成和毒化数据构建,验证了对抗防御的脆弱性。

Comments 23 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.00929 2025-11-24 cs.CV

Colo-ReID: Discriminative Representation Embedding with Meta-learning for Colonoscopic Polyp Re-Identification

Colo-ReID: 基于元学习的鉴别性表示嵌入用于结肠镜息肉重识别

Suncheng Xiang, Chengfeng Zhou, Zhengjie Zhang, Shilun Cai, Dahong Qian

机构 * School of Biomedical Engineering, Shanghai Jiao Tong University(生物医学工程学院,上海交通大学) Endoscopy Center, Zhongshan Hospital of Fudan University(复旦大学中山医院内窥镜中心)

AI总结 Colo-ReID通过元学习策略提升结肠镜息肉重识别性能,有效解决领域差距和自差异性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16666 2025-11-21 cs.CV

SceneDesigner: Controllable Multi-Object Image Generation with 9-DoF Pose Manipulation

SceneDesigner: 9自由度姿态操控的可控多物体图像生成

Zhenyuan Qin, Xincheng Shuai, Henghui Ding

机构 * Fudan University(复旦大学)

AI总结 SceneDesigner通过9自由度姿态操控实现多物体图像生成,采用CNOCS图和两阶段训练策略提升可控性与质量。

Comments NeurIPS 2025 (Spotlight), Project Page: https://henghuiding.com/SceneDesigner/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16602 2025-11-21 cs.AI

Bridging VLMs and Embodied Intelligence with Deliberate Practice Policy Optimization

通过刻意练习策略优化弥合视觉语言模型与具身智能之间的鸿沟

Yi Zhang, Che Liu, Xiancong Ren, Hanchu Ni, Yingji Zhang, Shuai Zhang, Zeyuan Ding, Jiayu Hu, Haozhe Shan, Junbo Qi, Yan Bai, Dengjie Li, Jiachen Luo, Yidong Wang, Yong Dai, Zenglin Xu, Bin Shen, Qifan Wang, Jian Tang, Xiaozhu Ju

机构 * X-Humanoid Imperial College London(帝国理工学院) Peking University(北京大学) University of Manchester(曼彻斯特大学) Westlake University(西湖大学) Fudan University(复旦大学) Waseda University(早稻田大学) Nvidia Queen Mary University of London(伦敦大学玛丽女王学院) Celonis AI Meta AI

AI总结 本文提出DPPO框架,通过监督微调与强化学习交替训练,提升具身智能系统在稀疏数据下的学习效率,并在性能和参数规模上取得显著优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13161 2025-11-21 cs.CV

Enhancing Video Large Language Models with Structured Multi-Video Collaborative Reasoning

通过结构化多视频协作推理增强视频大语言模型

Zhihao He, Tianyao He, Yun Xu, Tieyuan Chen, Huabin Liu, Chaofan Gan, Zuxuan Wu, Weiyao Lin

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) Fudan University(复旦大学)

AI总结 本文提出一种多视频协作框架,通过结构化视频表示和图融合模块提升视频大语言模型的推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13246 2025-11-21 cs.CL cs.AI

Atomic Calibration of LLMs in Long-Form Generations

大语言模型在长文本生成中的原子校准

Caiqi Zhang, Ruihan Yang, Zhisong Zhang, Xinting Huang, Sen Yang, Dong Yu, Nigel Collier

机构 * University of Cambridge(剑桥大学) Fudan University(复旦大学) Tencent AI Lab(腾讯AI实验室) The Chinese University of Hong Kong(香港中文大学)

AI总结 本研究提出原子校准方法,用于改进大语言模型在长文本生成中的校准能力,揭示置信度方法与生成过程中置信度变化的关联。

Comments ACL 2025 KnowFM Oral / AACL-IJCNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14760 2025-11-19 cs.CV

UniGen-1.5: Enhancing Image Generation and Editing through Reward Unification in Reinforcement Learning

Rui Tian, Mingfei Gao, Haiming Gang, Jiasen Lu, Zhe Gan, Yinfei Yang, Zuxuan Wu, Afshin Dehghan

机构 * Institute of Trustworthy Embodied AI, Fudan University(可信具身人工智能研究院,复旦大学) Apple(苹果公司)

详情

展开后加载摘要…

URL PDF HTML 收藏