arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Shanghai Jiao Tong University(上海交通大学)

共收录 3178
2504.04706 2026-01-06 cs.LG cs.AI cs.CY

AdvKT: An Adversarial Multi-Step Training Framework for Knowledge Tracing

AdvKT:一种对抗多步训练框架用于知识追踪

Lingyue Fu, Ting Long, Jianghao Lin, Wei Xia, Xinyi Dai, Ruiming Tang, Yasheng Wang, Weinan Zhang, Yong Yu

机构 * Shanghai Jiao Tong University(上海交通大学) Jilin University(吉林大学) Huawei Noah’s Ark Lab(华为诺亚实验室)

AI总结 AdvKT通过对抗学习框架解决知识追踪中的误差积累和数据稀疏性问题,提升智能辅导系统推荐模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.09385 2026-01-06 cs.CV

Towards Vision-Language Geo-Foundation Model: A Survey

迈向视觉-语言地理基础模型:一种综述

Yue Zhou, Zhihang Zhong, Xue Yang

机构 * School of GeoAI(地理人工智能学院) Hindon STAI Institute(Hindon STAI研究所) Key Laboratory of Geographic Information Science (Ministry of Education)(地理信息科学重点实验室) East China Normal University(华东师范大学) School of AI(人工智能学院) Shanghai Jiao Tong University(上海交通大学) School of Automation and Intelligent Sensing(自动化与智能感知学院)

AI总结 本文综述了视觉-语言地理基础模型(VLGFMs),探讨其背景、核心技术和应用,旨在构建具备多样化地理感知能力的智能模型。

Comments 18 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.08745 2026-01-06 eess.IV cs.CV cs.MM

Enhancing Blind Video Quality Assessment with Rich Quality-aware Features

通过丰富的质量感知特征增强盲视频质量评估

Wei Sun, Linhan Cao, Jun Jia, Zhichao Zhang, Zicheng Zhang, Xiongkuo Min, Guangtao Zhai

机构 * East China Normal University(华东师范大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出RQ-VQA方法,通过整合多源特征提升盲视频质量评估的泛化能力与准确性。

Comments RQ-VQA won first place in the CVPR NTIRE 2024 Short-form UGC Video Quality Assessment Challenge

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00862 2026-01-06 cs.LG

Universal Battery Degradation Forecasting Driven by Foundation Model Across Diverse Chemistries and Conditions

基于基础模型的通用电池退化预测:跨多样化学物质和条件

Joey Chan, Huan Wang, Haoyu Pan, Wei Wu, Zirong Wang, Zhen Chen, Ershun Pan, Min Xie, Lifeng Xi

机构 * Department of Industrial Engineering and Management, Shanghai Jiaotong University, Shanghai, China.(工业工程与管理系,上海交通大学,上海,中国) Department of Systems Engineering, The City University of Hong Kong, Hong Kong.(系统工程系,香港城市大学,香港)

AI总结 本文提出基于基础模型的通用电池退化预测框架,通过跨多样化学物质和条件的统一模型,实现稳定性能和高准确性。

Comments Due to space limitations, the open-source method for supporting materials is currently under discussion

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00542 2026-01-05 cs.CV

DynaDrag: Dynamic Drag-Style Image Editing by Motion Prediction

DynaDrag: 通过运动预测实现动态拖拽式图像编辑

Jiacheng Sui, Yujie Zhou, Li Niu

机构 * Shanghai Jiao Tong University(上海交通大学)

AI总结 DynaDrag通过运动预测和动态调整手柄点,实现了更高效的拖拽式图像编辑方法,优于现有技术。

Comments 9 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23328 2026-01-05 cs.AI cs.CL cs.CV

CubeBench: Diagnosing Interactive, Long-Horizon Spatial Reasoning Under Partial Observations

CubeBench: 在部分观察下诊断交互式、长周期空间推理

Huan-ang Gao, Zikang Zhang, Tianwei Luo, Kaisen Yang, Xinzhe Juan, Jiahao Qiu, Tianxing Chen, Bingxiang He, Hao Zhao, Hao Zhou, Shilong Liu, Mengdi Wang

机构 * THU(清华大学) Princeton(普林斯顿大学) SJTU & UMich(上海交通大学 & 密歇根大学) HKU(香港大学)

AI总结 CubeBench通过魔方基准评估LLM在部分观察下的空间推理和长周期任务能力,揭示LLM在长期规划中的根本缺陷。

Comments Webpage: https://cubebench.c7w.tech/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22872 2026-01-05 cs.CV

Lamps: Learning Anatomy from Multiple Perspectives via Self-supervision in Chest Radiographs

Lamps: 通过自监督学习从多视角学习解剖结构

Ziyu Zhou, Haozhe Luo, Mohammad Reza Hosseinzadeh Taher, Jiaxuan Pang, Xiaowei Ding, Michael B. Gotway, Jianming Liang

机构 * Shanghai Jiao Tong University(上海交通大学) Arizona State University(亚利桑那州立大学) University of Bern(伯尔尼大学) Mayo Clinic(梅奥诊所)

AI总结 Lamps通过自监督学习从多视角学习解剖结构,提升医学影像基础模型的鲁棒性和临床应用潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24638 2026-01-01 cs.RO

Resolving State Ambiguity in Robot Manipulation via Adaptive Working Memory Recoding

通过自适应工作记忆重编码解决机器人操作中的状态歧义

Qingda Hu, Ziheng Qiu, Zijun Xu, Kaizhao Zhang, Xizhou Bu, Zuolei Sun, Bo Zhang, Jieru Zhao, Zhongxue Gan, Wenchao Ding

机构 * Fudan Academy for Engineering and Technology, Fudan University(复旦大学工程与技术学院) Westwell(韦斯尔实验室) Department of Computer Science and Engineering, Shanghai Jiao Tong University(上海交通大学计算机科学与工程系)

AI总结 PAM通过自适应工作记忆重编码解决机器人操作中的状态歧义问题,支持300帧历史窗口并保持高推理速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24265 2026-01-01 cs.CL cs.LG

Joint Selection for Large-Scale Pre-Training Data via Policy Gradient-based Mask Learning

通过基于策略梯度的掩码学习进行大规模预训练数据的联合选择

Ziqing Fan, Yuqiao Xian, Yan Sun, Li Shen

机构 * Shanghai Jiao Tong University(上海交通大学) University of Sydney(悉尼大学) Sun Yat-sen University Shenzhen Campus(中山大学深圳校区)

AI总结 DATAMASK通过联合学习优化质量和多样性度量,显著提升大规模预训练数据选择效率和模型性能

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24165 2026-01-01 cs.CV

DiffThinker: Towards Generative Multimodal Reasoning with Diffusion Models

DiffThinker: 向基于扩散模型的生成多模态推理迈进

Zefeng He, Xiaoye Qu, Yafu Li, Tong Zhu, Siyuan Huang, Yu Cheng

机构 * Shanghai AI Laboratory(上海人工智能实验室) Nanjing University(南京大学) Shanghai Jiao Tong University(上海交通大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 DiffThinker通过基于扩散模型的生成方法,在多模态推理任务中实现了更高效的视觉推理和更精确的空间处理,显著优于现有模型。

Comments Project page: https://diffthinker-project.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24119 2026-01-01 cs.CV

GeoBench: Rethinking Multimodal Geometric Problem-Solving via Hierarchical Evaluation

GeoBench: 通过分层评估重新思考多模态几何问题解决

Yuan Feng, Yue Yang, Xiaohan He, Jiatong Zhao, Jianlong Chen, Zijun Chen, Daocheng Fu, Qi Liu, Renqiu Xia, Bo Zhang, Junchi Yan

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Fudan University(复旦大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

AI总结 GeoBench通过分层评估框架,系统评估几何问题解决能力,揭示任务复杂度对性能的影响及子目标分解的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24111 2026-01-01 cs.CV cs.RO

Guided Diffusion-based Generation of Adversarial Objects for Real-World Monocular Depth Estimation Attacks

引导扩散生成对抗性物体用于现实世界单目深度估计攻击

Yongtao Chen, Yanbo Wang, Wentao Zhao, Guole Shen, Tianchen Deng, Jingchuan Wang

机构 * School of Automation and Intelligent Sensing, Institute of Medical Robotics, Shanghai Jiao Tong University(自动化与智能感知学院、医疗机器人研究院、上海交通大学)

AI总结 本文提出一种无需训练的生成对抗攻击框架,通过扩散模型生成自然且场景一致的对抗性物体,以提升自动驾驶系统中单目深度估计的对抗攻击效果和实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24018 2026-01-01 cs.CV

Structure-Guided Allocation of 2D Gaussians for Image Representation and Compression

基于结构的2D高斯分配用于图像表示与压缩

Huanxiong Liang, Yunuo Chen, Yicheng Pan, Sixian Wang, Jincheng Dai, Guo Lu, Wenjun Zhang

机构 * Department of Electronic Engineering, Shanghai Jiao Tong University(上海交通大学电子工程系) Key Laboratory of Universal Wireless Communications, Ministry of Education, Beijing University of Posts and Telecommunications(教育部无线通信关键实验室)

AI总结 本文提出基于图像结构的2D高斯分配方法,通过自适应量化和几何正则化提升图像表示与压缩效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19156 2026-01-01 cs.IT cs.AI cs.LO math.IT

Information Physics of Intelligence: Unifying Logical Depth and Entropy under Thermodynamic Constraints

智能信息物理学:在热力学约束下统一逻辑深度与熵

Jianfeng Xu, Zeyan Li

机构 * Koguan School of Law, China Institute for Smart Justice, School of Computer Science, Shanghai Jiao Tong University(中国司法研究院、智能司法研究所、计算机科学学院,上海交通大学) School of Computer Science, Shanghai Jiao Tong University(计算机科学学院,上海交通大学)

AI总结 本文提出推导熵理论,统一逻辑深度与熵,在热力学约束下解释生成模型效率并为下一代节能AI架构提供数学界限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23361 2026-01-01 cs.CV

OmniVCus: Feedforward Subject-driven Video Customization with Multimodal Control Conditions

OmniVCus: 基于多模态控制条件的前馈主体驱动视频定制

Yuanhao Cai, He Zhang, Xi Chen, Jinbo Xing, Yiwei Hu, Yuqian Zhou, Kai Zhang, Zhifei Zhang, Soo Ye Kim, Tianyu Wang, Yulun Zhang, Xiaokang Yang, Zhe Lin, Alan Yuille

机构 * Johns Hopkins University(约翰霍普金斯大学) Adobe Research(Adobe研究) The University of Hong Kong(香港大学) The Chinese University of Hong Kong(香港中文大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 OmniVCus通过多模态控制条件和改进的嵌入机制实现高效的多主体视频定制。

Comments NeurIPS 2025; A data construction pipeline and a diffusion Transformer framework for controllable subject-driven video customization

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08151 2026-01-01 cs.AI

Foundation Models Knowledge Distillation For Battery Capacity Degradation Forecast

基础模型知识蒸馏用于电池容量退化预测

Joey Chan, Zhen Chen, Ershun Pan

机构 * Department of Industrial Engineering and Management, School of Mechanical Engineering, Shanghai Jiao Tong University, Shanghai 200240, China(工业工程与管理系,机械工程学院,上海交通大学,上海200240,中国)

AI总结 本文提出了一种基于基础模型和知识蒸馏的电池容量退化预测方法,通过微调和蒸馏提升模型的泛化能力和部署效率。

Journal ref Reliability Engineering & System Safety, Volume 270, 2026, 112139, ISSN 0951-8320,

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22942 2026-01-01 cs.RO cs.AI

AINav: Large Language Model-Based Adaptive Interactive Navigation

AINav: 基于大语言模型的自适应交互导航

Kangjie Zhou, Yao Mu, Haoyang Song, Yi Zeng, Pengying Wu, Han Gao, Chang Liu

机构 * School of Advanced Manufacturing and Robotics, Peking University(北京大学先进制造与机器人学院) AI Institute, School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机学院人工智能研究所)

AI总结 AINav通过基于大语言模型的自适应交互导航方法,实现复杂环境中的路径规划与目标达成。

Comments 13 pages, 12 figures, accepted to IEEE Robotics & Automation Magazine

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.08243 2026-01-01 cs.CV

Hierarchical Context Alignment with Disentangled Geometric and Temporal Modeling for Semantic Occupancy Prediction

具有解耦几何和时间建模的层次上下文对齐用于语义占用预测

Bohan Li, Jiajun Deng, Yasheng Sun, Xiaofeng Wang, Xin Jin, Wenjun Zeng

机构 * Shanghai Jiao Tong University(上海交通大学) Eastern Institute of Technology(东部技术研究所) Ningbo Institute of Digital Twin(宁波数字孪生研究所) University of Adelaide(阿德莱德大学) Tokyo Institute of Technology(东京技术大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

AI总结 本文提出Hi-SOP方法,通过解耦几何和时间上下文进行层次化对齐,提升语义占用预测的准确性,在多个数据集上取得优异效果。

Comments IEEE TPAMI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23858 2026-01-01 cs.LG cs.PL

Yggdrasil: Bridging Dynamic Speculation and Static Runtime for Latency-Optimal Tree-Based LLM Decoding

Yggdrasil:连接动态推测与静态运行时以实现延迟最优的树基LLM解码

Yue Guan, Changming Yu, Shihan Fang, Weiming Hu, Zaifeng Pan, Zheng Wang, Zihan Liu, Yangjie Zhou, Yufei Ding, Minyi Guo, Jingwen Leng

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Qizhi Institute(上海启智研究院) University of California, San Diego(加州大学圣地亚哥分校)

AI总结 Yggdrasil通过上下文感知的树起草和编译友好的执行,实现延迟最优的树基LLM解码,支持未经修改的LLM并在多种硬件上实现3.98倍速度提升。

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23705 2025-12-30 cs.CV

Diffusion Knows Transparency: Repurposing Video Diffusion for Transparent Object Depth and Normal Estimation

扩散知道透明:将视频扩散用于透明物体深度和法线估计

Shaocong Xu, Songlin Wei, Qizhe Wei, Zheng Geng, Hong Li, Licheng Shen, Qianpu Sun, Shu Han, Bin Ma, Bohan Li, Chongjie Ye, Yuhang Zheng, Nan Wang, Saining Zhang, Hao Zhao

机构 * Beijing Academy of Artificial Intelligence(北京人工智能研究院) University of Southern California(南加州大学) Tsinghua University(清华大学) Beihang University(北航) Wuhan University(武汉大学) Shanghai Jiao Tong University(上海交通大学) European Institute of Innovation and Technology Ningbo(创新与技术欧洲研究所宁波) FNii, The Chinese University of Hong Kong, Shenzhen(FNii,香港中文大学(深圳)) National University of Singapore(新加坡国立大学)

AI总结 本文提出DKT模型,利用视频扩散模型估计透明物体的深度和法线,实现零样本SOTA,提升现实和合成视频中的透明感知性能。

Comments Project Page: https://daniellli.github.io/projects/DKT/; Code: https://github.com/Daniellli/DKT; Dataset: https://huggingface.co/datasets/Daniellesry/TransPhy3D

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23576 2025-12-30 cs.CV

LiveTalk: Real-Time Multimodal Interactive Video Diffusion via Improved On-Policy Distillation

LiveTalk: 通过改进的在线策略蒸馏实现实时多模态交互视频扩散

Ethan Chern, Zhulin Hu, Bohao Tang, Jiadi Su, Steffi Chern, Zhijie Deng, Pengfei Liu

机构 * SII SJTU GAIR

AI总结 本文提出LiveTalk系统,通过改进的在线策略蒸馏实现实时多模态交互视频生成,显著提升效率和质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23545 2025-12-30 cs.CV cs.AI

PathFound: An Agentic Multimodal Model Activating Evidence-seeking Pathological Diagnosis

PathFound: 一种促进证据寻求病理诊断的代理多模态模型

Shengyi Hua, Jianfeng Wu, Tianle Shen, Kangzhe Hu, Zhongzhen Huang, Shujuan Ni, Zhihong Zhang, Yuan Li, Zhe Wang, Xiaofan Zhang

机构 * Qing Yuan Research Institute, Shanghai Jiao Tong University(上海交通大学庆元研究院) Shanghai Innovation Institute(上海创新研究院) Department of Pathology, The First Affiliated Hospital of USTC, Division of Life Sciences and Medicine, University of Science and Technology of China(中国科学技术大学生命科学与医学学院病理科) Intelligent Pathology Institute, Division of Life Sciences and Medicine(生命科学与医学学院智能病理研究所) Department of Pathology, Fudan University Shanghai Cancer Center(复旦大学上海癌症中心病理科) Department of Oncology, Shanghai Medical College, Fudan University(复旦大学上海医学院肿瘤科) Institute of Pathology, Fudan University(复旦大学病理研究所) Department of Pathology, The First Affiliated Hospital with Nanjing Medical University(南京医科大学第一附属医院病理科)

AI总结 PathFound是一种通过主动信息获取和诊断完善来提升病理诊断准确性的代理多模态模型,其在多种临床场景中表现出卓越的诊断性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23515 2025-12-30 q-fin.TR cs.AI cs.CE cs.LG

Alpha-R1: Alpha Screening with LLM Reasoning via Reinforcement Learning

Alpha-R1:通过强化学习实现基于LLM的Alpha筛选

Zuoyou Jiang, Li Zhao, Rui Sun, Ruohan Sun, Zhongjian Li, Jing Li, Daxin Jiang, Zuo Bai, Cheng Hua

机构 * Shanghai Jiao Tong University(上海交通大学)

AI总结 Alpha-R1通过强化学习实现基于LLM的上下文感知alpha筛选,提升非平稳市场中的投资策略性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18210 2025-12-30 cs.SD eess.SP

A Data-Centric Approach to Generalizable Speech Deepfake Detection

面向通用性语音深度伪造检测的数据导向方法

Wen Huang, Yuchen Mao, Yanmin Qian

机构 * Auditory Cognition and Computational Acoustics Lab MoE Key Lab of Artificial Intelligence, AI Institute School of Computer Science, Shanghai Jiao Tong University, China(听觉认知与计算声学实验室、人工智能MoE重点实验室、人工智能学院、上海交通大学)

AI总结 本文提出数据导向方法,通过构建和聚合数据集提升语音深度伪造检测的泛化能力,实验表明其在数据效率和性能上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04678 2025-12-30 cs.CV

Reward Forcing: Efficient Streaming Video Generation with Rewarded Distribution Matching Distillation

奖励强制:基于奖励分布匹配蒸馏的高效流式视频生成

Yunhong Lu, Yanhong Zeng, Haobo Li, Hao Ouyang, Qiuyu Wang, Ka Leong Cheng, Jiapeng Zhu, Hengyuan Cao, Zhipeng Zhang, Xing Zhu, Yujun Shen, Min Zhang

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团) SIAS-ZJU SJTU(上海交通大学)

AI总结 奖励强制通过EMA-Sink和Re-DMD提升流式视频生成效率与质量,实现23.1 FPS的高性能视频生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15965 2025-12-30 cs.LG cs.AI cs.DC

RLinf: Flexible and Efficient Large-scale Reinforcement Learning via Macro-to-Micro Flow Transformation

RLinf: 通过宏到微流转换实现灵活高效的大型强化学习

Chao Yu, Yuanqing Wang, Zhen Guo, Hao Lin, Si Xu, Hongzhi Zang, Quanlu Zhang, Yongji Wu, Chunyang Zhu, Junhao Hu, Zixiao Huang, Mingjie Wei, Yuqing Xie, Ke Yang, Bo Dai, Zhexuan Xu, Jiakun Du, Xiangyuan Wang, Xu Fu, Letong Shi, Zhihao Liu, Kang Chen, Weilin Liu, Gang Liu, Boxun Li, Jianlei Yang, Zhi Yang, Guohao Dai, Yu Wang

机构 * Tsinghua University(清华大学) Zhongguancun Academy(中关村学院) Infinigence AI Peking University(北京大学) UC Berkeley(加州大学伯克利分校) Beihang University(北航) Shanghai Jiaotong University(上海交通大学)

AI总结 RLinf通过宏到微流转换范式,实现了高效灵活的大型强化学习训练系统,显著提升了训练吞吐量。

Comments GitHub Repo: https://github.com/RLinf/RLinf

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22503 2025-12-30 cs.CV

SCAFusion: A Multimodal 3D Detection Framework for Small Object Detection in Lunar Surface Exploration

SCAFusion: 一种针对月球表面探索的小目标多模态3D检测框架

Xin Chen, Kang Luo, Yangyi Xiao, Hesheng Wang

机构 * Department of Automation, Key Laboratory of System Control and Information Processing of Ministry of Education, Key Laboratory of Marine Intelligent Equipment and System of Ministry of Education, Shanghai Engineering Research Center of Intelligent Control and Management, Shanghai Jiao Tong University(自动化系、教育部系统控制与信息处理重点实验室、教育部海洋智能装备与系统重点实验室、上海智能控制与管理工程研究中心、上海交通大学)

AI总结 SCAFusion提出了一种针对月球表面探索的小目标多模态3D检测框架,通过改进的特征对齐和坐标注意机制提升小目标检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22323 2025-12-30 cs.CV cs.AI

SpotEdit: Selective Region Editing in Diffusion Transformers

SpotEdit: 差分变换器中的选择性区域编辑

Zhibin Qin, Zhenxiong Tan, Zeqing Wang, Songhua Liu, Xinchao Wang

机构 * National University of Singapore(新加坡国立大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 SpotEdit提出了一种无需训练的差分编辑框架,通过选择性更新修改区域,实现高效且精确的图像编辑。

Comments 14 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22135 2025-12-30 cs.DC cs.AI cs.HC cs.MA

SoDA: An Efficient Interaction Paradigm for the Agentic Web

SoDA:面向代理网络的高效交互范式

Zicai Cui, Zhouyuan Jian, Weiwen Liu, Weinan Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院)

AI总结 SoDA提出了一种面向代理网络的高效交互范式,通过解耦记忆与应用逻辑,降低数据锁定和认知过载,提升信息处理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22027 2025-12-29 cs.CV

Patch-Discontinuity Mining for Generalized Deepfake Detection

用于通用深度伪造检测的补丁不连续性挖掘

Huanhuan Yuan, Yang Ping, Zhengqin Xu, Junyi Cao, Shuai Jia, Chao Ma

机构 * Artificial Intelligence Institute, Shanghai Jiao Tong University(上海交通大学人工智能研究院) Chinese Academy of Military Science(中国军事科学院)

AI总结 本文提出GenDF框架,通过简单网络设计实现高效深度伪造检测,具备跨领域和跨操纵的强泛化能力。

Comments Our paper was accepted by the IEEE Transactions on Multimedia

详情

展开后加载摘要…

URL PDF HTML 收藏