arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Science and Technology of China(中国科学技术大学)

共收录 2210
2601.17469 2026-06-04 cs.LG

Identifying and Correcting Label Noise for Robust GNNs via Influence Contradiction

通过影响矛盾识别和纠正标签噪声以实现鲁棒图神经网络

Wei Ju, Wei Zhang, Siyu Yi, Zhengyang Mao, Yifan Wang, Jingyang Yuan, Zhiping Xiao, Ziyue Qiao, Ming Zhang

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 提出ICGNN方法,利用图扩散矩阵计算影响矛盾分数(ICS)检测噪声标签,并通过邻居预测软策略纠正噪声标签,结合伪标签提升鲁棒性。

Comments Accepted by Proceedings of the 43rd International Conference on Machine Learning (ICML 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13796 2026-06-04 cs.CL cs.CV

The Mechanistic Emergence of Symbol Grounding in Language Models

语言模型中符号接地机制的涌现

Shuyu Wu, Ziqiao Ma, Xiaoxi Luo, Yidong Huang, Josue Torres-Fonseca, Freda Shi, Joyce Chai

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 通过机械因果分析,发现符号接地在语言模型的中层计算中通过注意力头聚合环境信息实现,并在多模态对话和多种架构中复现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14760 2026-06-04 cs.CL

Reasoning over Boundaries: Enhancing Specification Alignment via Test-time Deliberation

推理边界:通过测试时深思增强规范对齐

Haoran Zhang, Yafu Li, Xuyang Hu, Dongrui Liu, Zhilin Wang, Bo Li, Yu Cheng

机构 * School of Artificial Intelligence, Shanghai Jiao Tong University, Shanghai, China(上海交通大学人工智能学院) Shanghai Artificial Intelligence Laboratory, Shanghai, China(上海人工智能实验室) University of Science and Technology of China, Hefei, Anhui, China(中国科学技术大学) The Chinese University of Hong Kong, Hong Kong, China(香港中文大学) University of Illinois Urbana-Champaign, Urbana, IL, USA(伊利诺伊大学厄巴纳-香槟分校)

AI总结 提出Align3方法,利用测试时深思(TTD)和分层反思修正来推理规范边界,并构建SpecBench基准,实验表明TTD能有效增强规范对齐。

Comments 10 pages main text, 52 pages total (including appendix). Code and resources are available at https://github.com/zzzhr97/SpecBench

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21892 2026-06-04 cs.CL

Graph-R1: Towards Agentic GraphRAG Framework via End-to-end Reinforcement Learning

Graph-R1:通过端到端强化学习实现智能图RAG框架

Haoran Luo, Haihong E, Guanting Chen, Qika Lin, Yikai Guo, Fangzhi Xu, Zemin Kuang, Meina Song, Xiaobao Wu, Yifan Zhu, Luu Anh Tuan

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 提出Graph-R1,首个通过端到端强化学习的智能图RAG框架,采用轻量知识超图构建、多轮智能体-环境交互检索和端到端奖励机制,在推理准确性、检索效率和生成质量上优于传统图RAG和强化学习增强RAG方法。

Comments Accepted by ICML 2026 main conference

Journal ref ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.11309 2026-06-04 cs.CV

Achieving Rotation-Invariant Convolution via Non-Learnable Orientation Alignment Operators

通过不可学习的朝向对齐算子实现旋转不变卷积

Hanlin Mo, Peihong Lei, You Hao, Guoying Zhao

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 提出基于不可学习算子的旋转不变卷积(RIConvs),其参数量和计算过程与标准卷积相同,在多个视觉任务中提升准确率,尤其在数据有限时效果显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
1805.10638 2026-06-04 cs.LG cs.NA math.NA stat.ML

Fast K-Means Clustering with Anderson Acceleration

快速K均值聚类的安德森加速方法

Juyong Zhang, Yuxin Yao, Yue Peng, Hao Yu, Bailin Deng

机构 * University of Science and Technology of China(中国科学技术大学) Cardiff University(卡迪夫大学)

AI总结 本文提出了一种加速K均值聚类Lloyd算法的新方法,通过将Lloyd算法的分配和更新步骤视为固定点迭代,并应用安德森加速技术,动态调整参数m以实现鲁棒且一致的加速效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
1503.08855 2026-06-04 math.OC cs.IT cs.LG cs.MA cs.SY eess.SY math.IT stat.ML

Decentralized learning for wireless communications and networking

无线通信与网络中的去中心化学习

Georgios B. Giannakis, Qing Ling, Gonzalo Mateos, Ioannis D. Schizas, Hao Zhu

机构 * University of Minnesota(明尼苏达大学) University of Science and Technology of China(中国科学技术大学) University of Rochester(罗切斯特大学) University of Texas at Arlington(德克萨斯大学阿灵顿分校) University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 本文提出了一种去中心化学习算法,用于图数据的网络内处理,通过交替方向乘子法实现分布式优化,适用于无线通信和网络任务的案例研究。

Comments Contributed chapter to appear in Splitting Methods in Communication and Imaging, Science and Engineering, R. Glowinski, S. Osher, and W. Yin, Editors, New York, Springer, 2015

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03645 2026-06-03 cs.LG cs.AI

The Shape of Addition: Geometric Structures of Arithmetic in Large Language Models

加法的形状:大型语言模型中算术的几何结构

Liuyuan Wen, Xun Zhu, Lihao Huang, Wenbin Li, Yang Gao

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 通过分析多操作数加法中残差流的几何结构,发现等原始和轨迹(IRST)并建立噪声量化模型,将算术错误解释为由内部神经噪声引起的几何滑移,并利用几何一致性检查方法检测和纠正量化失败。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03629 2026-06-03 cs.AI

TSQAgent: Rating Time Series Data Quality via Dedicated Agentic Reasoning

TSQAgent: 通过专用智能体推理评估时间序列数据质量

Shunyu Wu, Dan Li, Haozheng Ye, Weibin Feng, Jian Lou, Bo Zhang, Wenjie Feng, Chenjuan Guo, See-Kiong Ng

机构 * Sun Yat-sen University(中山大学) China University of Mining Technology(中国矿业大学) University of Science and Technology of China(中国科学技术大学) East China Normal University(华东师范大学) National University of Singapore(新加坡国立大学)

AI总结 提出TSQAgent框架,通过三个协作智能体(感知器、检查员、裁决者)识别相关质量维度并进行定量比较,显著提升LLM在时间序列数据质量评估中的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03610 2026-06-03 cs.CV

SkelHCC: A Hyperbolic CLIP-Driven Cache Adaptation Framework for Skeleton-based One-Shot Action Recognition

SkelHCC:一种基于双曲CLIP驱动的缓存自适应框架用于骨架基础的一次动作识别

Yanan Liu, Anqi Zhu, Jingmin Zhu, Jun Liu, Hossein Rahmani, Mohammed Bennamoun, Farid Boussaid, Dan Xu, Qiuhong Ke

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 提出SkelHCC框架,利用双曲几何编码骨架层次结构,结合CLIP和免训练缓存实现一次动作识别,在三个数据集上达到最优。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03608 2026-06-03 cs.LG cs.AI

Exploiting Verification-Generation Gap: Test-Time Reinforcement Learning with Confidence-Conditioned Verification

利用验证-生成差距:基于置信度条件的测试时强化学习

Jiahui Li, Jianfeng Shan, Wenpei Chen, Shunyu Wu, Jian Lou, Wenjie Feng, Dan Li, See-Kiong Ng

机构 * Sun Yat-Sen University(中山大学) University of Science and Technology of China(中国科学技术大学) National University of Singapore(新加坡国立大学)

AI总结 提出TTRL-CoCoV框架,通过置信度自适应机制解决无标签设置下Pass@k优化中的伪标签错误和多样性崩溃问题,显著提升Pass@1和Pass@k性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03578 2026-06-03 cs.CV

Diffusing in the Right Space: A Systematic Study of Latent Diffusability

在正确空间中扩散:潜在可扩散性的系统研究

Tianxiong Zhong, Xingye Tian, Xuebo Wang, Xin Tao, Pengfei Wan

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 本文系统研究潜在扩散模型中潜在表示的可扩散性,提出速度不可约方差(VIV)作为生成质量的稳定预测指标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03556 2026-06-03 cs.RO

Partially Observable Adversarial Patch Attacks on Vision-Language-Action Models in Robotics

部分可观测的对抗性补丁攻击在机器人视觉-语言-动作模型上的应用

Xiaofei Wang, Mingliang Han, Tianyu Hao, Yi Yang, Yun-Bo Zhao, Keke Tang

机构 * Department of Automation, University of Science and Technology of China(自动化系,中国科学技术大学) SmartMore Corporation(SmartMore公司) Cyberspace Institute of Advanced Technology, Guangzhou University(广西亚技术空间研究所,广州大学) th Medical Center of Chinese PLA General Hospital(中国人民解放军总医院第八医学中心) Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(合肥综合性国家科学中心人工智能研究院)

AI总结 针对机器人VLA模型,提出部分可观测威胁模型下的两阶段攻击框架,利用注意力图定位关键区域并优化补丁以破坏语义接地和增加动作轨迹曲率,导致长期任务失败。

Comments Accepted by IEEE Robotics and Automation Letters, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03536 2026-06-03 cs.RO

Bionic Human-Motion Style Transfer for Physically Executable Whole-Body Control of Humanoid Robots

仿人运动风格迁移用于人形机器人物理可执行全身控制

Tianchen Huang, Mingkuan Zhao, Yang Gao, Feiyang Yuan, Junchi Gu, Xiaohu Zhang, Dongdong Zhao, Shi Yan, Yu Wang, Wei Gao, Shiwu Zhang

机构 * Institute of Humanoid Robots, Department of Precision Machinery and Precision Instrumentation, University of Science and Technology of China(人形机器人研究院,精密机械与精密仪器系,中国科学技术大学) School of Computer Science and Technology, Faculty of Electronic and Information Engineering, Xi’an Jiaotong University(计算机科学与技术学院,电子与信息工程学院,西安交通大学) School of Information Science and Engineering, Lanzhou University(信息科学与工程学院,兰州大学)

AI总结 提出一种仿生生成到控制框架,通过物理感知多条件潜扩散模型和预览式全身跟踪策略,将短时人体风格示例迁移到不同运动内容上,实现人形机器人可执行且表达性强的全身运动。

Comments Project page: https://huangtc233.github.io/bionic-style-transfer/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03503 2026-06-03 cs.AI

ThoughtFold: Folding Reasoning Chains via Introspective Preference Learning

ThoughtFold: 通过内省偏好学习折叠推理链

Ziyan Liu, Xueda Shen, Yuzhe Gu, Songyang Gao, Kuikun Liu, Guangran Cheng, Chengqi Lyu, Dahua Lin, Wenwei Zhang, Kai Chen

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) University of Science and Technology of China(中国科学技术大学) MMLab, The Chinese University of Hong Kong(香港中文大学MMLab)

AI总结 提出ThoughtFold框架,通过细粒度偏好学习惩罚冗余探索并鼓励直接连接关键推理段,将推理链折叠为更简洁路径,在保持精度的同时大幅降低token使用量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03486 2026-06-03 cs.CR cs.AI

NeuroArmor: Safe-Variant-Guided Representation Consistency for Selective Re-Anchoring in Jailbreak Defense

NeuroArmor:基于安全变体引导的表示一致性实现越狱防御中的选择性重新锚定

Zhongyang Lin, Ziran Zhao, Feifei Zhai, Pengyuan Liu

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 提出NeuroArmor白盒运行时防御方法,通过为每个提示构建安全变体作为局部安全参考,在隐藏状态空间进行一致性检查并路由异常,有效降低恶意攻击成功率同时保持低误报率。

Comments 16 pages, 4 figures, 17 tables. Submitted to ACL ARR

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03476 2026-06-03 cs.RO

Human2Humanoid: Physics-Aware Cross-Morphology Motion Retargeting for Humanoid Robots

Human2Humanoid: 面向人形机器人的物理感知跨形态运动重定向

Tianchen Huang, Feiyang Yuan, Junchi Gu, Shurui Fang, Xiaohu Zhang, Yu Wang, Wei Gao, Shiwu Zhang

机构 * Institute of Humanoid Robots, Department of Precision Machinery and Precision Instrumentation, University of Science and Technology of China(人形机器人研究院,精密机械与精密仪器系,中国科学技术大学)

AI总结 提出Human2Humanoid无监督运动重定向框架,利用CycleGAN和骨架感知图卷积网络处理未配对数据,通过形态不变末端执行器一致性损失和物理感知可行性约束,实现从人体运动到人形机器人的高保真重定向。

Comments Project page: https://huangtc233.github.io/human2humanoid_website/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03444 2026-06-03 cs.CV cs.AI

PRISM: Synergizing Vision Foundation Models via Self-organized Expert Specialization

PRISM: 通过自组织专家专业化协同视觉基础模型

Ying Tang, Dong Li, Youjia Zhang, Zikai Song, Junqing Yu, Wei Yang

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 提出PRISM框架,采用双流混合专家(MoE)架构,通过两阶段范式(先解构专家知识使其专业化,再动态重组为任务特定路径)解决视觉基础模型集成中的负迁移问题,在PASCAL-Context和NYUD-v2上达到新最优。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03417 2026-06-03 cs.CV

A unified multi-task framework enables interpretable chest radiograph analysis

统一多任务框架实现可解释的胸部X光片分析

Lijian Xu, Ziyu Ni, Xinglong Liu, Xiaosong Wang, Hongsheng Li, Shaoting Zhang

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 提出IMT-CXR框架,通过统一Transformer架构模拟放射科医生诊断流程,实现疾病识别、属性表征和可追溯报告生成,在十个基准上表现优异,且临床评估中66%的AI报告达到或超越原始报告。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03391 2026-06-03 cs.LG cs.AI cs.CL

When Model Merging Breaks Routing: Training-Free Calibration for MoE

当模型合并破坏路由:MoE的无训练校准

Canbin Huang, Tianyuan Shi, Xiaojun Quan, Jingang Wang, Jianfei Zhang, Qifan Wang

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 针对MoE架构中模型合并导致的路由崩溃问题,提出基于二阶曲率的无训练校准方法HARC,通过闭式解和共轭梯度法高效重对齐路由器,显著提升数学推理和代码生成性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03290 2026-06-03 cs.LG cs.AI

Message Tuning Outshines Graph Prompt Tuning: A Prismatic Space Perspective

消息调优优于图提示调优:棱镜空间视角

Yancheng Chen, Dun Ma, Shuai Zhang, Yang Liu, Xixun Lin, Xiangyu Zhao, Wenguo Yang, Wei Chen, Chuan Zhou

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 本文提出棱镜空间理论(PS-Theory)量化图提示调优的适应能力上限,并引入消息调优(MTG)方法,通过注入可学习消息原型超越该上限,实验验证其优越性。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03270 2026-06-03 cs.LG cs.AI

Are Common Substructures Transferable? Riemannian Graph Foundation Model with Neural Vector Bundles

常见子结构可迁移吗?基于神经向量丛的黎曼图基础模型

Li Sun, Zhenhao Huang, Yiding Wang, Qin Chen, Pietro Lio, Philip S. Yu

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 针对图结构迁移性理论缺失的问题,提出基于黎曼几何的神经向量丛框架GAUGE,通过内在几何学习实现可迁移子结构表征,在零样本链接预测和图同构任务中验证了优越性。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03262 2026-06-03 cs.LG cs.NA math.NA

Let There Be Light: Reflection, Refraction and Scattering for Neural Operators

Let There Be Light: 面向神经算子的反射、折射与散射

Keke Wu, Yixuan Zhang, Jingrun Chen

机构 * Suzhou Institute for Advanced Research, University of Science and Technology of China, Suzhou(苏州先进研究院,中国科学技术大学,苏州) School of Artificial Intelligence and Data Science, University of Science and Technology of China, Hefei(人工智能与数据科学学院,中国科学技术大学,合肥) Suzhou Big Data & AI Research and Engineering Center, Suzhou(苏州大数据与人工智能研究与工程中心,苏州) School of Mathematical Science, Peking University, Beijing(数学科学学院,北京大学,北京) School of Mathematical Sciences, University of Science and Technology of China, Hefei(数学科学学院,中国科学技术大学,合肥)

AI总结 提出一种受光传输启发的神经算子LiNO,通过反射、折射和散射三种机制分解潜在演化,实现局部特征调制与全局空间通信的结构化分离,并开发高效散射变体将空间复杂度从二次降至线性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03240 2026-06-03 cs.RO

GeoAlign: Beyond Semantics with State-Guided Spatial Alignment in VLA Models

GeoAlign: VLA模型中的状态引导空间对齐超越语义

Yizhi Chen, Zhanxiang Cao, Xinyi Peng, Yixiao Zheng, Xiaxi Si, Yiheng Li, Liyun Yan, Keqi Zhu, Xueyun Chen, Shengcheng Fu, Tianyue Zhan, Yufei Jia, Jinming Yao, Yan Xie, Kun Wang, Cewu Lu, Yue Gao

机构 * Tongji University(同济大学) Shanghai Innovation Institute(上海创新研究院) Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学) Jingdezhen Ceramic University(景德镇陶瓷大学) Tsinghua University(清华大学) HONOR(HONOR公司) University of Science and Technology of China(中国科学技术大学)

AI总结 提出GeoAlign架构,通过RGB几何分支的后训练和机器人本体状态引导的几何特征查询,实现几何感知的空间对齐和动态可供性选择,在多个基准上取得高性能。

Comments 20 pages, 9 figures, 8 tables, including appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03188 2026-06-03 cs.RO

GeoSem-WAM: Geometry- and Semantic-Aware World Action Models

GeoSem-WAM:几何与语义感知的世界动作模型

Fulong Ma, Daojie Peng, Wenjun Yue, Jiahang Cao, Bintao Wang, Qiang Zhang, Jun Ma

机构 * HKUST(GZ)(香港科技大学(广州)) HKU(香港大学) USTC(中国科学技术大学) SDU(山东大学) X-Humaniod

AI总结 提出GeoSem-WAM框架,通过几何和语义监督增强潜在表示,在统一潜在空间中联合捕捉场景动态、空间几何和语义上下文,避免测试时显式未来展开或视频生成,提升动作预测准确性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03135 2026-06-03 cs.AI

Uncertainty-Aware Clarification in LLM Agents with Information Gain

基于信息增益的LLM智能体不确定性感知澄清

Mengyi Deng, Zhiwei Li, Xin Li, Tingyu Zhu, Ying Zhao, Zhijiang Guo, Wei Wang

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 针对用户指令不明确导致LLM智能体工具操作错误的问题,提出一种以信息增益奖励为导向的澄清框架,通过贝叶斯信念更新量化澄清问题的效用,训练智能体生成高信息增益的澄清,在τ-Bench环境中将任务成功率提升3.7%,仅增加0.3个交互步骤。

Journal ref ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03119 2026-06-03 cs.CV cs.AI cs.LG

GuidedBridge: Training-freely Improving Bridge Models with Prior Guidance

GuidedBridge: 无需训练地利用先验引导改进桥接模型

Zehua Chen, Yucheng Yang, Binjie Yuan, Kaiwen Zheng, Jun S. Liu, Jun Zhu

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 提出无需训练的先验引导方法(PG)和频率调制先验引导(FMPG),通过对比弱先验与已见先验增强桥接模型的先验利用,并设计级联框架CFG-FMPG用于图像修复,实验证明该方法能一致提升预训练桥接模型在多种图像翻译任务中的性能。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03080 2026-06-03 cs.CL cs.AI

Regret Pre-training: Bridging Prior and Posterior Views for Enhanced Knowledge Grounding

遗憾预训练:桥接先验与后验视角以增强知识基础

Mingkuan Zhao, Xiayu Sun, Wentao Hu, Suquan Chen, Jiaxuan Li, Xiaoyan Zhu, Xin Lai, Jiayin Wang

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 提出遗憾预训练框架,通过双视角架构利用未来信息增强因果语言模型,在OLMoE-1B-7B架构上平均准确率提升至33.9%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03075 2026-06-03 cs.CV

TGV-KV: Text-Grounded KV Eviction for Vision-Language Models

TGV-KV:面向视觉语言模型的文本引导KV驱逐方法

Jizhihui Liu, Ruizi Han, Miao Zhang, Rui Shao, Xuebo Liu, Weili Guan, Yaowei Wang

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 针对视觉语言模型中视觉信息冗余导致的KV缓存内存消耗问题,提出基于文本引导的KV驱逐方法TGV-KV,通过文本-视觉预算分配、文本加权排序和文本优先保留策略,在保持高精度的同时显著提升推理吞吐量。

Comments Accepted by ICML-2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03066 2026-06-03 cs.AI

CORE: Conflict-Oriented Reasoning for General Multimodal Manipulation Detection

CORE: 面向冲突的通用多模态篡改检测推理

Jinjie Shen, Yaxiong Wang, Yujiao Wu, Lechao Cheng, Tianrui Hui, Nan Pu, Zhihui Li, Zhun Zhong

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 提出CORE框架,通过构建冲突归因语料库和面向冲突的推理,增强多模态大语言模型的冲突捕捉能力,实现鲁棒且泛化的多模态篡改检测。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏