arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Zhejiang University(浙江大学)

共收录 2909
2606.29579 2026-06-30 cs.CV cs.AI cs.LG cs.MM

ScAle: Attention Head Scaling as a Minimal Adapter for Spatial Reasoning in Vision Language Models

ScAle: 注意力头缩放作为视觉语言模型中空间推理的最小适配器

Rahul Chowdhury, Timothy A Rupprecht, Xuan Shen, Pu Zhao, Yanzhi Wang

机构 * Northeastern University(东北大学) EmbodyX Inc.(EmbodyX公司) Zhejiang University(浙江大学)

AI总结 提出ScAle,一种超轻量适配方法,通过学习少量标量系数调节冻结骨干网络中的注意力头和MLP激活,仅用1K可训练参数在空间推理任务上实现高达134.1%的相对精度提升。

Comments Accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28447 2026-06-30 cs.IR cs.AI

SemFlowRAG: Directed Semantic Flow from Abstraction to Evidence for Complex Reasoning

SemFlowRAG:从抽象到证据的有向语义流用于复杂推理

Houyuan Qin, Rong Wu, Qinyuan Qin, Botian Shi, Jingjing Qu, Yang Sun, Pinlong Cai

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Zhejiang University(浙江大学) Fudan University(复旦大学)

AI总结 提出SemFlowRAG框架,通过构建语料自适应的语义梯度图,将平面检索空间重构为层次结构,并设计抽象度引导的有向PageRank算法,使检索轨迹遵循“高到低语义抽象度”梯度,从而缓解“概率黑洞”问题,提升复杂多跳推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31603 2026-06-30 cs.CV cs.AI

Lumos-Nexus: Efficient Frequency Bridging with Homogeneous Latent Space for Video Unified Models

Lumos-Nexus: 面向视频统一模型的高效频率桥接与同质潜在空间

Jiazheng Xing, Hangjie Yuan, Lingling Cai, Xinyu Liu, Yujie Wei, Fei Du, Tao Feng, Hai Ci, Jiasheng Tang, Weihua Chen, Fan Wang, Yong Liu

机构 * Zhejiang University(浙江大学) DAMO Academy, Alibaba Group(阿里云达摩院) Hupan Lab(虎扑实验室) National University of Singapore(新加坡国立大学) Hong Kong University of Science and Technology(香港科技大学) Fudan University(复旦大学) Tsinghua University(清华大学)

AI总结 提出Lumos-Nexus框架,通过两阶段训练和渐进频率桥接,在保持推理能力的同时显著提升视频生成保真度。

Comments ECCV 2026 Camera-Ready Version. Project page (https://jiazheng-xing.github.io/nexus-lumos-home/) and Code (https://github.com/alibaba-damo-academy/Lumos-Custom/) are available

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22417 2026-06-30 cs.CV cs.SE

The Neglected Baseline in Model Interpretation

模型解释中被忽视的基线

Yongjin Cui, Xiaohui Fan

机构 * Zhejiang University(浙江大学)

AI总结 针对现有模型解释方法普遍忽略基线导致不精确的问题,本文重新定义解释任务和原则,统一梯度法、积分梯度法和泰勒展开,分析相关方法缺陷,并基于清晰合理的基线改进积分梯度法,实现基于任意层特征的解释。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19679 2026-06-30 cs.CV

MMControl: Unified Multi-Modal Control for Joint Audio-Video Generation

MMControl: 多模态控制用于联合音频视频生成

Liyang Li, Wen Wang, Canyu Zhao, Tianjian Feng, Zhiyue Zhao, Hao Chen, Chunhua Shen

机构 * Zhejiang University(浙江大学)

AI总结 本文提出MMControl,通过双流条件注入机制实现联合音频视频生成的多模态控制,支持视觉和听觉信号的精细控制,提升跨模态对齐效果。

Comments Accepted to ECCV 2026. Project page: https://aim-uofa.github.io/MMControl/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10764 2026-06-30 cs.CV

Dual-End Consistency Model

双端一致性模型

Linwei Dong, Ruoyu Guo, Ge Bai, Zehuan Yuan, Yawei Luo, Changqing Zou

机构 * Zhejiang University(浙江大学) Bytedance Inc.(字节跳动公司) Zhejiang Lab(浙江实验室)

AI总结 本文提出双端一致性模型,通过选择关键子轨迹集群解决训练不稳定和采样灵活性问题,实现稳定高效的生成。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25144 2026-06-30 cs.CV cs.AI

FD$^2$: A Dedicated Framework for Fine-Grained Dataset Distillation

FD²:面向细粒度数据集蒸馏的专用框架

Hongxu Ma, Guang Li, Shijie Wang, Dongzhan Zhou, Baoli Sun, Takahiro Ogawa, Miki Haseyama, Zhihui Wang

机构 * Zhejiang University(浙江大学) Hokkaido University(北海道大学) The University of Queensland(昆士兰大学) Shanghai AI Laboratory(上海人工智能实验室) Dalian University of Technology(大连理工大学)

AI总结 本文提出FD²框架,通过局部化判别区域和构建细粒度表示,解决细粒度数据集蒸馏中样本相似性过高的问题,提升识别性能。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23071 2026-06-30 cs.CV

PolarAPP: Beyond Polarization Demosaicking for Polarimetric Applications

PolarAPP: 超越极化去马赛克用于极化应用

Yidong Luo, Chenggong Li, Yunfeng Song, Ping Wang, Boxin Shi, Junchao Zhang, Xin Yuan

机构 * Zhejiang University(浙江大学) School of Engineering, Westlake University(西湖大学工学院) School of Automation, Central South University(中南大学自动化学院) State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(北京大学计算机学院多媒体信息处理国家重点实验室) National Engineering Research Center of Visual Technology, School of Computer Science, Peking University(北京大学计算机学院视觉技术国家工程研究中心)

AI总结 PolarAPP提出首个联合优化去马赛克与下游任务的框架,通过元学习实现语义对齐,引入等效成像约束并采用任务细化阶段提升精度,实验表明其在去马赛克质量和下游性能上均优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12049 2026-06-30 econ.GN cs.AI q-fin.EC

Generative AI and Sales Productivity: Field Experiments in Online Retail

生成式人工智能与销售效率:在线零售中的现场实验

Lu Fang, Zhe Yuan, Kaifu Zhang, Dante Donati, Miklos Sarvary

机构 * Duke University(杜克大学) Imperial Business School(帝国商学院) BIG AI Conference(大数据人工智能会议) MSI AI Forum(MSI人工智能论坛) TSE Digital Economics Conference(TSE数字经济会议) AIML Conference(人工智能与机器学习会议) Operational Innovation Network Summit(运营创新网络峰会) University of Rochester(罗切斯特大学) UC Davis(加州大学戴维斯分校) TUM Workshop on Generative AI in Marketing(慕尼黑工业大学生成AI在营销中的研讨会) UCL School of Management(伦敦大学学院管理学院) Columbia Business School(哥伦比亚商学院) Business & Generative AI Conference(商业与生成AI会议) Zhejiang University School of Management(浙江大学管理学院)

AI总结 通过大规模随机现场实验,量化生成式人工智能(GenAI)对在线零售销售业绩的短期影响,发现GenAI在多数工作流中提升销售额,主要通过提高转化率而非客单价,且对经验较少的消费者效果更显著。

Comments Keywords: Artificial Intelligence, Consumer Experience, Field Experiments, GenAI, Productivity, Retail Platforms, Sales. JEL codes: C93, D24, L81, M31, O3

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07056 2026-06-30 cs.CR cs.LG

LoRAShield: Data-Free Editing Alignment for Secure Personalized LoRA Sharing

LoRAShield: 无数据编辑对齐用于安全的个性化LoRA分享

Jiahao Chen, Junhao Li, Yiming Wang, Yong Yang, Yi Jiang, Chunyi Zhou, Qingming Li, Tianyu Du, Shouling Ji

机构 * Zhejiang University(浙江大学) Guizhou Medical University(贵州医科大学)

AI总结 LoRAShield通过对抗优化和语义增强动态编辑和对齐LoRA权重子空间,有效阻止恶意生成,保障个性化模型的安全共享。

Comments Accepted by SIGKDD 2026 Cycle2

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28144 2026-06-29 cs.CV 新提交

Monocular Avatar Reconstruction via Cascaded Diffusion Priors and UV-Space Differentiable Shading

基于级联扩散先验和UV空间可微分着色的单目虚拟人重建

Hong Li, Minqi Meng, Yanjun Liang, Chongjie Ye, Houyuan Chen, Weiqing Xiao, Xianda Guo, Guojun Lei, Xuhui Liu, Chaojie Yang, Yanlun Peng, Hao Zhao, Baochang Zhang

机构 * Beihang University(北航) Great Wall Motors(长城汽车) CUHK-Shenzhen(香港科技大学深圳研究院) HKUST(香港科技大学) Nanjing University(南京大学) Wuhan University(武汉大学) Zhejiang University(浙江大学) KAUST(王国 Abdullah 基础科学研究院) Tsinghua University(清华大学)

AI总结 提出数据高效框架,利用统一预训练扩散模型的鲁棒先验,通过级联LoRA依次处理纹理补全、去光照和材质分解,结合UV空间可微分BRDF着色损失,从单张野外图像重建高保真可重光照3D虚拟人。

Comments Accepted by ECCV 2026. Project page: https://luh1124.github.io/MARCUS-Avatar-Projectpage/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27929 2026-06-29 cs.RO 新提交

When Multi-Robot Systems Meet Agentic AI:Towards Embodied Collective Intelligence

当多机器人系统遇见智能体AI:迈向具身集体智能

Yuxuan Yan, Yuanyuan Jia, Qianqian Yang

机构 * College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息与电子工程学院)

AI总结 本文提出具身集体智能(ECI)范式,通过共感知、共行动和共演化使机器人团队共享世界上下文、任务进度和技能经验,并以导航实验验证共享世界记忆继承的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27678 2026-06-29 cs.CV 新提交

Two-Stage Cross-Domain Cervical Abnormality Screening with Cytopathological Image Synthesis and Knowledge Distillation

两阶段跨域宫颈异常筛查:细胞病理图像合成与知识蒸馏

Jincheng Li, Yuzhi He, Yihui Zhan, Xinmei Zhang, Yifei Sun, Zelin Liu, Lichi Zhang, Minye Shao, Lili Zhao

机构 * School of Artificial Intelligence and Computer Science, Nantong University(南通大学人工智能与计算机科学学院) School of Telecommunications Engineering, Xidian University(西安电子科技大学通信工程学院) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) School of Biomedical Engineering, Shanghai Jiao Tong University(上海交通大学生物医学工程学院) Department of Computer Science, Durham University(杜伦大学计算机科学系)

AI总结 提出两阶段框架,先用SC-UNSB合成中间域缓解域偏移,再用知识蒸馏对齐特征,提升跨域宫颈细胞检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27676 2026-06-29 cs.RO 新提交

CWI: Composite Humanoid Whole-Body Imitation System for Loco-manipulation

CWI: 复合型人形机器人全身模仿系统用于移动操作

Wenqi Ge, Junde Guo, Zhen Fu, Shunpeng Yang, Jiayu Chen, Hua Chen

机构 * LimX Dynamics The University of Hong Kong(香港大学) School of Automation and Intelligent Manufacturing, Southern University of Science and Technology(南方科技大学自动化与智能制造学院) Hong Kong University of Science and Technology(香港科技大学) ZJU-UIUC Institute, Zhejiang University(浙江大学伊利诺伊大学厄巴纳香槟校区联合学院)

AI总结 提出CWI框架,通过解耦上下半身动作捕捉数据,结合对抗性运动先验和多评论家架构,实现人形机器人稳定移动与灵巧操作的全身协调控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26557 2026-06-29 cs.CV 新提交

Coarse-to-Fine: A Hybrid Self-Supervised Method for Non-rigid 3D Shape Matching

从粗到细:一种用于非刚性3D形状匹配的混合自监督方法

Feifan Luo, Ting Li, Zhao Li, Hongyang Chen

机构 * Zhejiang University(浙江大学) Zhejiang Lab(之江实验室) Wenzhou University of Technology(温州理工学院)

AI总结 提出一种基于从粗到细策略的混合自监督方法,通过双分支功能映射学习流(拉普拉斯基和弹性基)实现粗映射与精化对应的一致性,在非等距变形和拓扑噪声等挑战场景下达到最先进性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22902 2026-06-29 cs.AI 新提交

Agent-as-a-Router: Agentic Model Routing for Coding Tasks

Agent-as-a-Router: 面向编码任务的智能体模型路由

Pengfei Zhou, Zhiwei Tang, Yixing Ma, Jiasheng Tang, Yizeng Han, Zhenglin Wan, Fanqing Meng, Wei Wang, Bohan Zhuang, Wangbo Zhao, Yang You

机构 * National University of Singapore(新加坡国立大学) DAMO Academy, Alibaba Group(阿里巴巴达摩院) University of California, Berkeley(加州大学伯克利分校) The Hong Kong University of Science and Technology(香港科技大学) Zhejiang University(浙江大学)

AI总结 提出Agent-as-a-Router框架,通过C-A-F循环积累执行经验,实现编码任务的动态模型路由,ACRouter在分布内任务上取得最低累积遗憾并泛化到分布外任务。

Comments 39 pages, 21 figures, a living technical report with a living benchmark that continuously updates

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17565 2026-06-29 cs.CV 版本更新

UniGeo: Unifying Geometric Guidance for Camera-Controllable Image Editing via Video Models

UniGeo:通过视频模型统一几何指导以实现相机可控的图像编辑

Hong Jiang, Wensong Song, Zongxin Yang, Ruijie Quan, Yi Yang

机构 * ReLER, CCAI, Zhejiang University(ReLER、CCAI、浙江大学) DBMI, HMS, Harvard University(DBMI、HMS、哈佛大学)

AI总结 UniGeo通过统一的几何指导在三个层面提升相机可控图像编辑的几何一致性与视觉质量,克服传统方法在连续相机运动下的几何漂移和结构退化问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04390 2026-06-29 cs.AI 版本更新

SciFig: Towards Automating Editable Figure Generation for Scientific Papers

SciFig:面向科学论文的可编辑图形自动生成

Siyuan Huang, Yifan Zhou, Yutong Gao, Zi Yin, Juyang Bai, Xinxin Liu, Rama Chellappa, Chun Pong Lau, Cheng Peng, Sayan Nag, Shraman Pramanick

机构 * Johns Hopkins University(约翰霍普金斯大学) Zhejiang University(浙江大学) Independant Researcher(独立研究者) Tsinghua University(清华大学) University of Central Florida(佛罗里达中央大学) City University of Hong Kong(香港城市大学) Adobe Research(Adobe研究)

AI总结 提出SciFig多智能体框架,从科学文本自动生成可编辑的高质量方法图,通过分解规划、布局、渲染和迭代优化,在435个基准上优于基线,平均10分钟生成可编辑图形。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.16116 2026-06-29 cs.CR cs.AI 版本更新

DMind Benchmark: Toward a Holistic Assessment of LLM Capabilities across the Web3 Domain

DMind Benchmark:面向Web3领域LLM能力的全面评估

Enhao Huang, Pengyu Sun, Shuxun Wang, Zixin Lin, Alex Chen, Kaichun Hu, Joey Ouyang, Frank Li, Zhiyu Zhang, Haobo Wang, Yiming Li, Zhan Qin, James Yi, Gang Zhao, Ziang Ling, Lowes Yang

机构 * Zhejiang University(浙江大学) Nanyang Technological University(南洋理工大学)

AI总结 提出DMind Benchmark,覆盖Web3九个子领域,结合客观知识与开放推理任务,评估31个LLM,发现模型在安全审计等高推理任务中存在显著弱点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21477 2026-06-29 cs.CV 版本更新

Fine-Grained Behavior and Lane Constraints Guided Trajectory Prediction Method

细粒度行为与车道约束引导的轨迹预测方法

Wenyi Xiong, Jian Chen, Ziheng Qi

机构 * School of Mechanical Engineering, Zhejiang University(浙江大学机械工程学院) Guangdong Provincial Key Laboratory of Fully Actuated System Control Theory and Technology, School of Automation and Intelligent Manufacturing, Southern University of Science and Technology(南方科技大学自动化与智能制造学院广东省全驱系统控制理论与技术重点实验室) Leapmotor Technology(零跑科技)

AI总结 提出BLNet双流架构,通过并行注意力机制融合行为意图识别与车道约束建模,利用两阶段解码器生成轨迹,在nuScenes和Argoverse数据集上显著提升预测精度。

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27025 2026-06-26 cs.CL 新提交

Improving General Role-Playing Agents via Psychology-Grounded Reasoning and Role-Aware Policy Optimization

通过心理学推理和角色感知策略优化改进通用角色扮演智能体

Zhenhua Xu, Dongsheng Chen, Jian Li, Yitong Lin, Zhebo Wang, Jiafu Wu, Yizhang Jin, Chengjie Wang, Meng Han, Yabiao Wang

机构 * Zhejiang University(浙江大学) Tencent Youtu Lab(腾讯优图实验室)

AI总结 提出Psy-CoT框架,将角色推理分解为三步,并结合RAPO算法通过互信息加权梯度,提升角色扮演的忠实度和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26973 2026-06-26 cs.CV cs.LG 新提交

Geometric Gradient Rectification for Safe Open-Set Semi-Supervised Learning

几何梯度修正用于安全开放集半监督学习

Jiahe Chen, Qian Shao, Qiyuan Chen, Jiaying He, Jintai Chen, Jian Wu, Hongxia Xu

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) Liangzhu Laboratory and WeDoctor Cloud(良渚实验室和微医云) Shanghai Innovation Institute(上海创新研究院) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) State Key Laboratory of Transvascular Implantation Devices and TIDRI(经血管植入器械全国重点实验室和TIDRI) Zhejiang Key Laboratory of Medical Imaging Artificial Intelligence(浙江省医学影像人工智能重点实验室)

AI总结 提出几何梯度修正(GGR)框架,通过将辅助梯度投影到监督梯度的允许区域,解决开放集半监督学习中样本筛选与利用的权衡问题,提升闭集泛化与开放集鲁棒性。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26930 2026-06-26 cs.CV 新提交

PortraitGen: Exemplar-Driven GRPO with Dual-Reward Guidance for Photorealistic Portrait Generation

PortraitGen: 基于示例驱动的双奖励引导GRPO的逼真肖像生成

Xiaomin Li, Qian Liang, Yinan Li, Ying Zhang, Chen Li, Jing Lyu, Huchuan Lu, Xu Jia

机构 * Dalian University of Technology(大连理工大学) University of Electronic Science and Technology of China(电子科技大学) Zhejiang University(浙江大学) WeChat, Tencent Inc.(腾讯微信)

AI总结 提出PortraitGen框架,通过将真实图像引入GRPO采样组并设计双奖励机制(OmniReward和AI-Portrait),有效抑制AI伪影,实现逼真肖像生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26850 2026-06-26 cs.GR cs.CV 新提交

Appearance-Preserving Refinement of Generated 3D Assets for Monochromatic Fabrication

面向单色制造的三维生成资产的外观保持优化

Chentao Shen, Chen Jia, Mingjie Huang, Zhuang Zhang, Haisen Zhao, Xiangru Huang

机构 * Zhejiang University(浙江大学) Westlake University(西湖大学) Fudan University(复旦大学) Hangzhou Dianzi University(杭州电子科技大学) Shandong University(山东大学)

AI总结 提出GenMF框架,通过外观导向的几何优化将纹理依赖的视觉线索转为几何着色效果,并引入可微应力正则化,在单色制造中保持外观细节并降低应力集中。

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26790 2026-06-26 cs.CL 新提交

OPID: On-Policy Skill Distillation for Agentic Reinforcement Learning

OPID: 面向智能体强化学习的在策略技能蒸馏

Shuo Yang, Jinyang Wu, Zhengxi Lu, Yuhao Shen, Fan Zhang, Lang Feng, Shuai Zhang, Haoran Luo, Zheng Lian, Zhengqi Wen, Jianhua Tao

机构 * Tsinghua University(清华大学) Zhejiang University(浙江大学) The Chinese University of Hong Kong(香港中文大学) Nanyang Technological University(南洋理工大学) Tongji University(同济大学)

AI总结 提出OPID框架,通过从在策略轨迹中提取层级技能(回合级和步骤级)提供密集标记级监督,结合结果优势进行策略优化,提升智能体性能、样本效率和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26769 2026-06-26 cs.AI cs.CV 新提交

ResilPhase: Plug-and-Play Phase Mapping and Noise-Resilient Macro-Trajectory Extrapolation for Diffusion Acceleration

ResilPhase: 即插即用的相位映射与抗噪宏轨迹外推用于扩散加速

Qicheng Zhao, Yu Li, Qi Sun, Zheyu Yan

机构 * Zhejiang University(浙江大学)

AI总结 针对扩散模型推理延迟高的问题,提出ResilPhase框架,通过将加速推理重构为ODE空间中的稳定宏轨迹外推,并引入无导数重心拉格朗日外推器和有界相位映射,实现高加速比下的抗噪加速。

Comments Accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26713 2026-06-26 cs.AI 新提交

LithoDreamer: A Physics-Informed World Model for Multi-Stage Computational Lithography

LithoDreamer: 一种用于多阶段计算光刻的物理信息世界模型

Yuqi Jiang, Yumeng Liu, Zimu Li, Jinyuan Deng, Qian Jin, Yucheng Cui, Yu Li, Xunzhao Yin, Qi Sun, Cheng Zhuo

机构 * Zhejiang University(浙江大学)

AI总结 提出首个物理信息世界模型LithoDreamer,将光刻流程建模为决策驱动的多步演化系统,通过对比变分优化实现可解释干预,在正向演化和逆向规划中达到最优性能。

Comments Correspondence to: Qi Sun <qisunchn \at zju \dot edu \dot cn>

Journal ref Proceedings of the 43rd International Conference on Machine Learning (ICML), Jul. 6-11, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26560 2026-06-26 cs.CL 新提交

Erase-then-Delta Attention: Decoupling Erase and Write Addresses in Delta-Rule Linear Attention

先擦除后增量注意力:在Delta规则线性注意力中解耦擦除与写入地址

Xiao Li, Chengruidong Zhang, Hao Luo, Xi Lin, Zekun Wang, Zihan Qiu, Yunfei Mao, Langshi Chen, Man Yuan, Minmin Sun, Huiqiang Jiang, Siqi Zhang, Rui Men, Wei Hu, Gong Cheng, Bo Zheng, Dayiheng Liu, Jingren Zhou

机构 * Qwen Team(Qwen团队) Nanjing University(南京大学) Zhejiang University(浙江大学)

AI总结 提出Erase-then-Delta Attention (EDA),通过解耦擦除和写入地址,在Delta规则基础上增加选择性擦除步骤,提升循环记忆模型的记忆管理能力,在2.5B密集和MoE 25B-A2.8B模型上取得最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26552 2026-06-26 cs.CV cs.AI 新提交

Perception, Verdict, and Evolution: Hindsight-Driven Self-Refining Forensics Agent for AI-Generated Image Detection

感知、判断与进化:基于事后洞察的自优化取证智能体用于AI生成图像检测

Yangjun Wu, Keyu Yan, Yu Liu, Jingren Zhou, Fei Huang, Rong Zhang, Zhou Zhao, Fei Wu

机构 * Zhejiang University(浙江大学) Alibaba Group(阿里巴巴集团)

AI总结 提出ForeAgent框架,采用感知-判断架构融合多视图线索,并引入事后洞察驱动的自优化策略,通过采样-反思-进化范式持续提升检测能力,在多个基准上达到最优性能。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26287 2026-06-26 cs.CV 新提交

GeMoE: Gating Entropy is All You Need for Uncertainty-aware Adaptive Routing in MoE-based Large Vision-Language Models

GeMoE:基于门控熵的MoE大视觉语言模型中不确定性感知自适应路由

Chaoxiang Cai, Minghe Weng, Jie Li, Yibo Jiang, Longrong Yang, Zequn Qin, Xi Li

机构 * School of Software Technology, Zhejiang University(浙江大学软件学院) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)

AI总结 针对MoE架构中静态路由无法自适应选择专家的问题,提出基于门控熵的不确定性感知自适应路由方法GeMoE,通过最小描述长度原理建模复杂度与性能的权衡,在保持99.5%性能的同时提升36.5%专家激活稀疏性。

详情

展开后加载摘要…

URL PDF HTML 收藏