arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Science and Technology of China(中国科学技术大学)

共收录 2226
2502.14560 2026-02-17 cs.LG cs.AI cs.CL

Less is More: Improving LLM Alignment via Preference Data Selection

少即是多:通过偏好数据选择改进大语言模型对齐

Xun Deng, Han Zhong, Rui Ai, Fuli Feng, Zheng Wang, Xiangnan He

机构 * University of Science and Technology of China(中国科学技术大学) Peking University(北京大学) Massachusetts Institute of Technology(麻省理工学院) Alibaba Cloud Computing(阿里云计算) MoE Key Lab of BIPC, University of Science and Technology of China(中国科学技术大学MoE关键实验室)

AI总结 通过改进偏好数据选择策略,提升大语言模型对齐效果,实验显示在较少数据下实现显著性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.09807 2026-02-17 cs.CV cs.AI

TKN: Transformer-based Keypoint Prediction Network For Real-time Video Prediction

TKN:基于Transformer的关键点预测网络用于实时视频预测

Haoran Li, XiaoLu Li, Yihang Lin, Yanbin Hao, Haiyong Xie, Pengyuan Zhou, Yong Liao

机构 * University of Science and Technology of China(中国科学技术大学) Adv. Innovation Center for Human Brain Protection, Capital Medical University(人类脑保护先进创新中心,首都医科大学) Aarhus University(奥胡斯大学)

AI总结 TKN通过基于Transformer的关键点预测网络,实现1176 fps的实时视频预测,显著降低计算成本并保持性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10098 2026-02-17 cs.RO cs.CV

VLA-JEPA: Enhancing Vision-Language-Action Model with Latent World Model

VLA-JEPA: 通过潜在世界模型增强视觉-语言-动作模型

Jingwen Sun, Wenyao Zhang, Zekun Qi, Shaojie Ren, Zezhi Liu, Hanxin Zhu, Guangzhong Sun, Xin Jin, Zhibo Chen

机构 * University of Science and Technology of China(中国科学技术大学) Zhongguancun Academy, Beijing, China(中关村学院) Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学) Eastern Institute of Technology, Ningbo(宁波东部科技研究院) University of Chinese Academy of Sciences(中国科学院大学) Nankai University(南开大学)

AI总结 VLA-JEPA通过潜在世界模型提升视觉-语言-动作模型的泛化与鲁棒性,采用无泄露状态预测和两阶段训练策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12751 2026-02-16 cs.CV

ReBA-Pred-Net: Weakly-Supervised Regional Brain Age Prediction on MRI

ReBA-Pred-Net:基于MRI的弱监督区域脑年龄预测

Shuai Shao, Yan Wang, Shu Jiang, Shiyuan Zhao, Xinzhe Luo, Di Yang, Jiangtao Wang, Yutong Bai, Jianguo Zhang

机构 * University of Science and Technology of China(科学技术大学) China University of Petroleum (East China)(中国石油大学(华东)) Northwestern Polytechnical University(西北工业大学) Beijing Jiaotong University(北京交通大学) Beijing Tiantan Hospital(北京天坛医院)

AI总结 本文提出ReBA-Pred-Net网络,通过教师-学生框架实现基于MRI的弱监督区域脑年龄预测,引入健康对照相似性和神经疾病相关性指标评估模型有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12205 2026-02-16 cs.CV cs.AI

DeepGen 1.0: A Lightweight Unified Multimodal Model for Advancing Image Generation and Editing

DeepGen 1.0: 一种轻量级统一多模态模型,用于推进图像生成与编辑

Dianyi Wang, Ruihang Li, Feng Han, Chaofan Ma, Wei Song, Siyuan Wang, Yibin Wang, Yi Xin, Hongjian Liu, Zhixiong Zhang, Shengyuan Ding, Tianhang Wang, Zhenglin Cheng, Tao Lin, Cheng Jin, Kaicheng Yu, Jingjing Chen, Wenjie Wang, Zhongyu Wei, Jiaqi Wang

机构 * Shanghai Innovation Institute(上海创新研究院) Fudan University(复旦大学) University of Science and Technology of China(中国科学技术大学) Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学) Westlake University(西湖大学) Nanjing University(南京大学) University of Southern California(南加州大学)

AI总结 DeepGen 1.0通过轻量级统一多模态模型在图像生成与编辑领域实现高性能,采用SCB框架和数据驱动训练策略,超越大参数模型表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12701 2026-02-16 cs.SD

DisSR: Disentangling Speech Representation for Degradation-Prior Guided Cross-Domain Speech Restoration

DisSR:解构语音表示以指导降质先验引导的跨域语音修复

Ziqi Liang, Zhijun Jia, Chang Liu, Minghui Yang, Zhihong Lu, Jian Wang

机构 * AntGroup(蚂蚁集团) University of Science and Technology of China(中国科学技术大学)

AI总结 DisSR通过降质先验引导和跨领域对齐训练,提升语音修复在不同降质和领域下的泛化能力与修复质量。

Comments Accepted to 2026 IEEE International Conference on Acoustics, Speech, and Signal Processing (ICASSP 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12590 2026-02-16 cs.CV

Unbiased Gradient Estimation for Event Binning via Functional Backpropagation

基于函数反向传播的事件分箱无偏梯度估计

Jinze Chen, Wei Zhai, Han Han, Tiankai Ma, Yang Cao, Bin Li, Zheng-Jun Zha

机构 * MoE Key Laboratory of Brain-inspired Intelligent Perception and Cognition, University of Science and Technology of China(脑启发智能感知与认知联合实验室,中国科学技术大学)

AI总结 本文提出基于函数反向传播的事件分箱无偏梯度估计框架,通过合成弱导数提升学习效率,实验显示在运动估计和光流任务中性能显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19558 2026-02-16 cs.CY cs.LG

PoliCon: Evaluating LLMs on Achieving Diverse Political Consensus Objectives

PoliCon:评估LLMs在实现多样化政治共识目标上的能力

Zhaowei Zhang, Xiaobo Wang, Minghua Yi, Mengmeng Wang, Fengshuo Bai, Zilong Zheng, Yipeng Kang, Yaodong Yang

机构 * Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院) USTC(中国科学技术大学) WHU(武汉大学) SJTU(上海交通大学) State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,BIGAI) Zhongguancun Academy(中关村学院)

AI总结 PoliCon通过构建基于欧洲议会辩论记录的基准,评估LLMs在不同政治环境下生成共识决议的能力,揭示其在复杂任务中的不足及党派偏见。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.20836 2026-02-16 cs.CV cs.CR

Vulnerabilities in AI-generated Image Detection: The Challenge of Adversarial Attacks

AI生成图像检测中的漏洞:对抗攻击的挑战

Yunfeng Diao, Naixin Zhai, Changtao Miao, Zitong Yu, Xingxing Wei, Xun Yang, Meng Wang

机构 * Hefei University of Technology(合肥工业大学) University of Science and Technology of China(中国科学技术大学) School of Computing and Information Technology(计算与信息学院) Institute of Artificial Intelligence(人工智能研究院) Great Bay University(大亚湾大学)

AI总结 本文提出FPBA方法,通过频域扰动和贝叶斯策略攻击AIGI检测器,揭示对抗攻击对检测器的真实威胁。

Comments Accepted in TMM

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04948 2026-02-13 cs.RO

SKATER: Synthesized Kinematics for Advanced Traversing Efficiency on a Humanoid Robot via Roller Skate Swizzles

SKATER:通过滚轮滑动实现人形机器人高级移动效率的合成运动学

Junchi Gu, Feiyang Yuan, Weize Shi, Tianchen Huang, Haopeng Zhang, Xiaohu Zhang, Yu Wang, Wei Gao, Shiwu Zhang

机构 * Institute of Humanoid Robots, Department of Precision Machinery and Precision Instrumentation, University of Science and Technology of China(人形机器人研究所,精密机械与精密仪器系,中国科学技术大学)

AI总结 SKATER通过在人形机器人脚部安装滚轮实现滑冰步态,利用深度强化学习提升移动效率,显著降低冲击力和能量消耗。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11513 2026-02-13 cs.CR cs.AI

Differentially Private and Communication Efficient Large Language Model Split Inference via Stochastic Quantization and Soft Prompt

通过随机量化和软提示实现差分隐私和通信高效的大型语言模型分拆推理

Yujie Gu, Richeng Jin, Xiaoyu Ji, Yier Jin, Wenyuan Xu

机构 * Zhejiang University, Hangzhou, China(浙江大学) University of Science and Technology of China, Anhui, China(中国科学技术大学)

AI总结 本文提出DEL框架,通过随机量化和软提示实现差分隐私和通信高效的LLM分拆推理,有效平衡隐私与效用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11498 2026-02-13 cs.LG

Partial GFlowNet: Accelerating Convergence in Large State Spaces via Strategic Partitioning

部分GFlowNet:通过战略划分加速大规模状态空间中的收敛

Xuan Yu, Xu Wang, Rui Zhu, Yudong Zhang, Yang Wang

机构 * University of Science and Technology of China (USTC)(中国科学技术大学) Suzhou Institute for Advanced Research, USTC(先进研究所) State Key Laboratory of Precision and Intelligent Chemistry, USTC(精密与智能化学国家重点实验室)

AI总结 本文提出部分GFlowNet,通过战略划分状态空间,加速大规模状态空间中的收敛并提升候选多样性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11491 2026-02-13 cs.LG

Exploring Multiple High-Scoring Subspaces in Generative Flow Networks

探索生成流网络中的多个高分子空间

Xuan Yu, Xu Wang, Rui Zhu, Yudong Zhang, Yang Wang

机构 * University of Science and Technology of China (USTC)(中国科学技术大学) Suzhou Institute for Advanced Research, USTC(先进研究苏州市机构) State Key Laboratory of Precision and Intelligent Chemistry, USTC(精密与智能化学国家重点实验室)

AI总结 本文提出CMAB-GFN,通过结合组合多臂老虎机框架与生成流网络,有效偏向高奖励解决方案,提升探索效率和多样性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11164 2026-02-13 cs.LG cs.AI cs.CL

Automated Optimization Modeling via a Localizable Error-Driven Perspective

通过可定位的误差驱动视角实现自动化优化建模

Weiting Liu, Han Wu, Yufei Kuang, Xiongwei Han, Tao Zhong, Jianfeng Feng, Wenlian Lu

机构 * Fudan University(复旦大学) Huawei Noah’s Ark Lab(华为诺亚实验室) University of Science and Technology of China(中国科学技术大学)

AI总结 MIND通过可定位的误差驱动视角,改进自动化优化建模方法,提升训练后性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03507 2026-02-13 cs.CL

FaithRL: Learning to Reason Faithfully through Step-Level Faithfulness Maximization

FaithRL: 通过步骤级忠实性最大化学习合理推理

Runquan Gui, Yafu Li, Xiaoye Qu, Ziyan Liu, Yeqiu Cheng, Yu Cheng

机构 * Shanghai AI Laboratory(上海人工智能实验室) University of Science and Technology of China(中国科学技术大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 FaithRL通过步骤级忠实性最大化优化,减少大型语言模型的幻觉并提高推理准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03192 2026-02-13 cs.CL

MemRL: Self-Evolving Agents via Runtime Reinforcement Learning on Episodic Memory

MemRL: 通过运行时强化学习在事件记忆上实现自我进化代理

Shengtao Zhang, Jiaqian Wang, Ruiwen Zhou, Junwei Liao, Yuchen Feng, Zhuo Li, Yujie Zheng, Weinan Zhang, Ying Wen, Zhiyu Li, Feiyu Xiong, Yutao Qi, Bo Tang, Muning Wen

机构 * Shanghai Jiao Tong University, Shanghai, China(上海交通大学) Xidian University, Xi'an, China(西安电子科技大学) National University of Singapore, Singapore(新加坡国立大学) Shanghai Innovation Institute, Shanghai, China(上海创新研究院) MemTensor (Shanghai) Technology Co., Ltd., Shanghai, China(MemTensor(上海)科技有限公司) University of Science and Technology of China, Hefei, China(中国科学技术大学)

AI总结 MemRL通过运行时强化学习在事件记忆上实现自我进化,解决稳定性与可塑性矛盾,实现持续改进。

Comments 41 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12314 2026-02-13 cs.LG cs.AI cs.CE cs.CR

Thought Purity: A Defense Framework For Chain-of-Thought Attack

思维纯洁性:针对思维链攻击的防御框架

Zihao Xue, Zhen Bi, Long Ma, Zhenlin Hu, Yan Wang, Xueshu Chen, Zhenfang Liu, Kang Zhao, Jie Xiao, Jungang Lou

机构 * Huzhou University(湖州大学) Zhejiang Key Laboratory of Intelligent Education Technology and Application(浙江智能教育技术与应用重点实验室) University of Science and Technology of China(中国科学技术大学) Alibaba Group(阿里巴巴集团) Zhejiang University of Technology(浙江工业大学)

AI总结 本文提出TP框架,通过整合安全数据管道与强化学习,有效防御思维链攻击,同时保持模型在良性任务上的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04988 2026-02-13 cs.CV cs.AI

Remote Sensing Retrieval-Augmented Generation: Bridging Remote Sensing Imagery and Comprehensive Knowledge with a Multi-Modal Dataset and Retrieval-Augmented Generation Model

遥感检索增强生成:通过多模态数据集和检索增强生成模型连接遥感图像与综合知识

Congcong Wen, Yiting Lin, Xiaokang Qu, Nan Li, Yong Liao, Xiang Li, Hui Lin

机构 * School of Cyber Science and Technology, University of Science and Technology of China(信息科学技术学院,中国科学技术大学) China Academy of Electronics and Information Technology(电子信息技术研究院)

AI总结 本文提出RS-RAG框架,通过多模态数据集和检索增强生成模型,提升遥感图像与综合知识的连接能力,有效提升复杂查询的语义推理性能。

Comments Accepted by IEEE Geoscience and Remote Sensing Magazine (GRSM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11066 2026-02-12 cs.CV

PuriLight: A Lightweight Shuffle and Purification Framework for Monocular Depth Estimation

PuriLight: 一种轻量级的洗牌与净化框架用于单目深度估计

Yujie Chen, Li Zhang, Xiaomeng Chu, Tian Zhang

机构 * Department of Mathematics, Hefei University of Technology, Hefei, China(数学系,合肥工业大学) Department of Computer Science and Technology, University of Science and Technology of China, Hefei, China(计算机科学与技术系,中国科学技术大学)

AI总结 PuriLight通过三种创新模块实现轻量级且结构精确的单目深度估计,提升计算效率与细节保留能力。

Comments 8 pages, 6figures, accepted by European Conference on Artificial Intelligence (ECAI2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01304 2026-02-12 cs.AI cs.CL

Agentic Jigsaw Interaction Learning for Enhancing Visual Perception and Reasoning in Vision-Language Models

代理拼图交互学习:提升视觉感知与推理能力在视觉-语言模型中

Yu Zeng, Wenxuan Huang, Shiting Huang, Xikun Bao, Yukun Qi, Yiming Zhao, Qiuchen Wang, Lin Chen, Zehui Chen, Huaian Chen, Wanli Ouyang, Feng Zhao

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai AI Laboratory(上海人工智能实验室) East China Normal University(华东师范大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 AGILE通过代理拼图交互学习提升视觉-语言模型的感知与推理能力,显著提高拼图任务性能并增强多模态模型的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10161 2026-02-12 cs.CR cs.AI cs.CL

Omni-Safety under Cross-Modality Conflict: Vulnerabilities, Dynamics Mechanisms and Efficient Alignment

跨模态冲突下的全方位安全:漏洞、动态机制和高效对齐

Kun Wang, Zherui Li, Zhenhong Zhou, Yitong Zhang, Yan Mi, Kun Yang, Yiming Zhang, Junhao Dong, Zhongxiang Sun, Qiankun Li, Yang Liu

机构 * Nanyang Technological University(南洋理工大学) Beijing University of Posts and Telecommunications(北京邮电大学) Tsinghua University(清华大学) Fudan University(复旦大学) University of Science and Technology of China(中国科学技术大学) Renmin University of China(中国人民大学)

AI总结 本文提出OmniSteer方法,通过提取黄金拒绝向量和轻量级适配器提升多模态模型的安全性与通用能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07262 2026-02-12 cs.CV

TwistNet-2D: Learning Second-Order Channel Interactions via Spiral Twisting for Texture Recognition

TwistNet-2D: 通过螺旋扭转学习第二阶通道交互用于纹理识别

Junbo Jacob Lian, Feng Xiong, Yujun Sun, Kaichen Ouyang, Zong Ke, Mingyang Yu, Shengwei Fu, Zhong Rui, Zhang Yujun, Huiling Chen

机构 * McCormick School of Engineering, Northwestern University(西北大学工程学院) School of Mathematics, University of Science and Technology of China(中国科学技术大学数学学院) National University of Singapore(新加坡国立大学) College of Artificial Intelligence, Nankai University(南开大学人工智能学院) Guizhou University(贵州大学) Information Initiative Center, Hokkaido University(北海道大学信息初始化中心) School of New Energy, Jingchu University of Technology(荆楚科技大学新能源学院) Wenzhou University(温州大学)

AI总结 TwistNet-2D通过螺旋扭转学习第二阶通道交互,提升纹理识别性能,参数高效且超越多种基线模型。

Comments Code is available at https://github.com/junbolian/TwistNet-2D

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01330 2026-02-12 cs.AI

Beyond Gemini-3-Pro: Revisiting LLM Routing and Aggregation at Scale

超越Gemini-3-Pro:大规模LLM路由与聚合的再审视

Shengji Tang, Weihao Lin, Peng Ye, Jingqi Ye, Hao Li, Yiqun Zhang, Xiaosong Wang, Bo Zhang, Shuyue Hu, Tao Chen, Lei Bai, Wanli Ouyang

机构 * Shanghai AI Lab(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学) Fudan University(复旦大学) University of Science and Technology of China(中国科学技术大学) Northwestern Polytechnical University(西北工业大学) Northeastern University(东北大学)

AI总结 本文提出JiSi框架,通过混合路由、支持集聚合选择和自适应切换技术,实现开源LLM协作超越Gemini-3-Pro。

Comments 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10019 2026-02-11 cs.LG cs.AI

ADORA: Training Reasoning Models with Dynamic Advantage Estimation on Reinforcement Learning

ADORA: 通过强化学习中的动态优势估计训练推理模型

Qingnan Ren, Shiting Huang, Zhen Fang, Zehui Chen, Lin Chen, Lijun Li, Feng Zhao

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai AI Laboratory(上海人工智能实验室)

AI总结 ADORA通过动态优势估计提升强化学习中推理模型的训练效率与稳定性

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09973 2026-02-11 cs.RO

RoboInter: A Holistic Intermediate Representation Suite Towards Robotic Manipulation

RoboInter: 一种面向机器人操控的综合中间表示套件

Hao Li, Ziqin Wang, Zi-han Ding, Shuai Yang, Yilun Chen, Yang Tian, Xiaolin Hu, Tai Wang, Dahua Lin, Feng Zhao, Si Liu, Jiangmiao Pang

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Beihang University(北航) Nanyang Technological University(南洋理工大学) Zhejiang University(浙江大学) Tsinghua University(清华大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 RoboInter通过统一的中间表示套件,提升机器人操控中视觉-语言-动作系统的泛化能力和推理能力。

Comments Published to ICLR 2026, 69 pages, 40 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07358 2026-02-11 cs.LG

UTOPIA: Unlearnable Tabular Data via Decoupled Shortcut Embedding

UTOPIA: 通过解耦的快捷嵌入实现不可学习的表格数据

Jiaming He, Fuming Luo, Hongwei Li, Wenbo Jiang, Wenshu Fan, Zhenbo Shi, Xudong Jiang, Yi Yu

机构 * University of Electronic Science and Technology of China(电子科学与技术大学) Independent Researcher(独立研究者) University of Science and Technology of China(科学技术大学) Nanyang Technological University(南洋理工大学)

AI总结 UTOPIA通过解耦的快捷嵌入方法,实现对敏感表格数据的不可学习保护,有效阻止未经授权的模型训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03213 2026-02-11 cs.CV

ConsisDrive: Identity-Preserving Driving World Models for Video Generation by Instance Mask

ConsisDrive: 用于视频生成的实例掩码驾驶世界模型

Zhuoran Yang, Yanyong Zhang

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 ConsisDrive通过实例掩码注意力和损失机制提升驾驶视频生成质量及自动驾驶性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22761 2026-02-11 cs.CV cs.AI

MILR: Improving Multimodal Image Generation via Test-Time Latent Reasoning

MILR:通过测试时潜在推理改进多模态图像生成

Yapeng Mi, Yanpeng Zhao, Hengli Li, Chenxi Li, Huimin Wu, Xiaojian Ma, Song-Chun Zhu, Ying Nian Wu, Qing Li

机构 * University of Science and Technology of China(中国科学技术大学) State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室) Peking University(北京大学) Tsinghua University(清华大学) University of California, Los Angeles(加州大学洛杉矶分校)

AI总结 MILR通过测试时潜在推理提升多模态图像生成性能,实现跨模态推理和统一潜在空间优化。

Comments 21 pages,14 figures,9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13761 2026-02-11 cs.AI cs.CL

THOR: Tool-Integrated Hierarchical Optimization via RL for Mathematical Reasoning

THOR:通过强化学习进行工具集成的分层优化以实现数学推理

Qikai Chang, Zhenrong Zhang, Pengfei Hu, Jun Du, Jiefeng Ma, Yicheng Pan, Jianshu Zhang, Quan Liu, Jianqing Gao

机构 * University of Science and Technology of China(中国科学技术大学) iFLYTEK Research(iFLYTEK研究院)

AI总结 THOR通过强化学习实现工具集成的分层优化,提升数学推理和代码生成能力。

Comments 22 pages, 13 figures, ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08725 2026-02-10 cs.CV

FusionEdit: Semantic Fusion and Attention Modulation for Training-Free Image Editing

FusionEdit: 基于语义融合与注意力调节的无训练图像编辑

Yongwen Lai, Chaoqun Wang, Shaobo Min

机构 * School of Artificial Intelligence, South China Normal University(人工智能学院,华南师范大学) University of Science and Technology of China(中国科学技术大学)

AI总结 FusionEdit通过语义融合与注意力调节实现无训练图像编辑,提升编辑精度与可控性。

Comments Accepted by ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏