arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Science and Technology of China(中国科学技术大学)

共收录 2226
2603.03820 2026-03-05 cs.LG cs.AI

Fairness Begins with State: Purifying Latent Preferences for Hierarchical Reinforcement Learning in Interactive Recommendation

公平始于状态:在交互推荐中通过净化潜在偏好进行分层强化学习

Yun Lu, Xiaoyu Shi, Hong Xie, Xiangyu Zhao, Mingsheng Shang

机构 * Chongqing Institute of Green and Intelligent Technology, Chinese Academy of Sciences(中国科学院重庆绿色智能技术研究所) Chongqing School, University of Chinese Academy of Sciences(中国科学院大学重庆学院) The First Affiliated Hospital, University of Science and Technology of China(中国科学技术大学第一附属医院) City University of Hong Kong(香港城市大学)

AI总结 本文提出DSRM-HRL框架,通过净化潜在偏好解决交互推荐中的公平与准确冲突,实现推荐效用与曝光公平的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03798 2026-03-05 cs.RO

Learning Surgical Robotic Manipulation with 3D Spatial Priors

利用3D空间先验学习手术机器人操作

Yu Sheng, Lidian Wang, Xiaomeng Chu, Jiajun Deng, Min Cheng, Yanyong Zhang, Bei Hua, Houqiang Li, Jianmin Ji

机构 * University of Science and Technology of China(中国科学技术大学) Tuodao Medical(图道医疗) Yale University(耶鲁大学)

AI总结 本文提出SST,一种端到端的视觉-运动策略,通过内窥镜图像中的3D空间线索提升手术机器人操作的3D空间意识,实现了复杂手术任务的高性能表现。

Comments CVPR26

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03094 2026-03-04 cs.IR cs.AI

Proactive Guiding Strategy for Item-side Fairness in Interactive Recommendation

面向交互推荐中物品侧公平性的前瞻性引导策略

Chongjun Xia, Xiaoyu Shi, Hong Xie, Xianzhi Wang, yun lu, Mingsheng Shang

机构 * Chinese Academy of Sciences(中国科学院) University of Technology Sydney(悉尼科技大学) University of Science and Technology of China(中国科学技术大学)

AI总结 HRL4PFG通过分层强化学习引导用户偏好向长尾物品倾斜,提升交互推荐的公平性和用户参与度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02910 2026-03-04 cs.CV

Articulation in Motion: Prior-free Part Mobility Analysis for Articulated Objects By Dynamic-Static Disentanglement

运动中的关节性:通过动态-静态解耦实现无先验知识的关节物体部分移动分析

Hao Ai, Wenjie Chang, Jianbo Jiao, Ales Leonardis, Ofek Eyal

机构 * School of Computer Science, University of Birmingham(伯明翰大学计算机科学学院) University of Science and Technology of China(中国科学技术大学)

AI总结 本文提出了一种无需先验知识的关节物体部分移动分析方法,通过动态-静态解耦实现高质量的3D重建与分割。

Comments Accepted by ICLR 2026. Project Page: https://haoai-1997.github.io/AiM/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26127 2026-03-04 cs.CV

EchoGen: Generating Visual Echoes in Any Scene via Feed-Forward Subject-Driven Auto-Regressive Model

EchoGen: 通过前馈主体驱动自回归模型在任意场景中生成视觉回声

Ruixiao Dong, Zhendong Wang, Keli Liu, Li Li, Ying Chen, Kai Li, Daowen Li, Houqiang Li

机构 * University of Science and Technology of China(中国科学技术大学) Alibaba Group(阿里巴巴集团)

AI总结 EchoGen通过前馈主体驱动自回归模型在任意场景中生成高质量视觉回声,实现高效生成与高保真度的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02281 2026-03-04 cs.LG cs.AI quant-ph

Quantum-Inspired Fine-Tuning for Few-Shot AIGC Detection via Phase-Structured Reparameterization

量子启发的少样本AIGC检测相结构重参数化细调

Kaiyang Xing, Han Fang, Zhaoyun Chen, Zhonghui Li, Yang Yang, Weiming Zhang, Guoping Guo

机构 * Anhui University, Hefei, China(安徽大学) Institute of Artificial Intelligence, Hefei Comprehensive National Science Center, Hefei, China(人工智能研究院) National University of Singapore, Singapore, Singapore(新加坡国立大学) University of Science and Technology of China, Hefei, China(中国科学技术大学)

AI总结 本文提出Q-LoRA和H-LoRA,利用量子和经典方法在少样本AIGC检测中提升准确率超过5%。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02219 2026-03-04 cs.LG cs.AI

NExT-Guard: Training-Free Streaming Safeguard without Token-Level Labels

NExT-Guard: 不依赖令牌级标签的无训练流式安全防护

Junfeng Fang, Nachuan Chen, Houcheng Jiang, Dan Zhang, Fei Shen, Xiang Wang, Xiangnan He, Tat-Seng Chua

机构 * University of Science and Technology of China(中国科学技术大学) National University of Singapore(新加坡国立大学)

AI总结 NExT-Guard通过监控稀疏自编码器的潜在特征,实现无训练的流式安全防护,优于基于监督训练的防护方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02216 2026-03-04 cs.LG cs.AI

ATPO: Adaptive Tree Policy Optimization for Multi-Turn Medical Dialogue

ATPO:多轮医疗对话中的自适应树策略优化

Ruike Cao, Shaojie Bai, Fugen Yao, Liang Dong, Jian Xu, Li Xiao

机构 * University of Science and Technology of China(中国科学技术大学) Qwen Applications Business Group, Alibaba Group(阿里云应用业务部) Zhejiang University(浙江大学)

AI总结 ATPO通过自适应树策略优化提升多轮医疗对话中的信息获取效率,有效解决不确定性问题,实验表明其在医疗对话任务中表现优异。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14686 2026-03-04 cs.DC cs.AI

xLLM Technical Report

xLLM 技术报告

Tongxuan Liu, Tao Peng, Peijun Yang, Xiaoyang Zhao, Xiusheng Lu, Weizhe Huang, Zirui Liu, Xiaoyu Chen, Zhiwei Liang, Jun Xiong, Donghe Jin, Minchao Zhang, Jinrong Guo, Yingxu Deng, Xu Zhang, Xianzhe Dong, Siqi Wang, Siyu Wu, Yu Wu, Zihan Tang, Yuting Zeng, Yanshu Wang, Jinguang Liu, Meng Kang, Menxin Li, Yunlong Wang, Yiming Liu, Xiaolong Ma, Yifan Wang, Yichen Zhang, Jinrun Yin, Keyang Zheng, Jiawei Yin, Jun Zhang, Ziyue Wang, Xiaobo Lin, Liangyu Liu, Liwei Lan, Yang Liu, Chunhua Peng, Han Liu, Songcheng Ren, Xuezhu Wang, Yunheng Shen, Yi Wang, Guyue Liu, Yitao Hu, Hui Chen, Tong Yang, Hailong Yang, Jing Li, Guiguang Ding, Ke Zhang

机构 * THU(清华大学) USTC(University of Science and Technology of China) BUAA(Beijing University of Aeronautics and Automation) PKU(Peking University) TJU(Tianjin University)

AI总结 xLLM是一种针对高性能大规模企业级服务设计的高效LLM推理框架,通过解耦服务引擎架构和多层优化提升吞吐量和推理效率。

Comments 39 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00438 2026-03-04 cs.CV

BindWeave: Subject-Consistent Video Generation via Cross-Modal Integration

BindWeave:通过跨模态整合实现主体一致的视频生成

Zhaoyang Li, Dongjun Qian, Kai Su, Qishuai Diao, Xiangyang Xia, Chang Liu, Wenfei Yang, Tianzhu Zhang, Zehuan Yuan

机构 * University of Science and Technology of China(中国科学技术大学) ByteDance(字节跳动) National Key Laboratory of Deep Space Exploration, Deep Space Exploration Laboratory(国家深空探测重点实验室,深空探测实验室)

AI总结 BindWeave通过跨模态整合解决主体一致视频生成难题,利用MLLM-DiT框架提升生成视频的主体一致性和自然度。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17520 2026-03-04 cs.RO cs.CV

InstructVLA: Vision-Language-Action Instruction Tuning from Understanding to Manipulation

InstructVLA: 从理解到操作的视觉-语言-动作指令微调

Shuai Yang, Hao Li, Bin Wang, Yilun Chen, Yang Tian, Tai Wang, Hanqing Wang, Feng Zhao, Yiyi Liao, Jiangmiao Pang

机构 * University of Science and Technology of China(中国科学技术大学) Zhejiang University(浙江大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

AI总结 InstructVLA通过视觉-语言-动作指令微调,实现了在多模态推理和动作生成之间的平衡,提升了机器人在复杂任务中的操控性能和泛化能力。

Comments 48 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07218 2026-03-04 cs.LG cs.AI cs.CV

Perception-R1: Advancing Multimodal Reasoning Capabilities of MLLMs via Visual Perception Reward

Perception-R1: 通过视觉感知奖励提升多模态大语言模型的多模态推理能力

Tong Xiao, Xin Xu, Zhenya Huang, Hongyu Gao, Quan Liu, Qi Liu, Enhong Chen

机构 * University of Science and Technology of China(中国科学技术大学) State Key Laboratory of Cognitive Intelligence(认知智能国家重点实验室) iFLYTEK AI Research(iFLYTEK人工智能研究院) Hong Kong University of Science and Technology(香港科学与技术大学)

AI总结 Perception-R1通过引入视觉感知奖励提升多模态大语言模型的多模态推理能力

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02137 2026-03-03 cs.IR cs.CV

NextAds: Towards Next-generation Personalized Video Advertising

NextAds: 向下一代个性化视频广告迈进

Yiyan Xu, Ruoxuan Xia, Wuqiang Zheng, Fengbin Zhu, Wenjie Wang, Fuli Feng

机构 * University of Science and Technology of China(科学技术大学) Hohai University(河海大学) National University of Singapore(新加坡国立大学)

AI总结 NextAds提出一种基于生成的范式,通过生成式AI实现连续空间中视频创意的实时优化,提升个性化广告的效果和时效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02079 2026-03-03 cs.CV

MMNavAgent: Multi-Magnification WSI Navigation Agent for Clinically Consistent Whole-Slide Analysis

MMNavAgent: 多倍率WSI导航代理用于临床一致的全滑片分析

Zhengyang Xu, Han Li, Jingsong Liu, Linrui Xie, Xun Ma, Xin You, Shihui Zu, Ayako Ito, Xinyu Hao, Hongming Xu, Shaohua Kevin Zhou, Nassir Navab, Peter J. Schüffler

机构 * Institute of Pathology, Technical University of Munich, Germany(慕尼黑技术大学病理研究所) Munich Data Science Institute (MDSI), Munich, Germany(慕尼黑数据科学研究所) Munich Center for Machine Learning (MCML), Munich, Germany(慕尼黑机器学习中心) Computer Aided Medical Procedures (CAMP), TU Munich, Munich, Germany(计算机辅助医疗程序(CAMP),慕尼黑技术大学) Dalian University of Technology(大连理工大学) Cancer Hospital of Dalian University of Technology, Shenyang(大连理工大学肿瘤医院) Department of Human Pathology, Juntendo University Graduate School of Medicine(立命大学医学研究生院人类病理部门) University of Science and Technology of China(中国科学技术大学) Institute of Medical Robotics, Shanghai Jiao Tong University(上海交通大学医学机器人研究所) Northwest University of China(中国西北大学)

AI总结 MMNavAgent通过多倍率交互建模和自适应倍率选择,提升全滑片图像诊断性能,实验显示AUC和BACC均有所提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01948 2026-03-03 cs.CV

PreSight: Preoperative Outcome Prediction for Parkinson's Disease via Region-Prior Morphometry and Patient-Specific Weighting

PreSight:通过区域先验形态学和患者特异性加权进行帕金森病术前预后预测

Yand Wang, Chen Zhang, Lanyun Zhu, Yixin Chen, Qunbo Wang, Yutong Bai, Jurgen Germann, Yinghong Wen, Shuai Shao

机构 * Beijing Jiaotong University(北京交通大学) Nanyang Technological University(南洋理工大学) Institute of Medical Technology, Peking University(北京大学医学技术研究院) Beijing Tiantan Hospital, Capital Medical University(北京天坛医院) University Health Network, University of Toronto(多伦多大学健康网络) Suzhou Institute for Advanced Research, University of Science and Technology of China(中国科学技术大学苏州研究院)

AI总结 PreSight通过结合临床先验与区域自适应形态学,实现帕金森病术前预后预测,提升术后运动改善预测的准确性和临床实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00654 2026-03-03 cs.LG

PHAT: Modeling Period Heterogeneity for Multivariate Time Series Forecasting

PHAT:用于多变量时间序列预测的周期异质性建模

Jiaming Ma, Qihe Huang, Haofeng Ma, Guanjun Wang, Sheng Huang, Zhengyang Zhou, Pengkun Wang, Binwu Wang, Yang Wang

机构 * University of Science and Technology of China(中国科学技术大学) Suzhou Institute for Advanced Research(苏州先进研究院) The University of Nottingham Ningbo China(宁波大学)

AI总结 PHAT通过周期异质性感知机制,有效捕捉多变量时间序列中的周期差异,提升预测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03069 2026-03-03 cs.CV

SSFMamba: Learning Symmetry-driven Spatial-Frequency Modeling for Physically Consistent 3D Medical Image Segmentation

SSFMamba: 基于对称性的空间-频率建模学习用于物理一致的3D医学图像分割

Bo Zhang, Yifan Zhang, Shuo Yan, Yu Bai, Zheng Zhang, Wu Liu, Wendong Wang, Yongdong Zhang

机构 * State Key Laboratory of Networking and Switching Technology, School of Computer Science (National Pilot Software Engineering School), Beijing University of Posts and Telecommunications(网络与交换技术国家重点实验室,计算机学院(国家试点软件工程学院),北京邮电大学) School of Intelligent Engineering and Automation, Beijing University of Posts and Telecommunications(智能工程与自动化学院,北京邮电大学) School of Information Science and Technology, University of Science and Technology of China(信息科学与技术学院,中国科学技术大学)

AI总结 SSFMamba通过结合对称性和空间-频率建模,提升3D医学图像分割的精度与一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01757 2026-03-03 cs.CV

StepVAR: Structure-Texture Guided Pruning for Visual Autoregressive Models

StepVAR: 结构-纹理引导的视觉自回归模型剪枝

Keli Liu, Zhendong Wang, Wengang Zhou, Houqiang Li

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 StepVAR通过结合结构和纹理重要性,提出无需训练的token剪枝框架,实现视觉自回归模型的高效推理加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01654 2026-03-03 cs.AI

CeProAgents: A Hierarchical Agents System for Automated Chemical Process Development

CeProAgents:一种用于自动化化学过程开发的分层智能体系统

Yuhang Yang, Ruikang Li, Jifei Ma, Kai Zhang, Qi Liu, Jianyu Han, Yonggan Bu, Jibin Zhou, Defu Lian, Xin Li, Enhong Chen

机构 * Dalian Institute of Chemical Physics, Chinese Academy of Sciences(大连化学物理研究所,中国科学院) State Key Laboratory of Cognitive Intelligence, University of Science and Technology of China(认知智能国家重点实验室,中国科学技术大学)

AI总结 CeProAgents通过分层多智能体系统实现化学过程开发的自动化,结合动态聊天组与结构化工作流,提出多维基准评估方法,验证了其在化工工程中的有效性与局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01647 2026-03-03 cs.CV

QCAgent: An agentic framework for quality-controllable pathology report generation from whole slide image

QCAgent:一种用于从全切片图像生成质量可控病理科报告的代理框架

Rundong Wang, Wei Ba, Ying Zhou, Yingtai Li, Bowen Liu, Baizhi Wang, Yuhao Wang, Zhidong Yang, Kun Zhang, Rui Yan, S. Kevin Zhou

机构 * School of Biomedical Engineering, Division of Life Sciences Medicine, University of Science Technology of China, Hefei, Anhui, 230026, P.R. China Center for Medical Imaging, Robotics, Analytic Computing \& Learning (MIRACLE), Suzhou Institute for Advance Research, USTC, 215123, P.R. China Chinese PLA General Hospital Ninth Medical Center, China Hong Kong University of Science

AI总结 QCAgent通过引入定制批评机制和证据驱动的细化流程,实现从全切片图像生成质量可控、具有临床意义的病理科报告。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01438 2026-03-03 cs.CL cs.AI

Enhancing Persona Following at Decoding Time via Dynamic Importance Estimation for Role-Playing Agents

通过动态重要性估计增强解码时的个性跟随以用于角色扮演代理

Yuxin Liu, Mingye Zhu, Siyuan Liu, Bo Hu, Lei Zhang

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 本文提出了一种基于理论的动态重要性估计方法,通过加权奖励引导解码提升角色扮演代理在动态场景中的个性跟随能力。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01409 2026-03-03 cs.AI cs.LG cs.SE

MIST-RL: Mutation-based Incremental Suite Testing via Reinforcement Learning

MIST-RL:基于突变的增量测试套件生成 via 强化学习

Sicheng Zhu, Jiajun Wang, Jiawei Ai, Xin Li

机构 * Fudan University, Shanghai, China(复旦大学) University of Science and Technology of China(中国科学技术大学) Xi'an Jiaotong University, Xi'an, China(西安交通大学) South China University of Technology, Guangzhou, China(华南理工大学)

AI总结 MIST-RL通过强化学习优化测试生成,提升突变得分并减少测试用例数量,改进代码验证效果。

Comments Preprint. 17 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01382 2026-03-03 cs.SD cs.CL

End-to-End Simultaneous Dysarthric Speech Reconstruction with Frame-Level Adaptor and Multiple Wait-k Knowledge Distillation

端到端的同时口吃语音重建与帧级适配模块及多视图知识蒸馏

Minghui Wu, Haitao Tang, Jiahuan Fan, Ruizhi Liao, Yanyong Zhang

机构 * University of Science and Technology of China(中国科学技术大学) iFlytek Co., Ltd.(科大讯飞股份有限公司)

AI总结 本文提出端到端的同时口吃语音重建系统,通过帧级适配模块和多视图知识蒸馏模块,提升重建语音的鲁棒性和可懂度。

Comments Submitted to 2025 Asia Pacific Signal and Information Processing Association Annual Summit and Conference (APSIPA ASC)

Journal ref 2025 Asia Pacific Signal and Information Processing Association Annual Summit and Conference (APSIPA ASC), Singapore, 2025, pp. 1092-1097

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01369 2026-03-03 cs.SD cs.CL

DARS: Dysarthria-Aware Rhythm-Style Synthesis for ASR Enhancement

DARS: 用于增强ASR的肌张力障碍意识节奏风格合成

Minghui Wu, Xueling Liu, Jiahuan Fan, Haitao Tang, Yanyong Zhang, Yue Zhang

机构 * University of Science and Technology of China(中国科学技术大学) iFlytek Co., Ltd.(iFlytek公司) Huawei Technology(华为技术)

AI总结 DARS通过多阶段节奏预测和条件流匹配机制,提升ASR在肌张力障碍语音识别中的性能。

Comments Submitted to 2025 Asia Pacific Signal and Information Processing Association Annual Summit and Conference (APSIPA ASC)

Journal ref 2025 Asia Pacific Signal and Information Processing Association Annual Summit and Conference (APSIPA ASC), Singapore, Singapore, 2025, pp. 1104-1109

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01135 2026-03-03 cs.AI

FCN-LLM: Empower LLM for Brain Functional Connectivity Network Understanding via Graph-level Multi-task Instruction Tuning

FCN-LLM: 通过图级多任务指令微调赋能LLM理解脑功能连接网络

Xingcan Hu, Wei Wang, Li Xiao

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 FCN-LLM通过图级多任务指令微调使LLM理解脑功能连接网络,提升其在临床任务中的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21592 2026-03-03 cs.LG

Accelerating Data Generation for Nonlinear temporal PDEs via homologous perturbation in solution space

通过解空间中的同源扰动加速非线性时间PDEs的数据生成

Lei Liu, Zhenxin Huang, Hong Wang, huanshuo dong, Haiyang Xin, Hongwei Zhao, Bin Li

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 HOPSS通过解空间中的同源扰动方法,高效生成非线性时间PDEs的数据集,减少计算时间并保持模型训练精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23040 2026-03-03 cs.CL cs.AI

Look Back to Reason Forward: Revisitable Memory for Long-Context LLM Agents

回望以推导前行:用于长上下文LLM代理的可回溯记忆

Yaorui Shi, Yuxin Chen, Siyuan Wang, Sihang Li, Hengxing Cai, Qi Gu, Xiang Wang, An Zhang

机构 * University of Science and Technology of China(中国科学技术大学) National University of Singapore(新加坡国立大学) Shanghai Jiao Tong University(上海交通大学) DP Technology(DP科技) Meituan(美团)

AI总结 ReMemR1通过整合记忆检索机制和多级奖励设计,提升长上下文问答任务的推理能力与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18041 2026-03-03 cs.CV cs.RO

Openfly: A comprehensive platform for aerial vision-language navigation

Openfly:面向空中视觉-语言导航的综合性平台

Yunpeng Gao, Chenhui Li, Zhongrui You, Junli Liu, Zhen Li, Pengan Chen, Qizhi Chen, Zhonghan Tang, Liansheng Wang, Penghui Yang, Yiwen Tang, Yuhang Tang, Shuai Liang, Songyi Zhu, Ziqin Xiong, Yifei Su, Xinyi Ye, Jianan Li, Yan Ding, Dong Wang, Xuelong Li, Zhigang Wang, Bin Zhao

机构 * Shanghai AI Laboratory(上海人工智能实验室) Northwestern Polytechnical University(西北工业大学) Beihang University(北航) Shanghai Jiao Tong University(上海交通大学) The University of Hong Kong(香港大学) Zhejiang University(浙江大学) University of Science and Technology of China(中国科学技术大学) East China University of Science and Technology(东华大学) Fudan University(复旦大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) TeleAI

AI总结 OpenFly平台通过整合多种渲染引擎和自动化工具链,构建大规模空中VLN数据集,并提出关键帧感知的VLN模型,提升户外空中视觉-语言导航的研究与应用。

Comments accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00978 2026-03-03 cs.CV cs.AI

EraseAnything++: Enabling Concept Erasure in Rectified Flow Transformers Leveraging Multi-Object Optimization

EraseAnything++: 通过多对象优化实现Rectified Flow Transformers中的概念擦除

Zhaoxin Fan, Nanxiang Jiang, Daiheng Gao, Shiji Zhou, Wenjun Wu

机构 * Beijing Advanced Innovation Center for Future Blockchain and Privacy Computing, School of Artificial Intelligence, Beihang University(北京未来区块链与隐私计算先进创新中心,人工智能学院,北航) University of Science and Technology of China(中国科学技术大学)

AI总结 EraseAnything++通过多目标优化实现图像和视频扩散模型中的概念擦除,提升生成质量与时间一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00719 2026-03-03 cs.RO

Keyframe-Guided Structured Rewards for Reinforcement Learning in Long-Horizon Laboratory Robotics

关键帧引导的结构化奖励用于长周期实验室机器人强化学习

Yibo Qiu, Shu'ang Sun, Haoliang Ye, Ronald X Xu, Mingzhai Sun

机构 * Suzhou Institute for Advanced Research, University of Science and Technology of China(科学技术大学苏州市先进研究院)

AI总结 本文提出关键帧引导的结构化奖励方法,用于提升实验室机器人在长周期任务中的精确操作能力。

详情

展开后加载摘要…

URL PDF HTML 收藏