arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Zhejiang University(浙江大学)

2026-07-28 至 2026-07-28 共收录 20
2607.24591 2026-07-28 cs.CV 新提交

CameraAnything: Refilming Videos with Arbitrary Camera Control

CameraAnything:使用任意相机控制重新拍摄视频

Yixuan Li, Yanhong Zeng, Ka Leong Cheng, Jiayi Zhu, Hanlin Wang, Wen Wang, Yihao Meng, Hao Ouyang, Qiuyu Wang, Yue Yu, ZiDong Wang, Yiyuan Zhang, Yujun Shen, Dahua Lin

机构 * The Chinese University of Hong Kong(香港中文大学) Ant Group(蚂蚁集团) Tsinghua University(清华大学) Zhejiang University(浙江大学) The Hong Kong University of Science and Technology(香港科技大学)

AI总结 CameraAnything是用于相机控制视频编辑的统一框架,采用逐像素普吕克光线注入等方法联合控制相机参数,开发合成管道克服数据稀缺,能在单过程中实现多种视频编辑操作,为视频制作提供实用价值。

Comments Project page: https://yixuanli98.github.io/cameraanything/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24031 2026-07-28 cs.AI cs.HC cs.RO eess.SP 新提交

A Cyclic Adaptation-Generalization Framework with Uncertainty-Guided Self-Paced Learning for Long-Term Brain-Machine Interfaces

一种用于长期脑机接口的具有不确定性引导自步学习的循环适应-泛化框架

Jiyu Wei, Di Hong, Zhanjie Zhang, Dazhong Rong, Qinming He, Yueming Wang

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) Nanhu Brain-Computer Interface Institute(南湖脑机接口研究所)

AI总结 针对侵入性脑机接口因神经漂移面临的长期部署挑战,提出UnSPC框架,通过UnSPL机制协同DA和DG,利用噪声鲁棒排序策略挖掘可靠伪标签样本,引入CycAG策略整合DA和DG,经实验验证其有效性和鲁棒性,为长期BMI控制铺路。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24023 2026-07-28 cs.AI cs.HC cs.RO eess.SP 新提交

Self-Supervised Consistency Enhanced Disentangled Learning for Neural Decoding Generalization in Brain-Machine Interface

用于脑机接口神经解码泛化的自监督一致性增强解缠学习

Jiyu Wei, Di Hong, Zhanjie Zhang, Dazhong Rong, Qinming He, Yueming Wang

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) Nanhu Brain-Computer Interface Institute(南湖脑机接口研究院)

AI总结 研究脑机接口因神经漂移致性能下降问题,提出自监督一致性增强解缠学习框架(SSCDL)。通过设计一致性增强神经解码器及采用互补解缠泛化机制,学习鲁棒表征,实现跨日泛化,提升解码性能,展现长期交互潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23669 2026-07-28 cs.CV cs.RO 新提交

RRTrack: Robust and Recoverable Object 6D Pose Tracking for Dynamic Scenes

RRTrack:用于动态场景的鲁棒且可恢复的物体6D姿态跟踪

Junyue Li, Ye Zheng, Yifan Chen, Zhe Sun, Xuelong Li

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) Institute of Artificial Intelligence (TeleAI), China Telecom(中国电信人工智能研究院) College of Future Information Technology, Fudan University(复旦大学未来信息技术学院)

AI总结 研究针对动态场景中物体6D姿态跟踪难题,提出RRTrack。它采用2D-6D闭环跟踪策略,集成记忆视频对象分割与6D姿态细化,还有双库模板匹配模块。在合成基准和真实世界实验中验证,相比FoundationPose有显著提升,兼具高效与鲁棒性。

Comments 6D Pose Tracking, 10 pages, real-world experiments, training-free

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23650 2026-07-28 cs.SD eess.AS 新提交

Expose Your Disguise: Recovering Source Speaker Identity From Voice Conversion

揭露你的伪装:从语音转换中恢复源说话者身份

Hanlei Zhang, Zhongming Ma, Mingyang Zhang, Tengfei Liu, Yushi Cheng, Yanjiao Chen

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团)

AI总结 研究针对语音转换威胁生物特征安全问题,提出TRIDENT框架,通过三叉戟架构,包括识别转换机制、提取目标说话者潜在表示等,从转换音频恢复源说话者身份,实验表明其准确率高且性能稳健。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23575 2026-07-28 cs.CV cs.AI 新提交

D3O: Dynamic Distribution Distillation for Ordinal Regression

D3O:用于序数回归的动态分布蒸馏

Chunlai Dong, Yaojun Hu, Yuyang Xu, Haochao Ying, Jian Wu

机构 * Zhejiang University(浙江大学)

AI总结 针对序数回归中因主观标注产生的问题,提出D3O动态分布蒸馏框架,通过自蒸馏用序数标签分布的训练驱动演化取代静态监督,引入对比序数感知标签增强模块和基于CDF的跨层交互蒸馏机制,实验证明其优于现有方法。

Comments 10 pages, 5 figures, ACMMM2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23503 2026-07-28 cs.LG cs.AI cs.DB 新提交

Impute On-Demand: Adaptive Correlated Time Series Imputation for Changing Environments

按需插补:针对变化环境的自适应相关时间序列插补

Zhichen Lai, Huan Li, Dalin Zhang, Dong Gong, Lina Yao, Christian S. Jensen

机构 * College of Computer and Data Science, Fuzhou University(福州大学计算机与数据科学学院) Engineering Research Center of Big Data Intelligence, Ministry of Education(教育部大数据智能工程研究中心) Fujian Key Laboratory of Network Computing and Intelligent Information Processing, Fuzhou University(福州大学福建省网络计算与智能信息处理重点实验室) Department of Computer Science, Aalborg University(奥尔堡大学计算机科学系) Space Information Research Institute, Hangzhou Dianzi University(杭州电子科技大学空间信息研究院) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) State Key Laboratory of Blockchain and Data Security, Zhejiang University(浙江大学区块链与数据安全国家重点实验室) School of Computer Science and Engineering, The University of New South Wales(新南威尔士大学计算机科学与工程学院) CSIRO’s Data61(联邦科学与工业研究组织数据61)

AI总结 研究针对物联网中相关时间序列数据缺失值插补问题,提出AdaCTSi方法,结合一次性时间卷积网络与相关技术提取解耦特征,经实验验证该方法能有效降低MAE,且单个模型支持自适应推理,可部署在商用设备上。

Comments 15 pages, 9 figures. Accepted for publication in IEEE Transactions on Knowledge and Data Engineering (IEEE TKDE)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23472 2026-07-28 cs.CV 新提交

VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation

VIPER:用于物理上合理的视频生成的视觉上下文物理推理

Tianxiao Chen, Hanmo Chen, Huajin Chen, Bo Li, Qi Ye, Peng-Tao Jiang

机构 * Zhejiang University(浙江大学) vivo Mobile Communication Co., Ltd.(维沃移动通信有限公司)

AI总结 研究针对视频生成模型控制物理行为难的问题,提出VIPER框架,利用多模态大语言模型提取物理线索,通过分层训练引导图像到视频生成器,构建VIPER-19K数据集,实验证明该框架能实现物理行为转移且效果良好。

Comments tech report

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23337 2026-07-28 cs.LG 新提交

Neural operator discovery from heterogeneous trajectories

从异构轨迹中发现神经算子

Zituo Chen, Qiaofeng Li, Jiaxin Hu, Sili Deng

机构 * Massachusetts Institute of Technology(麻省理工学院) Zhejiang University(浙江大学)

AI总结 研究如何从异构轨迹发现神经算子,提出因式分解潜在条件公式,联合学习神经算子与低维潜在表示,能捕获系统变化内在维度,实现零样本外推等泛化,为无显式监督的算子学习建立可解释范式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22597 2026-07-28 cs.AI 新提交

HyCE-RAG: Hypergraph Chain-of-Evidence Retrieval-Augmented Generation for Explainable Multi-hop Question Answering

HyCE-RAG:用于可解释多跳问答的超图证据链检索增强生成

Hong-Yu An, Yun-Jian Zhang, Chen-Wei Liang, Tian-Yi Zhang, Jian Ding, Yi-Lun Wu, Ao-Bo Li, Wei-Cong Su, Saifullah, Mujiangshan Wang

机构 * University of Macau(澳门大学) Shenzhen Kaihong Digital Industry Development Co., Ltd.(深圳开鸿数字产业发展有限公司) University of New South Wales(新南威尔士大学) Zhejiang University(浙江大学) Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院)

AI总结 研究可解释多跳问答,提出HyCE-RAG框架,将实体等组织成超边构建超图,经置信度传播和证据组装选择连接证据路径,评分时考虑多种因素,实验证明其在多方面优于标准和基于图的RAG基线,为复杂问答检索后推理提供新方向。

Comments 15 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22586 2026-07-28 cs.AI cs.CL 新提交

MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models

MM-ShiftKV:用于多模态大语言模型的解码感知预填充阶段键值选择

Jinsong Shu, Chenyang Wu, Zhongle Xie, Baokun Wang, Lidan Shou

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团) The State Key Laboratory of Blockchain and Data Security, Zhejiang University(浙江大学区块链与数据安全国家重点实验室) Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security(杭州高新技术产业开发区(滨江)区块链与数据安全研究院)

AI总结 研究多模态大语言模型中KV缓存问题,提出MM-ShiftKV方法,通过构建方差扩展查询代理近似解码时查询行为,基于聚合注意力质量估计KV重要性,在严格缓存预算下性能优于现有方法。

Comments 19 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22637 2026-07-28 cs.AI cs.IT math.IT 新提交

Fast Cross-Scenario Adaptation of CSI Models via Channel Conditional Parameter Generation

通过信道条件参数生成实现CSI模型的快速跨场景自适应

Xudong Zou, Siyu Wu, Zunlei Feng, Jie Song, Yuanyu Wan, Mingli Song, Jiacong Hu

机构 * School of Software Technology, Zhejiang University(浙江大学软件学院) State Key Laboratory of Blockchain and Data Security, Zhejiang University Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security(浙江大学杭州高新技术产业开发区(滨江)区块链与数据安全国家重点实验室)

AI总结 研究针对CSI模型在不同场景适应性差的问题,提出CCPG方法,通过组件冻结实验识别瓶颈,生成轻量级LoRA权重,经多种技术处理实现快速跨场景自适应,实验表明该方法能高效部署CSI模型用于6G通信。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16692 2026-07-28 cs.SE cs.CL 版本更新

Dependency-Guided Code Generation: Structured Matrix Decomposition and Consistency-Guided Refinement

依赖引导的代码生成:结构化矩阵分解与一致性引导的细化

Mingqiao Mo, Yangchen Zeng, Zikai Xiao, Xin Xiao, Wenhua Nie, Zhaolu Kang, Guangyuan Dong, Kai Shu, Hao Zhang, Xiaodong Fan

机构 * University of the Chinese Academy of Sciences(中国科学院大学) ByteDance Inc.(字节跳动公司) Zhejiang University(浙江大学) National Taiwan University(台湾国立大学) Peking University(北京大学) Alibaba Group(阿里巴巴集团) Tsinghua University(清华大学) Liaoning Technical University(辽宁技术大学)

AI总结 针对现有代码生成方法无法充分捕捉代码实体依赖关系的问题,提出依赖感知代码生成框架,通过结构化矩阵分解和一致性引导细化生成代码,经实验验证该方法能生成语义对齐和结构保真度更高的代码。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00552 2026-07-28 cs.OS cs.DC cs.NI cs.RO cs.SY eess.SY 版本更新

Edge-Based QoS-Aware Adaptive Task Placement: A Closed-Loop Control in Multi-Robot Systems

基于边缘的QoS感知自适应任务放置:多机器人系统中的闭环控制

Thien Tran, Jonathan Kua, Thuong Hoang, Minh Tran, Honghao Lyu, Jiong Jin

机构 * Deakin University(德肯大学) RMIT University(皇家墨尔本理工大学) Zhejiang University(浙江大学) Swinburne University of Technology(西姆伯恩理工大学)

AI总结 提出一种QoS感知的自适应任务放置(ATP)控制器,通过多指标成本评分和闭环控制,在共享边缘节点上动态切换任务放置,以降低尾延迟和截止时间违规。

Comments 6 pages, 2 figures, 2 tables, 1 algorithm, accepted paper on the 24th IEEE International Conference on Industrial Informatics (INDIN), 26-29 July, 2026, Melbourne, Australia

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17931 2026-07-28 cs.AI 版本更新

LiteResearcher: A Scalable Agentic RL Training Framework for Deep Research Agent

LiteResearcher:一种用于深度研究代理的可扩展代理强化学习训练框架

Bince Qu, Wanli Li, Bo Pan, Jianyu Zhang, Zheng Liu, Pan Zhang, Wei Chen, Bo Zhang

机构 * Zhejiang University(浙江大学) Simplex AI The Hong Kong Polytechnic University(香港理工大学)

AI总结 LiteResearcher通过构建轻量虚拟世界提升代理强化学习的可扩展性,使小规模搜索代理在GAIA和Xbench等基准上取得state-of-the-art结果。

Comments COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29452 2026-07-28 cs.RO 版本更新

CReF: Cross-modal and Recurrent Fusion for Depth-conditioned Humanoid Locomotion

CReF:跨模态与递归融合用于基于深度的人形机器人运动

Yuan Hao, Ruiqi Yu, Shixin Luo, Guoteng Zhang, Jun Wu, Qiuguo Zhu

机构 * Institute of Cyber-Systems and Control, Zhejiang University(浙江大学控制科学与工程学院) School of Control Science and Engineering, Shandong University(山东大学控制科学与工程学院)

AI总结 本文提出CReF框架,通过直接从原始前方深度数据学习运动相关特征,实现稳定复杂地形行走,改进了传统依赖几何抽象的方法,展示了在模拟和真实环境中鲁棒的地形穿越能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08521 2026-07-28 cs.CV cs.RO eess.IV 版本更新

OccTrack360: 4D Panoptic Occupancy Tracking from Surround-View Fisheye Cameras

OccTrack360: 从环视鱼眼相机实现4D全景占用跟踪

Yongzhi Lin, Kai Luo, Yuanfan Zheng, Hao Shi, Mengfei Duan, Yang Liu, Kailun Yang

机构 * School of Artificial Intelligence and Robotics, Hunan University(人工智能与机器人学院,湖南大学) State Key Laboratory of Extreme Photonics and Instrumentation, Zhejiang University(极端光子学与仪器国家重点实验室,浙江大学) National Engineering Research Center of Robot Visual Perception and Control Technology, Hunan University(机器人视觉感知与控制技术国家工程研究中心,湖南大学)

AI总结 OccTrack360提出新的4D全景占用跟踪基准及FoSOcc框架,解决鱼眼成像中的球面投影和体素定位问题,提升占用跟踪性能。

Comments Accepted to IEEE/RSJ IROS 2026. The benchmark and source code will be made publicly available at https://github.com/YouthZest-Lin/OccTrack360

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03570 2026-07-28 cs.LG 版本更新

Asymmetric Hierarchical Anchoring for Robust Audio-Visual Cross-Modal Generalization

非对称层次锚定用于音频-视觉联合表示:解决信息分配模糊性以实现鲁棒跨模态泛化

Bixing Wu, Yuhong Zhao, Zongli Ye, Jiachen Lian, Xiangyu Yue, Gopala Anumanchipalli

机构 * Zhejiang University, China(浙江大学) University of California, Berkeley, USA(加州大学伯克利分校) MMLab, Chinese University of Hong Kong, China(香港中文大学MMLab)

AI总结 本文提出非对称层次锚定框架,通过结构化语义锚点解决跨模态泛化中的信息分配模糊性,提升语义一致性和表示纯度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22342 2026-07-28 cs.RO 版本更新

VL-LN Bench: Towards Long-horizon Goal-oriented Navigation with Active Dialogs

VL-LN基准:通过主动对话实现长视界目标导向导航

Wensi Huang, Shaohao Zhu, Meng Wei, Siqi Zhang, Jinming Xu, Xihui Liu, Hanqing Wang, Tai Wang, Feng Zhao, Jiangmiao Pang

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai AI Laboratory(上海人工智能实验室) Zhejiang University(浙江大学) The University of Hong Kong(香港大学)

AI总结 VL-LN基准通过引入主动对话机制,提升长视界目标导向导航任务的性能和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17492 2026-07-28 cs.AI cs.CL cs.LG 版本更新

PD$^3$: A Project Duplication Detection Framework via Adapted Multi-Agent Debate

PD$^3$:一种通过适应性多智能体辩论的项目重复检测框架

Dezheng Bao, Yueci Yang, Chutian Yu, Xin Chen, Zeguo Fei, Xiang Yuan, Lijun Zhang, Jiangqian Huang, Zhengxuan Jiang, Daoze Zhang, Junru Chen, Yang Yang

机构 * Zhejiang University(浙江大学) State Grid Power Supply Co. Ltd.(国网电力供应有限公司)

AI总结 研究项目重复检测问题,提出PD$^3$框架,通过适应性多智能体辩论,结合局部多智能体辩论与全局循环调度检索项目集,能保证公平比较并产生相关分数和反馈,在真实项目上优于基线,还部署平台节省资金。

Comments 17 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏