arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Zhejiang University(浙江大学)

共收录 2931
2602.11919 2026-02-13 cs.CV cs.AI

DynaHOI: Benchmarking Hand-Object Interaction for Dynamic Target

DynaHOI:动态目标手-物体交互基准测试

BoCheng Hu, Zhonghan Zhao, Kaiyue Zhou, Hongwei Wang, Gaoang Wang

机构 * Shanghai AI Lab, Shanghai, China(上海人工智能实验室) Zhejiang University, Hangzhou, China(浙江大学) Sichuan Provincial Digital Human Center, Chengdu Minto Technology Co., Ltd., Chengdu, China(四川省数字人文中心)

AI总结 DynaHOI提出动态目标手-物体交互基准测试,通过参数化运动生成器和大规模数据集提升动态场景下的手部交互评估能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11825 2026-02-13 cs.LG physics.ao-ph

CAAL: Confidence-Aware Active Learning for Heteroscedastic Atmospheric Regression

CAAL:面向异方差大气回归的置信度感知主动学习

Fei Jiang, Jiyang Xia, Junjie Yu, Mingfei Sun, Hugh Coe, David Topping, Dantong Liu, Zhenhui Jessie Li, Zhonghua Zheng

机构 * Department of Computer Science The University of Manchester Manchester Greater Manchester UK(计算机科学系 伦敦大学曼彻斯特分校 曼彻斯特 大曼彻斯特 UK) Department of Atmospheric Sciences Zhejiang University Hangzhou China(大气科学系 浙江大学 杭州 中国) Yunqi Academy of Engineering Hangzhou China(云启工程学院 杭州 中国) The University of Manchester(伦敦大学曼彻斯特分校) Zhejiang University(浙江大学) Yunqi Academy of Engineering(云启工程学院)

AI总结 CAAL通过置信度感知主动学习框架,解决异方差大气回归中样本选择问题,提升高成本颗粒性质数据库的扩展效率。

Comments 17 pages in total

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11792 2026-02-13 cs.AI cs.CL

Detecting RLVR Training Data via Structural Convergence of Reasoning

通过推理的结构收敛检测RLVR训练数据

Hongbo Zhang, Yue Yang, Jianhao Yan, Guangsheng Bao, Yue Zhang, Yue Zhang

机构 * Zhejiang University(浙江大学) School of Engineering, Westlake University(西湖大学工程学院)

AI总结 通过推理结构收敛检测RLVR训练数据,提出Min-kNN距离方法有效区分训练数据与未见数据。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11000 2026-02-13 cs.CV

ContextGen: Contextual Layout Anchoring for Identity-Consistent Multi-Instance Generation

ContextGen: 基于情境布局锚定的多实例生成

Ruihang Xu, Dewei Zhou, Fan Ma, Yi Yang

机构 * ReLER Lab, CCAI, Zhejiang University(ReLER实验室、中国计算机学会、浙江大学)

AI总结 ContextGen通过情境布局锚定和身份一致性注意力机制,实现多实例生成中的布局控制与身份一致性,首次构建了IMIG-100K数据集并取得新突破。

Comments Project Page: https://nenhang.github.io/ContextGen/

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12022 2026-02-13 cs.CL cs.AI

Teaching LLMs According to Their Aptitude: Adaptive Reasoning for Mathematical Problem Solving

根据能力教学LLMs:数学问题解决的自适应推理

Xin Xu, Yan Xu, Tianhao Chen, Yuchen Yan, Chengwu Liu, Zaoyu Chen, Yufei Wang, Yichun Yin, Yasheng Wang, Lifeng Shang, Qun Liu, Lu Yin

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) Huawei Noah’s Ark Lab(华为诺亚实验室) Zhejiang University(浙江大学) Peking University(北京大学) The Hong Kong Polytechnic University(香港理工大学) University of Surrey(萨里大学)

AI总结 TATA通过自适应框架使LLMs根据自身能力自主调整推理策略,提升数学问题解决的效率和准确性。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11748 2026-02-13 cs.CL

Think Longer to Explore Deeper: Learn to Explore In-Context via Length-Incentivized Reinforcement Learning

思考更长以探索更深入:通过长度激励强化学习学习上下文中的探索

Futing Wang, Jianhao Yan, Yun Luo, Ganqu Cui, Zhi Wang, Xiaoye Qu, Yue Zhang, Yu Cheng, Tao Lin

机构 * Zhejiang University(浙江大学) Westlake University(西湖大学) Shanghai AI Laboratory(上海人工智能实验室) Nanjing University(南京大学) Institute of Advanced Technology, Westlake Institute for Advanced Study(西湖研究所以高级技术研究所) The Chinese University of Hong Kong(香港中文大学)

AI总结 通过长度激励强化学习,提升模型在上下文中的探索能力,从而在领域内和领域外任务中取得性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11584 2026-02-13 cs.LG cs.AI

Gradient Compression May Hurt Generalization: A Remedy by Synthetic Data Guided Sharpness Aware Minimization

梯度压缩可能损害泛化能力:通过合成数据引导的尖锐性感知最小化解决方法

Yujie Gu, Richeng Jin, Zhaoyang Zhang, Huaiyu Dai

机构 * Department of Information and Communication Engineering, Zhejiang University(浙江大学信息与通信工程学院) Zhejiang Provincial Key Laboratory of Multi-Modal Communication Networks and Intelligent Information Processing(浙江省多模态通信网络与智能信息处理重点实验室) Department of Electrical and Computer Engineering, North Carolina State University(北卡罗来纳州立大学电子与计算机工程系)

AI总结 本文提出FedSynSAM,通过合成数据引导尖锐性感知最小化,解决联邦学习中梯度压缩导致泛化能力下降的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11558 2026-02-13 cs.LG

Brain4FMs: A Benchmark of Foundation Models for Electrical Brain Signal

Brain4FMs: 一种用于电气脑信号基础模型的基准测试

Fanqi Shen, Enhong Yang, Jiahe Li, Junru Hong, Xiaoran Pan, Zhizhang Yuan, Meng Li, Yang Yang

机构 * Zhejiang University(浙江大学) Shanghai Institute of Microsystem and Information Technology, CAS(上海微系统与信息工程研究所,中国科学院)

AI总结 Brain4FMs提出了一种开放评估平台,用于评估和比较脑基础模型在电气脑信号处理中的性能和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11551 2026-02-13 cs.CL

SIGHT: Reinforcement Learning with Self-Evidence and Information-Gain Diverse Branching for Search Agent

SIGHT: 基于自证证据和信息增益多样分支的强化学习

Wenlin Zhong, Jinluan Yang, Yiquan Wu, Yi Liu, Jianhang Yao, Kun Kuang

机构 * Zhejiang University(浙江大学) Chongqing Ant Consumer Finance Co., Ltd.(重庆蚂蚁消费金融有限公司) Alibaba Group(阿里巴巴集团)

AI总结 SIGHT通过自证证据和信息增益驱动多样化分支,提升搜索代理的自主推理能力,减少冗余并增强探索策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11513 2026-02-13 cs.CR cs.AI

Differentially Private and Communication Efficient Large Language Model Split Inference via Stochastic Quantization and Soft Prompt

通过随机量化和软提示实现差分隐私和通信高效的大型语言模型分拆推理

Yujie Gu, Richeng Jin, Xiaoyu Ji, Yier Jin, Wenyuan Xu

机构 * Zhejiang University, Hangzhou, China(浙江大学) University of Science and Technology of China, Anhui, China(中国科学技术大学)

AI总结 本文提出DEL框架,通过随机量化和软提示实现差分隐私和通信高效的LLM分拆推理,有效平衡隐私与效用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24836 2026-02-13 cs.AI cs.CL cs.LG

Logical Structure as Knowledge: Enhancing LLM Reasoning via Structured Logical Knowledge Density Estimation

逻辑结构作为知识:通过结构化逻辑知识密度估计增强LLM推理

Zhen Bi, Zhenlin Hu, Xueshu Chen, Mingyang Chen, Cheng Deng, Yida Xue, Zhen Wang, Qing Shen, Ningyu Zhang, Jungang Lou

机构 * Huzhou University(湖州大学) Zhejiang Key Laboratory of Intelligent Education Technology and Application(浙江智能教育技术与应用重点实验室) Banbu AI Foundation(Banbu AI基金会) Baichuan Inc(白川公司) University of Edinburgh(爱丁堡大学) Zhejiang University(浙江大学)

AI总结 本文提出通过结构化逻辑知识密度估计提升LLM推理能力,通过增强逻辑密度而非扩大数据量来提高模型认知潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10793 2026-02-13 cs.SD cs.HC cs.LG eess.AS

SonicSieve: Bringing Directional Speech Extraction to Smartphones Using Acoustic Microstructures

SonicSieve:利用声学微结构在智能手机上实现定向语音提取

Kuang Yuan, Yifeng Wang, Xiyuxing Zhang, Chengyi Shen, Swarun Kumar, Justin Chan

机构 * Carnegie Mellon University(卡内基梅隆大学) Tsinghua University(清华大学) Zhejiang University(浙江大学)

AI总结 SonicSieve通过生物启发式声学微结构在智能手机上实现定向语音提取,提升信号质量并优于传统麦克风阵列。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11057 2026-02-12 cs.LG

Divide, Harmonize, Then Conquer It: Shooting Multi-Commodity Flow Problems with Multimodal Language Models

分割、调和、然后征服:利用多模态语言模型解决多商品流问题

Xinyu Yuan, Yan Qiao, Zonghui Wang, Wenzhi Chen

机构 * Zhejiang University(浙江大学) Hefei University of Technology(合肥工业大学) Co-corresponding authors(共同通讯作者)

AI总结 Pram利用多模态语言模型解决多商品流问题,通过分解和调和子问题实现高效优化,性能接近线性规划求解器且运行时间显著降低。

Comments Published as a conference paper at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10997 2026-02-12 cs.RO

Multi-Task Reinforcement Learning of Drone Aerobatics by Exploiting Geometric Symmetries

利用几何对称性进行无人机空翻的多任务强化学习

Zhanyu Guo, Zikang Yin, Guobin Zhu, Shiliang Guo, Shiyu Zhao

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) WINDY Lab, School of Engineering, Westlake University(西湖大学工程学院WINDY实验室) School of Automation Science and Electrical Engineering, Beihang University(北航自动化科学与电气工程学院)

AI总结 GEAR通过利用几何对称性,提出了一种端到端多任务强化学习框架,实现高效且灵活的无人机空翻控制,成功率达98.85%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10819 2026-02-12 cs.LG

RePO: Bridging On-Policy Learning and Off-Policy Knowledge through Rephrasing Policy Optimization

RePO:通过重新表述策略优化弥合基于策略学习和基于策略知识的差距

Linxuan Xia, Xiaolong Yang, Yongyuan Chen, Enyue Zhao, Deng Cai, Yasheng Wang, Boxi Wu

机构 * State Key Laboratory of CAD\&CG, the College of Computer Science Technology, Zhejiang University. FiT, Tencent, Shenzhen, China. School of Software Technology, Zhejiang University

AI总结 RePO通过重新表述策略优化,有效结合基于策略学习和基于策略知识,提升困难样本利用和模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10815 2026-02-12 cs.CV cs.LG

Why Does RL Generalize Better Than SFT? A Data-Centric Perspective on VLM Post-Training

为什么强化学习比监督微调在泛化能力上更优?一种以数据为中心的视觉语言模型后训练视角

Aojun Lu, Tao Feng, Hangjie Yuan, Wei Li, Yanan Sun

机构 * College of Computer Science, Sichuan University(四川大学计算机科学学院) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)

AI总结 本文通过数据视角揭示了RL在VLM后训练中泛化能力优于SFT的原因,提出DC-SFT方法提升OOD性能并提高稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10675 2026-02-12 cs.CV cs.AI

TwiFF (Think With Future Frames): A Large-Scale Dataset for Dynamic Visual Reasoning

TwiFF (Think With Future Frames): 一个大规模动态视觉推理数据集

Junhua Liu, Zhangcheng Wang, Zhike Han, Ningli Wang, Guotao Liang, Kun Kuang

机构 * College of Computer Science and Technology, Zhejiang University, Hangzhou, China(浙江大学计算机科学与技术学院) School of Computer and Computing Science, Hangzhou City University, Hangzhou, China(杭州市城市大学计算机与计算科学学院) Henan Academy of Innovations in Medical Science (AIMS), Zhengzhou, China(河南省医学创新研究院) School of Software, Beihang University, Beijing, China(北京航空航天大学软件学院)

AI总结 TwiFF提出一个大规模动态视觉推理数据集及模型,通过整合视频生成与图像理解能力,提升动态场景下的视觉问答性能。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10549 2026-02-12 cs.CV cs.AI

Enhancing Weakly Supervised Multimodal Video Anomaly Detection through Text Guidance

通过文本引导增强弱监督多模态视频异常检测

Shengyang Sun, Jiashen Hua, Junyi Feng, Xiaojin Gong

机构 * School of Computer Science and Technology, Hangzhou Dianzi University(杭州电子科技大学计算机科学与技术学院) Alibaba Cloud(阿里云) College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息科学与电子工程学院)

AI总结 本文提出文本引导框架,通过多阶段文本增强和多尺度瓶颈Transformer融合模块,提升弱监督多模态视频异常检测的性能。

Comments Accepted by IEEE Transactions on Multimedia

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10146 2026-02-12 cs.CV cs.CL

VERA: Identifying and Leveraging Visual Evidence Retrieval Heads in Long-Context Understanding

VERA:识别和利用长上下文理解中的视觉证据检索头

Rongcan Pei, Huan Li, Fang Guo, Qi Zhu

机构 * Tongji University(同济大学) Zhejiang University(浙江大学) Westlake University(西湖大学) Amazon Web Services(亚马逊网络服务)

AI总结 VERA通过识别和利用视觉证据检索头,提升长上下文理解能力,显著提高开源VLMs的性能。

Comments 12 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09509 2026-02-12 cs.LG

Beyond Student: An Asymmetric Network for Neural Network Inheritance

超越学生:一种用于神经网络继承的非对称网络

Yiyun Zhou, Jingwei Shi, Mingjing Xu, Zhonghua Jiang, Jingyuan Chen

机构 * Zhejiang University(浙江大学) Shanghai University of Finance and Economics(上海金融学院) Swansea University(斯旺西大学)

AI总结 InherNet通过非对称低秩分解和SVD初始化,实现比传统学生网络更高效的神经网络继承,提升模型压缩性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09476 2026-02-12 cs.CV

FD-DB: Frequency-Decoupled Dual-Branch Network for Unpaired Synthetic-to-Real Domain Translation

FD-DB: 用于无配对合成到真实域翻译的频率解耦双分支网络

Chuanhai Zang, Jiabao Hu, XW Song

机构 * State Key Laboratory of Fluid Power and Mechatronic System, School of Mechanical Engineering, Zhejiang University(流体动力与机械系统国家重点实验室,机械工程学院,浙江大学) Zhejiang Key Laboratory of Advanced Manufacturing Technology, School of Mechanical Engineering, Zhejiang University(浙江省先进制造技术重点实验室,机械工程学院,浙江大学)

AI总结 FD-DB通过频率解耦双分支模型提升合成到真实域翻译的稳定性和真实性,优化外观一致性和下游任务性能。

Comments 26 pages, 13 figures, 2 tables. Code available at https://github.com/tryzang/FD-DB

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05380 2026-02-12 cs.CV

SAIL: Self-Amplified Iterative Learning for Diffusion Model Alignment with Minimal Human Feedback

SAIL:基于最小人类反馈的扩散模型对齐的自增强迭代学习

Xiaoxuan He, Siming Fu, Wanli Li, Zhiyuan Li, Dacheng Yin, Kang Rong, Fengyun Rao, Bo Zhang

机构 * ZheJiang University(浙江大学) Tencent Inc(腾讯公司)

AI总结 SAIL通过最小人类反馈实现扩散模型对齐,利用自我增强迭代学习替代传统奖励模型和大规模标注数据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00437 2026-02-12 cs.CV

ADGaussian: Generalizable Gaussian Splatting for Autonomous Driving via Multi-modal Joint Learning

ADGaussian:通过多模态联合学习实现自动驾驶的通用高斯点云重建

Qi Song, Chenghong Li, Haotong Lin, Sida Peng, Rui Huang

机构 * School of Science and Engineering, The Chinese University of Hong Kong (Shenzhen)(中国香港中文大学(深圳)科学与工程学院) Zhejiang University(浙江大学)

AI总结 ADGaussian通过多模态联合学习实现自动驾驶场景的高斯点云重建,提升零样本泛化能力。

Comments The paper is accepted by ICRA 2026 and the project page can be found at https://maggiesong7.github.io/research/ADGaussian/

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00443 2026-02-12 cs.RO cs.SY eess.SY

Dynamic Motion/Force Control of Mobile Manipulators via Extended-UDE

通过扩展UDE实现移动机械臂的动态运动/力控制

Songqun Gao, Wendi Ding, Maotong Cheng, Qinyuan Ren, Ben M. Chen

机构 * Department of Mechanical and Automation Engineering, The Chinese University of Hong Kong(香港中文大学机械与自动化工程系) College of Control Science and Engineering, Zhejiang University(浙江大学控制科学与工程学院)

AI总结 本文提出了一种基于扩展UDE的移动机械臂动态耦合控制方法,通过分离动态耦合项和未建模不确定性,提升系统响应速度和动态交互性能。

Journal ref Control Engineering Practice, Volume 167, 2026, 106650

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09973 2026-02-11 cs.RO

RoboInter: A Holistic Intermediate Representation Suite Towards Robotic Manipulation

RoboInter: 一种面向机器人操控的综合中间表示套件

Hao Li, Ziqin Wang, Zi-han Ding, Shuai Yang, Yilun Chen, Yang Tian, Xiaolin Hu, Tai Wang, Dahua Lin, Feng Zhao, Si Liu, Jiangmiao Pang

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Beihang University(北航) Nanyang Technological University(南洋理工大学) Zhejiang University(浙江大学) Tsinghua University(清华大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 RoboInter通过统一的中间表示套件,提升机器人操控中视觉-语言-动作系统的泛化能力和推理能力。

Comments Published to ICLR 2026, 69 pages, 40 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09888 2026-02-11 cs.RO

TriPilot-FF: Coordinated Whole-Body Teleoperation with Force Feedback

TriPilot-FF:具有力反馈的协调全身遥控

Zihao Li, Yanan Zhou, Ranpeng Qiu, Hangyu Wu, Guoqiang Ren, Weiming Zhi

机构 * Zeno AI Zhejiang University(浙江大学) Zhejiang University of Technology(浙江工业大学) University of Sydney(悉尼大学)

AI总结 TriPilot-FF通过引入脚踏板触觉反馈和双臂跟随遥控,实现了具有力反馈的协调全身遥控,提升移动机械臂的操控精度和避障能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09690 2026-02-11 cs.LG

Contextual and Seasonal LSTMs for Time Series Anomaly Detection

上下文和季节性LSTM用于时间序列异常检测

Lingpei Zhang, Qingming Li, Yong Yang, Jiahao Chen, Rui Zeng, Chenyang Lyu, Shouling Ji

机构 * Zhejiang University(浙江大学) Huawei Technologies(华为技术有限公司) Zhejiang Key Laboratory of Decision Intelligence(浙江省决策智能重点实验室)

AI总结 本文提出CS-LSTMs框架,通过结合上下文依赖和季节性模式,提升时间序列中细微异常的检测能力,并在基准数据集上验证了其有效性。

Comments Published as a conference paper at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09502 2026-02-11 cs.LG

Improved Approximate Regret for Decentralized Online Continuous Submodular Maximization via Reductions

通过降维实现去中心化在线连续亚模函数最大化问题的近似懊悔改进

Yuanyu Wan, Yu Shen, Dingzhi Yu, Bo Xue, Mingli Song

机构 * School of Software Technology, Zhejiang University, Ningbo, China(浙江大学宁波校区软件学院) State Key Laboratory of Blockchain and Data Security, Zhejiang University, Hangzhou, China(浙江大学区块链与数据安全国家重点实验室) School of Artificial Intelligence, Nanjing University, Nanjing, China(南京大学人工智能学院) Department of Computer Science, City University of Hong Kong, Hong Kong, China(香港城市大学计算机科学系)

AI总结 本文通过将去中心化在线连续亚模函数最大化问题转化为去中心化在线凸优化问题,改进了去中心化在线连续亚模函数最大化问题的近似懊悔界。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09483 2026-02-11 cs.CV

Beyond Next-Token Alignment: Distilling Multimodal Large Language Models via Token Interactions

超越单个词对齐:通过令牌交互蒸馏多模态大语言模型

Lin Chen, Xiaoke Zhao, Kun Ding, Weiwei Feng, Changtao Miao, Zili Wang, Wenxuan Guo, Ying Wang, Kaiyuan Zheng, Bo Zhang, Zhe Li, Shiming Xiang

机构 * MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所信息与智能系统研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Zhejiang University(浙江大学)

AI总结 Align-TI通过令牌交互改进知识蒸馏,实现多模态大语言模型的高效压缩与性能提升

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08321 2026-02-11 cs.CL

Improving Data and Reward Design for Scientific Reasoning in Large Language Models

改进大型语言模型中的数据与奖励设计以提升科学推理能力

Zijie Chen, Zhenghao Lin, Xiao Liu, Zhenzhong Lan, Yeyun Gong, Peng Cheng

机构 * Zhejiang University(浙江大学) Westlake University(西湖大学) Microsoft Research Asia(微软亚洲研究院)

AI总结 本文提出Dr. SCI数据集和后训练流程,通过探索扩展SFT、动态难度课程和SciRubric引导RL提升大型语言模型的科学推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏