arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Zhejiang University(浙江大学)

共收录 2903
2607.25218 2026-07-29 cs.AI 新提交

Everyone is unique: Towards Behaviorally Heterogeneous Negotiation Dialogue Systems for Debt Collection

每个人都是独特的:迈向用于债务催收的行为异质性协商对话系统

Yuhang Yang, Kai Tang, Chao Ye, Haobo Wang, Qiqi Luo, Jinguang Zheng, Zhixin Zhang

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团)

AI总结 针对债务催收场景中现有基准无法体现用户行为异质性的问题,提出DebtBench基准并开发DebtGPT代理,用16个先进LLMs实验,发现多数模型表现不佳,DebtGPT优于开源基线且性能与GPT-4o相当。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24771 2026-07-29 cs.AI cs.LG 新提交

RoCo-ACE: Rollout-Conditioned Online Distillation for Retention-Aware Knowledge Injection

RoCo-ACE:用于保留感知知识注入的基于展开的在线蒸馏

Yan Hong, Wei Li, Kedong Xiu, Jun Lan, Shuheng Zhou, Zhongcai Lyu, Huijia Zhu, Weiqiang Wang, Jianfu Zhang

机构 * Ant Group(蚂蚁集团) Zhejiang University(浙江大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 研究针对知识注入中拟合权威答案致行为偏差问题,提出RoCo-ACE方法,通过同展开无参考/基于参考条件的似然对比及参考侧锚定校正,在多知识注入设置等下,实现最佳注入知识准确性且保持保留率接近基础模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24766 2026-07-29 cs.AI 新提交

Crystalis: Progressive Nucleation and Semantic Annealing for Coordinated Multi-View Visualization Generation

Crystalis:用于协同多视图可视化生成的渐进式成核与语义退火

Dazhen Deng, Zhaoping He, Xin Qian, Xiaotong Wang, Zi Ying, Yingcai Wu

机构 * Zhejiang University(浙江大学)

AI总结 研究针对大语言模型难以生成协同多视图可视化的问题,提出Crystalis框架,基于以查询为中心的CMV建模,通过渐进式成核和语义退火机制,在多任务基准测试中取得高成功率,且经用户研究验证了工作流程可用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24777 2026-07-29 cs.AI cond-mat.mtrl-sci cs.LG 新提交

Steering topology distributions for unified generative design of architected metamaterials

用于结构化超材料统一生成设计的引导拓扑分布

Haolin Li, Yuyang Miao, Menglei Li, Jinshuai Bai, Liyuan Wang, Xin Liu, Bo Gao, Jiantao Liu, Danilo Mandic, Zahra Sharif Khodaei, M. H. Aliabadi, Weiqiu Chen

机构 * Imperial College London(伦敦帝国理工学院) Tsinghua University(清华大学) Zhejiang University(浙江大学) Harbin Institute of Technology(哈尔滨工业大学) Southwest Jiaotong University(西南交通大学) Ningbo University(宁波大学) Carnegie Mellon University(卡内基梅隆大学)

AI总结 研究结构化超材料设计问题,提出GenTO统一框架,通过训练扩散模型并引导拓扑分布,能为异构任务重用拓扑先验,保留结构多样性,获高性能方案,确立拓扑知识为超材料设计统一原则。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24743 2026-07-29 cs.CV cs.AI cs.CL 版本更新

ClinFusion: A Vision-Centric Multimodal LLM System for Holistic Medical Understanding

ClinFusion:用于整体医学理解的以视觉为中心的多模态大语言模型系统

Hangjie Yuan, Yichen Qian, Zhiwei Tang, Xianzhe Xu, Lirong Wu, Sicheng Yang, Jinwang Wang, Pengju Wang, Zhitao Zeng, Yizeng Han, Yan Xing, Shengxuan Luo, Tao Feng, Qing Xie, Weigen Yao, Yi Yang, Zuozhu Liu, Jiasheng Tang, Shaocheng Wang, Jitao Wang, Jiahong Dong, Weihua Chen, Feng Xu, Fan Wang

机构 * DAMO Academy, Alibaba Group(达摩院,阿里巴巴集团) Hupan Laboratory(湖畔实验室) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) Department of Radiology, The Affiliated Yangming Hospital of Ningbo University(宁波大学附属阳明医院放射科) Zhejiang University-University of Illinois Urbana-Champaign Institute, Zhejiang University(浙江大学伊利诺伊大学厄巴纳香槟校区联合学院,浙江大学) Hepato-Pancreato-Biliary Center, Beijing Tsinghua Changgung Hospital, School of Clinical Medicine, Tsinghua Medicine, Tsinghua University(清华长庚医院肝胆胰中心,清华大学临床医学院,清华医学,清华大学) School of Software, Tsinghua University(清华大学软件学院) Beijing National Research Center for Information Science and Technology, Tsinghua University(清华大学北京信息科学与技术国家研究中心)

AI总结 研究针对多模态大语言模型在医学领域部署的挑战,提出ClinFusion,采用组合级联视觉编码器架构和视觉基础评估框架,在多模态医学基准测试中表现优异,超越开源和专有模型,经专家盲评验证效果良好。

Comments Code: https://github.com/alibaba-damo-academy/ClinFusion Models: https://huggingface.co/collections/Alibaba-DAMO-Academy/clinfusion

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17036 2026-07-29 cs.IR cs.LG 版本更新

LiveGraph: Active-Structure Neural Re-ranking for Exercise Recommendation

LiveGraph: 基于主动-结构神经重排序的运动推荐

Rong Fu, Zijian Zhang, Jiekai Wu, Kun Liu, Xianda Li, Haoyu Zhao, Yang Li, Yongtai Liu, Ziming Wang, Rui Lu, Simon Fong

机构 * University of Macau(澳门大学) University of Pennsylvania(宾夕法尼亚大学) Tongji University(同济大学) Juntendo University(立命馆大学) University of Southampton(南安普顿大学) University of Bologna(博洛尼亚大学) Wuhan University(武汉大学) University of the Chinese Academy of Sciences(中国科学院大学) Hanyang University(汉阳大学) Zhejiang University(浙江大学) The Hong Kong University of Science and Technology(香港科学与技术大学)

AI总结 LiveGraph通过图表示增强策略和动态重排序机制,解决学生参与长尾分布和个性化学习轨迹适应问题,提升推荐精度与教学多样性。

Comments 19 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16161 2026-07-29 cs.MM cs.CL cs.LG 版本更新

Emotion Collider: Dual Hyperbolic Mirror Manifolds for Sentiment Recovery via Anti Emotion Reflection

情感碰撞:双双曲镜面流形用于通过反情感反射进行情感恢复

Rong Fu, Ziming Wang, Shuo Yin, Kun Liu, Xianda Li, Simon Fong

机构 * University of Macau(澳门大学) Zhejiang University(浙江大学) Tsinghua University(清华大学) Tongji University(同济大学) University of Southampton(南安普顿大学) University of Bologna(博洛尼亚大学) Minzu University of China(中央民族大学)

AI总结 本文提出Emotion Collider网络,利用双双曲镜面流形实现多模态情感和情绪建模,通过双曲空间对比学习提升类别分离,并在标准多模态情感基准上验证了其鲁棒性和准确性。

Comments 25 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15355 2026-07-29 cs.CV 版本更新

DAV-GSWT: Diffusion-Active-View Sampling for Data-Efficient Gaussian Splatting Wang Tiles

DAV-GSWT:基于扩散优先的主动视角采样用于数据高效的高斯溅射瓦片

Rong Fu, Jiekai Wu, Yee Tan Jia, Yang Li, Xiaowen Ma, Wangyu Wu, Simon Fong

机构 * University of Macau(澳门大学) Juntendo University(立命馆大学) Tongji University(同济大学) Renmin University of China(中国人民大学) University of Chinese Academy of Sciences(中国科学院大学) Zhejiang University(浙江大学) University of Liverpool(利物浦大学)

AI总结 本文提出DAV-GSWT框架,利用扩散先验和主动视角采样,从少量输入观测合成高保真高斯溅射瓦片,减少数据需求并保持视觉质量和交互性能。

Comments 16 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18634 2026-07-29 cs.CV cs.LG 版本更新

SwiftGS: Episodic Priors for Immediate Satellite Surface Recovery

SwiftGS: 基于事件的先验知识用于即时卫星表面恢复

Rong Fu, Jiekai Wu, Xiaowen Ma, Shiyin Lin, Kangan Qian, Chuang Liu, Simon James Fong

机构 * University of Macau(澳门大学) Juntendo University(顺天堂大学) Tongji University(同济大学) Zhejiang University(浙江大学) University of Florida(佛罗里达大学) Tsinghua University(清华大学) Wuhan University(武汉大学) Juniata College(朱尼亚塔学院)

AI总结 SwiftGS通过元学习方法实现单次前向传递的3D重建,结合几何-辐射解耦的高斯基元和轻量SDF,降低单场景优化成本,实现高效准确的数字表面模型重建和视图一致渲染。

Comments 23 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12366 2026-07-29 cs.SC cs.AI cs.CV

FactorHD: A Hyperdimensional Computing Model for Multi-Object Multi-Class Representation and Factorization

Yifei Zhou, Xuchu Huang, Chenyu Ni, Min Zhou, Zheyu Yan, Xunzhao Yin, Cheng Zhuo

机构 * Zhejiang University(浙江大学) Key Laboratory of Collaborative Sensing and Autonomous Unmanned Systems of Zhejiang Province(浙江省协同感知与自主无人系统重点实验室)

Comments 7 pages, 5 figures, 2 tables, to be published in the 62nd DAC (Design Automation Conference) proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24591 2026-07-28 cs.CV 新提交

CameraAnything: Refilming Videos with Arbitrary Camera Control

CameraAnything:使用任意相机控制重新拍摄视频

Yixuan Li, Yanhong Zeng, Ka Leong Cheng, Jiayi Zhu, Hanlin Wang, Wen Wang, Yihao Meng, Hao Ouyang, Qiuyu Wang, Yue Yu, ZiDong Wang, Yiyuan Zhang, Yujun Shen, Dahua Lin

机构 * The Chinese University of Hong Kong(香港中文大学) Ant Group(蚂蚁集团) Tsinghua University(清华大学) Zhejiang University(浙江大学) The Hong Kong University of Science and Technology(香港科技大学)

AI总结 CameraAnything是用于相机控制视频编辑的统一框架,采用逐像素普吕克光线注入等方法联合控制相机参数,开发合成管道克服数据稀缺,能在单过程中实现多种视频编辑操作,为视频制作提供实用价值。

Comments Project page: https://yixuanli98.github.io/cameraanything/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24031 2026-07-28 cs.AI cs.HC cs.RO eess.SP 新提交

A Cyclic Adaptation-Generalization Framework with Uncertainty-Guided Self-Paced Learning for Long-Term Brain-Machine Interfaces

一种用于长期脑机接口的具有不确定性引导自步学习的循环适应-泛化框架

Jiyu Wei, Di Hong, Zhanjie Zhang, Dazhong Rong, Qinming He, Yueming Wang

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) Nanhu Brain-Computer Interface Institute(南湖脑机接口研究所)

AI总结 针对侵入性脑机接口因神经漂移面临的长期部署挑战,提出UnSPC框架,通过UnSPL机制协同DA和DG,利用噪声鲁棒排序策略挖掘可靠伪标签样本,引入CycAG策略整合DA和DG,经实验验证其有效性和鲁棒性,为长期BMI控制铺路。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24023 2026-07-28 cs.AI cs.HC cs.RO eess.SP 新提交

Self-Supervised Consistency Enhanced Disentangled Learning for Neural Decoding Generalization in Brain-Machine Interface

用于脑机接口神经解码泛化的自监督一致性增强解缠学习

Jiyu Wei, Di Hong, Zhanjie Zhang, Dazhong Rong, Qinming He, Yueming Wang

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) Nanhu Brain-Computer Interface Institute(南湖脑机接口研究院)

AI总结 研究脑机接口因神经漂移致性能下降问题,提出自监督一致性增强解缠学习框架(SSCDL)。通过设计一致性增强神经解码器及采用互补解缠泛化机制,学习鲁棒表征,实现跨日泛化,提升解码性能,展现长期交互潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23669 2026-07-28 cs.CV cs.RO 新提交

RRTrack: Robust and Recoverable Object 6D Pose Tracking for Dynamic Scenes

RRTrack:用于动态场景的鲁棒且可恢复的物体6D姿态跟踪

Junyue Li, Ye Zheng, Yifan Chen, Zhe Sun, Xuelong Li

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) Institute of Artificial Intelligence (TeleAI), China Telecom(中国电信人工智能研究院) College of Future Information Technology, Fudan University(复旦大学未来信息技术学院)

AI总结 研究针对动态场景中物体6D姿态跟踪难题,提出RRTrack。它采用2D-6D闭环跟踪策略,集成记忆视频对象分割与6D姿态细化,还有双库模板匹配模块。在合成基准和真实世界实验中验证,相比FoundationPose有显著提升,兼具高效与鲁棒性。

Comments 6D Pose Tracking, 10 pages, real-world experiments, training-free

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23650 2026-07-28 cs.SD eess.AS 新提交

Expose Your Disguise: Recovering Source Speaker Identity From Voice Conversion

揭露你的伪装:从语音转换中恢复源说话者身份

Hanlei Zhang, Zhongming Ma, Mingyang Zhang, Tengfei Liu, Yushi Cheng, Yanjiao Chen

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团)

AI总结 研究针对语音转换威胁生物特征安全问题,提出TRIDENT框架,通过三叉戟架构,包括识别转换机制、提取目标说话者潜在表示等,从转换音频恢复源说话者身份,实验表明其准确率高且性能稳健。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23575 2026-07-28 cs.CV cs.AI 新提交

D3O: Dynamic Distribution Distillation for Ordinal Regression

D3O:用于序数回归的动态分布蒸馏

Chunlai Dong, Yaojun Hu, Yuyang Xu, Haochao Ying, Jian Wu

机构 * Zhejiang University(浙江大学)

AI总结 针对序数回归中因主观标注产生的问题,提出D3O动态分布蒸馏框架,通过自蒸馏用序数标签分布的训练驱动演化取代静态监督,引入对比序数感知标签增强模块和基于CDF的跨层交互蒸馏机制,实验证明其优于现有方法。

Comments 10 pages, 5 figures, ACMMM2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23503 2026-07-28 cs.LG cs.AI cs.DB 新提交

Impute On-Demand: Adaptive Correlated Time Series Imputation for Changing Environments

按需插补:针对变化环境的自适应相关时间序列插补

Zhichen Lai, Huan Li, Dalin Zhang, Dong Gong, Lina Yao, Christian S. Jensen

机构 * College of Computer and Data Science, Fuzhou University(福州大学计算机与数据科学学院) Engineering Research Center of Big Data Intelligence, Ministry of Education(教育部大数据智能工程研究中心) Fujian Key Laboratory of Network Computing and Intelligent Information Processing, Fuzhou University(福州大学福建省网络计算与智能信息处理重点实验室) Department of Computer Science, Aalborg University(奥尔堡大学计算机科学系) Space Information Research Institute, Hangzhou Dianzi University(杭州电子科技大学空间信息研究院) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) State Key Laboratory of Blockchain and Data Security, Zhejiang University(浙江大学区块链与数据安全国家重点实验室) School of Computer Science and Engineering, The University of New South Wales(新南威尔士大学计算机科学与工程学院) CSIRO’s Data61(联邦科学与工业研究组织数据61)

AI总结 研究针对物联网中相关时间序列数据缺失值插补问题,提出AdaCTSi方法,结合一次性时间卷积网络与相关技术提取解耦特征,经实验验证该方法能有效降低MAE,且单个模型支持自适应推理,可部署在商用设备上。

Comments 15 pages, 9 figures. Accepted for publication in IEEE Transactions on Knowledge and Data Engineering (IEEE TKDE)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23472 2026-07-28 cs.CV 新提交

VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation

VIPER:用于物理上合理的视频生成的视觉上下文物理推理

Tianxiao Chen, Hanmo Chen, Huajin Chen, Bo Li, Qi Ye, Peng-Tao Jiang

机构 * Zhejiang University(浙江大学) vivo Mobile Communication Co., Ltd.(维沃移动通信有限公司)

AI总结 研究针对视频生成模型控制物理行为难的问题,提出VIPER框架,利用多模态大语言模型提取物理线索,通过分层训练引导图像到视频生成器,构建VIPER-19K数据集,实验证明该框架能实现物理行为转移且效果良好。

Comments tech report

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23337 2026-07-28 cs.LG 新提交

Neural operator discovery from heterogeneous trajectories

从异构轨迹中发现神经算子

Zituo Chen, Qiaofeng Li, Jiaxin Hu, Sili Deng

机构 * Massachusetts Institute of Technology(麻省理工学院) Zhejiang University(浙江大学)

AI总结 研究如何从异构轨迹发现神经算子,提出因式分解潜在条件公式,联合学习神经算子与低维潜在表示,能捕获系统变化内在维度,实现零样本外推等泛化,为无显式监督的算子学习建立可解释范式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22597 2026-07-28 cs.AI 新提交

HyCE-RAG: Hypergraph Chain-of-Evidence Retrieval-Augmented Generation for Explainable Multi-hop Question Answering

HyCE-RAG:用于可解释多跳问答的超图证据链检索增强生成

Hong-Yu An, Yun-Jian Zhang, Chen-Wei Liang, Tian-Yi Zhang, Jian Ding, Yi-Lun Wu, Ao-Bo Li, Wei-Cong Su, Saifullah, Mujiangshan Wang

机构 * University of Macau(澳门大学) Shenzhen Kaihong Digital Industry Development Co., Ltd.(深圳开鸿数字产业发展有限公司) University of New South Wales(新南威尔士大学) Zhejiang University(浙江大学) Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院)

AI总结 研究可解释多跳问答,提出HyCE-RAG框架,将实体等组织成超边构建超图,经置信度传播和证据组装选择连接证据路径,评分时考虑多种因素,实验证明其在多方面优于标准和基于图的RAG基线,为复杂问答检索后推理提供新方向。

Comments 15 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22586 2026-07-28 cs.AI cs.CL 新提交

MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models

MM-ShiftKV:用于多模态大语言模型的解码感知预填充阶段键值选择

Jinsong Shu, Chenyang Wu, Zhongle Xie, Baokun Wang, Lidan Shou

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团) The State Key Laboratory of Blockchain and Data Security, Zhejiang University(浙江大学区块链与数据安全国家重点实验室) Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security(杭州高新技术产业开发区(滨江)区块链与数据安全研究院)

AI总结 研究多模态大语言模型中KV缓存问题,提出MM-ShiftKV方法,通过构建方差扩展查询代理近似解码时查询行为,基于聚合注意力质量估计KV重要性,在严格缓存预算下性能优于现有方法。

Comments 19 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22637 2026-07-28 cs.AI cs.IT math.IT 新提交

Fast Cross-Scenario Adaptation of CSI Models via Channel Conditional Parameter Generation

通过信道条件参数生成实现CSI模型的快速跨场景自适应

Xudong Zou, Siyu Wu, Zunlei Feng, Jie Song, Yuanyu Wan, Mingli Song, Jiacong Hu

机构 * School of Software Technology, Zhejiang University(浙江大学软件学院) State Key Laboratory of Blockchain and Data Security, Zhejiang University Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security(浙江大学杭州高新技术产业开发区(滨江)区块链与数据安全国家重点实验室)

AI总结 研究针对CSI模型在不同场景适应性差的问题,提出CCPG方法,通过组件冻结实验识别瓶颈,生成轻量级LoRA权重,经多种技术处理实现快速跨场景自适应,实验表明该方法能高效部署CSI模型用于6G通信。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16692 2026-07-28 cs.SE cs.CL 版本更新

Dependency-Guided Code Generation: Structured Matrix Decomposition and Consistency-Guided Refinement

依赖引导的代码生成:结构化矩阵分解与一致性引导的细化

Mingqiao Mo, Yangchen Zeng, Zikai Xiao, Xin Xiao, Wenhua Nie, Zhaolu Kang, Guangyuan Dong, Kai Shu, Hao Zhang, Xiaodong Fan

机构 * University of the Chinese Academy of Sciences(中国科学院大学) ByteDance Inc.(字节跳动公司) Zhejiang University(浙江大学) National Taiwan University(台湾国立大学) Peking University(北京大学) Alibaba Group(阿里巴巴集团) Tsinghua University(清华大学) Liaoning Technical University(辽宁技术大学)

AI总结 针对现有代码生成方法无法充分捕捉代码实体依赖关系的问题,提出依赖感知代码生成框架,通过结构化矩阵分解和一致性引导细化生成代码,经实验验证该方法能生成语义对齐和结构保真度更高的代码。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00552 2026-07-28 cs.OS cs.DC cs.NI cs.RO cs.SY eess.SY 版本更新

Edge-Based QoS-Aware Adaptive Task Placement: A Closed-Loop Control in Multi-Robot Systems

基于边缘的QoS感知自适应任务放置:多机器人系统中的闭环控制

Thien Tran, Jonathan Kua, Thuong Hoang, Minh Tran, Honghao Lyu, Jiong Jin

机构 * Deakin University(德肯大学) RMIT University(皇家墨尔本理工大学) Zhejiang University(浙江大学) Swinburne University of Technology(西姆伯恩理工大学)

AI总结 提出一种QoS感知的自适应任务放置(ATP)控制器,通过多指标成本评分和闭环控制,在共享边缘节点上动态切换任务放置,以降低尾延迟和截止时间违规。

Comments 6 pages, 2 figures, 2 tables, 1 algorithm, accepted paper on the 24th IEEE International Conference on Industrial Informatics (INDIN), 26-29 July, 2026, Melbourne, Australia

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17931 2026-07-28 cs.AI 版本更新

LiteResearcher: A Scalable Agentic RL Training Framework for Deep Research Agent

LiteResearcher:一种用于深度研究代理的可扩展代理强化学习训练框架

Bince Qu, Wanli Li, Bo Pan, Jianyu Zhang, Zheng Liu, Pan Zhang, Wei Chen, Bo Zhang

机构 * Zhejiang University(浙江大学) Simplex AI The Hong Kong Polytechnic University(香港理工大学)

AI总结 LiteResearcher通过构建轻量虚拟世界提升代理强化学习的可扩展性,使小规模搜索代理在GAIA和Xbench等基准上取得state-of-the-art结果。

Comments COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29452 2026-07-28 cs.RO 版本更新

CReF: Cross-modal and Recurrent Fusion for Depth-conditioned Humanoid Locomotion

CReF:跨模态与递归融合用于基于深度的人形机器人运动

Yuan Hao, Ruiqi Yu, Shixin Luo, Guoteng Zhang, Jun Wu, Qiuguo Zhu

机构 * Institute of Cyber-Systems and Control, Zhejiang University(浙江大学控制科学与工程学院) School of Control Science and Engineering, Shandong University(山东大学控制科学与工程学院)

AI总结 本文提出CReF框架,通过直接从原始前方深度数据学习运动相关特征,实现稳定复杂地形行走,改进了传统依赖几何抽象的方法,展示了在模拟和真实环境中鲁棒的地形穿越能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08521 2026-07-28 cs.CV cs.RO eess.IV 版本更新

OccTrack360: 4D Panoptic Occupancy Tracking from Surround-View Fisheye Cameras

OccTrack360: 从环视鱼眼相机实现4D全景占用跟踪

Yongzhi Lin, Kai Luo, Yuanfan Zheng, Hao Shi, Mengfei Duan, Yang Liu, Kailun Yang

机构 * School of Artificial Intelligence and Robotics, Hunan University(人工智能与机器人学院,湖南大学) State Key Laboratory of Extreme Photonics and Instrumentation, Zhejiang University(极端光子学与仪器国家重点实验室,浙江大学) National Engineering Research Center of Robot Visual Perception and Control Technology, Hunan University(机器人视觉感知与控制技术国家工程研究中心,湖南大学)

AI总结 OccTrack360提出新的4D全景占用跟踪基准及FoSOcc框架,解决鱼眼成像中的球面投影和体素定位问题,提升占用跟踪性能。

Comments Accepted to IEEE/RSJ IROS 2026. The benchmark and source code will be made publicly available at https://github.com/YouthZest-Lin/OccTrack360

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03570 2026-07-28 cs.LG 版本更新

Asymmetric Hierarchical Anchoring for Robust Audio-Visual Cross-Modal Generalization

非对称层次锚定用于音频-视觉联合表示:解决信息分配模糊性以实现鲁棒跨模态泛化

Bixing Wu, Yuhong Zhao, Zongli Ye, Jiachen Lian, Xiangyu Yue, Gopala Anumanchipalli

机构 * Zhejiang University, China(浙江大学) University of California, Berkeley, USA(加州大学伯克利分校) MMLab, Chinese University of Hong Kong, China(香港中文大学MMLab)

AI总结 本文提出非对称层次锚定框架,通过结构化语义锚点解决跨模态泛化中的信息分配模糊性,提升语义一致性和表示纯度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22342 2026-07-28 cs.RO 版本更新

VL-LN Bench: Towards Long-horizon Goal-oriented Navigation with Active Dialogs

VL-LN基准:通过主动对话实现长视界目标导向导航

Wensi Huang, Shaohao Zhu, Meng Wei, Siqi Zhang, Jinming Xu, Xihui Liu, Hanqing Wang, Tai Wang, Feng Zhao, Jiangmiao Pang

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai AI Laboratory(上海人工智能实验室) Zhejiang University(浙江大学) The University of Hong Kong(香港大学)

AI总结 VL-LN基准通过引入主动对话机制,提升长视界目标导向导航任务的性能和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17492 2026-07-28 cs.AI cs.CL cs.LG 版本更新

PD$^3$: A Project Duplication Detection Framework via Adapted Multi-Agent Debate

PD$^3$:一种通过适应性多智能体辩论的项目重复检测框架

Dezheng Bao, Yueci Yang, Chutian Yu, Xin Chen, Zeguo Fei, Xiang Yuan, Lijun Zhang, Jiangqian Huang, Zhengxuan Jiang, Daoze Zhang, Junru Chen, Yang Yang

机构 * Zhejiang University(浙江大学) State Grid Power Supply Co. Ltd.(国网电力供应有限公司)

AI总结 研究项目重复检测问题,提出PD$^3$框架,通过适应性多智能体辩论,结合局部多智能体辩论与全局循环调度检索项目集,能保证公平比较并产生相关分数和反馈,在真实项目上优于基线,还部署平台节省资金。

Comments 17 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏