arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Zhejiang University(浙江大学)

共收录 2925
2601.05930 2026-04-08 cs.CL cs.AI cs.LG cs.MA

Can We Predict Before Executing Machine Learning Agents?

在执行机器学习代理之前,我们能否进行预测?

Jingsheng Zheng, Jintian Zhang, Yujie Luo, Yuren Mao, Yunjun Gao, Lun Du, Huajun Chen, Ningyu Zhang

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团) Zhejiang University - Ant Group Joint Laboratory of Knowledge Graph(浙江大学-蚂蚁集团知识图谱联合实验室)

AI总结 本文提出通过内部化执行先验来预测数据驱动的解决方案偏好,利用预验证的数据分析报告提升LLM的预测能力,并在FOREAGENT中实现预测-验证循环,加速收敛并超越基于执行的基线。

Comments ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05905 2026-04-08 cs.CL cs.AI cs.HC cs.LG cs.MA

Illusions of Confidence? Diagnosing LLM Truthfulness via Neighborhood Consistency

自信的幻觉?通过邻域一致性诊断LLM的真实性

Haoming Xu, Ningyuan Zhao, Yunzhi Yao, Weihong Xu, Hongru Wang, Xinle Deng, Shumin Deng, Jeff Z. Pan, Huajun Chen, Ningyu Zhang

机构 * Zhejiang University(浙江大学) University of Edinburgh(爱丁堡大学)

AI总结 本文提出邻域一致性信念(NCB)来评估LLM在上下文干扰下的信念鲁棒性,通过结构化测量提升模型在真实场景中的可靠性,并引入结构感知训练(SAT)减少知识脆性。

Comments ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05831 2026-04-08 cs.LG cs.AI

HeartcareGPT: A Unified Multimodal ECG Suite for Dual Signal-Image Modeling and Understanding

HeartcareGPT:一种统一的多模态ECG套件,用于双信号-图像建模与理解

Yihan Xie, Sijing Li, Tianwei Lin, Zhuonan Wang, Chenglin Yang, Yu Zhong, Wenjie Yan, Wenqiao Zhang, Xiaogang Guo, Jun Xiao, Yueting Zhuang, Beng Chin Ooi

机构 * Zhejiang University(浙江大学)

AI总结 本文提出HeartcareGPT,通过Dual Stream Projection Alignment机制,实现ECG信号与图像的统一建模,提升多视角ECG理解能力,并建立医学多模态大语言模型向生理信号领域扩展的方法论基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04477 2026-04-07 cs.CV

MVis-Fold: A Three-Dimensional Microvascular Structure Inference Model for Super-Resolution Ultrasound

MVis-Fold:一种用于超分辨率超声的三维微循环结构推断模型

Jincao Yao, Ke Zhang, Yahan Zhou, Jiafei Shen, Jie Liu, Mudassar Ali, Bojian Feng, Jiye Chen, Jinlong Fan, Ping Liang, Dong Xu

机构 * Department of Diagnostic Ultrasound Imaging & Interventional Therapy, Zhejiang Cancer Hospital, Hangzhou Institute of Medicine (HIM), Chinese Academy of Sciences(中国科学院杭州医学研究所浙江省肿瘤医院超声诊断与介入治疗科) Research Center of Interventional Medicine and Engineering, Hangzhou Institute of Medicine (HIM), Chinese Academy of Sciences(中国科学院杭州医学研究所介入医学与工程研究中心) Wenling Institute of Big Data and Artificial Intelligence in Medicine(温岭医学大数据与人工智能研究所) Zhejiang Provincial Research Center for Innovative Technology and Equipment in Interventional Oncology, Zhejiang Cancer Hospital(浙江省肿瘤医院介入肿瘤创新技术与装备浙江省研究中心) College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息与电子工程学院) Department of Ultrasound, Chinese PLA General Hospital, Chinese PLA Medical School(中国人民解放军总医院超声科,中国人民解放军医学院)

AI总结 本文提出MVis-Fold模型,通过跨尺度网络架构实现从二维超声图像高保真重建三维微循环网络,解决超分辨率超声三维重建难题,为微循环定量分析提供新工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04215 2026-04-07 cs.CL

DARE: Diffusion Large Language Models Alignment and Reinforcement Executor

DARE:扩散大语言模型对齐与强化执行器

Jingyi Yang, Yuxian Jiang, Xuhao Hu, Shuang Cheng, Biqing Qi, Jing Shao

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Fudan University(复旦大学) Zhejiang University(浙江大学) Shanghai AI Laboratory(上海人工智能实验室)

AI总结 DARE框架整合了监督微调、参数高效微调、偏好优化和强化学习,为扩散大语言模型提供统一的执行栈,支持多种模型家族,实现算法覆盖、可重复评估和实际加速。

Comments 14 pages,3 figures,5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04142 2026-04-07 cs.CV

OP-GRPO: Efficient Off-Policy GRPO for Flow-Matching Models

OP-GRPO:用于流匹配模型的高效非策略GRPO

Liyu Zhang, Kehan Li, Tingrui Han, Tao Zhao, Yuxuan Sheng, Shibo He, Chao Li

机构 * College of Control Science and Engineering, Zhejiang University(浙江大学控制科学与工程学院) Central Research Institute, Huawei(华为中央研究院)

AI总结 OP-GRPO通过高效非策略训练方法提升流匹配模型生成质量,通过高质轨迹选择与重要采样修正,实现训练效率提升34.2%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01870 2026-04-07 cs.LG cs.SY eess.SY

Towards Intrinsically Calibrated Uncertainty Quantification in Industrial Data-Driven Models via Diffusion Sampler

面向工业数据驱动模型中固有校准不确定性量化的方法 via 扩散采样器

Yiran Ma, Jerome Le Ny, Zhichao Chen, Zhihuan Song

机构 * College of Control Science and Engineering, Zhejiang University(浙江大学控制科学与工程学院) Electrical Engineering Department, Polytechnique Montreal(蒙特利尔理工学院电气工程系) GERAD State Key Lab of General AI, School of Intelligence Science and Technology, Peking University(北京大学智能科学与技术学院通用人工智能国家重点实验室) Guangdong Provincial Key Laboratory of Petrochemical Equipment Fault Diagnosis, Guangdong University of Petrochemical Technology(广东石油化工学院广东省石化装备故障诊断重点实验室)

AI总结 本文提出一种基于扩散的后验采样框架,通过忠实的后验采样实现固有校准的预测不确定性量化,解决了数据驱动方法中不确定性量化难题。

Comments This manuscript has been accepted for publication in IEEE Transactions on Industrial Informatics. Copyright has been transferred to IEEE. Reuse of this material is subject to IEEE copyright restrictions

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.13096 2026-04-07 cs.CV

3D Magic Mirror: Clothing Reconstruction from a Single Image via a Causal Perspective

3D魔镜:通过因果视角从单张图像进行衣物重建

Zhedong Zheng, Jiayin Zhu, Wei Ji, Yi Yang, Tat-Seng Chua

机构 * Sea-NExT Joint Lab, National University of Singapore(新加坡国立大学Sea-NExT联合实验室) Zhejiang University(浙江大学)

AI总结 本文提出一种自监督学习方法,通过因果视角从单张图像重建3D非刚性物体,解决3D标注困难、模板限制和内在模糊性问题,实验表明其在时尚数据集上能实现高质量重建。

Comments Update results. Report person re-id performance. Add details in Appendix

Journal ref npj Artif. Intell. 2, 29 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03993 2026-04-07 cs.LG cs.AI

Can LLMs Learn to Reason Robustly under Noisy Supervision?

大语言模型能否在噪声监督下实现稳健推理?

Shenzhi Yang, Guangcheng Zhu, Bowen Song, Sharon Li, Haobo Wang, Xing Zheng, Yingfan Ma, Zhongqi Chen, Weiqiang Wang, Gang Chen

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团) University of Wisconsin-Madison(威斯康星大学麦迪逊分校)

AI总结 本文研究了强化学习中可验证奖励在噪声标签下的鲁棒性问题,提出在线标签细化方法,通过动态修正潜在噪声标签提升模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03819 2026-04-07 cs.CV

ActivityForensics: A Comprehensive Benchmark for Localizing Manipulated Activity in Videos

活动取证:一种全面的基准,用于定位视频中的篡改活动

Peijun Bao, Anwei Luo, Gang Pan, Alex C. Kot, Xudong Jiang

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) School of Electrical and Electronic Engineering, Nanyang Technological University(南洋理工大学电气与电子工程学院) School of Computing and Artificial Intelligence, Jiangxi University of Finance and Economics(江西财经大学计算机与人工智能学院) Jiangxi Provincial Key Laboratory of Multimedia Intelligent Processing(江西省多媒体智能处理重点实验室) Faculty of Engineering, Shenzhen MSU-BIT University(深圳北理莫斯科大学工程系) VinUniversity

AI总结 本文提出ActivityForensics基准,用于定位视频中被篡改的活动。该基准包含6000多个无缝融合的篡改视频片段,并引入了Temporal Artifact Diffuser方法,评估了多种最先进的伪造定位器。

Comments [CVPR 2026] The first benchmark for action-level deepfake localization

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03679 2026-04-07 cs.CL cs.AI cs.IR cs.LG cs.MM

LightThinker++: From Reasoning Compression to Memory Management

LightThinker++:从推理压缩到内存管理

Yuqi Zhu, Jintian Zhang, Zhenjie Wan, Yujie Luo, Shuofei Qiao, Zhengke Gui, Da Zheng, Lei Liang, Huajun Chen, Ningyu Zhang

机构 * Zhejiang University(浙江大学)

AI总结 本文提出LightThinker++,通过引入显式自适应内存管理,有效压缩LLM推理过程中的中间思维,减少内存占用并提升推理效率,尤其在长周期智能任务中表现突出。

Comments Work in progress. This is an extended version of LightThinker

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01702 2026-04-07 cs.CL

On the Role of Reasoning Patterns in the Generalization Discrepancy of Long Chain-of-Thought Supervised Fine-Tuning

在长链式思维监督微调中推理模式在泛化差异中的作用

Zhaoyi Li, Xiangyu Xi, Zhengyu Chen, Wei Wang, Gangwei Jiang, Ranran Shen, Linqi Song, Ying Wei, Defu Lian

机构 * University of Science and Technology of China(中国科学技术大学) Meituan LongCat Team(美团龙猫团队) City University of Hong Kong(香港城市大学) Zhejiang University(浙江大学)

AI总结 本文研究不同来源的长链式思维轨迹对模型泛化性能的影响,发现训练损失低并不一定带来更好的泛化能力,提出过滤频繁分支轨迹以提升SFT泛化性能。

Comments Under Review. version2: correct typos in Table 4 and add an ablation study (Table 5)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19967 2026-04-07 cs.LG

Unlearning Noise in PINNs: A Selective Pruning Framework for PDE Inverse Problems

在PINNs中去除噪声:一种用于PDE反问题的选性剪枝框架

Yongsheng Chen, Yong Chen, Wei Guo, Xinghui Zhong

机构 * Zhejiang University(浙江大学) University of Pennsylvania(宾夕法尼亚大学) Texas Tech University(德克萨斯理工大学)

AI总结 本文提出P-PINN框架,通过选性剪枝去除预训练PINN中受污染数据的影响,提升PDE反问题的鲁棒性、准确性和训练稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16197 2026-04-07 cs.LG cs.CL cs.MM

ModalImmune: Immunity Driven Unlearning via Self Destructive Training

ModalImmune: 通过自毁式训练实现的免疫驱动反学习

Rong Fu, WeiZhi Tang, Ziming Wang, Jia Yee Tan, Zijian Zhang, Zhaolu Kang, Muge Qi, Shuning Zhang, Simon Fong

机构 * University of Macau(澳门大学) Zhejiang University(浙江大学) Renmin University of China(中国人民大学) University of Pennsylvania(宾夕法尼亚大学) Peking University(北京大学) Tsinghua University(清华大学)

AI总结 本文提出ModalImmune框架,通过可控地在训练中坍缩选定模态信息,使模型学习到对破坏性模态影响具有鲁棒性的联合表示,提升多模态系统在模态丢失或损坏时的可靠性。

Comments 24 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14536 2026-04-07 cs.CL cs.AI

Explainable Token-level Noise Filtering for LLM Fine-tuning Datasets

可解释的token级噪声过滤用于LLM微调数据集

Yuchen Yang, Wenze Lin, Enhao Huang, Zhixuan Chu, Hongbin Zhou, Lan Tao, Yiming Li, Zhan Qin, Kui Ren

机构 * The State Key Laboratory of Blockchain and Data Security, Zhejiang University(浙江大学区块链与数据安全全国重点实验室) Hangzhou HighTech Zone (Binjiang) Blockchain and Data Security Research Institute(杭州高新区(滨江)区块链与数据安全研究院)

AI总结 本文提出XTF框架,通过分解token级数据对微调过程的贡献,提升LLM微调性能,实验表明在数学、代码和医学任务中性能提升达13.7%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07469 2026-04-07 cs.CV

VideoCoF: Unified Video Editing with Temporal Reasoner

VideoCoF:基于时间推理的统一视频编辑

Xiangpeng Yang, Ji Xie, Yiyuan Yang, Yue Ma, Yan Huang, Min Xu, Qiang Wu

机构 * University of Technology Sydney(悉尼科技大学) Zhejiang University(浙江大学) HKUST(香港科技大学)

AI总结 VideoCoF通过引入时间推理机制,解决视频编辑中精度与统一性的矛盾,实现无需掩码的精确区域映射和细粒度编辑,验证了方法的高效性与有效性。

Comments Accepted by CVPR 2026, Project Page: https://videocof.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02795 2026-04-06 cs.CL cs.AI

Rubrics to Tokens: Bridging Response-level Rubrics and Token-level Rewards in Instruction Following Tasks

评分标准到标记:在指令遵循任务中连接响应级评分标准和标记级奖励

Tianze Xu, Yanzhao Zheng, Pengrui Lu, Lyumanshan Ye, Yong Wu, Zhentao Zhang, Yuanqiang Yu, Chao Ma, Jihuai Zhu, Pengfei Liu, Baohua Dong, Hangcheng Zhu, Ruohui Huang, Gang Yu

机构 * Shanghai Jiao Tong University(上海交通大学) Alibaba Group(阿里巴巴集团) Zhejiang University(浙江大学) Shanghai Innovation Institute(上海创新研究院) GAIR

AI总结 本文提出RTT框架,通过引入标记级相关性判别器和RTT-GRPO方法,解决响应级奖励稀疏性和模糊性问题,提升指令遵循任务的准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02691 2026-04-06 cs.LG

Adaptive Semantic Communication for Wireless Image Transmission Leveraging Mixture-of-Experts Mechanism

基于混合专家机制的自适应语义通信用于无线图像传输

Haowen Wan, Qianqian Yang

机构 * Polytechnic Institute, Zhejiang University(浙江大学竺可桢学院) College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息与电子工程学院)

AI总结 本文提出一种多阶段端到端图像语义通信系统,利用自适应MoE Swin Transformer块,通过动态专家门控机制提升MIMO通道下的传输效率与重建质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16672 2026-04-06 cs.CV

ReWeaver: Towards Simulation-Ready and Topology-Accurate Garment Reconstruction

ReWeaver:面向仿真准备和拓扑准确的服装重建

Ming Li, Hui Shan, Kai Zheng, Chentao Shen, Siyu Liu, Yanwei Fu, Zhen Chen, Xiangru Huang

机构 * Zhejiang University(浙江大学) Shanghai Innovation Institute(上海创新研究院) Westlake University(西湖大学) Fudan University(复旦大学) Adobe Xidian University(西安电子科技大学)

AI总结 ReWeaver通过稀疏多视角图像实现拓扑准确的3D服装和缝纫图案重建,提升仿真和机器人应用的精度与一致性。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03127 2026-04-06 cs.CV cs.AI

Unified Thinker: A General Reasoning Modular Core for Image Generation

统一思考者:一种通用图像生成的推理模块核心

Sashuai Zhou, Qiang Zhou, Jijin Hu, Hanqing Yang, Yue Cao, Junpeng Ma, Yinchao Ma, Jun Song, Tiezheng Ge, Cheng Yu, Bo Zheng, Zhou Zhao

机构 * Zhejiang University(浙江大学) Alibaba Group(阿里巴巴集团) Nanjing University(南京大学) Fudan University(复旦大学)

AI总结 本文提出统一思考者,一种通用图像生成的推理模块核心,旨在通过可执行推理解决生成模型中的推理-执行差距,提升图像生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07951 2026-04-06 cs.CV

Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality

保留源视频真实性:面向电影质量的高保真面部交换

Zekai Luo, Zongze Du, Zhouhang Zhu, Hao Zhong, Muzhi Zhu, Wen Wang, Yuling Xi, Chenchen Jing, Hao Chen, Chunhua Shen

机构 * Zhejiang University, State Key Laboratory of CAD & CG(浙江大学,计算机辅助设计与图形学国家重点实验室) Zhejiang University of Technology(浙江工业大学) Ant Group(蚂蚁集团)

AI总结 本文提出LivingSwap模型,通过关键帧和视频参考引导实现高保真面部交换,提升视频真实感与时间一致性,减少生产流程中的手动工作量。

Comments Accepted to CVPR 2026. Project webpage: https://aim-uofa.github.io/LivingSwap

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04728 2026-04-06 eess.IV cs.CV physics.ins-det

Neural Field-Based 3D Surface Reconstruction of Microstructures from Multi-Detector Signals in Scanning Electron Microscopy

基于神经场的多探测器信号扫描电子显微镜微结构三维表面重建

Shuo Chen, Yijin Li, Xi Zheng, Guofeng Zhang

机构 * State Key Lab of CAD&CG, Zhejiang University(浙江大学CAD&CG国家重点实验室) Alibaba Group(阿里巴巴集团) Analysis Center of Agriculture, Life and Environment Sciences, Zhejiang University(浙江大学农业、生命与环境科学分析中心)

AI总结 本文提出NFH-SEM框架,利用神经场整合多视图几何与探测器信号光度立体线索,实现高保真三维表面重建,展示了在不同材料上的精确恢复能力。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29966 2026-04-03 cs.CV

Scaling Video Pretraining for Surgical Foundation Models

为手术基础模型扩展视频预训练

Sicheng Lu, Zikai Xiao, Jianhui Wei, Danyu Sun, Qi Lu, Keli Hu, Yang Feng, Jian Wu, Zongxin Yang, Zuozhu Liu

机构 * The Johns Hopkins University(约翰霍普金斯大学) Zhejiang University(浙江大学) Zhejiang University-University of Illinois Urbana-Champaign Institute(浙江大学伊利诺伊大学厄巴纳-香槟分校联合学院) Zhejiang Lab(之江实验室) Shaoxing University(绍兴大学) Angelalign(时代天使) Harvard Medical School(哈佛医学院)

AI总结 本文提出SurgRec,通过大规模数据和统一预训练流程提升手术视频理解能力,对比SSL基线和视觉语言模型,展示SurgRec在多个下游任务中的优越性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24458 2026-04-03 cs.CV

OmniWeaving: Towards Unified Video Generation with Free-form Composition and Reasoning

OmniWeaving:迈向统一视频生成的自由组合与推理

Kaihang Pan, Qi Tian, Jianwei Zhang, Weijie Kong, Jiangfeng Xiong, Yanxin Long, Shixue Zhang, Haiyi Qiu, Tan Wang, Zheqi Lv, Yue Wu, Liefeng Bo, Siliang Tang, Zhao Zhong

机构 * Zhejiang University(浙江大学) Tencent Hunyuan(腾讯混元) Nanyang Technological University(南洋理工大学)

AI总结 本文提出OmniWeaving模型,通过大规模预训练数据学习多模态组合与推理能力,引入IntelligentVBench基准测试,展示其在开放源码统一视频生成中的领先性能。

Comments 32 pages, 22 figures. Project Page: https://omniweaving.github.io. Github: https://github.com/Tencent-Hunyuan/OmniWeaving. Model: https://huggingface.co/tencent/HY-OmniWeaving

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13024 2026-04-03 cs.LG math.OC

Fragility-aware Classification for Understanding Risk and Improving Generalization

面向脆弱性的分类:理解风险与提升泛化能力

Chen Yang, Zheng Cui, Daniel Zhuoyu Long, Jin Qi, Ruohan Zhan

机构 * School of Management, Zhejiang University(浙江大学管理学院) Department of Systems Engineering and Engineering Management, The Chinese University of Hong Kong(香港中文大学系统工程与工程管理系) Department of Industrial Engineering and Decision Analytics, Hong Kong University of Science and Technology(香港科技大学工业工程与决策分析系) Department of Marketing and Analytics, University College London(伦敦大学学院市场营销与分析系)

AI总结 本文提出Fragility Index作为新型性能指标,从风险规避角度评估分类器,通过鲁棒满足框架确保在分布不确定性下的鲁棒性,并开发可训练框架以直接优化FI,实验证明其能揭示误差尾部风险并提升决策质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01749 2026-04-03 cs.CV

Ultrasound-CLIP: Semantic-Aware Contrastive Pre-training for Ultrasound Image-Text Understanding

超声-CLIP:面向超声图像-文本理解的语义感知对比预训练

Jiayun Jin, Haolong Chai, Xueying Huang, Xiaoqing Guo, Zengwei Zheng, Zhan Zhou, Junmei Wang, Xinyu Wang, Jie Liu, Binbin Zhou

机构 * Hangzhou City University(杭州城市大学) Hong Kong Baptist University(香港浸会大学) Zhejiang University(浙江大学) The First Affiliated Hospital, Zhejiang University School of Medicine(浙江大学医学院附属第一医院) City University of Hong Kong(香港城市大学)

AI总结 本文提出超声-CLIP,通过构建US-365K数据集和UDT知识框架,引入语义软标签和损失函数,提升超声图像与文本的语义对比学习效果,实现分类和检索的SOTA性能。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01712 2026-04-03 cs.LG cs.AI eess.SP physics.comp-ph

Transformer self-attention encoder-decoder with multimodal deep learning for response time series forecasting and digital twin support in wind structural health monitoring

基于多模态深度学习的Transformer自注意力编码器-解码器:用于响应时间序列预测和风力结构健康监测的数字孪生支持

Feiyu Zhou, Marios Impraimakis

机构 * Department of Mechanical Engineering, University of Bath(巴斯大学机械工程系) Department of Civil Engineering, Zhejiang University(浙江大学土木工程系)

AI总结 本文提出一种基于Transformer的多模态深度学习方法,用于风力结构响应时间序列预测和数字孪生支持,通过捕捉系统时间特性提升结构健康监测的准确性与鲁棒性。

Comments 21 pages, 22 figures, 9 tables. This version corresponds to the published article in Computers & Structures. https://doi.org/10.1016/j.compstruc.2026.108216

Journal ref Computers and Structures 326 (2026) 108216

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01705 2026-04-03 cs.CL cs.AI

Development and multi-center evaluation of domain-adapted speech recognition for human-AI teaming in real-world gastrointestinal endoscopy

开发与多中心评估用于真实世界胃肠道内窥镜中人类-人工智能协作的领域适应语音识别

Ruijie Yang, Yan Zhu, Peiyao Fu, Te Luo, Zhihua Wang, Xian Yang, Quanlin Li, Pinghong Zhou, Shuo Wang

机构 * Zhejiang University(浙江大学) Shanghai Institute for Advanced Study, Zhejiang University(浙江大学上海高等研究院) Shanghai Key Laboratory of MICCAI(上海市MICCAI重点实验室) Digital Medical Research Center, School of Basic Medical Sciences, Fudan University(复旦大学基础医学院数字医学研究中心) Endoscopy Center and Endoscopy Research Institute, Zhongshan Hospital, Fudan University(复旦大学附属中山医院内镜中心及内镜研究所) Shanghai Collaborative Innovation Center of Endoscopy(上海市内镜协同创新中心) Alliance Manchester Business School, The University of Manchester(曼彻斯特大学联盟曼彻斯特商学院)

AI总结 本文提出EndoASR,通过合成内窥镜报告开发两阶段适应策略,提升内窥镜流程中的语音识别准确率和临床实用性,经多中心验证其在异质真实世界条件下的鲁棒性。

Comments Under review at npj Digital Medicine

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01664 2026-04-03 cs.AI

ContextBudget: Budget-Aware Context Management for Long-Horizon Search Agents

ContextBudget: 长时间 horizon 搜索代理的预算感知上下文管理

Yong Wu, YanZhao Zheng, TianZe Xu, ZhenTao Zhang, YuanQiang Yu, JiHuai Zhu, Chao Ma, BinBin Lin, BaoHua Dong, HangCheng Zhu, RuoHui Huang, Gang Yu

机构 * Zhejiang University(浙江大学) Alibaba Group(阿里巴巴集团)

AI总结 本文提出BACM方法,通过预算约束的序列决策问题管理上下文,结合BACM-RL强化学习方法,在多目标问答和长时间网页浏览任务中优于现有方法,尤其在高复杂度场景下表现突出。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01659 2026-04-03 cs.RO

AURA: Multimodal Shared Autonomy for Real-World Urban Navigation

AURA:多模态共享自主控制用于真实世界城市导航

Yukai Ma, Honglin He, Selina Song, Wayne Wu, Bolei Zhou

机构 * University of California, Los Angeles(加州大学洛杉矶分校) Zhejiang University(浙江大学)

AI总结 AURA通过将城市导航分解为高层人类指令和低层AI控制,减少人工操作负担,提升导航稳定性,并在真实世界中实现44%的接管减少。

Comments 17 pages, 18 figures, 4 tables, conference

详情

展开后加载摘要…

URL PDF HTML 收藏