arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Zhejiang University(浙江大学)

2026-03-10 至 2026-03-10 共收录 16
2603.08251 2026-03-10 cs.CL

Not All Queries Need Deep Thought: CoFiCot for Adaptive Coarse-to-fine Stateful Refinement

并非所有查询都需要深度思考:CoFiCot用于自适应粗到细状态细化

Dongxu Zhang, Hongqiang Lin, Yiding Sun, Pengyu Wang, Qirui Wang, Ning Yang, Jihua Zhu

机构 * Xi’an Jiaotong University(西安交通大学) Zhejiang University(浙江大学) The Chinese University of Hong Kong (Shenzhen)(香港中文大学(深圳)) Institute of Automation CASIA(中国科学院自动化研究所)

AI总结 CoFiCot通过自适应粗到细框架,利用多指标分类器和状态依赖传播过程,提升大语言模型在不同任务上的推理能力与上下文一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05867 2026-03-10 cs.CV

TumorChain: Interleaved Multimodal Chain-of-Thought Reasoning for Traceable Clinical Tumor Analysis

TumorChain: 交错多模态链式推理用于可追溯的临床肿瘤分析

Sijing Li, Zhongwei Qiu, Jiang Liu, Wenqiao Zhang, Tianwei Lin, Yihan Xie, Jianxiang An, Boxiang Yun, Chenglin Yang, Jun Xiao, Guangyu Guo, Jiawen Yao, Wei Liu, Yuan Gao, Ke Yan, Weiwei Cao, Zhilin Zheng, Tony C. W. Mok, Kai Cao, Yu Shi, Jiuyu Zhang, Jian Zhou, Beng Chin Ooi, Yingda Xia, Ling Zhang

机构 * Zhejiang University(浙江大学) DAMO Academy, Alibaba Group(阿里集团达摩院) Hupan Lab(虎扑实验室) Shanghai Institution of Pancreatic Disease(上海胰腺疾病研究所) Shengjing Hospital of China Medical University(中国医科大学盛京医院) Sun Yat-sen University Cancer Center(中山大学肿瘤中心)

AI总结 TumorChain通过多模态交错推理框架提升临床肿瘤分析的可追溯性和准确性。

Comments Accepted at ICLR 2026. 10 pages + appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08048 2026-03-10 cs.AI

S2S-FDD: Bridging Industrial Time Series and Natural Language for Explainable Zero-shot Fault Diagnosis

S2S-FDD:连接工业时间序列与自然语言用于可解释的零样本故障诊断

Baoxue Li, Chunhui Zhao

机构 * 1. State Key Laboratory of Industrial Control Technology, College of Control Science Engineering Zhejiang University Hangzhou, China Engineering Zhejiang University 2. School of Information Electrical Engineering, Zhejiang University City College Hangzhou, China

AI总结 S2S-FDD通过将高维传感器信号转换为自然语言摘要,并结合树状结构诊断方法,实现可解释的零样本故障诊断。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07559 2026-03-10 cs.CV

Active Inference for Micro-Gesture Recognition: EFE-Guided Temporal Sampling and Adaptive Learning

主动推断用于微手势识别:EFE引导的时间采样与自适应学习

Weijia Feng, Jingyu Yang, Ruojia Zhang, Fengtao Sun, Qian Gao, Chenyang Wang, Tongtong Su, Jia Guo, Xiaobai Li, Minglai Shao

机构 * Tianjin Normal University(天津师范大学) Shenzhen University(深圳大学) The State Key Laboratory of Blockchain and Data Security, Zhejiang University(浙江大学区块链与数据安全国家重点实验室) Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security(杭州高新技术区(滨江)区块链与数据安全研究院) School of New Media and Communications, Tianjin University(天津大学新媒体与传播学院)

AI总结 本文提出基于主动推断的微手势识别框架,通过EFE引导的时间采样和不确定性感知的自适应学习,提升低资源和噪声条件下的识别性能。

Comments 10 pages, accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07516 2026-03-10 cs.RO cs.AI

InterReal: A Unified Physics-Based Imitation Framework for Learning Human-Object Interaction Skills

InterReal:一种基于物理的统一模仿学习框架,用于学习人-物交互技能

Dayang Liang, Yuhang Lin, Xinzhe Liu, Jiyuan Shi, Yunlong Liu, Chenjia Bai

机构 * Xiamen University(厦门大学) Zhejiang University(浙江大学) ShanghaiTech University(上海科技大学) Institute of Artificial Intelligence (TeleAI)(人工智能研究院(TeleAI))

AI总结 InterReal通过基于物理的统一模仿学习框架,提升类人机器人在现实世界中学习人-物交互技能的精度和成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07515 2026-03-10 cs.CV

EvolveReason: Self-Evolving Reasoning Paradigm for Explainable Deepfake Facial Image Identification

EvolveReason: 为可解释的深度伪造面部图像识别设计的自演化推理范式

Binjia Zhou, Dawei Luo, Shuai Chen, Feng Xu, Seow, Haoyuan Li, Jiachi Wang, Jiawen Wang, Zunlei Feng, Yijun Bei

机构 * School of Software Technology, Zhejiang University(浙江大学软件技术学院) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) Ant Group(蚂蚁集团)

AI总结 EvolveReason通过模仿人类推理过程和构建特定数据集,提升深度伪造面部图像识别的可解释性和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08131 2026-03-10 cs.CV

Real-Time Motion-Controllable Autoregressive Video Diffusion

实时可控的自回归视频扩散

Kesen Zhao, Jiaxin Shi, Beier Zhu, Junbao Zhou, Xiaolong Shen, Yuan Zhou, Qianru Sun, Hanwang Zhang

机构 * Nanyang Technological University(南洋理工大学) Xmax.AI Ltd(Xmax.AI有限公司) Zhejiang University(浙江大学) Singapore Management University(新加坡国立大学)

AI总结 AR-Drag是一种基于强化学习的实时图像到视频生成模型,通过自回归机制和轨迹奖励模型实现高效运动控制,提升视频生成质量和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01487 2026-03-10 cs.CV

PointSlice: Accurate and Efficient Slice-Based Representation for 3D Object Detection from Point Clouds

PointSlice: 用于点云3D物体检测的准确且高效的基于切片的表示方法

Liu Qifeng, Zhao Dawei, Dong Yabo, Xiao Liang, Wang Juan, Min Chen, Li Fuyang, Jiang Weizhong, Lu Dongming, Nie Yiming

机构 * Zhejiang University(浙江大学) Defense Innovation Institute(国防科技创新研究院) Tsinghua University(清华大学)

AI总结 PointSlice提出了一种基于切片的点云表示方法,通过引入切片交互网络提升3D物体检测的精度与效率。

Comments Accepted by Pattern Recognition

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.17881 2026-03-10 cs.CV

Deepfake Generation and Detection: A Benchmark and Survey

深度伪造生成与检测:基准与综述

Gan Pei, Jiangning Zhang, Menghan Hu, Zhenyu Zhang, Chengjie Wang, Yunsheng Wu, Guangtao Zhai, Jian Yang, Dacheng Tao

机构 * East China Normal University(华东师范大学) Zhejiang University(浙江大学) Nanjing University(南京大学) Youtu Lab, Tencent(腾讯优图实验室) Shanghai Jiao Tong University(上海交通大学) Nanyang Technological University(南洋理工大学)

AI总结 本文综述了深度伪造生成与检测的最新进展,分析了相关技术、数据集及未来研究方向。

Comments This paper has been accepted by ACM Computing Surveys. We closely follow the latest developments in this \href{https://github.com/flyingby/Awesome-Deepfake-Generation-and-Detection}{project}

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07199 2026-03-10 cs.RO

Vision-Guided MPPI for Agile Drone Racing: Navigating Arbitrary Gate Poses via Neural Signed Distance Fields

基于视觉的MPPI用于敏捷无人机竞速:通过神经签名距离场导航任意门姿态

Fangguo Zhao, Hanbing Zhang, Zhouheng Li, Xin Guan, Shuo Li

机构 * College of Control Science and Engineering, Zhejiang University(控制科学与工程学院,浙江大学)

AI总结 本文提出基于视觉的MPPI框架,利用神经签名距离场实现无需参考的敏捷无人机飞行,有效应对动态变化的赛道和门姿态。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07098 2026-03-10 cs.CV

NuNext: Reframing Nucleus Detection as Next-Point Detection

NuNext:将核检测重新表述为下一个点检测

Zhongyi Shui, Honglin Li, Xiaozhong Ji, Ye Zhang, Zijiang Yang, Chenglu Zhu, Yuxuan Sun, Kai Yao, Conghui He, Cheng Tan

机构 * Zhejiang University(浙江大学) Westlake University(西湖大学) Nanjing University(南京大学) Harbin Institute of Technology(哈尔滨工业大学) University of Science and Technology Beijing(北京科技大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

AI总结 NuNext通过多模态大语言模型直接输出核质心,采用空间感知软监督和强化微调策略提升检测性能,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09486 2026-03-10 cs.CV cs.AI cs.MM

Video-EM: Event-Centric Episodic Memory for Long-Form Video Understanding

视频-EM:面向长视频理解的事件中心型片段记忆

Yun Wang, Long Zhang, Jingren Liu, Jiaqi Yan, Zhanjie Zhang, Jiahao Zheng, Ao Ma, Run Ling, Xun Yang, Dapeng Wu, Xiangyu Chen, Xuelong Li

机构 * City University of Hong Kong(香港城市大学) University of Science and Technology of China(中国科学技术大学) Tianjin University(天津大学) Nanjing University(南京大学) Zhejiang University(浙江大学) The Institute of Artificial Intelligence (TeleAI), China Telecom(中国电信人工智能研究所(TeleAI))

AI总结 Video-EM通过事件中心型片段记忆框架,将长视频问答转化为事件构建与记忆细化,提升长视频理解的连贯性与可靠性。

Comments 14 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13347 2026-03-10 cs.CV

$π^3$: Permutation-Equivariant Visual Geometry Learning

π³:排列等变视觉几何学习

Yifan Wang, Jianjun Zhou, Haoyi Zhu, Wenzheng Chang, Yang Zhou, Zizun Li, Junyi Chen, Jiangmiao Pang, Chunhua Shen, Tong He

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Innovation Institute(上海创新研究院) Zhejiang University(浙江大学) University of Science and Technology of China(中国科学技术大学) Fudan University(复旦大学)

AI总结 π³通过排列等变架构实现无需参考视角的视觉几何重建,提升相机姿态和点地图重建的准确性和鲁棒性。

Comments Project page: https://yyfz.github.io/pi3/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11202 2026-03-10 cs.CV cs.AI cs.LG

A Robust Incomplete Multimodal Low-Rank Adaptation Approach for Emotion Recognition

一种鲁棒的不完整多模态低秩适应方法用于情感识别

Xinkui Zhao, Jinsong Shu, Yangyang Wu, Guanjie Cheng, Zihe Liu, Naibo Wang, Shuiguang Deng, Zhongle Xie, Jianwei Yin

机构 * Zhejiang University(浙江大学)

AI总结 本文提出MCULoRA方法,通过解耦模态组合的共享信息和动态调整参数微调,提升不完整多模态学习模型的训练效率和下游任务准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00940 2026-03-10 cs.LG math.OC stat.CO stat.ME

StablePCA: Distributionally Robust Learning of Shared Representations from Multi-Source Data

StablePCA:从多源数据中鲁棒学习共享表示

Zhenyu Wang, Molei Liu, Jing Lei, Francis Bach, Zijian Guo

机构 * Rutgers University(罗杰斯大学) Peking University Health Science Center(北京大学医学部) Beijing International Center for Mathematical Research(北京国际数学研究中心) Inria École Normale Supérieure PSL Research University(Inria 常规大学) Zhejiang University(浙江大学)

AI总结 StablePCA通过分布鲁棒方法从多源数据中学习稳定的共享表示,解决非凸秩约束问题并提供收敛保证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03505 2026-03-10 cs.AI

Parallelized Planning-Acting for Efficient LLM-based Multi-Agent Systems in Minecraft

并行规划-行动用于Minecraft中基于大语言模型的多智能体系统的高效性

Yaoru Li, Shunyu Liu, Tongya Zheng, Li Sun, Mingli Song

机构 * Zhejiang University(浙江大学) Nanyang Technological University(南洋理工大学) Hangzhou City University(杭州市城市大学) Ningbo Global Innovation Center, Zhejiang University(宁波全球创新中心,浙江大学)

AI总结 本文提出了一种基于大语言模型的多智能体系统并行规划-行动框架,通过双线程架构实现同时规划和行动,提升Minecraft中动态决策的效率和响应能力。

详情

展开后加载摘要…

URL PDF HTML 收藏