arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Zhejiang University(浙江大学)

2026-03-02 至 2026-03-02 共收录 14
2602.23945 2026-03-02 cs.CV cs.AI cs.MM

PointCoT: A Multi-modal Benchmark for Explicit 3D Geometric Reasoning

PointCoT: 一种用于显式3D几何推理的多模态基准

Dongxu Zhang, Yiding Sun, Pengcheng Li, Yumou Liu, Hongqiang Lin, Haoran Xu, Xiaoxuan Mu, Liang Lin, Wenbiao Yan, Ning Yang, Chaowei Fang, Juanjuan Zhao, Jihua Zhu, Conghui He, Cheng Tan

机构 * Xi'an Jiaotong University(西安交通大学) Tsinghua University(清华大学) Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学) Nanyang Technological University(南洋理工大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Institute of Automation, CASIA(中国科学院自动化研究所) Taiyuan University of Technology(太原理工大学) Shanghai AI Laboratory(上海人工智能实验室)

AI总结 PointCoT通过显式链式推理提升3D几何推理能力,提出多模态基准和双流架构,实现对3D点云的高精度理解与推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23864 2026-03-02 cs.AI

RUMAD: Reinforcement-Unifying Multi-Agent Debate

RUMAD:强化统一多智能体辩论

Chao Wang, Han Lin, Huaze Tang, Huijing Lin, Wenbo Ding

机构 * Tsinghua University(清华大学) Zhejiang University(浙江大学)

AI总结 RUMAD通过强化学习动态控制通信拓扑,提升多智能体辩论的效率和准确性,实现80%以上的token成本降低和跨域泛化能力。

Comments 13 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23806 2026-03-02 cs.CV cs.AI

See, Act, Adapt: Active Perception for Unsupervised Cross-Domain Visual Adaptation via Personalized VLM-Guided Agent

看见、行动、适应:通过个性化VLM引导代理的主动感知用于无监督跨域视觉适应

Tianci Tang, Tielong Cai, Hongwei Wang, Gaoang Wang

机构 * Zhejiang University, Hangzhou, China(浙江大学)

AI总结 Sea$^2$通过智能姿态控制代理实现无监督跨域视觉适应,利用现成感知模型提升视觉任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23803 2026-03-02 eess.IV cs.CV

BiM-GeoAttn-Net: Linear-Time Depth Modeling with Geometry-Aware Attention for 3D Aortic Dissection CTA Segmentation

BiM-GeoAttn-Net:基于几何感知注意力的线性时间深度建模用于3D主动脉夹层CTA分割

Yuan Zhang, Lei Liu, Jialin Zhang, Ya-Nan Zhang, Ling Wang, Nan Mu

机构 * College of Computer Science Sichuan Normal University(四川师范大学计算机学院) Zhejiang University(浙江大学) Ant Group(蚂蚁集团) State Key Laboratory of Public Big Data Guizhou University(贵州公共大数据省重点实验室贵州大学)

AI总结 BiM-GeoAttn-Net通过几何感知注意力与线性时间深度建模,实现高效准确的3D主动脉夹层CTA分割。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23761 2026-03-02 cs.LG cs.CV

OPTIAGENT: A Physics-Driven Agentic Framework for Automated Optical Design

OPTIAGENT:一种基于物理的代理框架用于自动光学设计

Yuyu Geng, Lei Sun, Yao Gao, Xinxin Hu, Zhonghua Yi, Xiaolong Qian, Weijian Hu, Jian Bai, Kaiwei Wang

机构 * Zhejiang University(浙江大学) INSAIT, Sofia University(INSAIT,索菲亚大学)

AI总结 OPTIAGENT通过结合LLM与物理驱动的优化方法,首次实现了无需专业光学知识即可自动设计光学系统,提升了光学设计的自动化水平和精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22695 2026-03-02 cs.CV

GFRRN: Explore the Gaps in Single Image Reflection Removal

GFRRN: 探索单图像反光去除中的空白

Yu Chen, Zewei He, Xingyu Liu, Zixuan Chen, Zheming Lu

机构 * Zhejiang University(浙江大学) Huanjiang Laboratory(焕江实验室) The Chinese University of Hong Kong(香港中文大学)

AI总结 GFRRN通过引入PEFT策略、标签生成器和自适应频率学习块,解决单图像反光去除中的语义差距和标签不一致问题,实现更高效的反光去除性能。

Comments CVPR26

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22006 2026-03-02 cs.RO

Parallel Continuous-Time Relative Localization with Augmented Clamped Non-Uniform B-Splines

并行连续时间相对定位与增强钳制非均匀B样条

Jiadong Lu, Zhehan Li, Tao Han, Miao Xu, Chao Xu, Yanjun Cao

机构 * State Key Laboratory of Industrial Control Technology, Institute of Cyber-Systems and Control, Zhejiang University(工业控制技术国家重点实验室,系统与控制研究所,浙江大学) Huzhou Institute of Zhejiang University(浙江大学湖州研究院) Department of Automatic Control, Faculty of Engineering, Lund University(自动控制系,工程学院, Lund大学)

AI总结 本文提出CT-RIO框架,利用钳制非均匀B样条实现高精度、低延迟的多机器人相对定位,通过灵活的节点管理提升计算效率。

Comments 26 pages, 23 figures, submitted to IEEE Transactions on Robotics

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12113 2026-03-02 cs.AI cs.CL

Stop Unnecessary Reflection: Training LRMs for Efficient Reasoning with Adaptive Reflection and Length Coordinated Penalty

停止不必要的反思:通过自适应反思和长度协调惩罚训练高效的推理模型

Zewei Yu, Lirong Gao, Yuke Zhu, Bo Zheng, Junbo Zhao, Sheng Guo, Haobo Wang

机构 * State Key Laboratory of Blockchain and Data Security, Zhejiang University(浙江大学区块链与数据安全国家重点实验室) MYbank, Ant Group(蚂蚁集团MYbank) Innovation and Management Center, School of Software Technology (Ningbo), Zhejiang University(浙江大学软件学院(宁波)创新与管理中心)

AI总结 通过自适应反思和长度协调惩罚方法,提升推理效率和准确性,减少响应长度并提高性能。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05362 2026-03-02 cs.CV

Imagine a City: CityGenAgent for Procedural 3D City Generation

想象一座城市:CityGenAgent用于程序化3D城市生成

Zishan Liu, Zecong Tang, RuoCheng Wu, Xinzhe Zheng, Jingyu Hu, Ka-Hei Hui, Haoran Xie, Bo Dai, Zhengzhe Liu

机构 * Lingnan University, Hong Kong SAR, China(岭南大学) Zhejiang University, Hangzhou, China(浙江大学) The Chinese University of Hong Kong, Hong Kong SAR, China(香港中文大学) Autodesk AI Lab, Canada(Autodesk AI实验室) The University of Hong Kong, Hong Kong SAR, China(香港大学)

AI总结 CityGenAgent通过自然语言驱动的分层程序化生成方法,实现了高质量3D城市生成,提升了语义对齐、视觉质量和可控性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21135 2026-03-02 cs.RO cs.AI cs.CV

SocialNav: Training Human-Inspired Foundation Model for Socially-Aware Embodied Navigation

SocialNav: 为社交感知具身导航训练的人类启发式基础模型

Ziyi Chen, Yingnan Guo, Zedong Chu, Minghua Luo, Yanfen Shen, Mingchao Sun, Junjun Hu, Shichao Xie, Kuan Yang, Pei Shi, Zhining Gu, Lu Liu, Honglin Han, Xiaolong Wu, Mu Xu, Yu Zhang, Ning Guo

机构 * Amap, Alibaba Group, China(阿里集团阿地图,中国) Zhejiang University, China(浙江大学,中国)

AI总结 SocialNav通过分层架构和多阶段训练,实现了社交感知导航,显著提升了导航性能和社会合规率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21171 2026-03-02 cs.CV

TokenCLIP: Token-wise Prompt Learning for Zero-shot Anomaly Detection

TokenCLIP: 基于令牌的提示学习用于零样本异常检测

Qihang Zhou, Binbin Gao, Guansong Pang, Xin Wang, Jiming Chen, Shibo He

机构 * Zhejiang University(浙江大学) Tencent YouTu Lab(腾讯YouTu实验室) Singapore Management University(新加坡管理学院) Qilu University of Technology (Shandong Academy of Sciences)(青岛科技大学(山东科学院))

AI总结 TokenCLIP通过动态对齐视觉与文本子空间,实现细粒度异常检测,提升零样本异常检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21021 2026-03-02 cs.LG cs.AI stat.ML

Efficient Ensemble Conditional Independence Test Framework for Causal Discovery

高效的因果发现条件独立性测试框架

Zhengkang Guan, Kun Kuang

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)

AI总结 本文提出了一种高效的条件独立性测试框架,通过分组聚合策略降低计算复杂度并提升因果发现性能。

Comments Published as a conference paper at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17966 2026-03-02 cs.IR cs.CV

LLM-Enhanced Multimodal Fusion for Cross-Domain Sequential Recommendation

基于大语言模型的跨域序列推荐多模态融合

Wangyu Wu, Zhenhong Chen, Wenqiao Zhang, Xianglin Qiu, Siqi Song, Xiaowei Huang, Fei Ma, Jimin Xiao

机构 * Xi'an Jiaotong-Liverpool University(西安交通大学利物浦大学) University of Liverpool(利物浦大学) Microsoft(微软公司) Zhejiang University(浙江大学)

AI总结 本文提出LLM-EMF方法,通过融合视觉和文本数据提升跨域序列推荐性能,利用CLIP模型生成多模态嵌入并引入多重注意力机制,实验证明其在多领域推荐中的有效性。

Comments arXiv admin note: substantial text overlap with arXiv:2504.15085

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18579 2026-03-02 cs.LG

Sparsity Forcing: Reinforcing Token Sparsity of MLLMs

稀疏性强制:强化多模态大语言模型的token稀疏性

Feng Chen, Yefei He, Lequan Lin, Chenhui Gou, Jing Liu, Bohan Zhuang, Qi Wu

机构 * AIML, University of Adelaide, Australia(AIML,澳大利亚阿德莱德大学) ZIP Lab, Zhejiang University, China(浙江工业大学ZIP实验室) University of Sydney, Australia(悉尼大学) Monash University, Australia(墨尔本大学)

AI总结 本文提出Sparsity Forcing方法,通过强化学习框架在多模态大语言模型中提升token稀疏性,实现75%的token减少与极小的精度损失。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏