arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Zhejiang University(浙江大学)

2026-04-09 至 2026-04-09 共收录 14
2604.06966 2026-04-09 cs.CV

MAR-GRPO: Stabilized GRPO for AR-diffusion Hybrid Image Generation

MAR-GRPO:用于AR-扩散混合图像生成的稳定GRPO

Xiaoxiao Ma, Jiachen Lei, Tianfei Ren, Jie Huang, Siming Fu, Aiming Hao, Jiahong Wu, Xiangxiang Chu, Feng Zhao

机构 * University of Science and Technology of China(中国科学技术大学) AMAP, Alibaba Group(阿里巴巴集团高德地图) Zhejiang University(浙江大学)

AI总结 本文提出稳定RL框架用于MAR,通过多轨迹期望减少梯度噪声,结合不确定性估计和一致性aware的token选择策略,提升图像生成质量与稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06882 2026-04-09 cs.RO cs.SY eess.SP eess.SY

Telecom World Models: Unifying Digital Twins, Foundation Models, and Predictive Planning for 6G

电信世界模型:统一数字孪生、基础模型和预测规划用于6G

Hang Zou, Yuzhi Yang, Lina Bariah, Yu Tian, Yuhuan Lu, Bohao Wang, Anis Bara, Brahim Mefgouda, Hao Liu, Yiwei Tao, Sergy Petrov, Salma Cheour, Nassim Sehad, Sumudu Samarakoon, Chongwen Huang, Samson Lasaulce, Mehdi Bennis, Mérouane Debbah

机构 * Research Institute for Digital Future, Khalifa University(哈利法大学数字未来研究所) College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息与电子工程学院) University of Oulu(奥卢大学) Aalto University(阿尔托大学) Université de Lorraine, CNRS, CRAN(洛林大学,法国国家科学研究中心,CRAN)

AI总结 本文提出电信世界模型(TWM),结合数字孪生与基础模型,解决6G网络中动态建模、不确定性处理和多层控制规划问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06870 2026-04-09 cs.CV

RefineAnything: Multimodal Region-Specific Refinement for Perfect Local Details

RefineAnything: 多模态区域特定细化以实现完美局部细节

Dewei Zhou, You Li, Zongxin Yang, Yi Yang

机构 * RELER, CCAI, Zhejiang University(浙江大学计算机辅助设计与图形学国家重点实验室、人工智能研究所) DBMI, HMS, Harvard University(哈佛大学医学院生物医学信息学系)

AI总结 本文提出区域特定图像细化方法,通过多模态扩散模型实现局部细节恢复,同时保持非编辑区域不变,引入边界一致性损失和Focus-and-Refine策略提升效果。

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06834 2026-04-09 cs.CL cs.AI

On the Step Length Confounding in LLM Reasoning Data Selection

在LLM推理数据选择中的步长混淆问题

Bing Wang, Rui Miao, Chen Shen, Shaotian Yan, Kaiyuan Liu, Ximing Li, Xiaosong Yuan, Sinan Fan, Jun Zhang, Jieping Ye

机构 * College of Computer Science and Technology, Jilin University(吉林大学计算机科学与技术学院) Key Laboratory of Symbolic Computation and Knowledge Engineering, MoE, Jilin University(吉林大学符号计算与知识工程教育部重点实验室) Alibaba Cloud Computing(阿里云) School of Artificial Intelligence, Jilin University(吉林大学人工智能学院) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) Department of Mathematics, University of Michigan(密歇根大学数学系) RIKEN Center for Advanced Intelligence Project(理化学研究所先进智能研究中心)

AI总结 本文分析了自然性基于的数据选择方法在LLM推理数据中系统性偏好长推理步骤的问题,并提出ASLEC-DROP和ASLEC-CASL方法以缓解此混淆。

Comments Accepted by Findings of ACL 2026. 15 pages, 9 figures. Code: https://github.com/wangbing1416/ASLEC

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06777 2026-04-09 cs.CV

Walk the Talk: Bridging the Reasoning-Action Gap for Thinking with Images via Multimodal Agentic Policy Optimization

行走与言说:通过多模态代理策略优化弥合图像推理与行动之间的差距

Wenhao Yang, Yu Xia, Jinlong Huang, Shiyin Lu, Qing-Guo Chen, Zhao Xu, Weihua Luo, Kaifu Zhang, Yuchen Zhou, Xiaobo Xia, Yuanyu Wan, Lijun Zhang, Tat-Seng Chua

机构 * National Key Laboratory for Novel Software Technology, Nanjing University, China(南京大学计算机软件新技术国家重点实验室) School of Artificial Intelligence, Nanjing University, China(南京大学人工智能学院) AI Business, Alibaba Group(阿里巴巴集团智能计算研究院) School of Automation and Intelligent Sensing, Shanghai Jiao Tong University, China(上海交通大学自动化与智能感知学院) School of Intelligent Systems Engineering, Sun Yat-sen University, Shenzhen, China(中山大学智能工程学院(深圳)) School of Information Science and Technology, University of Science and Technology of China(中国科学技术大学信息科学技术学院) School of Software Technology, Zhejiang University, China(浙江大学软件学院) School of Computing, National University of Singapore, Singapore, Singapore(新加坡国立大学计算机学院)

AI总结 本文提出MAPO方法,通过强制生成视觉内容的显式文本描述,结合语义对齐与任务奖励,提升多模态推理能力,实验表明其在多个视觉推理基准上表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06713 2026-04-09 cs.CV

Improving Local Feature Matching by Entropy-inspired Scale Adaptability and Flow-endowed Local Consistency

通过熵启发的尺度适应性与流赋能的局部一致性改进局部特征匹配

Ke Jin, Jiming Chen, Qi Ye

机构 * State Key Laboratory of Industrial Control Technology, Zhejiang University(浙江大学工业控制技术国家重点实验室)

AI总结 本文提出通过熵启发的尺度适应性和流赋能的局部一致性改进局部特征匹配,解决尺度差异和局部一致性问题,提升匹配性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06663 2026-04-09 cs.CY cs.AI

Restoring Heterogeneity in LLM-based Social Simulation: An Audience Segmentation Approach

在基于大语言模型的社会模拟中恢复异质性:一种受众细分方法

Xiaoyou Qin, Zhihong Li, Xiaoxiao Cheng

机构 * School of Journalism, Fudan University(复旦大学新闻学院) College of Media and International Culture, Zhejiang University(浙江大学传媒与国际文化学院)

AI总结 本文提出通过受众细分方法恢复基于大语言模型的社会模拟中的异质性,利用美国气候意见调查数据,比较不同细分配置在两个大语言模型上的表现,发现适度细化能提升性能,但过度细化可能损害结构和预测忠实度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06267 2026-04-09 cs.LG cs.AI

MO-RiskVAE: A Multi-Omics Variational Autoencoder for Survival Risk Modeling in Multiple MyelomaMO-RiskVAE

MO-RiskVAE: 一种多组学变分自编码器用于多发性骨髓瘤生存风险建模

Zixuan Chen, Heng Zhang, YuPeng Qin, WenPeng Xing, Qiang Wang, Da Wang, Changting Lin, Meng Han

机构 * Binjiang Institute of Zhejiang University(浙江大学滨江研究院) Zhejiang University(浙江大学) School of Medicine, Zhejiang University(浙江大学医学院)

AI总结 本文提出MO-RiskVAE,通过统一扩展MyeVAE框架,系统研究了潜变量建模选择对多模态生存预测的影响,发现生存驱动训练对潜变量正则化幅度和结构更敏感,通过混合连续-离散公式提升风险排序,改进了风险分层。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05828 2026-04-09 cs.RO

Precise Aggressive Aerial Maneuvers with Sensorimotor Policies

精确的激进空中动作与传感器运动政策

Tianyue Wu, Guangtong Xu, Zihan Wang, Junxiao Lin, Tianyang Chen, Yuze Wu, Zhichao Han, Zhiyang Liu, Fei Gao

机构 * Institute of Cyber-Systems and Control, College of Control Science and Engineering, Zhejiang University(浙江大学控制科学与工程学院工业控制技术研究所) Huzhou Institute of Zhejiang University(浙江大学湖州研究院) Differential Robotics Technology Co., Ltd.(微分机器人技术有限公司)

AI总结 本文提出了一种基于强化学习的传感器运动政策,用于实现四旋翼无人机在狭窄间隙中精确激进的空中动作,通过模拟训练和仿真到现实的设计,实现了低空隙和高重复性的导航能力。

Comments This manuscript was submitted in June 2025. The first revision was submitted in November 2025. The second revision was submitted in February 2026. The first two authors contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02996 2026-04-09 cs.CV

Rendering Multi-Human and Multi-Object with 3D Gaussian Splatting

多人类和多物体的3D高斯散射渲染

Weiquan Wang, Jun Xiao, Feifei Shao, Yi Yang, Yueting Zhuang, Long Chen

机构 * State Key Lab of CAD&CG, College of Computer Science, Zhejiang University(浙江大学计算机科学与技术学院计算机辅助设计与图形学国家重点实验室) Department of Computer Science and Engineering, The Hong Kong University of Science and Technology(香港科技大学计算机科学与工程系)

AI总结 本文提出MM-GS框架,通过实例级多视图融合和场景级实例交互模块,解决多人类和多物体动态场景重建中的视图一致性与复杂依赖建模问题,实现高保真渲染。

Comments 8 pages, 4 figures, accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27253 2026-04-09 cs.CL

Mitigating Hallucination on Hallucination in RAG via Ensemble Voting

通过集成投票缓解RAG中的幻觉

Zequn Xie, Zhengyang Sun

机构 * Polytechnic Institute Zhejiang University Hangzhou, China School of Computer Science Technology Xinjiang University Urumqi, China

AI总结 本文提出VOTE-RAG框架,通过集成投票机制缓解RAG中的幻觉问题,实验表明其性能优于复杂框架,且结构简单、并行高效。

Comments arXiv admin note: text overlap with arXiv:2505.18581 by other authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23158 2026-04-09 cs.CV cs.AI

REVEAL: Reasoning-Enhanced Forensic Evidence Analysis for Explainable AI-Generated Image Detection

REVEAL: 基于推理的取证分析用于可解释的AI生成图像检测

Huangsen Cao, Qin Mei, Zhiheng Li, Yuxi Li, Zhan Meng, Ying Zhang, Chen Li, Zhimeng Zhang, Xin Ding, Yongwei Wang, Jing Lyu, Fei Wu

机构 * Zhejiang University(浙江大学) WeChat Vision, Tencent Inc(腾讯微信视觉) Nanjing University of Information Science and Technology(南京信息工程大学)

AI总结 REVEAL通过构建可验证的证据链,提升AI生成图像检测的可解释性与泛化能力,采用专家引导的强化学习训练框架,实现更准确和可信的检测结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22396 2026-04-09 cs.CV cs.AI

Asking like Socrates: Socrates helps VLMs understand remote sensing images

像苏格拉底提问:苏格拉底帮助VLMs理解遥感图像

Run Shao, Ziyu Li, Zhaoyang Zhang, Linrui Xu, Xinran He, Hongyuan Yuan, Bolei He, Yongxing Dai, Yiming Yan, Yijun Chen, Wang Guo, Haifeng Li

机构 * School of Geosciences and Info-Physics, Central South University(中南大学地球科学与信息物理学院) Baidu Inc.(百度公司) School of Earth Sciences, Zhejiang University(浙江大学地球科学学院)

AI总结 本文提出RS-EoT方法,通过迭代视觉证据寻求机制和两阶段强化学习策略,解决遥感图像中伪推理问题,提升视觉证据基础的推理能力。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26083 2026-04-09 cs.LG cs.AI

Nirvana: A Specialized Generalist Model With Task-Aware Memory Mechanism

Nirvana:一种具有任务感知内存机制的专用通用模型

Yuhua Jiang, Shuang Cheng, Yihao Liu, Ermo Hua, Che Jiang, Weigao Sun, Yu Cheng, Feifei Gao, Biqing Qi, Bowen Zhou

机构 * Shanghai AI Laboratory(上海人工智能实验室) Tsinghua University(清华大学) Xiong’an Anying Technology Co., Ltd.(雄安安影科技有限公司) Zhejiang University(浙江大学)

AI总结 Nirvana提出一种具备任务感知内存机制的专用通用模型,通过线性时间复杂度和测试时任务信息提取,在通用和专业领域均表现优异,尤其在医学、金融和法律等专业领域实现最低困惑度。

详情

展开后加载摘要…

URL PDF HTML 收藏