arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Zhejiang University(浙江大学)

共收录 2931
2512.20940 2025-12-25 cs.RO

ETP-R1: Evolving Topological Planning with Reinforcement Fine-tuning for Vision-Language Navigation in Continuous Environments

连续环境中的视觉-语言导航(VLN-CE)需要一个具身体验的智能体在连续环境中导航至目标,遵循自然语言指令。虽然当前基于图的方法通过将环境抽象为拓扑地图并简化动作空间到路径选择,提供了一种高效、结构化的方法,但它们在利用大规模数据和先进训练范式方面落后于基于大视觉-语言模型(LVLMs)的方法。在本文中,我们通过引入ETP-R1框架,将数据扩展和强化微调(RFT)范式应用于基于图的VLN-CE模型,以弥合这一差距。

Shuhao Ye, Sitong Mao, Yuxiang Cui, Xuan Yu, Shichao Zhai, Wen Chen, Shunbo Zhou, Rong Xiong, Yue Wang

机构 * Zhejiang University(浙江大学) Huawei Technologies Co., Ltd(华为技术有限公司) Zhejiang Humanoid Robot Innovation Center(浙江人形机器人创新中心)

AI总结 ETP-R1通过数据扩展和强化微调范式,提升基于图的连续环境视觉-语言导航性能,实现新状态最先进的表现。

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15745 2025-12-25 cs.LG cs.AI cs.CL

LLaDA2.0: Scaling Up Diffusion Language Models to 100B

LLaDA2.0:将扩散语言模型扩展到100B参数

Tiwei Bie, Maosong Cao, Kun Chen, Lun Du, Mingliang Gong, Zhuochen Gong, Yanmei Gu, Jiaqi Hu, Zenan Huang, Zhenzhong Lan, Chengxi Li, Chongxuan Li, Jianguo Li, Zehuan Li, Huabin Liu, Lin Liu, Guoshan Lu, Xiaocheng Lu, Yuxin Ma, Jianfeng Tan, Lanning Wei, Ji-Rong Wen, Yipeng Xing, Xiaolu Zhang, Junbo Zhao, Da Zheng, Jun Zhou, Junlin Zhou, Zhanchao Zhou, Liwang Zhu, Yihong Zhuang

机构 * Ant Group(蚂蚁集团) Renmin University of China(中国人民大学) Zhejiang University(浙江大学) Westlake University(西湖大学) HongKong University of Science and Technology(香港科学与技术大学)

AI总结 LLaDA2.0通过三阶段块级训练方案将扩散语言模型扩展至100B参数,实现高效前沿规模部署。

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02622 2025-12-25 cs.CV

RULER-Bench: Probing Rule-based Reasoning Abilities of Next-level Video Generation Models for Vision Foundation Intelligence

RULER-Bench: 探索下一代视频生成模型的基于规则的推理能力以实现视觉基础智能

Xuming He, Zehao Fan, Hengjia Li, Fan Zhuo, Hankun Xu, Senlin Cheng, Di Weng, Haifeng Liu, Can Ye, Boxi Wu

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团)

AI总结 RULER-Bench通过评估视频生成模型的基于规则的推理能力,揭示了其在时间一致性等指标上的不足,为提升视频生成模型的推理能力提供新方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00020 2025-12-25 cs.AR cs.AI

Large Language Model for Verilog Code Generation: Literature Review and the Road Ahead

用于Verilog代码生成的大型语言模型:文献综述与未来方向

Guang Yang, Wei Zheng, Xiang Chen, Dong Liang, Peng Hu, Yukui Yang, Shaohang Peng, Zhenghan Li, Jiahui Feng, Xiao Wei, Kexin Sun, Deyuan Ma, Haotian Cheng, Yiheng Shen, Xing Hu, Terry Yue Zhuo, David Lo

机构 * Zhejiang University \& Northwestern Polytechnical University China Northwestern Polytechnical University China Nantong University China Zhejiang University China Monash University Australia Singapore Management University Singapore Zhejiang University \& Northwestern Polytechnical University Northwestern Polytechnical University Nantong University Zhejiang University Monash University Singapore Management University

AI总结 本文综述了LLMs在Verilog代码生成中的应用,分析了现有方法的有效性、局限性及未来研究方向。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01907 2025-12-25 cs.CV cs.CL

RSCC: A Large-Scale Remote Sensing Change Caption Dataset for Disaster Events

RSCC:一种大规模遥感变化描述数据集用于灾害事件

Zhenyuan Chen, Chenxi Wang, Ningyu Zhang, Feng Zhang

机构 * School of Earth Sciences, Zhejiang University(浙江大学地球科学学院) School of Software Technology, Zhejiang University(浙江大学软件学院) Zhejiang Provincial Key Laboratory of Geographic Information Science(浙江省地理信息科学重点实验室) Key Laboratory of Spatio-temporal Information and Intelligent Services (LSIIS), Ministry of Natural Resources of the People’s Republic of China(国家自然资源部空间时空信息与智能服务重点实验室)

AI总结 RSCC数据集通过提供大规模遥感图像对和详细变化描述,提升视觉-语言模型在灾害事件双时间理解中的性能和应用能力。

Comments Accepted by NeurIPS 2025 Dataset and Benchmark Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08712 2025-12-25 cs.RO

NavDP: Learning Sim-to-Real Navigation Diffusion Policy with Privileged Information Guidance

NavDP: 基于特权信息引导的学习导航扩散策略

Wenzhe Cai, Jiaqi Peng, Yuqiang Yang, Yujian Zhang, Meng Wei, Hanqing Wang, Yilun Chen, Tai Wang, Jiangmiao Pang

机构 * Shanghai AI Lab(上海人工智能实验室) Tsinghua University(清华大学) Zhejiang University(浙江大学) The University of Hong Kong(香港大学)

AI总结 NavDP通过基于特权信息引导的学习方法,实现自主机器人在多样化环境中的零样本模拟到现实导航转移。

Comments Project Page: https://wzcai99.github.io/navigation-diffusion-policy.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20159 2025-12-24 cs.SE cs.AI

AXIOM: Benchmarking LLM-as-a-Judge for Code via Rule-Based Perturbation and Multisource Quality Calibration

AXIOM:通过基于规则的扰动和多源质量校准构建LLM-as-a-Judge代码评估基准

Ruiqi Wang, Xinchen Wang, Cuiyun Gao, Chun Yong Chong, Xin Xia, Qing Liao

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Monash University Malaysia(墨尔本大学马来西亚分校) Zhejiang University(浙江大学)

AI总结 AXIOM通过基于规则的扰动和多源质量校准构建代码评估基准,以实现高质量代码评分的平衡分布和可靠评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20151 2025-12-24 eess.AS cs.SD

QuarkAudio Technical Report

QuarkAudio 技术报告

Chengwei Liu, Haoyin Yan, Shaofei Xue, Xiaotao Liang, Xiaofu Chen, Bin Gong, Zheng Xue, Gang Song

机构 * Alibaba Group(阿里巴巴集团) Zhejiang University(浙江大学)

AI总结 QuarkAudio通过统一的解码器-only自回归语言模型框架,整合多种音频任务,实现高效高质量的音频生成与处理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20145 2025-12-24 cs.CL cs.AI cs.CV cs.IR cs.LG

Retrieval-augmented Prompt Learning for Pre-trained Foundation Models

基于检索的提示学习用于预训练基础模型

Xiang Chen, Yixin Ou, Quan Feng, Lei Li, Piji Li, Haibo Ye, Sheng-Jun Huang, Shuofei Qiao, Shumin Deng, Huajun Chen, Ningyu Zhang

机构 * MIIT Key Laboratory of Pattern Analysis and Machine Intelligence, College of Computer Science and Technology, Nanjing University of Aeronautics and Astronautics(信息产业部模式分析与机器智能重点实验室,计算机科学与技术学院,南京航空航天大学) Zhejiang University(浙江大学) Hunan Vanguard Group Corporation Limited(湖南先锋集团有限公司) National University of Singapore(新加坡国立大学)

AI总结 RetroPrompt通过整合检索机制和知识库,提升预训练基础模型在少样本和零样本场景下的泛化能力与记忆平衡。

Comments IEEE/ACM Transactions on Audio, Speech and Language Processing

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19730 2025-12-24 cs.LG cs.CR

ArcGen: Generalizing Neural Backdoor Detection Across Diverse Architectures

ArcGen: 在多样架构上实现神经后门检测的泛化

Zhonghao Yang, Cheng Luo, Daojing He, Yiming Li, Yu Li

机构 * Software Engineering Institute, East China Normal University(东华大学软件工程学院) School of Computer Science and Technology, Harbin Institute of Technology(哈尔滨工业大学计算机科学与技术学院) Nanyang Technological University(南洋理工大学) College of Integrated Circuits, Zhejiang University(浙江大学集成电路学院)

AI总结 ArcGen通过引入对齐层和损失函数,提升神经后门检测在不同架构上的泛化能力,实现42.5%的性能提升。

Comments 16 pages, 8 figures. This article was accepted by IEEE Transactions on Information Forensics and Security. DOI: 10.1109/TIFS.2025.3610254

Journal ref in IEEE Transactions on Information Forensics and Security, vol. 20, pp. 10082-10097, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08189 2025-12-24 cs.CV

Reinforcement Learning for Large Model: A Survey

为大模型设计强化学习:综述

Weijia Wu, Chen Gao, Joya Chen, Kevin Qinghong Lin, Qingwei Meng, Yiming Zhang, Yuke Qiu, Hong Zhou, Mike Zheng Shou

机构 * National University of Singapore(新加坡国立大学) Zhejiang University(浙江大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 本文综述了视觉强化学习领域,探讨了多模态大语言模型、视觉生成等四个主题,分析了算法设计、奖励工程及评估协议,并指出了样本效率、泛化能力等开放挑战。

Comments 22 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.19849 2025-12-24 cs.LG cs.DS cs.PL

Deep Learning and Machine Learning -- Python Data Structures and Mathematics Fundamental: From Theory to Practice

深度学习与机器学习——Python数据结构与数学基础:从理论到实践

Silin Chen, Ziqian Bi, Junyu Liu, Benji Peng, Sen Zhang, Xuanhe Pan, Jiawei Xu, Jinlang Wang, Keyu Chen, Caitlyn Heqi Yin, Pohsun Feng, Yizhu Wen, Tianyang Wang, Ming Li, Jintao Ren, Qian Niu, Xinyuan Song, Ming Liu

机构 * Zhejiang University(浙江大学) Indiana University(印第安纳大学) Kyoto University(京都大学) AppCubic Rutgers University(罗格斯大学) University of Wisconsin-Madison(威斯康星大学麦迪逊分校) Purdue University(普渡大学) Georgia Institute of Technology(佐治亚理工学院)

AI总结 本书通过Python语言,系统讲解机器学习和深度学习的基础理论与实践,涵盖数学基础、算法实现及大数据应用,帮助读者掌握AI开发的核心技能。

Comments 298 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19159 2025-12-23 cs.CV

OmniMoGen: Unifying Human Motion Generation via Learning from Interleaved Text-Motion Instructions

OmniMoGen:通过学习交错的文本-运动指令统一人类运动生成

Wendong Bu, Kaihang Pan, Yuze Lin, Jiacheng Li, Kai Shen, Wenqiao Zhang, Juncheng Li, Jun Xiao, Siliang Tang

机构 * Zhejiang University(浙江大学) HiThink Research(HiThink研究院)

AI总结 OmniMoGen通过学习交错的文本-运动指令,实现了人类运动生成的统一框架,展示了在文本到运动、运动编辑和AnyContext任务上的卓越性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19147 2025-12-23 cs.LG

RP-CATE: Recurrent Perceptron-based Channel Attention Transformer Encoder for Industrial Hybrid Modeling

基于递归感知机的通道注意力变换器编码器用于工业混合建模:RP-CATE

Haoran Yang, Yinan Zhang, Wenjie Zhang, Dongxia Wang, Peiyu Liu, Yuqi Ye, Kexin Chen, Wenhai Wang

机构 * Department of Control Science and Engineering, Zhejiang University(控制科学与工程系,浙江大学) Risk Department, Binance(Binance风险部)

AI总结 本文提出RP-CATE,通过引入通道注意力和递归感知机模块,提升工业混合建模的性能。

Comments 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19107 2025-12-23 cs.AI

FC-MIR: A Mobile Screen Awareness Framework for Intent-Aware Recommendation based on Frame-Compressed Multimodal Trajectory Reasoning

FC-MIR:一种基于帧压缩多模态轨迹推理的移动屏幕感知框架,用于意图感知推荐

Zhe Yang, Xiaoshuang Sheng, Zhengnan Zhang, Jidong Wu, Zexing Wang, Xin He, Shenghua Xu, Guanjing Xiong

机构 * vivo AI Lab(vivo人工智能实验室) Zhejiang University(浙江大学)

AI总结 FC-MIR框架通过帧压缩多模态轨迹推理,提升移动设备上意图感知推荐的效率与实用性,支持轻量级部署并探索生成操作与建议。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19103 2025-12-23 cs.LG cs.DC

Timely Parameter Updating in Over-the-Air Federated Learning

空中联邦学习中的及时参数更新

Jiaqi Zhu, Zhongyuan Zhao, Xiao Li, Ruihao Du, Shi Jin, Howard H. Yang

机构 * ZJU-UIUC Institute, Zhejiang University(浙江大学之江学院-伊利诺伊大学联合学院) School of Information Science and Engineering, Southeast University(东南大学信息科学与工程学院)

AI总结 FAIR-k算法通过平衡参数更新的及时性和重要性,提升空中联邦学习的收敛速度和通信效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19021 2025-12-23 cs.CV cs.RO

VLNVerse: A Benchmark for Vision-Language Navigation with Versatile, Embodied, Realistic Simulation and Evaluation

VLNVerse: 一个用于视觉语言导航的基准,具备多用途、具身体验、逼真模拟和评估

Sihao Lin, Zerui Li, Xunyi Zhao, Gengze Zhou, Liuyi Wang, Rong Wei, Rui Tang, Juncheng Li, Hanqing Wang, Jiangmiao Pang, Anton van den Hengel, Jiajun Liu, Qi Wu

机构 * Adelaide University(阿德莱德大学) Responsible AI Research Centre, Australian Institute for Machine Learning(负责任人工智能研究中心、澳大利亚机器学习研究所) Tongji University(同济大学) ManyCore Zhejiang University(浙江大学) Shanghai AI Lab(上海人工智能实验室) CSIRO Data61

AI总结 VLNVerse是一个大规模、可扩展的视觉语言导航基准,通过多用途、具身体验和逼真模拟提升导航任务的泛化能力与研究效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18635 2025-12-23 cs.CV

Uni-Neur2Img: Unified Neural Signal-Guided Image Generation, Editing, and Stylization via Diffusion Transformers

Uni-Neur2Img:通过扩散变换器实现神经信号引导的图像生成、编辑和风格化

Xiyue Bai, Ronghao Yu, Jia Xiu, Pengfei Zhou, Jie Xia, Peng Ji

机构 * Fudan University(复旦大学) Zhejiang University(浙江大学) National University of Singapore(新加坡国立大学)

AI总结 Uni-Neur2Img通过扩散变换器实现神经信号引导的图像生成、编辑和风格化,提供统一且高效的解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15553 2025-12-23 eess.IV cs.CV

Deep Equilibrium Convolutional Sparse Coding for Hyperspectral Image Denoising

深度均衡卷积稀疏编码用于超光谱图像去噪

Jin Ye, Jingran Wang, Fengchao Xiong, Jingzhou Chen, Yuntao Qian

机构 * School of Computer Science and Engineering, Nanjing University of Science and Technology(南京理工大学计算机科学与工程学院) College of Computer Science, Zhejiang University(浙江大学计算机科学学院)

AI总结 本文提出深度均衡卷积稀疏编码框架,通过统一局部空间-光谱相关性、非局部自相似性和全局一致性,提升超光谱图像去噪性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18947 2025-12-23 cs.CV

OpenHOI: Open-World Hand-Object Interaction Synthesis with Multimodal Large Language Model

OpenHOI: 基于多模态大语言模型的开放世界手-物体交互合成

Zhenhao Zhang, Ye Shi, Lingxiao Yang, Suting Ni, Qi Ye, Jingya Wang

机构 * ShanghaiTech University(上海科技大学) Zhejiang University(浙江大学)

AI总结 OpenHOI通过多模态大语言模型实现开放世界手-物体交互合成,能生成长周期操控序列并处理复杂语言指令。

Comments Accepted by NeurIPS 2025 as Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12489 2025-12-23 eess.AS cs.AI cs.MM

A Comprehensive Survey on Generative AI for Video-to-Music Generation

生成式AI在视频到音乐生成中的全面综述

Shulei Ji, Songruoyao Wu, Zihao Wang, Shuyu Li, Kejun Zhang

机构 * Zhejiang University(浙江大学) Innovation Center of Yangtze River Delta, Zhejiang University(长江三角洲创新中心) Carnegie Mellon University(卡内基梅隆大学)

AI总结 本文综述了生成式AI在视频到音乐生成中的关键技术和方法,分析了输入构造、条件机制和音乐生成框架,并总结了现有数据集和评估指标及面临的挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18386 2025-12-23 cs.CV

RecurGS: Interactive Scene Modeling via Discrete-State Recurrent Gaussian Fusion

RecurGS: 通过离散状态递归高斯融合实现交互式场景建模

Wenhao Hu, Haonan Zhou, Zesheng Li, Liu Liu, Jiacheng Dong, Zhizhong Su, Gaoang Wang

机构 * Zhejiang University(浙江大学) Horizon Robotics Nanyang Technological University(南洋理工大学)

AI总结 RecurGS通过递归融合框架实现离散状态的交互式场景建模,提升3D环境的更新效率和逼真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18228 2025-12-23 cs.SE cs.LG

Toward Efficient Testing of Graph Neural Networks via Test Input Prioritization

通过测试输入优先级提升图神经网络的效率

Lichen Yang, Qiang Wang, Zhonghao Yang, Daojing He, Yu Li

机构 * Computer Science and Technology(计算机科学与技术) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) Integrated Circuits(集成电路) Zhejiang University(浙江大学) Software Engineering Institute(软件工程研究所) East China Normal University(华东师范大学)

AI总结 GraphRank通过引入模型无关属性和图结构信息,提升图神经网络测试输入优先级的效率和准确性。

Comments This is the author-accepted manuscript of a paper published in Automated Software Engineering Journal

Journal ref Autom Softw Eng 33, 14 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01298 2025-12-23 cs.CV cs.AI

Towards Enhanced Image Generation Via Multi-modal Chain of Thought in Unified Generative Models

通过统一生成模型中的多模态推理链提升图像生成

Yi Wang, Mushui Liu, Wanggui He, Hanyang Yuan, Longxiang Zhang, Ziwei Huang, Guanghao Zhang, Wenkai Fang, Haoze Jiang, Shengxuming Zhang, Dong She, Jinlong Liu, Weilong Dai, Mingli Song, Hao Jiang, Jie Song

机构 * Zhejiang University(浙江大学) Alibaba Group(阿里巴巴集团)

AI总结 本文通过引入多模态推理链提升统一生成模型的复杂图像生成能力,提出FoXperts架构和MCoT方法,实现更高效的多模态生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17702 2025-12-22 cs.LG

MolMark: Safeguarding Molecular Structures through Learnable Atom-Level Watermarking

MolMark:通过可学习的原子级水印保障分子结构

Runwen Hu, Peilin Chen, Keyan Ding, Shiqi Wang

机构 * Department of Computer Science, City University of Hong Kong(香港城市大学计算机科学系) ZJU-Hangzhou Global Scientific and Technological Innovation Center, Zhejiang University(浙江大学杭州全球科技创新中心)

AI总结 MolMark通过可学习的原子级水印技术,为分子生成提供保护,确保分子结构的可验证性和可追溯性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17349 2025-12-22 cs.RO

Flying in Clutter on Monocular RGB by Learning in 3D Radiance Fields with Domain Adaptation

在仅用单目RGB图像中飞行的 clutter 问题通过学习3D辐射场并进行域适应

Xijie Huang, Jinhan Li, Tianyue Wu, Xin Zhou, Zhichao Han, Fei Gao

机构 * State Key Laboratory of Industrial Control Technology, Zhejiang University, Hangzhou 310027, China(浙江大学工业控制技术状态重点实验室) Differential Robotics, Hangzhou 311121, China(差异机器人技术)

AI总结 本文提出通过学习3D辐射场并结合域适应,使飞行机器人在仅使用单目RGB图像的情况下实现鲁棒的零样本迁移,以应对 clutter 和光照变化的挑战。

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17206 2025-12-22 cs.CV

Reasoning Palette: Modulating Reasoning via Latent Contextualization for Controllable Exploration for (V)LMs

推理调色板:通过潜在上下文化调节推理以实现可控探索用于(V)LMs

Rujiao Long, Yang Li, Xingyao Zhang, Weixun Wang, Tianqianjin Lin, Xi Zhao, Yuchi Xu, Wenbo Su, Junchi Yan, Bo Zheng

机构 * Alibaba Group(阿里巴巴集团) Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学)

AI总结 Reasoning Palette通过引入潜在变量调节模型推理策略,提升可控探索和持续学习能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19041 2025-12-22 cs.CL cs.AI cs.CV cs.LG cs.MM

LookAhead Tuning: Safer Language Models via Partial Answer Previews

LookAhead Tuning: 通过部分答案预览实现更安全的语言模型

Kangwei Liu, Mengru Wang, Yujie Luo, Lin Yuan, Mengshu Sun, Lei Liang, Zhiqiang Zhang, Jun Zhou, Bryan Hooi, Shumin Deng

机构 * Zhejiang University(浙江大学) Zhejiang University - Ant Group Joint Laboratory of Knowledge Graph(浙江大学-蚂蚁集团知识图谱联合实验室) Ant Group(蚂蚁集团) National University of Singapore(新加坡国立大学)

AI总结 LookAhead Tuning通过预览部分答案前缀,有效保持语言模型在微调过程中的安全性,同时不损害下游任务的性能。

Comments WSDM 2026 short

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00946 2025-12-19 cs.CL cs.AI

Fine-tuning of lightweight large language models for sentiment classification on heterogeneous financial textual data

轻量级大语言模型在异构金融文本数据上的情感分类微调

Alvaro Paredes Amorin, Andre Python, Christoph Weisser

机构 * International Business School, Zhejiang University(浙江大学国际商务学院) Center for Data Science, Zhejiang University(浙江大学数据科学中心) Centre for Statistics, Georg-August-Universität Göttingen(哥廷根大学统计中心)

AI总结 本研究探讨了轻量级开源大语言模型在异构金融文本数据上的情感分类微调效果,发现Qwen3 8B和Llama3 8B在有限数据下表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15766 2025-12-19 cs.PL cs.AI cs.DC cs.PF

LOOPRAG: Enhancing Loop Transformation Optimization with Retrieval-Augmented Large Language Models

LOOPRAG:通过检索增强的大语言模型增强循环变换优化

Yijie Zhi, Yayu Cao, Jianhua Dai, Xiaoyang Han, Jingwen Pu, Qingran Wu, Sheng Cheng, Ming Cai

机构 * Zhejiang University(浙江大学) Zhejiang Institute of Administration(浙江行政研究院) Beijing ShenZhou Aerospace Software Technology Ltd.(北京神舟航天软件技术有限公司)

AI总结 LOOPRAG通过检索增强大语言模型提升循环变换优化效率,实现代码生成的准确性和性能提升。

Comments Accepted to ASPLOS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏