arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Zhejiang University(浙江大学)

共收录 2931
2510.24592 2026-02-11 cs.CL

ReForm: Reflective Autoformalization with Prospective Bounded Sequence Optimization

ReForm:具有前瞻性有界序列优化的反思自动形式化

Guoxin Chen, Jing Wu, Xinjie Chen, Wayne Xin Zhao, Ruihua Song, Chengxi Li, Kai Fan, Dayiheng Liu, Minpeng Liao

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院) Tongyi Lab, Alibaba Group(阿里巴巴集团通义实验室) Zhejiang University(浙江大学) Beijing Key Laboratory of Research on Large Models and Intelligent Governance(北京大模型与智能治理重点实验室)

AI总结 ReForm通过整合语义一致性评估和前瞻性有界序列优化,提升自动形式化任务的准确性和语义保真度,实验表明其在四个基准上的性能提升了22.6个百分点。

Comments Camera Ready version for ICLR 2026. Code: https://github.com/Chen-GX/ReForm

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09022 2026-02-10 cs.CV

WorldCompass: Reinforcement Learning for Long-Horizon World Models

WorldCompass:用于长周期世界模型的强化学习

Zehan Wang, Tengfei Wang, Haiyu Zhang, Xuhui Zuo, Junta Wu, Haoyuan Wang, Wenqiang Sun, Zhenwei Wang, Chenjie Cao, Hengshuang Zhao, Chunchao Guo, Zhou Zhao

机构 * Zhejiang University(浙江大学) Tencent Hunyuan(腾讯混元) The University of Hong Kong(香港大学)

AI总结 WorldCompass通过三种创新提升长周期世界模型的交互准确性和视觉保真度。

Comments Project page: \url{https://3d-models.hunyuan.tencent.com/world/}

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08599 2026-02-10 cs.RO

A Precise Real-Time Force-Aware Grasping System for Robust Aerial Manipulation

一种精确的实时力感知抓取系统用于稳健的空中 manipulation

Kenghou Hoi, Yuze Wu, Annan Ding, Junjie Wang, Anke Zhao, Chengqian Zhang, Fei Gao

机构 * State Key Laboratory of Industrial Control Technology, Zhejiang University(浙江大学工业控制技术状态重点实验室) Huzhou Institute, Zhejiang University(浙江大学湖州研究院) State Key Laboratory of Fluid Power and Mechatronic Systems, School of Mechanical Engineering, Zhejiang University(浙江大学流体动力与机械系统状态重点实验室) Zhejiang Key Laboratory of Additive Manufacturing Technology and Equipment, School of Mechanical Engineering, Zhejiang University(浙江省增材制造技术与装备重点实验室)

AI总结 本文提出了一种低成本力感知抓取系统,通过磁性触觉传感模块实现高精度力测量,用于稳健的空中 manipulation。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08584 2026-02-10 cs.LG

Conditional Sequence Modeling for Safe Reinforcement Learning

基于条件序列建模的安全强化学习

Wensong Bai, Chao Zhang, Qihang Xu, Chufan Chen, Chenhao Zhou, Hui Qian

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) Advanced Technology Institute, Zhejiang University(浙江大学先进技术研究院)

AI总结 RCDT是一种基于条件序列建模的离线安全强化学习方法,通过集成Lagrangian风格的成本惩罚与自适应惩罚系数,实现跨多个成本阈值的零样本部署,并在DSRL基准上提升了回报-成本权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08582 2026-02-10 cs.CV

SemiNFT: Learning to Transfer Presets from Imitation to Appreciation via Hybrid-Sample Reinforcement Learning

SemiNFT: 通过混合样本强化学习从模仿到欣赏学习转移预设

Melany Yang, Yuhang Yu, Diwang Weng, Jinwei Chen, Wei Dong

机构 * vivo Mobile Communication Co. Ltd(vivo移动通信有限公司) Zhejiang University(浙江大学)

AI总结 SemiNFT通过混合样本强化学习从模仿到欣赏学习,实现更高级的审美理解与色彩润色能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08259 2026-02-10 stat.ML cs.LG

A Statistical Framework for Alignment with Biased AI Feedback

带有偏见AI反馈的统计框架

Xintao Xia, Zhiqiu Xia, Linjun Zhang, Zhanrui Cai

机构 * Center for Data Science, Zhejiang University(浙江大学数据科学中心) Department of Electrical and Computer Engineering, Rutgers University(罗格斯大学电气与计算机工程系) Department of Statistics, Rutgers University(罗格斯大学统计学系) Faculty of Business and Economics, The University of Hong Kong(香港大学商学院)

AI总结 本文提出两种去偏对齐方法,DDPO通过残差修正和密度比重加权提升效率,DIPO直接估计人类偏好概率,实验证明其在情感生成、摘要和对话任务中提升了对齐效率并接近全人类标注数据性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08229 2026-02-10 cs.AI cs.CR cs.LG

InfiCoEvalChain: A Blockchain-Based Decentralized Framework for Collaborative LLM Evaluation

InfiCoEvalChain: 一种基于区块链的去中心化框架用于协作大语言模型评估

Yifan Yang, Jinjia Li, Kunxi Li, Puhao Zheng, Yuanyi Wang, Zheyan Qu, Yang Yu, Jianmin Wu, Ming Li, Hongxia Yang

机构 * The Hong Kong Polytechnic University(香港理工大学) Zhejiang University(浙江大学)

AI总结 InfiCoEvalChain提出一种基于区块链的去中心化框架,通过大规模基准测试和集体验证,提升大语言模型评估的稳定性和代表性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01227 2026-02-10 cs.CL cs.AI cs.LG

Supervised Fine-Tuning Needs to Unlock the Potential of Token Priority

监督微调需要解锁标记优先的潜力

Zhanming Shen, Zeyu Qin, Jiaqi Hu, Wentao Ye, Hao Chen, Xiaomeng Hu, Haokai Xu, Gang Chen, Yi R. Fung, Haobo Wang

机构 * Zhejiang University(浙江大学) Hong Kong University of Science and Technology(香港科学与技术大学)

AI总结 本文提出标记优先作为监督微调的关键桥梁,通过分布重塑过程实现数据与理想对齐流形的匹配,并分析了噪声过滤和有毒模式卸载两种不同的研究领域。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14042 2026-02-10 cs.CV cs.LG

Federated Balanced Learning

联邦平衡学习

Jiaze Li, Haoran Xu, Wanyi Wu, Changwei Wang, Shuaiguang Li, Jianzhong Ju, Zhenbo Luo, Jian Luan, Youyang Qu, Longxiang Gao, Xudong Yang, Lumin Xing

机构 * MiLM Plus of Xiaomi Inc.(小米公司MiLM Plus部门) Zhejiang University(浙江大学) Shandong University(山东大学) Shandong Provincial Key Laboratory of Computing Power Internet and Service Computing(山东省计算能力互联网与服务计算重点实验室) Shandong Fundamental Research Center for Computer Science(山东省计算机科学基础研究中心) Shandong Key Laboratory of Digital diagnosis and Treatment of Thoracic Oncology(山东省胸部肿瘤数字诊断与治疗重点实验室) The First Affiliated Hospital of Shandong First Medical University(山东第一医科大学第一附属医院) Shandong Provincial Qianfoshan Hospital(山东省青岛浮山医院) Shandong Engineering Research Center of Intelligent Surgery(山东省智能手术工程研究中心) Qilu University of Technology (Shandong Academy of Sciences) Youth Outstanding Talent Program(齐鲁工业大学(山东省科学院)青年优秀人才计划)

AI总结 本文提出联邦平衡学习(FBL),通过客户端侧样本平衡和知识填充策略,解决非独立同分布环境下联邦学习中的客户端漂移问题,提升模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05599 2026-02-10 cs.CV

WeTok: Powerful Discrete Tokenization for High-Fidelity Visual Reconstruction

WeTok:强大的离散分词用于高保真的视觉重建

Shaobin Zhuang, Yiwei Guo, Canmiao Fu, Zhipeng Huang, Zeyue Tian, Xiaohui Li, Fangyikang Wang, Ying Zhang, Chen Li, Yali Wang

机构 * Shanghai Jiao Tong University(上海交通大学) WeChat Vision, Tencent Inc.(腾讯微信视觉部门) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究所) Hong Kong University of Science and Technology(香港科学大学) Zhejiang University(浙江大学) Shanghai AI Laboratory(上海人工智能实验室)

AI总结 WeTok通过GQ和GD创新实现高保真视觉重建,以更高效的压缩率和更优的重建质量在ImageNet上取得突破。

Comments 32 pages, 15 figures, 39 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04747 2026-02-10 q-bio.GN cs.LG

GRIT: Graph-Regularized Logit Refinement for Zero-shot Cell Type Annotation

GRIT:图正则化逻辑细化用于零样本细胞类型注释

Tianxiang Hu, Chenyi Zhou, Jiaxiang Liu, Jiongxin Wang, Ruizhe Chen, Haoxiang Xia, Gaoang Wang, Jian Wu, Zuozhu Liu

机构 * Zhejiang University(浙江大学) Guangdong Institute of Intelligence Science and Technology(广东智能科学与技术研究院)

AI总结 GRIT通过图正则化逻辑细化提升零样本细胞类型注释的准确性,结合预训练模型的可扩展性与人类专家注释的结构鲁棒性。

Comments 10 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20487 2026-02-10 cs.RO

A Survey of Behavior Foundation Model: Next-Generation Whole-Body Control System of Humanoid Robots

人形机器人行为基础模型综述:下一代全身体控系统

Mingqi Yuan, Tao Yu, Wenqi Ge, Xiuyong Yao, Huijiang Wang, Jiayu Chen, Bo Li, Wei Zhang, Wenjun Zeng, Hua Chen, Xin Jin

机构 * Department of Computing, The Hong Kong Polytechnic University(香港理工大学计算机系) LimX Dynamics Ningbo Institute of Digital Twin, Eastern Institute of Technology(宁波数字孪生研究院、东部技术研究所) Department of Data and Systems Engineering, The University of Hong Kong(香港大学数据与系统工程系) CREATE Lab, EPFL(EPFL CREATE 实验室) School of System Design and Intelligent Manufacturing, Southern University of Science and Technology(南方科技大学系统设计与智能制造学院) ZJU-UIUC Institute, Zhejiang University(浙江大学ZJU-UIUC研究院) INFIFORCE Intelligent Technology Co., Ltd.(INFIFORCE智能科技有限公司)

AI总结 本文综述了人形机器人全身体控中行为基础模型的发展,探讨了其在复杂任务中的应用及未来研究方向。

Comments 19 pages, 10 figures

Journal ref IEEE TRANSACTIONS ON PATTERN ANALYSIS AND MACHINE INTELLIGENCE, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10734 2026-02-10 cs.CV

OmniHD-Scenes: A Next-Generation Multimodal Dataset for Autonomous Driving

OmniHD-Scenes:面向自动驾驶的下一代多模态数据集

Lianqing Zheng, Long Yang, Qunshu Lin, Wenjin Ai, Minghao Liu, Shouyi Lu, Jianan Liu, Hongze Ren, Jingyue Mo, Xiaokai Bai, Jie Bai, Zhixiong Ma, Xichan Zhu

机构 * School of Automotive Studies, Tongji University(同济大学汽车学院) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) AI Foundation(2077AI基金会) Momoni AI College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息科学与电子工程学院) School of Information and Electrical Engineering, Hangzhou City University(杭州城市学院信息与电气工程学院)

AI总结 OmniHD-Scenes提出了一种大规模多模态数据集,结合多种传感器数据,用于提升自动驾驶的3D检测和语义预测性能。

Comments Accepted by IEEE TPAMI

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08068 2026-02-10 cs.CV

ReRoPE: Repurposing RoPE for Relative Camera Control

ReRoPE:将RoPE用于相对相机控制

Chunyang Li, Yuanbo Yang, Jiahao Shao, Hongyu Zhou, Katja Schwarz, Yiyi Liao

机构 * Zhejiang University(浙江大学) Independent Researcher(独立研究者)

AI总结 ReRoPE通过将RoPE用于相对相机控制,实现可控视频生成,提升生成质量与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07891 2026-02-10 cs.CV cs.AI

Scalable Adaptation of 3D Geometric Foundation Models via Weak Supervision from Internet Video

通过互联网视频弱监督实现3D几何基础模型的可扩展适应

Zihui Gao, Ke Liu, Donny Y. Chen, Duochao Shi, Guosheng Lin, Hao Chen, Chunhua Shen

机构 * Zhejiang University, State Key Lab of CAD \& CG Nanyang Technological University Independent Researcher Zhejiang University of Technology

AI总结 SAGE通过互联网视频弱监督实现几何基础模型的可扩展适应,提升零样本泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07878 2026-02-10 cs.CR cs.AI

Rethinking Latency Denial-of-Service: Attacking the LLM Serving Framework, Not the Model

重新审视延迟拒绝服务:攻击LLM服务框架,而非模型

Tianyi Wang, Huawei Fan, Yuanchao Shu, Peng Cheng, Cong Wang

机构 * Zhejiang University(浙江大学)

AI总结 本文提出Fill和Squeeze攻击策略,通过影响调度器状态转换,攻击LLM服务框架而非模型,降低攻击成本并造成显著延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07804 2026-02-10 cs.CL cs.AI

Pruning as a Cooperative Game: Surrogate-Assisted Layer Contribution Estimation for Large Language Models

剪枝作为合作博弈:用于大型语言模型的代理辅助层贡献估计

Xuan Ding, Pengyu Tong, Ranjie Duan, Yunjian Zhang, Rui Sun, Yao Zhu

机构 * Shenzhen Future Network of Intelligence Institute(深圳未来网络智能研究院) Guangdong Provincial Key Laboratory of Future Networks of Intelligence(广东省未来网络智能重点实验室) The Chinese University of Hong Kong (Shenzhen)(香港中文大学(深圳)) Beijing Normal University(北京师范大学) Alibaba Group(阿里巴巴集团) University of Chinese Academy of Sciences(中国科学院大学) Zhejiang University(浙江大学)

AI总结 本文提出基于博弈论的层剪枝方法,利用代理网络估计层贡献,实现高效且有效的大型语言模型剪枝。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05325 2026-02-10 cs.RO

RoboPaint: From Human Demonstration to Any Robot and Any View

RoboPaint:从人类示范到任何机器人和任何视角

Jiacheng Fan, Zhiyue Zhao, Yiqian Zhang, Chao Chen, Peide Wang, Hengdi Zhang, Zhengxue Cheng

机构 * Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学)

AI总结 RoboPaint通过真实-仿真-真实数据流程,将人类示范转化为机器人训练数据,实现高效、低成本的复杂灵巧操作训练。

Comments 17 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05132 2026-02-10 cs.CV cs.AI

Breaking Scale Anchoring: Frequency Representation Learning for Accurate High-Resolution Inference from Low-Resolution Training

打破尺度锚定:用于从低分辨率训练准确进行高分辨率推断的频率表示学习

Wenshuo Wang, Fan Zhang

机构 * School of Future Technology, South China University of Technology, China(未来技术学院,华南理工大学,中国) State Key Laboratory of Ocean Sensing & Ocean College, Zhejiang University, China(海洋感知国家重点实验室,浙江大学,中国) Kavli Institute for Astrophysics and Space Research, Massachusetts Institute of Technology, USA(天体物理与空间研究所,麻省理工学院,美国)

AI总结 本文提出了一种架构无关的频率表示学习方法,通过分辨率对齐的频率表示和频谱一致性训练,解决尺度锚定问题,提升高分辨率推断的准确性。

Comments Accepted as a poster paper at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18715 2026-02-10 cs.AI

HuggingR$^{4}$: A Progressive Reasoning Framework for Discovering Optimal Model Companions

HuggingR$^{4}$: 一种用于发现最优模型伙伴的渐进推理框架

Shaoyin Ma, Chenggong Hu, Huiqiong Wang, Li Sun, Mingli Song, Jie Song

机构 * Zhejiang University, Hangzhou, China(浙江大学)

AI总结 HuggingR$^4$通过渐进推理框架提升模型选择效率,实现更高的可行性与合理性,同时降低token消耗。

Comments 21 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16729 2026-02-10 cs.CV

Vision-Centric 4D Occupancy Forecasting and Planning via Implicit Residual World Models

基于隐式残差世界模型的视觉导向4D占用预测与规划

Jianbiao Mei, Yu Yang, Xuemeng Yang, Licheng Wen, Jiajun Lv, Botian Shi, Yong Liu

机构 * Zhejiang University(浙江大学) Shanghai AI Laboratory(上海人工智能实验室)

AI总结 本文提出IR-WM,通过隐式残差世界模型提升自动驾驶中的4D占用预测与轨迹规划精度。

Comments ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17307 2026-02-10 cs.LG cs.AI cs.CL

R-Stitch: Dynamic Trajectory Stitching for Efficient Reasoning

R-Stitch:动态轨迹拼接以实现高效的推理

Zhuokun Chen, Zeren Chen, Jiahao He, Lu Sheng, Mingkui Tan, Jianfei Cai, Bohan Zhuang

机构 * Monash University, Australia(墨尔本大学,澳大利亚) School of Software, Beihang University, China(北航软件学院,中国) South China University of Technology, China(华南理工大学,中国) ZIP Lab, Zhejiang University, China(浙江大学ZIP实验室,中国)

AI总结 R-Stitch通过熵引导的混合解码框架,实现高效推理,减少计算成本并保持精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07103 2026-02-10 q-bio.QM cs.AI

scDFM: Distributional Flow Matching Model for Robust Single-Cell Perturbation Prediction

scDFM:用于鲁棒单细胞扰动预测的分布流匹配模型

Chenglei Yu, Chuanrui Wang, Bangyan Liao, Tailin Wu

机构 * Zhejiang University(浙江大学) Department of Artificial Intelligence, School of Engineering, Westlake University(人工智能系,工程学院,西湖大学)

AI总结 scDFM通过分布级生成建模提升单细胞扰动预测的鲁棒性,结合流匹配与PAD-Transformer架构,在多个基准测试中实现更优性能。

Comments ICLR 2026 poster, 25 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07095 2026-02-10 cs.CV cs.AI

WorldEdit: Towards Open-World Image Editing with a Knowledge-Informed Benchmark

WorldEdit: 向开放世界图像编辑迈进的基于知识的基准

Wang Lin, Feng Wang, Majun Zhang, Wentao Hu, Tao Jin, Zhou Zhao, Fei Wu, Jingyuan Chen, Alan Yuille, Sucheng Ren

机构 * Zhejiang University(浙江大学) Johns Hopkins University(约翰霍普金斯大学) Nanyang Technological University(南洋理工大学)

AI总结 WorldEdit通过引入基于知识的基准,提升模型在开放世界图像编辑中对隐式指令的理解和处理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06994 2026-02-10 q-bio.NC cs.AI cs.CV

SurfAge-Net: A Hierarchical Surface-Based Network for Interpretable Fine-Grained Brain Age Prediction

SurfAge-Net:一种基于层次表面的网络用于可解释的细粒度脑年龄预测

Rongzhao He, Dalin Zhu, Ying Wang, Songhong Yue, Leilei Zhao, Yu Fu, Dan Wu, Bin Hu, Weihao Zheng

机构 * Gansu Provincial Key Laboratory of Wearable Computing, School of Information Science and Engineering, Lanzhou University(甘肃省可穿戴计算重点实验室,信息科学与工程学院,兰州大学) Department of Medical Imaging Center, Gansu Provincial Maternity and Child-Care Hospital(医学影像中心,甘肃省妇幼保健院) Department of Magnetic Resonance, Lanzhou University Second Hospital(磁共振科,兰州大学第二医院) Department of Computer Science and Technology, Harbin Institute of Technology (Shenzhen)(计算机科学与技术系,哈尔滨工业大学(深圳)) Key Laboratory for Biomedical Engineering of Ministry of Education, Department of Biomedical Engineering, College of Biomedical Engineering & Instrument Science, Zhejiang University(教育部生物医学工程重点实验室,生物医学工程学院,浙江大学)

AI总结 SurfAge-Net通过结合皮层组织的连接组原理,提出了一种基于层次表面的网络,用于可解释的细粒度脑年龄预测,有效识别异常发育人群中的异质延迟和区域特定异常。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06959 2026-02-09 cs.CV

CineScene: Implicit 3D as Effective Scene Representation for Cinematic Video Generation

CineScene:隐式3D作为电影视频生成的有效场景表示

Kaiyi Huang, Yukun Huang, Yu Li, Jianhong Bai, Xintao Wang, Zinan Lin, Xuefei Ning, Jiwen Yu, Pengfei Wan, Yu Wang, Xihui Liu

机构 * The University of Hong Kong(香港大学) Kling Team, Kuaishou Technology(快手技术 Kling 团队) Tsinghua University(清华大学) Zhejiang University(浙江大学) Microsoft Research Project Page(微软研究院项目页面)

AI总结 CineScene通过隐式3D场景表示实现电影视频生成,能生成动态主体且保持场景一致的高质量视频。

Comments Project website: https://karine-huang.github.io/CineScene/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03048 2026-02-09 cs.LG cs.AI

CoBA-RL: Capability-Oriented Budget Allocation for Reinforcement Learning in LLMs

CoBA-RL:面向大语言模型强化学习的基于能力的预算分配

Zhiyuan Yao, Yi-Kai Zhang, Yuxin Chen, Yueqing Sun, Zishan Xu, Yu Yang, Tianhao Hu, Qi Gu, Hui Su, Xunliang Cai

机构 * Zhejiang University(浙江大学) Nanjing University(南京大学) National University of Singapore(新加坡国立大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 CoBA-RL通过基于能力的价值函数和堆贪心策略,优化大语言模型强化学习中的预算分配,提升训练效率和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01539 2026-02-09 cs.AI cs.CL cs.LG cs.MA

MAGIC: A Co-Evolving Attacker-Defender Adversarial Game for Robust LLM Safety

MAGIC: 一种共进化攻击者-防御者对抗游戏用于鲁棒大语言模型安全

Xiaoyu Wen, Zhida He, Han Qi, Ziyu Wan, Zhongtian Ma, Ying Wen, Tianhang Zheng, Xingcheng Xu, Chaochao Lu, Qiaosheng Zhang

机构 * Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学)

AI总结 MAGIC通过共进化对抗游戏提升大语言模型的安全性,攻击者与防御者智能体在多轮强化学习中相互演化,有效识别并抵御未知攻击模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16690 2026-02-09 cs.CV

Spectral Compressive Imaging via Chromaticity-Intensity Decomposition

通过色度-强度分解实现光谱压缩成像

Xiaodong Wang, Zijun He, Ping Wang, Lishun Wang, Yanan Hu, Xin Yuan

机构 * Zhejiang University(浙江大学) School of Engineering, Westlake University(西湖大学工程学院) Chengdu Institute of Biology, Chinese Academy of Sciences(中国科学院成都生物研究所)

AI总结 本文提出了一种色度-强度分解框架,通过双相机CASSI系统实现超光谱图像的高效重建,结合混合Transformer和噪声估计模块,提升光谱和色度保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05017 2026-02-09 cs.CL

Scalable Multi-Stage Influence Function for Large Language Models via Eigenvalue-Corrected Kronecker-Factored Parameterization

通过特征值校正的克罗内克因子化参数化实现大规模语言模型的可扩展多阶段影响函数

Yuntai Bao, Xuhong Zhang, Tianyu Du, Xinkui Zhao, Jiang Zong, Hao Peng, Jianwei Yin

机构 * Zhejiang University(浙江大学) Universal Identification Technology (Hangzhou) Co.,Ltd.(universal identification technology (hangzhou) co., ltd.) Zhejiang Normal University(浙江师范大学)

AI总结 本文提出了一种基于特征值校正的克罗内克因子化参数化的多阶段影响函数,用于解释大规模语言模型在微调后的预测归因于预训练数据,展示了其在大规模模型中的可扩展性和解释能力。

Comments 17 pages, 4 figures; accepted by IJCAI 2025

Journal ref Proceedings of the Thirty-Fourth International Joint Conference on Artificial Intelligence Main Track (2025) 8022-8030

详情

展开后加载摘要…

URL PDF HTML 收藏