arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Tsinghua University(清华大学)

共收录 4556
2404.19026 2026-02-20 cs.CV

MeGA: Hybrid Mesh-Gaussian Head Avatar for High-Fidelity Rendering and Head Editing

MeGA: 混合网格-高斯头像用于高保真渲染和头像编辑

Cong Wang, Di Kang, He-Yi Sun, Shen-Han Qian, Zi-Xuan Wang, Linchao Bao, Song-Hai Zhang

机构 * Tsinghua University(清华大学) Tencent(腾讯) Technical University of Munich(慕尼黑技术大学) Carnegie Mellon University(卡内基梅隆大学)

AI总结 MeGA通过混合网格和高斯表示,实现高保真头像渲染与编辑,提升面部和头发的细节与真实感。

Comments Accepted by CVPR 2025. Project page: https://conallwang.github.io/MeGA_Pages/

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.12217 2026-02-20 cs.CV

LoLep: Single-View View Synthesis with Locally-Learned Planes and Self-Attention Occlusion Inference

LoLep:单视角视图合成与局部学习平面及自注意力遮挡推断

Cong Wang, Yu-Ping Wang, Dinesh Manocha

机构 * Tsinghua University(清华大学) The Beijing Institute of Technology(北京理工大学) University of Maryland(马里兰大学)

AI总结 LoLep通过局部学习平面和自注意力机制实现单视角视图合成,有效提升遮挡推断和生成质量。

Comments Accepted by ICCV 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.05000 2026-02-20 cs.CV

Neural Point-based Volumetric Avatar: Surface-guided Neural Points for Efficient and Photorealistic Volumetric Head Avatar

神经点基体积人像:基于表面的神经点用于高效且逼真的人体体积头人像

Cong Wang, Di Kang, Yan-Pei Cao, Linchao Bao, Ying Shan, Song-Hai Zhang

机构 * Tsinghua University, Tencent AI Lab(清华大学) Tencent AI Lab(腾讯AI实验室) Tsinghua University(清华大学)

AI总结 本文提出了一种基于神经点的体积人像方法,通过高分辨率UV位移图约束神经点,提升建模能力和表达控制精度,有效处理复杂面部区域。

Comments Accepted by SIGGRAPH Asia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.06768 2026-02-20 cs.CV cs.RO

MotionHint: Self-Supervised Monocular Visual Odometry with Motion Constraints

MotionHint: 基于运动约束的自监督单目视觉里程计

Cong Wang, Yu-Ping Wang, Dinesh Manocha

机构 * Department of Computer Science and Technology, Tsinghua University(计算机科学与技术系,清华大学)

AI总结 MotionHint通过引入运动约束模型,提升单目视觉里程计的精度,减少ATE误差达28.73%

Comments Accepted by ICRA 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16681 2026-02-19 cs.CV

VETime: Vision Enhanced Zero-Shot Time Series Anomaly Detection

VETime: 基于视觉增强的零样本时间序列异常检测

Yingyuan Yang, Tian Lan, Yifei Gao, Yimeng Lu, Wenjun He, Meng Wang, Chenghao Liu, Chen Zhang

机构 * Department of Industrial Engineering, Tsinghua University, Beijing, China(清华大学工业工程系) Lab, Huawei Technologies Ltd, Beijing, China(华为技术有限公司2012实验室) Datadog AI Research(Datadog人工智能研究)

AI总结 VETime通过融合视觉与时间模态,提出零样本时间序列异常检测框架,实现高精度定位与低计算开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16603 2026-02-19 cs.DC cs.AI

FlowPrefill: Decoupling Preemption from Prefill Scheduling Granularity to Mitigate Head-of-Line Blocking in LLM Serving

FlowPrefill: 解耦预emption与prefill调度粒度以缓解LLM服务中的头部阻塞

Chia-chi Hsieh, Zan Zong, Xinyang Chen, Jianjiang Li, Jidong Zhai, Lijie Wen

机构 * Tsinghua University(清华大学) University of Science and Technology Beijing(北京科技大学)

AI总结 FlowPrefill通过解耦预emption与调度粒度,优化TTFT和吞吐量,缓解LLM服务中的头部阻塞问题。

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22237 2026-02-19 cs.CL cs.AI cs.SE

FeatBench: Towards More Realistic Evaluation of Feature-level Code Generation

FeatBench: 向更真实的特征级代码生成评估迈进

Haorui Chen, Chengze Li, Jia Li

机构 * College of AI, Tsinghua University(清华大学人工智能学院) University of Electronic Science and Technology of China(电子科技大学) Nanjing University(南京大学)

AI总结 FeatBench提出了一种新的特征级代码生成评估基准,通过真实任务输入和动态数据构建,解决现有基准的局限性,并揭示了代理在实现中的激进行为问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.08963 2026-02-19 cs.LG

Modeling Time-evolving Causality over Data Streams

对数据流中时间演变因果关系的建模

Naoki Chihara, Yasuko Matsubara, Ren Fujiwara, Yasushi Sakurai

机构 * SANKEN, Osaka University(SANKEN,大阪大学) Institute for Clarity in Documentation(文档清晰研究所) Inria Paris-Rocquencourt(巴黎-鲁克勒特研究所) Rajiv Gandhi University(拉贾·甘地大学) Tsinghua University(清华大学) Palmer Research Laboratories(帕勒姆研究实验室)

AI总结 本文提出ModePlait方法,用于建模数据流中时间演变的因果关系,并通过实验验证其在发现因果关系和预测未来值方面的有效性。

Comments Accepted by KDD'25

Journal ref The 31st ACM SIGKDD international conference on Knowledge discovery and data mining, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15961 2026-02-19 cs.LG

R$^2$Energy: A Large-Scale Benchmark for Robust Renewable Energy Forecasting under Diverse and Extreme Conditions

R²能量:一种大规模基准,用于在多样和极端条件下鲁棒的可再生能源预测

Zhi Sheng, Yuan Yuan, Guozhen Zhang, Yong Li

机构 * Center for Urban Science and Computation, Tsinghua University(城市科学与计算中心,清华大学) Courant Institute of Mathematical Sciences, New York University(数学科学学院,纽约大学)

AI总结 R²Energy提出了一种大规模基准,用于在多样和极端条件下评估鲁棒的可再生能源预测模型,揭示了鲁棒性与复杂性之间的权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15901 2026-02-19 cs.RO

Coverage Path Planning for Autonomous Sailboats in Inhomogeneous and Time-Varying Oceans: A Spatiotemporal Optimization Approach

自主帆船在非均匀和时变海洋中的覆盖路径规划:一种时空优化方法

Yang An, Zhikang Ge, Taiyu Zhang, Jean-Baptiste R. G. Souppez, Gaofei Xu, Zhengru Ren

机构 * Institute of Deep-sea Science and Engineering, Chinese Academy of Sciences(中国科学院深海科学与工程研究所) Institute for Ocean Engineering, Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院海洋工程研究所) ZJU-Hangzhou Global Scientific and Technological Innovation Center, Zhejiang University(浙江大学 Hangzhou 全球科技创新中心) Department of Engineering, Faculty of Computing, Engineering and the Built Environment, Birmingham City University(伯明翰城市大学工程系) School of Ocean and Civil Engineering, Shanghai Jiao Tong University(上海交通大学海洋与Civil Engineering学院)

AI总结 本文提出了一种专为自主帆船设计的时空优化方法,解决非均匀和时变海洋环境中的覆盖路径规划问题,通过空间拓扑约束和时间预测规划提升覆盖效率。

Comments 12 pages, 9 figures. This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15882 2026-02-19 cs.RO cs.AI

FUTURE-VLA: Forecasting Unified Trajectories Under Real-time Execution

FUTURE-VLA:在实时执行下统一轨迹预测

Jingjing Fan, Yushan Liu, Shoujie Li, Botao Ren, Siyuan Li, Xiao-Ping Zhang, Wenbo Ding, Zhidong Deng

机构 * Department of Automation, Tsinghua University(自动化系,清华大学) Shenzhen International Graduation School, Tsinghua University(深圳国际研究生院,清华大学) Department of Computer Science and Technology, Tsinghua University(计算机科学与技术系,清华大学) School of Mechanical and Aerospace Engineering, Nanyang Technological University(机械与航空航天工程学院,南洋理工大学)

AI总结 FUTURE-VLA通过实时执行实现统一轨迹预测,采用双效效率范式提升时空信息密度,实现实时预测与人机交互机制,取得多项任务的高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15873 2026-02-19 cs.RO cs.AI

Test-Time Adaptation for Tactile-Vision-Language Models

测试时适应用于触觉-视觉-语言模型

Chuyang Ye, Haoxian Jing, Qinting Jiang, Yixi Lin, Qiang Li, Xing Tang, Jingyan Jiang

机构 * Shenzhen Technology University(深圳技术大学) New York University(纽约大学) Shenzhen University(深圳大学) Tsinghua University(清华大学)

AI总结 本文提出了一种可靠性感知框架,用于提升触觉-视觉-语言模型在测试时的适应能力,通过估计各模态可靠性来过滤不可靠样本并优化融合过程,有效提升了在模态损坏情况下的准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15485 2026-02-19 cs.CR cs.AI cs.SE

SecCodeBench-V2 Technical Report

SecCodeBench-V2 技术报告

Longfei Chen, Ji Zhao, Lanxiao Cui, Tong Su, Xingbo Pan, Ziyang Li, Yongxing Wu, Qijiang Cao, Qiyao Cai, Jing Zhang, Yuandong Ni, Junyao He, Zeyu Zhang, Chao Ge, Xuhuai Lu, Zeyu Gao, Yuxin Cui, Weisen Chen, Yuxuan Peng, Shengping Wang, Qi Li, Yukai Huang, Yukun Liu, Tuo Zhou, Terry Yue Zhuo, Junyang Lin, Chao Zhang

机构 * Tsinghua University(清华大学) Alibaba Group(阿里巴巴集团)

AI总结 SecCodeBench-V2 通过动态执行和LLM-as-a-judge oracle评估AI编程助手的安全能力,提供可复现的基准测试框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22007 2026-02-19 cs.LG

Stage-wise Dynamics of Classifier-Free Guidance in Diffusion Models

扩散模型中分类器自由引导的分阶段动态

Cheng Jin, Qitan Shi, Yuantao Gu

机构 * Department of Electronic Engineering, Tsinghua University(电子工程系,清华大学)

AI总结 本文研究了扩散模型中分类器自由引导的分阶段动态,揭示了引导对采样过程三个阶段的影响,并提出时间变化的引导策略以提升质量和多样性。

Comments 24 pages, 10 figures, accepted by ICLR26

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15776 2026-02-18 cs.AI

GlobeDiff: State Diffusion Process for Partial Observability in Multi-Agent Systems

GlobeDiff:多智能体系统中部分可观测性的状态扩散过程

Yiqin Yang, Xu Yang, Yuhua Jiang, Ni Mu, Hao Hu, Runpeng Xie, Ziyou Zhang, Siyuan Li, Yuan-Hua Ni, Qianchuan Zhao, Bo Xu

机构 * The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institute of Automation, Chinese Academy of Sciences(认知与决策智能复杂系统重点实验室,自动化研究所,中国科学院) Tsinghua University(清华大学) Moonshot AI Nankai University(南开大学) Faculty of Computing, Harbin Institute of Technology(哈尔滨工业大学计算机学院)

AI总结 GlobeDiff通过多模态扩散过程解决多智能体系统中部分可观测性问题,实现高保真度的全局状态推断。

Journal ref ICLR-2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15733 2026-02-18 cs.RO cs.AI

MeshMimic: Geometry-Aware Humanoid Motion Learning through 3D Scene Reconstruction

MeshMimic: 通过3D场景重建实现几何感知的人形运动学习

Qiang Zhang, Jiahao Ma, Peiran Liu, Shuai Shi, Zeran Su, Zifan Wang, Jingkai Sun, Wei Cui, Jialin Yu, Gang Han, Wen Zhao, Pihai Sun, Kangning Yin, Jiaxu Wang, Jiahang Cao, Lingfeng Zhang, Hao Cheng, Xiaoshuai Hao, Yiding Ji, Junwei Liang, Jian Tang, Renjing Xu, Yijie Guo

机构 * X-Humanoid The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) The University of Hong Kong(香港大学) Tsinghua University(清华大学) The Chinese University of Hong Kong(香港中文大学) Shanghai Jiao Tong University(上海交通大学) The Australian National University(澳大利亚国立大学)

AI总结 MeshMimic通过3D场景重建实现人形机器人学习与地形耦合的运动交互,利用消费级传感器低成本训练复杂物理交互。

Comments 17 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15397 2026-02-18 cs.RO cs.AI

ActionCodec: What Makes for Good Action Tokenizers

ActionCodec:什么使好的动作分词器成为可能

Zibin Dong, Yicheng Liu, Shiduo Zhang, Baijun Ye, Yifu Yuan, Fei Ni, Jingjing Gong, Xipeng Qiu, Hang Zhao, Yinchuan Li, Jianye Hao

机构 * Tsinghua University(清华大学) Fudan University(复旦大学) Tianjin University(天津大学) Shanghai Innovation Institute(上海创新研究院)

AI总结 本文提出ActionCodec,通过信息论原则提升动作分词性能,实现无需机器人预训练的VLA模型新SOTA。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16117 2026-02-17 cs.LG cs.AI cs.CV

DiffusionNFT: Online Diffusion Reinforcement with Forward Process

DiffusionNFT: 在线扩散强化学习与正向过程

Kaiwen Zheng, Huayu Chen, Haotian Ye, Haoxiang Wang, Qinsheng Zhang, Kai Jiang, Hang Su, Stefano Ermon, Jun Zhu, Ming-Yu Liu

机构 * Tsinghua University(清华大学) NVIDIA Stanford University(斯坦福大学)

AI总结 DiffusionNFT通过正向过程优化扩散模型,结合正负生成对比提升强化学习效率,无需CFG且比FlowGRPO更高效。

Comments ICLR 2026 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04641 2026-02-17 cs.CV cs.AI cs.LG

Simulating the Real World: A Unified Survey of Multimodal Generative Models

模拟现实世界:多模态生成模型的统一综述

Yuqi Hu, Longguang Wang, Xian Liu, Ling-Hao Chen, Yuwei Guo, Yukai Shi, Ce Liu, Anyi Rao, Zeyu Wang, Hui Xiong

机构 * Thrust of Artificial Intelligence, The Hong Kong University of Science and Technology (Guangzhou)(人工智能前沿技术研究所,香港科学与技术大学(广州)) Department of Computer Science and Engineering, The Hong Kong University of Science and Technology Hong Kong SAR(计算机科学与工程系,香港科学与技术大学香港特别行政区) MMLab, The Hong Kong University of Science and Technology(多模态实验室,香港科学与技术大学) School of Electronics and Communication Engineering, Shenzhen Campus of Sun Yat-sen University(电子与通信工程学院,中山大学深圳校区) The Chinese University of Hong Kong, Hong Kong, China(香港中文大学,香港,中国) Tsinghua University, Guangdong, China(清华大学,广东,中国) Bosch (China) Investment Co., Ltd., Shanghai, China(博世(中国)投资有限公司,上海,中国)

AI总结 本文首次系统性地统一研究了2D、视频、3D和4D生成,为多模态生成模型和现实世界模拟提供了统一框架的综述。

Comments Repository for the related papers at https://github.com/ALEEEHU/World-Simulator

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14577 2026-02-17 cs.CV

DriveFine: Refining-Augmented Masked Diffusion VLA for Precise and Robust Driving

DriveFine: 通过细化增强的掩码扩散VLA实现精确且鲁棒的驾驶

Chenxu Dang, Sining Ang, Yongkang Li, Haochen Tian, Jie Wang, Guang Li, Hangjun Ye, Jie Ma, Long Chen, Yan Wang

机构 * Huazhong University of Science and Technology(华中科技大学) Xiaomi EV(小米电动车) Institute for AI Industry Research (AIR), Tsinghua University(人工智能产业研究院(AIR),清华大学)

AI总结 DriveFine提出一种结合灵活解码与自我纠正能力的掩码扩散VLA模型,通过插件式块MoE和混合强化学习策略提升自动驾驶规划的精度与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14470 2026-02-17 cs.CL

HyperRAG: Reasoning N-ary Facts over Hypergraphs for Retrieval Augmented Generation

HyperRAG:基于超图的n元事实推理用于检索增强生成

Wen-Sheng Lien, Yu-Kai Chan, Hao-Lung Hsiao, Bo-Kai Ruan, Meng-Fen Chiang, Chien-An Chen, Yi-Ren Yeh, Hong-Han Shuai

机构 * National Yang Ming Chiao Tung University(国立阳明交通大学) National Kaohsiung Normal University(国立高雄师范大学) Institute for Clarity in Documentation(文档清晰研究所) Inria Paris-Rocquencourt(巴黎-勒克努尔研究所) Rajiv Gandhi University(拉贾·甘地大学) Tsinghua University(清华大学) Palmer Research Laboratories(帕勒尔研究实验室)

AI总结 HyperRAG通过n元超图推理提升检索增强生成的准确性与效率

Comments Accepted by The ACM Web Conference 2026 (WWW '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14452 2026-02-17 cs.LG cs.AI

WiSparse: Boosting LLM Inference Efficiency with Weight-Aware Mixed Activation Sparsity

WiSparse: 通过权重感知混合激活稀疏性提升大语言模型推理效率

Lei Chen, Yuan Meng, Xiaoyu Zhan, Zhi Wang, Wenwu Zhu

机构 * Tsinghua University(清华大学)

AI总结 WiSparse通过结合激活和权重信息,实现高效的大语言模型推理,以50%稀疏率保持97%性能并提升21.4%推理速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14225 2026-02-17 cs.AI

Text Before Vision: Staged Knowledge Injection Matters for Agentic RLVR in Ultra-High-Resolution Remote Sensing Understanding

文本优先于视觉:针对超高清遥感理解的代理强化学习在超高清遥感理解中的知识注入至关重要

Fengxiang Wang, Mingshuo Chen, Yueying Li, Yajie Yang, Yuhao Zhou, Di Wang, Yifan Zhang, Haoyu Wang, Haiyan Zhao, Hongda Sun, Long Lan, Jun Song, Yulin Wang, Jing Zhang, Wenlong Zhang, Bo Du

机构 * National University of Defense Technology, China(国防科技大学) Beijing University of Posts and Telecommunications, China(北京邮电大学) University of the Chinese Academy of Sciences, China(中国科学院大学) Sichuan University, China(四川大学) Wuhan University, China(武汉大学) Chinese Academy of Science, China(中国科学院) Tsinghua University, China(清华大学) Shanghai Artificial Intelligence Laboratory, China(上海人工智能实验室) Renmin University of China, China(中国人民大学)

AI总结 本文提出分阶段知识注入方法,利用文本引导提升超高清遥感理解的视觉推理能力,实现XLRS-Bench上的高准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14214 2026-02-17 cs.CV

HiVid: LLM-Guided Video Saliency For Content-Aware VOD And Live Streaming

HiVid: 基于大语言模型的视频显著性识别用于内容感知点播与直播

Jiahui Chen, Bo Peng, Lianchen Jia, Zeyu Zhang, Tianchi Huang, Lifeng Sun

机构 * Tsinghua University(清华大学) The Australian National University(澳大利亚国立大学) Key Laboratory of Pervasive Computing, Ministry of Education(教育部普适计算重点实验室)

AI总结 HiVid利用大语言模型生成内容感知的视频显著性权重,提升点播和直播的QoE性能。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14186 2026-02-17 cs.CV

UniRef-Image-Edit: Towards Scalable and Consistent Multi-Reference Image Editing

UniRef-Image-Edit: 向可扩展和一致的多参考图像编辑迈进

Hongyang Wei, Bin Wen, Yancheng Long, Yankai Yang, Yuhang Hu, Tianke Zhang, Wei Chen, Haonan Fan, Kaiyu Jiang, Jiankang Chen, Changyi Liu, Kaiyu Tang, Haojie Ding, Xiao Yang, Jia Sun, Huaiqing Wang, Zhenyu Yang, Xinyu Wei, Xianglong He, Yangguang Li, Fan Yang, Tingting Gao, Lei Zhang, Guorui Zhou, Han Li

机构 * Tsinghua University(清华大学) Kuaishou Technology(快手科技) Hong Kong Polytechnic University(香港理工大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) CUHK MMLab(香港中文大学MMLab)

AI总结 UniRef-Image-Edit通过统一的输入表示和两阶段训练框架,提升多参考图像编辑的一致性和保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13993 2026-02-17 cs.CV

Elastic Diffusion Transformer

弹性扩散变换器

Jiangshan Wang, Zeqiang Lai, Jiarui Chen, Jiayi Guo, Hang Guo, Xiu Li, Xiangyu Yue, Chunchao Guo

机构 * Tsinghua University(清华大学) MMLab, CUHK(CUHK实验室) Tencent Hunyuan(腾讯文言)

AI总结 E-DiT通过自适应加速框架提升扩散变换器效率,保持生成质量,实现约2倍加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13857 2026-02-17 cs.LG eess.SP

sleep2vec: Unified Cross-Modal Alignment for Heterogeneous Nocturnal Biosignals

sleep2vec:用于异构夜间生物信号的统一跨模态对齐

Weixuan Yuan, Zengrui Jin, Yichen Wang, Donglin Xie, Ziyi Ye, Chao Zhang, Xuesong Chen

机构 * Five Seasons Medical(五 Seasons 医疗) Tsinghua University(清华大学) Beijing Key Laboratory for Sleep Breathing Disorder(北京睡眠呼吸障碍重点实验室) Peking University(北京大学) Fudan University(复旦大学) Technical University of Munich(慕尼黑技术大学)

AI总结 sleep2vec通过统一跨模态对齐和原理化缩放,实现了对异构夜间生物信号的高效、通用建模。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13832 2026-02-17 cs.CL

Beyond Words: Evaluating and Bridging Epistemic Divergence in User-Agent Interaction via Theory of Mind

超越词语:通过心灵理论评估和弥合用户代理交互中的认知分歧

Minyuan Ruan, Ziyue Wang, Kaiming Liu, Yunghwei Lai, Peng Li, Yang Liu

机构 * Dept. of Comp. Sci. \& Tech., Institute for AI, Tsinghua University, Beijing, China Institute for AI Industry Research (AIR), Tsinghua University, Beijing, China

AI总结 本文提出通过心灵理论评估和弥合用户代理交互中的认知分歧,通过强化学习提升模型对用户心理状态的推理能力,从而增强下游任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13738 2026-02-17 cs.AI

OneLatent: Single-Token Compression for Visual Latent Reasoning

OneLatent:视觉潜在推理中的单令牌压缩

Bo Lv, Yasheng Sun, Junjie Wang, Haoxiang Shi

机构 * Tsinghua University(清华大学) Institute of Science Tokyo(东京科学研究所) Waseda University(早稻田大学)

AI总结 OneLatent通过将中间推理压缩为单个潜在令牌,提升了视觉推理效率,同时保持较高的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13103 2026-02-17 cs.LG

R-Diverse: Mitigating Diversity Illusion in Self-Play LLM Training

R-Diverse: 缓解自博弈LLM训练中的多样性幻觉

Gengsheng Li, Jinghan He, Shijie Wang, Dan Zhang, Ruiqi Liu, Renrui Zhang, Zijun Yao, Junfeng Fang, Haiyun Guo, Jinqiao Wang

机构 * Foundation Model Research Center, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所基础模型研究中心) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Wuhan AI Research(武汉人工智能研究所) National University of Singapore(新加坡国立大学) Tsinghua University(清华大学)

AI总结 R-Diverse通过引入记忆增强惩罚和技能感知测量,缓解自博弈LLM训练中的多样性幻觉问题,提升模型推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏