arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Tsinghua University(清华大学)

共收录 4547
2604.27929 2026-05-01 cs.CL

DPN-LE: Dual Personality Neuron Localization and Editing for Large Language Models

DPN-LE: 大语言模型双人格神经元定位与编辑

Lifan Zheng, Xue Yang, Jiawei Chen, Chenyan Wu, Jingyuan Zhang, Fanheng Kong, Xinyi Zeng, Xiang Chen, Yu Tian

机构 * Southeast University(东南大学) Shanghai Jiao Tong University(上海交通大学) East China Normal University(华东师范大学) Zhongguancun Academy(中关村学院) Zhejiang University of Technology(浙江工业大学) Kuaishou Technology(快手科技) Northeastern University(东北大学) Tsinghua University(清华大学) Nanjing University of Aeronautics and Astronautics(南京航空航天大学)

AI总结 本文提出DPN-LE方法,通过对比高特质与低特质样本的MLP激活,定位并编辑双人格神经元,实现精准的人格控制与能力保留。

Journal ref ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27895 2026-05-01 cs.AI

Graph World Models: Concepts, Taxonomy, and Future Directions

图世界模型:概念、分类与未来方向

Jiawei Liu, Senqiao Yang, Mingjun Wang, Yu Wang, Bei Yu

机构 * The Chinese University of Hong Kong(香港中文大学) Tsinghua University(清华大学)

AI总结 本文系统阐述了图世界模型的概念,分类了基于关系归纳偏置的三种类型,并探讨了其未来研究方向与挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19528 2026-05-01 cs.LG cs.AI cs.DB

Revisiting RaBitQ and TurboQuant: A Symmetric Comparison of Methods, Theory, and Experiments

重新审视RaBitQ和TurboQuant:方法、理论和实验的对称比较

Jianyang Gao, Yutong Gou, Yuexuan Xu, Jifan Shi, Yongyi Yang, Shuolin Li, Raymond Chi-Wing Wong, Cheng Long

机构 * ETH Zurich(苏黎世联邦理工学院) Nanyang Technological University(南洋理工大学) University of Michigan(密歇根大学) Tsinghua University(清华大学) HKUST(香港科技大学)

AI总结 本文对比了RaBitQ和TurboQuant在方法、理论和实验证据上的表现,发现TurboQuant在内积估计、最近邻搜索和KV缓存量化任务中表现不如RaBitQ,并指出TurboQuant论文中的一些运行时间和召回率结果无法复现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00607 2026-05-01 cs.MM cs.SD

MTAVG-Bench: A Diagnostic Benchmark for Multi-Talker Dialogue-Centric Audio-Video Generation

MTAVG-Bench: 多说话人对话中心音频视频生成的诊断基准

Yang-Hao Zhou, Haitian Li, Rexar Lin, Heyan Huang, Jinxing Zhou, Changsen Yuan, Tian Lan, Ziqin Zhou, Yudong Li, Jiajun Xu, Jingyun Liao, Yi-Ming Cheng, Xuefeng Chen, Xian-Ling Mao, Yousheng Feng

机构 * Beijing Institute of Technology(北京理工大学) Shanghai University(上海大学) OpenNLP Lab(OpenNLP实验室) Beijing University of Technology(北京工业大学) The University of Adelaide(阿德莱德大学) Tsinghua University(清华大学) Inkeverse Group Limited(Inkeverse集团)

AI总结 本文提出MTAVG-Bench,用于评估多说话人对话中心音频视频生成的失败模式诊断,通过半自动化流程生成1.8k视频并标注2.4k问答对,评估音频视频信号保真度、时间属性一致性、社交互动和电影表现四个层面。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14044 2026-05-01 cs.CV cs.AI

OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving

OmniDrive-R1: 基于强化学习的交错多模态链式推理用于可信的视觉-语言自动驾驶

Zhenguo Zhang, Haohan Zheng, Yishen Wang, Le Xu, Tianchen Deng, Xuefeng Chen, Qu Chen, Bo Zhang, Wuxiong Huang

机构 * ShanghaiTech University(上海科技大学) Tsinghua University(清华大学) Tongji University(同济大学) Shanghai Jiao Tong University(上海交通大学) MEGVII Technology(美科维七科技) AFARI

AI总结 本文提出OmniDrive-R1,通过交错多模态链式推理机制统一感知与推理,引入强化驱动的视觉 grounding 能力,提升自动驾驶中的推理准确性和稳定性,实验显示其在DriveLMM-o1数据集上的表现显著优于基线模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27725 2026-05-01 cs.HC cs.AI

AgentEconomist: An End-to-end Agentic System Translating Economic Intuitions into Executable Computational Experiments

AgentEconomist:一个端到端的代理系统,将经济直觉转化为可执行的计算实验

Jiaju Chen, Jinghua Piao, Xia Xu, Songwei Li, Tong Xia, Xiangnan He, Yong Li

机构 * Zhongguancun Academy(中关村学院) University of Science and Technology of China(中国科学技术大学) Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) Vanke School of Public Health, Tsinghua University(清华大学万科公共卫生学院)

AI总结 AgentEconomist通过模块化多阶段架构,将经济直觉转化为可执行的计算实验,通过文献基础假设生成、实验设计和执行阶段,结合人类与AI协作,提升研究创新性与文献相关性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27724 2026-05-01 cs.AI

Iterative Multimodal Retrieval-Augmented Generation for Medical Question Answering

迭代多模态检索增强生成用于医疗问答

Xupeng Chen, Binbin Shi, Chenqian Le, Jiaqi Zhang, Kewen Wang, Ran Gong, Jinhan Zhang, Chihang Wang

机构 * New York University, New York, USA(纽约大学) Tsinghua University, Beijing, China(清华大学) Independent Researcher(独立研究者) Chinese Academy of Sciences, Beijing, China(中国科学院)

AI总结 MED-VRAG通过多模态检索增强生成框架,利用文档页面图像而非OCR文本进行医疗问答,提升准确率至78.6%,并验证检索和迭代对问答性能的积极影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27699 2026-05-01 cs.AI

Bridging Values and Behavior: A Hierarchical Framework for Proactive Embodied Agents

连接价值与行为:一种面向主动具身代理的分层框架

Chunhui Zhang, Yuxuan Wang, Aoyang Qin, Yi-Long Lu, Kunlun Wu, Yizhou Wang, Wei Wang

机构 * State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,BIGAI) School of Computer Science, Peking University(北京大学计算机学院) Tsinghua University(清华大学) Nat’l Eng. Research Center of Visual Technology, Peking University(北京大学视觉技术国家工程研究中心) Institute for AI, Peking University(北京大学人工智能研究院) State Key Laboratory of General Artificial Intelligence, Peking University(通用人工智能国家重点实验室,北京大学)

AI总结 本文提出ValuePlanner框架,通过分层认知架构分离高阶价值调度与低阶行动执行,结合LLM生成符号子目标并用PDDL规划器转化为行动计划,通过反馈机制提升自主性,实验表明其能生成连贯的长期自主行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27491 2026-05-01 cs.CV

Uni-HOI:A Unified framework for Learning the Joint distribution of Text and Human-Object Interaction

Uni-HOI: 一种学习文本与人-物交互联合分布的统一框架

Mengfei Zhang, Jinlu Zhang, Zhigang Tu

机构 * Wuhan University(武汉大学) Peking University(北京大学) Institute for Clarity in Documentation(文档清晰研究所) Inria Paris-Rocquencourt(巴黎-罗quentcourt研究所) Rajiv Gandhi University(拉贾·甘地大学) Tsinghua University(清华大学) Palmer Research Laboratories(帕勒研究实验室)

AI总结 本文提出Uni-HOI框架,通过结合大语言模型和VQ-VAE,统一建模文本、人体运动和物运动的联合分布,解决多模态交互任务中的数据异质性问题。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27488 2026-05-01 cs.CL

Skills-Coach: A Self-Evolving Skill Optimizer via Training-Free GRPO

Skills-Coach:一种通过无训练GRPO实现的自我进化技能优化器

Yu Tian, Jiawei Chen, Lifan Zheng, Mingxiang Tao, Xinyi Zeng, Zhaoxia Yin, Hang Su, Xian Sun

机构 * University of Chinese Academy of Sciences(中国科学院大学) East China Normal University(华东师范大学) Zhongguancun Academy(中关村学院) Southeast University(东南大学) Hainan University(海南大学) Tsinghua University(清华大学)

AI总结 Skills-Coach通过无训练GRPO框架提升LLM代理技能自我进化能力,包含四个核心模块,通过Skill-X基准测试展示其在多种技能类别中的显著性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27472 2026-05-01 cs.AI cs.LG cs.RO

PRTS: A Primitive Reasoning and Tasking System via Contrastive Representations

PRTS:通过对比表示实现的原始推理与任务系统

Yang Zhang, Jiangyuan Zhao, Chenyou Fan, Fangzheng Yan, Tian Li, Haitong Tang, Sen Fu, Xuan'er Wu, Qizhen Weng, Weinan Zhang, Xiu Li, Chi Zhang, Chenjia Bai, Xuelong Li

机构 * Institute of Artificial Intelligence (TeleAI), China Telecom(人工智能研究院(TeleAI),中国电信) Tsinghua University(清华大学) Shanghai Jiao Tong University(上海交通大学) Fudan University(复旦大学)

AI总结 PRTS通过目标引导强化学习重构预训练过程,学习统一嵌入空间以评估物理可行性,提升机器人任务执行与长期规划能力。

Comments 38 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27387 2026-05-01 cs.AI

Robust Learning on Heterogeneous Graphs with Heterophily: A Graph Structure Learning Approach

在存在异质性中的鲁棒学习:一种图结构学习方法

Yihan Zhang, Ercan E. Kuruoglu

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

AI总结 本文提出HGUL框架,通过联合处理异质性和噪声图结构,提升异质图学习的鲁棒性,实验表明其在清洁图和噪声环境下均表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27361 2026-05-01 cs.CV cs.GR

CasLayout: Cascaded 3D Layout Diffusion for Indoor Scene Synthesis with Implicit Relation Modeling

CasLayout:基于级联3D布局扩散的室内场景合成与隐式关系建模

Yingrui Wu, Youkang Kong, Mingyang Zhao, Weize Quan, Dong-Ming Yan, Yang Liu

机构 * MAIS, Institute of Automation, Chinese Academy of Sciences and School of Artificial Intelligence, University of Chinese Academy of Sciences(MAIS,自动化研究所,中国科学院,人工智能学院,中国科学院大学) Tsinghua University(清华大学) SKLMS, Academy of Mathematics and Systems Science, Chinese Academy of Sciences(系统科学研究所,中国科学院) Microsoft Research Asia(微软亚洲研究院)

AI总结 CasLayout通过级联扩散框架将场景生成分解为四个阶段,结合物理与语义约束,提升生成效率与可控性,实现高质量室内场景合成。

Comments SIGGARPH 2026 (Journal Track), Code: https://github.com/YingruiWoo/CasLayout

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27329 2026-05-01 cs.GR cs.CV

SQuadGen: Generating Simple Quad Layouts via Chart Distance Fields

SQuadGen: 通过图表距离场生成简单的四边布局

Youkang Kong, Yang Liu, Yue Dong, Xin Tong, Heung-Yeung Shum

机构 * Tsinghua University Beijing P. R. China Microsoft Research Asia Beijing P. R. China Tsinghua University \& International Digital Economy Academy Beijing P. R. China Tsinghua University Microsoft Research Asia Tsinghua University \& International Digital Economy Academy

AI总结 本文提出SQuadGen,一种基于扩散的生成框架,利用图表距离场生成简单四边布局,解决网格连接离散性和数据集稀缺性问题,实现高效四边布局生成。

Comments SIGGRAPH 2026 (Journal Track), project page: https://youkang-kong.github.io/squadgen/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27325 2026-05-01 cs.LG cs.NA math.NA

A Short Note on Batch-efficient Divide-and-Conquer Algorithm for EigenDecomposition

关于批高效分治算法用于特征分解的简短注记

Yue Song

机构 * College of AI, Tsinghua University, China(人工智能学院,清华大学,中国)

AI总结 本文提出一种适用于大矩阵的批高效分治特征分解算法,针对深度神经网络中矩阵批次计算成本高的问题,通过数值测试展示其在小尺寸矩阵批次中优于Pytorch SVD性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27085 2026-05-01 cs.DC cs.AI cs.LG

Efficient Training on Multiple Consumer GPUs with RoundPipe

在多个消费级GPU上高效训练的RoundPipe

Yibin Luo, Shiwei Gao, Huichuan Zheng, Youyou Lu, Jiwu Shu

机构 * Tsinghua University(清华大学)

AI总结 本文提出RoundPipe,通过动态调度和优先级转移解决GPU负载不均问题,实现近零管道气泡,提升大语言模型微调效率。

Comments Github Repo: https://github.com/ITcarrot/RoundPipe Project website: https://itcarrot.github.io/RoundPipe/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24564 2026-05-01 cs.CL cs.IR cs.IT math.IT

MEG-RAG: Quantifying Multi-modal Evidence Grounding for Evidence Selection in RAG

MEG-RAG: 多模态证据 grounding 的量化研究以提升 RAG 中的证据选择

Xihang Wang, Zihan Wang, Chengkai Huang, Quan Z. Sheng, Lina Yao

机构 * Institute for Clarity in Documentation(清晰文档研究所) Inria Paris-Rocquencourt(巴黎- Rocquencourt 国家信息与自动化研究所) Rajiv Gandhi University(拉吉夫·甘地大学) Tsinghua University(清华大学) Palmer Research Laboratories(帕勒尔研究实验室) Zhejiang University(浙江大学) Peking University(北京大学) University of New South Wales(新南威尔士大学) Macquarie University(麦考瑞大学) CSIRO’s Data61(CSIRO 数据61)

AI总结 本文提出 MEG-RAG 框架,通过语义感知的多模态证据 grounding 方法提升 RAG 中的证据选择准确性与多模态一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23763 2026-05-01 cs.CV

Edit Where You Mean: Region-Aware Adapter Injection for Mask-Free Local Image Editing

在需要的地方编辑:区域感知的适配器注入用于无掩码的局部图像编辑

Honghao Cai, Xiangyuan Wang, Yunhao Bai, Haohua Chen, Tianze Zhou, Runqi Wang, Wei Zhu, Yibo Chen, Xu Tang, Yao Hu, Zhen Li

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Beijing University of Aeronautics and Astronautics(北京航空航天大学) Tsinghua University(清华大学) Peking University(北京大学) Xiaohongshu Inc.(小红书公司)

AI总结 本文提出AdaptEdit框架,通过区域感知适配器实现无掩码的局部图像编辑,结合轻量级Block Adapter和SpatialGate提升编辑精度,同时通过Region-Aware Loss优化训练目标,实现无需用户掩码的高质量编辑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11119 2026-05-01 stat.ML cs.LG

DDO-RM: Distribution-Level Policy Improvement after Reward Learning

DDO-RM:奖励学习后基于分布的策略改进

Tiantian Zhang, Jierui Zuo, Michael Chen, Wenping Wang

机构 * Department of Computer Science(计算机科学系) Columbia University(哥伦比亚大学) Department of Management Science and Engineering(管理科学与工程系) Tsinghua University(清华大学) Carnegie Mellon University(卡内基梅隆大学)

AI总结 DDO-RM通过将奖励评分转化为显式目标分布,改进策略在分布层面的性能,实验显示其在准确性与边际均值上优于DPO。

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14289 2026-05-01 cs.CL cs.AI

RPC-Bench: A Fine-grained Benchmark for Research Paper Comprehension

RPC-Bench: 一项针对研究论文理解的细粒度基准测试

Yelin Chen, Fanjin Zhang, Suping Sun, Yunhe Pang, Yuanchun Wang, Jian Song, Xiaoyan Li, Lei Hou, Shu Zhao, Jie Tang, Juanzi Li

机构 * Xinjiang University(新疆大学) Renmin University of China(中国人民大学) Anhui University(安徽大学) Sun Yat-sen University(中山大学) Tsinghua University(清华大学) University of Southampton(南安普顿大学)

AI总结 本文提出RPC-Bench,通过高质量计算机科学论文的评审反驳交流构建,包含15000对人工验证的问答对,设计细粒度分类评估模型在学术场景中理解并回答为何、什么和如何问题的能力,揭示即使最强模型在精确学术论文理解上仍有显著差距。

Comments ACL'26, 12 pages, 23 appendix pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12089 2026-05-01 eess.SP cs.CL

RadarPLM: Adapting Pre-trained Language Models for Marine Radar Target Detection by Selective Fine-tuning

RadarPLM:通过选择性微调适应预训练语言模型用于海洋雷达目标检测

Qiying Hu, Yaowen Li, Shengyi Zhang, Chuan Huang, Yu Liu, You He

机构 * Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) Shenzhen International Graduate School, Tsinghua University(深圳国际研究生院)

AI总结 本文提出RadarPLM框架,通过轻量级适应模块和选择性微调策略提升海洋雷达目标检测性能,在低信噪比环境下实现显著提升。

Comments Preprint,in submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02671 2026-05-01 cs.CV

Test-Time Distillation for Continual Model Adaptation

测试时蒸馏用于持续模型适应

Xiao Chen, Jiazhen Huang, Zhiming Liu, Qinting Jiang, Fanding Huang, Jingyan Jiang, Zhi Wang

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Shenzhen Technology University(深圳技术大学)

AI总结 本文提出CoDiRe框架,通过动态融合VLM和目标模型预测构建鲁棒教师,利用MSP缓解熵偏见,通过最优传输对齐预测,实现稳定持续适应,优于现有方法。

Comments Accepted by CVPR 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26934 2026-04-30 cs.CV

World2VLM: Distilling World Model Imagination into VLMs for Dynamic Spatial Reasoning

World2VLM: 将世界模型的想象能力蒸馏到VLM中以实现动态空间推理

Wanyue Zhang, Wenxiang Wu, Wang Xu, Jiaxin Luo, Helu Zhi, Yibin Huang, Shuo Ren, Zitao Liu, Jiajun Zhang

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Tsinghua University(清华大学) Harbin Institute of Technology(哈尔滨工业大学) Wuhan AI Research(武汉人工智能研究院)

AI总结 本文提出World2VLM框架,通过蒸馏生成式世界模型的空间想象能力到VLM中,提升动态空间推理性能,优于基线模型和测试时世界模型耦合方法。

Comments The code is available at https://github.com/WanyueZhang-ai/World2VLM. The dataset is available at https://huggingface.co/datasets/WanyueZhang/World2VLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26839 2026-04-30 cs.RO

Walk With Me: Long-Horizon Social Navigation for Human-Centric Outdoor Assistance

带我走:面向以人为本的户外助行的长周期社交导航

Lingfeng Zhang, Xiaoshuai Hao, Xizhou Bu, Yingbo Tang, Hongsheng Li, Jinghui Lu, Xiu-shen Wei, Jiayi Ma, Yu Liu, Jing Zhang, Hangjun Ye, Xiaojun Liang, Long Chen, Wenbo Ding

机构 * Tsinghua University(清华大学) Pengcheng Laboratory(鹏城实验室) Hefei University of Technology(合肥工业大学)

AI总结 本文提出Walk with Me框架,通过高阶视觉语言模型和轻量级兴趣点,实现无地图的长周期社交导航,结合语义意图定位、安全推理和低层动作生成,提升户外助行的实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26768 2026-04-30 cs.CL

Decoupling Knowledge and Task Subspaces for Composable Parametric Retrieval Augmented Generation

解耦知识与任务子空间以实现可组合的参数检索增强生成

Weihang Su, Hanwen Zhang, Qingyao Ai, Yiqun Liu

机构 * Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系)

AI总结 本文提出通过正交子空间分解分离任务行为与文档知识,提升多文档参数RAG的组合鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23758 2026-04-30 cs.LG cond-mat.mtrl-sci

Agentic Fusion of Large Atomic and Language Models to Accelerate Superconductors Discovery

代理融合大规模原子和语言模型以加速超导体发现

Mingze Li, Yu Rong, Songyou Li, Lihong Wang, Jiacheng Cen, Liming Wu, Anyi Li, Zongzhao Li, Qiuliang Liu, Rui Jiao, Tian Bian, Pengju Wang, Hao Sun, Jianfeng Zhang, Ji-Rong Wen, Deli Zhao, Shifeng Jin, Tingyang Xu, Wenbing Huang

机构 * Gaoling School of Artificial Intelligence, Renmin University of China, Beijing, China(中国人民大学北京校区人工智能学院) DAMO Academy, Alibaba Group, Hangzhou, China(阿里巴巴集团达摩院,杭州,中国) Hupan Lab, Hangzhou, China(虎扑实验室,杭州,中国) Institution of Physics, University of the Chinese Academy of Sciences, Beijing, China(中国科学院物理研究所,北京,中国) Department of Computer Science and Technology, Tsinghua University, Beijing, China(清华大学计算机科学与技术系,北京,中国)

AI总结 本文提出ElementsClaw框架,结合大规模原子模型与语言模型,通过自主协作加速超导体发现,筛选240万晶体识别6.8万高置信度候选,发现四个新实验验证超导体。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16496 2026-04-30 cs.CL

AdaMem: Adaptive User-Centric Memory for Long-Horizon Dialogue Agents

AdaMem:面向长时对话代理的自适应用户导向记忆

Shannan Yan, Jingchen Ni, Leqi Zheng, Jiajun Zhang, Peixi Wu, Dacheng Yin, Jing Lyu, Chun Yuan, Fengyun Rao

机构 * Tsinghua University(清华大学) WeChat Vision, Tencent Inc.(腾讯微信视觉实验室)

AI总结 AdaMem通过自适应用户导向记忆框架提升长时对话代理的长时推理与用户建模能力,采用统一框架整合工作记忆、事件记忆、人格记忆和图记忆,实现高效信息组织与推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26573 2026-04-30 cs.LG

PAINT: Partial-Solution Adaptive Interpolated Training for Self-Distilled Reasoners

PAINT:部分解适应插值训练用于自蒸馏推理器

Zhiquan Tan, Yinrong Hong

机构 * Tsinghua University(清华大学) Beihang University(北航)

AI总结 PAINT通过部分解适应插值训练,在自蒸馏推理器中提升大语言模型的推理能力,优于现有基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26363 2026-04-30 cs.CV cs.LG

CO-EVO: Co-evolving Semantic Anchoring and Style Diversification for Federated DG-ReID

CO-EVO: 用于联邦域泛化的语义锚定与风格多样化协同进化

Fengchun Zhang, Qiang Ma, Liuyu Xiang, Jinshan Lai, Tingxuan Huang, Jianwei Hu

机构 * School of Information and Software Engineering, University of Electronic Science and Technology of China(电子科技大学信息与软件学院) QiYuan Lab(启元实验室) School of Artificial Intelligence, Beijing University of Posts and Telecommunications(北京邮电大学人工智能学院) School of Software, Tsinghua University(清华大学软件学院)

AI总结 本文提出CO-EVO框架,通过语义净化与风格扩展的协同机制,解决联邦域泛化中因客户端风格差异导致的语义冲突问题,实现跨域泛化性能提升。

Comments Accepted at ACL 2026 (Main Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26261 2026-04-30 cs.CV

Multiple Consistent 2D-3D Mappings for Robust Zero-Shot 3D Visual Grounding

多一致的2D-3D映射用于鲁棒的零样本3D视觉定位

Yufei Yin, Jie Zheng, Qianke Meng, Zhou Yu, Minghao Chen, Jiajun Ding, Min Tan, Yuling Xi, Zhiwen Chen, Chengfei Lv

机构 * Hangzhou Dianzi University(杭州电子科技大学) Zhejiang University(浙江大学) Alibaba Group(阿里巴巴集团) Institute for Clarity in Documentation(文档清晰研究所) Inria Paris-Rocquencourt(Inria巴黎-鲁克蒙特研究所) Rajiv Gandhi University(拉贾·甘地大学) Tsinghua University(清华大学) Palmer Research Laboratories(帕勒实验室)

AI总结 本文提出MCM-VG框架,通过建立多一致的2D-3D映射实现鲁棒的零样本3D视觉定位,解决开放词汇3D提案质量差的问题,提升目标定位和推理的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏