arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Tsinghua University(清华大学)

2026-03-10 至 2026-03-10 共收录 46
2603.08617 2026-03-10 cs.RO

Diff-Muscle: Efficient Learning for Musculoskeletal Robotic Table Tennis

Diff-Muscle: 高效学习用于肌骨骼机器人乒乓球

Wentao Zhao, Jun Guo, Kangyao Huang, Xin Liu, Huaping Liu

机构 * Department of Computer Science and Technology, Tsinghua University, China(清华大学计算机科学与技术系)

AI总结 Diff-Muscle通过微分平坦性将高维动作空间转化为低维关节空间,实现高效学习,使肌骨骼机器人在动态乒乓球任务中实现连续回球。

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08283 2026-03-10 cs.LG cs.SY eess.SY math.OC

PolyFormer: learning efficient reformulations for scalable optimization under complex physical constraints

PolyFormer: 为在复杂物理约束下可扩展优化学习高效重述

Yilin Wen, Yi Guo, Bo Zhao, Wei Qi, Zechun Hu, Colin Jones, Jian Sun

机构 * School of Electrical and Electronic Engineering(电气电子工程学院) North China Electric Power University(华北电力大学) Department of Electrical Engineering(电气工程系) Tsinghua University(清华大学) School of Automation(自动化学院) Beijing Institute of Technology(北京理工大学) Department of Industrial Engineering(工业工程系) Laboratory for Systems and Control(系统与控制实验室) École Polytechnique Fédérale de Lausanne (EPFL)(瑞士联邦理工学院(EPFL))

AI总结 PolyFormer通过将物理和几何知识转化为高效多边形重述,实现了在复杂约束下的高效优化,显著提升计算效率和内存利用率。

Comments Code availability: All the data and code are made openly available at https://github.com/wenyl16/PolyFormer

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16187 2026-03-10 cs.RO cs.AI

EasyInsert: A Data-Efficient and Generalizable Insertion Policy

EasyInsert: 一种数据高效且具有通用性的插入策略

Guanghe Li, Junming Zhao, Shengjie Wang, Yang Gao

机构 * Tsinghua University(清华大学) Shanghai Qi Zhi Institute(上海启智研究院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

AI总结 EasyInsert通过delta-pose回归问题实现高效数据收集,提升机器人在杂乱环境中的插入任务泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08136 2026-03-10 cs.RO

POIROT: Investigating Direct Tangible vs. Digitally Mediated Interaction and Attitude Moderation in Multi-party Murder Mystery Games

POIROT:探讨多党谋杀谜游戏中的直接实体交互与数字中介交互及态度调节

Wen Chen, Rongxi Chen, Shankai Chen, Huiyang Gong, Minghui Guo, Yingri Xu, Xintong Wu, Xinyi Fu

机构 * Tsinghua University(清华大学) University of Pennsylvania(宾夕法尼亚大学) Syracuse University(Syracuse大学) National University of Singapore(新加坡国立大学) Royal College of Art(皇家艺术学院)

AI总结 POIROT研究通过实验揭示,用户对机器人的负面态度影响其在多党谋杀谜游戏中的沉浸体验,表明交互方式需根据用户倾向进行适应性调整。

Comments 16 pages, 7 figures. Accepted to the 21st ACM/IEEE International Conference on Human-Robot Interaction (HRI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08113 2026-03-10 cs.CV

SAMoE-VLA: A Scene Adaptive Mixture-of-Experts Vision-Language-Action Model for Autonomous Driving

SAMoE-VLA:一种面向自动驾驶的场景自适应混合专家视觉-语言-动作模型

Zihan You, Hongwei Liu, Chenxu Dang, Zhe Wang, Sining Ang, Aoqi Wang, Yan Wang

机构 * Institute for AI Industry Research (AIR), Tsinghua University(人工智能产业研究院(AIR),清华大学) School of Instrument Science and Engineering, Southeast University(仪器科学与工程学院,东南大学) Zhili College, Tsinghua University(紫荆学院,清华大学) School of Artificial Intelligence and Automation, Huazhong University of Science and Technology(人工智能与自动化学院,华中科技大学) Department of Automation, University of Science and Technology of China(自动化学院,中国科学技术大学) Department of Automation, University of Science and Technology Beijing(自动化学院,北京科技大学)

AI总结 SAMoE-VLA通过场景自适应混合专家机制提升自动驾驶中的视觉-语言-动作推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08089 2026-03-10 cs.RO

Adaptive Vision-Based Control of Redundant Robots with Null-Space Interaction for Human-Robot Collaboration

适应性视觉控制的冗余机器人用于人机协作的空隙空间交互

Xiangjie Yan, Chen Chen, Xiang Li

机构 * Department of Automation, Tsinghua University(自动化系,清华大学)

AI总结 本文提出了一种适应性视觉控制与空隙空间交互相结合的控制方案,用于冗余机器人的人机协作,以提升协作效率和安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08022 2026-03-10 cs.LG

Capacity-Aware Mixture Law Enables Efficient LLM Data Optimization

面向容量的混合法则实现高效大语言模型数据优化

Jingwei Li, Xinran Gu, Jingzhao Zhang

机构 * Institute for Interdisciplinary Information Sciences, Tsinghua University(交叉信息研究院,清华大学) Shanghai Qizhi Institute(上海启智研究院)

AI总结 面向容量的混合法则通过高效数据混合优化,减少50%的优化成本并提升3%的下游性能

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07660 2026-03-10 cs.CV

Holi-Spatial: Evolving Video Streams into Holistic 3D Spatial Intelligence

Holi-Spatial: 将视频流转化为整体3D空间智能

Yuanyuan Gao, Hao Li, Yifei Liu, Xinhao Ji, Yuning Gong, Yuanjun Liao, Fangfu Liu, Manyuan Zhang, Yuchen Yang, Dan Xu, Xue Yang, Huaxi Huang, Hongjie Zhang, Ziwei Liu, Xiao Sun, Dingwen Zhang, Zhihang Zhong

机构 * Shanghai AI Lab(上海人工智能实验室) Northwestern Polytechnical University(西北工业大学) Shanghai Jiao Tong University(上海交通大学) Peking University(北京大学) Nanyang Technological University(南洋理工大学) Beihang University(北京航空航天大学) Sichuan University(四川大学) Tsinghua University(清华大学) The Chinese University of Hong Kong(香港中文大学) Fudan University(复旦大学) Hong Kong University of Science and Technology(香港科技大学)

AI总结 Holi-Spatial通过自动化方法构建大规模多模态3D空间数据集,提升空间推理任务的模型性能。

Comments project page: https://visionary-laboratory.github.io/holi-spatial/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07654 2026-03-10 math.OC cs.LG

Compressed Proximal Federated Learning for Non-Convex Composite Optimization on Heterogeneous Data

压缩的联邦学习用于非凸复合优化在异构数据上

Pu Qiu, Chen Ouyang, Yongyang Xiong, Keyou You, Wanquan Liu, Yang Shi

机构 * School of Intelligent Systems Engineering, Sun Yat-Sen University(中山大学智能系统工程学院) Department of Automation, Beijing National Research Center for Information Science and Technology, Tsinghua University(清华大学自动化系) Department of Mechanical Engineering, University of Victoria(维多利亚大学机械工程系)

AI总结 FedCEF通过解耦近端更新和通信机制,提高非凸复合优化在异构数据上的通信效率与收敛鲁棒性。

Comments 14 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07642 2026-03-10 cs.LG

Helix: Evolutionary Reinforcement Learning for Open-Ended Scientific Problem Solving

Helix:基于进化强化学习的开放性科学问题求解

Chang Su, Zhongkai Hao, Zhizhou Zhang, Zeyu Xia, Youjia Wu, Hang Su, Jun Zhu

机构 * Bosch (China) Investment Co., Ltd.(博世(中国)投资有限公司) Tsinghua-Bosch Joint Center for ML, Tsinghua University(清华大学-博世联合人工智能中心,清华大学) Dept. of EE, Tsinghua University(清华大学电子工程系) Dept. of Comp. Sci. & Techn., Tsinghua University(清华大学计算机科学与技术系)

AI总结 HELIX通过分层进化强化学习框架,在开放性科学问题求解中实现了先进解决方案的发现,其在圆圈装箱任务中取得state-of-the-art结果,并在机器学习基准测试中超越GPT-4o。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07580 2026-03-10 cs.RO

FeasibleCap: Real-Time Embodiment Constraint Guidance for In-the-Wild Robot Demonstration Collection

FeasibleCap: 机器人自由捕捉中的实时执行性指导

Zi Yin, Fanhong Li, Yun Gui, Jia Liu

机构 * Tsinghua University(清华大学)

AI总结 FeasibleCap通过实时执行性指导提升机器人自由捕捉的效率和成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07568 2026-03-10 cs.LG

Constraints Matrix Diffusion based Generative Neural Solver for Vehicle Routing Problems

基于约束矩阵扩散的生成神经求解器用于车辆路径问题

Zhenwei Wang, Tiehua Zhang, Ning Xue, Ender Ozcan, Ling Wang, Ruibin Bai

机构 * University of Nottingham Ningbo China(诺丁汉大学宁波校区) Tongji University(同济大学) University of Nottingham(诺丁汉大学) Tsinghua University(清华大学)

AI总结 本文提出基于约束矩阵扩散的生成神经求解器,用于解决车辆路径问题,通过融合神经网络框架提升求解性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07484 2026-03-10 cs.RO

HSC-VLA: Hierarchical Scene-Clearing for Robust Bimanual Manipulation in Dense Clutter

HSC-VLA:分层场景清除用于密集杂乱环境中的鲁棒双臂操作

Zhen Liu, Xinyu Ning, Zhe Hu, XinXin Xie, Yitong Liu, Zhongzhu Pu

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Tsinghua University(清华大学)

AI总结 HSC-VLA 通过分层场景清除方法提升密集杂乱环境中的双臂操作鲁棒性,实现 86.7% 的高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07449 2026-03-10 cs.DB cs.AI cs.CL cs.IR cs.LG

Dial: A Knowledge-Grounded Dialect-Specific NL2SQL System

Dial:一种基于知识的方言特定自然语言到SQL系统

Xiang Zhang, Hongming Xu, Le Zhou, Wei Zhou, Xuanhe Zhou, Guoliang Li, Yuyu Luo, Changdong Liu, Guorun Chen, Jiang Liao, Fan Wu

机构 * Tsinghua University(清华大学) China Telecom Corporation Ltd. Shanghai Branch(中国电信股份有限公司上海分公司) Shanghai Jiao Tong University(上海交通大学)

AI总结 Dial提出一种基于知识的方言特定自然语言到SQL系统,通过逻辑查询规划、知识库和执行驱动调试提升翻译准确性和方言特征覆盖度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07393 2026-03-10 cs.RO cs.SY eess.SY

Underwater Embodied Intelligence for Autonomous Robots: A Constraint-Coupled Perspective on Planning, Control, and Deployment

水下具身智能:一种约束耦合视角下的规划、控制与部署

Jingzehua Xu, Guanwen Xie, Jiwei Tang, Shuai Zhang, Xiaofan Li

机构 * Department of Mechanical Engineering, The University of Hong Kong(香港大学机械工程系) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生学院) Department of Data and Systems Engineering, The University of Hong Kong(香港大学数据与系统工程系) Department of Data Science, New Jersey Institute of Technology(新泽西理工学院数据科学系)

AI总结 本文提出一种约束耦合视角下的水下具身智能方法,探讨了规划、控制与部署中的紧密耦合约束,旨在实现更可靠和可扩展的自主性。

Comments This article is currently under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22263 2026-03-10 q-bio.BM cs.AI eess.IV q-bio.QM

CryoNet.Refine: A One-step Diffusion Model for Rapid Refinement of Structural Models with Cryo-EM Density Map Restraints

CryoNet.Refine: 一种用于利用冷冻电镜密度图约束快速优化结构模型的一步扩散模型

Fuyao Huang, Xiaozhu Yu, Kui Xu, Qiangfeng Cliff Zhang

机构 * State Key Laboratory of Membrane Biology, Beijing Frontier Research Center of Biological Structures, Tsinghua-Peking Joint Center for Life Sciences, School of Life Sciences, Tsinghua University, Beijing, China(膜生物学国家重点实验室,北京生物结构前沿研究中心,清华大学-北京大学联合生命科学中心,生命科学学院,清华大学,北京,中国) State Key Laboratory of Membrane Biology–Membrane Structure and Artificial Intelligence Biology Branch, Hangzhou, China(膜生物学国家重点实验室——生物结构与人工智能生物学分支,杭州,中国) State Key Laboratory of Membrane Biology, Beijing Tsinghua Institute for Frontier Interdisciplinary Innovation, Beijing, China(膜生物学国家重点实验室,北京清华大学前沿交叉创新研究院,北京,中国)

AI总结 CryoNet.Refine通过一步扩散模型实现快速结构模型优化,结合密度感知损失和立体化学约束,提供自动化且高效的冷冻电镜结构精修解决方案。

Comments Published as a conference paper at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13810 2026-03-10 cs.LG cs.AI

Mean Flow Policy with Instantaneous Velocity Constraint for One-step Action Generation

具有瞬时速度约束的一步动作生成均流策略

Guojian Zhan, Letian Tao, Pengcheng Wang, Yixiao Wang, Yiheng Li, Yuxin Chen, Hongyang Li, Masayoshi Tomizuka, Shengbo Eben Li

机构 * School of Vehicle and Mobility & College of AI, Tsinghua University(车辆与移动学院及人工智能学院,清华大学) Berkeley AI Research (BAIR), UC Berkeley(伯克利人工智能研究(BAIR),加州大学伯克利分校) The University of Hong Kong(香港大学)

AI总结 本文提出均速度策略(MVP),通过引入瞬时速度约束来提升动作生成效率,实现高效的一步动作生成并在机器人操作任务中取得最佳性能。

Comments ICLR Oral Presentation

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12575 2026-03-10 cs.CL cs.LG

Discovering Semantic Latent Structures in Psychological Scales: A Response-Free Pathway to Efficient Simplification

在心理量表中发现语义潜在结构:一种无响应路径的高效简化方法

Bo Wang, Yuxuan Zhang, Yueqin Hu, Hanchao Hou, Kaiping Peng, Shiguang Ni

机构 * Department of Psychological and Cognitive Sciences, Tsinghua University, Beijing, China(心理学与认知科学系,清华大学,北京,中国) Shenzhen International Graduate School, Tsinghua University, Shenzehen, China(深圳国际研究生院,清华大学,深圳,中国) Faculty of Psychology, Beijing Normal University, Beijing, China(心理学系,北京师范大学,北京,中国) Beijing Key Laboratory of Applied Experimental Psychology, National Demonstration Center for Experimental Psychology Education, Faculty of Psychology, Beijing Normal University, Beijing, China(应用实验心理学北京市重点实验室,国家级实验心理学教育示范中心,心理学系,北京师范大学,北京,中国)

AI总结 本文提出一种基于语义结构的无响应方法,通过主题建模简化心理量表,实现60.5%的长度缩减并保持心理测量有效性。

Comments 79 pages, 20 figures; parameter perturbation result of epoch-cn updated; minor revisions on grammars

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11492 2026-03-10 cs.AI

BoxMind: Closed-loop AI strategy optimization for elite boxing validated in the 2024 Olympics

BoxMind: 闭环AI策略优化用于精英拳击的验证在2024年奥运会

Kaiwen Wang, Kaili Zheng, Rongrong Deng, Qingmin Fan, Milin Zhang, Zongrui Li, Xuesi Zhou, Bo Han, Liren Chen, Chenyi Guo, Ji Wu

机构 * Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) Tsinghua University(清华大学) Beijing Sport University(北京体育大学) Beijing National Research Center for Information Science and Technology(北京国家信息科学与技术研究中心)

AI总结 BoxMind通过闭环AI策略优化在2024年奥运会中验证,实现了拳击比赛的高效战术调整和战略决策支持。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03034 2026-03-10 cs.CV

MAViD: A Multimodal Framework for Audio-Visual Dialogue Understanding and Generation

MAViD:一种多模态框架用于音频-视觉对话理解和生成

Youxin Pang, Jiajun Liu, Lingfeng Tan, Yong Zhang, Feng Gao, Xiang Deng, Zhuoliang Kang, Xiaoming Wei, Yebin Liu

机构 * Tsinghua University(清华大学) Meituan(美团)

AI总结 MAViD提出了一种多模态框架,通过Conductor-Creator架构实现音频-视觉对话的理解与生成,结合自回归和扩散模型提升长时多模态内容生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02486 2026-03-10 cs.LG

Dual-Robust Cross-Domain Offline Reinforcement Learning Against Dynamics Shifts

对抗动态偏移的双鲁棒跨域离线强化学习

Zhongjian Qiao, Rui Yang, Jiafei Lyu, Xiu Li, Zhongxiang Dai, Zhuoran Yang, Siyang Gao, Shuang Qiu

机构 * CityUHK(城市大学 Hong Kong 分校) UIUC(伊利诺伊大学香槟分校) Tsinghua University(清华大学) Yale University(耶鲁大学) CUHK(SZ)(香港中文大学(深圳)) Tencent(腾讯)

AI总结 本文提出DROCO算法,通过引入鲁棒跨域Bellman算子和动态价值惩罚等技术,提升跨域离线强化学习在动态偏移下的双鲁棒性。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13795 2026-03-10 cs.CV cs.AI

Bee: A High-Quality Corpus and Full-Stack Suite to Unlock Advanced Fully Open MLLMs

Bee:一个高质量语料库和全栈工具包,解锁高级完全开放的多模态大语言模型

Yi Zhang, Bolin Ni, Xin-Sheng Chen, Heng-Rui Zhang, Yongming Rao, Houwen Peng, Qinglin Lu, Han Hu, Meng-Hao Guo, Shi-Min Hu

机构 * Tsinghua University(清华大学) Tencent Hunyuan Team(腾讯文英团队)

AI总结 Bee通过高质量数据集和全栈工具包,提升完全开放多模态大语言模型的性能,达到与半开放模型相当甚至超越的水平。

Comments homepage: https://open-bee.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01487 2026-03-10 cs.CV

PointSlice: Accurate and Efficient Slice-Based Representation for 3D Object Detection from Point Clouds

PointSlice: 用于点云3D物体检测的准确且高效的基于切片的表示方法

Liu Qifeng, Zhao Dawei, Dong Yabo, Xiao Liang, Wang Juan, Min Chen, Li Fuyang, Jiang Weizhong, Lu Dongming, Nie Yiming

机构 * Zhejiang University(浙江大学) Defense Innovation Institute(国防科技创新研究院) Tsinghua University(清华大学)

AI总结 PointSlice提出了一种基于切片的点云表示方法,通过引入切片交互网络提升3D物体检测的精度与效率。

Comments Accepted by Pattern Recognition

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10934 2026-03-10 cs.DB cs.LG

Towards Practical Benchmarking of Data Cleaning Techniques: On Generating Authentic Errors via Large Language Models

面向数据清洗技术实用基准测试的探索:通过大语言模型生成真实错误

Xinyuan Liu, Jiahui Chen, Bocheng Hu, Yu Sun, Xinyang Chen, Shaoxu Song, Yongxin Tong

机构 * Nankai University(南开大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Tsinghua University(清华大学) Beihang University(北京航空航天大学)

AI总结 TableEG利用大语言模型生成真实错误,通过三元组表示和表格微调策略,提升数据清洗技术的基准测试效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23932 2026-03-10 cs.CL

SwingArena: Competitive Programming Arena for Long-context GitHub Issue Solving

SwingArena: 用于长上下文GitHub问题解决的竞争性编程竞技场

Wendong Xu, Jing Xiong, Chenyang Zhao, Qiujiang Chen, Haoran Wang, Hui Shen, Zhongwei Wan, Jianbo Dai, Taiqiang Wu, He Xiao, Chaofan Tao, Z. Morley Mao, Ying Sheng, Zhijiang Guo, Hongxia Yang, Bei Yu, Lingpeng Kong, Quanquan Gu, Ngai Wong

机构 * The University of Hong Kong(香港大学) University of California Los Angeles(加州大学洛杉矶分校) Tsinghua University(清华大学) University of Michigan Ann Arbor(密歇根大学安娜堡分校) The Ohio State University(俄亥俄州立大学) University of Edinburgh(爱丁堡大学) The Chinese University of Hong Kong(香港中文大学) The Hong Kong Polytechnic University(香港理工大学) Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) LMSYS Org(LMSYS组织)

AI总结 SwingArena是一个用于评估LLM在真实CI驱动软件开发环境中性能的竞争性编程竞技场,通过模拟软件迭代过程,结合检索增强型代码生成模块,实现对长上下文问题的高效处理。

Comments The paper has been accepted as an oral presentation at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14357 2026-03-10 cs.CV cs.LG

Vid2World: Crafting Video Diffusion Models to Interactive World Models

Vid2World: 构建视频扩散模型以交互式世界模型

Siqiao Huang, Jialong Wu, Qixing Zhou, Shangchen Miao, Mingsheng Long

机构 * Tsinghua University(清华大学) Chongqing University(重庆大学)

AI总结 Vid2World通过因果化视频扩散模型,提升其在交互式世界建模中的可控性和生成能力,适用于机器人操作、游戏模拟和开放世界导航等多种领域。

Comments Project page: http://knightnemo.github.io/vid2world/

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09587 2026-03-10 cs.RO

GeoNav: Empowering MLLMs with dual-scale geospatial reasoning for language-goal aerial navigation

GeoNav: 通过双尺度地理推理赋能大语言模型实现语言目标的空中导航

Haotian Xu, Yue Hu, Chen Gao, Zhengqiu Zhu, Yong Zhao, Yong Li, Quanjun Yin

机构 * College of Systems Engineering, National University of Defense Technology(系统工程学院,国防科技大学) State Key Laboratory of Digital Intelligent Modeling and Simulation(数字智能建模与仿真国家重点实验室) BNRist, Tsinghua University(清华大学BNRist)

AI总结 GeoNav通过双尺度地理推理赋能大语言模型,实现语言目标的空中导航,提升城市场景下的导航成功率和精度。

Comments Published in Pattern Recognition (2026)

Journal ref Pattern Recognition, Volume 177, 113365, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19747 2026-03-10 cs.CL cs.AR

HaLoRA: Hardware-aware Low-Rank Adaptation for Large Language Models Based on Hybrid Compute-in-Memory Architecture

HaLoRA: 基于混合计算-内存架构的硬件感知低秩适应法用于大型语言模型

Taiqiang Wu, Chenchen Ding, Wenyong Zhou, Yuxin Cheng, Xincheng Feng, Shuqi Wang, Wendong Xu, Chufan Shi, Zhengwu Liu, Ngai Wong

机构 * The University of Hong Kong(香港大学) Tsinghua University(清华大学)

AI总结 HaLoRA通过在混合计算-内存架构中部署低秩适应,利用RRAM和SRAM实现高效能和高精度的LLM微调。

Comments 22 pages, Accepted by TODAES (ACM Transactions on Design Automation of Electronic Systems)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.17635 2026-03-10 cs.CV

LangSurf: Language-Embedded Surface Gaussians for 3D Scene Understanding

LangSurf: 语言嵌入的表面高斯用于3D场景理解

Hao Li, Minghan Qin, Zhengyu Zou, Diqi He, Xinhao Ji, Bohan Li, Bingquan Dai, Dingewn Zhang, Junwei Han

机构 * Brain and Artificial Intelligence Lab, Northwestern Polytechnical University(脑科学与人工智能实验室,西北工业大学) Tsinghua University(清华大学) Shanghai Jiaotong University(上海交通大学) Peking University(北京大学) School of Artifical Intelligence, Chongqing University of Posts and Telecommunications(人工智能学院,重庆邮电大学)

AI总结 LangSurf通过语言嵌入的表面高斯实现3D场景理解,提升2D和3D分割精度,扩展了下游任务如去除和编辑。

Comments \url{https://langsurf.github.io}

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.08687 2026-03-10 cs.RO cs.LG

xTED: Cross-Domain Adaptation via Diffusion-Based Trajectory Editing

xTED: 通过扩散基于轨迹编辑实现跨域适应

Haoyi Niu, Qimao Chen, Tenglong Liu, Jianxiong Li, Guyue Zhou, Yi Zhang, Jianming Hu, Xianyuan Zhan

机构 * Tsinghua University(清华大学) National University of Defense Technology(国防科技大学)

AI总结 xTED通过扩散模型实现跨域轨迹编辑,有效弥合领域差距,提升数据真实性和动态可靠性,适用于多种下游策略学习任务。

Comments xTED offers a novel, generic, flexible, simple and effective paradigm that casts cross-domain policy adaptation as a data pre-processing problem

详情

展开后加载摘要…

URL PDF HTML 收藏