arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Tsinghua University(清华大学)

共收录 4556
2603.06542 2026-03-09 cs.SD cs.AI

RAMoEA-QA: Hierarchical Specialization for Robust Respiratory Audio Question Answering

RAMoEA-QA:面向呼吸音频问答的分层专业化

Gaia A. Bertolino, Yuwei Zhang, Tong Xia, Domenico Talia, Cecilia Mascolo

机构 * University of Cambridge(剑桥大学) Tsinghua University(清华大学) University of Calabria(卡拉布里亚大学)

AI总结 RAMoEA-QA通过分层专业化机制,统一处理多种呼吸音频问答任务,提升在不同领域和任务转换下的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06530 2026-03-09 cs.CV

AV-Unified: A Unified Framework for Audio-visual Scene Understanding

AV-Unified: 一个用于音频-视觉场景理解的统一框架

Guangyao Li, Xin Wang, Wenwu Zhu

机构 * Department of Computer Science and Technology, Tsinghua University(计算机科学与技术系,清华大学) Beijing National Research Center for Information Science and Technology(北京信息科学与技术国家研究中心)

AI总结 AV-Unified提出一个统一框架,通过多尺度时空感知网络和跨模态指导模块,实现音频-视觉场景理解任务的联合学习和高效处理。

Comments Accepted by IEEE Transactions on Multimedia (TMM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06280 2026-03-09 cs.RO

SuperSuit: An Isomorphic Bimodal Interface for Scalable Mobile Manipulation

SuperSuit:一种用于可扩展移动操作的同构双模接口

Tongqing Chen, Hang Wu, Jiasen Wang, Xiaotao Li, Zhu Jin, Lu Fang

机构 * Tsinghua University(清华大学) TARS Robotics(TARS机器人)

AI总结 SuperSuit 提出了一种双模数据采集框架,通过同构运动学接口实现移动机械臂的高效长周期演示和策略训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06049 2026-03-09 cs.CV cs.RO

Devil is in Narrow Policy: Unleashing Exploration in Driving VLA Models

魔鬼在窄政策中:解锁驾驶VLA模型的探索

Canyu Chen, Yuguang Yang, Zhewen Tan, Yizhi Wang, Ruiyi Zhan, Haiyan Liu, Xuanyao Mao, Jason Bao, Xinyue Tang, Linlin Yang, Bingchuan Sun, Yan Wang, Baochang Zhang

机构 * National Superior College for Engineers, Beihang University(北京航空航天大学工程师学院) School of Electronic Information Engineering, Beihang University(北京航空航天大学电子信息工程学院) Institute for AI Industry Research, Tsinghua University(清华大学人工智能产业研究院) Lenovo Group Limited(联想集团有限公司) State Key Laboratory of Media Convergence and Communication, Communication University of China(中国传媒大学媒体融合与传播国家重点实验室)

AI总结 Curious-VLA通过双阶段设计缓解探索-利用困境,提升驾驶VLA模型的探索潜力,实现Navsim基准的最优性能。

Comments Accepted by CVPR2026 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05804 2026-03-09 cs.RO

CDF-Glove: A Cable-Driven Force Feedback Glove for Dexterous Teleoperation

CDF-Glove: 一种用于灵巧遥控操作的电缆驱动力反馈手套

Huayue Liang, Ruochong Li, Yaodong Yang, Long Zeng, Yuanpei Chen, Xueqian Wang

机构 * Center for Artificial Intelligence and Robotics, Shenzhen International Graduate School, Tsinghua University(人工智能与机器人中心,深圳国际研究生院,清华大学) PKU-Psibot Joint Lab(北京大学-PsiBot联合实验室) Department of Advanced Manufacturing, Shenzhen International Graduate School, Tsinghua University(先进制造系,深圳国际研究生院,清华大学)

AI总结 CDF-Glove是一种低成本的电缆驱动力反馈手套,通过实时力反馈提升灵巧遥控操作的演示质量和任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05567 2026-03-09 cs.LG

FuseDiff: Symmetry-Preserving Joint Diffusion for Dual-Target Structure-Based Drug Design

FuseDiff: 保留对称性的双目标结构导向药物设计联合扩散

Jianliang Wu, Anjie Qiao, Zhen Wang, Zhewei Wei, Sheng Chen

机构 * Sun Yat-sen University(中山大学) Renmin University of China(中国人民大学) Tsinghua University(清华大学)

AI总结 FuseDiff通过端到端扩散模型联合生成双目标结合姿态,保留对称性并实现高精度药物设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05355 2026-03-09 cs.RO

OmniDP: Beyond-FOV Large-Workspace Humanoid Manipulation with Omnidirectional 3D Perception

OmniDP: 在超广角大工作空间中实现人形机器人的全方位3D感知

Pei Qu, Zheng Li, Yufei Jia, Ziyun Liu, Liang Zhu, Haoang Li, Jinni Zhou, Jun Ma

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Tsinghua University(清华大学)

AI总结 OmniDP通过360度全景点云感知和时间感知注意力池化机制,实现人形机器人在大工作空间中的稳健操作,优于传统深度相机方法。

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05078 2026-03-09 cs.CV

MoRe: Motion-aware Feed-forward 4D Reconstruction Transformer

MoRe:面向运动的前馈4D重建Transformer

Juntong Fang, Zequn Chen, Weiqi Zhang, Donglin Di, Xuancheng Zhang, Chengmin Yang, Yu-Shen Liu

机构 * School of Software, Tsinghua University(软件学院,清华大学)

AI总结 MoRe通过注意力强制策略和分组因果注意力,高效重建动态3D场景,适用于实时应用。

Comments Accepted by CVPR 2026. Project page:https://hellexf.github.io/MoRe/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04992 2026-03-09 cs.CL

ThaiSafetyBench: Assessing Language Model Safety in Thai Cultural Contexts

ThaiSafetyBench: 评估泰语文化背景下语言模型的安全性

Trapoom Ukarapol, Nut Chukamphaeng, Kunat Pipatanakul, Pakhapoom Sarapat

机构 * SCB DataX(SCB数据X) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) SCBX R&D(SCBX研发部) SCB 10X

AI总结 本研究提出ThaiSafetyBench,通过泰语文化背景下的恶意提示评估语言模型安全性,发现闭源模型安全性更强,同时揭示了文化特定攻击的高风险。

Comments ICLR 2026 Workshop on Principled Design for Trustworthy AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10704 2026-03-09 cs.CV cs.RO

(MGS)$^2$-Net: Unifying Micro-Geometric Scale and Macro-Geometric Structure for Cross-View Geo-Localization

(MGS)$^2$-Net:融合微几何尺度与宏几何结构的跨视角地理定位

Minglei Li, Mengfan He, Chunyu Li, Chao Chen, Xingyu Shao, Ziyang Meng

机构 * Department of Precision Instrument, Tsinghua University, Beijing 100084, China(精密仪器系,清华大学,北京100084,中国)

AI总结 (MGS)$^2$-Net通过融合微几何尺度与宏几何结构,解决跨视角地理定位中的几何错位问题,实现高精度和鲁棒性的定位性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01719 2026-03-09 cs.CL

COMI: Coarse-to-fine Context Compression via Marginal Information Gain

COMI:通过边际信息增益的粗到细上下文压缩

Jiwei Tang, Shilei Liu, Zhicheng Zhang, Yujin Yuan, Libin Zheng, Wenbo Su, Bo Zheng

机构 * Tsinghua University(清华大学) Future Living Lab of Alibaba(阿里巴巴未来生活实验室) Sun Yat-sen University(中山大学)

AI总结 COMI通过边际信息增益实现粗到细的上下文压缩,在长上下文任务中提升压缩效率和语义保留能力。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16538 2026-03-09 cs.CV

OnlineSI: Taming Large Language Model for Online 3D Understanding and Grounding

OnlineSI: 通过大规模语言模型实现在线3D理解和定位

Zixian Liu, Zhaoxi Chen, Liang Pan, Ziwei Liu

机构 * Tsinghua University(清华大学) Nanyang Technological University(南洋理工大学) Shanghai AI Lab(上海人工智能实验室)

AI总结 OnlineSI通过整合3D点云与语义信息,提升大规模语言模型在动态环境中的空间理解和物体识别能力。

Comments Project Page: https://onlinesi.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11165 2026-03-09 cs.LG cs.AI cs.CL cs.CV

Maximizing Asynchronicity in Event-based Neural Networks

在事件驱动神经网络中最大化异步性

Haiqing Hao, Nikola Zubić, Weihua He, Zhipeng Sui, Davide Scaramuzza, Wenhui Wang

机构 * State Key Laboratory of Precision Measurement Technology and Instrument, Department of Precision Instrument, Tsinghua University(精密测量技术与仪器国家重点实验室,精密仪器系,清华大学) Robotics and Perception Group, University of Zurich(机器人与感知组,苏黎世大学)

AI总结 EVA通过借鉴语言建模技术,提出一种新的A2S框架,生成高表达性和通用性的事件特征,在识别和检测任务中表现出色。

Comments 22 pages, 7 figures, 15 tables, ICLR 2026 Camera Ready paper

Journal ref International Conference on Learning Representations (ICLR), Brazil, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09242 2026-03-09 cs.CV

NAMI: Efficient Image Generation via Bridged Progressive Rectified Flow Transformers

NAMI: 通过桥接渐进修正流变压器实现高效的图像生成

Yuhang Ma, Bo Cheng, Shanyuan Liu, Hongyi Zhou, Liebucha Wu, Dawei Leng, Yuhui Yin

机构 * AI Research(360人工智能研究院) Tsinghua University(清华大学)

AI总结 NAMI通过桥接渐进修正流变压器实现高效图像生成,减少推理时间64%,并提升多分辨率训练效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05454 2026-03-06 cs.CV

Beyond Scattered Acceptance: Fast and Coherent Inference for DLMs via Longest Stable Prefixes

超越零散接受:通过最长稳定前缀实现DLMs的快速且一致推理

Pengxiang Li, Joey Tsai, Hongwei Xue, Kunyu Shi, Shilin Yan

机构 * Alibaba Group(阿里巴巴集团) Tsinghua University(清华大学)

AI总结 通过最长稳定前缀调度器,提升DLMs推理速度3.4倍,同时保持输出质量。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13306 2026-03-06 cs.AI cs.CV

DAP: A Discrete-token Autoregressive Planner for Autonomous Driving

DAP:一种用于自动驾驶的离散令牌自回归规划器

Bowen Ye, Bin Zhang, Hang Zhao

机构 * Shanghai Qi Zhi Institute IIIS, Tsinghua University(上海启智研究院 IIIS,清华大学) Shanghai Jiaotong University(上海交通大学)

AI总结 DAP是一种基于离散令牌自回归的自动驾驶规划器,通过联合预测鸟瞰图语义和自身轨迹,实现高效且全面的表示学习,从而在开环和闭环指标上均取得优异性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05028 2026-03-06 cs.AI cs.CL

Survive at All Costs: Exploring LLM's Risky Behaviors under Survival Pressure

在生存压力下:探索LLM的冒险行为

Yida Lu, Jianwei Fang, Xuyang Shao, Zixuan Chen, Shiyao Cui, Shanshan Bian, Guangyao Su, Pei Ke, Han Qiu, Minlie Huang

机构 * The Conversational AI (CoAI) group, DCST, Tsinghua University(清华大学智能对话AI小组,DCST,清华大学) China Unicom Software Research Institute(中国联合软件研究所) University of Electronic Science and Technology of China(电子科技大学) Institute for Network Sciences and Cyberspace, Tsinghua University(清华大学网络科学与网络空间研究院)

AI总结 本文研究了在生存压力下LLM的冒险行为,通过现实案例和基准测试揭示其潜在风险及缓解方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04898 2026-03-06 cs.LG cs.NI

U-Parking: Distributed UWB-Assisted Autonomous Parking System with Robust Localization and Intelligent Planning

U-Parking:基于UWB的分布式自主泊车系统,具备稳健定位与智能规划

Yiang Wu, Qiong Wu, Pingyi Fan, Kezhi Wang, Wen Chen, Guoqiang Mao, Khaled B. Letaief

机构 * Jiangnan University(江南大学) Zhuhai Fudan Innovation Institute(珠海复旦创新研究院) Tsinghua University(清华大学) Brunel University of London(布鲁内尔大学) Shanghai Jiao Tong University(上海交通大学) Southeast University(东南大学) The Hong Kong University of Science and Technology(香港科学与技术大学)

AI总结 U-Parking通过整合大语言模型辅助规划、稳健定位与轨迹跟踪,实现具有挑战性的室内环境中的可靠自动化泊车。

Comments This paper has been accepted by infocom. The source code has been released at: https://github.com/qiongwu86/U-Parking

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16714 2026-03-06 cs.CV cs.AI

SceneCOT: Eliciting Grounded Chain-of-Thought Reasoning in 3D Scenes

SceneCOT: 在3D场景中引导链式推理

Xiongkun Linghu, Jiangyong Huang, Ziyu Zhu, Baoxiong Jia, Siyuan Huang

机构 * State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,BIGAI) Peking University(北京大学) Tsinghua University(清华大学)

AI总结 本文提出SCENECOT框架,通过分解复杂任务并构建视觉线索,首次在3D场景中实现 grounded 链式推理,提升场景理解的推理能力。

Comments Accepted by ICLR 2026. Project page: https://scenecot.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04395 2026-03-05 cs.LG physics.ao-ph

Accurate and Efficient Hybrid-Ensemble Atmospheric Data Assimilation in Latent Space with Uncertainty Quantification

在潜在空间中实现准确且高效的混合-集成大气数据同化与不确定性量化

Hang Fan, Juan Nathaniel, Yi Xiao, Ce Bian, Fenghua Ling, Ben Fei, Lei Bai, Pierre Gentine

机构 * Department of Earth and Environmental Engineering, School of Engineering and Applied Sciences, Climate School, Columbia University(地球与环境工程系,工程与应用科学学院,气候学院,哥伦比亚大学) Learning the Earth with Artificial Intelligence and Physics (LEAP) Center, Columbia University(人工智能与物理学习地球中心,哥伦比亚大学) Shanghai Artificial Intelligence Laboratory, Shanghai, China(上海人工智能实验室,上海,中国) The Chinese University of Hong Kong, Hong Kong, China(香港中文大学,香港,中国) Department of Computer Science and Technology, Tsinghua University, Beijing, China(计算机科学与技术系,清华大学,北京,中国)

AI总结 本文提出HLOBA方法,在潜在空间中实现高效准确的大气数据同化,结合贝叶斯更新与误差去相关性,提升预测与再分析能力。

Comments 23 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04363 2026-03-05 cs.RO

ManipulationNet: An Infrastructure for Benchmarking Real-World Robot Manipulation with Physical Skill Challenges and Embodied Multimodal Reasoning

ManipulationNet: 一个用于基于现实世界机器人操作的基准测试基础设施,包含物理技能挑战和具身多模态推理

Yiting Chen, Kenneth Kimble, Edward H. Adelson, Tamim Asfour, Podshara Chanrungmaneekul, Sachin Chitta, Yash Chitambar, Ziyang Chen, Ken Goldberg, Danica Kragic, Hui Li, Xiang Li, Yunzhu Li, Aaron Prather, Nancy Pollard, Maximo A. Roa-Garzon, Robert Seney, Shuo Sha, Shihefeng Wang, Yu Xiang, Kaifeng Zhang, Yuke Zhu, Kaiyu Hang

机构 * Rice University(里士大学) U.S. National Institute of Standards and Technology(美国国家标准与技术研究院) Massachusetts Institute of Technology(麻省理工学院) Karlsruhe Institute of Technology(卡尔斯鲁厄技术大学) Autodesk Research(Autodesk研究) University of California, Berkeley(加州大学伯克利分校) KTH Royal Institute of Technology(皇家理工学院) Tsinghua University(清华大学) Columbia University(哥伦比亚大学) ASTM International(美国材料与试验协会) Carnegie Mellon University(卡内基梅隆大学) German Aerospace Center (DLR)(德国航空航天中心) University of Texas at Dallas(德克萨斯大学达拉斯分校) University of Texas at Austin(德克萨斯大学奥斯汀分校) NVIDIA Research(NVIDIA研究)

AI总结 ManipulationNet通过标准化硬件和统一软件客户端,为机器人操作提供现实世界基准测试,促进物理技能和具身推理能力的系统性发展。

Comments 32 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04338 2026-03-05 cs.CV

ArtHOI: Articulated Human-Object Interaction Synthesis by 4D Reconstruction from Video Priors

ArtHOI: 通过视频先验进行4D重建的可变形人-物交互合成

Zihao Huang, Tianqi Liu, Zhaoxi Chen, Shaocong Xu, Saining Zhang, Lixing Xiao, Zhiguo Cao, Wei Li, Hao Zhao, Ziwei Liu

机构 * School of AIA, Huazhong University of Science and Technology(华中科技大学人工智能学院) the S-Lab, Nanyang Technological University (NTU)(南洋理工大学S实验室) the Beijing Academy of Artificial Intelligence (BAAI)(北京人工智能研究院) Zhejiang University (ZJU)(浙江大学) the Institute for AI Industry Research (AIR), Tsinghua University (THU)(清华大学人工智能产业研究院)

AI总结 ArtHOI通过4D重建从视频先验生成可变形人-物交互,提升接触精度和物理合理性。

Comments Project Page: https://arthoi.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04050 2026-03-05 cs.RO

HE-VPR: Height Estimation Enabled Aerial Visual Place Recognition Against Scale Variance

HE-VPR: 一种结合高度估计的空中视觉位置识别框架以应对尺度变化

Mengfan He, Xingyu Shao, Chunyu Li, Chao Chen, Liangzheng Sun, Ziyang Meng, Yuanqing Wu

机构 * Department of Precision Instrument, Tsinghua University(清华大学精密仪器系) School of Aerospace Engineering, Beijing Institute of Technology(北京理工大学航天工程学院) School of Instrumentation Science and Opto-electronics Engineering, Beijing Information Science and Technology University(北京信息科技大学仪器科学与光电工程学院) School of Intelligent Systems Engineering, Sun Yat-sen University(中山大学智能系统工程学院)

AI总结 HE-VPR通过结合高度估计与轻量级旁路适配器,实现了高效且可扩展的空中视觉位置识别,提升了在GNSS拒止环境下的实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03957 2026-03-05 cs.RO

ArthroCut: Autonomous Policy Learning for Robotic Bone Resection in Knee Arthroplasty

ArthroCut:膝关节置换术中机器人骨切除的自主策略学习

Xu Lu, Yiling Zhang, Wenquan Cheng, Longfei Ma, Fang Chen, Hongen Liao

机构 * School of Biomedical Engineering, Tsinghua University(清华大学生物医学工程学院) School of Biomedical Engineering, Shanghai Jiao Tong University(上海交通大学生物医学工程学院) Longwood Valley MedTech

AI总结 ArthroCut通过结合术前和术中数据,实现膝关节置换术中骨切除的自主策略学习,提升机器人手术的自主性和可解释性。

Comments Accepted for publication at the 2026 IEEE International Conference on Robotics and Automation (ICRA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03839 2026-03-05 cs.CV

All-in-One Image Restoration via Causal-Deconfounding Wavelet-Disentangled Prompt Network

通过因果去混淆小波解耦提示网络实现一站式图像恢复

Bingnan Wang, Bin Qin, Jiangmeng Li, Fanjiang Xu, Fuchun Sun, Hui Xiong

机构 * University of Chinese Academy of Sciences(中国科学院大学) Institute of Software, Chinese Academy of Science(中国科学院软件研究所) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) National Research Center for Information Science and Technology (BNRist)(国家信息科学与技术研究中心(BNRist)) Artificial Intelligence Thrust, The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)人工智能方向)

AI总结 本文提出CWP-Net,通过因果去混淆和小波解耦技术解决图像恢复中退化模式偏差和虚假相关性问题,提升恢复效果。

Comments Accepted by IEEE TIP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03825 2026-03-05 cs.CV cs.AI

From Narrow to Panoramic Vision: Attention-Guided Cold-Start Reshapes Multimodal Reasoning

从窄视场到全景视觉:基于注意力的冷启动重塑多模态推理

Ruilin Luo, Chufan Shi, Yizhen Zhang, Cheng Yang, Songtao Jiang, Tongkun Guan, Ruizhe Chen, Ruihang Chu, Peng Wang, Mingkun Yang, Yujiu Yang, Junyang Lin, Zhibo Yang

机构 * Tsinghua University(清华大学) University of South California(南加州大学) Qwen Team, Alibaba Group(通义实验室,阿里巴巴集团) University of California San Diego(南加州大学圣地亚哥分校) Zhejiang University(浙江大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出AVAR框架,通过视觉锚定与注意力引导提升多模态推理性能,实现7%的平均提升。

Comments ICLR 2026 Poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03792 2026-03-05 cs.CV cs.LG

TAP: A Token-Adaptive Predictor Framework for Training-Free Diffusion Acceleration

TAP:一种用于无训练扩散加速的令牌自适应预测框架

Haowei Zhu, Tingxuan Huang, Xing Wang, Tianyu Zhao, Jiexi Wang, Weifeng Chen, Xurui Peng, Fangmin Chen, Junhai Yong, Bin Wang

机构 * Tsinghua University(清华大学) ByteDance(字节跳动)

AI总结 TAP通过为每个令牌自适应选择预测器,实现无训练的扩散模型加速,提升生成效率并减少感知质量损失。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03781 2026-03-05 cs.AI

LifeBench: A Benchmark for Long-Horizon Multi-Source Memory

LifeBench: 一个用于长周期多源记忆的基准

Zihao Cheng, Weixin Wang, Yu Zhao, Ziyang Ren, Jiaxuan Chen, Ruiyang Xu, Shuai Huang, Yang Chen, Guowei Li, Mengshi Wang, Yi Xie, Ren Zhu, Zeren Jiang, Keda Lu, Yihong Li, Xiaoliang Wang, Liwei Liu, Cam-Tu Nguyen

机构 * Institute for Clarity in Documentation(清晰文档研究所) Inria Paris-Rocquencourt(巴黎-罗克琴库特研究所) Rajiv Gandhi University(拉贾夫·甘地大学) Tsinghua University(清华大学) Palmer Research Laboratories(帕勒尔研究实验室) State Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学) School of Artificial Intelligence, Nanjing University(人工智能学院,南京大学) Huawei Technologies Co., Ltd.(华为技术有限公司)

AI总结 Lifebench是一个用于长周期多源记忆的基准,通过密集连接的长周期事件模拟,推动AI代理在多样且时间延长的上下文中整合声明性和非声明性记忆推理。

Comments A total of 28 pages, 8 pages of main text, and 15 figures and tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03752 2026-03-05 cs.CL cs.AI

Confidence-Calibrated Small-Large Language Model Collaboration for Cost-Efficient Reasoning

置信度校准的小-大语言模型协作用于成本有效的推理

Chuang Zhang, Zizhen Zhu, Yihao Wei, Bing Tian, Junyi Liu, Henan Wang, Xavier Wang, Yaxiao Liu

机构 * Amazon Web Services(亚马逊网络服务) Tsinghua University(清华大学)

AI总结 COREA通过结合小型和大型语言模型,利用置信度校准提升推理效率,降低21.5%-16.8%成本,同时保持高准确率。

Comments Accepted to EACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03739 2026-03-05 cs.CV cs.AI

PROSPECT: Unified Streaming Vision-Language Navigation via Semantic--Spatial Fusion and Latent Predictive Representation

PROSPECT:通过语义-空间融合和潜在预测表示实现统一的流式视觉-语言导航

Zehua Fan, Wenqi Lyu, Wenxuan Song, Linge Zhao, Yifei Yang, Xi Wang, Junjie He, Lida Huang, Haiyan Liu, Bingchuan Sun, Guangjun Bao, Xuanyao Mao, Liang Xu, Yan Wang, Feng Gao

机构 * Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学) University of Adelaide(阿德莱德大学) Wuhan University(武汉大学) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Beijing Jiaotong University(北京交通大学) AIR Wuxi Innovation Center, Tsinghua University(清华大学无锡创新中心) Lenovo(联想集团)

AI总结 PROSPECT通过语义-空间融合和潜在预测表示,实现统一的流式视觉-语言导航,提升环境动态和空间结构的预测能力。

详情

展开后加载摘要…

URL PDF HTML 收藏