arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Tsinghua University(清华大学)

2026-03-11 至 2026-03-11 共收录 10
2603.09774 2026-03-11 cs.AI

World2Mind: Cognition Toolkit for Allocentric Spatial Reasoning in Foundation Models

World2Mind: 用于基础模型的方位认知工具包

Shouwei Ruan, Bin Wang, Zhenyu Wu, Qihui Zhu, Yuxiang Zhang, Hang Su, Yubin Wang

机构 * Institute of Artificial Intelligence, Beihang University(北京航空航天大学人工智能研究院) Huawei Noah’s Ark Lab(华为诺亚方舟实验室) Dept. of Comp. Sci. and Tech., Institute for AI, Tsinghua-Bosch Joint ML Center, THBI Lab, BNRist Center, Tsinghua University(清华大学人工智能院计算机科学与技术系、清华大学-博世联合机器学习中心、THBI实验室、BNRist中心、清华大学)

AI总结 World2Mind通过构建空间认知地图和三阶段推理链,提升基础模型的空间推理能力,使纯文本模型也能实现复杂3D空间推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09733 2026-03-11 cs.CV cs.MA

FetalAgents: A Multi-Agent System for Fetal Ultrasound Image and Video Analysis

FetalAgents:一种用于胎儿超声图像和视频分析的多智能体系统

Xiaotian Hu, Junwei Huang, Mingxuan Liu, Kasidit Anmahapong, Yifei Chen, Yitong Luo, Yiming Huang, Xuguang Bai, Zihan Li, Yi Liao, Haibo Qu, Qiyuan Tian

机构 * Tsinghua University(清华大学) University of California San Diego(加州大学圣地亚哥分校) West China Second University Hospital, Sichuan University(四川大学华西第二医院)

AI总结 FetalAgents是一种多智能体系统,通过动态协调视觉专家,实现胎儿超声图像和视频的端到端分析与报告,提供高准确性和流程对齐的解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09460 2026-03-11 cs.RO

SEA-Nav: Efficient Policy Learning for Safe and Agile Quadruped Navigation in Cluttered Environments

SEA-Nav: 高效安全敏捷四足机器人在密集环境中导航的策略学习

Shiyi Chen, Mingye Yang, Haiyan Mao, Jiaqi Zhang, Haiyi Liu, Shuheng He, Debing Zhang, Zihao Qiu, Chun Zhang

机构 * Tsinghua University(清华大学) Imperial College London(伦敦帝国理工学院)

AI总结 SEA-Nav通过安全、高效和敏捷的强化学习框架,实现了在密集环境中四足机器人导航的高效训练,仅需分钟级训练时间。

Comments Project website: https://11chens.github.io/sea-nav/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09218 2026-03-11 cs.RO cs.AI

Embodied Human Simulation for Quantitative Design and Analysis of Interactive Robotics

具身人类仿真用于交互机器人定量设计与分析

Chenhui Zuo, Jinhao Xu, Michael Qian Vergnolle, Yanan Sui

机构 * School of Aerospace Engineering, Tsinghua University(清华大学航天航空学院)

AI总结 本文提出了一种基于仿真的具身人类仿真框架,用于交互机器人设计中的定量分析与优化,通过生理学基础的运动行为生成和大规模设计空间探索,提升人机交互的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24146 2026-03-11 cs.CV

Taming Preference Mode Collapse via Directional Decoupling Alignment in Diffusion Reinforcement Learning

通过方向解耦对齐缓解偏好模式崩溃在扩散强化学习中

Chubin Chen, Sujie Hu, Jiashu Zhu, Meiqi Wu, Jintao Chen, Yanxun Li, Nisha Huang, Chengyu Fang, Jiahong Wu, Xiangxiang Chu, Xiu Li

机构 * Tsinghua University(清华大学) AMAP, Alibaba Group(阿里云实验室,阿里巴巴集团)

AI总结 本文提出D²-Align框架,通过方向解耦对齐缓解扩散强化学习中的偏好模式崩溃,提升生成多样性。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11648 2026-03-11 cs.LG cs.AI

Lightweight Time Series Data Valuation on Time Series Foundation Models via In-Context Finetuning

基于上下文微调的轻量时间序列数据估值方法

Shunyu Wu, Tianyue Li, Yixuan Leng, Jingyi Suo, Jian Lou, Dan Li, See-Kiong Ng

机构 * Sun Yat-sen University State Key Laboratory of Internet Architecture(中山大学互联网架构国家重点实验室) Tsinghua University(清华大学) National University of Singapore(新加坡国立大学)

AI总结 本文提出LTSV方法,通过上下文微调实现轻量时间序列数据估值,有效解决传统方法的计算瓶颈和时间依赖性问题。

Comments Accepted as a full paper at DASFAA 2026 (The 31st International Conference on Database Systems for Advanced Applications)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06702 2026-03-11 cs.CV

SPAN: Spatial-Projection Alignment for Monocular 3D Object Detection

SPAN: 用于单目3D目标检测的空间-投影对齐

Yifan Wang, Yian Zhao, Fanqi Pu, Xiaochen Yang, Yang Tang, Xi Chen, Wenming Yang

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) School of Electronic and Computer Engineering, Peking University(北京大学电子与计算机工程学院) School of Mathematics and Statistics, University of Glasgow(格拉斯哥大学数学与统计学学院) Basic Algorithm Center, PCG, Tencent(腾讯计算机系统有限公司基础算法中心)

AI总结 SPAN通过空间点对齐和3D-2D投影对齐解决单目3D目标检测中几何一致性不足的问题,提升检测性能。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25896 2026-03-11 cs.CV

LLaVAShield: Safeguarding Multimodal Multi-Turn Dialogues in Vision-Language Models

LLaVAShield: 保障视觉语言模型中的多模态多轮对话安全

Guolei Huang, Qinzhi Peng, Gan Xu, Yao Huang, Yuxuan Lu, Yongjun Shen

机构 * Southeast University(东南大学) University of California, Santa Cruz(加州大学圣克鲁兹分校) Zhejiang University of Technology(浙江工业大学) Tsinghua University(清华大学) RealAI

AI总结 LLaVAShield通过构建MMDS数据集和MMRT框架,有效提升多模态多轮对话的安全性,优于现有VLMs和内容审查工具,揭示了主流模型的安全漏洞。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06067 2026-03-11 cs.LG

A Surrogate model for High Temperature Superconducting Magnets to Predict Current Distribution with Neural Network

一种基于神经网络的代理模型用于预测高温超导磁体中的电流分布

Mianjun Xiao, Peng Song, Yulong Liu, Cedric Korte, Ziyang Xu, Jiale Gao, Jiaqi Lu, Haoyang Nie, Qiantong Deng, Timing Qu

机构 * State Key Laboratory of Clean and Efficient Turbomachinery Power Equipment, Department of Mechanical Engineering, Tsinghua University(清洁高效 turbomachinery 动力设备国家重点实验室,机械工程系,清华大学) Key Laboratory for Advanced Materials Processing Technology, Ministry of Education(先进材料加工技术重点实验室,教育部)

AI总结 本文提出一种基于神经网络的代理模型,用于高效预测高温超导磁体中的电流分布,提升大尺寸磁体设计效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16368 2026-03-11 cs.LG cs.AI

SATURN: SAT-based Reinforcement Learning to Unleash LLMs Reasoning

SATURN: 基于求解的强化学习以释放大语言模型的推理能力

Huanyu Liu, Ge Li, Jia Li, Hao Zhu, Kechi Zhang, Yihong Dong

机构 * Peking University(北京大学) Tsinghua University(清华大学)

AI总结 Saturn通过基于SAT问题的强化学习框架,提升大语言模型的推理能力,实现可扩展的任务构建、规则验证和难度控制,取得显著效果。

Comments Camera-ready version for Neural Information Processing Systems (NeurIPS) 2025, Spotlight Paper

详情

展开后加载摘要…

URL PDF HTML 收藏