arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Tsinghua University(清华大学)

2026-03-18 至 2026-03-18 共收录 18
2603.16866 2026-03-18 cs.RO cs.AI cs.GR cs.LG cs.SE

ManiTwin: Scaling Data-Generation-Ready Digital Object Dataset to 100K

ManiTwin:将数据生成-ready的数字对象数据集扩展到10万

Kaixuan Wang, Tianxing Chen, Jiawei Liu, Honghao Su, Shaolong Zhu, Minxuan Wang, Zixuan Li, Yue Chen, Huan-ang Gao, Yusen Qin, Jiawei Wang, Qixuan Zhang, Lan Xu, Jingyi Yu, Yao Mu, Ping Luo

机构 * The University of Hong Kong(香港大学) Xspark AI Deemos Tech Shanghai Jiao Tong University(上海交通大学) ShanghaiTech University(上海交通大学) University of California, San Diego(加州大学圣地亚哥分校) D-Robotics Peking University(北京大学) Tsinghua University(清华大学) Shenzhen University(深圳大学)

AI总结 本文提出ManiTwin,一种高效生成数据生成-ready数字对象双胞胎的自动化流程,构建了包含10万高质量标注3D资产的ManiTwin-100K数据集,为大规模仿真数据合成和策略学习提供基础。

Comments Website: https://manitwin.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16800 2026-03-18 cs.LG

RaDAR: Relation-aware Diffusion-Asymmetric Graph Contrastive Learning for Recommendation

RaDAR: 关系感知的扩散非对称图对比学习用于推荐系统

Yixuan Huang, Jiawei Chen, Shengfan Zhang, Zongsheng Cao

机构 * University of Electronic Science and Technology of China(电子科技大学) National University of Defense Technology(国防科技大学) Tsinghua University(清华大学)

AI总结 RaDAR通过结合图生成模型和关系感知去噪模型,解决图对比学习中边扰动和数据稀疏的问题,提升推荐系统在噪声和稀疏条件下的性能。

Comments 12 pages, 5 figures. Accepted at WWW 2026

Journal ref Proceedings of the ACM Web Conference (WWW), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15633 2026-03-18 cs.AI

Neural-Symbolic Logic Query Answering in Non-Euclidean Space

非欧空间中的神经符号逻辑查询回答

Lihui Liu

机构 * Institute for Clarity in Documentation(清晰文档研究所) Inria Paris-Rocquencourt(巴黎-罗克琴堡研究所) Rajiv Gandhi University(拉朱·甘地大学) Tsinghua University(清华大学) Palmer Research Laboratories(帕勒尔研究实验室)

AI总结 本文提出HYQNET模型,通过超几何空间提升逻辑查询推理能力,结合符号与神经方法,有效处理知识图谱中的缺失链接问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16671 2026-03-18 cs.CV

$x^2$-Fusion: Cross-Modality and Cross-Dimension Flow Estimation in Event Edge Space

$x^2$-Fusion:事件边缘空间中的跨模态和跨维度流估计

Ruishan Guo, Ciyu Ruan, Haoyang Wang, Zihang Gong, Jingao Xu, Xinlei Chen

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Harbin Institute of Technology(哈尔滨工业大学) The University of Hong Kong(香港大学)

AI总结 本文提出$x^2$-Fusion方法,通过事件边缘空间实现跨模态和跨维度流的统一表示,提升动态场景理解的准确性和鲁棒性。

Comments This version is the camera-ready version accepted at CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16620 2026-03-18 cs.CV

TCATSeg: A Tooth Center-Wise Attention Network for 3D Dental Model Semantic Segmentation

TCATSeg:一种针对3D牙科模型语义分割的牙齿中心导向注意力网络

Qiang He, Wentian Qu, Jiajia Dai, Changsong Lei, Shaofeng Wang, Feifei Zuo, Yajie Wang, Yaqian Liang, Xiaoming Deng, Cuixia Ma, Yong-Jin Liu, Hongan Wang

机构 * Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) University of Chinese Academy of Sciences(中国科学院大学) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) Beijing Stomatological Hospital, Capital Medical University(首都医科大学北京 stomatological Hospital) LargeV Instrument Corporation, Ltd.(LargeV仪器有限公司)

AI总结 本文提出TCATSeg网络,结合局部几何特征与全局语义上下文,通过引入物理意义的稀疏超点提升分割精度,并通过400个牙科模型数据集验证方法有效性。

Comments 6 pages, 4 figures, ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16596 2026-03-18 cs.CV cs.AI

FSMC-Pose: Frequency and Spatial Fusion with Multiscale Self-calibration for Cattle Mounting Pose Estimation

FSMC-Pose:基于多尺度自校准的频率与空间融合用于牛交配姿态估计

Fangjing Li, Zhihai Wang, Xinxin Ding, Haiyang Liu, Ronghua Gao, Rong Wang, Yao Zhu, Ming Jin

机构 * Beijing Jiaotong University(北京交通大学) NERCITA Tsinghua University(清华大学) Griffith University(格里菲斯大学)

AI总结 本文提出FSMC-Pose框架,通过轻量级频率-空间融合骨干网络、CattleMountNet和多尺度自校准头SC2Head,有效解决牛交配姿态估计中的复杂背景和动物遮挡问题,实现高精度低开销的实时估计。

Comments 10 pages, 6 figures. Accept by CVPR2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16542 2026-03-18 cs.RO

Conservative Offline Robot Policy Learning via Posterior-Transition Reweighting

通过后过渡重加权实现保守的离线机器人策略学习

Wanpeng Zhang, Hao Luo, Sipeng Zheng, Yicheng Feng, Haiweng Xu, Ziheng Xi, Chaoyi Xu, Haoqi Yuan, Zongqing Lu

机构 * Peking University(北京大学) Tsinghua University(清华大学) BeingBeyond

AI总结 本文提出PTR方法,通过后验过渡重加权实现保守的离线机器人策略学习,根据样本后作用后果的可归因性分配信用,提升对异质机器人数据的适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16417 2026-03-18 cs.AI

Via Negativa for AI Alignment: Why Negative Constraints Are Structurally Superior to Positive Preferences

通过否定来实现AI对齐:为什么否定约束在结构上优于积极偏好

Quan Cheng

机构 * Tsinghua University(清华大学)

AI总结 本文探讨了通过否定约束而非积极偏好进行AI对齐的结构优势,提出基于波普尔的证伪逻辑,指出否定信号方法在避免趋炎附势和提升效果上的有效性。

Comments 9 pages, position paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16373 2026-03-18 cs.CV

Semantic One-Dimensional Tokenizer for Image Reconstruction and Generation

语义一维分词器用于图像重建与生成

Yunpeng Qu, Kaidong Zhang, Yukang Ding, Ying Chen, Jian Wang

机构 * Tsinghua University, Beijing, China(清华大学,北京,中国) Alibaba Group, Beijing, China(阿里巴巴集团,北京,中国)

AI总结 本文提出SemTok,一种语义一维分词器,通过压缩2D图像为1D离散token实现高效图像重建,采用三重创新框架提升生成效果。

Comments 18 pages,12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16001 2026-03-18 cs.CV cs.CL cs.LG

Mostly Text, Smart Visuals: Asymmetric Text-Visual Pruning for Large Vision-Language Models

大部分文本,智能视觉:不对称文本-视觉剪枝用于大型视觉-语言模型

Sijie Li, Biao Qian, Jungong Han

机构 * University of Sheffield, UK(英国谢菲尔德大学) Tsinghua University, China(清华大学)

AI总结 本文提出不对称文本-视觉剪枝方法,通过解耦文本和视觉token的权重,发现文本路径需用文本token校准,视觉路径可实现50%稀疏率,验证了其在多模态基准上的优越性。

Comments CVPR 2026. Code available here: https://github.com/LezJ/ATV-Pruning

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15238 2026-03-18 cs.AI

Why the Valuable Capabilities of LLMs Are Precisely the Unexplainable Ones

为何大语言模型的宝贵能力恰恰是无法解释的那些

Quan Cheng

机构 * Tsinghua University(清华大学)

AI总结 本文提出论点:大语言模型真正有价值的能力恰恰是无法用人类可读的离散规则完全描述的部分。通过专家系统等价性证明,若LLM能力可被规则完全描述,则等同于专家系统,但专家系统在历史上和实证上均弱于LLM,从而产生矛盾。

Comments 12 pages, v2: added correction to Polanyi on why tacit knowledge is tacit (structural vs quantitative), unified three independent intellectual threads (Smolensky, Dreyfus, dynamical systems theory)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05551 2026-03-18 cs.IR cs.CV

AutothinkRAG: Complexity-Aware Control of Retrieval-Augmented Reasoning for Image-Text Interaction

AutothinkRAG: 多模态文档问答中检索增强推理的复杂度感知控制

Jiashu Yang, Chi Zhang, Abudukelimu Wuerkaixi, Xuxin Cheng, Cao Liu, Ke Zeng, Xu Jia, Xunliang Cai

机构 * Dalian University of Technology(大连理工大学) Tsinghua University(清华大学) Meituan LongCat Interaction Team(美团LongCat交互团队)

AI总结 本文提出AutoThinkRAG,通过查询复杂度路由器和感知-推理解耦架构,提升多模态文档问答的效率与鲁棒性,实验表明在DocBench和MMLongBench上准确率提升,且降低计算与成本消耗。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11237 2026-03-18 cs.CV cs.GR

WildCap: Facial Albedo Capture in the Wild via Hybrid Inverse Rendering

WildCap:通过混合反向渲染实现野外面部铝含量捕获

Yuxuan Han, Xin Ming, Tianxiao Li, Zhuofan Shen, Qixuan Zhang, Lan Xu, Feng Xu

机构 * School of Software and BNRist, Tsinghua University(软件学院和BNRist,清华大学) ShanghaiTech University(上海科技大学) Deemos Technology(德摩斯技术)

AI总结 本文提出WildCap,一种通过混合反向渲染在野外从手机视频中实现高质量面部铝含量捕获的方法,解决了复杂光照下的铝含量分离问题。

Comments CVPR 2026. project page: https://yxuhan.github.io/WildCap/index.html; code: https://github.com/yxuhan/WildCap

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19117 2026-03-18 cs.CV physics.optics

3M-TI: High-Quality Mobile Thermal Imaging via Calibration-free Multi-Camera Cross-Modal Diffusion

3M-TI: 通过无校准多相机跨模态扩散实现高质量移动热成像

Minchong Chen, Xiaoyun Yuan, Junzhe Wan, Jianing Zhang, Jun Zhang

机构 * MoE Key Lab of Artificial Intelligence, AI Institute, Shanghai Jiao Tong University(人工智能联合实验室,人工智能研究院,上海交通大学) School of Computer Science, Shanghai Jiao Tong University(计算机科学学院,上海交通大学) Fudan University(复旦大学) Tsinghua University(清华大学)

AI总结 本文提出3M-TI,一种无需校准的多相机跨模态扩散框架,通过跨模态自注意力模块提升热成像的分辨率和细节,验证其在实际应用中的优越性能。

Comments Accepted by CVPR 2026, Code: https://github.com/work-submit/3MTI, Project page: https://lab.xiaoyunyuan.net/index.html?project=3m-ti

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.03442 2026-03-18 cs.CV

High-Quality Facial Geometry and Appearance Capture at Home

在家中的高质量面部几何与外观捕捉

Yuxuan Han, Junfeng Lyu, Feng Xu

机构 * School of Software and BNRist, Tsinghua University(软件学院和BNRist,清华大学)

AI总结 本文提出了一种易用的系统,能够在暗室中通过手机闪光灯序列捕捉高质量的完整面部模型,包括皮肤、口腔、头发和眼睛。

Comments CVPR 2024. Project page: https://yxuhan.github.io/CoRA/index.html ; Github repo: https://github.com/yxuhan/CoRA

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.02007 2026-03-18 cs.RO cs.SY eess.SY

Mixed Cloud Control Testbed: Validating Vehicle-Road-Cloud Integration via Mixed Digital Twin

混合云控制测试床:通过混合数字孪生验证车辆-道路-云集成

Jianghong Dong, Qing Xu, Jiawei Wang, Chunying Yang, Mengchi Cai, Chaoyi Chen, Jianqiang Wang, Keqiang Li

机构 * Tsinghua University-Didi Joint Research Center for Future Mobility(清华大学-滴滴未来移动联合研究中心) Beihang University(北航) Beijing Idriverplus Technology Co., Ltd.(北京 Idriverplus 技术有限公司) Dongfeng Automobile Co., Ltd.(东风汽车有限公司)

AI总结 本文提出混合云控制测试床,通过混合数字孪生技术验证车辆-道路-云集成,展示了多车辆协同的灵活性和可扩展性。

Comments 13 pages, 13 figures

Journal ref 2023 in IEEE Transactions on Intelligent Vehicles

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15724 2026-03-18 cs.LG cs.AI

Meta-TTRL: A Metacognitive Framework for Self-Improving Test-Time Reinforcement Learning in Unified Multimodal Models

Meta-TTRL:一种用于统一多模态模型中自改进测试时间强化学习的元认知框架

Lit Sin Tan, Junzhe Chen, Xiaolong Fu, Lichen Ma, Junshi Huang, Jianzhong Shi, Yan Li, Lijie Wen

机构 * Tsinghua University(清华大学)

AI总结 Meta-TTRL通过元认知信号实现测试时间参数优化,提升统一多模态模型的自改进能力,在文本到图像生成任务中取得显著成果。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15690 2026-03-18 cs.SE cs.AI

Loosely-Structured Software: Engineering Context, Structure, and Evolution Entropy in Runtime-Rewired Multi-Agent Systems

松散结构软件:运行时重 wiring 多智能体系统的工程上下文、结构与进化熵

Weihao Zhang, Yitong Zhou, Huanyu Qu, Hongyi Li

机构 * The Hong Kong University of Science and Technology(香港科技大学) AI Chip Center for Emerging Smart Systems(新兴智能系统人工智能芯片中心) University of Macau(澳门大学) Tsinghua University(清华大学)

AI总结 本文提出松散结构软件,通过运行时熵管理提升多智能体系统的可设计性、可扩展性和可进化性。

详情

展开后加载摘要…

URL PDF HTML 收藏