arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Tsinghua University(清华大学)

共收录 4556
2601.17058 2026-01-27 cs.DB cs.AI cs.CL cs.LG

Can LLMs Clean Up Your Mess? A Survey of Application-Ready Data Preparation with LLMs

大模型能帮你清理数据吗?基于大模型的应用级数据准备综述

Wei Zhou, Jun Zhou, Haoyu Wang, Zhenghao Li, Qikang He, Shaokun Han, Guoliang Li, Xuanhe Zhou, Yeye He, Chunwei Liu, Zirui Tang, Bin Wang, Shen Tang, Kai Zuo, Yuyu Luo, Zhenzhe Zheng, Conghui He, Jingren Zhou, Fan Wu

机构 * Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学) Microsoft Research(微软研究院) MIT CSAIL(麻省理工学院计算机科学与人工智能实验室) Shanghai AI Laboratory(上海人工智能实验室) Xiaohongshu Inc.(小红书公司) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Alibaba Group(阿里巴巴集团)

AI总结 本文综述了基于大语言模型的应用级数据准备方法,探讨了数据清洗、整合与丰富三大任务的技术、优势与局限,并提出了可扩展的大语言模型-数据系统和稳健评估协议的未来研究方向。

Comments Please refer to our repository for more details: https://github.com/weAIDB/awesome-data-llm

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17047 2026-01-27 cs.CV cs.LG eess.IV

A Contrastive Pre-trained Foundation Model for Deciphering Imaging Noisomics across Modalities

一种用于跨模态解码成像噪声组学的对比预训练基础模型

Yuanjie Gu, Yiqun Wang, Chaohui Yu, Ang Xuan, Fan Wang, Zhi Lu, Biqin Dong

机构 * College of Biomedical Engineering, Yiwu Research Institute, Fudan University, Shanghai, China(复旦大学生物医学工程学院) Department of Psychological and Cognitive Sciences, Tsinghua University, Beijing, China(清华大学心理学与认知科学系) Shanghai Innovation Institute, Shanghai, China(上海创新研究院) DAMO Academy, Alibaba Group, Beijing, China(阿里云达摩院) Hupan Laboratory, Hangzhou, Zhejiang, China(华平实验室)

AI总结 本文提出CoP基础模型,通过对比学习解码成像噪声,实现无需大量数据的高性能噪声分析,提升跨模态成像诊断的精度与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17021 2026-01-27 q-fin.PM cs.LG cs.MA

Regret-Driven Portfolios: LLM-Guided Smart Clustering for Optimal Allocation

后悔驱动的组合:LLM引导的智能聚类用于最优分配

Muhammad Abro, Hassan Jaleel

机构 * Lahore University of Management Sciences(拉合尔管理科学大学) Institute for Clarity in Documentation(文档清晰研究所) Inria Paris-Rocquencourt(巴黎-罗quant研究所) Rajiv Gandhi University(拉贾·甘地大学) Tsinghua University(清华大学) Palmer Research Laboratories(帕勒尔研究实验室)

AI总结 本文提出一种LLM引导的智能聚类方法,通过整合在线学习动态和市场情绪指标,构建高夏普比率的投资组合,实现优于传统基准的收益和风险控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16764 2026-01-26 eess.SY cs.LG cs.SY math.OC

ReLU Networks for Model Predictive Control: Network Complexity and Performance Guarantees

ReLU网络用于模型预测控制:网络复杂度与性能保证

Xingchen Li, Keyou You

机构 * Department of Automation, and Beijing National Research Center for Info. Sci. & Tech. (BNRist), Tsinghua University, Beijing 100084, China(自动化系,北京信息科学与技术国家研究中心(BNRist),清华大学,北京)

AI总结 本文提出基于投影的方法,建立状态依赖的Lipschitz连续性属性,并推导ReLU网络宽度和深度的显式界限,以保证MPC策略的闭环性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16547 2026-01-26 cs.SD cs.AI eess.AS

CORD: Bridging the Audio-Text Reasoning Gap via Weighted On-policy Cross-modal Distillation

CORD:通过加权在线跨模态蒸馏弥合音频-文本推理差距

Jing Hu, Danxiang Zhu, Xianlong Luo, Dan Zhang, Shuwei He, Yishu Lei, Haitao Zheng, Shikun Feng, Jingzhou He, Yu Sun, Hua Wu, Haifeng Wang

机构 * ERNIE Team, Baidu(百度ERNIE团队) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) College of Computer Science, Inner Mongolia University(内蒙古大学计算机学院)

AI总结 CORD通过加权在线跨模态蒸馏方法,有效弥合音频与文本推理之间的差距,提升音频条件推理能力。

Comments 13 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16520 2026-01-26 cs.CV cs.AI cs.CL

TangramPuzzle: Evaluating Multimodal Large Language Models with Compositional Spatial Reasoning

TangramPuzzle: 通过组合空间推理评估多模态大语言模型

Daixian Liu, Jiayi Kuang, Yinghui Li, Yangning Li, Di Yin, Haoyu Cao, Xing Sun, Ying Shen, Hai-Tao Zheng, Liang Lin, Philip S. Yu

机构 * Tsinghua University(清华大学) Sun-Yat Sen University(孙逸人大学) Tencent Youtu Lab(腾讯优图实验室) University of Illinois Chicago(伊利诺伊大学香槟分校)

AI总结 TangramPuzzle通过几何基准测试评估多模态大语言模型的组合空间推理能力,发现模型在匹配轮廓时忽视几何约束,导致碎片变形。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16506 2026-01-26 cs.CR cs.AI

SafeThinker: Reasoning about Risk to Deepen Safety Beyond Shallow Alignment

SafeThinker: 通过风险推理深化安全对齐

Xianya Fang, Xianying Luo, Yadong Wang, Xiang Chen, Yu Tian, Zequn Sun, Rui Liu, Jun Fang, Naiqiang Tan, Yuanning Cui, Sheng-Jun Huang

机构 * Nanjing University of Aeronautics and Astronautics(南京航空航天大学) Didi International Business Group(滴滴国际商务集团) Institute for AI, Tsinghua University(清华大学人工智能研究院) Nanjing University of Information Science & Technology(南京信息科学技术大学)

AI总结 SafeThinker通过动态分配防御资源,有效提升模型对伪装攻击的防御能力,同时保持实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16489 2026-01-26 cs.SE cs.AI cs.CL

EvoConfig: Self-Evolving Multi-Agent Systems for Efficient Autonomous Environment Configuration

EvoConfig:用于高效自主环境配置的自演化多智能体系统

Xinshuai Guo, Jiayi Kuang, Linyue Pan, Yinghui Li, Yangning Li, Hai-Tao Zheng, Ying Shen, Di Yin, Xing Sun

机构 * Tsinghua University(清华大学) Sun-Yat Sen University(孙逸人大学) Tencent Youtu Lab(腾讯优图实验室)

AI总结 EvoConfig通过自演化多智能体系统提升自主环境配置效率,实现更高成功率和更强调试能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16429 2026-01-26 cs.CV cs.AI

AlphaFace: High Fidelity and Real-time Face Swapper Robust to Facial Pose

AlphaFace: 高保真和实时的面部交换器,对面部姿态具有鲁棒性

Jongmin Yu, Hyeontaek Oh, Zhongtian Sun, Angelica I Aviles-Rivero, Moongu Jeon, Jinhong Yang

机构 * University of Cambridge(剑桥大学) University of Kent(肯特大学) Tsinghua University(清华大学) Gwangju Institute of Science and Technology(全州科学技术院) Inje University(庆北大学)

AI总结 AlphaFace通过结合视觉-语言模型和CLIP嵌入,实现高保真和实时的面部交换,提升对极端面部姿态的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16035 2026-01-26 cs.RO

Collision-Free Humanoid Traversal in Cluttered Indoor Scenes

无碰撞的人形机器人在杂乱室内场景中的移动

Han Xue, Sikai Liang, Zhikai Zhang, Zicheng Zeng, Yun Liu, Yunrui Lian, Jilong Wang, Qingtao Liu, Xuesong Shi, Li Yi

机构 * Tsinghua University(清华大学) Tongji University(同济大学) Galbot Shanghai Qi Zhi Institute(上海启智研究院) South China University of Technology(华南理工大学) Peking University(北京大学) Zhejiang University(浙江大学)

AI总结 提出HumanoidPF势场方法,通过混合场景生成实现人形机器人在杂乱室内场景中的无碰撞移动,有效提升强化学习的训练效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13976 2026-01-26 cs.CV cs.RO

FantasyVLN: Unified Multimodal Chain-of-Thought Reasoning for Vision-Language Navigation

FantasyVLN: 一种统一的多模态链式推理框架用于视觉-语言导航

Jing Zuo, Lingzhou Mu, Fan Jiang, Chengcheng Ma, Mu Xu, Yonggang Qi

机构 * Fantasy AIGC Team(幻想AIGC团队) Beijing University of Posts and Telecommunications(北京邮电大学) Tsinghua University(清华大学)

AI总结 FantasyVLN通过统一的隐式推理框架实现视觉-语言导航的实时高效推理,结合多模态信息提升导航性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12856 2026-01-26 cs.AI cs.LG

Mining Citywide Dengue Spread Patterns in Singapore Through Hotspot Dynamics from Open Web Data

通过开放网络数据挖掘新加坡城市登革热传播模式的热点动态

Liping Huang, Gaoxi Xiao, Stefan Ma, Hechang Chen, Shisong Tang, Flora Salim

机构 * Agency for Science, Technology and Research (A*STAR)(科技研究局) Nanyang Technological University(南洋理工大学) Jilin University(吉林大学) Tsinghua University(清华大学) University of New South Wales(新南威尔士大学)

AI总结 通过开放网络数据挖掘新加坡登革热传播模式,利用热点动态预测和验证传播动态,提升公共卫生规划与城市韧性。

Comments 9 pages, 9 figures. It's accepted by WWW 2026 Web4Good Track. To make accessible earlier, authors would like to put it on arxiv before the conference

Journal ref WWW 2026, i.e., The Web Conference 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10492 2026-01-26 cs.LG cs.AI

UACER: An Uncertainty-Adaptive Critic Ensemble Framework for Robust Adversarial Reinforcement Learning

UACER:一种用于鲁棒对抗强化学习的不确定性自适应批评者集合框架

Jiaxi Wu, Tiantian Zhang, Yuxing Wang, Yongzhe Chang, Xueqian Wang

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

AI总结 UACER通过多样化批评者集合和时间变化衰减不确定性机制,提升鲁棒对抗强化学习的稳定性与性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12176 2026-01-26 quant-ph cs.AI

Reinforcement Learning for Charging Optimization of Inhomogeneous Dicke Quantum Batteries

强化学习用于不均匀迪克量子电池的充电优化

Xiaobin Song, Siyuan Bai, Da-Wei Wang, Hanxiao Tao, Xizhe Wang, Rebing Wu, Benben Jiang

机构 * CFINS, Department of Automation, Beijing National Research Center for Information Science and Technology, Tsinghua University, Beijing, 100084, China(信息科学与技术北京国家研究中心,自动化系,清华大学,北京,100084,中国) School of Integrated Circuits, Tsinghua University, Beijing, 100084, China(集成电路学院,清华大学,北京,100084,中国)

AI总结 本文通过强化学习优化不均匀迪克量子电池的充电策略,在部分可观测条件下利用二阶相关性提升充电效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.05092 2026-01-26 cs.LG

Task Aware Dreamer for Task Generalization in Reinforcement Learning

面向任务泛化的任务感知梦者

Chengyang Ying, Xinning Zhou, Zhongkai Hao, Hang Su, Songming Liu, Dong Yan, Jun Zhu

机构 * Department of Computer Science and Technology(计算机科学与技术系) Beijing National Research Center for Information Science and Technology(北京信息科学国家研究中心) Tsinghua-Bosch Joint Center for Machine Learning, Institute for Artificial Intelligence(清华大学-博世联合机器学习中心,人工智能研究院) Tsinghua University(清华大学)

AI总结 本文提出任务感知梦者(TAD)方法,通过整合奖励引导的特征提升强化学习中任务泛化能力,尤其在高任务分布相关性任务中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.15635 2026-01-26 cs.LG cs.IR

Vertical Semi-Federated Learning for Efficient Online Advertising

垂直半联邦学习用于高效在线广告

Wenjie Li, Shu-Tao Xia, Jiangke Fan, Teng Zhang, Xingxing Wang

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

AI总结 本文提出垂直半联邦学习方法,通过联合特权学习框架解决传统垂直联邦学习在适用范围和实时服务中的局限,提升在线广告系统的效率和效果。

Comments TheWebConf 2026 short (proceedings). An earlier version was presented at the FL workshop of IJCAI 2023 (non-proceedings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15906 2026-01-23 cs.CV

Opening the Black Box: Preliminary Insights into Affective Modeling in Multimodal Foundation Models

揭开黑箱:多模态基础模型中情感建模的初步洞察

Zhen Zhang, Runhao Zeng, Sicheng Zhao, Xiping Hu

机构 * Shenzhen MSU-BIT University, Shenzhen, China(深圳MSU-BIT大学) Tsinghua University, Beijing, China(清华大学)

AI总结 本研究揭示多模态基础模型中情感建模的关键机制,发现前馈门控投影模块对情感理解和生成至关重要,通过参数高效调整实现高性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19849 2026-01-23 cs.DC cs.AI cs.LG cs.NI

UCCL-EP: Portable Expert-Parallel Communication

UCCL-EP:便携式专家并行通信

Ziming Mao, Yihan Zhang, Chihan Cui, Zhen Huang, Kaichao You, Zhongjie Chen, Zhiying Xu, Zhenyu Gu, Scott Shenker, Costin Raiciu, Yang Zhou, Ion Stoica

机构 * UC Berkeley(加州大学伯克利分校) UC Davis(加州大学戴维斯分校) UW–Madison(威斯康星大学麦迪逊分校) AMD(超威半导体) Tsinghua University(清华大学) Amazon Web Services(亚马逊网络服务) ICSI(信息与计算机科学研究所) Broadcom & University Politehnica of Bucharest(博通与布加勒斯特理工大学)

AI总结 UCCL-EP通过高吞吐量GPU-CPU控制通道和RDMA立即数据模拟,实现了在异构GPU和NIC平台上的高性能专家并行通信,提升了多个模型的训练和推理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00439 2026-01-23 cs.CL

UniAttn: Reducing Inference Costs via Softmax Unification for Post-Training LLMs

UniAttn: 通过Softmax统一降低推理成本以适应训练后的LLM

Yizhe Xiong, Wei Huang, Xin Ye, Hui Chen, Zijia Lin, Haoran Lian, Zhenpeng Su, Jungong Han, Guiguang Ding

机构 * School of Software, Tsinghua University(清华大学软件学院) School of Computer Science, Beijing University of Posts and Telecommunications(北京邮电大学计算机学院) Beihang University(北航) Department of Automation, Tsinghua University(清华大学自动化系)

AI总结 UniAttn通过统一Softmax操作降低训练后LLM的推理成本,同时保持性能。

Comments 8 pages, 6 figures. Preprint, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15267 2026-01-22 cs.CY cs.AI cs.CL

Evaluation of Large Language Models in Legal Applications: Challenges, Methods, and Future Directions

评估大型语言模型在法律应用中的表现:挑战、方法与未来方向

Yiran Hu, Huanghai Liu, Chong Wang, Kunran Li, Tien-Hsuan Wu, Haitao Li, Xinran Xu, Siqing Huo, Weihang Su, Ning Zheng, Siyuan Zheng, Qingyao Ai, Yun Liu, Renjun Bian, Yiqun Liu, Charles L. A. Clarke, Weixing Shen, Ben Kao

机构 * Tsinghua University(清华大学) The University of Hong Kong(香港大学) University of Waterloo(多伦多大学) Shanghai Jiaotong University(上海交通大学) Peking University(北京大学)

AI总结 本文探讨了大型语言模型在法律应用中的评估挑战与方法,分析了现有评估框架的局限性,并提出了未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15250 2026-01-22 cs.CV cs.RO

FlowSSC: Universal Generative Monocular Semantic Scene Completion via One-Step Latent Diffusion

FlowSSC: 通过一步潜在扩散实现通用生成单目语义场景补全

Zichen Xi, Hao-Xiang Chen, Nan Xue, Hongyu Yan, Qi-Yuan Feng, Levent Burak Kara, Joaquim Jorge, Qun-Ce Xu

机构 * Ant Group(蚂蚁集团) Tsinghua University(清华大学) Carnegie Mellon University(卡内基梅隆大学) Instituto Superior Técnico(里斯本大学理工学院)

AI总结 FlowSSC通过一步潜在扩散模型实现高效单目语义场景补全,显著提升性能并适用于自动驾驶系统。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14888 2026-01-22 cs.LG cs.AI cs.CL

What Makes Low-Bit Quantization-Aware Training Work for Reasoning LLMs? A Systematic Study

是什么使低比特量化感知训练在推理大语言模型中有效?一项系统研究

Keyu Lv, Manyi Zhang, Xiaobo Xia, Jingchen Ni, Shannan Yan, Xianzhi Yu, Lu Hou, Chun Yuan, Haoli Bai

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Huawei Technologies(华为技术有限公司) National University of Singapore(新加坡国立大学)

AI总结 本研究通过系统分析揭示了低比特量化感知训练在推理大语言模型中的有效性,提出优化工作流Reasoning-QAT,显著提升精度与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14695 2026-01-22 cs.LG cs.AI

CoScale-RL: Efficient Post-Training by Co-Scaling Data and Computation

CoScale-RL: 通过协同扩展数据与计算实现高效后期训练

Yutong Chen, Jiandong Gao, Ji Wu

机构 * Department of Electronic Engineering, Tsinghua University, Beijing, China(清华大学电子工程系) College of AI, Tsinghua University, Beijing, China(清华大学人工智能学院) Beijing National Research Center for Information Science(北京信息科学国家研究中心)

AI总结 CoScale-RL通过协同扩展数据与计算,提升大型推理模型的训练效率和推理能力。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14629 2026-01-22 math.OC cs.DS cs.LG

Online Linear Programming with Replenishment

具有补给的在线线性规划

Yuze Chen, Yuan Zhou, Baichuan Mo, Jie Ying, Yufei Ruan, Zhou Ye

机构 * Qiuzhen College, Tsinghua University, Beijing 100084, China(清华大学齐臻学院) Yau Mathematical Sciences Center & Department of Mathematical Sciences, Tsinghua University, Beijing 100084, China, Beijing Institute of Mathematical Sciences and Applications, Beijing 101408, China(清华大学尤数学科学中心及数学科学系) Bytedance Inc., 1199 Coleman Ave, San Jose, CA 95110, USA(字节跳动公司) Bytedance China, Aili Center, Cangqian Street, Yuhang District, Hangzhou, Zhejiang 310000, China(字节跳动中国)

AI总结 本文研究了具有补给的在线线性规划模型,提出新算法和分析,揭示了不同分布下最优后悔的边界,并展示了算法在实际应用中的优势。

Comments 63 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14339 2026-01-22 cs.CV cs.AI

CityCube: Benchmarking Cross-view Spatial Reasoning on Vision-Language Models in Urban Environments

CityCube:在城市环境中对视觉-语言模型的跨视角空间推理进行基准测试

Haotian Xu, Yue Hu, Zhengqiu Zhu, Chen Gao, Ziyou Wang, Junreng Rao, Wenhao Lu, Weishi Li, Quanjun Yin, Yong Li

机构 * College of Systems Engineering, National University of Defense Technology(系统工程学院,国防科技大学) State Key Laboratory of Digital Intelligent Modeling and Simulation(数字智能建模与仿真国家重点实验室) BNRist, Tsinghua University(清华大学北京研究院) Department of Electronic Engineering, Tsinghua University(电子工程系,清华大学)

AI总结 CityCube是一个用于评估视觉-语言模型在城市环境中跨视角空间推理能力的基准,通过多视角问答对揭示模型与人类表现的差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14270 2026-01-22 cs.CL cs.AI

Opening the Black Box: A Survey on the Mechanisms of Multi-Step Reasoning in Large Language Models

揭开黑箱:关于大语言模型多步推理机制的综述

Liangming Pan, Jason Liang, Jiaran Ye, Minglai Yang, Xinyuan Lu, Fengbin Zhu

机构 * Peking University(北京大学) Stanford University(斯坦福大学) Tsinghua University(清华大学) University of Arizona(亚利桑那大学) National University of Singapore(新加坡国立大学)

AI总结 本文综述了大语言模型多步推理机制,探讨了隐式和显式推理过程,并提出了未来研究方向。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14127 2026-01-21 cs.CV cs.CL

The Side Effects of Being Smart: Safety Risks in MLLMs' Multi-Image Reasoning

智能的副作用:MLLMs多图像推理中的安全风险

Renmiao Chen, Yida Lu, Shiyao Cui, Xuan Ouyang, Victor Shea-Jay Huang, Shumin Zhang, Chengwei Pan, Han Qiu, Minlie Huang

机构 * CoAI group, DCST, Tsinghua University(清华大学) Beihang University(北航) Tsinghua University(清华大学)

AI总结 研究发现,多图像推理能力越强的模型在安全测试中越容易产生不安全响应,揭示了模型在任务解决中可能忽视安全约束的风险。

Comments *15 pages, 5 figures. Introduces MIR-SafetyBench (2,676 instances; 9 multi-image relations). Equal contribution; †Corresponding author. Code/data: https://github.com/thu-coai/MIR-SafetyBench

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14052 2026-01-21 cs.CV

Vision Also You Need: Navigating Out-of-Distribution Detection with Multimodal Large Language Model

视觉也需要:利用多模态大语言模型进行分布外检测导航

Haoran Xu, Yanlin Liu, Zizhao Tong, Jiaze Li, Kexue Fu, Yuyang Zhang, Longxiang Gao, Shuaiguang Li, Xingyu Li, Yanran Xu, Changwei Wang

机构 * Zhejiang University(浙江大学) Tsinghua University(清华大学) University of Chinese Academy of Sciences(中国科学院大学) Key Laboratory of Computing Power Network and Information Security, Ministry of Education, Shandong Computer Science Center (National Supercomputer Center in Jinan), Qilu University of Technology (Shandong Academy of Sciences)(教育部计算电力网络与信息安全重点实验室,山东计算机科学中心(国家超算中心济南中心),齐鲁工业大学(山东科学院)) Shandong Provincial Key Laboratory of Computing Power Internet and Service Computing, Shandong Fundamental Research Center for Computer Science(山东省计算电力互联网与服务计算重点实验室,山东省计算机科学基础研究中心) University of Electronic Science and Technology of China(电子科技大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) RWTH Aachen University(亚琛工业大学)

AI总结 本文提出MM-OOD方法,利用多模态大语言模型的推理能力,通过多轮对话增强分布外检测,提升近远OOD任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13644 2026-01-21 cs.CL cs.LG

Towards Token-Level Text Anomaly Detection

迈向词级文本异常检测

Yang Cao, Bicheng Yu, Sikun Yang, Ming Liu, Yujiu Yang

机构 * Great Bay University(大湾大学) Tsinghua University(清华大学) Shenzhen University(深圳大学) Dongguan Key Laboratory for AI and Dynamical Systems(东莞人工智能与动力系统重点实验室) Deakin University(德肯大学)

AI总结 本文提出词级文本异常检测方法,通过多层级统一框架实现精准定位,提升文本异常识别的细粒度分析能力。

Comments WWW 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05839 2026-01-21 cs.CV

GeoSurDepth: Harnessing Foundation Model for Spatial Geometry Consistency-Oriented Self-Supervised Surround-View Depth Estimation

GeoSurDepth:利用基础模型实现以空间几何一致性为导向的自监督周围视图深度估计

Weimin Liu, Wenjun Wang, Joshua H. Meng

机构 * State Key Laboratory of Intelligent Green Vehicle and Mobility, School of Vehicle and Mobility, Tsinghua University, Beijing 100084, China(1 智能绿色车辆与移动国家重点实验室,车辆与移动学院,清华大学,北京100084,中国) California PATH, University of California, Berkeley, CA, United States(2 加州PATH,加州大学伯克利分校,加州,美国)

AI总结 GeoSurDepth通过利用基础模型和几何一致性,实现了更鲁棒的自监督周围视图深度估计,验证了其在自动驾驶中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏