arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Tsinghua University(清华大学)

共收录 4556
2510.00457 2026-02-04 cs.LG cs.AI cs.CE

UrbanGraph: Physics-Informed Spatio-Temporal Dynamic Heterogeneous Graphs for Urban Microclimate Prediction

UrbanGraph: 基于物理的时空动态异质图用于城市微气候预测

Weilin Xin, Chenyu Huang, Peilin Li, Jing Zhong, Jiawei Yao

机构 * National University of Singapore(新加坡国立大学) Tongji University(同济大学) Tsinghua University(清华大学)

AI总结 UrbanGraph通过显式编码物理因果关系,提升城市微气候预测的物理一致性和效率,实现高性能和高精度的时空动态异质图建模。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09131 2026-02-04 cs.GR cs.AI cs.CV

Training-Free Text-Guided Color Editing with Multi-Modal Diffusion Transformer

无需训练的文本引导颜色编辑与多模态扩散变换器

Zixin Yin, Xili Dai, Ling-Hao Chen, Deyu Zhou, Jianan Wang, Duomin Wang, Gang Yu, Lionel M. Ni, Lei Zhang, Heung-Yeung Shum

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) International Digital Economy Academy(国际数字经济学院) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Tsinghua University(清华大学) Astribot StepFun

AI总结 ColorCtrl通过多模态扩散变换器实现无需训练的文本引导颜色编辑,精准控制颜色属性并保持一致性,优于现有方法和商业模型。

Comments https://zxyin.github.io/ColorCtrl

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17878 2026-02-04 cs.CR cs.AI

Crypto-ncRNA: a bio-inspired post-quantum cryptographic primitive exploiting RNA folding complexity

Crypto-ncRNA:一种受生物启发的后量子密码原语,利用非编码RNA折叠复杂性

Xu Wang, Yiquan Wang, Tin-yeh Huang, Zhaorui Jiang, Kai Wei

机构 * Tsinghua University-Peking University Joint Center for Life Sciences, Tsinghua University(清华大学-北京大学联合生命科学中心,清华大学) Xinjiang Key Laboratory of Biological Resources and Genetic Engineering, College of Life Science and Technology, Xinjiang University(新疆生物资源与基因工程重点实验室,新疆大学生命科学与技术学院) College of Mathematics and System Science, Xinjiang University(新疆大学数学与系统科学学院) Department of Industrial and Systems Engineering, Faculty of Engineering, The Hong Kong Polytechnic University(工程学院工业与系统工程系,香港理工大学) School of Environment and Energy, Shenzhen Graduate School, Peking University(环境与能源学院,北京大学深圳研究生院)

AI总结 Crypto-ncRNA利用非编码RNA折叠的热力学复杂性,提出一种基于生物启发的后量子密码原语,具备高安全性和高效性。

Comments Accepted at the AI4NA workshop at ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02486 2026-02-03 cs.CL cs.AI

RE-TRAC: REcursive TRAjectory Compression for Deep Search Agents

RE-TRAC: 递归轨迹压缩用于深度搜索代理

Jialiang Zhu, Gongrui Zhang, Xiaolong Ma, Lin Xu, Miaosen Zhang, Ruiqi Yang, Song Wang, Kai Qiu, Zhirong Wu, Qi Dai, Ruichun Ma, Bei Liu, Yifan Yang, Chong Luo, Zhengyuan Yang, Linjie Li, Lijuan Wang, Weizhu Chen, Xin Geng, Baining Guo

机构 * Southeast University(东南大学) Waseda University(早稻田大学) Tsinghua University(清华大学) Brown University(布朗大学) Zhejiang University(浙江大学) Microsoft(微软)

AI总结 Re-TRAC通过递归轨迹压缩提升深度搜索代理的效率,实现跨轨迹探索与全局规划,显著优于ReAct框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02331 2026-02-03 cs.RO cs.AI

TTT-Parkour: Rapid Test-Time Training for Perceptive Robot Parkour

TTT-Parkour: 为感知机器人攀爬实现快速测试时训练

Shaoting Zhu, Baijun Ye, Jiaxuan Wang, Jiakang Chen, Ziwen Zhuang, Linzhan Mou, Runhan Huang, Hang Zhao

机构 * Tsinghua University(清华大学) Shanghai Qi Zhi Institute(上海启智研究院) Princeton University(普林斯顿大学)

AI总结 TTT-Parkour通过快速测试时训练方法,使人形机器人能够高效适应复杂地形,提升其在极端几何结构中的攀爬能力。

Comments Project Page: https://ttt-parkour.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02318 2026-02-03 cs.CV

Enhancing Indoor Occupancy Prediction via Sparse Query-Based Multi-Level Consistent Knowledge Distillation

通过稀疏查询多级一致知识蒸馏增强室内占用预测

Xiang Li, Yupeng Zheng, Pengfei Li, Yilun Chen, Ya-Qin Zhang, Wenchao Ding

机构 * College of AI, Tsinghua University(清华大学人工智能学院) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) AIR, Tsinghua University(清华大学人工智能研究院) TARS College of Intelligent Robotics and Advanced Manufacturing, Fudan University(复旦大学智能机器人与先进制造学院)

AI总结 DiScene通过多级一致知识蒸馏和教师引导初始化,实现高效鲁棒的室内占用预测,优于现有方法并取得SOTA性能。

Comments Accepted by RA-L

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02222 2026-02-03 cs.CV cs.CR

MIRROR: Manifold Ideal Reference ReconstructOR for Generalizable AI-Generated Image Detection

MIRROR:基于流形理想参考的通用AI生成图像检测器

Ruiqi Liu, Manni Cui, Ziheng Qin, Zhiyuan Yan, Ruoxin Chen, Yi Han, Zhiheng Li, Junkai Chen, ZhiJin Chen, Kaiqing Lin, Jialiang Shen, Lubin Weng, Jing Dong, Yan Wang, Shu Wu

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Advanced Interdisciplinary Sciences, UCAS(北京大学交叉信息学院) Huazhong University of Science and Technology(华中科技大学) Tencent YouTu Lab(腾讯YouTu实验室) Southwest University(西南大学) Peking University(北京大学) The University of Sydney(悉尼大学) Shenzhen University(深圳大学) Tsinghua University(清华大学)

AI总结 MIRROR通过流形理想参考重建器,利用现实先验和残差信号,实现对AI生成图像的高效检测,超越现有方法并接近人类感知极限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02195 2026-02-03 cs.LG cs.AI

State Rank Dynamics in Linear Attention LLMs

线性注意力大语言模型中的状态排名动态

Ao Sun, Hongtao Zhang, Heng Zhou, Yixuan Ma, Yiran Qin, Tongrui Su, Yan Liu, Zhanyu Ma, Jun Xu, Jiuchong Gao, Jinghua Hao, Renqing He

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) University of Chinese Academy of Sciences(中国科学院大学) CAS Key Laboratory of AI Safety, Institute of Computing Technology, CAS(中国科学院人工智能安全重点实验室) University of Science and Technology of China(中国科学技术大学) Harbin Institute of Technology(哈尔滨工业大学) University of Oxford(牛津大学) Tsinghua University(清华大学)

AI总结 本研究揭示了线性注意力模型中状态排名分层现象,提出联合秩-范数剪枝策略,有效降低KV缓存开销并维持模型准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01916 2026-02-03 cs.RO

ForSim: Stepwise Forward Simulation for Traffic Policy Fine-Tuning

ForSim:基于逐步前向模拟的交通策略微调

Keyu Chen, Wenchao Sun, Hao Cheng, Zheng Fu, Sifa Zheng

机构 * School of Vehicle and Mobility, Tsinghua University(车辆与移动系统学院,清华大学)

AI总结 ForSim通过逐步闭环前向模拟范式提升交通模拟的保真度,结合组相对优化微调交通策略,提高安全性与效率。

Comments Accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01884 2026-02-03 cs.AI cs.LG

Entropy-Guided Data-Efficient Training for Multimodal Reasoning Reward Models

熵引导的数据高效训练用于多模态推理奖励模型

Shidong Yang, Tongwen Huang, Hao Wen, Yong Wang, Li Chen, Xiangxiang Chu

机构 * School of Software, Tsinghua University(清华大学软件学院) AMAP, Alibaba Group(阿里巴巴集团AMAP)

AI总结 本文提出熵引导训练方法,通过熵指导数据筛选和训练策略提升多模态推理奖励模型的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01811 2026-02-03 cs.RO

From Knowing to Doing Precisely: A General Self-Correction and Termination Framework for VLA models

从认知到精准执行:一种通用的自我校正与终止框架用于VLA模型

Wentao Zhang, Aolan Sun, Wentao Mo, Xiaoyang Qu, Yuxin Zheng, Jianzong Wang

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University, Shenzhen, China(清华大学深圳国际研究生院,清华大学,深圳,中国) Ping An Technology (Shenzhen) Co., Ltd., Shenzhen, China(平安科技(深圳)有限公司,深圳,中国)

AI总结 本文提出VLA-SCT框架,通过自我校正和终止机制提升VLA模型在抓取任务中的精度和鲁棒性,提高复杂环境下的执行可靠性。

Comments Accepted to 2026 IEEE International Conference on Acoustics, Speech, and Signal Processing (ICASSP 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01778 2026-02-03 cs.CL

Data Distribution Matters: A Data-Centric Perspective on Context Compression for Large Language Model

数据分布至关重要:一种以数据为中心的视角来探讨大型语言模型中的上下文压缩

Kangtao Lv, Jiwei Tang, Langming Liu, Haibin Chen, Weidong Zhang, Shilei Liu, Yongwei Wang, Yujin Yuan, Wenbo Su, Bo Zheng

机构 * Future Living Lab of Alibaba(阿里巴巴未来生活实验室) Tsinghua University(清华大学) Zhejiang University(浙江大学)

AI总结 本文从数据分布角度探讨了大型语言模型中的上下文压缩问题,发现输入熵与压缩质量负相关,而内在数据差距影响压缩增益,提出优化压缩的实用指南。

Comments 15 pages,6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01775 2026-02-03 cs.AI cs.LG

Efficient Cross-Architecture Knowledge Transfer for Large-Scale Online User Response Prediction

高效跨架构知识迁移用于大规模在线用户响应预测

Yucheng Wu, Yuekui Yang, Hongzheng Li, Anan Liu, Jian Xiao, Junjie Zhai, Huan Yu, Shaoping Ma, Leye Wang

机构 * Key Lab of High Confidence Software Technologies (Peking University), Ministry of Education \& School of Computer Science, Peking University Beijing China Department of Computer Science Technology, Tsinghua University \& Advertising Engineering Department, CDG, Tencent Corporation Beijing China Advertising Engineering Department, CDG, Tencent Corporation Beijing China Technology, Tsinghua University Beijing China Key Lab of High Confidence Software Technologies (Peking University), Ministry of Education \& School of Computer Science, Peking University Technology, Tsinghua University \& Advertising Engineering Department, CDG, Tencent Corporation Advertising Engineering Department, CDG, Tencent Corporation Technology, Tsinghua University

AI总结 CrossAdapt通过两阶段框架实现高效跨架构知识迁移,提升AUC并降低训练时间,适用于大规模在线用户响应预测。

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01756 2026-02-03 cs.CV

Mind-Brush: Integrating Agentic Cognitive Search and Reasoning into Image Generation

Mind-Brush: 将代理认知搜索与推理整合到图像生成中

Jun He, Junyan Ye, Zilong Huang, Dongzhi Jiang, Chenjue Zhang, Leqi Zhu, Renrui Zhang, Xiang Zhang, Weijia Li

机构 * Sun Yat-sen University(中山大学) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) MMLab, The Chinese University of Hong Kong(香港中文大学MMLab)

AI总结 Mind-Brush通过整合代理认知搜索与推理,提升图像生成模型对复杂知识推理和动态适应能力,实现性能显著跃升。

Comments 36 pages, 24 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01741 2026-02-03 cs.CV

Tail-Aware Post-Training Quantization for 3D Geometry Models

面向尾部的训练后量化用于3D几何模型

Sicheng Pan, Chen Tang, Shuzhao Xie, Ke Yang, Weixiang Zhang, Jiawei Li, Bin Chen, Shu-Tao Xia, Zhi Wang

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University, Shenzhen, China(清华大学深圳国际研究生院,清华大学,深圳,中国) MMLab, The Chinese University of Hong Kong, Hong Kong, China(MMLab,香港中文大学,香港,中国) Harbin Institute of Technology Shenzhen, China(哈尔滨工业大学深圳,中国) Huawei Technology, Shenzhen, China(华为技术,深圳,中国)

AI总结 TAPTQ通过面向尾部的训练后量化方法,提升3D几何模型的部署效率和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01736 2026-02-03 cs.LG

Position: The Inevitable End of One-Architecture-Fits-All-Domains in Time Series Forecasting

位置:时间序列预测中“一架构适所有领域”的必然终结

Qinwei Ma, Jingzhe Shi, Jiahao Qiu, Zaiwen Yang

机构 * Tsinghua University(清华大学) Princeton University(普林斯顿大学)

AI总结 本文指出时间序列预测中“一架构适所有领域”的方法已不再有效,建议转向特定领域深度学习或一般领域元学习方法。

Comments 14 pages, 3 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01695 2026-02-03 cs.AI cs.LG

Beyond Dense States: Elevating Sparse Transcoders to Active Operators for Latent Reasoning

超越密集状态:将稀疏转码器提升为活跃运算符以进行潜在推理

Yadong Wang, Haodong Chen, Yu Tian, Chuanxing Geng, Dong Liang, Xiang Chen

机构 * College of Computer Science and Technology, Nanjing University of Aeronautics and Astronautics(南京航空航天大学计算机科学与技术学院) MIIT Key Laboratory of Pattern Analysis and Machine Intelligence(信息产业部模式分析与机器智能重点实验室) Institute for AI, Tsinghua University, Beijing, China(清华大学人工智能研究院)

AI总结 LSTR通过将稀疏转码器提升为活跃运算符,实现更可控和可解释的潜在推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01630 2026-02-03 cs.CV

Research on World Models Is Not Merely Injecting World Knowledge into Specific Tasks

世界模型的研究并非仅仅是将世界知识注入特定任务

Bohan Zeng, Kaixin Zhu, Daili Hua, Bozhou Li, Chengzhuo Tong, Yuran Wang, Xinyi Huang, Yifan Dai, Zixiang Zhang, Yifan Yang, Zhou Liu, Hao Liang, Xiaochen Ma, Ruichuan An, Tianyi Bai, Hongcheng Gao, Junbo Niu, Yang Shi, Xinlong Chen, Yue Ding, Minglei Shi, Kai Zeng, Yiwen Tang, Yuanxing Zhang, Pengfei Wan, Xintao Wang, Wentao Zhang

机构 * Peking University(北京大学) Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)

AI总结 本文提出统一的世界模型设计规范,强调其应整合交互、感知、符号推理和空间表示,以实现更通用和稳健的世界模型。

Comments 13 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01608 2026-02-03 cs.AI

Reasoning with Autoregressive-Diffusion Collaborative Thoughts

基于自回归扩散协同思想的推理

Mu Yuan, Liekang Zeng, Guoliang Xing, Lan Zhang, Yunhao Liu

机构 * The Chinese University of Hong Kong(香港中文大学) University of Science and Technology of China(中国科学技术大学) Tsinghua University(清华大学)

AI总结 本文提出协同思想框架,通过自回归和扩散模型的闭环协作提升空间推理可靠性与生成可控性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01594 2026-02-03 cs.CV

UV-M3TL: A Unified and Versatile Multimodal Multi-Task Learning Framework for Assistive Driving Perception

UV-M3TL: 一种统一且多功能的多模态多任务学习框架用于辅助驾驶感知

Wenzhuo Liu, Qiannan Guo, Zhen Wang, Wenshuo Wang, Lei Yang, Yicheng Qiao, Lening Wang, Zhiwei Li, Chen Lv, Shanghang Zhang, Junqiang Xi, Huaping Liu

机构 * Energy and Transportation Domain, Beijing Institute of Technology(能源与交通领域,北京理工大学) State Key Laboratory of Intelligent Technology and Systems and Department of Computer Science and Technology, Tsinghua University(智能技术与系统国家重点实验室和清华大学计算机科学与技术系) School of Mechanical and Aerospace Engineering, Nanyang Technological University(机械与航空航天工程学院,南洋理工大学) School of Transportation Science and Engineering and the State Key Lab of Intelligent Transportation System, Beihang University(交通运输科学与工程学院和智能交通系统国家重点实验室,北京航空航天大学) Beijing University of Chemical Technology(北京化工大学)

AI总结 UV-M3TL通过双分支结构和自适应损失机制,实现多模态多任务学习,提升辅助驾驶感知的性能与多样性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01558 2026-02-03 cs.LG

How Implicit Bias Accumulates and Propagates in LLM Long-term Memory

隐性偏见如何在LLM长期记忆中积累和传播

Yiming Ma, Lixu Wang, Lionel Z. Wang, Hongkun Yang, Haoming Sun, Xin Xu, Jiaqi Wu, Bin Chen, Wei Dong

机构 * International Research Center for Artificial Intelligence, Harbin Institute of Technology (Shenzhen), Shenzhen, China Chongqing Research Institute of Harbin Institute of Technology, Chongqing, China College of Computing Data Science, Nanyang Technological University, Singapore Department of Management Marketing, The Hong Kong Polytechnic University, Hong Kong Haide College, Ocean University of China, Qingdao, China School of Computer Science, The University of Sheffield, Sheffield, UK Department of Automation, Tsinghua University, Beijing, China

AI总结 本文研究了LLM长期记忆中隐性偏见的积累与传播,提出动态内存标记方法以缓解偏见问题。

Comments Under review, and the first two authors contribute equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13418 2026-02-03 cs.CV

Reinforcement Learning Meets Masked Generative Models: Mask-GRPO for Text-to-Image Generation

强化学习遇见掩码生成模型:Mask-GRPO用于文本到图像生成

Yifu Luo, Xinhao Hu, Keyu Fan, Haoyuan Sun, Zeyu Chen, Bo Xia, Tiantian Zhang, Yongzhe Chang, Xueqian Wang

机构 * Tsinghua University(清华大学)

AI总结 本文提出Mask-GRPO,通过重新定义转移概率和多步骤决策问题,改进文本到图像生成模型,实现优于现有方法的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15386 2026-02-03 cs.CL cs.AI

RePPL: Recalibrating Perplexity by Uncertainty in Semantic Propagation and Language Generation for Explainable QA Hallucination Detection

RePPL:通过语义传播和语言生成中的不确定性重新校准困惑度以检测可解释问答幻觉

Yiming Huang, Junyan Zhang, Zihao Wang, Biquan Bie, Yunzhong Qiu, Xuming Hu, Yi R. Fung, Xinlei He

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) Tsinghua University(清华大学)

AI总结 RePPL通过校准语义传播和语言生成中的不确定性,提升问答幻觉检测性能,生成token级不确定性评分作为解释。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11891 2026-02-03 cs.CL cs.AI

Mobile-Bench-v2: A More Realistic and Comprehensive Benchmark for VLM-based Mobile Agents

Mobile-Bench-v2: 一种更现实和全面的基于VLM的移动代理基准测试

Weikai Xu, Zhizheng Jiang, Yuxuan Liu, Pengzhi Gao, Wei Liu, Jian Luan, Yuanchun Li, Yunxin Liu, Bin Wang, Bo An

机构 * Nanyang Technological University(南洋理工大学) Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学 Gallagher人工智能学院) MiLM Plus, Xiaomi Inc.(小米公司 MiLM Plus) Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究所)

AI总结 Mobile-Bench-v2通过引入基于槽位的指令生成方法,构建了一个更现实和全面的基准测试,以评估基于VLM的移动代理在处理噪声、多路径任务和主动交互方面的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01477 2026-02-03 cs.LG cs.AI

Achieving Time Series Reasoning Requires Rethinking Model Design, Tasks Formulation, and Evaluation

实现时间序列推理需要重新思考模型设计、任务制定和评估

Yaxuan Kong, Yiyuan Yang, Shiyu Wang, Chenghao Liu, Yuxuan Liang, Ming Jin, Stefan Zohren, Dan Pei, Yan Liu, Qingsong Wen

机构 * University of Oxford, UK(牛津大学) Hong Kong University of Science(香港科学大学) Griffith University, Australia(格里菲斯大学) Tsinghua University, China(清华大学) University of Southern California, USA(南加州大学)

AI总结 本文指出时间序列推理需重新审视模型设计、任务制定和评估,提出统一框架以提升现实应用中的鲁棒性、可解释性和决策相关性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01331 2026-02-03 cs.MA cs.CL

A-MapReduce: Executing Wide Search via Agentic MapReduce

A-MapReduce:通过代理MapReduce执行广泛搜索

Mingju Chen, Guibin Zhang, Heng Chang, Yuchen Guo, Shiji Zhou

机构 * Beijing Advanced Innovation Center for Future Blockchain and Privacy Computing, School of Artificial Intelligence, Beihang University(北京未来区块链与隐私计算创新中心,人工智能学院,北京航空航天大学) National University of Singapore(新加坡国立大学) Tsinghua University(清华大学) BNRist, Tsinghua University(BNRist,清华大学)

AI总结 A-MapReduce通过引入MapReduce范式,提出一种多代理框架,将广泛搜索转化为水平结构的检索问题,实现高效且低成本的广泛搜索执行。

Comments 33 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01278 2026-02-03 cs.CV

DSFC-Net: A Dual-Encoder Spatial and Frequency Co-Awareness Network for Rural Road Extraction

DSFC-Net:一种用于农村道路提取的双编码空间和频率协同网络

Zhengbo Zhang, Yihe Tian, Wanke Xia, Lin Chen, Yue Sun, Kun Ding, Ying Wang, Bing Xu, Shiming Xiang

机构 * School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所多模态人工智能系统国家重点实验室) Department of Earth System Science, Tsinghua University(清华大学地球系统科学系) Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) College of Information and Electrical Engineering, China Agricultural University(中国农业大学信息与电气工程学院)

AI总结 DSFC-Net通过双编码框架融合空间和频域信息,有效解决农村道路提取中的植被遮挡和狭窄道路连续性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01137 2026-02-03 cs.LG

Self-Generative Adversarial Fine-Tuning for Large Language Models

自生成对抗微调用于大语言模型

Shiguang Wu, Yaqing Wang, Quanming Yao

机构 * Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) Beijing Institute of Mathematical Sciences and Applications(北京数学科学研究院)

AI总结 本文提出SGALM,通过生成对抗游戏实现大语言模型的对齐微调,无需外部奖励模型,达到最先进的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01089 2026-02-03 cs.CV

Differential Vector Erasure: Unified Training-Free Concept Erasure for Flow Matching Models

微分向量擦除:用于流匹配模型的无训练概念擦除

Zhiqi Zhang, Xinhao Zhong, Yi Sun, Shuoyang Sun, Bin Chen, Shu-Tao Xia, Xuan Wang

机构 * Jilin University(吉林大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Peng Cheng Laboratory(鹏城实验室) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

AI总结 本文提出DVE,一种针对流匹配模型的无训练概念擦除方法,通过微分向量场实现精确概念抑制,优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01078 2026-02-03 cs.AI

AutoHealth: An Uncertainty-Aware Multi-Agent System for Autonomous Health Data Modeling

AutoHealth:一种面向自主健康数据建模的不确定性感知多智能体系统

Tong Xia, Weibin Li, Gang Liu, Yong Li

机构 * Vanke School of Public Health, Tsinghua University(清华大学万科公共卫生学院) Department of Electronic Engineering, Beijing National Research Center for Information Science and Technology(北京信息科学与技术国家研究中心电子工程系) Tsinghua University, China(清华大学)

AI总结 AutoHealth通过多智能体系统自主建模健康数据,提升预测性能和不确定性估计,有效解决健康数据建模中的泛化和可靠性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏