arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Tsinghua University(清华大学)

共收录 392
2509.17390 2026-08-05 cs.RO 版本更新

FGGS-LiDAR: Ultra-Fast, GPU-Accelerated Simulation from General 3DGS Models to LiDAR

FGGS-LiDAR:从通用3DGS模型到LiDAR的超快速GPU加速仿真

Junzhe Wu, Yufei Jia, Yiyi Yan, Zhixing Chen, Tiao Tan, Zifan Wang, Guangyu Wang, BoKui Chen, Guyue Zhou

机构 * Tsinghua University, Shenzhen, China(清华大学深圳研究院) Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) DISCOVER Robotics Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) The Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院(AIR))

AI总结 提出FGGS-LiDAR框架,通过体积离散化和TSDF提取将预训练3DGS资产转换为水密网格,结合GPU加速光线投射实现超500 FPS的LiDAR仿真,在并行设置中比Isaac Sim低一个数量级延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24024 2026-08-04 cs.CV 版本更新

GeoStereo: A Unified Stereo Geometry Estimation Framework for Disparity and Surface Normal

用于视差和表面法线的统一立体几何估计框架

Qizhe Wei, Xianda Guo, Shaocong Xu, Hong Li, Runyi Yang, Hao Zhao

机构 * Beijing Institute of Technology(北京理工大学) School of Computer Science, Wuhan University(武汉大学计算机科学学院) Beihang University(北京航空航天大学) INSAIT, Sofia University(索非亚大学INSAIT) BAAI AIR, Tsinghua University(清华大学BAAI AIR)

AI总结 本文针对立体匹配和表面法线估计问题,提出统一框架GeoStereo,结合前馈立体匹配与基于扩散的法线估计分支,引入初始化策略与扭曲条件,实现有效交互,在多场景表现可靠,零样本设置下视差和法线估计精度高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17244 2026-08-04 cs.LG 版本更新

DynImmune-BERT: Dynamic Immune Repertoire Modeling with Neural ODE Driven Continuous Transformers

DynImmune-BERT:基于神经常微分方程驱动的连续变换器的动态免疫组库建模

Rong Fu, Yongtai Liu, Xiaowen Ma, Haoyu Zhao, Shuo Yin, Yiqing Lyu, Long Zhang, Wangyu Wu

机构 * University of Macau(澳门大学) Hanyang University(汉阳大学) Zhejiang University(浙江大学) Wuhan University(武汉大学) Tsinghua University(清华大学) South China University of Technology(华南理工大学) University of Liverpool(利物浦大学)

AI总结 研究针对纵向T细胞受体组库建模问题,提出DynImmune-BERT模型,结合多种方法,能在有纵向组库结构时补充静态编码器,通过特定评估方式得出结果,对小外部队列和协议差异需谨慎解读。

Comments 13 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11510 2026-08-04 cs.LG stat.ML 版本更新

DAG-FM: A Foundation Model for Causal Discovery under Heterogeneous Causal Mechanisms

DAG-FM:异构因果机制下因果发现的基础模型

Yikang Chen, Zhengkang Guan, Haoyuan Qian, Xingxuan Zhang, Peng Cui, Yi Yang, Fei Wu, Kun Kuang

机构 * Zhejiang University(浙江大学) Tsinghua University(清华大学)

AI总结 针对观测表格数据因果发现难题,提出DAG-FM基础模型,通过自回归阶段、表格交互块及叶专家混合处理复杂情况,经迭代推理构建DAG,在合成及真实数据集上性能优于传统算法和其他模型。

Comments 33 pages, 9 figures, 12 tables, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04603 2026-08-04 cs.CV cs.AI 版本更新

LCPNet: Latent Consistent Proximal Unfolding Network for Infrared Small Target Detection

LCPNet:用于红外小目标检测的潜在一致近端展开网络

Tianfang Zhang, Lei Li, Chang Liu, Zhenming Peng, Huaping Zhang, Xiangyang Ji

机构 * Department of Automation, Tsinghua University(清华大学自动化系) Laboratory of Imaging Detection and Intelligent Perception, University of Electronic Science and Technology of China(电子科技大学成像探测与智能感知实验室) School of Artificial Intelligence, Beijing Institute of Technology(北京理工大学人工智能学院)

AI总结 针对红外小目标检测,提出LCPNet。通过在潜在空间展开并利用低秩先验,推导LCP求解器及引入共享优化内存,实现准确鲁棒检测,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02252 2026-08-04 cs.CV 版本更新

ArcAD: Anomaly-Rectified Calibration for Cold-Start Supervised Anomaly Detection

ArcAD: 冷启动监督异常检测的异常校正校准框架

Ningning Han, Lei Fan, Jia Guo, Yunkang Cao, Xiu Su, Feng Cao, Donglin Di, Tonghua Su

机构 * Faculty of Computing, Harbin Institute of Technology, Harbin, China University of New South Wales, Sydney, Australia School of Biomedical Engineering, Tsinghua University, Beijing, China School of Artificial Intelligence Robotics, Hunan University, Changsha, China Big data institute, Central South University, Sydney, Australia DZ-Matrix, Beijing, China Chongqing Research Institute of HIT, Chongqing, China

AI总结 针对工业异常检测中冷启动场景下正常样本不足、异常样本稀少的问题,提出基于推拉学习范式的即插即用校准框架ArcAD,通过将正常样本投影到超球面并聚类、合成伪异常并利用真实异常优化边界,在多个数据集上显著优于现有方法。

Comments Accepted to European Conference on Computer Vision (ECCV) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27814 2026-08-04 cs.AI 版本更新

ATOD: Annealed Turn-Aware On-Policy Distillation for Multi-Turn Agentic Tasks

ATOD: 面向多轮自主智能体的退火轮次感知在线策略蒸馏

Qitai Tan, Zefang Zong, Mo Li, Yipeng Shi, Yang Li, Peng Chen

机构 * Tencent Inc.(腾讯公司) Tsinghua University(清华大学)

AI总结 提出ATOD混合在线蒸馏算法,通过退火式OPD-RL调度和轮次级重加权,解决长程交互任务中OPD性能天花板和RL早期低效问题,在三个基准上超越教师模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21337 2026-08-04 cs.LG cs.AI 版本更新

DataClaw0: Agentic Tailoring Multimodal Data from Raw Streams

DataClaw0: 从原始流中智能定制多模态数据

Cong Wan, Zeyu Guo, Zijian Cai, Jiangyang Li, SongLin Dong, Lin Peng, Xiangyang Luo, Zhiheng Ma, Yihong Gong

机构 * University of Chinese Academy of Sciences(中国科学院大学) Shenzhen University of Advanced Technology(深圳理工大学) Tsinghua University(清华大学)

AI总结 提出DataClaw0模型,通过两阶段流水线将生成语义合成锚定于确定性事实锚点,结合SFT与GRPO实现复杂数据精炼意图的对齐,首个数据精炼基准验证其高效性。

Comments add base model: Qwen3.5-27B

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15553 2026-08-04 cs.LG cs.AI 版本更新

Distilling Drifting Transformers with Representation Autoencoders

用表示自编码器蒸馏漂移变换器

Jiawei Zhang, Mengfei Xia, Gen Li, Yuantao Gu

机构 * Tsinghua University(清华大学) Ant Group(蚂蚁集团) CUHK(香港中文大学)

AI总结 提出Drift-RAE方法,通过漂移范式在表示自编码器潜空间中蒸馏预训练流模型,解决各向异性和大曲率问题,在ImageNet 256上仅用10k步达到1.77 FID。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01173 2026-08-04 cs.CV 版本更新

Bridging Multimodal Fusion and Expert Routing via Spectral Reliability Descriptors for Robust Object Detection

复用融合时频谱可靠性用于RGB-红外目标检测的自适应融合与专家路由

Yefeng Wu

机构 * Tsinghua University(清华大学)

AI总结 提出一种无参数的7维频谱可靠性描述符,通过频谱可靠性融合和可靠性条件专家路由,提升RGB-红外目标检测在退化条件下的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30239 2026-08-04 cs.CV 版本更新

CA-World: Multi-Object Counterfactual Alignment for Efficient Interactive-Ready Reconstruction

SAM3D-Phys:迈向真实世界中的多物体交互仿真

Xin Dong, Weijian Deng, Lihan Zhang, Tianru Dai, Wenfeng Deng, Yansong Tang

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Pengcheng Laboratory(鹏城实验室)

AI总结 提出SAM3D-Phys框架,结合场景重建与SAM3D生成式先验,从部分观测中恢复完整可仿真物体几何,并通过物理约束优化和掩码引导外观蒸馏实现场景一致性,支持多物体同时交互仿真。

Comments 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23872 2026-08-04 cs.CV cs.RO 版本更新

Altitude-Adaptive Vision-Only Geo-Localization for UAVs in GPS-Denied Environments

GPS拒止环境下无人机的高度自适应纯视觉地理定位

Xingyu Shao, Mengfan He, Liangzheng Sun, Chunyu Li, Ziyang Meng

机构 * Department of Precision Instrument, Tsinghua University(清华大学精密仪器系) School of Aerospace Engineering, Beijing Institute of Technology(北京理工大学航天工程学院) School of Instrumentation Science and Opto-electronics Engineering, Beijing Information Science and Technology University(北京信息科技大学仪器科学与光电工程学院)

AI总结 针对无人机视觉位置识别中高度变化导致的尺度不匹配问题,提出一种基于单目视觉的高度自适应地理定位框架,通过频域变换估计相对高度并用于图像尺度归一化,结合分类-检索视觉位置识别模块实现粗定位,引入质量自适应边缘分类器提升检索鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23668 2026-08-04 cs.CL cs.AI 版本更新

OnePred: Next-Query Prediction via Recursive Intent Memory in Multi-Turn Conversations

OnePred: 多轮对话中基于递归意图记忆的下一个查询预测

Jiangwang Chen, Bowen Zhang, Zixin Song, Jiazheng Kang, Xiao Yang, Da Zhu, Guanjun Jiang

机构 * Tsinghua University(清华大学) Qwen Applications Business Group of Alibaba(阿里巴巴Qwen应用业务组)

AI总结 针对多轮对话中下一个查询预测任务,提出OnePred模型,通过递归更新的意图记忆代替完整历史,结合两阶段强化学习训练,在NQP-Bench基准上实现高达22倍的每轮token节省且预测质量优于所有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23590 2026-08-04 cs.AI 版本更新

Co-ReAct: Rubrics as Step-Level Collaborators for ReAct Agents

Co-ReAct:作为ReAct智能体逐步协作者的评分准则

Jiazheng Kang, Bowen Zhang, Zixin Song, Jiangwang Chen, Xiao Yang, Da Zhu, Guanjun Jiang

机构 * Qwen Applications Business Group of Alibaba(阿里巴巴文勤应用业务组) Tsinghua University(清华大学)

AI总结 提出Co-ReAct框架,通过训练专用评分准则生成器,在推理时逐步指导ReAct智能体的行动选择,显著提升搜索密集型多步推理任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20266 2026-08-04 cs.SD 版本更新

A Survey of Large Audio Language Models: Generalization, Trustworthiness, and Outlook

大型音频语言模型综述:通用性、可信度与展望

Kaiwen Luo, Zhenhong Zhou, Leyan Wang, Liang Lin, Tianyu Shao, Yuanhe Zhang, Yang Xiao, Yuxuan Li, Miao Yu, Kailin Lyu, Jiaming Zhang, Li Sun, Songze Li, Yueming Wu, Ting Dang, Xiaojun Jia, Dongrui Liu, Kai Li, Rohan Kumar Das, Siyuan Liang, Xinfeng Li, Qiankun Li, Jing Chen, Xingjun Ma, Kun Wang, Junhao Dong, Deqing Zou, Yu Cheng, Xia Hu, Zhigang Zeng, Sen Su, Yang Liu, Yu-Gang Jiang, Philip S. Yu, Yew-Soon Ong

机构 * Nanyang Technological University(南洋理工大学) Independent Researcher(独立研究者) The University of Melbourne(墨尔本大学) North China Electric Power University(华北电力大学) Beijing University of Posts and Telecommunications(北京邮电大学) University of Chinese Academy of Sciences(中国科学院大学) University of Science and Technology of China(中国科学技术大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Shanghai AI Laboratory(上海人工智能实验室) Huazhong University of Science and Technology(华中科技大学) Tsinghua University(清华大学) Fortemedia Singapore(富媒体新加坡) Tencent(腾讯) Fudan University(复旦大学) Wuhan University(武汉大学) Chinese University of Hong Kong(香港中文大学) Chongqing University of Posts and Telecommunications(重庆邮电大学) University of Illinois Chicago(伊利诺伊大学芝加哥分校)

AI总结 本文综述了大型音频语言模型的通用性、可信度及未来发展方向,探讨了其架构创新、对齐算法及安全风险,并提出了防御深入、因果音频世界建模等策略以提升音频智能的可信度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14512 2026-08-04 cs.IR cs.AI 版本更新

Asymmetric Generative Recommendation via Kronecker Residual Bridge and Multi-Faceted Hierarchical Quantization

基于多专家投影和多维层次量化的一致生成推荐

Bin Huang, Xin Wang, Junwei Pan, Yongqi Zhou, Yifeng Zhou, Zhixiang Feng, Shudong Huang, Haijie Gu, Wenwu Zhu

机构 * DCST, Tsinghua University(清华大学直流系统研究所) DCST, BNRist, Tsinghua University(清华大学直流系统研究所) Tencent(腾讯)

AI总结 本文提出AsymRec框架,通过分离输入输出表示解决生成推荐中的信息瓶颈问题,采用多专家投影和多维层次量化提升推荐性能,实验表明在推荐任务中平均提升15.8%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13092 2026-08-04 stat.ML cs.LG stat.ME 版本更新

Adaptive Kernel Density Estimation with Pre-training

具有预训练的自适应核密度估计

Ruitong Zhang, Ke Deng

机构 * Department of Statistics and Data Science, Tsinghua University(统计与数据科学系,清华大学)

AI总结 本文提出利用预训练技术提升高维下自适应核密度估计效率,通过神经网络推荐合适核函数,实验证明在目标分布接近预训练分布时效果显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18557 2026-08-04 cs.CV cs.GR cs.RO 版本更新

SynAgent: Generalizable Cooperative Humanoid Manipulation via Solo-to-Cooperative Agent Synergy

SynAgent:通过独狼到协作代理协同实现通用化的人形机器人操作

Wei Yao, Haohan Ma, Hongwen Zhang, Liangjun Xing, Zhile Yang, Yuanjun Guo, Yunlian Sun, Yebin Liu

机构 * School of Computer Science and Engineering, Nanjing University of Science and Technology(南京理工大学计算机科学与工程学院) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院) School of Artificial Intelligence, Beijing Normal University(北京师范大学人工智能学院) Department of Automation, Tsinghua University(清华大学自动化系) College of Artificial Intelligence, Nanjing Forestry University(南京林业大学人工智能学院)

AI总结 本文提出SynAgent框架,通过独狼到协作代理协同转移单agent人-物体交互技能,实现可扩展且物理合理的协作操作,实验显示其在协作模仿和轨迹条件控制方面优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15423 2026-08-04 cs.IR cs.LG 版本更新

GaiaFlow: Semantic-Guided Diffusion Tuning for Carbon-Frugal Search

GaiaFlow:基于语义的扩散调优用于碳节约搜索

Rong Fu, Jia Yee Tan, Chunlei Meng, Shuo Yin, Xiaowen Ma, Wangyu Wu, Simon Fong

机构 * University of Macau(澳门大学) Renmin University of China(中国人民大学) Fudan University(复旦大学) Tsinghua University(清华大学) Zhejiang University(浙江大学) University of Liverpool(利物浦大学) Peking University(北京大学) Northeast Normal University(东北师范大学) Minzu University of China(民族大学)

AI总结 GaiaFlow通过结合语义引导的扩散调优与硬件无关的性能建模策略,在保证检索精度的同时降低环境影响,实现了高效且可持续的神经搜索系统。

Comments 19 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16144 2026-08-04 cs.CL cs.LG 版本更新

Missing-by-Design: Certifiable Modality Deletion for Revocable Multimodal Sentiment Analysis

缺失-by-设计:可撤销多模态情感分析的可验证模态删除

Rong Fu, Ziming Wang, Chunlei Meng, Jiekai Wu, Kangan Qian, Hao Zhang, Simon Fong

机构 * University of Macau(澳门大学) Zhejiang University(浙江大学) Fudan University(复旦大学) Shanghai AI Laboratory(上海人工智能实验室) Juntendo University(立命馆大学) Tsinghua University(清华大学) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 本文提出MBD框架,通过结构化表示学习和可验证参数修改流程,实现可撤销多模态情感分析中的模态删除,实验表明其在不完整输入下具有强预测性能,并实现隐私与效用的平衡。

Comments 21 pages, 6 figures. In the previous version, Juntendo University was erroneously listed as the affiliation; we must clarify that this paper has absolutely no relation to Juntendo University. Therefore, we have replaced this affiliation in the new version

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18109 2026-08-04 cs.LG cs.OS cs.SY eess.SY 版本更新

TempoNet: Slack-Quantized Transformer-Guided Reinforcement Scheduler for Adaptive Deadline-Centric Real-Time Dispatchs

TempoNet:基于Transformer的强化学习调度器用于自适应截止时间导向的实时调度

Rong Fu, Yibo Meng, Zeyu Zhang, Ziming Guo, Jia Yee Tan, Xiaojing Du, Simon James Fong

机构 * University of Macau(澳门大学) Tsinghua University(清华大学) Northeast Normal University(东北师范大学) Shanghai AI Laboratory(上海人工智能实验室) The Australian National University(澳大利亚国立大学) Peking University(北京大学) Harbin University of Science and Technology(哈尔滨理工大学) Renmin University of China(中国人民大学) Adelaide University(阿德莱德大学)

AI总结 TempoNet结合Transformer与深度Q近似,通过时间松弛量化和稀疏注意力机制提升实时调度性能,实现高吞吐量下的截止时间保障。

Comments 43 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11025 2026-08-04 cs.CV 版本更新

Test-time Scaling over Perception: Resolving the Grounding Paradox in Thinking with Images

图像推理中的测试时感知扩展:解决图像推理中的 grounding 困境

Zheng Jiang, Yiming Chen, Nan He, Jiahui Chen, Chaoyang Li, Houde Qian, Lifeng Sun

机构 * Tsinghua University(清华大学) Beijing University of Technology(北京工业大学)

AI总结 本文提出 TTSP 框架,通过测试时扩展感知解决图像推理中的 grounding 困境,通过生成多个感知轨迹并过滤不可靠轨迹来提升细粒度视觉推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00919 2026-08-04 cs.CV cs.RO 版本更新

DriveCode: Domain Specific Numerical Encoding for LLM-Based Autonomous Driving

DriveCode: 针对基于LLM的自动驾驶的领域特定数值编码

Zhiye Wang, Yanbo Jiang, Rui Zhou, Bo Zhang, Fang Zhang, Zhenhua Xu, Yaqin Zhang, Jianqiang Wang

机构 * School of Information Science and Engineering, Lanzhou University(兰州大学信息科学与工程学院) The School of Vehicle and Mobility, Tsinghua University(清华大学车辆与移动性学院) The Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院) DiDi, Beijing, China(滴滴出行) State Key Laboratory of Intelligent Green Vehicle and Mobility, Tsinghua University(清华大学智能绿色车辆与移动性国家重点实验室)

AI总结 本文提出DriveCode,一种将数字表示为专用嵌入而非离散文本标记的新型数值编码方法,提升LLM在自动驾驶中的数值推理与解码效率。

Comments The project page is available at https://shiftwilliam.github.io/DriveCode

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10485 2026-08-04 cs.AI 版本更新

Panning for Gold: Expanding Domain-Specific Knowledge Graphs with General Knowledge

寻找黄金:利用通用知识图谱扩展领域特定知识图谱

Runhao Zhao, Weixin Zeng, Wentao Zhang, Chong Chen, Zhengpin Li, Xiang Zhao, Lei Chen

机构 * National Key Laboratory of Big Data and Decision(大数据与决策国家重点实验室) National University of Defense Technology(国防科技大学) The Center for machine learning research(机器学习研究中心) Peking University(北京大学) Tsinghua University(清华大学) The Hong Kong University of Science and Technology(香港科学与技术大学)

AI总结 本文提出领域特定知识图谱融合任务,通过神经符号框架ExeFuse,利用通用知识图谱提升领域知识图谱的完整性和实用性。

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10719 2026-08-04 cs.RO cs.CV 版本更新

From Representational Complementarity to Dual Systems: Synergizing VLM and Vision-Only Backbones for End-to-End Driving

从表征互补性到双系统:协同VLM和纯视觉骨干网络用于端到端驾驶

Sining Ang, Yuguang Yang, Chenxu Dang, Canyu Chen, Cheng Chi, Haiyan Liu, Xuanyao Mao, Jason Bao, Xuliang, Bingchuan Sun, Yan Wang

机构 * Department of Automation, University of Science and Technology of China(中国科学技术大学自动化系) School of Electronic Information Engineering, Beihang University(北京航空航天大学电子信息工程学院) School of Artificial Intelligence and Automation, Huazhong University of Science and Technology(华中科技大学人工智能与自动化学院) National Superior College for Engineers, Beihang University(北京航空航天大学国家级工程师学院) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Lenovo Group Limited(联想集团有限公司) Institute for AI Industry Research, Tsinghua University(清华大学人工智能产业研究院)

AI总结 本文通过协同VLM和纯视觉骨干网络,提出HybridDriveVLA和DualDriveVLA,提升端到端驾驶的PDMS性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20717 2026-08-04 cs.RO cs.AI 版本更新

RobotDancing: Residual-Action Reinforcement Learning Enables Robust Long-Horizon Humanoid Motion Tracking

RobotDancing:残差动作强化学习实现人形机器人的鲁棒长时程运动跟踪

Zhenguo Sun, Yibo Peng, Yuan Meng, Xukun Li, Bo-Sheng Huang, Zhenshan Bing, Xinlong Wang, Alois Knoll

机构 * School of Computation, Information and Technology, Technical University of Munich(慕尼黑技术大学计算、信息与技术学院) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Department of Computer Science, Tsinghua University(清华大学计算机学院) The State Key Laboratory for Novel Software Technology, Nanjing University(南京大学新型软件技术国家重点实验室)

AI总结 本研究提出RobotDancing,一种单阶段强化学习方案,通过残差动作补偿动力学不匹配,在Unitree G1等机器人上实现鲁棒长时程高动态运动跟踪,具备跨平台可行性。

Comments accepted by R-AL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20650 2026-08-04 cs.LG 版本更新

Self-composing neural operators for high-frequency and multiscale PDE surrogates

用于高频与多尺度偏微分方程(PDE)代理模型的自组合神经算子

Juncai He, Xinliang Liu, Jinchao Xu

机构 * Yau Mathematical Sciences Center, Tsinghua University(清华大学姚期智数学科学中心) Ocean University of China(中国海洋大学) King Abdullah University of Science and Technology(国王 Abdullah 科学与技术大学)

AI总结 本研究提出自组合神经算子(SC-NO)框架,模拟数值求解器更新步骤,结合自适应“训练-展开”策略,在亥姆霍兹方程任务中较FNO及其变体显著降低预测误差,还给出自组合深度与逼近精度的理论分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21529 2026-08-03 cs.CV cs.AI 版本更新

ElasticTTT: Prior-Preserving Test-Time Tuning for Video Editing

ElasticTTT:用于视频编辑的保留先验的测试时调优

Yueyi Liu, Chi Zhang, Sen Cui, Miao Liu

机构 * College of AI, Tsinghua University(清华大学人工智能学院) Beijing Academy of Artificial Intelligence(北京人工智能研究院)

AI总结 研究针对预训练扩散模型的测试时调优中存在的问题,提出ElasticTTT框架,通过目标分布正则化、对比条件采样和异步噪声调度等方法,成功保留基础模型生成先验,在一次性视频编辑中达领先性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03322 2026-08-03 cs.CL cs.AI 版本更新

Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery

大语言模型能否推导新知识?一种动态生物知识发现基准

Chaoqun Yang, Xinyu Lin, Shulin Li, Wenjie Wang, Ruihan Guo, Fuli Feng, Tat-Seng Chua

机构 * National University of Singapore(新加坡国立大学) Tsinghua University(清华大学) University of Science and Technology of China(中国科学技术大学)

AI总结 本文提出DBench-Bio,一种动态生物知识发现基准,通过三阶段流程评估AI的新知识发现能力,揭示当前模型在知识发现上的局限性。

Comments Accepted by KDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00847 2026-08-03 cs.GT cs.AI 版本更新

Pay for The Second-Best Service: A Game-Theoretic Approach Against Dishonest LLM Providers

为次优服务付费:一种对抗不诚实大语言模型提供者的博弈论方法

Yuhan Cao, Yu Wang, Sitong Liu, Miao Li, Yixin Tao, Tianxing He

机构 * Shanghai Qi Zhi Institute(上海启智研究院) ShanghaiTech University(上海科技大学) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) Beijing Institute for General Artificial Intelligence(北京通用人工智能研究院) Shanghai University of Finance(上海财经大学) Tsinghua University(清华大学)

AI总结 本文提出了一种博弈论方法,通过设计近似激励相容机制,解决大语言模型服务提供者可能存在的不诚实行为问题,并保证用户效用的次优性。

Comments Published as a conference paper at WWW 2026; 12 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏