arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Tsinghua University(清华大学)

2026-06-30 至 2026-06-30 共收录 40
2511.02734 2026-06-30 cs.AI cs.CL

CostBench: Evaluating Multi-Turn Cost-Optimal Planning and Adaptation in Dynamic Environments for LLM Tool-Use Agents

CostBench:评估LLM工具使用代理在动态环境中的多轮成本最优规划与适应

Jiayu Liu, Cheng Qian, Zhaochen Su, Qing Zong, Shijue Huang, Bingxiang He, Yi R. Fung

机构 * Hong Kong University of Science and Technology(香港科技大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Tsinghua University(清华大学)

AI总结 本文提出CostBench,一个以成本为中心的可扩展基准,用于评估LLM代理在动态环境中的经济推理和重新规划能力,揭示现有模型在成本感知规划方面的显著不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21802 2026-06-30 cs.AI cs.CV

MixGRPO: Unlocking Flow-based GRPO Efficiency with Mixed ODE-SDE

MixGRPO: 通过混合ODE-SDE解锁基于流的GRPO效率

Junzhe Li, Yutao Cui, Tao Huang, Weijie Kong, Yiming Cheng, Chuxuan Zeng, Yinping Ma, Chun Fan, Miles Yang, Zhao Zhong, Liefeng Bo

机构 * Hunyuan, Tencent(腾讯混元) School of Computer Science, Peking University(北京大学计算机学院) Computer Center, Peking University(北京大学计算中心) Department of Engineering Physics, Tsinghua University(清华大学工程物理系)

AI总结 本文提出MixGRPO框架,通过结合ODE和SDE混合采样策略,优化流匹配模型的效率与性能,采用滑动窗口机制减少优化开销,提升收敛速度,其中MixGRPO-Flash进一步降低训练时间达71%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19054 2026-06-30 cs.CV cs.AI

Em-Garde: A Propose-Match Framework for Proactive Streaming Video Understanding

Em-Garde:一种用于主动流视频理解的提出-匹配框架

Yikai Zheng, Xin Ding, Yifan Yang, Shiqi Jiang, Hao Wu, Qianxi Zhang, Weijun Wang, Ting Cao, Yunxin Liu

机构 * Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院(AIR)) Institute for Interdisciplinary Information Sciences (IIIS), Tsinghua University(清华大学交叉信息研究院(IIIS)) Nanjing University(南京大学) University of Science and Technology of China(中国科学技术大学) Microsoft Research Asia(微软亚洲研究院)

AI总结 本文提出Em-Garde框架,通过解耦语义理解与流感知,提升主动响应的准确性和效率,实验验证其在严格计算约束下的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06133 2026-06-30 math.OC cs.AI cs.LG

LLM Serving Optimization with Variable Prefill and Decode Lengths

具有可变预填和解码长度的LLM服务优化

Meixuan Wang, Yinyu Ye, Zijie Zhou

机构 * Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) Department of Management Science and Engineering, Stanford University(斯坦福大学管理科学与工程系) Department of Industrial Engineering and Decision Analytics, HKUST(香港科技大学工业工程与决策分析系)

AI总结 研究在固定KV缓存内存预算下,异构提示和响应长度的离线调度问题,提出Sorted-F算法以平衡批次大小与下游解码成本,实现常数因子近似保证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20117 2026-06-30 cs.CV cs.SD eess.AS

Delayed Bidirectional Alignment via Disentangled Audio Semantics for Audio-Visual Segmentation

通过解耦音频语义实现延迟双向对齐的音频视觉分割

Jingqi Tian, Yiheng Du, Haoji Zhang, Yuji Wang, Isaac Ning Lee, Xulong Bai, Tianrui Zhu, Jingxuan Niu, Yansong Tang

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Peking University(北京大学)

AI总结 本文提出DDAVS方法,通过解耦音频语义和延迟双向对齐解决音频视觉分割中的多源纠缠和视听错位问题,实验表明其在多种场景下均取得最优性能。

Comments Accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10359 2026-06-30 cs.CV cs.AI

Tool-Augmented Spatiotemporal Reasoning for Streamlining Video Question Answering Task

增强工具的时空推理用于视频问答任务的优化

Sunqi Fan, Jiashuo Cui, Meng-Hao Guo, Shuojin Yang

机构 * BNRist, Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系,北京信息科学与技术国家研究中心)

AI总结 本文提出STAR框架和视频工具包,提升多模态大语言模型的时空推理能力,在VideoMME和LongVideoBench上分别提升8.2%和4.6%。

Comments Accepted by NeurIPS 2025 main track

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03142 2026-06-30 cs.RO cs.CV

MM-Nav: Multi-View VLA Model for Robust Visual Navigation via Multi-Expert Learning

MM-Nav:基于多专家学习的多视角VLA模型用于鲁棒视觉导航

Tianyu Xu, Jiawei Chen, Jiazhao Zhang, Wenyao Zhang, Zekun Qi, Minghan Li, Zhizheng Zhang, He Wang

机构 * Peking University(北京大学) Galbot Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学)

AI总结 本文提出MM-Nav模型,通过多专家学习从合成数据中学习多样化的导航能力,展示模型在合成环境中的强泛化能力,并在现实世界实验中验证其有效性。

Comments Project page: https://pku-epic.github.io/MM-Nav-Web/

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12078 2026-06-30 cs.MA cs.AI cs.CL cs.CY cs.SI

Modeling Earth-Scale Human-Like Societies with One Billion Agents

用十亿个智能体建模地球尺度的人类社会

Haoxiang Guan, Jiyan He, Liyang Fan, Zhenzhen Ren, Shaobin He, Xin Yu, Yuan Chen, Xueyin Xu, Shuxin Zheng, Yan Gao, Enhong Chen, Tie-Yan Liu, Zhen Liu

机构 * University of Science and Technology of China(中国科学技术大学) Zhongguancun Academy(中关村学院) Zhongguancun Institute of Artificial Intelligence(中关村人工智能研究院) Shenzhen University(深圳大学) Shanghai University of Finance and Economics(上海财经大学) Tsinghua University(清华大学) Fudan University(复旦大学)

AI总结 本文提出Light Society框架,通过结合大语言模型与优化算法,实现高效模拟十亿级智能体的社会现象,验证了其在信任游戏和意见扩散中的高保真度与效率。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08319 2026-06-30 eess.SY cs.RO cs.SY

Differentiable Physics-Informed Adaptive Koopman Control for Stable Flight under Unknown Disturbances

可微物理信息自适应柯普曼控制:在未知干扰下稳定飞行

Ao Jin, Qiujin Liang, Tao Zhang, Panfeng Huang, Fan Zhang

机构 * Research Center for Intelligent Robotics, School of Astronautics, Northwestern Polytechnical University(西北工业大学航天学院智能机器人研究中心) Department of Automation, Tsinghua University(清华大学自动化系)

AI总结 本文提出DEKC框架,结合物理模型与深度神经网络,通过学习干扰的动态演化来预测并补偿未来干扰,提升机器人在未知干扰下的控制精度。

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17421 2026-06-30 cs.LG cs.AI

Towards Harnessing the Collaborative Power of Large and Small Models for Domain Tasks

向利用大模型和小模型的协作力量进行领域任务

Yang Liu, Kejia Zhang, Bingjie Yan, Tianyuan Zou, Jianqing Zhang, Zixuan Gu, Xiangsen Chen, Jianbing Ding, Xidong Wang, Jingyi Li, Xiaozhou Ye, Ye Ouyang, Qiang Yang, Ya-Qin Zhang

机构 * The Hong Kong Polytechnic University(香港理工大学) Institute for AI Industry Research, Tsinghua University(清华大学智能产业研究院) Shanghai Jiao Tong University(上海交通大学) School of Software, Tsinghua University(清华大学软件学院) AsiaInfo Technologies(亚信科技)

AI总结 本文探讨了大模型与小模型协作在领域适应中的应用,分析了跨边界环境中的数据隐私、模型安全和效率挑战,并提出多目标优化问题以指导实际部署。

Comments For ongoing updates and a curated list of recent advances in this area, we maintain a public repository: https://github.com/KejiaZhang-Robust/Awesome-LM-SM-Domain-Collaboration

详情

展开后加载摘要…

URL PDF HTML 收藏