arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Texas at Austin(得克萨斯大学奥斯汀分校)

共收录 1213
1802.04205 2026-06-04 cs.RO cs.AI cs.SY eess.SY

Efficient Hierarchical Robot Motion Planning Under Uncertainty and Hybrid Dynamics

在不确定性和混合动力学下的高效机器人运动规划

Ajinkya Jain, Scott Niekum

机构 * Department of Mechanical Engineering(机械工程系) Department of Computer Science(计算机科学系) University of Texas at Austin, USA(得克萨斯大学奥斯汀分校)

AI总结 本文提出了一种分层POMDP规划器,用于在存在不确定性的情况下为混合动力学模型生成成本优化的运动计划,通过将非线性动力学分解为离散的局部动力学模型,从而有效减少状态不确定性。

Comments 2nd Conference on Robot Learning (CoRL 2018), Zurich, Switzerland

详情

展开后加载摘要…

URL PDF HTML 收藏
1805.03090 2026-06-04 math.OC cs.AI cs.SY eess.SY

Deception in Optimal Control

最优控制中的欺骗

Melkior Ornik, Ufuk Topcu

机构 * Institute for Computational Engineering and Sciences, University of Texas at Austin(德克萨斯大学奥斯汀分校计算工程与科学研究所) Department of Aerospace Engineering and Engineering Mechanics and the Institute for Computational Engineering and Sciences, University of Texas at Austin(德克萨斯大学奥斯汀分校航空航天工程与工程力学系及计算工程与科学研究所)

AI总结 本文提出一个数学严谨的框架,用于定义最优控制中的欺骗,通过设计最优欺骗策略,考虑代理和对手的信念空间,并讨论在不确定性和部分可观测马尔可夫决策过程中的欺骗策略设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
1705.10887 2026-06-04 stat.ML cs.CV cs.LG cs.NA math.NA

Efficient, sparse representation of manifold distance matrices for classical scaling

高效表示经典标度中的流形距离矩阵

Javier S. Turek, Alexander Huth

机构 * Intel Labs(英特尔实验室) The University of Texas at Austin(得克萨斯大学奥斯汀分校)

AI总结 本文提出一种基于双调和插值的稀疏方法,用于高效表示流形距离矩阵,相比现有方法速度快2倍,内存占用低20倍,能处理大规模点集。

Comments Conference CVPR 2018

详情

展开后加载摘要…

URL PDF HTML 收藏
1708.06345 2026-06-04 cs.RO cs.SY eess.SY

Robust Optimal Planning and Control of Non-Periodic Bipedal Locomotion with A Centroidal Momentum Model

非周期双足运动的鲁棒最优规划与控制:基于质心动量模型

Ye Zhao, Benito R. Fernandez, Luis Sentis

机构 * Human Centered Robotics Laboratory, The University of Texas at Austin, TX, USA(以人为本的机器人实验室,德克萨斯大学奥斯汀分校) Neuro-Engineering Research and Development Laboratory, The University of Texas at Austin, TX, USA(神经工程研究与开发实验室,德克萨斯大学奥斯汀分校)

AI总结 本文提出基于质心动量动力学的混合相空间规划与控制方法,通过非周期关键帧状态的鲁棒跟踪实现双足运动的稳健控制,重点解决非周期步态生成和扰动鲁棒性问题。

Comments 43 pages, 22 figures, journal, International Journal of Robotics Research, 2017. arXiv admin note: substantial text overlap with arXiv:1701.05929, arXiv:1511.04628

详情

展开后加载摘要…

URL PDF HTML 收藏
1511.04628 2026-06-04 cs.RO cs.SY eess.SY

A Framework for Planning and Controlling Non-Periodic Bipedal Locomotion

一种用于非周期性双足运动规划与控制的框架

Ye Zhao, Benito R. Fernandez, Luis Sentis

机构 * Human Centered Robotics Laboratory, The University of Texas at Austin, TX, USA(以人为中心的机器人实验室,德克萨斯大学奥斯汀分校) Neuro-Engineering Research and Development Laboratory, The University of Texas at Austin, TX, USA(神经工程研究与开发实验室,德克萨斯大学奥斯汀分校)

AI总结 本文提出了一种基于非周期性顶点状态鲁棒跟踪的双足运动规划与控制理论框架,通过混合相空间规划与控制方法实现非周期性步态生成及抗干扰能力。

Comments 33 pages, 18 figures, journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03940 2026-06-03 eess.IV cs.CV cs.LG cs.RO

SEAOTTER: Sensor Embedded Autoencoding with One-Time Transcode for Efficient Reconstruction

SEAOTTER: 基于传感器嵌入自编码器与一次性转码的高效重建

Dan Jacobellis, Neeraja J. Yadwadkar

机构 * Department of Electrical and Computer Engineering(电气与计算机工程系) The University of Texas at Austin(德克萨斯大学奥斯汀分校)

AI总结 提出SEAOTTER框架,结合传感器嵌入自编码器与可学习JPEG转码,在200:1压缩比下实现比AVIF快7倍编码、3.5倍解码,并提升ImageNet top-1准确率8%,同时保持JPEG兼容性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03260 2026-06-03 cs.LG cs.AI

EqGINO: Equivariant Geometry-Informed Fourier Neural Operators for 3D PDEs

EqGINO: 面向3D PDE的等变几何信息傅里叶神经算子

Sungwon Kim, Juho Song, Seungmin Shin, Guimok Cho, Sangkook Kim, Chanyoung Park

机构 * University of Texas at Austin(得克萨斯大学奥斯汀分校)

AI总结 提出EqGINO框架,通过在谱域强制执行各向同性,实现离散对称性的精确等变,并泛化到任意连续旋转,有效建模3D PDE的坐标不变物理规律。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04956 2026-06-03 cs.LG cs.IT math.IT

WaterSIC: Information-Theoretically (Near) Optimal Linear Layer Quantization

WaterSIC: 信息论(近乎)最优的线性层量化

Egor Lifar, Semyon Savkin, Or Ordentlich, Yury Polyanskiy

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Stanford University(斯坦福大学) University of California, Berkeley(加州大学伯克利分校) University of Texas at Austin(德克萨斯大学奥斯汀分校)

AI总结 针对密集线性层低精度量化问题,提出WaterSIC算法,通过为权重矩阵不同列分配不同量化率,实现与信息论极限仅0.255比特的差距,并在Llama和Qwen系列大语言模型上达到1-4比特量化的最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12221 2026-06-03 cs.CV

Best of Both Worlds: Multimodal Reasoning and Generation via Unified Discrete Flow Matching

两全其美:通过统一离散流匹配实现多模态推理与生成

Onkar Susladkar, Tushar Prakash, Gayatri Deshmukh, Kiet A. Nguyen, Jiaxun Zhang, Adheesh Juvekar, Tianshu Bao, Lin Chai, Sparsh Mittal, Inderjit S Dhillon, Ismini Lourentzou

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Google Research(谷歌研究) Sony Research, India(索尼印度研究) Indian Institute of Technology, Roorkee(印度理工学院罗尔基分校) University of Texas at Austin(德克萨斯大学奥斯汀分校)

AI总结 提出UniDFlow框架,通过任务特定低秩适配器解耦理解与生成,并利用基于参考的多模态偏好对齐优化忠实性与可控性,在多个基准上达到最先进性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02573 2026-06-02 cs.CV

HumanNOVA: Photorealistic, Universal and Rapid 3D Human Avatar Modeling from a Single Image

HumanNOVA: 从单张图像实现逼真、通用且快速的3D人体化身建模

Hezhen Hu, Wangbo Zhao, Lanqing Guo, Hanwen Jiang, Jonathan C. Liu, Zhiwen Fan, Kai Wang, Zhangyang Wang, Georgios Pavlakos

机构 * University of Texas at Austin(德克萨斯大学奥斯汀分校) National University of Singapore(新加坡国立大学) Texas A&M University(德克萨斯农工大学)

AI总结 提出HumanNOVA模型,通过可扩展数据生成流水线和前馈令牌条件化架构,从单张RGB图像快速生成逼真3D人体化身,无需测试时优化。

Comments CVPR 2026 Highlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02556 2026-06-02 cs.CL

HERO'S JOURNEY: Testing Complex Rule Induction with Text Games

英雄之旅:用文本游戏测试复杂规则归纳

Anshun Asher Zheng, Kanishka Misra, David I. Beaver, Junyi Jessy Li

机构 * Department of Linguistics(语言学系) The University of Texas at Austin(德克萨斯大学奥斯汀分校)

AI总结 本文提出HERO'S JOURNEY基准,通过目标导向的文本游戏评估大型语言模型在属性与程序归纳任务中的规则推理能力,发现模型虽能进行规则归纳但能力有限且不均衡,程序执行成为瓶颈,而表面语义影响较小。

Comments 24 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01985 2026-06-02 cs.CV

MT-EditFlow: Reinforcement Learning for Multi-Turn Image Editing with Flow Matching

MT-EditFlow:基于流匹配的多轮图像编辑强化学习

Jiahui Huang, Yasi Zhang, Tianyu Chen, Shu Wang, Jianwen Xie, Oscar Leong, Mingyuan Zhou, Nanzhu Wang, Ying Nian Wu

机构 * Apple(苹果公司) University of California, Los Angeles(加州大学洛杉矶分校) University of Texas at Austin(德克萨斯大学奥斯汀分校) Lambda, Inc(Lambda公司)

AI总结 提出MT-EditFlow框架,通过流匹配强化学习优化多轮图像编辑的奖励信号,解决单轮编辑模型在多轮交互中的失败和误差传播问题,显著提升多轮编辑性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01596 2026-06-02 math.NA cs.LG cs.NA

Learning Chaotic Dynamics through Second-Order Geometric Supervision

通过二阶几何监督学习混沌动力学

Shinhoo Kang, Hai V. Nguyen, Tan Bui-Thanh

机构 * Department of Computer Science and Software Engineering, Korea University(韩国大学计算机科学与软件工程系) Department of Aerospace Engineering and Engineering Mechanics, The Oden Institute for Computational Engineering and Sciences, The University of Texas at Austin(德克萨斯大学奥斯汀分校航空航天工程与工程力学系,奥登计算工程与科学研究所)

AI总结 提出模型约束随机雅可比匹配方法,以O(d^2)代价隐式施加二阶一致性,在混沌系统中恢复吸引子几何和不变统计量。

Comments 37 pages, 15 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01468 2026-06-02 stat.ML cs.AI cs.LG

Computation-Aware Kalman Filtering with Model Selection for Neural Dynamics

基于模型选择的计算感知卡尔曼滤波用于神经动力学

JR Huml, Jonathan Wenger, John P. Cunningham

机构 * University of California, Berkeley(加州大学伯克利分校) University of Washington(华盛顿大学) University of Texas at Austin(得克萨斯大学奥斯汀分校)

AI总结 提出计算感知状态空间模型(CASSM),通过新训练损失和优化方案实现模型选择,在试验数远少于神经元数的规模不平衡场景中,以可处理的计算复杂度提供竞争性预测和更优的不确定性校准。

Comments 24 pages, Proceedings of 2nd International Conference on Probabilistic Numerics (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00953 2026-06-02 cs.LG cs.MA

When Parallelism Pays Off: Cohesion-Aware Task Partitioning for Multi-Agent Coding

当并行性有回报时:面向多智能体编码的凝聚力感知任务划分

Xu Yang, Lunyiu Nie, Ethan Chandra, Stanislav Gannutin, Fangru Lin, Swarat Chaudhuri

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校) University of Oxford(牛津大学)

AI总结 提出Co-Coder方法,通过静态分析构建依赖图、社区检测划分图及依赖感知调度,在仓库级软件工程中平衡通信与计算开销,实现多智能体并行编码的效率和成本优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00888 2026-06-02 cs.LG cs.AI

Memory-Efficient LLM Training with Dynamic Sparsity: From Stability to Practical Scaling

基于动态稀疏性的内存高效LLM训练:从稳定性到实际扩展

Qiao Xiao, Boqian Wu, Patrik Okanovic, Tomasz Sternal, Maurice van Keulen, Elena Mocanu, Mykola Pechenizkiy, Decebal Constantin Mocanu, Torsten Hoefler

机构 * University of Waterloo(滑铁卢大学) University of California, Berkeley(加州大学伯克利分校) ETH Zurich(苏黎世联邦理工学院) University of Texas at Austin(德克萨斯大学奥斯汀分校) University of Michigan(密歇根大学)

AI总结 提出SMET方法,通过优化器预热和密度感知学习率缩放解决动态稀疏训练中的优化不稳定问题,实现LLM的稳定、可扩展且内存高效的稀疏预训练。

Comments Accepted at ICML2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00198 2026-06-02 cs.LG cs.AI cs.CL

BAGEN: Are LLM Agents Budget-Aware?

BAGEN:LLM 智能体是否具有预算意识?

Yuxiang Lin, Zihan Wang, Mengyang Liu, Yuxuan Shan, Longju Bai, Junyao Zhang, Xing Jin, Boshan Chen, Jinyan Su, Xingyao Wang, Jiaxin Pei, Manling Li

机构 * Northwestern University(西北大学) O2 Lab(O2实验室) Independent(独立) University of Michigan(密歇根大学) Cornell(康奈尔大学) All Hands AI Stanford(斯坦福大学) UT Austin(德克萨斯大学奥斯汀分校)

AI总结 本文提出预算感知智能体(BAGEN)概念,将预算作为主动控制信号而非被动成本指标,通过渐进区间估计方法预测剩余预算上下界,并在四个环境和五个前沿模型上发现强模型不一定具有强预算意识、模型过度乐观等失败模式,早期停止可节省 28-64% 令牌,但精确区间校准仍具挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00132 2026-06-02 cs.LG cs.AI

Foundation-Preserving Adaptation via Generalized Rayleigh-Quotient Optimization

基于广义瑞利商优化的基础模型保留适配

Dongjun Kim, Adrian de Wynter, Huancheng Chen, Heasung Kim, Haris Vikalo

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校) Microsoft(微软) Microsoft AI(微软人工智能) Meta

AI总结 提出FoLoRA框架,通过广义瑞利商优化更新方向,在微调中平衡下游任务性能与预训练能力保留。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17034 2026-06-02 cs.LG cs.AI cs.CR

Privacy Policy Enforcement Guardrails for Data-Sensitive Retrieval-Augmented Generation

面向数据敏感检索增强生成的隐私策略执行护栏

Osama Zafar, Alexander Nemecek, Yiqian Zhang, Wenbiao Li, Debargha Ganguly, Vikash Singh, Vipin Chaudhary, Erman Ayday

机构 * University of California, Berkeley(加州大学伯克利分校) University of Washington(华盛顿大学) University of Toronto(多伦多大学) University of Texas at Austin(德克萨斯大学奥斯汀分校) University of California, Los Angeles(加州大学洛杉矶分校)

AI总结 针对RAG系统中上下文数据泄露问题,提出基于双单类密度估计器与融合文本嵌入的隐私策略执行框架,在医学、金融和法律领域实现高AUROC和低误报率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00310 2026-06-02 cs.CV cs.AI cs.LG

Beyond Visual Fidelity: Benchmarking Super-Resolution Models for Large-Scale Remote Sensing Imagery via Downstream Task Integration

超越视觉保真度:通过下游任务集成评估大规模遥感影像的超分辨率模型

Zhili Li, Kangyang Chai, Zhihao Wang, Xiaowei Jia, Yanhua Li, Gengchen Mai, Sergii Skakun, Dinesh Manocha, Yiqun Xie

机构 * University of Maryland(马里兰大学) University of Pittsburgh(匹兹堡大学) Worcester Polytechnic Institute(沃思利技术学院) University of Texas at Austin(德克萨斯大学奥斯汀分校)

AI总结 针对现有超分辨率评估依赖PSNR/SSIM等保真度指标而忽略下游任务效用的问题,提出GeoSR-Bench基准数据集,集成土地覆盖分割、基础设施映射等下游任务,评估GAN、Transformer等9种SR模型在270种设置下的性能,发现保真度指标与任务性能弱相关甚至负相关。

Comments Under review at IEEE TPAMI

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15956 2026-06-02 cs.RO cs.AI

ExpertGen: Scalable Sim-to-Real Expert Policy Learning from Imperfect Behavior Priors

ExpertGen: 从非完美行为先验的可扩展仿真到现实专家策略学习

Zifan Xu, Ran Gong, Maria Vittoria Minniti, Kausik Sivakumar, Ahmet Salih Gundogdu, Eric Rosen, Riedana Yan, Tushar Kusnur, Zixing Wang, Di Deng, Peter Stone, Xiaohan Zhang, Karl Schmeckpeper

机构 * Robotics and AI Institute(机器人与人工智能研究院) University of Texas at Austin(德克萨斯大学奥斯汀分校) Sony AI(索尼人工智能)

AI总结 提出ExpertGen框架,通过扩散策略初始化行为先验并结合强化学习优化噪声,在仅稀疏奖励下生成高质量专家策略,实现从仿真到现实的可扩展迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13430 2026-06-02 cs.CV

Handling Supervision Scarcity in Chest X-ray Classification: Long-Tailed and Zero-Shot Learning

处理胸部X光分类中的监督稀缺性:长尾与零样本学习

Ha-Hieu Pham, Hai-Dang Nguyen, Thanh-Huy Nguyen, Min Xu, Ulas Bagci, Trung-Nghia Le, Huy-Hieu Pham

机构 * University of Technology, Vietnam(越南技术大学) National University of Singapore(新加坡国立大学) University of California, San Diego(加州大学圣地亚哥分校) University of Texas at Austin(德克萨斯大学奥斯汀分校)

AI总结 针对胸部X光分类中极端长尾多标签分布和罕见/未见发现缺失标注的问题,提出不平衡感知多标签学习(任务1)和无需监督标签的零样本预测方法(任务2),在CXR-LT 2026挑战赛中取得领先性能。

Journal ref 2026 IEEE 23rd International Symposium on Biomedical Imaging (ISBI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07438 2026-06-02 cs.CV cs.NA math.NA stat.ME

Two Datasets Are Better Than One: Method of Double Moments for 3-D Reconstruction in Cryo-EM

两个数据集优于一个:冷冻电镜三维重建的双矩方法

Joe Kileel, Oscar Mickelin, Amit Singer, Sheng Xu

机构 * Department of Mathematics and Oden Institute, University of Texas at Austin(德克萨斯大学奥斯汀分校数学系与奥登研究所) Yau Mathematical Sciences Center, Tsinghua University(清华大学姚贝泰数学科学中心) Program in Applied and Computational Mathematics and Department of Mathematics, Princeton University(普林斯顿大学应用与计算数学项目及数学系) Program in Applied and Computational Mathematics, Princeton University(普林斯顿大学应用与计算数学项目)

AI总结 提出双矩方法(MoDM),利用均匀和非均匀两种取向分布下的二阶矩数据唯一确定分子结构,并开发基于凸松弛的算法实现高精度重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04791 2026-06-02 cs.LG

DuetServe: Harmonizing Prefill and Decode for LLM Serving via Adaptive GPU Multiplexing

DuetServe: 通过自适应GPU多路复用协调LLM服务的预填充与解码

Lei Gao, Chaoyi Jiang, Hossein Entezari Zarch, Daniel Wong, Mark Hill, Murali Annavaram

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学) University of Toronto(多伦多大学) University of Washington(华盛顿大学) University of Texas at Austin(德克萨斯大学奥斯汀分校)

AI总结 针对LLM服务中预填充与解码阶段的干扰问题,提出DuetServe框架,通过自适应SM级GPU空间多路复用实现单GPU内的阶段隔离,在保证低延迟的同时提升吞吐量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05641 2026-06-02 cs.CL cs.AI cs.LG

Skill-Based Mixture-of-Experts: Adaptive Routing for Heterogeneous Reasoning via Inferred Skills

基于技能的混合专家模型:通过推断技能实现异构推理的自适应路由

Justin Chih-Yao Chen, Sukwon Yun, Elias Stengel-Eskin, Tianlong Chen, Mohit Bansal

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校)

AI总结 提出Skill-MoE框架,通过推断查询所需技能进行实例级专家选择,并采用批推理策略降低开销,在单GPU上集成16个专家模型,在多个推理基准上平均提升8.15%。

Comments ICML 2026 (Camera-Ready). The first three authors contributed equally. Project Page: https://skill-moe.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04646 2026-06-02 cs.LG cs.AI

Efficient Weighted Sampling via Score-based Generative Models

基于分数生成模型的高效加权采样

Heasung Kim, Taekyun Lee, Hyeji Kim, Gustavo de Veciana

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校)

AI总结 提出一种无需训练的加权采样框架,通过轻量级引导近似和不确定性感知调度器,在预训练分数生成模型上实现高效、稳定的采样,并在大规模设置中取得1.2至4.7倍加速。

Comments 37 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31586 2026-06-01 cs.CL cs.AI

Language Models Learn Constructional Semantics, Not To Mention Syntax: Investigating LM Understanding of Paired-Focus Constructions

语言模型学习构式语义,更不用说句法:探究LM对配对焦点构式的理解

Wesley Scivetti, Ethan Wilcox, Nathan Schneider, Kanishka Misra, Leonie Weissweiler

机构 * Georgetown University(乔治城大学) The University of Texas at Austin(德克萨斯大学奥斯汀分校) Leipzig University(莱比锡大学)

AI总结 通过构建新数据集,研究不同规模开源语言模型对英语中稀有配对焦点构式(如“let alone”)的语义理解,发现中等规模模型能掌握其形式和意义,且语义学习晚于句法知识,并与世界知识相关。

Comments Conference on Natural Language Learning (CoNLL) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31559 2026-06-01 cs.LG

Functional Attention: From Pairwise Affinities to Functional Correspondences

函数注意力:从成对亲和性到函数对应

Jiefang Xiao, Maolin Gao, Simon Weber, Guandao Yang, Daniel Cremers

机构 * Technical University of Munich, Germany(慕尼黑技术大学,德国) Munich Center for Machine Learning (MCML), Germany(慕尼黑机器学习中心(MCML),德国) PIXL, Department of Computer Science, University of Oxford, United Kingdom(牛津大学计算机科学系PIXL,英国) ECE, University of Texas at Austin, USA(德克萨斯大学奥斯汀分校电子与计算机工程系,美国)

AI总结 提出函数注意力机制,将注意力重新解释为自适应基之间的函数对应,通过结构化线性算子替代softmax亲和性,实现紧凑、可泛化、分辨率不变的全局依赖表示,在PDE求解、3D分割和回归等算子学习任务中达到最先进性能。

Comments 26 pages, 12 figures. Accepted at the 43rd International Conference on Machine Learning (ICML 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31464 2026-06-01 cs.LG cs.AI

GPU Forecasters: Language Models as Selective Surrogates for Kernel Runtime Optimization

GPU预测器:语言模型作为内核运行时优化的选择性替代

Zaid Khan, Justin Chih-Yao Chen, Jaemin Cho, Elias Stengel-Eskin, Mohit Bansal

机构 * UNC Chapel Hill(北卡罗来纳大学教堂山分校) AI2 Johns Hopkins University(约翰霍普金斯大学) University of Texas at Austin(德克萨斯大学奥斯汀分校)

AI总结 研究利用语言模型作为GPU内核性能的选择性替代,通过强化学习提高预测准确性和校准度,在有限GPU评估预算下加速内核搜索。

Comments Code: https://github.com/codezakh/gpu-forecasters

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31126 2026-06-01 cs.CL cs.AI cs.LG

Not All Synthetic Data Is Yours to Learn From

并非所有合成数据都适合学习

Sina Alemohammad, Li Chen, Richard G. Baraniuk, Zhangyang Wang

机构 * ECE Department(电子工程系) Apple(苹果公司) The University of Texas at Austin(德克萨斯大学奥斯汀分校) Rice University(里奇大学)

AI总结 研究无提示、无教师、无验证器、无奖励模型的自训练中,语言模型能否从自身生成的文本中学习,发现合成数据与学生之间的兼容性是关键,并揭示了能力与逐字记忆可分离的现象。

详情

展开后加载摘要…

URL PDF HTML 收藏