arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Stanford University(斯坦福大学)

2026-06-23 至 2026-06-23 共收录 16
2606.23595 2026-06-23 cs.AI 新提交

SPIRAL: Learning to Search and Aggregate

SPIRAL: 学习搜索与聚合

Jubayer Ibn Hamid, Ifdita Hasan Orney, Michael Y. Li, Omar Shaikh, Yoonho Lee, Dorsa Sadigh, Chelsea Finn, Noah Goodman

机构 * Stanford University(斯坦福大学)

AI总结 提出SPIRAL框架,通过强化学习联合训练语言模型在推理时使用顺序推理、并行采样和聚合三种原语,实现端到端优化,显著提升推理计算扩展效率。

Comments Ongoing Work

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23489 2026-06-23 cs.GR cs.CV 新提交

MeshFlow: Mesh Generation with Equivariant Flow Matching

MeshFlow: 基于等变流匹配的网格生成

Qi Sun, Kiyohiro Nakayama, Jing Nathan Yan, Qixing Huang, Alexander Rush, Leonidas Guibas, Gordon Wetzstein, Jing Liao, Guandao Yang

机构 * City University of Hong Kong(香港城市大学) Stanford University(斯坦福大学) The University of Texas, Austin(德克萨斯大学奥斯汀分校)

AI总结 提出MeshFlow,利用等变最优传输流匹配模型直接生成三角网格,避免序列化,通过改进扩散变压器架构实现等变性,推理速度提升约18倍。

Comments SIGGRAPH 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22836 2026-06-23 cs.RO 新提交

Cloak: Zero-Shot Cross-Embodiment Manipulation by Masking the End-Effector from the VLA

Cloak: 通过遮蔽末端执行器实现零样本跨本体操作

Michael Piseno, Guy Tevet, C. Karen Liu

机构 * Stanford University(斯坦福大学)

AI总结 提出Cloak训练方法,通过遮蔽腕部相机中的末端执行器,使VLA模型实现零样本跨本体迁移,无需新本体数据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22692 2026-06-23 cs.AI cs.CL cs.DB cs.IR 新提交

VISTA Architect: A graph database-oriented health AI system demonstrated in multidisciplinary tumor boards

VISTA Architect:一种面向图数据库的健康AI系统,在多学科肿瘤委员会中展示

Tuomo Kiiskinen, Jason Fries, Philip Adamson, David Wu, Timothy John Ellis-Caleo, Aaron Fanous, Balasubramanian Narasimhan, Joel Neal, Sylvia Plevritis, Manuel A. Rivas

机构 * Department of Biomedical Data Science, Stanford University School of Medicine(斯坦福大学医学院生物医学数据科学系) Department of Medicine, Stanford University School of Medicine(斯坦福大学医学院医学系)

AI总结 提出VISTA Architect架构,通过图数据库和LLM将EHR转化为持久知识图谱,解决长上下文提示和RAG的时序缺失与高成本问题,在胸科肿瘤委员会中实现96.4%准确率。

Comments 22 pages, 4 figures, 6 tables; includes Supplementary Information. Code: https://github.com/VISTA-Stanford/vista-architect (tag v0.1.0-preprint, commit 8837d44)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21646 2026-06-23 cs.RO 新提交

Energy-based Compositional Diffusion Planning

基于能量的组合扩散规划

Tao Sun, Utkarsh Aashu Mishra, Jiaxin Lu, Danfei Xu, Iro Armeni

机构 * Stanford University(斯坦福大学) Georgia Institute of Technology(佐治亚理工学院) University of Texas at Austin(德克萨斯大学奥斯汀分校)

AI总结 提出能量基组合扩散器(ECD),将全局轨迹建模为局部桥势之和的最小化,通过保守修正场和边界反应项改进启发式拼接,实现线性时间复杂度的马尔可夫分数近似,在OGBench任务中达到最优成功率。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21148 2026-06-23 cs.RO 新提交

Pose-Agnostic Robotic Functional Grasping via Observation-Action Canonicalization

通过观测-动作规范化实现姿态无关的机器人功能性抓取

Le Qiu, Cole Harrison, Jiankai Sun, Yao Liu, Suning Huang, Qianzhong Chen, Yang You, Marco Pavone

机构 * Tsinghua University(清华大学) Amazon(亚马逊) Stanford University(斯坦福大学) University of California, Berkeley(加州大学伯克利分校)

AI总结 提出AnyMug框架,通过观测-动作规范化将深度观测和末端执行器动作转换到物体中心坐标系,训练单一闭环策略实现零样本迁移的功能性抓取,在模拟和真实机器人上均取得高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21126 2026-06-23 cs.LG stat.ML 新提交

What Accuracy and Gradient Cosine Miss: Evaluating Feedback Alignment via Scale Stability, Reference Validity, and Depth Utility

准确率和梯度余弦遗漏了什么:通过尺度稳定性、参考有效性和深度效用评估反馈对齐

Yuren Hao, Xiang Wan, ChengXiang Zhai

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Stanford University(斯坦福大学)

AI总结 针对反馈对齐方法评估中准确率和余弦相似度无法检测的两种隐性失效模式,提出包含尺度稳定性、参考有效性和深度效用三项检查的诊断协议,并采用逐层余弦报告。

Comments 12+10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20993 2026-06-23 cs.CL 新提交

Phonemes to the Rescue: Multilingual Tokenization Based on International Phonetic Alphabet

音素救援:基于国际音标的多语言分词

Milan Miletić, Julie Kallini, Ekaterina Shutova

机构 * University of Amsterdam(阿姆斯特丹大学) Stanford University(斯坦福大学)

AI总结 提出使用国际音标(IPA)作为多语言分词的语言无关输入表示,通过更平衡的字节-字符分布和跨语言字符重叠,显著提升分词质量,尤其对非拉丁文字和未见语言更有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20990 2026-06-23 cs.RO 新提交

Duet: Dual-Robot Understanding via Efficient Teaching

Duet: 通过高效教学实现双机器人理解

Yiqi Zhao, Ruohai Ge, Celina Shiyu Wang, Junjie Ye, Muchen Xu, Minhao Li, Sergey Zakharov, Basile Van Hoorick, Vitor Campagnolo Guizilini, Leonidas Guibas, Gaurav S. Sukhatme, Jyotirmoy V. Deshmukh, Yue Wang

机构 * University of Southern California(南加州大学) Toyota Research Institute(丰田研究所) Stanford University(斯坦福大学)

AI总结 提出DUET框架,利用VR遥操作和人类协作先验,通过预训练与微调结合,实现双机器人移动操作的高效学习,显著降低数据采集成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20852 2026-06-23 cs.CV cs.AI 新提交

Translating Inference-Time Control to Radiology Vision-Language Models: Activation Steering for Pneumonia Classification on Chest X-rays

将推理时控制转化为放射学视觉语言模型:针对胸部X光片肺炎分类的激活引导

Eduardo Moreno Judice de Mattos Farina, Mateus A. Esmeraldo, Felipe Akio Matsuoka, Paulo Eduardo de Aguiar Kuriki, Felipe Campos Kitamura

机构 * Universidade Federal de São Paulo (UNIFESP)(圣保罗联邦大学) Hospital Israelita Albert Einstein(以色列阿尔伯特·爱因斯坦医院) Stanford University School of Medicine(斯坦福大学医学院) DASA University of Texas Southwestern Medical Center (UTSW)(德克萨斯大学西南医学中心) Eden

AI总结 研究评估对比激活添加(CAA)能否在不微调模型权重的情况下改善胸部X光片视觉语言模型(VLM)的肺炎分类性能,在三个冻结模型上测试,发现对其中一个模型有显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20569 2026-06-23 cs.AI cs.HC 新提交

On the Identifiability of User Adaptation in Co-Adaptive Neural Interfaces

关于共适应神经接口中用户适应性的可识别性研究

Philip Waggoner

机构 * Stanford University(斯坦福大学)

AI总结 分析共适应人机系统的可识别性,证明闭环编码器估计不能唯一识别用户适应性,而反映联合系统特性,讨论行为适应解释的含义并提出识别条件。

Comments 4 pages, 6 equations, 1 theorem, 1 proof

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22493 2026-06-23 physics.optics cs.AI 新提交

An LLM-Orchestrated Agent for Directional-Coupler Design with Self-Consistent Eigenmode and FDTD Validation

一种用于定向耦合器设计的LLM编排智能体,具有自洽本征模和FDTD验证

Saumya Biswas, Amrit De, Md Tauhidul Islam

机构 * Department of Mechanical Engineering, University of Maryland, College Park(马里兰大学学院市机械工程系) Apsidal LLC Department of Radiation Oncology, Stanford University(斯坦福大学放射肿瘤科)

AI总结 提出一种由大语言模型编排的智能体,结合本征模求解器和FDTD验证,自动设计SOI 2×2定向耦合器,实现高精度50/50分束。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20246 2026-06-23 cs.RO cs.AI 新提交

Finetuning Vision-Language-Action Models Requires Fewer Layers Than You Think

微调视觉-语言-动作模型所需的层数比你想象的少

Gia-Binh Nguyen, Trong-Bao Ho, Thien-Loc Ha, Khoa Vo, Philip Lund Møller, Quang T. Nguyen, Long Dinh, Tung M. Luu, Tuan Dam, Vu Duong, Trung Le, Nghi D. Q. Bui, Minh Vu, Tran Nguyen Le, An Thai Le, Ngan Le, Daniel Sonntag, James Zou, Jan Peters, Duy M. H. Nguyen, Ngo Anh Vien

机构 * Center for AI Research, VinUniversity(VinUniversity人工智能研究中心) VinRobotics University of Arkansas(阿肯色大学) Technical University of Denmark(丹麦技术大学) Hanoi University of Science and Technology(河内科技大学) KAIST(韩国科学技术院) Monash University(莫纳什大学) Oldenburg University(奥尔登堡大学) DFKI(德国人工智能研究中心) University of Stuttgart(斯图加特大学) IMPRS-IS(国际马克斯·普朗克智能系统研究学院) Stanford University(斯坦福大学) Technische Universität Darmstadt(达姆施塔特工业大学)

AI总结 本文发现VLA模型存在层间表示冗余,提出无需训练的压缩方法,通过去除冗余层将模型深度减少50%,实现40-50%训练加速和30%推理加速,性能不变。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18487 2026-06-23 cs.LG cs.AI cs.CL 新提交

SFT Overtraining Predicts Rank Inversion via Entropy Collapse Under RLVR

SFT 过训练通过熵崩溃预测 RLVR 下的排名反转

Siddharth Aphale, Kelly Liu

机构 * Stanford University(斯坦福大学)

AI总结 研究发现 SFT 过度训练导致 rollout 分布熵降低,使 GRPO 中优势信号消失,从而引发排名反转;提出基于熵的两阶段诊断方法可预警高风险检查点。

Comments Accepted at the Deep Learning for Code (DL4C) Workshop at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16118 2026-06-23 cs.AI cs.CL cs.LO 新提交

Know Your Limits : On the Faithfulness of LLMs as Solvers and Autoformalizers in Legal Reasoning

了解你的局限:LLM在法律推理中作为求解器和自动形式化工具的忠实性

Olivia Peiyu Wang, Sanna Wong-Toropainen, Daneshvar Amrollahi, Ryan Bai, Tashvi Bansal, Arush Garg, Leilani H. Gilpin

机构 * UC Santa Cruz(加州大学圣克鲁兹分校) Univ. Helsinki(赫尔辛基大学) CodeX, Stanford(斯坦福大学CodeX中心) Stanford University(斯坦福大学) Canyon Crest Academy(峡谷峰学院) Monta Vista High School(蒙塔维斯塔高中) Los Altos High School(洛斯阿尔托斯高中)

AI总结 研究LLM在法律推理中是否忠实执行逻辑推理,发现LLM基于形式推理的高性能掩盖了范围清洗等不忠实模式,揭示基准准确性与逻辑忠实性之间的根本差距。

Comments 10 pages, submitted to COLM 2026 (under review, average score of 6.25 across 4 reviewers) and accepted by the AI4Law and AI4Math workshops at ICML. This is the version where we already addressed most of the reviews from the COLM & AI4Law &; AI4Math reviewers

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14970 2026-06-23 cs.LG 新提交

Zero-order Parameter-free Optimization for LMO-based Methods: Novel Approach for Efficient Fine-tuning

基于LMO方法的零阶无参数优化:高效微调的新方法

Dmitriy Bystrov, Daniil Medyakov, Dmitry Bylinkin, Aleksandr Beznosikov

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学)

AI总结 针对大模型微调中反向传播内存开销大、零阶优化对步长和平滑参数敏感的问题,提出统一无梯度训练、自适应调参和非欧几里得更新几何的AdaNAGED方法,并在OPT-1.3B模型上验证有效性。

Comments 29 pages, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏