arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Stanford University(斯坦福大学)

2026-06-24 至 2026-06-24 共收录 9
2606.24884 2026-06-24 cs.RO cs.AI cs.LG 新提交

InSight: Self-Guided Skill Acquisition via Steerable VLAs

InSight: 通过可引导的VLA实现自主技能获取

Maggie Wang, Lars Osterberg, Stephen Tian, Ola Shorinwa, Jiajun Wu, Mac Schwager

机构 * Stanford University(斯坦福大学) Princeton University(普林斯顿大学)

AI总结 提出InSight框架,通过将VLA模型在基本动作层面变得可引导,实现自主技能获取,包括自动分割演示为基本动作和VLM引导的数据飞轮,无需人类演示即可学习新技能。

Comments Project website: https://insight-vla.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24883 2026-06-24 cs.CV 新提交

BenchX: Benchmarking AI Models for Cancer Detection and Localization with Demographic and Protocol Biases

BenchX: 基于人口统计和协议偏差的癌症检测与定位AI模型基准测试

Qi Chen, Wenxuan Li, Pedro R. A. S. Bassi, Xinze Zhou, Jakob Wasserthal, Ibrahim Ethem Hamamci, Sezgin Er, Ashwin Kumar, Yiwen Ye, Yuhan Wang, Yuyin Zhou, Akshay S. Chaudhari, Curtis Langlotz, Kang Wang, Yang Yang, Alan L. Yuille, Zongwei Zhou

机构 * Johns Hopkins University(约翰霍普金斯大学) German Cancer Research Center(德国癌症研究中心) University Hospital Basel(巴塞尔大学医院) University of Zurich(苏黎世大学) ETH AI Center(苏黎世联邦理工学院AI中心) Istanbul Medipol University(伊斯坦布尔梅迪波尔大学) Stanford University(斯坦福大学) École Polytechnique Fédérale de Lausanne(洛桑联邦理工学院) Nanyang Technological University(南洋理工大学) University of California, Santa Cruz(加州大学圣克鲁兹分校) University of California, San Francisco(加州大学旧金山分校) Johns Hopkins Medicine(约翰霍普金斯医学)

AI总结 提出BenchX基准,通过85,355次CT扫描系统评估12个肿瘤检测AI模型在肿瘤大小、位置、患者亚组和成像协议上的表现,揭示模型在罕见亚组中性能不佳。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24855 2026-06-24 cs.AI 新提交

OpenThoughts-Agent: Data Recipes for Agentic Models

OpenThoughts-Agent: 智能体模型的数据配方

Negin Raoof, Richard Zhuang, Marianna Nezhurina, Etash Guha, Atula Tejaswi, Ryan Marten, Charlie F. Ruan, Tyler Griggs, Alexander Glenn Shaw, Hritik Bansal, E. Kelly Buchanan, Artem Gazizov, Reinhard Heckel, Chinmay Hegde, Sankalp Jajee, Daanish Khazi, Emmanouil Koukoumidis, Xiangyi Li, Hange Liu, Shlok Natarajan, Harsh Raj, Nicholas Roberts, Ethan Shen, Nishad Singhi, Michael Siu, Ashima Suvarna, Hanwen Xing, Patrick Yubeaton, Robert Zhang, Leon Liangyu Chen, Xiaokun Chen, Steven Dillmann, Saadia Gabriel, Xunyi Jiang, Anurag Kashyap, Boxuan Li, Yein Park, Minh Pham, Sujay Sanghavi, Lin Shi, Ke Sun, Yixin Wang, Zhiwei Xu, Erica Zhang, Siyan Zhao, Wanjia Zhao, Jenia Jitsev, Alex Dimakis, Benjamin Feuer, Ludwig Schmidt

机构 * UC Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学) JSC(于利希超级计算中心) LAION University of Texas at Austin(德克萨斯大学奥斯汀分校) Bespoke Labs Laude Institute UCLA(加州大学洛杉矶分校) Harvard University & Harvard Medical School(哈佛大学与哈佛医学院) TU Munich & Munich Center for Machine Learning(慕尼黑工业大学与慕尼黑机器学习中心) New York University(纽约大学) Medical University of South Carolina(南卡罗来纳医科大学) The LLM Data Company BenchFlow Independent Researcher(独立研究员) Northeastern University(东北大学) University of Wisconsin–Madison(威斯康星大学麦迪逊分校) University of Washington(华盛顿大学) TU Darmstadt(达姆施塔特工业大学) University of Southern California(南加州大学) UC San Diego(加州大学圣地亚哥分校) Amazon(亚马逊) Microsoft(微软) Korea University(高丽大学) Cornell Tech(康奈尔科技) University of Michigan(密歇根大学)

AI总结 提出全开放数据筛选流水线,通过100多次消融实验研究任务来源与多样性,构建10万样本训练集,在7个智能体基准上平均44.8%准确率,较最强开源模型提升3.9个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24770 2026-06-24 cs.CY cs.AI cs.LG 新提交

Context-Aware Prediction of Student Quiz Performance with Multimodal Textbook Features

基于多模态教材特征的情境感知学生测验表现预测

Samin Khan

机构 * Stanford University(斯坦福大学)

AI总结 本研究通过提取CourseKata教材中复习题的文字和图像特征,结合学生历史表现,将章节测验预测准确率相对提升9.1%,表明情境感知模型能利用内容特征改进预测。

Comments 4 pages, 2 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24256 2026-06-24 cs.CV 新提交

Trimming the Long-Tail of Visual World Modeling Evaluation

修剪视觉世界建模评估的长尾

Bingxuan Li, Yining Hong, Cheng Qian, Hyeonjeong Ha, Jiateng Liu, Zhenhailong Wang, Yue Guo, Yunzhu Li, Heng Ji

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Stanford University(斯坦福大学) Columbia University(哥伦比亚大学)

AI总结 针对视觉世界模型在罕见物理交互上泛化不足的问题,提出Tailor-Bench基准,通过常规、非常规和不可能三种场景模式系统评估模型推理能力,揭示长尾性能差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24177 2026-06-24 cs.SE cs.AI cs.CL cs.MA 新提交

Agon: An Autonomous Large-Scale Omnidisciplinary Research System Built on Prompt Economy

Agon:基于提示经济学的自主大规模全学科研究系统

Youran Sun, Xingyu Ren, Chugang Yi, Jiaxuan Guo, Kejia Zhang, Jianda Du, Haizhao Yang

机构 * University of Maryland, College Park(马里兰大学 College Park 分校) The Chinese University of Hong Kong(香港中文大学) Stanford University(斯坦福大学)

AI总结 提出Agon研究编排系统,通过提示经济学循环实现大规模自主研究,将可验证任务自动化,不可验证判断留给人类,并分类了系统失败类型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24162 2026-06-24 cs.CL cs.LG 新提交

BehaviorBench: Benchmarking Foundation Models for Behavioral Science Tasks

BehaviorBench: 行为科学任务的基础模型基准测试

Jin Huang, Yutong Xie, Wanli Song, Xingjian Zhang, Walter Yuan, Matthew O. Jackson, Qiaozhu Mei

机构 * University of Michigan(密歇根大学) MobLab Stanford University(斯坦福大学) Santa Fe Institute(圣塔菲研究所)

AI总结 提出BehaviorBench基准,评估基础模型在行为预测、战略决策、特质推断和行为知识应用四类任务上的个体与分布级表现,发现通用模型个体预测强,而微调的行为模型分布对齐更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23830 2026-06-24 cs.LG cs.AI 新提交

Deciphering Fingerprints of 3D Molecular Surfaces for Accurate Epitope Prediction

解读3D分子表面指纹以实现准确的表位预测

Fang Wu, Weihao Xuan, Jure Leskovec, Yejin Choi, Li Erran Li

机构 * Stanford University(斯坦福大学) The University of Tokyo(东京大学) Amazon AWS(亚马逊AWS)

AI总结 提出SurfBind框架,直接基于分子表面表示,通过Transformer架构、补丁级表面建模、结合物感知交叉注意力和分层粗到细预测范式,实现表位预测,在SAbDab和DB5.5基准上达到最先进性能。

Journal ref KDD 2026 AI4Science

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22923 2026-06-24 cs.RO 新提交

PanoVine: Whole-Body Visuomotor Control for Soft Growing Vine Robot

PanoVine: 软体生长藤蔓机器人的全身视觉运动控制

Yimeng Qin, Xiaomeng Xu, William Heap, Aditi Oak, Shuran Song, Allison Okamura

机构 * Stanford University(斯坦福大学)

AI总结 针对软体生长藤蔓机器人难以建模和控制的问题,提出基于全身视觉反馈的数据驱动控制框架,利用19个分布式相机和端到端策略实现复杂环境下的自主导航与操作。

详情

展开后加载摘要…

URL PDF HTML 收藏