arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Stanford University(斯坦福大学)

2026-06-03 至 2026-06-03 共收录 23
2606.02937 2026-06-03 q-bio.NC cs.CV

BEAST3D: Animal behavioral analysis and neural encoding from multi-view video via Gaussian splatting

BEAST3D: 通过高斯泼溅从多视角视频进行动物行为分析与神经编码

Yanchen Wang, Lenny Aharon, Wangshu Zhu, Kyle Daruwalla, Linghua Zhang, Jiaru Zou, Selmaan Chettih, Helen Hou, Liam Paninski, Matthew R Whiteway

机构 * Columbia University(哥伦比亚大学) Cold Spring Harbor(冷泉港) Stanford University(斯坦福大学)

AI总结 提出BEAST3D自监督预训练框架,利用未标注的多视角视频通过3D高斯泼溅重建和动物分割,学习3D视觉表征,有效应用于新视角合成、多视角姿态估计和神经编码。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03823 2026-06-03 cs.AI cs.CY cs.NE

Calibrating Urban Traffic Simulation from Sparse Road Observations via Genetic Optimization

基于遗传优化的稀疏道路观测城市交通仿真校准

Hunter Sawyer, Jesse Roberts, Simon Matei

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学)

AI总结 提出一种基于遗传算法的框架,利用稀疏道路观测数据校准城市交通仿真,无需详细就业数据,生成与真实测量高度相关的交通流和就业分布。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03814 2026-06-03 cs.AI

Leveraging BART to Assess CS1 C++ Programming Assignments using Rubric-based Criteria

利用BART基于评分标准评估CS1 C++编程作业

Kelsey Rainey, Jesse Roberts

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学)

AI总结 提出基于评分标准的多任务微调BART模型,用于自动评分C++编程作业,通过联合预测数值分数和等级区间并匹配分布,使评分更接近教师行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03686 2026-06-03 cs.AI

The DeepSpeak-Agentic Dataset

DeepSpeak-Agentic 数据集

Sarah Barrington, Maty Bohacek, Hany Farid

机构 * University of California, Berkeley, USA(加州大学伯克利分校) Stanford University, USA(斯坦福大学)

AI总结 本文提出了一个包含37小时人机半结构化对话视频的数据集DeepSpeak-Agentic,用于评估AI代理的自动取证识别、研究人机交互特性,并作为大型语言模型和AI生成语音/面部技术的基准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03291 2026-06-03 cs.CL

Multilingual Unlearning in LLMs: Transfer, Dynamics, and Reversibility

大型语言模型中的多语言遗忘:迁移、动态与可逆性

Chaoyi Xiang, Olga Ohrimenko, Benjamin I. P. Rubinstein, Lea Frermann

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学) University of Toronto(多伦多大学) University of Washington(华盛顿大学)

AI总结 本文通过扩展TOFU基准到五种语言,研究大型语言模型中的多语言遗忘,发现遗忘迁移在不同语言间高度可变,且遗忘主要作用于后期解码层而非共享的跨语言潜在空间,因此可以通过推理时的单一引导方向逆转大部分遗忘效果。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03232 2026-06-03 cs.LG cs.AI

GFFMERGE: Efficient Merging of Graph Neural Force Fields and Beyond

GFFMERGE: 图神经力场的高效合并及其扩展

Parth Verma, Parv P. Singh, Vipul Garg, Ishita Thakre, N. M. Anoop Krishnan, Sayan Ranu

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学) University of Cambridge(剑桥大学)

AI总结 提出GFFMERGE框架,通过凸嵌入对齐问题解析解实现图神经网络的闭式模型合并,在力场回归任务中恢复接近联合训练的性能,并实现5-27倍加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03173 2026-06-03 cs.CY cs.LG cs.SI

Auditing Engagement Incentives in the Kidfluencer Ecosystem: A Multimodal Weak Supervision Approach

审计儿童网红生态系统中的参与激励:一种多模态弱监督方法

Zijing Wei, Chao Peter Yang, Xuanjie Chen

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学)

AI总结 本研究采用多模态弱监督方法审计YouTube儿童网红频道,发现剥削信号与观看量显著正相关,且表演性劳动、情感诱饵和隐私侵犯能带来参与度溢价。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03148 2026-06-03 cs.CV

$A^2$: Smaller Self-Supervised ViTs Localize Better than Larger Ones

$A^2$: 较小的自监督ViT比更大的ViT定位更优

Sreehari Rammohan, Huy Ha, Carl Vondrick

机构 * Columbia University(哥伦比亚大学) Stanford University(斯坦福大学)

AI总结 针对视觉分类中前景定位与丰富表征的矛盾,提出$A^2$方法,通过解耦小模型定位与大模型嵌入,利用预训练特征实现无需额外训练的竞争性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03131 2026-06-03 cs.LG

HARVE: Hacking-Aware Reward-Head Vector Editing for Robust Reward Models

HARVE:面向鲁棒奖励模型的感知黑客奖励头向量编辑

Shuang Liu, Yuxuan Bo, Qiuyang Zhao, Caiyue Huang, Xiaorong Chen, Yanguang Liu, Mengnan Du

机构 * Carnegie Mellon University(卡内基梅隆大学) University of Virginia(弗吉尼亚大学) Harvard University(哈佛大学) Stanford University(斯坦福大学) University of Michigan(密歇根大学) New Jersey Institute of Technology(新泽西理工学院) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

AI总结 针对奖励模型易受奖励黑客攻击的问题,提出无需训练的奖励头编辑方法HARVE,通过移除与黑客相关子空间对齐的奖励头向量分量,提升鲁棒性并保持通用能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02967 2026-06-03 cs.ET cs.AI cs.AR cs.SY eess.SY

Glass Box at Orbit: A Constitutional AI Verification Framework for Trustworthy Autonomous CubeSat Intelligence

轨道上的玻璃盒:面向可信自主立方星智能的宪法AI验证框架

Karthik Barma, Anil Sanneboyina, V C Premchand Yadav

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学)

AI总结 提出玻璃盒框架,通过运行时宪法AI验证层拦截自主航天器决策,利用六项物理约束和七项线性时序逻辑安全不变式确保安全,并证明其验证开销与模型规模无关。

Comments 12 pages, 2 figures, 2 tables, 32 references. Paper 1 of the Project October series on autonomous orbital intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02958 2026-06-03 cs.CR cs.AI

Echelon: Auditable Aggregate-Only Language-Model Adaptation Across Privacy Boundaries

Echelon: 跨隐私边界的可审计聚合专用语言模型适配

Hina Dixit, Punit Kumar, Irene Tenison, Nevasini Sasikumar

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学)

AI总结 提出Echelon架构,通过强制设备级模型状态不可导出为系统不变量,仅允许聚合后的跨边界数据传输,并结合缓冲半异步安全聚合、陈旧感知加权等机制,在1B参数LoRA适配中实现低通信开销下的稳定训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02948 2026-06-03 cs.LG cs.DS

From Non-Convex to Strongly Convex: Curvature-Adaptive FTPL for Online Optimization

从非凸到强凸:曲率自适应的FTPL在线优化

Moses Charikar, Chirag Pabbaraju, Ambuj Tewari

机构 * Stanford University(斯坦福大学) University of Michigan, Ann Arbor(密歇根大学安娜堡分校)

AI总结 提出一种曲率自适应的FTPL算法,通过时变扰动尺度实现非凸Lipschitz损失下的最优遗憾界,并在线性累积曲率下达到对数遗憾。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26006 2026-06-03 cs.CV cs.GR cs.RO

MIND: Multi-Scale Intent Diffusion for Text-Driven Physics-Based Humanoid Control

MIND: 多尺度意图扩散用于文本驱动的基于物理的人形控制

Bin Li, Ruichi Zhang, Han Liang, Jingyan Zhang, Juze Zhang, Xin Chen, Jingya Wang

机构 * ShanghaiTech University(上海科技大学) University of Pennsylvania(宾夕法尼亚大学) Bytedance Seed(字节跳动种子) Stanford University(斯坦福大学) InstAdapt

AI总结 提出MIND框架,通过多尺度意图扩散机制将文本命令与低级动作语义对齐,实现基于物理的人形机器人行为生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29123 2026-06-03 cs.CL

Learning Concepts, Not Tokens: Self-Supervised Semantic Alignment for Language Models

学习概念,而非词元:语言模型的自我监督语义对齐

Christine Zhang, Dan Jurafsky, Chen Shani

机构 * Stanford University(斯坦福大学)

AI总结 提出一种自我监督框架,通过预测语义等价词元集合(概念)替代下一个词元预测,提升语言模型的语义对齐能力,并在分类、聚类、重排序及下游推理任务中取得更优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00667 2026-06-03 cs.CV

Act Like a Pathologist: Tissue-Aware Whole Slide Image Reasoning

像病理学家一样:组织感知的全切片图像推理

Wentao Huang, Weimin Lyu, Peiliang Lou, Qingqiao Hu, Xiaoling Hu, Shahira Abousamra, Wenchao Han, Ruifeng Guo, Jiawei Zhou, Chao Chen, Chen Wang

机构 * Stony Brook University(石英溪大学) Mayo Clinic(梅奥诊所) Harvard Medical School(哈佛医学院) Stanford University(斯坦福大学)

AI总结 提出一种问题引导、组织感知的粗到细检索框架HistoSelect,通过识别相关组织区域并选择最具信息量的补丁,在减少70%视觉标记的同时提升病理问答准确性。

Comments 14 pages, 8 figures. Accepted by CVPR'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20508 2026-06-03 cs.MA cs.AI cs.CL

Measuring Weak-to-Strong Legibility of Reasoning Models

衡量推理模型的弱到强可读性

Dani Roytburg, Shreya Sridhar, Daphne Ippolito

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学)

AI总结 针对推理语言模型在多智能体场景中生成的中间思维链,提出“弱到强可读性”概念,并设计衡量指标以评估强模型输出对弱模型的易理解性。

Comments Accepted to Trustworthy AI4GOOD Workshop @ ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04956 2026-06-03 cs.LG cs.IT math.IT

WaterSIC: Information-Theoretically (Near) Optimal Linear Layer Quantization

WaterSIC: 信息论(近乎)最优的线性层量化

Egor Lifar, Semyon Savkin, Or Ordentlich, Yury Polyanskiy

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Stanford University(斯坦福大学) University of California, Berkeley(加州大学伯克利分校) University of Texas at Austin(德克萨斯大学奥斯汀分校)

AI总结 针对密集线性层低精度量化问题,提出WaterSIC算法,通过为权重矩阵不同列分配不同量化率,实现与信息论极限仅0.255比特的差距,并在Llama和Qwen系列大语言模型上达到1-4比特量化的最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10387 2026-06-03 cs.DB cs.AI

Test-Time Optimization of Physical Query Plans with LLMs

基于LLM的物理查询计划测试时优化

Mehmet Hamza Erol, Xiangpeng Hao, Federico Bianchi, Ciro Greco, Jacopo Tagliabue, James Zou

机构 * Stanford University(斯坦福大学) University of Wisconsin-Madison(威斯康星大学麦迪逊分校) TogetherAI Bauplan

AI总结 提出DBPlanBench框架,利用LLM在测试时通过语义推理和进化搜索优化物理查询计划,在OLAP查询中实现1.05-1.12倍中位数加速,并支持小规模到大规模的迁移。

Comments Code is available at: https://github.com/BauplanLabs/DBPLANBENCH

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23169 2026-06-03 cs.LG cs.LO cs.SC

Names Don't Matter: Symbol-Invariant Transformer for Open-Vocabulary Learning

名称无关:面向开放词汇学习的符号不变Transformer

İlker Işık, Wenchao Li

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学)

AI总结 提出一种符号不变Transformer机制,通过并行嵌入流和聚合注意力实现可互换令牌的重命名不变性,在开放词汇任务上取得显著性能提升。

Comments ICML 2026 Poster (Camera-Ready Version)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22443 2026-06-03 cs.LG cs.CV stat.CO stat.ML

Weak Diffusion Priors Can Still Achieve Strong Inverse-Problem Performance

弱扩散先验仍能实现强逆问题性能

Jing Jia, Wei Yuan, Sifan Liu, Liyue Shen, Guanyang Wang

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学)

AI总结 研究弱扩散先验在逆问题中的鲁棒性,通过贝叶斯一致性和局部相关性分析揭示其在信息丰富测量下仍有效的原因。

Comments 37 pages, ICML 2026 spotlight. Code: https://github.com/jjia131/weak-diffusion-priors-inverse-problem, Project Page: https://jjia131.github.io/weak-diffusion-priors-inverse-problem/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02304 2026-06-03 cs.MA cs.AI cs.CL cs.FL cs.LG

Automata-Conditioned Cooperative Multi-Agent Reinforcement Learning

自动机条件化协作多智能体强化学习

Beyazit Yalcinkaya, Marcell Vazquez-Chanlatte, Ameesh Shah, Hanna Krasowski, Sanjit A. Seshia

机构 * Massachusetts Institute of Technology(麻省理工学院) Stanford University(斯坦福大学)

AI总结 提出自动机条件化协作多智能体强化学习框架,通过自动机分解团队目标为子任务,学习任务条件化的分散策略,实现最优任务分配和多步协调。

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11821 2026-06-03 cs.AI

Approximating Probabilistic Inference in Statistical EL with Knowledge Graph Embeddings

使用知识图谱嵌入近似统计EL中的概率推理

Yuqicheng Zhu, Nico Potyka, Bo Xiong, Trung-Kien Tran, Mojtaba Nayyeri, Evgeny Kharlamov, Steffen Staab

机构 * Bosch Center for AI(博世人工智能中心) University of Stuttgart(斯图加特大学) Cardiff University(卡迪夫大学) Stanford University(斯坦福大学) University of Oslo(奥斯陆大学) University of Southampton(南安普顿大学)

AI总结 本文提出利用知识图谱嵌入高效近似统计EL中的概率推理,并提供了运行时和正确性保证的理论证明及实验评估。

Comments Accepted at UAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.15619 2026-06-03 cs.CL cs.AI

Typhoon: Towards an Effective Task-Specific Masking Strategy for Pre-trained Language Models

Typhoon: 面向预训练语言模型的有效任务特定掩码策略

Muhammed Shahir Abdurrahman, Hashem Elezabi, Bruce Changlong Xu

机构 * Department of Computer Science, Stanford University(斯坦福大学计算机科学系)

AI总结 本文提出Typhoon,一种基于任务损失梯度的自适应掩码策略,在GLUE任务上对比随机掩码和整词掩码,经严格评估发现无显著优势。

Comments 9 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏