arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

University of California, Berkeley(加州大学伯克利分校)

2026-03-31 至 2026-03-31 共收录 7
2603.28005 2026-03-31 cs.CL

Rethinking Atomic Decomposition for LLM Judges: A Prompt-Controlled Study of Reference-Grounded QA Evaluation

重新思考用于LLM裁判的原子分解:一种受参考影响的问答评估的提示控制研究

Xinran Zhang

机构 * University of California, Berkeley(加州大学伯克利分校)

AI总结 本文研究了参考导向问答评估中原子分解与整体裁判的性能差异,发现整体裁判在多数基准中表现更优,尤其在部分支持案例中表现突出,且参考质量下降对两种裁判方式均产生显著影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27850 2026-03-31 cs.SE cs.CL

EffiSkill: Agent Skill Based Automated Code Efficiency Optimization

EffiSkill:基于代理技能的自动代码效率优化

Zimu Wang, Yuling Shi, Mengfan Li, Zijun Liu, Jie M. Zhang, Chengcheng Wan, Xiaodong Gu

机构 * Shanghai Jiao Tong University(上海交通大学) University of California, Berkeley(加州大学伯克利分校) Columbia University(哥伦比亚大学) King's College London(伦敦国王学院) East China Normal University(华东师范大学) Shanghai Innovation Institute(上海创新研究院)

AI总结 EffiSkill通过构建可移植的优化工具箱,利用代码效率优化机制,实现无运行反馈的代码优化,提升了优化成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21356 2026-03-31 cs.CV

FluidGaussian: Propagating Simulation-Based Uncertainty Toward Functionally-Intelligent 3D Reconstruction

FluidGaussian: 通过基于仿真的不确定性传播实现功能智能的3D重建

Yuqiu Liu, Jialin Song, Marissa Ramirez de Chanlatte, Rochishnu Chowdhury, Rushil Paresh Desai, Wuyang Chen, Daniel Martin, Michael W. Mahoney

机构 * Simon Fraser University(西蒙弗雷泽大学) Lawrence Berkeley National Lab(劳伦斯伯克利国家实验室) University of California, Berkeley(加州大学伯克利分校) International Computer Science Institute(国际计算机科学研究所)

AI总结 本文提出FluidGaussian方法,通过耦合几何重建与流体-结构相互作用,提升3D重建的物理真实性和功能感知能力,实验显示在多个数据集上提升了视觉质量和物理仿真精度。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04618 2026-03-31 cs.LG cs.AI cs.CL

Agentic Context Engineering: Evolving Contexts for Self-Improving Language Models

代理情境工程:为自我改进语言模型演化情境

Qizheng Zhang, Changran Hu, Shubhangi Upasani, Boyuan Ma, Fenglu Hong, Vamsidhar Kamanuru, Jay Rainton, Chen Wu, Mengmeng Ji, Hanchen Li, Urmish Thakker, James Zou, Kunle Olukotun

机构 * Stanford University(斯坦福大学) SambaNova Systems, Inc.(SambaNova Systems公司) UC Berkeley(加州大学伯克利分校)

AI总结 本文提出ACE框架,通过生成、反思和整理的模块化过程,使情境持续进化,提升语言模型在代理和领域推理中的性能,减少适应延迟和成本。

Comments ICLR 2026; 32 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03721 2026-03-31 cs.CV cs.CL cs.CY cs.LG

Person-Centric Annotations of LAION-400M: Auditing Bias and Its Transfer to Models

针对LAION-400M的人为中心标注:审查偏见及其在模型中的转移

Leander Girrbach, Stephan Alaniz, Genevieve Smith, Trevor Darrell, Zeynep Akata

机构 * Technical University of Munich, Munich Center for Machine Learning (MCML), MDSI(慕尼黑工业大学,慕尼黑机器学习中心(MCML),MDSI) LTCI, Télécom Paris, Institut Polytechnique de Paris, France(法国巴黎理工学院,巴黎电信学院,LTCI) Helmholtz Munich(亥姆霍兹慕尼黑中心) University of California, Berkeley(加州大学伯克利分校)

AI总结 本文通过创建LAION-400M的人为中心标注,揭示了训练数据中存在的人口统计学偏见,并展示了这些偏见如何转移到视觉-语言模型中。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03821 2026-03-31 cs.CV cs.AI

Beyond Recognition: Evaluating Visual Perspective Taking in Vision Language Models

超越识别:评估视觉语言模型中的视觉视角理解

Gracjan Góral, Alicja Ziarko, Piotr Miłoś, Michał Nauman, Maciej Wołczyk, Michał Kosiński

机构 * University of Warsaw(华沙大学) Polish Academy of Sciences(波兰科学院) Stanford University(斯坦福大学) University of California, Berkeley(加州大学伯克利分校) IDEAS NCBR Lute

AI总结 本文通过144个视觉任务评估VLMs的视觉视角理解能力,发现模型在场景理解上表现优异,但在空间推理和视角理解上存在明显不足。

Comments Accepted at CVPR 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26795 2026-03-31 eess.AS cs.AI cs.SD

HASS: Hierarchical Simulation of Logopenic Aphasic Speech for Scalable PPA Detection

HASS:面向可扩展PPA检测的层次化日语口语模拟

Harrison Li, Kevin Wang, Cheol Jun Cho, Jiachen Lian, Rabab Rangwala, Chenxu Guo, Emma Yang, Lynn Kurteff, Zoe Ezzes, Willa Keegan-Rodewald, Jet Vonk, Siddarth Ramkrishnan, Giada Antonicelli, Zachary Miller, Marilu Gorno Tempini, Gopala Anumanchipalli

机构 * UC Berkeley(加州大学伯克利分校) UCSF(加州大学旧金山分校) Zhejiang University(浙江大学) Columbia University(哥伦比亚大学) Basque Center on Cognition, Brain and Language(巴斯克认知、大脑与语言中心)

AI总结 本文提出HASS框架,通过系统模拟lvPPA的语义、语音和时间缺陷,提升PPA检测模型的准确性和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏