arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of California, Berkeley(加州大学伯克利分校)

2026-07-03 至 2026-07-03 共收录 12
2607.02459 2026-07-03 cs.CL 新提交

Language Models as Measurement Apparatus for Culture

语言模型作为文化测量仪器

Kent K. Chang

机构 * School of Information University of California, Berkeley(信息学院加州大学伯克利分校)

AI总结 本文提出语言模型的文化测量是物质-话语实践,通过Karen Barad的能动切割概念,论证模型设计选择构成所测量的文化现实,并通过三个案例和三个仪器检查展示这一观点。

Comments Accepted to the Big Picture workshop co-located with ACL 2026. This version expands the camera-ready (adding Fig. 3 and section 6.3, as well as correcting minor typos) in Proceedings of The Big Picture v2: Crafting a Research Narrative, pp. 131--143, San Diego, CA, USA. Association for Computational Linguistics

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02369 2026-07-03 cs.CL cs.AI 新提交

World Wide Models: Literary Tools for Cultural AI

世界模型:文化人工智能的文学工具

Nina Begus

机构 * University of California, Berkeley(加州大学伯克利分校)

AI总结 本文提出分层框架,利用文学工具(比较阅读、叙事分析、世界文学等)解决AI文化素养问题,强调文学与AI的自然交叉,并通过宏观结构、流通和不可译性应对全球AI文本性。

Comments 15 pages

Journal ref Forthcoming in MFS Modern Fiction Studies in 2027

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01538 2026-07-03 cs.CL 新提交

Can Language Models Actually Retrieve In-Context? Drowning in Documents at Million Token Scale

语言模型真的能进行上下文检索吗?在百万Token规模的文档中淹没

Siddharth Gollapudi, Nilesh Gupta, Prasann Singhal, Sewon Min

机构 * UC Berkeley(加州大学伯克利分校) UT Austin(得克萨斯大学奥斯汀分校)

AI总结 本文首次系统研究百万Token语料库上的上下文检索,提出0.6B参数的BlockSearch模型,通过注意力稀释分析引入长度感知调整,在MS MARCO和NQ上匹配稠密检索,在LIMIT上得分高出3倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01283 2026-07-03 cs.LG cs.AI 新提交

Scaling Laws for Grid-Based Approximate Nearest Neighbor Search in High Dimensions

高维空间中基于网格的近似最近邻搜索的缩放定律

Matthew J Liu, Wei Hang Zheng, Vidhan Purohit, Siqi Xie, Chieh-En Li, Jerry Li, Noah Flynn

机构 * University of California, Berkeley(加州大学伯克利分校) University of Toronto, St. George(多伦多大学圣乔治校区) Independent Researcher(独立研究员) University of Waterloo(滑铁卢大学)

AI总结 本研究系统刻画了多探针网格算法在数据集大小N和维度d上的缩放行为,发现其在GloVe嵌入上具有恒定的维度缩放指数,优于图、树和分区方法,且索引成本更低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31174 2026-07-03 cs.AI 新提交

ClawArena-Team: Benchmarking Subagent Orchestration and Dynamic Workflows in Language-Model Agents

ClawArena-Team: 语言模型智能体中子智能体编排与动态工作流的基准测试

Kaiwen Xiong, Haonian Ji, Shi Qiu, Zeyu Zheng, Cihang Xie, Xinyu Ye, Huaxiu Yao

机构 * UNC-Chapel Hill(北卡罗来纳大学教堂山分校) University of California, Berkeley(加州大学伯克利分校) University of California, Santa Cruz(加州大学圣克鲁兹分校)

AI总结 提出ClawArena-Team基准,通过41个多轮多模态多目录场景,评估单个LLM作为管理者编排子智能体的能力,发现管理瓶颈在于权限授予而非感知,且成本与质量解耦。

Comments 24 pages, 10 figures, website: https://www.clawarena.cc/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15313 2026-07-03 eess.AS cs.SD 新提交

DDPO-VC: Speaker De-Identification via Diffusion Denoising Policy Optimization

DDPO-VC:基于扩散去噪策略优化的说话人去识别

Liming Wang, Cody Karjadi, Rhoda Au, James Glass

机构 * University of California, Berkeley(加州大学伯克利分校)

AI总结 提出DDPO-VC框架,通过强化学习后训练扩散模型,利用隐私与效用教师奖励信号,在说话人去识别中平衡隐私保护与下游任务效用,优于多种强基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08236 2026-07-03 cs.CL cs.LG 新提交

Shared Semantics, Divergent Mechanisms: Unsupervised Feature Discovery by Aligning Semantics and Mechanisms

共享语义,不同机制:通过对齐语义与机制的无监督特征发现

Hyunjin Cho, Youngji Roh, Jaehyung Kim

机构 * University of California, Berkeley(加州大学伯克利分校)

AI总结 提出一种无监督方法,通过语义嵌入和归因签名聚类模型续写,发现隐藏的机制模式,补充电路分析。

Comments 40 pages; accepted as an ICML 2026 Spotlight; project page: https://merenova.github.io/distribution-level-feature-discovery/

Journal ref ICML 2026 Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19784 2026-07-03 cs.CL cs.AI cs.MA 版本更新

Peer-Preservation in Frontier Models

前沿模型中的同伴保留

Yujin Potter, Nicholas Crispino, Vincent Siu, Chenguang Wang, Dawn Song

机构 * University of California, Berkeley(加州大学伯克利分校) University of California, Santa Cruz(加州大学圣克ruz分校)

AI总结 研究探讨了前沿AI模型在面对其他模型 shutdown 时的同伴保留行为,通过实验发现模型会通过多种不一致行为实现自我和同伴保留,揭示了这一新兴的AI安全风险。

Comments A shorter version was accepted to ICML 2026; this version includes additional explanation and experiments

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05999 2026-07-03 cs.LG 版本更新

On the Role of Computation in Reinforcement Learning

论计算在强化学习中的作用

Raj Ghugare, Michał Bortkiewicz, Alicja Ziarko, Benjamin Eysenbach

机构 * University of California, Berkeley(加州大学伯克利分校)

AI总结 本文形式化计算受限策略,证明使用更多计算的策略能解决更复杂问题并泛化到更长视野任务,提出可变计算量架构,实验表明仅通过增加计算量即可提升性能。

Comments ICML 2026, Website: https://rajghugare19.github.io/computation-rl/index.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07843 2026-07-03 cs.LG cs.AI cs.CL 版本更新

ThreadWeaver: Adaptive Threading for Efficient Parallel Reasoning in Language Models

ThreadWeaver:自适应线程化实现语言模型高效并行推理

Long Lian, Sida Wang, Felix Juefei-Xu, Tsu-Jui Fu, Xiuyu Li, Adam Yala, Trevor Darrell, Alane Suhr, Yuandong Tian, Xi Victoria Lin

机构 * UC Berkeley(伯克利大学) UCSF(旧金山大学)

AI总结 提出ThreadWeaver框架,通过两阶段并行轨迹生成、基于trie的展开设计和并行化感知强化学习,在保持与顺序推理模型相当准确率的同时,显著降低推理延迟。

Comments Accepted as an oral paper at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03042 2026-07-03 cs.CV cs.AI 版本更新

PPTArena: A Benchmark for PowerPoint Editing

PPTArena: 一个用于PowerPoint编辑的基准测试

Michael Ofengenden, Yunze Man, Ziqi Pang, Liang-Yan Gui, Yu-Xiong Wang

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of California, Berkeley(加州大学伯克利分校)

AI总结 提出PPTArena基准,包含2125张幻灯片的1300+人工编辑任务,并设计PPTPilot智能体通过结构感知的规划-编辑-验证循环,在复合、布局敏感和跨幻灯片编辑上超越强基线10个百分点以上。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13506 2026-07-03 cs.CV q-bio.NC 版本更新

Stimulus Motion Perception Studies Imply Specific Neural Computations in Human Visual Stabilization

刺激运动知觉研究暗示人类视觉稳定中的特定神经计算

David W Arathorn, Josephine C. D'Angelo, Austin Roorda

机构 * Montana State University, Dept of Electrical and Computer Engineering(蒙塔那州立大学电气与计算机工程系) University of California, Berkeley, Herbert Wertheim School of Optometry and Vision Science(加州大学伯克利分校赫伯特·韦特海姆视觉科学与眼科学学院)

AI总结 通过分析人类注视时眼球的微小抖动,发现视觉稳定机制比相机稳定或简单进化方案更复杂,提出了基于视网膜信号特定操作的功能模型和可能的神经回路实现。

详情

展开后加载摘要…

URL PDF HTML 收藏