arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of California, Los Angeles(加州大学洛杉矶分校)

2026-08-12 至 2026-08-12 共收录 8
2608.11171 2026-08-12 cs.CL cs.AI cs.CY 新提交

From Interpretability to Control: Insights from Six Years of the TrustNLP Workshop

从可解释性到控制:TrustNLP研讨会六年的启示

Rahul Gupta, Abhinav Mohanty, Anaelia Ovalle, Anil Ramakrishna, Anubrata Das, Apurv Verma, Jwala Dhamala, Ninareh Mehrabi, Tharindu Kumarage, Yada Pruksachatkun, Yang Trista Cao, Kai-Wei Chang, Aram Galstyan

机构 * Meta Autodesk(欧特克公司) New Jersey Institute of Technology(新泽西理工学院) Salesforce(salesforce公司) University of California, Los Angeles(加州大学洛杉矶分校) Amazon AGI(亚马逊AGI)

AI总结 该研究基于TrustNLP研讨会六年论文,分析NLP可信领域从可解释性到生成式系统控制的转变,明确各信任维度的发展趋势及与领域整体的关联性,提出结构性见解与研究方向。

Comments 17 pages, 2 figures, 3 tables. Submitted to ACL ARR August 2026 cycle (EACL 2027)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11143 2026-08-12 cs.LG 新提交

A Recommendation System Approach for Interference-Robust Sensor Subset Selection

面向抗干扰传感器子集选择的推荐系统方法

Kaan Buyukkalayci, Kyle Pak, Merve Karakas, Christina Fragouli

机构 * University of California, Los Angeles(加利福尼亚大学洛杉矶分校)

AI总结 本文针对现有基于RSSI的传感器子集选择方法易受声学干扰的问题,提出结合频带声学特征与双塔MLP架构的推荐系统框架,在户外车辆跟踪任务中较RSSI基线提升约20%精度且保持低计算开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10333 2026-08-12 cs.LG 新提交

MERA: Model Evolution and Routing with Skill Adaptation for Agentic Systems at Scale

MERA:面向大规模智能体系统的技能适配型模型演化与路由

Yuhang Yao, Zeyu Wang, Wanyi Chen, Tongyun Yang, Yuhang Han, Jie Xiao, Chengke Bao, Tianyi Zhao, Lynn Ai, Eric Yang, Tianyu Shi

机构 * Gradient Soochow University(苏州大学) Carnegie Mellon University(卡内基梅隆大学) Shanghai Jiao Tong University(上海交通大学) University of California, Los Angeles(加利福尼亚大学洛杉矶分校)

AI总结 MERA以单模型调用为适应单元,通过多轮适配提升小模型能力,结合带验证器回退的成本校准路由,在HumanEval+MBPP、TAU-2等数据集上实现小模型性能提升与成本降低。

Comments Preliminary version in CAIS RL-Eval

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07616 2026-08-12 cs.CV 版本更新

HSMLA: Hierarchical Softmax Multi-scale Linear Attention for Efficient Vision Transformers

HSMLA:用于高效视觉Transformer的分层Softmax多尺度线性注意力

Dong Liu, Yanxuan Yu, Renata Borovica-Gajic, Tong Geng, Ying Nian Wu

机构 * University of California, Los Angeles(加州大学洛杉矶分校) Columbia University(哥伦比亚大学) The University of Melbourne(墨尔本大学)

AI总结 针对视觉Transformer高分辨率密集预测的计算开销问题,提出HSMLA,结合多类注意力机制与深度卷积,在多项任务上实现精度与效率的优异平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07284 2026-08-12 cs.LG 版本更新

Same Targets, Different Computation: How Post-Training Divides Work Across Model Layers

指令微调如何改变上游状态影响后期读取:一种跨修补诊断

Yifan Zhou

机构 * University of California, Los Angeles(加州大学洛杉矶分校)

AI总结 研究探讨指令微调如何通过后期栈与上游状态交互影响后续token选择,通过跨修补诊断发现指令微调模型的后期栈效果依赖自身训练状态,且稀疏特征在其中起中介作用。

Comments 14 pages, 4 figures. Code and compact artifacts: https://github.com/yifan1207/first-divergence-crosspatching

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08849 2026-08-12 cs.CL cs.AI cs.DB cs.MA cs.SC 版本更新

SatIR: Scalable High-Recall Constraint-Satisfaction-Based Information Retrieval for Clinical Trials Matching

SatIR:可扩展的高召回率约束满足基于信息检索的临床试验匹配

Zikai Zhou, Yufei Jin, Yilin Xu, Yu-Chiang Wang, Chieh-Ju Chao, Monica S. Lam

机构 * Department of Computer Science, Stanford University(斯坦福大学计算机科学系) Samueli Electrical and Computer Engineering, UCLA(UCLA Samueli电气与计算机工程系) Department of Computer Science and Informatics, Emory University(埃默里大学计算机科学与信息学系) Mayo Clinic(梅奥诊所)

AI总结 SatIR通过将临床试验资格条件和摘要转化为形式约束,结合SMT、关系代数和大语言模型,提升了临床试验匹配的召回率和效率,优于基于相似度的基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23102 2026-08-12 cs.AI cs.CL 版本更新

Multiplayer Nash Preference Optimization

多玩家纳什偏好优化

Fang Wu, Xu Huang, Weihao Xuan, Zhiwei Zhang, Yijia Xiao, Guancheng Wan, Xiaomin Li, Bing Hu, Peng Xia, Jure Leskovec, Yejin Choi

机构 * Stanford University(斯坦福大学) Georgia Institute of Technology(佐治亚理工学院) The University of Tokyo(东京大学) RIKEN AIP(日本理化学研究所智能系统研究中心) Pennsylvania State University(宾夕法尼亚州立大学) University of California, Los Angeles(加州大学洛杉矶分校) Harvard University(哈佛大学) UNC–Chapel Hill(北卡罗来纳大学教堂山分校)

AI总结 本文提出多玩家纳什偏好优化框架,扩展了传统的两玩家纳什对齐方法,通过引入多玩家博弈机制,提升对复杂非传递性人类偏好的对齐能力,并在多个基准测试中表现更优。

Journal ref ICLR 2026 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25143 2026-08-12 cs.CV cs.CL 版本更新

TemMed-Bench: Evaluating Temporal Medical Image Reasoning in Vision-Language Models

TemMed-Bench:评估视觉语言模型的时序医学图像推理能力

Junyi Zhang, Jia-Chen Gu, Wenbo Hu, Yu Zhou, Robinson Piramuthu, Nanyun Peng

机构 * University of California, Los Angeles(加州大学洛杉矶分校)

AI总结 本文提出TemMed-Bench时序医学图像推理基准,评估12个视觉语言模型,发现多数模型缺乏分析患者状况时序变化的能力,多模态检索扩充可显著提升其性能。

详情

展开后加载摘要…

URL PDF HTML 收藏