arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-07-23 至 2026-07-23 共收录 10 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 10 篇

2607.17890 2026-07-23 cs.AI 版本更新 89%

Stress Testing Concept Erasure with Large Language Model Agents

用大语言模型智能体对概念擦除进行压力测试

Yuyang Xue, Feng Chen, Zhihua Liu, Edward Moroshko, Jingyu Sun, Steven McDonagh, Sotirios A. Tsaftaris

机构 * School of Engineering, University of Edinburgh(爱丁堡大学工程学院) The University of Manchester(曼彻斯特大学) The University of Melbourne(墨尔本大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 研究针对概念擦除评估面临的验证挑战,提出STACE框架,利用大语言模型智能体迭代生成并验证压力测试假设,通过一套指标评估性能效率,经实验证明该框架在多方面表现优异且可拓展到其他领域。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19371 2026-07-23 cs.AI cs.CL cs.LG 新提交 86%

Mitigating Scaffolding Collapse in Socratic Tutors via Representation Alignment

通过表示对齐减轻苏格拉底式导师中的支架坍塌

Jing Shao, Qifeng Wu, Hanyu Zhang, Sixia Sun, Jun Zhuang

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);preference optimization(abstract)

AI总结 研究基于大语言模型的苏格拉底式导师的支架坍塌问题,提出支架保留表示对齐方法,先监督微调预热,再结合轨迹加权优化与表示损失,经多学科和策略评估,该方法能提升长程苏格拉底辅导的鲁棒性。

Comments preprint, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19618 2026-07-23 q-bio.GN cs.AI cs.LG 新提交 84%

Causal dictionary learning reveals and validates transcription-factor binding features in genomic language models

因果字典学习揭示并验证基因组语言模型中的转录因子结合特征

Sarwan Ali

机构 * Columbia University Irving Medical Center(哥伦比亚大学伊文思医疗中心)

专题命中 知识编辑与模型理解 :language model(title,abstract);foundation model(abstract);分类 cs.AI、cs.LG

AI总结 研究针对基因组语言模型内部表示不透明问题,引入结合稀疏字典学习与因果干预的框架,训练自动编码器提取转录因子结合特征,开发去混淆协议并因果验证,为基因组深度学习可解释性提供计算标准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22864 2026-07-23 cs.LG 版本更新 79%

Reading Calibrated Uncertainty from Language Model Trajectories

从语言模型轨迹中读取校准的不确定性

Aliai Eusebi, Alexander Herzog, Xiaoyu Liang, Marie Vasek, Enrico Mariconti, Lorenzo Cavallaro

机构 * University College London, London, United Kingdom(伦敦大学学院)

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.LG

AI总结 本文通过提取层间MLP更新的尺度不变几何特征,使用稀疏线性探针从语言模型内部激活轨迹中校准不确定性,在选择性弃权任务中优于最大softmax概率,最高提升21 AURC点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20202 2026-07-23 eess.SP 新提交 78%

JEPA-CFM: A Joint Embedding Predictive Architecture-based Channel Foundation Model for Robust Fluid Antenna Systems

JEPA-CFM:一种基于联合嵌入预测架构的稳健流体天线系统信道基础模型

Yuan Gao, Yiming Liu, Jun Jiang, Jianbo Du, Shunqing Zhang, Xiaoli Chu, Kai-Kit Wong

专题命中 知识编辑与模型理解 :foundation model(title,abstract)

AI总结 针对流体天线系统获取信道信息及定位的障碍,提出基于联合嵌入预测架构的信道基础模型,通过提取潜在嵌入学习通用表示,结合互补损失项训练,经仿真验证其在信道外推和无线定位上优于传统基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19977 2026-07-23 physics.chem-ph physics.atm-clus physics.comp-ph 新提交 78%

Rem3Di: Learning smooth, chiral 3D molecular descriptors from atomistic foundation models

Rem3Di:从原子基础模型学习平滑、手性3D分子描述符

Steffen Wedig, Felix Burton, Rokas Elijošius, Christoph Schran, Lars L. Schaaf

专题命中 知识编辑与模型理解 :foundation model(title,abstract)

AI总结 Rem3Di是一种表征学习框架,利用原子基础模型潜在特征生成可转移分子描述符,用于性质预测和虚拟筛选。它能捕捉分子手性,在药物性质基准测试中表现出色,还能区分过渡金属配合物,为化学机器学习提供新途径。

Comments An earlier version of this work appeared at the NeurIPS 2025 Workshop on Symmetry and Geometry in Neural Representations (NeurReps). Workshop version: https://openreview.net/forum?id=jOmZsvXoK5

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20817 2026-07-23 cs.CL 版本更新 77%

EssayCBM: Rubric-Aligned Concept Bottleneck Models for Transparent Essay Grading

EssayCBM: 基于评分标准的概念瓶颈模型用于透明的作文评分

Kumar Satvik Chaudhary, Chengshuai Zhao, Fan Zhang, Garima Agrawal, Yuli Deng, Huan Liu

机构 * Arizona State University(亚利桑那州立大学)

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);language model(abstract);分类 cs.CL

AI总结 EssayCBM通过分解为八种可解释的写作概念,提供透明的作文评分方法,使教师能够检查和调整评分标准级别的预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20146 2026-07-23 cs.CL 新提交 70%

Gotta Catch them all: the modes of Sycophancy

必须抓住它们:谄媚的模式

Shreyans Jain, Alexandra Yost, Amirali Abdullah

机构 * Thoughtworks(Thoughtworks公司) Southern Utah University (SUU)(南犹他大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究大语言模型谄媚行为,通过分析948种社会压力情境下的三种假设模式,发现其并非单一倾向,而是结构化家族,内部表示从第14层起线性可分,出现在不同处理阶段,依赖不同注意力电路,为更精确测量和干预提供依据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04081 2026-07-23 cs.CL 版本更新 70%

Abstraction Induces the Brain Alignment of Language and Speech Models

抽象诱导语言和语音模型的脑对齐

Emily Cheng, Aditya R. Vaidya, Richard Antonello

机构 * The University of Texas at Austin, USA(德克萨斯大学奥斯汀分校) Zuckerman Mind Brain Behavior Institute, Columbia University, USA(祖克曼心智-大脑-行为研究所,哥伦比亚大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究发现语言和语音模型通过共享的意义抽象与大脑对齐,中间层的高内在维度和语义内容增强了大脑预测性。

Comments ICML 2026 camera-ready version

Journal ref ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18543 2026-07-23 cs.AI cs.CL cs.SE 版本更新 62%

CEO-Bench: Can Agents Play the Long Game?

CEO-Bench:智能体能否玩转长期博弈?

Haozhe Chen, Karthik Narasimhan, Zhuang Liu

机构 * Princeton University(普林斯顿大学)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.AI

AI总结 提出CEO-Bench,通过模拟500天运营初创公司的任务,评估语言模型智能体在长期、不确定、动态环境下的综合决策能力。

详情

展开后加载摘要…

URL PDF HTML 收藏