arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-08-04 至 2026-08-04 共收录 23 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 23 篇

2608.00979 2026-08-04 cs.AI cs.CL cs.GT 新提交 90%

Passing Coarse Marginal Checks Can Be Cheap: Persona Mixtures and Imprecise Treatment-Response Estimates in an LLM Persona Panel

通过粗略边际检验成本可能很低:LLM角色面板中的角色混合与不精确的处理-响应估计

Yohei Nakajima

机构 * Untapped Capital(未开发资本)

专题命中 知识编辑与模型理解 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本研究以16个轻量角色条件化GPT-4.1配置面板为对象,发现通过粗略边际检验成本较低,还揭示了p13需复制、无实时调用可验证结果等结论,未证明LLM可替代人类。

Comments 19 pages, 5 figures. Project site: https://yoheinakajima.github.io/synthetic-players/ ; code, data, registrations, review record, and zero-call replay capsule: https://github.com/yoheinakajima/synthetic-players

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02124 2026-08-04 cs.CV cs.CL 新提交 85%

HAFI-VLM: A Frequency Perspective for Diagnosing and Enhancing Visual Perception in Vision-Language Models

HAFI-VLM:用于诊断和增强视觉语言模型中视觉感知的频率视角

Jin Cui, Chuanchang Su, Jiayi Lu, Xinyue Long, Boran Zhao, Pengju Ren

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.CL

AI总结 该研究针对VLMs视觉预测不可靠的频谱响应刚性问题,提出HAFI-VLM,通过任务条件频率通路与相关组件优化,在多个VLMs基准上提升了视觉感知性能。

Comments 11 pages, 8 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01710 2026-08-04 cs.AI 新提交 85%

Beyond Single-Use Tokens: Durable Authorization State for Replay-Resistant LLM Agent Actions

超越单次使用令牌:面向抗重放的大语言模型智能体行动的持久授权状态

Jinghan Xu, Longze Fan, Zeyuan Wang, Xinjin Li, Hankai Liu

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究针对大语言模型智能体重规划等行为引发的语义重放问题,提出 CapLease 授权消耗层,结合服务器账本实现抗重放,证明持久授权状态是抗重放智能体执行的系统要求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02486 2026-08-04 cs.CL cs.CY cs.LG 新提交 85%

Cultural Awareness is Represented but Not Decoded: Tracing Mythological Knowledge across 18 Open-Source LLMs

文化意识被表征但未被解码:追踪18个开源大语言模型(LLM)中的神话知识

Iaroslav Chelombitko, Ekaterina Chelombitko, Mika Hämäläinen

机构 * DataSpike Metropolia University of Applied Sciences(梅托波利亞應用科學大學) Neapolis University Pafos(帕福斯尼阿波利斯大學)

专题命中 知识编辑与模型理解 :LLM(title_cn,summary_cn);分类 cs.CL、cs.LG

AI总结 该研究分析18个开源LLM的神话知识表征,发现文化表征存在于模型残差流中,但解码器因提示语言偏差无法解码非主导文化内容,还发布了相关跨文化研究工具与基准。

Comments 45 pages, 23 figures, 18 tables. Dataset: https://huggingface.co/datasets/Aragoner/folkmotif Code: https://github.com/AragonerUA/folkmotif

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01046 2026-08-04 cs.CL cs.AI 新提交 82%

DeBERTa-Sentinel: Toward Transparent and Trustworthy Detection of AI-Generated Text

DeBERTa-Sentinel:实现透明且可信的AI生成文本检测

Muhammad Yousaf Rehman, Muhammad Islam

机构 * University of Hertfordshire(赫特福德大学) James Cook University(詹姆斯库克大学)

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 DeBERTa-Sentinel是基于DeBERTa-v3的透明AI生成文本检测框架,在GLC-AIText数据集上实现优异检测性能,可公开token级解释以支持利益相关者审计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00586 2026-08-04 cs.CV 新提交 82%

Representation Transfer of Foundation Models for Ultra-Widefield Retinal Imaging

用于超广域视网膜成像的基础模型表示迁移

Mingya Alexa Gong, Da Ma, Lovre Antonio Budimir, Ivana Matovinovic, Sven Loncaric, Myeong Jin Ju, Yukun Zhou, Siegfried K. Wagner, Pearse A. Keane, Marinko V. Sarunic

机构 * Institute of Ophthalmology, University College London(伦敦大学学院眼科研究所) Wake Forest University School of Medicine(维克森林大学医学院) Virginia Tech-Wake Forest University School of Biomedical Engineering and Sciences(弗吉尼亚理工大学-维克森林大学生物医学工程与科学学院) University of Zagreb Faculty of Electrical Engineering and Computing(萨格勒布大学电气工程与计算机学院) NIHR Biomedical Research Centre, Moorfields Eye Hospital NHS Foundation Trust(NIHR生物医学研究中心,摩尔菲尔兹眼科医院NHS基金会信托)

专题命中 知识编辑与模型理解 :foundation model(title,abstract);pretraining(abstract)

AI总结 该研究探讨基础模型预训练策略对超广域视网膜成像表示迁移的影响,发现DINOv3模型在五类糖尿病视网膜病变分级中性能最优,监督和自蒸馏预训练的ViT优于MAE,部分微调可缩小MAE的性能差距。

Comments 15 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02602 2026-08-04 cs.CL 新提交 79%

AURORA-LM: Autoencoding Unified Representation for Continuous-Latent Diffusion Language Modeling

AURORA-LM:用于连续潜在扩散语言建模的统一表示自动编码

Jiajun Liang, Yucheng Liao, Yukang Cao, Jiazhe Wei, Ken Li, Wende Tan, Jiankun Zhang, ZY Cui, Jingkang Yang, Liucheng Guo, Shiqi Yang, B. Yang, Caifeng Shan, Ziwei Liu, Chenyang Si

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL

AI总结 AURORA-LM是一种分离文本表示构建与分布建模的连续潜在扩散语言模型,通过特定技术优化后,在OpenWebText自由生成和XSum摘要任务中性能优于同类模型。

Comments 40 pages, 17tables, project page: https://aurora-lm-project.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00033 2026-08-04 cs.AI 新提交 79%

SIRIN: A Unified Toolkit for Detecting Contextual Hallucinations in Retrieval-Augmented and Memory-Grounded LLM Systems

SIRIN:用于检测检索增强与记忆基大型语言模型系统中上下文幻觉的统一工具包

Julia Belikova, Rauf Parchiev, Mikhail Filimonov, Konstantin Polev, Andrey Savchenko, Maksim Makarenko

机构 * Sber AI Lab(Sber AI实验室)

专题命中 知识编辑与模型理解 :LLM(title,abstract);分类 cs.AI

AI总结 本研究提出SIRIN工具包,整合三类检测器范式与查询可回答性任务,支持多设置下的幻觉检测,可作为长期记忆系统的忠实性门控,源代码公开可用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00147 2026-08-04 cs.CV cs.LG 新提交 77%

RadPRISM: Schema-stratified radiology-report supervision for concept-disentangled image representations and visual grounding

RadPRISM:用于概念解耦图像表示与视觉定位的模式分层放射学报告监督方法

Fabian Drexel, Marlene Fritzsche, Era Stambollxhiu, Miriam Kumpf, Lena Schmitzer, Lea Schumann, Jannik Kahmann, Friedrich Puttkammer, Johannes Moll, Jannik Lübberstedt, Zeineb Ben Chaaben, Anirudh Narayanan, Cosmin I. Bercea, Sebastian Ziegelmayer, Marcus R. Makowski, Daniel Rueckert, Lisa C. Adams, Keno K. Bressem

机构 * Technical University of Munich (TUM)(慕尼黑工业大学(TUM)) TUM University Hospital(慕尼黑工业大学医院) Technical University of Munich, School of Medicine and Health(慕尼黑工业大学医学与健康学院) Klinikum rechts der Isar(右伊萨尔医院) Charité – Universitätsmedizin Berlin(柏林夏里特医学院) Freie Universität Berlin(柏林自由大学) Humboldt Universität zu Berlin(柏林洪堡大学) Imperial College London(伦敦帝国理工学院) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心(MCML)) University Hospital Essen (AöR)(埃森大学医院(AöR)) Institute for Artificial Intelligence in Medicine (IKIM)(医学人工智能研究所(IKIM)) Institute of Interventional and Diagnostic Radiology and Neuroradiology(介入与诊断放射学及神经放射学研究所) National Center for Tumor Diseases West(西部肿瘤疾病国家中心)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.LG

AI总结 RadPRISM将放射学模式作为分层轴,通过专用视觉子空间对齐临床概念,提升零样本分类与视觉定位性能,实现可透明检查的概念解耦医学图像表示。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21022 2026-08-04 cs.SE 版本更新 75%

Don't Use a Cannon to Kill a Fly: Lightweight Model Editing for LLMs to Correct Deprecated API Recommendations

轻量级模型编辑用于LLMs纠正过时的API推荐

Guancheng Lin, Xiao Yu, Jacky Keung, Xing Hu, Xin Xia, Alex X. Liu

专题命中 知识编辑与模型理解 :LLM(abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文提出AdaLoRA-L方法,通过区分通用API层和特定API层,提升LLMs生成最新API的能力。

Comments Accepted to ISSTA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01893 2026-08-04 cs.AI cs.LG 版本更新 73%

Geometric Analysis of Token Selection in Multi-Head Attention

多头注意机制中令牌选择的几何分析

Timur Mudarisov, Mikhal Burtsev, Tatiana Petrova, Radu State

机构 * University of Luxembourg(卢森堡大学) London Institute for Mathematical Sciences(伦敦数学科学研究所)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本研究通过几何分析揭示了多头注意力机制中令牌选择的结构特性,提出了精度、召回率和F分数等指标,并展示了头部在不同制度下的几何特征。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00891 2026-08-04 cs.AI 新提交 70%

CADIR: A Cross-Backend Editable Intermediate Representation for Agentic CAD Generation

CADIR:一种用于智能体CAD生成的跨后端可编辑中间表示

Yu Liu, Jingzhe Ni, Yiming Chen, Junqi Huang, Ruofeng Tong, Min Tang, Peng Du

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究提出CADIR跨后端可编辑中间表示,结合几何签名匹配与构造图检索,解决现有CAD生成方法的跨系统编辑与建模历史保留问题,实验验证其几何保真度与可靠性优于现有方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00396 2026-08-04 cs.LO cs.AI 新提交 70%

Verifiable Checks for Business Rule Consistency

业务规则一致性的可验证检查

Joseph Tafese, Milad Hooshyar, Sam Bayless, Nick Feng, Arie Gurfinkel

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对大型系统中业务规则自然语言文档与内部实现的一致性检查难题,提出结合LLMs与形式化验证的SIRNA框架,经税务成本计算案例验证,其可减少误报漏报并具备可解释性。

Comments Formal Methods in Computer-Aided Design 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01335 2026-08-04 cs.HC 新提交 67%

PartInteractor: Intent-Driven Part-Aware 3D Authoring for Continuous Co-Creation in XR

PartInteractor:面向XR中持续协同创作的意图驱动、部件感知的三维创作工具

Jianan Jiang, Bin Li

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn)

AI总结 PartInteractor是支持语音、草图、图像输入的部件感知三维创作框架,将语义部件层级作为可操控单元,提升生成后控制与意图一致性,助力XR中持续人机协同创作。

Comments Accepted to ACM UIST 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01306 2026-08-04 cs.CV 新提交 67%

SPAE: Spectrally Guided Autoencoder for Pretrained Visual Latents

SPAE:用于预训练视觉隐层的频谱引导自编码器

Yibin Huang, Jixiang Hong, Zongzhao Li, Yuhan Dai, Zhibin Wang, Chunwei Wang, Jun Song, Chen Wang, Xiaofei Sun, Xiaoxiao Xu, Conghui Zhu

机构 * Alibaba Group(阿里巴巴集团) Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学高瓴人工智能学院)

专题命中 知识编辑与模型理解 :foundation model(abstract,abstract_cn)

AI总结 针对DiT生成隐层与编码器隐层的频谱不匹配问题,提出SPAE框架,通过紧凑瓶颈结构与通道级掩码策略实现隐层适配,在视觉理解、生成质量与重建保真度间取得良好平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27902 2026-08-04 cs.CV 版本更新 67%

One Patch Is Enough: Reinforcement-Optimized Visual Token Grounding for MLLM-Based Scene Text Spotting

一个补丁就够:面向基于多模态大语言模型(MLLM)的场景文本定位的强化优化视觉标记接地

Rui Tang, Wentao Yang, Peirong Zhang, Yongxin Shi, Shun Zhang, Huiguo He, Lianwen Jin

机构 * South China University of Technology(华南理工大学) HiThink Research(海思思考研究院)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

AI总结 针对现有多补丁场景文本定位范式的冗余噪声与定位歧义问题,提出以视觉为中心的单补丁文本定位框架 SPaTS,通过强化学习优化的单补丁选择等技术实现性能提升,显著优于前沿相关模型。

Comments 15 pages, 11 figures. Accepted to ACM Multimedia 2026

Journal ref Proceedings of the 34th ACM International Conference on Multimedia (MM '26), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01585 2026-08-04 cs.CL cs.LG 新提交 62%

Semantic Alignment of AI Models: Concept Collapse, Checkpoint Dynamics, and Cross-Lingual Transfer

AI模型的语义对齐:概念坍缩、检查点动态与跨语言迁移

Tyler Ashoff, Jordan Rodu

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.LG

AI总结 该研究针对语言模型基准测试的难点,提出用拓扑方法将模型高维嵌入空间与可解释基线严格比较,以实现多模态对齐,追踪模型适应并测试跨语言短语理解。

Comments Code available at github.com/tylerashoff/persiscope (PyPI: persiscope)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01021 2026-08-04 cs.CV cs.AI cs.CL 新提交 62%

Can Humans Dream of Electric Sheep? Human-Written Samples for Fine-Grained Vision-and-Language Hallucination Benchmarking

人类能否“梦到”电子羊?用于细粒度视觉语言幻觉基准测试的人类编写样本

Timothee Mickus, Claudio Savelli, Eduardo Calò, Emilio Raimond, Stella Frank, Hengyu Luo, Flavio Giobergia, Vincent Segonne, Chuyuan Li, Aman Sinha, Lorenzo Vaiani, Jörg Tiedemann, Raúl Vázquez

机构 * University of Helsinki(赫尔辛基大学) Politecnico di Torino(都灵理工大学) Universiteit Utrecht(乌得勒支大学) Université Bretagne Sud(南布列塔尼大学) University of Copenhagen(哥本哈根大学) University Grenoble Alpes(格勒诺布尔阿尔卑斯大学) University of Lorraine(洛林大学)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.AI

AI总结 该研究针对模型迭代快导致幻觉评估普适性不足的问题,构建多语言人类编写幻觉样本数据集,证实其可替代模型生成样本用于细粒度视觉语言幻觉基准测试。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13352 2026-08-04 cs.LG 版本更新 57%

GeoFlowVLM: Geometry-Aware Joint Uncertainty for Frozen Vision-Language Embedding

GeoFlowVLM: 基于几何的联合不确定性用于冻结视觉-语言嵌入

Mayank Nautiyal, Li Ju, Andreas Hellander, Ekta Vats, Prashant Singh

机构 * Department of Information Technology, Uppsala University(乌普萨拉大学信息科技系) SciLifeLab, Uppsala University(乌普萨拉大学SciLifeLab)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.LG

AI总结 GeoFlowVLM通过流匹配学习双编码VLM嵌入的联合分布,解决视觉-语言模型中缺乏联合不确定性的问题,提出条件检索熵和边际典型性得分以量化不确定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.15534 2026-08-04 eess.IV cs.CV cs.LG 57%

DiCoM -- Diverse Concept Modeling towards Enhancing Generalizability in Chest X-Ray Studies

Abhijeet Parida, Daniel Capellan-Martin, Sara Atito, Muhammad Awais, Maria J. Ledesma-Carbayo, Marius G. Linguraru, Syed Muhammad Anwar

专题命中 知识编辑与模型理解 :foundation model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00279 2026-08-04 eess.IV cs.CV 新提交 50%

Learning to See Locally and Align Clinically with Pathology Semantics for Radiology Report Generation

学习局部感知并与病理学语义临床对齐的放射学报告生成方法

Xuan Cuong Ngo

专题命中 知识编辑与模型理解 :language model(abstract)

AI总结 针对放射学视觉-语言模型的图像-文本对齐缺陷,提出病理学感知对齐框架PALM,结合共享病理学原型与掩码证据建模,在多数据集上提升报告生成与异常鲁棒性

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08575 2026-08-04 cs.RO 版本更新 50%

FabriVLA: A Lightweight Vision-Language-Action Model with Conformal Action Chunk Uncertainty

FabriVLA:用于精确多任务操作的轻量级视觉-语言-动作模型

Shiyuan Yang, Borong Zhang, Jizheng Zhang, Zhijia Tao, Junfei Guo, Donglai Ran, Xu Bian, Qingbiao Li

专题命中 知识编辑与模型理解 :post-training(abstract)

AI总结 研究提出FabriVLA模型,结合视觉-语言主干与流匹配动作头,经单阶段联合优化训练。在Meta-World MT50基准测试中,该模型基于1B规模VLM,不依赖数十亿参数主干,实现90.0%平均成功率,展现强大性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15587 2026-08-04 physics.optics 50%

High-speed optical microscopy for neural voltage imaging: Methods, trade-offs, and opportunities

高速光学显微镜用于神经电压成像:方法、权衡与机遇

Zhaoqiang Wang, Ruth R. Sims, Sheng Xiao, Ruixuan Zhao, Ohr Benshlomo, Zihan Zang, Jiamin Wu, Valentina Emiliani, Liang Gao

专题命中 知识编辑与模型理解 :prompting(abstract)

AI总结 本文探讨了高速光学显微镜在神经电压成像中的方法、技术权衡及应用前景,总结了最新进展与潜在影响。

Journal ref Wang, Z., Sims, R.R., Xiao, S. et al. Methods, trade-offs and opportunities in high-speed optical microscopy for neural voltage imaging. Nat. Photon. (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏