arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 366 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 366 篇

2601.06599 2026-07-31 cs.CL cs.AI 版本更新 79%

How Context Shapes Truth: Geometric Transformations of Statement-level Truth Representations in LLMs

上下文如何塑造真相:LLMs中语句级真相表示的几何变换

Shivam Adarsh, Maria Maistro, Christina Lioma

机构 * University of Copenhagen(哥本哈根大学)

专题命中 其他LLM :LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究LLMs中上下文如何改变真相向量,发现早期层正交、中层收敛,上下文增加向量幅度,大模型通过方向变化区分相关与无关上下文。

Comments ACL 2026 (Main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22259 2026-06-26 cs.LG cs.AI 版本更新 79%

Rotary Position Encodings for Graphs

图的旋转位置编码

Isaac Reid, Arijit Sehanobish, Cederik Höfs, Bruno Mlodozeniec, Leonhard Vulpius, Federico Barbero, Adrian Weller, Krzysztof Choromanski, Richard E. Turner, Petar Veličković

专题命中 其他LLM :LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究旋转位置编码(RoPE)在图结构数据上的应用,提出基于图拉普拉斯谱的旋转方法(WIRE),提升图学习性能,并具有理论性质。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19790 2026-07-31 cs.CV 版本更新 78%

Geometric Risk Control for Vision-Language Model OCR

从可信性到可验证性:具有视觉-语言模型的风险控制生成OCR

Weile Gong, Zijian Lu, Mingcai Chen, Yiping Zuo, Xin He, Weibei Fan

机构 * Nanjing University of Posts and Telecommunications(南京邮电大学) China University of Petroleum(中国石油大学) Southeast University(东南大学)

专题命中 其他LLM :language model(title,abstract)

AI总结 本文提出通过几何风险控制器减少生成OCR的极端错误风险,利用结构化视图和轻量级筛查实现可靠部署。

Comments 9 pages, 5 figures, Code: https://github.com/phare111/GRC

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16755 2026-07-30 cs.SE 版本更新 78%

An Empirical Study of Foundation Models for Variability-Induced Compilation Errors in Configurable C Code

具有变异性意识的编译错误检测与修复:利用基础模型在可配置系统中

Rohit Gheyi, Lucas Albuquerque, Márcio Ribeiro, Eduardo Almeida, Danyllo Albuquerque, Mirko Perkusich

专题命中 其他LLM :foundation model(title,abstract)

AI总结 本文研究利用基础模型检测和修复可配置系统中的编译错误,展示其在精度和召回率上的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19785 2026-07-27 cs.MA 版本更新 78%

Not Birds of a Feather: Personality-Based Partner Selection in LLM Agents

并非一丘之貉:基于大语言模型代理的个性伙伴选择

Tao Wang, Hsiang-Ling Chiu, Chihang Wei, Zhonghao Hou, Yang Xiu

专题命中 其他LLM :LLM(title,abstract)

AI总结 研究大语言模型代理中基于个性的伙伴选择,在能力不变时,通过实验发现选择遵循任务刻板印象映射,非同类相吸且与人类团队绩效证据校准错误,揭示了个性选择的特点及对代理市场偏差审计的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11372 2026-07-15 cs.SE 版本更新 78%

Predicting Program Comprehension with Foundation Models of Human Cognition

用人类认知基础模型预测程序理解能力

Yannick Lehmen, Marvin Wyrich, Anna-Maria Maurer, Norman Peitek, Sven Apel

专题命中 其他LLM :foundation model(title,abstract)

AI总结 研究探讨用人类认知基础模型预测程序理解能力,通过评估基于160个心理实验训练的Centaur在9个程序理解研究中的表现,发现其比基础模型更契合人类响应模式,为软件工程中开发者行为建模提供了新思路。

Comments Submission under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04356 2026-07-07 cs.CV 版本更新 78%

Stage-wise Attention-Guided Region Sequencing for Adversarial Attacks on Large Vision-Language Models

用于对大型视觉语言模型进行对抗攻击的逐阶段注意力引导区域排序

Jaehyun Kwak, Nam Cao, Boryeong Cho, Segyu Lee, Sumyeong Ahn, Se-Young Yun

机构 * KAIST(韩国科学技术院) KENTECH(KENTECH研究院)

专题命中 其他LLM :language model(title,abstract)

AI总结 研究针对大型视觉语言模型的有针对性对抗攻击,基于注意力分析提出逐阶段注意力引导区域排序,介绍了黑盒区域排序框架SAGA,在多个模型上取得了最先进的攻击成功率和最佳不可感知性。

Comments Pre-print

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14088 2026-07-07 cs.CY 版本更新 78%

Interleaving Natural Language Prompting with Code Editing for Solving Programming Tasks with Generative AI Models

通过代码编辑与自然语言提示交织使用生成式人工智能模型解决编程任务

Victor-Alexandru Pădurean, Alkis Gotovos, Ahana Ghosh, Paul Denny, Juho Leinonen, Andrew Luxton-Reilly, James Prather, Adish Singla

专题命中 其他LLM :prompting(title,abstract)

AI总结 研究通过在编程课程中大规模研究,收集学生交互数据,分析学生解决编程任务时自然语言提示和代码编辑的结合方式、随任务复杂度及学生能力的变化,发现编辑起补充作用。

Comments ITiCSE'26 paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14271 2026-06-29 cs.CV 版本更新 78%

Let Language Constrain Geometry: Vision-Language Models as Semantic and Spatial Critics for 3D Generation

让语言约束几何:视觉-语言模型作为3D生成的语义和空间评判者

Weimin Bai, Yubo Li, Weijian Luo, Zeqiang Lai, Yequan Wang, Wenzheng Chen, He Sun

机构 * Peking University(北京大学) hi-lab, Xiaohongshu Inc.(小红书科技公司 hi-lab) MMLab, CUHK(香港中文大学 MMLab) Beijing Academy of Artificial Intelligence(北京人工智能研究院)

专题命中 其他LLM :language model(title,abstract)

AI总结 提出VLM3D框架,利用视觉-语言模型作为可微分的语义和空间评判者,通过双查询评判信号改善文本到3D生成的语义对齐和几何一致性。

Comments arXiv admin note: substantial text overlap with arXiv:2509.15772

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11962 2026-06-18 cond-mat.str-el 版本更新 78%

Attention-Based Foundation Model for Quantum States

基于注意力机制的量子态基础模型

Timothy Zaklama, Daniele Guerci, Liang Fu

专题命中 其他LLM :foundation model(title,abstract)

AI总结 提出一种基于注意力机制的基础模型架构,仅使用基组态和物理参数作为输入,即可高精度预测不同哈密顿参数、系统尺寸和物理系统下的基态波函数,为构建量子物质通用基础模型奠定基础。

Comments 8 plus 7 pages. 6 plus 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.15919 2026-06-16 cs.RO 版本更新 78%

ReMoBot: Retrieval-Based Few-Shot Imitation Learning for Mobile Manipulation with Vision Foundation Models

ReMoBot: 基于检索的少样本模仿学习用于移动操作与视觉基础模型

Yuying Zhang, Wenyan Yang, Francesco Verdoja, Ville Kyrki, Joni Pajarinen

机构 * School of Electrical Engineering, Aalto University, Espoo, Finland(艾尔沃大学电气工程学院,埃斯波,芬兰)

专题命中 其他LLM :foundation model(title,abstract)

AI总结 提出ReMoBot,一种基于检索的少样本模仿学习框架,利用视觉基础模型从演示中检索信息,解决移动操作任务中的部分可观测性和数据有限问题,在真实世界任务中取得高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02169 2026-08-17 cs.LG 版本更新 77%

Responsiveness Verification: Will Predictions Change? How Much? How Often?

响应性验证:预测会改变吗?改变多少?改变频率如何?

Harry Cheon, Meredith Stewart, Bogdan Kulynych, Tsui-Wei Weng, Berk Ustun

专题命中 其他LLM :LLM(summary_cn,abstract_cn);分类 cs.LG

AI总结 本研究提出测量响应性的算法与交互模型框架,搭配统计保证,可用于检测累犯预测的排除情况、估计内容审核博弈成本、测试LLM基准鲁棒性,提升模型安全性与可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13683 2026-08-03 cs.CL 版本更新 77%

HarnessBank: Semantic Gene-Bank Search with Gated Verification for Agent-Harness Self-Evolution

通过门控语义质量多样性实现自我进化智能体的驾驭

Xiaotian Luo, Dizhan Xue, Fengxingyu Wang, Chuanrui Hu, Yafeng Deng

专题命中 其他LLM :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.CL

AI总结 研究大语言模型智能体驾驭因素提升性能的问题,提出自我进化智能体驾驭框架,将提出与评估更改分开,通过门控存档避免过度拟合,在多领域测试中取得较好泛化效果,证明诊断与评估循环的有效性。

Comments 9 pages, 4 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21517 2026-07-31 cs.IT cs.AI cs.DM math.CO math.IT 版本更新 77%

Improved lower bounds for the Shannon capacity of odd cycles

奇数圈香农容量的改进下界

Nathaniel Itty, Christopher D. Rosin, Chase Carstensen, Daniel Reichman

机构 * Worcester Polytechnic Institute(沃斯特理工学院)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究通过与大语言模型迭代交互,在奇数圈\(C_7^{10}\)、\(C_{11}^{6}\)、\(C_{13}^{6}\)中构造独立集,改进了这些图香农容量的已知下界,还改进了几个奇数圈单个强幂独立数的已知下界。

Comments v2: added improvement on lower bound for the Shannon capacity of C15

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04390 2026-07-03 cs.AI cs.SE 版本更新 77%

A Dual-Helix Governance Approach Towards Reliable Agentic Artificial Intelligence for WebGIS Development

面向可靠WebGIS开发的代理人工智能双螺旋治理方法

Boyuan Guan, Wencong Cui, Levente Juhasz

机构 * Geographic Information Systems Center, Florida International University(佛罗里达国际大学地理信息系统中心) Geospatial Analytics, Technology and Open Research Lab, University of Florida(佛罗里达大学地理空间分析、技术与开放研究实验室)

专题命中 其他LLM :LLM(abstract,abstract_cn);prompting(abstract);分类 cs.AI

AI总结 针对代理AI在WebGIS开发中的不可靠问题,提出双螺旋治理框架,通过知识-行为-技能三轨架构和持久知识图谱外化事实与协议,实验证明能降低代码复杂度、减少输出方差并防止制图错误。

Comments Paper submitted to and under review in Transactions in GIS

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18364 2026-06-26 cs.IT cs.LG math.IT quant-ph stat.ML 版本更新 77%

Quantum Maximum Likelihood Prediction via Hilbert Space Embeddings

通过希尔伯特空间嵌入的量子最大似然预测

Sreejith Sreekumar, Nir Weinberger

机构 * L2S, CNRS, CentraleSupélec, University of Paris-Saclay, France(L2S、CNRS、CentraleSupélec、巴黎-萨克雷大学、法国)

专题命中 其他LLM :LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 研究量子最大似然预测任务,通过将经验概率分布嵌入量子态并最小化量子相对熵,提出统一框架,给出非渐近性能保证。

Comments 38+4 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09839 2026-06-24 cs.LG 版本更新 77%

Stabilizing Black-Box Prompt Optimization with Textual Regularization and Signal Aggregation

通过文本正则化与信号聚合稳定黑盒提示优化

MohammadReza Davari, Utkarsh Garg, Weixin Cai, Eugene Belilovsky

专题命中 其他LLM :LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 提出TRAS框架,利用成功预测的文本正则化与蒙特卡洛信号聚合,解决黑盒提示优化中的不稳定性和语义漂移,提升准确率与收敛速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01558 2026-07-02 cs.LG cs.AI 版本更新 76%

Utilizing Earth Foundation Models to Enhance the Simulation Performance of Hydrological Models with AlphaEarth Embeddings

利用地球基础模型通过AlphaEarth嵌入增强水文模型的模拟性能

Pengfei Qu, Wenyu Ouyang, Chi Zhang, Yikai Chai, Shuolong Xu, Lei Ye, Yongri Piao, Miao Zhang, Huchuan Lu

机构 * School of Computer Science and Technology, Dalian University of Technology(大连理工大学计算机科学与技术学院) School of Infrastructure Engineering, Dalian University of Technology(大连理工大学建设工程学院) School of Information and Communication Engineering, Dalian University of Technology(大连理工大学信息与通信工程学院) School of Software, Dalian University of Technology(大连理工大学软件学院) School of Artificial Intelligence, Dalian University of Technology(大连理工大学人工智能学院)

专题命中 其他LLM :foundation model(title);分类 cs.AI、cs.LG

AI总结 研究利用AlphaEarth基础模型从卫星图像中学习的嵌入表征流域特征,相比传统属性更有效提升无测站流域的径流预测精度,并发现基于嵌入相似性选择捐赠流域可改善预测性能。

Comments 12 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00043 2026-08-13 cs.SE 版本更新 75%

A Taxonomy of Single-Turn Textual Prompt Patterns

单轮文本提示模式分类法

Vennila Sooben, Eugene Syriani

专题命中 其他LLM :LLM(abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出一种单轮文本交互的提示模式分类法,通过可复现方法识别30种规范模式,按两个维度组织。

Comments 25 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09487 2026-07-31 cs.CL cs.AI cs.LG 版本更新 75%

Metareasoning constraints couple narratives, affect and cognition

内部叙事参数化情感状态

Jakub Onysk, Quentin J. M. Huys

机构 * Applied Computational Psychiatry Lab(应用计算精神病学实验室) Max Planck UCL Centre for Computational Psychiatry and Ageing Research(马克斯·普朗克UCL计算精神病学与衰老研究中心) Queen Square Institute of Neurology and Mental Health(圣夸克广场神经病学与心理健康研究所) Neuroscience Department(神经科学系) Division of Psychiatry(精神病学系)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文通过量化参与者内部叙事的大语言模型表示及其子空间,研究了叙事与情感状态之间的关系,发现特定症状的描述性思维能够预测标准化的抑郁评分,并强调保持症状间的协方差对构建效度至关重要。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18221 2026-07-28 cs.CY 版本更新 75%

Scalable and Personalized Oral Assessments Using Voice AI

基于语音AI的可扩展与个性化口头评估

Panos Ipeirotis, Konstantinos Rizakos

专题命中 其他LLM :LLM(abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文提出利用语音AI进行个性化口头评估,通过Viva系统实现高效评估,降低成本,并发现需分解模块、约束行为、保持随机化、多模型评分等改进方法。

Comments 34 pages, 6 figures, 9 tables. Author's version of a paper published in Communications of the ACM

Journal ref Communications of the ACM (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12149 2026-07-17 cs.CY 版本更新 75%

It is not enough to give your moderation rules to ChatGPT: Policy-as-Prompt Moderation and Its Potential Impacts on Community Governance

仅向ChatGPT提供审核规则是不够的:策略即提示的审核及其对社区治理的潜在影响

Anna Neumann, Jasmin Wyss, Ivy Turk, Rebekah Overdorf

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 研究社交媒体内容审核模式变化,探讨“策略即提示”方法在内容审核中应用,阐述其技术与治理特性、局限性及风险,提出有效提示治理考量,指出仅编写提示不适用于确保社区治理。

Comments Accepted at the Mensch und Computer (MuC) 2026 Workshop "Human-Centered Content Moderation: Expertise, Context & Evaluation"

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.13771 2026-07-07 cs.CV 版本更新 75%

AppAgent: Multimodal Agents as Smartphone Users

AppAgent:作为智能手机用户的多模态智能体

Chi Zhang, Zhao Yang, Jiaxuan Liu, Yanda Li, Yucheng Han, Xin Chen, Zebiao Huang, Bin Fu, Gang Yu

机构 * Tencent(腾讯)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 介绍基于大语言模型的多模态智能体框架,通过简化动作空间操作智能手机应用,无需系统后端访问,经自主探索或观察人类示范学习,能执行复杂任务,测试验证其处理多种高级任务的能力。

Comments Accepted to CHI 2025, project page is https://appagent-official.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27130 2026-07-03 cs.SE 版本更新 75%

A Large-Scale Comprehensive Measurement of AI-Generated Code in Real-World Repositories

对现实仓库中AI生成代码的大型实证研究

Tianhao Mao, Dongfang Zhao, Haixu Tang, Xiaofeng Wang, Hang Zhang

专题命中 其他LLM :LLM(abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文通过大规模实证研究分析现实仓库中AI生成代码的特性,探讨AI辅助开发与传统人类开发的差异,为理解AI在软件开发中的实际影响提供依据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19610 2026-06-16 cs.SE 版本更新 75%

The Influence of Code Comments on the Perceived Helpfulness of Stack Overflow Posts

代码注释对 Stack Overflow 帖子感知有用性的影响

Kathrin Figl, Maria Kirchner, Sebastian Baltes, Michael Felderer

专题命中 其他LLM :large language model(abstract);language model(abstract);prompting(abstract)

AI总结 通过在线实验(n=91)研究代码注释如何影响 Stack Overflow 答案的感知有用性,发现块注释和行内注释均显著提高有用性,且新手认为块注释更有用,而答案位置和分数影响较小。

Comments 32 pages, 7 figures, 2 tables, accepted in Empirical Software Engineering

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04885 2026-06-15 cs.CL cs.AI cs.LG 版本更新 75%

CuMA: Aligning LLMs with Sparse Cultural Values via Demographic-Aware Mixture of Adapters

CuMA: 通过人口统计感知的适配器混合使大语言模型与稀疏文化价值观对齐

Ao Sun, Xiaoyu Wang, Zhe Tan, Yu Li, Jiachen Zhu, Yuheng Jia, Shu Su

机构 * Southeast University(东南大学) ByteDance Inc.(字节跳动公司) Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications (Southeast University), Ministry of Education, China(新一代人工智能技术及其交叉应用重点实验室(东南大学),中华人民共和国教育部,中国)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出CuMA框架,通过人口统计感知路由将冲突梯度分离到专家子空间,解决密集模型在多文化对齐中的均值崩溃问题,在WorldValuesBench等基准上取得最优性能。

Comments ACL 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18934 2026-06-11 cs.HC cs.MM 版本更新 75%

Whispering Water: Materializing Human-AI Dialogue as Interactive Ripples

低语之水:将人机对话物化为交互式涟漪

Ruipeng Wang, Tawab Safi, Yunge Wen, Christina Cunningham, Hoi Ling Tang, Behnaz Farahi

专题命中 其他LLM :LLM(summary_cn,abstract_cn)

AI总结 通过将语音情感转换为激发频率、语义内容输入多智能体LLM系统,以及用对数间距和Bark尺度映射分解合成语音为谐波分量,在物理水面上实现人机对话的物化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.14844 2026-08-14 cs.CL cs.AI cs.MA 版本更新 73%

Unmasking Conversational Bias in AI Multiagent Systems

揭示AI多智能体系统中的对话偏见

Erica Coppolillo, Giuseppe Manco, Luca Maria Aiello

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 该研究针对AI多智能体系统的对话偏见检测空白,提出对话型LLMs多智能体系统偏见量化框架,发现现有问卷式方法无法检测到该场景下的偏见,呼吁开发更复杂的偏见检测与缓解工具包。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13246 2026-08-04 cs.LG cs.AI 版本更新 73%

Reassessing Muon for Matrix Factorization

重新评估用于矩阵分解的Muon优化器

Ali Parviz, Gal Mishne, Alex Cloninger

机构 * Halicioğlu Data Science Institute, UC San Diego(加州大学圣地亚哥分校哈利西奥卢数据科学研究所) Department of Mathematics, UC San Diego(加州大学圣地亚哥分校数学系)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究在低秩矩阵分解问题上重新评估Muon优化器,通过与精心调整的自适应基线对比,发现Muon在此设置下不始终优于AdamW,一些优势对超参数选择敏感,更细致地展现谱感知正交化何时有益,主张在受控问题上评估优化器。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02288 2026-08-04 cs.LG cs.AI 版本更新 73%

AROpt: An Optimization Method for Autoregressive Time Series Forecasting

AROpt: 一种用于自回归时间序列预测的优化方法

Zheng Li, Jerry Cheng, Huanying Gu

机构 * Department of Computer Science(计算机科学系) New York Institute of Technology(纽约理工学院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种新方法,通过强制预测误差随预测时间增加而增长,提升自回归时间序列预测的准确性与灵活性,实验表明在多个基准上取得新突破。

Comments 16 pages, 5 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏