arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-07-28 至 2026-07-28 共收录 37 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 37 篇

2408.03910 2026-07-28 cs.SE cs.AI cs.CL 版本更新 92%

CodexGraph: Bridging Large Language Models and Code Repositories via Code Graph Databases

CodexGraph:通过代码图数据库连接大型语言模型和代码库

Xiangyan Liu, Bo Lan, Zhiyuan Hu, Yang Liu, Zhicheng Zhang, Fei Wang, Michael Shieh, Wenmeng Zhou

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

AI总结 研究旨在解决大型语言模型处理整个代码库的难题,提出通过将LLM代理与代码库图数据库接口集成的CodexGraph系统,利用图数据库特性实现精确上下文检索和代码导航,经多基准评估及实际应用开发,展现其在软件工程中的竞争力与潜力。

Comments work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24372 2026-07-28 econ.GN q-fin.EC 新提交 92%

Randomness in large language models: What researchers need to know (and report)

大语言模型中的随机性:研究人员需要了解(并报告)的内容

Guillaume Coqueret, Joan Llull, Florian Oswald, Christophe Pérignon, Christoph Scheuch, Lars Vilhuber

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract)

AI总结 研究大语言模型输出随机性问题及影响,指出其输出因多种因素在重复请求时可变,难以精确再现。通过公司备案文件情感分类说明问题,提出文章、复制包报告标准及对数据编辑和作者的指导,建议将LLM输出视为分布抽样。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23213 2026-07-28 cs.HC 新提交 89%

A Taxonomy of Confabulations and the Perception-Reality Gap in LLM-Assisted Immersive Scene Editing

大语言模型辅助沉浸式场景编辑中的虚构分类与感知-现实差距

Junlong Chen, Per Ola Kristensson

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 研究LLM辅助沉浸式3D场景编辑中的虚构,通过对24名非专业用户的探索性研究构建分类法,报告其普遍性与破坏性,定义感知-现实差距结构,强调负载下虚构意识饱和度,得出对未来系统减轻虚构的设计启示。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28116 2026-07-28 cs.CL 版本更新 87%

Mechanism-Driven Monitors for Preemptive Detection of LLM Training Instability

机制驱动的LLM训练不稳定性抢先检测监控器

Ruixuan Huang, Hantao Huang, Yifan Huang, Ansheng You, Zhenxing Zhang, Shuai Wang

机构 * HKUST(香港科技大学) Huawei(华为) Independent Researcher(独立研究者)

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 针对大语言模型训练中的数值或超参数故障,提出基于模块功能角色的内部监控器,通过QK双线性分解谱熵和MoE路由器指标,在损失发散前数千步检测到不稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23037 2026-07-28 cs.CL 新提交 86%

Speech Signals Complement LLMs for Predicting Interpersonal Attraction in Speed Dating

语音信号补充大语言模型用于预测速配中的人际吸引力

Yuriko Kikuchi, Takato Hayashi, Ryusei Kimura, Naoya Inoue, Ryo Ishii, Shogo Okada

机构 * Japan Advanced Institute of Science and Technology(日本先进科学技术学院) NTT, Inc.(日本电报电话公司)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究利用日语速配对话,结合仅基于转录本的LLM预测与语音预测器预测来估计参与者对约会对象的喜好,发现语音能补充LLM预测,二者结合可提高两两排序准确率,且互补性有条件,还明确了语音预测价值及互补性出现的情况。

Comments Accepted at the 28th ACM International Conference on Multimodal Interaction (ICMI 2026). 16 pages total, including a 7-page supplementary appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22880 2026-07-28 cs.SE cs.AI cs.LG 新提交 86%

Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)

大语言模型生成的测试套件的覆盖度和变异分数与其有效性相关吗?(可重复性研究)

Junda Zhao, Shurui Zhou, Eldan Cohen

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究大语言模型生成测试套件时,覆盖度和变异分数与有效性的关系。通过重复研究发现其有用性依赖上下文,在不同场景表现不同,且测试套件大小非主要混杂因素,为评估此类测试生成提供指导。

Comments 24 pages, 4 figures, 14 tables. Accepted at ISSTA 2026; to appear in Proceedings of the ACM on Software Engineering (PACMSE), Vol. 3, No. ISSTA, Article ISSTA002

URL PDF HTML 收藏
2607.24051 2026-07-28 astro-ph.IM cs.AI cs.RO 新提交 85%

HELIOS: An LLM-Driven Autonomous Indirect Trajectory Optimization Agent

HELIOS:一个由大语言模型驱动的自主间接轨迹优化智能体

An-yi Huang

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究低推力轨迹优化面临的问题,提出基于大语言模型的HELIOS智能体,能自主进行PMP符号推导等。其创新包括约束自适应推导框架等,实验表明可解决多种轨迹优化问题,验证了模型无关架构及模型规模与推导能力的正相关。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23201 2026-07-28 cs.HC 新提交 85%

Beyond Conversations: Spatially-Anchored Previews for Intent Disambiguation in LLM-Assisted Geometry Editing in Virtual Reality

超越对话:虚拟现实中大型语言模型辅助几何编辑中用于意图消歧的空间锚定预览

Junlong Chen, Amr Gomaa, Jens Grubert, Per Ola Kristensson

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 研究虚拟现实中大型语言模型辅助几何编辑的意图消歧问题,通过结合澄清问题与空间锚定图形预览的混合方法,经实验验证其能提升交互稳定性、改善用户体验,为相关系统集成提供设计依据。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04260 2026-07-28 cs.HC cs.AI 版本更新 83%

Steerable Chatbots: Exploring Personalization Control Interfaces via LLM Activation Steering

可控聊天机器人:通过大语言模型激活引导探索个性化控制界面

Jessica Y. Bo, Tianyu Xu, Ishan Chatterjee, Katrina Passarella-Ward, Achin Kulshrestha, D Shin

机构 * University of Toronto(多伦多大学) Google AR(谷歌AR)

专题命中 其他LLM :LLM(title,abstract);prompting(abstract);分类 cs.AI

AI总结 研究探索可控聊天机器人范式,通过激活引导实现个性化,利用线性标量控制偏好表达强度,设计三种界面原型并进行用户研究,发现其在冷启动任务中比单独提示更能契合用户偏好,揭示了相关个性化方面的不同价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17394 2026-07-28 cs.HC 版本更新 82%

TaskArtisan: Designing Composable Generative Widgets for LLM-Assisted Analysis

TaskArtisan:为大语言模型辅助分析设计可组合的生成式小部件

Meng Chen, Amy Pavel

专题命中 其他LLM :LLM(title,abstract);prompting(abstract)

AI总结 研究探索大语言模型辅助分析中生成式用户界面带来的新机会。通过采访、分析工具及比较研究,发现GUI利弊,总结权衡形成临时设计框架,为未来大语言模型辅助分析工作流程中的生成式用户界面设计提供参考。

Comments Accepted to the 2026 IEEE Symposium on Visual Languages and Human-Centric Computing (VL/HCC 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17394 2026-07-28 cs.NI cs.AI cs.SD 版本更新 81%

Voice-Driven Semantic Perception for UAV-Assisted Emergency Networks

基于语音的语义感知用于无人机辅助应急网络

Nuno Saavedra, Pedro Ribeiro, André Coelho, Rui Campos

机构 * FCT – Fundação para a Ciência e a Tecnologia, I.P.(葡萄牙科学与技术基金会)

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出SIREN框架,通过整合语音识别与语义提取技术,实现无人机辅助网络的语音驱动感知,提升应急通信的自动化水平和决策支持能力。

Comments 6 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18673 2026-07-28 cs.MA cs.DC 版本更新 80%

When Coordination Is Avoidable: A Monotonicity Analysis of Organizational Tasks

当协调可避免时:组织任务的单调性分析

Harang Ju

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文通过单调性分析,证明协调并非所有组织任务必需,并基于分布式系统理论提出判定规则,应用于工作流和任务数据集,发现大量协调支出可避免。

Comments 27 pages, 1 figure, 10 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24306 2026-07-28 cs.CL 新提交 79%

Rethinking the Generation Order of Block Diffusion Language Models

重新思考块扩散语言模型的生成顺序

Kai Syun Hou, James Kwok

专题命中 其他LLM :language model(title,abstract);分类 cs.CL

AI总结 研究块扩散语言模型的采样,基于其更适合从左到右解码的特点,提出并行自回归解码方法PARD,该方法无需训练,能保留结构并允许并行令牌承诺,实验证明其在生成质量和速度上优于现有方法。

Comments 20 pages, 15 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22691 2026-07-28 cs.AI 新提交 79%

HiLLTS: Zero-Shot Hierarchical LLM-Guided Traffic Signal Control for Sustainable Transportation

HiLLTS:用于可持续交通的零样本分层大语言模型引导的交通信号控制

Yue Ding, Tendai Mukande, Mingming Liu

机构 * School of Electronic Engineering, Dublin City University(都柏林城市大学电子工程学院)

专题命中 其他LLM :LLM(title,abstract);分类 cs.AI

AI总结 针对传统交通信号控制策略的问题,提出HiLLTS框架,它采用分层三层架构,由中央协调代理等组成。实验表明其能改善拥堵和环境性能,相比不同基线,在减少等待时间和二氧化碳排放上效果显著,消融研究验证了大语言模型引导协调的作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.05487 2026-07-28 cs.CL 版本更新 79%

Like a bilingual baby: The advantage of visually grounding a bilingual language model

像双语婴儿一样:视觉基础双语语言模型的优势

Khai-Nguyen Nguyen, Zixin Tang, Ankur Mali, Mary ALexandria Kelly

专题命中 其他LLM :language model(title,abstract);分类 cs.CL

AI总结 研究旨在探讨视觉基础对双语语言模型的影响,通过在英西双语图像及字幕上训练LSTM模型,发现视觉基础能提升模型对语义相似性的理解及降低困惑度,为视觉基础语言模型优势提供证据,指出需更多自然语言数据。

Comments Preprint, 7 pages, 2 tables, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23884 2026-07-28 cs.MA 新提交 78%

A Comparative Study of MCP and A2A for Inter-Agent Coordination in LLM-Based Systems

基于大语言模型的系统中用于智能体间协调的MCP和A2A的比较研究

Ionut Predoaia, Tuong Manh Vu, Konstantinos Barmpis, Dimitris Kolovos, Antonio García-Domínguez

专题命中 其他LLM :LLM(title,abstract)

AI总结 本文从多智能体系统工程角度,以涉及基于大语言模型智能体的协调场景,比较MCP和A2A协议。针对多项要求评估同一软件工程任务的两种多智能体实现,发现MCP协调复杂度低,A2A支持更丰富,但都有特点,为智能体间协调协议设计提供了经验和权衡要点。

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18221 2026-07-28 cs.CY 版本更新 75%

Scalable and Personalized Oral Assessments Using Voice AI

基于语音AI的可扩展与个性化口头评估

Panos Ipeirotis, Konstantinos Rizakos

专题命中 其他LLM :LLM(abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文提出利用语音AI进行个性化口头评估,通过Viva系统实现高效评估,降低成本,并发现需分解模块、约束行为、保持随机化、多模型评分等改进方法。

Comments 34 pages, 6 figures, 9 tables. Author's version of a paper published in Communications of the ACM

Journal ref Communications of the ACM (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.14544 2026-07-28 cs.CL cs.AI 版本更新 73%

Speed Reading Tool Powered by Artificial Intelligence for Students with ADHD, Dyslexia, and Short Attention Span

由人工智能驱动的针对患有注意力缺陷多动障碍、阅读障碍和注意力持续时间短的学生的快速阅读工具

Megat Irfan Zackry Bin Ismail, Ahmad Nazran bin Yusri, Muhammad Hafizzul Bin Abdul Manap, Muhammad Muizzuddin Bin Kamarozaman

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 针对阅读障碍、多动症及注意力不集中学生,提出用云托管大语言模型与自适应排版结合的人工智能工具,通过向Gemini API请求实时生成摘要,接受多种文件输入,优化可读性,经Flask框架部署,显著提升阅读速度与理解能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24539 2026-07-28 cs.AI cs.SY eess.SY 新提交 70%

Task-Conditional Faithfulness Auditing of Multimodal LLMs for Grid Diagnosis

用于电网诊断的多模态大语言模型的任务条件忠实性审计

Tianqiao Zhao, Meng Yue, Jianhui Wang

机构 * The University of Texas at Arlington(德克萨斯大学阿灵顿分校) Brookhaven National Laboratory(布鲁克海文国家实验室) Southern Methodist University(南卫理公会大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究针对多模态大语言模型用于电网诊断时答案准确性与证据使用的问题,提出通用框架进行任务条件忠实性审计,通过比较多种依赖并设计校正和重新审计机制,经案例研究验证了框架检测、诊断及纠正相关失败的能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24425 2026-07-28 cs.LG 新提交 70%

Context Is King: How In-Context Specification Shapes the Geometry of Concepts

上下文为王:上下文规范如何塑造概念的几何结构

Elad David, Max Fomin

机构 * Zenity

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 研究大型语言模型中上下文规范对概念几何结构的塑造,发现上下文决定模型实际使用的结构,声明性规则可确定几何编码关系及拓扑类型,不同规模模型表现不同,同一模型家族中较大模型存在的机制在较小模型中可能不存在。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23142 2026-07-28 cs.CL 新提交 70%

Interview with Kalle Lyytinen on "Implications of Theories of Language for Information Systems"

关于《语言理论对信息系统的影响》的卡莱·利伊蒂宁访谈

Kalle J. Lyytinen, Pierre Maier, Paul Ackah Toffey

机构 * Case Western Reserve University(凯斯西储大学) University of Duisburg-Essen(杜伊斯堡-埃森大学) Louisiana State University(路易斯安那州立大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本次访谈中,利伊蒂宁反思《语言理论对信息系统的影响》论文起源与领域发展,结合大语言模型等最新趋势,讨论信息系统语言核心,并概述了从语言学角度研究信息系统的未来方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23002 2026-07-28 cs.SE cs.AI 新提交 70%

Adversarial Test-Hardening for AI-Written Code: An Instrument Autopsy and a Pre-Registered Causal Estimate of the Critic Loop

人工智能编写代码的对抗性测试强化:工具剖析与评论家循环的预注册因果估计

Jeff Otterson

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究大语言模型编写代码及测试用例的对抗性测试强化循环,通过机械预言机实现。实验发现早期跨谱系效应是工具工件,消除混淆因素后,同谱系评论家轮次有因果估计,跨供应商配置有差异,还发布了相关协议、记录和代码。

Comments 26 pages. Two pre-registered experiments; protocols, all run receipts, and analysis code at https://github.com/Jott2121/crucible

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24304 2026-07-28 physics.soc-ph cs.AI math.DS 新提交 70%

Teacher Knows It Best: Spontaneous Symmetry Breaking and Tipping Points in Networked Langevin Dynamics AI Sycophancy

教师最了解:网络朗之万动力学人工智能谄媚中的自发对称性破缺和临界点

Sayantari Ghosh, Saumik Bhattacharya, Partha Pratim Chakrabarti

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 构建统计物理框架研究网络随机动力系统的双稳态,用于理解和缓解AI妄想螺旋。通过划分网络节点,用度加权平均场近似简化方程,推导临界翻转时间,验证解析边界,优化干预策略,证明特定条件下集中快速干预优于分布式缓慢方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13077 2026-07-28 cs.CY cs.AI cs.SE 版本更新 70%

The Hitchhiker's Guide to Monoculture

单一文化的搭便车指南

Gordon Burtch

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究通过Kaggle竞赛提交代码,探讨人工智能编码助手对代码的影响,采用多种方法在不同层面研究代码同质化,发现句法有显著同质化,语义同质化不明显,表明编码助手规范了实现细节但未使方法和策略趋同。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.04551 2026-07-28 math.OC cs.LG stat.ML 70%

Measure-to-measure interpolation using Transformers

使用Transformer进行测度到测度的插值

Borjan Geshkovski, Philippe Rigollet, Domènec Ruiz-Balet

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出了一种基于Transformer的测度到测度插值方法,通过显式参数选择实现对任意输入和目标测度的映射。

Comments To appear in Foundations of Computational Mathematics

Journal ref Foundations of Computational Mathematics (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17168 2026-07-28 cs.CL 版本更新 70%

Neural Dynamics of AI-attributed Irony Reveal a Partial Intentional Stance

人工智能归因反讽的神经动力学揭示部分意向立场

Xiaohui Rao, Hanlin Wu, Zhenguang G. Cai

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究探讨人们理解人工智能归因反讽时是否采取意向立场,通过EEG比较对AI与人类反讽话语的反应,发现人们对AI反讽未完全采取意向立场,神经反应受个体对AI认知调节,揭示AI社交障碍及相关重要意义。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24194 2026-07-28 cs.CV 新提交 67%

Face Age Verification Vulnerabilities Under Simple Appearance Manipulations

简单外观操纵下的面部年龄验证漏洞

Ioannis Sarridis, Ioannis Kompatsiaris, Symeon Papadopoulos

机构 * Information Technologies Institute, Centre for Research and Technology Hellas(信息技术研究所,希腊研究与技术中心)

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 研究简单外观操纵下面部年龄验证的漏洞,评估七个模型在三个数据集及四种操纵类型下的情况,发现胡茬操纵影响大,不同人口统计特征受影响有差异,还探索了用偏差缓解方法减轻偏差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24187 2026-07-28 cs.AI 新提交 57%

Myopia Prevention and Control 3.0: Artificial Intelligence--Driven Risk Stratification, Proactive Monitoring, and Personalized Intervention

近视防控3.0:人工智能驱动的风险分层、主动监测和个性化干预

Tieniu Wang, Cangzhu Huang, Qianhui Li

机构 * Shanghai Nile Intelligent Technology Co., Ltd.(上海尼罗智能科技有限公司) Beijing Tanyuan Academy of Intelligent Sensing(北京潭渊智能传感研究院)

专题命中 其他LLM :foundation model(abstract);分类 cs.AI

AI总结 研究借助人工智能、数字传感等技术推动近视防控从被动变主动精准模式。通过多模态数据机器学习预测风险、可穿戴等监测及个性化干预形成闭环。评估各阶段证据,讨论相关挑战并给出未来方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23845 2026-07-28 cs.AI 新提交 57%

Do Visual Features Improve Other-Initiated Repair Detection? A Dyadic Multimodal Approach

视觉特征能否改善他人发起的修复检测?一种二元多模态方法

Anh Ngo, Nicolas Rollet, Catherine Pelachaud, Chloé Clavel

机构 * INRIA Paris(法国国家信息与自动化研究所巴黎分院) ISIR, Sorbonne University Paris(巴黎索邦大学信息学、系统与机器人研究所) Télécom Paris, SES, Institut Polytechnique de Paris, I3-CNRS Paris(巴黎电信学院、巴黎高等理工学院SES系、巴黎综合理工学院I3 - 法国国家科学研究中心) CNRS(法国国家科学研究中心) LTCI, Institut Polytechnique de Paris(巴黎综合理工学院LTCI实验室)

专题命中 其他LLM :prompting(abstract);分类 cs.AI

AI总结 研究他人发起的修复检测问题,提出结合视觉特征的二元多模态模型,通过在两个语料库上评估,证明视觉信息能提升检测性能,提供跨模态特征贡献见解。

Comments Accepted to ICMI 2026 (International Conference on Multimodal Interaction), October 5-9, 2026, Napoli, Italy

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23676 2026-07-28 cs.AI 新提交 57%

SpecAHD: Localize to Specialize for Automated Heuristic Design in Large-Scale Routing Problems

SpecAHD:在大规模路由问题中定位以专门化自动启发式设计

Kezhao Lai, Yutao Lai, Hai-Lin Liu

专题命中 其他LLM :LLM(abstract);分类 cs.AI

AI总结 针对大规模路由问题,提出耦合双层框架SpecAHD,上层搜索确定修复区域,下层为修复任务开发启发式方法,目标具单调次模性可贪婪选择,实验表明其相比基线大幅降低成本,性能更优。

Comments 9 pages, 1 figure, and 3 tables. Supplementary material included

详情

展开后加载摘要…

URL PDF HTML 收藏