arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-06-26 至 2026-06-26 共收录 23 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 23 篇

2404.08948 2026-06-26 cs.SE 版本更新 92%

Large Language Models for Mobile GUI Text Input Generation: An Empirical Study

大型语言模型用于移动GUI文本输入生成:一项实证研究

Chenhui Cui, Tao Li, Junjie Wang, Chunyang Chen, Dave Towey, Rubing Huang

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);prompting(abstract)

AI总结 本研究评估九种LLM在115个真实应用中的GUI文本输入生成,比较三种UI上下文提示设置,发现提取文本和XML达到71%的页面通过率,视觉输入成本更高;反馈增强协议提升缺陷检测率至64.5%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27287 2026-06-26 cs.AI 新提交 92%

Prompt Injection in Automated Résumé Screening with Large Language Models: Single and Multi-Injection Settings

大型语言模型在自动化简历筛选中的提示注入:单注入与多注入设置

Preet Baxi, Jiannan Xu, Jane Yi Jiang, Stefanus Jasin

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 研究LLM在简历筛选中的提示注入攻击,发现当简历质量同质且注入者少时有效,但随注入者增多效果消失;质量异质时虽平均效果减弱,但偶尔让低质量候选人超越高质量,引发公平问题。

Journal ref Findings of the Association for Computational Linguistics: ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13670 2026-06-26 cs.AI 新提交 92%

Automated reproducibility assessments in the social and behavioral sciences using large language models

使用大型语言模型自动评估社会与行为科学的可重复性

Tobias Holtdirk, Pietro Marcolongo, Anna Steinberg Schulten, Felix Henninger, Stefan Rose, Sarah Ball, Bolei Ma, Frauke Kreuter, Markus Weinmann, Stefan Feuerriegel

机构 * LMU Munich(慕尼黑大学) Munich Center for Machine Learning(慕尼黑机器学习中心) University of Cologne(科隆大学)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本研究利用大型语言模型(LLMs)自动评估社会与行为科学研究的可重复性,在76项研究中,LLM在41%的研究中恢复了原始效应量,在96%的案例中得出了与原始研究相同的定性结论,优于人类再分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26106 2026-06-26 cs.CL cs.AI 新提交 91%

Reducing Conversational Escalation in Large Language Model Dialogue with Nonviolent Communication Constraints

使用非暴力沟通约束减少大语言模型对话中的对话升级

Zhixing Sun, Shenghe Xu, Tao Li

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) City University of Hong Kong(香港城市大学)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);prompting(abstract)

AI总结 本研究通过非暴力沟通原则的轻量级提示约束,引导大语言模型在冲突对话中减少升级行为,实验表明该方法能稳定与高度抵抗用户的交互。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26505 2026-06-26 cs.SE cs.HC 新提交 91%

Same Scrutiny, More Time: Eye Tracking Insights into Reviewing LLM-Labelled Code

同样审查,更多时间:眼动追踪洞察审查LLM标记代码

Ranim Khojah, Francisco Gomes de Oliveira Neto, Mazen Mohamad, Julian Frattini, Philipp Leitner

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 通过Wizard-of-Oz实验和眼动追踪,发现开发者审查LLM标记代码时更专注但策略调整,提示需重新审视AI政策。

Comments Accepted at the 41st IEEE/ACM International Conference on Automated Software Engineering (ASE 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06401 2026-06-26 cs.SE 版本更新 91%

LLMCFG-TGen: Using LLM-Generated Control Flow Graphs to Automatically Create Test Cases from Use Cases

LLMCFG-TGen:利用LLM生成的控制流图从用例自动创建测试用例

Zhenzhen Yang, Chenhui Cui, Tao Li, Rubing Huang, Nan Niu, Dave Towey, Shikai Guo

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 提出LLMCFG-TGen方法,通过LLM将自然语言用例转化为控制流图,提取执行路径并生成测试用例,解决现有方法覆盖不全和逻辑遗漏问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26924 2026-06-26 cs.SE cs.AI cs.CR 新提交 90%

A Deterministic Control Plane for LLM Coding Agents

LLM编码代理的确定性控制平面

Padmaraj Madatha

机构 * Happiest Minds Technologies (AIP Centre of Excellence)(happiest minds technologies(aip中心卓越机构))

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI

AI总结 针对LLM编码代理配置缺乏管理的问题,提出确定性控制平面Rel(AI)Build,通过内容寻址、分层权限、阶段状态机等机制确保配置安全与一致性。

Comments 45 pages, 9 figures, 13 tables. Dataset and reproduction scripts: Zenodo DOI 10.5281/zenodo.20780913. Ancillary files include report.json, organizations.txt, and figure-reproduction scripts

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26203 2026-06-26 cs.AI cs.CY cs.MA cs.SI 新提交 90%

Agentic Analysis for Agentic Infrastructure: An LLM-Powered Pipeline for Comparative Governance of DAO and Corporate AI Protocols

面向代理基础设施的代理分析:基于LLM的DAO与企业AI协议比较治理管道

Yutian Wang, Luyao Zhang

机构 * Duke Kunshan University(昆山杜克大学)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI

AI总结 提出LLM驱动的比较分析管道,结合自动标注、神经主题建模和多层网络分析,研究DAO与企业AI协议的治理结构,发现开放治理促进主题收敛但参与不平等普遍存在。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27136 2026-06-26 cs.AI 新提交 89%

Joint Learning of Experiential Rules and Policies for Large Language Model Agents

大型语言模型智能体的经验规则与策略联合学习

Shicheng Ye, Chao Yu

机构 * Sun Yat-sen University(中山大学)

专题命中 其他LLM :large language model(title);language model(title);LLM(abstract,abstract_cn);prompting(abstract)

AI总结 提出JERP框架,通过联合更新经验规则库和策略,使规则与演化策略对齐,在AlfWorld和WebShop上提升复杂交互任务的决策性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26593 2026-06-26 cs.AI 新提交 89%

Content-Based Smart E-Mail Dispatcher Using Large Language Models

基于内容的大型语言模型智能电子邮件分发器

K. Paramesha, K R Sriram, Sujan Shetty, Shamanth Kishore, R. Tejaswini

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract_cn);分类 cs.AI

AI总结 提出利用大型语言模型自动分析邮件内容并分派至相关WhatsApp群组,无需标注数据,提升效率并降低认知负荷。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00570 2026-06-26 cs.HC 版本更新 87%

User Perceptions of an LLM-Based Chatbot for Cognitive Reappraisal of Stress: Feasibility Study

用户对基于LLM的认知重评压力聊天机器人的感知:可行性研究

Ananya Bhattacharjee, Jina Suh, Mohit Chandra, Javier Hernandez

专题命中 其他LLM :LLM(title,title_cn)

AI总结 研究基于GPT-4o的聊天机器人在工作场所压力认知重评中的可行性,通过100名员工实验发现其能显著降低压力强度并改善压力心态,但存在脚本化、交互长度和AI共情等设计张力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26918 2026-06-26 cs.AI 新提交 83%

Diagnosing Task Insensitivity in Language Agents

诊断语言智能体中的任务不敏感性

Jingyu Liu, Xiaopeng Wu, Kehan Chen, Chuan Yu, Yong Liu

机构 * Gaoling School of Artificial Intelligence Renmin University of China(中国人民大学高瓴人工智能学院) Taobao & Tmall Group of Alibaba(阿里巴巴淘天集团) Beijing Key Laboratory of Research on Large Models and Intelligent Governance(北京市大模型与智能治理重点实验室) Engineering Research Center of Next-Generation Intelligent Search and Recommendation, MOE(教育部新一代智能搜索与推荐工程研究中心)

专题命中 其他LLM :language agent(title);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文发现大语言模型在长程任务中因过度依赖训练模式而忽略任务指令,导致分布外泛化失败,并提出任务扰动负对数似然优化(Task-Perturbed NLL Optimization)来增强任务敏感性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26383 2026-06-26 cs.LG cs.AI cs.AR cs.MA cs.PF 新提交 82%

SOLAR: AI-Powered Speed-of-Light Performance Analysis

SOLAR: AI驱动的光速性能分析

Qijing Huang, Sana Damani, Zhifan Ye, Athinagoras Skiadopoulos, Siva Kumar Sastry Hari, Jason Clemons, Sahil Modi, Jingquan Wang, Aditya Kane, Edward C Lin, Humphrey Shi, Christos Kozyrakis

机构 * NVIDIA(英伟达)

专题命中 其他LLM :LLM(summary_cn,abstract);分类 cs.AI、cs.LG

AI总结 提出SOLAR框架,自动从PyTorch和JAX代码推导理论最小执行时间(光速界限),通过LLM前端和确定性分析实现无违反界限的多保真度性能分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22259 2026-06-26 cs.LG cs.AI 版本更新 79%

Rotary Position Encodings for Graphs

图的旋转位置编码

Isaac Reid, Arijit Sehanobish, Cederik Höfs, Bruno Mlodozeniec, Leonhard Vulpius, Federico Barbero, Adrian Weller, Krzysztof Choromanski, Richard E. Turner, Petar Veličković

专题命中 其他LLM :LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究旋转位置编码(RoPE)在图结构数据上的应用,提出基于图拉普拉斯谱的旋转方法(WIRE),提升图学习性能,并具有理论性质。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26626 2026-06-26 cs.HC 新提交 78%

Reviving Reflection-in-Action: Instilling Designerly Thinking in AI-Supported Ideation through Multimodal Prompting

复兴反思行动:通过多模态提示在AI支持的构思中注入设计思维

Samangi Wadinambiarachchi, Jenny Waycott, Greg Wadley

专题命中 其他LLM :prompting(title,abstract)

AI总结 针对当前AI创造力支持工具主要依赖文本提示的局限,提出SketchifAI原型,通过多模态输入(文本、草图、草图加标签)增强设计学生的表达意图、创造力支持和发散思维,发现草图模态提升流畅性但用户偏好文本,探讨如何通过草图反思保留设计技能。

Comments ACM Creativity and Cognition 2026 conference (C&C'26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18364 2026-06-26 cs.IT cs.LG math.IT quant-ph stat.ML 版本更新 77%

Quantum Maximum Likelihood Prediction via Hilbert Space Embeddings

通过希尔伯特空间嵌入的量子最大似然预测

Sreejith Sreekumar, Nir Weinberger

机构 * L2S, CNRS, CentraleSupélec, University of Paris-Saclay, France(L2S、CNRS、CentraleSupélec、巴黎-萨克雷大学、法国)

专题命中 其他LLM :LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 研究量子最大似然预测任务,通过将经验概率分布嵌入量子态并最小化量子相对熵,提出统一框架,给出非渐近性能保证。

Comments 38+4 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26641 2026-06-26 cs.HC 新提交 67%

Invisible Impact of Empathy on Behavioral Change: Isolating the Effect of Empathy in Long-term Physical Activity Coaching Chatbot Interactions

共情对行为改变的隐形影响:在长期身体活动教练聊天机器人交互中隔离共情效应

Li Siyan, Kai-Hui Liang, Shopnil Shahriar, Yilin Ye, Shiyoh Goetsu, Wei-Wei Du, Masahiro Yoshida, Tsunayuki Ohwa, Xuhai Xu, Zhou Yu

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 通过构建仅共情水平不同的三个聊天机器人进行六周实验,发现用户难以区分共情程度,但高共情版本仍能增加步数并改善遵循意图,表明共情通过外围路径影响动机和信任。

Comments Shortened version of paper accepted into CUI Short paper and WIP

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08518 2026-06-26 physics.optics cond-mat.quant-gas physics.atom-ph 版本更新 67%

Fresnel zone plates for reconfigurable atomic waveguides

用于可重构原子波导的菲涅耳波带片

A. M. Pike, A. Dorne, L. Pickering, M. Jamieson, I. T. MacCuish, E. Riis, M. Y. H. Johnson, V. A. Henderson, P. F. Griffin, A. S. Arnold

专题命中 其他LLM :SLM(abstract,abstract_cn)

AI总结 提出一种结合菲涅耳波带片与空间光调制器优势的新型波带片,可生成大面积环形光场,用于超冷原子萨格纳克干涉测量。

Comments 10 pages, 5 figures, to appear in Optics Express

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20919 2026-06-26 cs.LG cs.AI cs.PL 版本更新 62%

Sutra: Tensor-Op RNNs as a Compilation Target for Vector Symbolic Architectures

Sutra: 以张量操作RNN作为向量符号架构的编译目标

Emma Leonhart

机构 * Emma Leonhart

专题命中 其他LLM :language model(abstract);分类 cs.AI、cs.LG

AI总结 Sutra是一种纯函数式编程语言,通过编译将整个程序降级为融合张量操作图,同时支持符号推理和神经网络训练,实现逻辑程序与可训练网络的统一。

Comments Modified NeurIPS submission, see AI declaration and replication materials at end of paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23816 2026-06-26 cs.LG cs.AI 版本更新 62%

Improved Bounds for Private and Robust Alignment

私有和鲁棒对齐的改进界

Wenqian Weng, Yi He, Xingyu Zhou

专题命中 其他LLM :language model(abstract);分类 cs.AI、cs.LG

AI总结 本文从理论角度研究语言模型的私有和鲁棒对齐,通过建立离线与在线设置下的次优性差距上界,分析隐私与对抗性腐败的两种交互模式,并给出改进的界。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26423 2026-06-26 cs.RO cs.AI 新提交 57%

CoStream: Composing Simple Behaviors for Generalizable Complex Manipulation

CoStream: 组合简单行为实现可泛化的复杂操作

Haonan Chen, Yuxiang Ma, Stephen Tian, Xiaoshen Han, Wenlong Huang, Feiyang Wu, Yunzhu Li, Jiajun Wu, Edward H. Adelson, Yilun Du

专题命中 其他LLM :foundation model(abstract);分类 cs.AI

AI总结 提出CoStream框架,通过组合语义、预测和反应三种简单行为,在共享SE(3)接口上实现高精度、可泛化的复杂操作,在8个真实任务中验证了其有效性。

Comments Website: https://costream-simple.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26361 2026-06-26 cs.LG physics.ao-ph 新提交 57%

Does Aurora Encode Atmospheric Structure? Latent Regime Analysis and Attribution

Aurora 是否编码了大气结构?潜在状态分析及归因

Emma Kasteleyn, Ana Lucic

机构 * University of Amsterdam(阿姆斯特丹大学)

专题命中 其他LLM :foundation model(abstract);分类 cs.LG

AI总结 本文通过空间池化PCA和逐层相关性传播分析Aurora模型的内部表征,发现其潜在空间主要按季节周期组织,且模型关注与三维垂直结构一致的特征,表明模型无需显式指令即可学习气象一致性和垂直结构。

Comments Accepted at the FM4Science and Sci4DL workshops at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27111 2026-06-26 cs.HC cs.SI 新提交 50%

Behind the Mask: A Taxonomic Analysis of Activities in Online Social Networks

面具背后:在线社交网络中活动的分类学分析

Debora F De Souza, Gabriela Beltrao, Berta Chulvi, Sergio Dantonio, Mehmet Gokay Ozerim, Javier Torregrosa, Adrian Giron, Angel Panizo, Pablo Miralles Gonzalez, Helena Liz, Javier Huertas Tato, Sonia Sousa, Alejandro Martin, Monika Maciuliene, David Camacho

专题命中 其他LLM :prompting(abstract)

AI总结 通过专家协作和文献综述设计分类法,分析恶意行为者的特征与活动,并以反移民话语案例研究验证其帮助识别虚假信息传播的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏