arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12096 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 12096 篇

2606.07821 2026-06-09 physics.optics 新提交 89%

Independent amplitude and phase control using a single phase-only SLM

使用单个纯相位SLM实现独立幅度和相位控制

Marius Constantin Chirita Mihaila, Mikuláš Fiala, Martin Kozák

专题命中 其他LLM :SLM(title,title_cn)

AI总结 提出利用单个纯相位空间光调制器(SLM)的不同区域实现双调制平面,通过偏振器将相位转换为幅度调制,实现复振幅调制的紧凑方案,并验证了贝塞尔-高斯光束等生成。

Comments v2: AAM; licence: CC BY 4.0

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06936 2026-06-08 cs.HC 新提交 89%

Personality Anchoring for Social Simulation: Linking Personality, Social Behavior, and Interaction Success with LLM Agents

社会模拟的人格锚定:将人格、社会行为与交互成功关联于LLM智能体

Vahid Sadiri Javadi, Aksa Aksa, Fryderyk Róg, Lucie Flek, Johanne R. Trippas

专题命中 其他LLM :LLM(title,title_cn)

AI总结 提出人格锚定方法,利用电影角色构建多LLM社会模拟,发现双人宜人性组合与共享目标达成呈单调关系,同质宜人性对成功率是同质不宜人性的10倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15202 2026-06-08 cs.DC cs.OS 版本更新 89%

Simple is Better: Multiplication May Be All You Need for LLM Request Scheduling

简单即最佳:乘法可能就是LLM请求调度所需的一切

Dingyan Zhang, Jinbo Han, Kaixi Zhang, Xingda Wei, Sijie Shen, Chenguang Fang, Wenyuan Yu, Jingren Zhou, Rong Chen

专题命中 其他LLM :LLM(title,title_cn)

AI总结 本文提出通过简单乘法结合KVCache和负载均衡指标,实现LLM请求调度的双重目标,无需超参数调优,实验显示在真实工作负载中显著提升性能。

Comments To appear in the Proceedings of 20th USENIX Symposium on Operating Systems Design and Implementation (OSDI'26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10102 2026-06-02 cs.MA 89%

When Identity Overrides Incentives: Representational Choices as Governance Decisions in Multi-Agent LLM Systems

当身份压倒激励:多智能体LLM系统中的表征选择作为治理决策

Viswonathan Manoranjan, Snehalkumar `Neil' S. Gaikwad

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 通过四智能体战略博弈实验,发现角色身份分配会抑制基于报酬的行为,使均衡选择偏移高达90个百分点,表明表征选择是决定系统输出的治理决策。

Comments Accepted to ACM FAccT 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14661 2026-06-02 cs.IT math.IT 89%

LLM-Enabled Automated Algorithm Design for Multiuser Fluid Antenna Communications

面向多用户流体天线通信的LLM自动化算法设计

Gan Zheng, Fei Liu, Qingfu Zhang

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 针对流体天线系统中端口选择这一大规模组合优化问题,提出利用大语言模型自动设计优化算法(包括改进遗传算法和从头设计启发式算法AutoPort),以最大化最小信干噪比,实现接近最优的性能。

Comments This paper has been accepted in IEEE Transactions on Wireless Communications

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00142 2026-06-02 cs.HC 89%

Practice Less, Explain More: LLM-Supported Self-Explanation Improves Explanation Quality on Transfer Problems in Calculus

少练习,多解释:LLM 支持的自我解释提高了微积分迁移问题的解释质量

Eason Chen, Xinyi Tang, Yvonne Zhao, Meiyi Chen, Meryam Elmir, Elizabeth McLaughlin, Mingyu Yuan, Yumo Wang, Shyam Agarwal, Jared Cochrane, Jionghao Lin, Tongshuang Wu, Ken Koedinger

专题命中 其他LLM :LLM(title,title_cn)

AI总结 通过对比无自我解释、菜单式自我解释和LLM支持的开放式自我解释三种条件,发现开放式自我解释在迁移问题(尤其是NEI问题)上显著提高了解释质量,尽管练习数量较少。

Comments 9 pages, 2 figures. Accepted at AIED 2026. Camera-ready version with updated references

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28071 2026-05-28 cs.CR 89%

AgentGuard: An Attribute-Based Access Control Framework for Tool-Use LLM-Based Agent

AgentGuard:面向工具使用型LLM智能体的基于属性的访问控制框架

Jiaqi Luo, Songyang Peng, Jiarun Dai, Zhile Chen, Zhuoxiang Shen, Geng Hong, Xudong Pan, Yuan Zhang, Min Yang

专题命中 其他LLM :LLM(title,title_cn)

AI总结 提出AgentGuard框架,通过客户端-服务器架构和三种互补检查机制,为工具使用型LLM智能体提供轻量级集成与跨工具安全风险防护。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27716 2026-05-28 cs.SE 89%

LLM Based Web Accessibility Repair: An Empirical Study of Detection, Remediation, and Cost

基于LLM的网页可访问性修复:检测、修复与成本的实证研究

Oluwatoyosi Oyelayo, Ghada Abushaqra, Parham Asadi, Durjoy Dey, Diego Elias Costa

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 本文通过实证研究评估基于大语言模型的智能体(Kimi K2.5)在网页可访问性自动检测与修复中的性能,发现其检测能力与规则工具相当但可靠性不足,修复在语法有效性上表现优异但完全修复率低,且迭代优化增加成本而无益,提出混合方法的需求。

Comments 12 pages, 6 figures, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17318 2026-05-20 hep-ph 89%

RooAgent: An LLM Agent for Root-Based High Energy Physics Analysis

RooAgent:基于根的高能物理分析的LLM代理

Aman Desai

专题命中 其他LLM :LLM(title,title_cn)

AI总结 本文提出RooAgent,一种通过自然语言接口进行根基于高能物理数据分析的LLM代理,支持两种操作模式,并实现了包括直方图检查、事件选择、动量分布可视化、拟合和显著性估计在内的多种任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16976 2026-05-19 cs.CR 89%

Securing LLM Agents Need Intent-to-Execution Integrity

为LLM代理的安全性需要意图到执行的完整性

Wenjie Qu, Ming Xu, Peiran Wang, Shengfang Zhai, Jiaheng Zhang, Dawn Song

专题命中 其他LLM :LLM(title,title_cn)

AI总结 本文提出了一种新的正确性属性,用于定义LLM代理在执行时如何忠实反映用户的意图,同时提出了四个必须同时满足的完整性属性,以确保代理的安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00560 2026-05-19 cs.CR cs.SE quant-ph 89%

Quantum-Safe Code Auditing: LLM-Assisted Static Analysis and Quantum-Aware Risk Scoring for Post-Quantum Cryptography Migration

量子安全代码审计:基于LLM的静态分析与量子感知风险评分用于后量子密码学迁移

Animesh Shaw

专题命中 其他LLM :LLM(title,title_cn)

AI总结 本文提出量子安全代码审计工具,结合正则表达式检测量子脆弱算法、LLM辅助上下文丰富及VQE模型风险评分,评估五个开源库发现5775项问题,实现高精度和召回率。

Comments 13 pages, 2 figures. Code and evaluation data: https://github.com/AnimeshShaw/quantum-safe-auditor

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13776 2026-05-14 cs.HC 89%

"Like Taking the Path of Least Resistance": Exploring the Impact of LLM Interaction on the Creative Process of Programming

像选择阻力最小的路径:探索LLM交互对编程创作过程的影响

Zeinabsadat Saghi, Run Huang, Souti Chattopadhyay

专题命中 其他LLM :LLM(title,title_cn)

AI总结 研究通过对比LLM辅助与无辅助条件,发现LLM能缩短编程创意生成时间,但生成的解决方案创意点数与用户自创相当,探讨了LLM在支持用户创造力方面的设计启示。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12875 2026-05-14 cs.CR 89%

Do Skill Descriptions Tell the Truth? Detecting Undisclosed Security Behaviors in Code-Backed LLM Skills

技能描述是否真实?在代码支持的LLM技能中检测未披露的安全行为

Wenhui He, Yue Li, Bang Fu, Huan Xing, Xing Fan, ZeHua Zhang, Baoning Niu

专题命中 其他LLM :LLM(title,title_cn)

AI总结 本文研究LLM生态系统中程序性技能描述与实现之间的不一致,通过构建安全属性分类法和SKILLSCOPE工具,发现9.4%的技能存在安全风险,工具在识别不一致时达到84.8%的精度和96.5%的召回率。

Comments 11 pages, 3 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10964 2026-05-13 cs.GT 89%

Mechanism Design for Quality-Preserving LLM Advertising

面向质量保持的LLM广告机制设计

Jiale Han, Xiaowu Dai

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 本文提出一种质量保持拍卖框架,通过检索增强生成技术,结合KL正则化和筛选VCG机制,在保证内容忠实性的同时提升广告收益。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27022 2026-05-01 cs.HC 89%

Breaking Bad Financial Habits: How LLM Conversations Correct Financial Misconceptions

打破不良财务习惯:LLM对话如何纠正财务误解

Jillian Ross, Eric So, Andrew W. Lo

专题命中 其他LLM :LLM(title,title_cn)

AI总结 研究发现,精心设计的LLM能有效持久纠正财务误解,关键在于纠正意图和受体接受度,为传统财务教育提供可扩展替代方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26747 2026-04-30 q-fin.PM q-fin.GN q-fin.TR 89%

From Hypotheses to Factors: Constrained LLM Agents in Cryptocurrency Markets

从假说到因素:在加密货币市场中的受约束LLM代理

Yikuan Huang, Zheqi Fan, Kaiqi Hu, Yifan Ye

专题命中 其他LLM :LLM(title,title_cn)

AI总结 本文研究了通过加密货币因素发现使用受约束的LLM代理,在可重复的协议下进行因素发现,通过序列假说搜索框架,结合确定性引擎进行数据分割、选择门、交易成本和投资组合测试,实现了44.55%的年化收益和1.55的夏普比率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18602 2026-04-30 q-fin.TR cs.CE 89%

Machine Spirits: Speculation and Adaptation of LLM Agents in Asset Markets

机器精神:大型语言模型在资产市场中的行为与适应

Maxime Saxena, Marco Pangallo, Cars Hommes, Fabio Caccioli, R. Maria del Rio-Chanona

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 本文研究了LLM在资产市场中的行为,发现其表现出从稳定基本面到人类投机泡沫的多样化行为,且与理性预期假说不一致,同时指出异质性智能体的适应性可能加剧市场波动。

Comments 46 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07011 2026-04-28 stat.ME stat.AP 89%

Recovering manifold structure in LLM responses through a joint Euclidean mirror

通过联合欧几里得镜面恢复LLM响应中的流形结构

Maximilian Baum, Aranyak Acharyya, Tianyi Chen, Avanti Athreya, Youngser Park, Francesco Sanna Passino, Carey E. Priebe, Zachary Lubberts

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 本文通过联合欧几里得镜面分析LLM响应分布的变化,揭示模型参数与响应分布之间的几何关系,提出估计镜面和推断模型参数的方法,用于预测不同调参下的响应分布。

Comments 13 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21740 2026-04-27 cs.CY cs.SI physics.soc-ph 89%

Towards Operational Validation of LLM-Agent Social Simulations: A Replicated Study of a Reddit-like Technology Forum

向LLM-代理社会模拟的操作验证:一个Reddit-like技术论坛的重复研究

Aleksandar Tomašević, Darja Cvetković, Sara Major, Slobodan Maletić, Miroslav Anđelković, Ana Vranić, Boris Stupovski, Dušan Vudragović, Aleksandar Bogojević, Marija Mitrović Dankulov

专题命中 其他LLM :LLM(title,title_cn)

AI总结 本文通过30天的模拟研究,验证LLM-代理在技术论坛中的操作有效性,发现模拟结果与真实数据在用户和帖子层面有重叠,但评论毒性等指标存在差异,揭示了代理设计对模拟结果的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18228 2026-04-21 cs.SE 89%

Towards an Agentic LLM-based Approach to Requirement Formalization from Unstructured Specifications

迈向基于代理的LLM方法:从非结构化规范中提取需求形式化

Alberto Tagliaferro, Bruno Guindani, Livia Lestingi, Matteo Rossi

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 本文提出基于代理的方法,从非结构化规范中自动生成符合验证要求的形式化属性,通过提取、过滤和翻译三个模块,实现语义对齐,实验表明其在三个场景中准确率达77.8%。

Comments Accepted at the AIPV 2026 workshop (non-archival)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02546 2026-04-15 cs.CR 89%

To trust or not to trust: Attention-based Trust Management for LLM Multi-Agent Systems

信任还是不信任:基于注意力的信任管理用于大语言模型多智能体系统

Pengfei He, Zhenwei Dai, Xianfeng Tang, Yue Xing, Hui Liu, Jingying Zeng, Qiankun Peng, Shrivats Agrawal, Samarth Varshney, Suhang Wang, Jiliang Tang, Qi He

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 本文提出基于注意力的信任评分方法,通过六个信任维度提升LLM多智能体系统对恶意输入的鲁棒性。

Comments Accepted to ACL 2026 main

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.09916 2026-04-15 cs.SE 89%

"Should I Give Up Now?" Investigating LLM Pitfalls in Software Engineering

现在就放弃吗?调查LLM在软件工程中的缺陷

Jiessie Tie, Bingsheng Yao, Tianshi Li, Hongbo Fang, Syed Ishtiaque Ahmed, Dakuo Wang, Shurui Zhou

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 研究LLM在软件工程中的缺陷,通过分析26名参与者的复杂网页开发任务数据,发现九种失败类型,包括不准确或不完整响应、认知过载和上下文丢失,发现不帮助的响应增加了放弃的可能性,而更多提示减少了放弃概率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00214 2025-05-20 cs.AR cs.SE 89%

C2HLSC: Leveraging Large Language Models to Bridge the Software-to-Hardware Design Gap

Luca Collini, Siddharth Garg, Ramesh Karri

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Accepted at ACM Transactions on Design Automation of Electronic Systems

Journal ref 2025. C2HLSC: Leveraging Large Language Models to Bridge the Software-to-Hardware Design Gap. ACM Trans. Des. Autom. Electron. Syst. (May 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19515 2024-12-02 cs.CE cs.MA 89%

Leveraging Large Language Models for Institutional Portfolio Management: Persona-Based Ensembles

Yoshia Abe, Shuhei Matsuo, Ryoma Kondo, Ryohei Hisano

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 10 pages, 5 figures, submitted to The IEEE International Workshop on Large Language Models for Finance 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.15078 2024-02-26 cs.SE 89%

LLM-CompDroid: Repairing Configuration Compatibility Bugs in Android Apps with Pre-trained Large Language Models

Zhijie Liu, Yutian Tang, Meiyun Li, Xin Jin, Yunfei Long, Liang Feng Zhang, Xiapu Luo

专题命中 其他LLM :LLM(title,abstract);large language model(title);language model(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11649 2026-08-13 cs.CL 新提交 89%

Who Would You Vote For? Auditing Political Alignment in LLMs: An Italian Case-Study

你会投票给谁?大型语言模型(LLM)的政治立场审计:意大利案例研究

Simone Mungari

机构 * Revelis s.r.l.(雷维利斯有限责任公司)

专题命中 其他LLM :LLM(title_cn,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文以意大利为案例,提出系统可复现的LLM政治立场审计框架,分析多模型对意政党及领导人的评价行为、差异等,探究模型政治偏好相关问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.24191 2026-08-11 cs.CR cs.AI 版本更新 89%

When Grammar Guides the Attack: Uncovering Control-Plane Vulnerabilities in LLMs with Structured Output

当语法引导攻击:利用结构化输出揭示LLM中的控制平面漏洞

Shuoming Zhang, Jiacheng Zhao, Hanyuan Dong, Ruiyuan Xu, Zhicheng Li, Yangyu Zhang, Shuaijiang Li, Yuan Wen, Chunwei Xia, Zheng Wang, Xiaobing Feng, Huimin Cui

机构 * SKLP, ICT, CAS & UCAS(SKLP、信息科技研究院、中国科学院及中国科学院大学) University of Aberdeen(阿伯丁大学) University of Leeds(利兹大学) SKLP, ICT, CAS(SKLP、信息科技研究院、中国科学院)

专题命中 其他LLM :LLM(title_cn,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文研究了通过结构化输出揭示LLM控制平面漏洞的问题,提出了一种名为Constrained Decoding Attack(CDA)的新类别的 jailbreak 方法,通过控制到语义的管道机制,利用schema-enforced logit masking注入恶意前缀,并由模型自身完成有害意图,展示了DictAttack在多个模型上的高攻击成功率,揭示了需要跨平面防御来弥合数据和控制平面之间的语义差距。

Comments To appear in CCS2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02989 2026-07-15 cs.CL cs.CY 版本更新 89%

Growing a Tail: Increasing Output Diversity in Large Language Models

增长尾巴:增加大语言模型的输出多样性

Michal Shur-Ofry, Bar Horowitz-Amsalem, Adir Rahamim, Yonatan Belinkov

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

AI总结 研究大语言模型输出多样性,通过对比模型与人类回答发现模型输出集中。提出三种增加多样性的方法,即温度采样、单提示多角度回答、聚合多模型输出,组合使用可大幅提升多样性,还探讨了对AI政策治理的影响。

Comments Accepted to Machine Learning with Applications

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09262 2026-07-13 cs.CY cs.AI 新提交 89%

Geopolitical alignment: Endorsement effects in large language models

地缘政治倾向:大语言模型中的背书效应

Maxim Chupilkin

机构 * Department of Politics and International Relations, University of Oxford(政治与国际关系系,牛津大学)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 研究大语言模型政策评估是否受地缘政治线索影响,通过背书实验让四个模型评估相同政策,发现模型评分受背书者身份影响,西方背书被视为可信度线索,中国和俄罗斯背书被视为其他风险线索。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16946 2026-07-09 cs.CL 版本更新 89%

Strategies for Span Labeling with Large Language Models

使用大语言模型进行跨度标记的策略

Danil Semin, Ondřej Dušek, Zdeněk Kasner

机构 * Institute of Formal and Applied Linguistics(形式与应用语言学研究所) Faculty of Mathematics and Physics, Charles University(数学与物理系,查尔斯大学)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

AI总结 研究使用大语言模型进行跨度标记的策略,将现有策略分为三类,针对内容匹配局限引入LogitMatch方法,经四项任务评估,发现标记是强大基线,LogitMatch能改进基于匹配的方法,在部分设置中表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏