arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12169 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 12169 篇

2304.06708 2023-04-14 cs.CV cs.AI cs.CL 84%

Verbs in Action: Improving verb understanding in video-language models

Liliane Momeni, Mathilde Caron, Arsha Nagrani, Andrew Zisserman, Cordelia Schmid

专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.09527 2022-11-18 cs.CL cs.AI 84%

Ignore Previous Prompt: Attack Techniques For Language Models

Fábio Perez, Ian Ribeiro

专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments ML Safety Workshop NeurIPS 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.05344 2022-11-11 cs.CL cs.LG 84%

LERT: A Linguistically-motivated Pre-trained Language Model

Yiming Cui, Wanxiang Che, Shijin Wang, Ting Liu

专题命中 其他LLM :language model(title,abstract);foundation model(abstract);分类 cs.CL、cs.LG

Comments 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.05479 2022-09-16 cs.LG cs.AI 84%

Leveraging Language Foundation Models for Human Mobility Forecasting

Hao Xue, Bhanu Prakash Voutharoja, Flora D. Salim

专题命中 其他LLM :foundation model(title,abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted at ACM SIGSPATIAL 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.07406 2022-09-08 cs.CL cs.AI 84%

Fooling MOSS Detection with Pretrained Language Models

Stella Biderman, Edward Raff

专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments To appear in the Proceedings of the 29th ACM International Conference on Information & Knowledge Management (CIKM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.01068 2022-06-22 cs.CL cs.LG 84%

OPT: Open Pre-trained Transformer Language Models

Susan Zhang, Stephen Roller, Naman Goyal, Mikel Artetxe, Moya Chen, Shuohui Chen, Christopher Dewan, Mona Diab, Xian Li, Xi Victoria Lin, Todor Mihaylov, Myle Ott, Sam Shleifer, Kurt Shuster, Daniel Simig, Punit Singh Koura, Anjali Sridhar, Tianlu Wang, Luke Zettlemoyer

专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.08745 2022-03-17 cs.CL cs.AI 84%

Multi-Stage Prompting for Knowledgeable Dialogue Generation

Zihan Liu, Mostofa Patwary, Ryan Prenger, Shrimai Prabhumoye, Wei Ping, Mohammad Shoeybi, Bryan Catanzaro

专题命中 其他LLM :prompting(title,abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.04876 2022-02-11 cs.CL cs.AI 84%

Distilling Hypernymy Relations from Language Models: On the Effectiveness of Zero-Shot Taxonomy Induction

Devansh Jain, Luis Espinosa Anke

专题命中 其他LLM :language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.10543 2021-12-21 cs.CL cs.AI 84%

Spiral Language Modeling

Yong Cao, Yukun Feng, Shaohui Kuang, Gu Xu

专题命中 其他LLM :language model(title,abstract);SLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00828 2026-01-06 cs.AI 84%

Decomposing LLM Self-Correction: The Accuracy-Correction Paradox and Error Depth Hypothesis

分解大语言模型的自我纠正:准确性-纠正悖论与错误深度假说

Yin Li

机构 * University of Birmingham(伯明翰大学)

专题命中 其他LLM :LLM(title,comments);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究揭示大语言模型在自我纠正中的准确性-纠正悖论,提出错误深度假说,发现更强模型犯更深入的错误,且错误检测与纠正成功率无直接关联。

Comments 9 pages, 2 figures, 3 tables. Code available at https://github.com/Kevin0304-li/llm-self-correction

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19747 2025-11-03 math.AG cs.LG 84%

TokenBlowUp: Resolving Representational Singularities in LLM Token Spaces via Monoidal Transformations

Dongfang Zhao

专题命中 其他LLM :LLM(title,comments);large language model(abstract);language model(abstract);分类 cs.LG

Comments Multiple senior math professors pointed out technical flaws of this work, i.e., weak connection between the proposed work and LLM applications. In order not to mislead readers, we would like to withdraw this preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13783 2025-06-24 physics.soc-ph cs.LG 84%

Infected Smallville: How Disease Threat Shapes Sociality in LLM Agents

Soyeon Choi, Kangwook Lee, Oliver Sng, Joshua M. Ackerman

机构 * Department of Psychology, University of Wisconsin-Madison(威斯康星大学麦迪逊分校心理学系) Department of Electrical and Computer Engineering, University of Wisconsin-Madison(威斯康星大学麦迪逊分校电气与计算机工程系) Department of Psychological Science, University of California, Irvine(加州大学伊文斯分校心理学科学系) Department of Psychology, University of Michigan, Ann Arbor(密歇根大学安娜堡分校心理学系)

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.LG

Comments ICML 2025 Workshop on Multi-Agent Systems in the Era of Foundation Models: Opportunities, Challenges and Futures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04768 2026-08-06 cs.CV 新提交 83%

Embedding Large Language Models into Flow Controls: An Agentic Framework for Adaptive and Trustworthy Automated Cooking

将大语言模型嵌入流程控制:一种用于自适应且可信的自动化烹饪的智能体框架

Zihan Song, Hongwei Huang, Yueshuo Sun, Yonglin Tian, Fei-Yue Wang, Bai Li

专题命中 其他LLM :large language model(title);language model(title)

AI总结 针对自动化烹饪机器人的个性化与可信性问题,提出智能体框架,通过多智能体分解需求、分阶段生成执行代码,实验验证其在真实场景中可靠且实用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09767 2026-08-06 cs.HC 版本更新 83%

LLMs are the Ideal Candidate for Mixed-Initiative Game Design Pillar Workflows

LLMs是混合倡议游戏设计支柱工作流的理想候选人

Julian Geheeb, Marvin Julian Schwarz, Daniel Dyrda, Georg Groh

专题命中 其他LLM :LLM(summary_cn,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文探讨了LLM在游戏设计支柱工作流中的应用,提出SPINE原型,并通过实验验证其在早期开发阶段的价值,展示了LLM在生成和决策过程中的有效性。

Comments 10 pages, 1 figure, 3 tables. 6 pages appendix, 13 tables

Journal ref Proceedings of the 21st International Conference on Foundations of Digital Games (FDG '26), Copenhagen, Denmark, August 10-13, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24895 2026-06-25 cs.DL 新提交 83%

Hybrid Metadata Extraction from League of Nations Index Cards: From Feasibility Study to Archival System Integration

国联索引卡片的混合元数据提取:从可行性研究到档案系统集成

Florian Cafiero, Grégoire Mallard

专题命中 其他LLM :LLM(summary_cn,abstract);language model(abstract)

AI总结 提出混合AI工作流从国联索引卡片中提取并整合档案元数据,结合YOLO、TrOCR、本地LLM后校正及微调视觉语言模型,实现从布局感知管道到混合架构的演进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08050 2026-06-09 cs.HC 新提交 83%

Automatic, Real-time Classification of User Feedback Using Large Language Models

使用大型语言模型自动实时分类用户反馈

Jim Maddock, Rose Leitner, Anna Wu

专题命中 其他LLM :large language model(title);language model(title)

AI总结 本文介绍一个多年项目,利用大型语言模型自动分类用户反馈,降低时间与知识成本,使非技术用户也能实时访问评论、主题和分析,从而民主化数据分析过程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15676 2026-06-04 cs.LG cs.AI cs.CL 83%

KITE: Kernelized and Information Theoretic Exemplars for In-Context Learning

KITE: 基于核方法和信息论的上下文学习示例选择

Vaibhav Singh, Soumya Suvra Ghosal, Kapu Nirmal Joshua, Soumyabrata Pal, Sayak Ray Chowdhury

机构 * IIT Bombay(印度比哈尔理工学院) UMD College Park(马里兰大学 College Park 分校) IIT Kanpur(印度坎普尔理工学院) Adobe Research(Adobe 研究)

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 针对上下文学习中的示例选择问题,提出一种基于信息论和核方法的贪心算法,通过最小化查询特定预测误差并引入多样性正则化,显著提升分类性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03145 2026-06-03 cs.DB 83%

The Case for Text-to-SQL Friendly Logical Database Design

面向文本到SQL的友好逻辑数据库设计

Shi Heng Zhang, Zhengjie Miao, Jiannan Wang

专题命中 其他LLM :LLM(summary_cn,abstract);language model(abstract)

AI总结 本文提出LLM友好的逻辑数据库设计目标,通过三种语义保持的模式变换(抽象、分区、重命名)优化数据库模式,提升文本到SQL的生成准确率,实验显示执行准确率提升高达4.2%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29268 2026-06-01 cs.CL cs.AI cs.LG cs.NE 83%

Compute Allocation in Evolutionary Search: From Depth-Breadth to Multi-Armed Bandits

进化搜索中的计算分配:从深度-广度到多臂老虎机

Sixue Xing, Haoyu He, Kerui Wu, Zhuo Yang, Haozheng Luo, Tianfan Fu, Aarthy Nagarajan

机构 * University of Notre Dame(诺丁汉大学) Northeastern University(东北大学) University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) Southeast University(东南大学) Northwestern University(西北大学) Nanjing University(南京大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 其他LLM :LLM(summary_cn,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 针对LLM引导的进化搜索中固定预算的LLM调用分配问题,提出基于多臂老虎机的BaSE方法,通过跨并行轨迹分配调用,平均适应度提升12.3%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13824 2026-05-19 quant-ph 83%

Semantic Concurrency Limits in Large Language Models

大语言模型中的语义并发极限

Karl Svozil

专题命中 其他LLM :large language model(title);language model(title)

AI总结 研究探讨了高维嵌入空间中语义方向的并发限制,提出动能容量与知识可访问性区分,揭示维度在语义并发带宽中的作用。

Comments 8 pages, 1 figure, totally rewritten, contribution to the ES Forum on "Quantum Thinking" (Frankfurt, Germany, EU, September 21-26, 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17247 2026-04-21 cs.CY cs.HC 83%

All Public Voices Are Equal, But Are Some More Equal Than Others to LLMs?

所有公共声音都平等,但有些比其他声音更平等吗?

Sola Kim, Marco A. Janssen, Jieshu Wang, Ame Min-Venditti, Neha Karanjia, John M. Anderies

专题命中 其他LLM :LLM(summary_cn,abstract_cn);large language model(abstract);language model(abstract)

AI总结 研究通过对比不同身份属性对LLM处理公共评论的影响,发现职业身份对摘要质量有显著影响,而种族和性别影响不一致,提示需在政府信息系统中关注社会经济信号。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10646 2026-03-12 cs.SE 83%

ESG Reporting Lifecycle Management with Large Language Models and AI Agents

基于大语言模型和AI代理的ESG报告生命周期管理

Thong Hoang, Mykhailo Klymenko, Xiwei Xu, Shidong Pan, Yi Ding, Xushuo Tang, Zhengyi Yang, Jieke Shi, David Lo

专题命中 其他LLM :large language model(title);language model(title)

AI总结 本文提出基于大语言模型和AI代理的ESG报告生命周期管理框架,通过整合识别、测量、报告、参与和改进阶段,实现动态、可问责的可持续性治理系统。

Comments 8 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07736 2026-03-10 econ.TH 83%

Menu Pricing of Large Language Models

大型语言模型的菜单定价

Dirk Bergemann, Alessandro Bonatti, Alex Smolin

专题命中 其他LLM :large language model(title);language model(title)

AI总结 本文提出了一种针对大型语言模型的最优定价框架,通过一维筛选机制和承诺支出合同,优化用户预算分配与计算资源提供。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02318 2025-10-03 cs.SE 83%

Reflective Unit Test Generation for Precise Type Error Detection with Large Language Models

Chen Yang, Ziqi Wang, Yanjie Jiang, Lin Yang, Yuteng Zheng, Jianyi Zhou, Junjie Chen

专题命中 其他LLM :large language model(title);language model(title)

Comments accepted in the research track of ASE 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16768 2025-09-23 cs.CV 83%

MMPart: Harnessing Multi-Modal Large Language Models for Part-Aware 3D Generation

Omid Bonakdar, Nasser Mozayani

机构 * School of Computer engineering, Iran university of Science and Technology(计算机工程学院,伊朗科学技术大学)

专题命中 其他LLM :large language model(title);language model(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07315 2025-02-25 cs.IR cs.GT 83%

White Hat Search Engine Optimization using Large Language Models

Niv Bardas, Tommy Mordo, Oren Kurland, Moshe Tennenholtz, Gal Zur

专题命中 其他LLM :large language model(title);language model(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.13684 2025-02-24 cs.HC cs.SE 83%

"Always Nice and Confident, Sometimes Wrong": Developer's Experiences Engaging Large Language Models (LLMs) Versus Human-Powered Q&A Platforms for Coding Support

Jiachen Li, Elizabeth Mynatt, Varun Mishra, Jonathan Bell

专题命中 其他LLM :large language model(title);language model(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.03259 2025-01-08 cs.CL cs.AI cs.CY cs.LG cs.MA 83%

Toward Inclusive Educational AI: Auditing Frontier LLMs through a Multiplexity Lens

Abdullah Mushtaq, Muhammad Rafay Naeem, Muhammad Imran Taj, Ibrahim Ghaznavi, Junaid Qadir

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.02136 2024-11-20 cs.HC 83%

User Intent Recognition and Satisfaction with Large Language Models: A User Study with ChatGPT

Anna Bodonhelyi, Efe Bozkir, Shuo Yang, Enkelejda Kasneci, Gjergji Kasneci

专题命中 其他LLM :large language model(title);language model(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10657 2024-10-15 physics.flu-dyn cs.NE 83%

AutoTurb: Using Large Language Models for Automatic Algebraic Model Discovery of Turbulence Closure

Yu Zhang, Kefeng Zheng, Fei Liu, Qingfu Zhang, Zhenkun Wang

专题命中 其他LLM :large language model(title);language model(title)

详情

展开后加载摘要…

URL PDF HTML 收藏