arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12157 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 12157 篇

2312.08958 2023-12-15 cs.LG cs.AI cs.RO 86%

LiFT: Unsupervised Reinforcement Learning with Foundation Models as Teachers

Taewook Nam, Juyong Lee, Jesse Zhang, Sung Ju Hwang, Joseph J. Lim, Karl Pertsch

专题命中 其他LLM :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 2nd Workshop on Agent Learning in Open-Endedness (ALOE) at NeurIPS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.03881 2023-12-08 cs.LG cs.AI 86%

FoMo Rewards: Can we cast foundation models as reward functions?

Ekdeep Singh Lubana, Johann Brehmer, Pim de Haan, Taco Cohen

专题命中 其他LLM :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted to NeurIPS FMDM workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.08396 2023-11-15 eess.AS cs.AI cs.CL cs.SD 86%

Zero-shot audio captioning with audio-language model guidance and audio context keywords

Leonard Salewski, Stefan Fauth, A. Sophia Koepke, Zeynep Akata

专题命中 其他LLM :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments NeurIPS 2023 - Machine Learning for Audio Workshop (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.06737 2023-11-14 cs.CL cs.AI 86%

Detecting and Correcting Hate Speech in Multimodal Memes with Large Visual Language Model

Minh-Hao Van, Xintao Wu

专题命中 其他LLM :language model(title,abstract);large language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.19713 2023-10-20 cs.CL cs.LG 86%

Red Teaming Language Model Detectors with Language Models

Zhouxing Shi, Yihan Wang, Fan Yin, Xiangning Chen, Kai-Wei Chang, Cho-Jui Hsieh

专题命中 其他LLM :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.LG

Comments Preprint. Accepted by TACL

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.06547 2023-10-11 cs.CL cs.AI 86%

Rationale-Enhanced Language Models are Better Continual Relation Learners

Weimin Xiong, Yifan Song, Peiyi Wang, Sujian Li

专题命中 其他LLM :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Accepted at EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.01002 2023-10-11 cs.CL cs.AI cs.HC 86%

Does Human Collaboration Enhance the Accuracy of Identifying LLM-Generated Deepfake Texts?

Adaku Uchendu, Jooyoung Lee, Hua Shen, Thai Le, Ting-Hao 'Kenneth' Huang, Dongwon Lee

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted at The 11th AAAI Conference on Human Computation and Crowdsourcing (HCOMP 2023)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.01260 2023-10-03 cs.CL cs.AI 86%

SPELL: Semantic Prompt Evolution based on a LLM

Yujian Betterest Li, Kai Wu

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.05076 2023-09-12 cs.AI cs.CL cs.HC 86%

An Appraisal-Based Chain-Of-Emotion Architecture for Affective Language Model Game Agents

Maximilian Croissant, Madeleine Frister, Guy Schofield, Cade McCall

专题命中 其他LLM :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14449 2023-06-21 cs.AI cs.IR cs.LG 86%

Graph Meets LLM: A Novel Approach to Collaborative Filtering for Robust Conversational Understanding

Zheng Chen, Ziyan Jiang, Fan Yang, Eunah Cho, Xing Fan, Xiaojiang Huang, Yanbin Lu, Aram Galstyan

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.06297 2023-06-13 cs.CL cs.AI 86%

Protect Your Prompts: Protocols for IP Protection in LLM Applications

M. A. van Wyk, M. Bekker, X. L. Richards, K. J. Nixon

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 5 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.19835 2023-06-01 cs.CL cs.AI 86%

Deliberate then Generate: Enhanced Prompting Framework for Text Generation

Bei Li, Rui Wang, Junliang Guo, Kaitao Song, Xu Tan, Hany Hassan, Arul Menezes, Tong Xiao, Jiang Bian, JingBo Zhu

专题命中 其他LLM :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.01020 2023-05-03 cs.CL cs.AI 86%

Evaluating statistical language models as pragmatic reasoners

Benjamin Lipkin, Lionel Wong, Gabriel Grand, Joshua B Tenenbaum

专题命中 其他LLM :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments 8 pages, 4 figures, to appear in the Proceedings of the Annual Meeting of the Cognitive Science Society 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.04964 2023-05-03 cs.RO cs.AI cs.CL 86%

Generating Executable Action Plans with Environmentally-Aware Language Models

Maitrey Gramopadhye, Daniel Szafir

专题命中 其他LLM :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.08966 2022-10-06 cs.CL cs.AI 86%

Will It Blend? Mixing Training Paradigms & Prompting for Argument Quality Prediction

Michiel van der Meer, Myrthe Reuver, Urja Khurana, Lea Krause, Selene Báez Santamaría

专题命中 其他LLM :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted at the 9th Workshop on Argument Mining (2022)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00656 2025-12-02 cs.CL cs.CY 86%

Sycophancy Claims about Language Models: The Missing Human-in-the-Loop

语言模型中的趋炎附势主张:缺失的人工智能循环

Jan Batzner, Volker Stocker, Stefan Schmid, Gjergji Kasneci

机构 * Weizenbaum Institute(韦岑鲍姆研究所) Technical University Berlin(柏林技术大学) Technical University Munich(慕尼黑技术大学)

专题命中 其他LLM :language model(title,abstract);LLM(abstract,comments);large language model(abstract);分类 cs.CL

AI总结 本文探讨了大型语言模型中趋炎附势现象的测量挑战,提出五个核心操作化定义,并指出当前研究缺乏对人类感知的评估,为未来研究提供建议。

Comments NeurIPS 2025 Workshop on LLM Evaluation and ICLR 2025 Workshop on Bi-Directional Human-AI Alignment

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06718 2025-10-09 cs.SE cs.AI 86%

LLM Company Policies and Policy Implications in Software Organizations

Ranim Khojah, Mazen Mohamad, Linda Erlenhov, Francisco Gomes de Oliveira Neto, Philipp Leitner

机构 * Chalmers University of Technology and University of Gothenburg(楚尔姆斯理工大学和哥德堡大学)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted at IEEE Software Special Issue on AIware in the Foundation Models Era

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18019 2025-05-26 cs.SE cs.AI 86%

LLM assisted web application functional requirements generation: A case study of four popular LLMs over a Mess Management System

Rashmi Gupta, Aditya K Gupta, Aarav Jain, Avinash C Pandey, Atul Gupta

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 11 pages, 12 figures, Accepted in EASE 2025 https://conf.researchr.org/details/ease-2025/ease-2025-ai-models---data/11/LLM-assisted-web-application-functional-requirements-generation-A-case-study-of-fou

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.02580 2024-12-09 cs.SE cs.AI 86%

PropertyGPT: LLM-driven Formal Verification of Smart Contracts through Retrieval-Augmented Property Generation

Ye Liu, Yue Xue, Daoyuan Wu, Yuqiang Sun, Yi Li, Miaolei Shi, Yang Liu

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted by NDSS Symposium 2025. Please cite the conference version of this paper, e.g., "Ye Liu, Yue Xue, Daoyuan Wu, Yuqiang Sun, Yi Li, Miaolei Shi, Yang Liu. PropertyGPT: LLM-driven Formal Verification of Smart Contracts through Retrieval-Augmented Property Generation. In 32nd Annual Network and Distributed System Security Symposium (NDSS 2025)."

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.03720 2024-08-12 cs.LG 86%

SteP: Stacked LLM Policies for Web Actions

Paloma Sodhi, S. R. K. Branavan, Yoav Artzi, Ryan McDonald

专题命中 其他LLM :LLM(title,abstract);language model(abstract,comments);large language model(abstract);分类 cs.LG

Comments Accepted at Conference on Language Modeling (COLM) 2024. 30 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18292 2026-08-20 cs.RO cs.CV 新提交 86%

GuideFetch: A Task Coordination Framework for Concurrent Navigation and Object Retrieval in Assistive Robot Dogs

GuideFetch:用于辅助机器狗并发导航与物体检索的任务协调框架

Qian Yin, Ruiping Liu, Kunyu Peng, Jianxiang Man, Isik Baran Sandan, Junwei Zheng, Yufan Chen, Di Wen, Kailun Yang, Rainer Stiefelhagen

机构 * Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) Hunan University(湖南大学)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 针对异构辅助机器狗的导航与物体检索并发任务,提出GuideFetch协调框架,通过LLM规划与状态验证提升执行效率,并行执行可缩短41.3%平均总完成时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16908 2026-08-19 cs.SI 新提交 86%

MAG-Bot: A Multi-Agent Auditing Framework for Social Bot Detection

MAG-Bot:一种用于社交机器人检测的多智能体审计框架

Sichen Zhao, Yalun Qi

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 本研究提出基于LangGraph的多智能体框架MAG-Bot,用于社交机器人检测,通过角色约束的证据分解修正单LLM审计的盲点,在TwiBot-22测试集上显著提升了检测的准确率、召回率与F1值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12638 2026-08-18 cs.PL 版本更新 86%

Equivalence Checking of ML GPU Kernels

ML GPU 内核的等价性检查

Benjamin Driscoll, Kshitij Dubey, Anjiang Wei, Neeraj Kayal, Rahul Sharma, Alex Aiken

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 研究人员提出首个GPU内核等价性检查器Volta,可验证手工、LLM及编译器优化的ML内核正确性,适用于卷积、矩阵乘法等ML计算。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14113 2026-08-17 cs.HC 新提交 86%

Search or Chat? Comparing How We Learn About Debated Topics

搜索还是聊天?对比我们如何了解有争议的话题

Ran Yu, Alisa Rieger, Rabia Karatoprak Ersen, Jiqun Liu

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 该研究通过194人参与的众包实验,对比传统搜索与LLM聊天界面对学习有争议话题的影响,发现工具无显著差异,用户特征对学习结果影响更大。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13063 2026-08-14 cs.AI cs.CL cs.LG 新提交 86%

Explanatory Engagement Under Rare Anomalous Failure: Asymptotic Rarity in Model Behavior (or: The Asymptotic AI)

罕见异常失效下的解释性参与:模型行为中的渐近稀有性(或:渐近式AI)

Sam Mao

专题命中 其他LLM :LLM(summary_cn,abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本研究探究LLM在低可控失效概率工作流中,解释性参与度随失效渐近稀有性的变化,发现触发结构是关键调节变量,不同模型的异常识别与参与表现存在差异。

Comments 11 figures. Elicitation-condition sweep across three open-weight models (qwen3:8b, llama3.1:8b, mistral:7b); pipeline scripts and experimental data available upon reasonable request

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06525 2026-07-31 cs.GT cs.MA econ.TH 版本更新 86%

Who Is Really Playing? Strategic Interaction in AI-Guided Populations

通过AI维持群体合作:一种针对大语言模型的folk定理

Jonathan Shaki, Eden Hartman, Sarit Kraus, Yonatan Aumann

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 本文研究了大语言模型如何通过指导多个群体中的代理实现合作,发现即使基础游戏激励不一致,共享LLM指导也能维持合作,证明了针对LLM的folk定理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26591 2026-07-30 cs.SE 新提交 86%

MultiFixer: A Coordinator-Proposer Based Multi-Agent Framework For Fixing Multi-Hunk Bugs

MultiFixer:一种用于修复多块漏洞的基于协调者-提议者的多智能体框架

Haichuan Hu, Chunrong Fang, Ye Shang, Jiawei Liu, Weifeng Sun, Guoqing Xie, Chenxing Zhong, Quanjun Zhang

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 该研究针对现有LLM-based APR方法难以修复多块漏洞的问题,提出MultiFixer多智能体框架,经多基准测试,其在Defects4J等数据集上达到最优修复效果,能有效修复多块漏洞。

Comments Accepted to 41st IEEE/ACM International Conference on Automated Software Engineering (ASE 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13357 2026-07-24 cs.HC 版本更新 86%

TANDE: Disentangling Verbal and Nonverbal Backchannels in Emotional AI-Avatar Conversations with Young Adults

TANDE:在与年轻人的情感人工智能-虚拟化身对话中区分言语和非言语反馈渠道

Ann-Kareen Gedeus, Jack Good, Nadine Wagener, Angelique Taylor

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 研究在与年轻人的情感人工智能-虚拟化身对话中反馈渠道模式的影响,引入TANDE这个由LLM驱动的ECA,通过实验探讨其对融洽关系、同理心和参与度的作用及性别差异,得出相关设计启示。

Comments This paper has been accepted for publication at the 28th ACM International Conference on Multimodal Interaction (ICMI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00445 2026-07-02 cs.HC 新提交 86%

Gaze-Informed Proactive AI Assistance for Children's Picture Exploration

基于注视的主动式AI辅助儿童图画探索

Zekun Wu, Man Su, Huiyong Li, Tomohiro Nagashima, Anna Maria Feit

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 提出Ollie系统,利用儿童注视估计注意力并触发LLM描述相关图画区域,实验表明注视辅助比随机辅助更有效维持注意力并引导探索。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25550 2026-06-25 cs.SE 新提交 86%

On the Viability of Requirements Generation From Code: An Experience Report

从代码生成需求的可行性:经验报告

Alexander Korn, Jone Bartel, Max Unterbusch, Andreas Vogelsang

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 本文通过实验评估基于LLM和RAG的代理方法从源代码生成需求,发现LLM无法可靠生成未实现需求、高质量需求或引入需求气味,且单一人工难以检测气味,表明该方法尚不可行。

Comments Accepted for publication at the 13th International Workshop on Artificial Intelligence and Requirements Engineering (AIRE'26)

详情

展开后加载摘要…

URL PDF HTML 收藏