arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7539 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7539 篇

2510.01048 2026-04-21 cs.CL cs.AI cs.LG 85%

Interpreting Language Models Through Concept Descriptions: A Survey

通过概念描述解读语言模型:一项调查

Nils Feldhus, Laura Kopf

机构 * BIFOLD – Berlin Institute for the Foundations of Learning and Data(柏林学习与数据基础研究所) Technische Universität Berlin(柏林技术大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文调查了通过生成自然语言概念描述来解读模型组件和抽象的方法,揭示了生成这些描述的关键方法、评估指标及数据集,并指出对更严谨因果评估的需求。

Comments Accepted at The Eight Workshop on Analyzing and Interpreting Neural Networks for NLP (BlackboxNLP), co-located with EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10107 2026-04-14 cs.HC 85%

The Double-Edged Sword of Open-Ended Interaction: How LLM-Driven NPCs Affect Players' Cognitive Load and Gaming Experience

开放式交互的双刃剑:LLM驱动的NPC如何影响玩家的认知负荷和游戏体验

Ting-Chen Hsu, Wenran Chen, Jiangxu Lin, Fei Qin, Zheyuan Zhang

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 研究探讨LLM驱动NPC对玩家认知负荷和游戏体验的影响,揭示心理机制、任务场景差异及个体特质作用,发现NPC显著增加认知负荷但未提升整体体验,且效果随任务场景变化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09318 2026-04-13 cs.PL cs.FL 85%

CIR+CVN: Bridging LLM Semantic Understanding and Petri-Net Verification for Concurrent Programs

CIR+CVN:连接LLM语义理解与Petri网验证以实现并发程序

Kaiwen Zhang, Guanjun Liu

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出CIR+CVN框架,通过LLM生成并发抽象模型,结合Petri网验证并发程序,实现迭代调试与修复,提升并发程序的可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08708 2026-04-13 cs.LG cs.AI cs.CL 85%

Every Response Counts: Quantifying Uncertainty of LLM-based Multi-Agent Systems through Tensor Decomposition

每种回应都重要:通过张量分解量化基于大语言模型的多智能体系统不确定性

Tiejin Chen, Huaiyuan Yao, Jia Chen, Evangelos E. Papalexakis, Hua Wei

机构 * Arizona State University(亚利桑那州立大学) University of California, Riverside(加利福尼亚大学河滨分校)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出MATU框架,通过张量分解量化多智能体系统中的不确定性,解决多步推理、通信路径变化和拓扑多样性等挑战,提供通用可靠性评估。

Comments Accept to ACL 26

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.04570 2026-04-02 cs.HC 85%

A Map of Exploring Human Interaction patterns with LLM: Insights into Collaboration and Creativity

探索人类交互模式的地图:协作与创造力的洞察

Jiayang Li, Jiale Li

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文通过系统分析110篇人类与LLM交互研究,提出一种新的映射方法,揭示协作与创造力领域的研究现状与挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22567 2026-03-25 cs.CE cs.MA 85%

TrustTrade: Human-Inspired Selective Consensus Reduces Decision Uncertainty in LLM Trading Agents

TrustTrade: 人类启发的选 择性共识降低LLM交易代理决策不确定性

Minghan Li, Rachel Gonsalves, Weiyue Li, Sunghoon Yoon, Mengyu Wang

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 TrustTrade通过引入多代理选择性共识框架,减少LLM交易代理在高噪声市场中的决策不确定性,提升风险意识和稳定性。

Comments 24 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11605 2026-03-13 cs.CV 85%

LaMoGen: Language to Motion Generation Through LLM-Guided Symbolic Inference

LaMoGen:通过LLM引导的符号推理实现语言到动作生成

Junkun Jiang, Ho Yin Au, Jingyu Xiang, Jie Chen

机构 * Department of Computer Science, Hong Kong Baptist University, HKSAR(香港 Baptist 大学计算机科学系)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 LaMoGen通过LLM引导的符号推理实现语言到动作的生成,利用LabanLite动作表示提升动作的可解释性和可控性。

Comments Accepted by CVPR 2026. Supplementary material included. Project page: https://jjkislele.github.io/LaMoGen/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01096 2026-03-03 cs.CV cs.AI cs.CL cs.LG 85%

Unified Vision-Language Modeling via Concept Space Alignment

通过概念空间对齐实现统一的视觉-语言建模

Yifu Qiu, Paul-Ambroise Duquenne, Holger Schwenk

机构 * University of Edinburgh(爱丁堡大学) FAIR at Meta(Meta公司FAIR团队)

专题命中 知识编辑与模型理解 :language model(title,abstract);instruction tuning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 通过概念空间对齐实现统一的视觉-语言建模,V-SONAR在多语言和多模态任务中超越现有模型。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12021 2026-02-09 cs.SE 85%

LitterBox+: An Extensible Framework for LLM-enhanced Scratch Static Code Analysis

LitterBox+: 一种可扩展的LLM增强Scratch静态代码分析框架

Benedikt Fein, Florian Obermüller, Gordon Fraser

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 LitterBox+通过将Scratch块式代码转换为文本形式,利用LLM生成能力提升静态代码分析,提供API和界面扩展,支持代码查询与修复,提升学习者编程体验。

Comments ASE 2025 Tool Demonstration Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03271 2026-02-04 cs.CR 85%

LogicScan: An LLM-driven Framework for Detecting Business Logic Vulnerabilities in Smart Contracts

LogicScan: 一种基于大语言模型的智能合约业务逻辑漏洞检测框架

Jiaqi Gao, Zijian Zhang, Yuqiang Sun, Ye Liu, Chengwei Liu, Han Liu, Yi Li, Yang Liu

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 LogicScan利用大语言模型和业务规范语言,通过挖掘链上协议的业务不变量,实现对智能合约业务逻辑漏洞的高效检测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12273 2026-01-21 cs.SE 85%

Leveraging Mutation Analysis for LLM-based Repair of Quantum Programs

利用突变分析改进基于大语言模型的量子程序修复

Chihiro Yoshida, Yuta Ishimoto, Olivier Nourry, Masanari Kondo, Makoto Matsushita, Yasutaka Kamei, Yoshiki Higo

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出利用突变分析提升基于大语言模型的量子程序修复效果,通过设计不同提示配置实验,发现突变分析能显著提高修复成功率和解释质量。

Comments 6 pages, Accepted at SANER-ERA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11238 2026-01-19 cs.IR 85%

LLM-Assisted Pseudo-Relevance Feedback

基于大语言模型的伪相关反馈

David Otero, Javier Parapar

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出一种结合大语言模型的伪相关反馈方法,通过在RM3计算前过滤相关文档,提升查询扩展的鲁棒性和准确性。

Comments Accepted ECIR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17535 2026-01-14 cs.IR 85%

How role-play shapes relevance judgment in zero-shot LLM rankers

角色扮演如何塑造零样本LLM排序器的相关性判断

Yumeng Wang, Jirui Qi, Catherine Chen, Panagiotis Eustratiadis, Suzan Verberne

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本研究探讨角色扮演如何影响零样本LLM排序器的相关性判断,发现角色描述的精心制定显著提升排序质量,且角色信号主要在早期层编码,为设计更有效的提示提供了指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02878 2026-01-07 econ.TH 85%

Improving Financial Forecasting with a Synergistic LLM-Transformer Architecture: A Hybrid Approach to Stock Price Prediction

通过协同LLM-Transformer架构提升金融预测:一种股票价格预测的混合方法

Sayed Akif Hussain, Chen Qiu-shi, Syed Amer Hussain, Syed Atif Hussain, Asma Komal, Muhammad Imran Khalid

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出混合LLM-Transformer架构,通过融合文本和数值数据提升股票价格预测精度,实验证明模型在噪声环境下具有更强的鲁棒性和可解释性。

Comments 14 pages, 6 Figures, 3 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22250 2025-12-30 cs.SE 85%

Hallucination Detection for LLM-based Text-to-SQL Generation via Two-Stage Metamorphic Testing

通过双阶段元测试检测基于大语言模型的文本到SQL生成中的幻觉

Bo Yang, Yinfen Xia, Weisong Sun, Yang Liu

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 通过双阶段元测试方法检测基于大语言模型的文本到SQL生成中的幻觉,无需地面真实数据,提升检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23070 2025-12-23 cs.CV 85%

Vocabulary-free Fine-grained Visual Recognition via Enriched Contextually Grounded Vision-Language Model

无需词汇的细粒度视觉识别 via 增强的上下文感知视觉语言模型

Dmitry Demidov, Zaigham Zaheer, Omkar Thawakar, Salman Khan, Fahad Shahbaz Khan

机构 * Mohamed bin Zayed University of Artificial Intelligence(莫扎德·本·扎耶德人工智能大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract)

AI总结 本文提出E-FineR方法,无需词汇实现细粒度视觉识别,提供高可解释性和在零样本和少样本分类中的高性能。

Comments Accepted to ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05706 2025-11-20 eess.AS 85%

Bridging the Modality Gap: Softly Discretizing Audio Representation for LLM-based Automatic Speech Recognition

Mu Yang, Szu-Jui Chen, Jiamin Xie, John Hansen

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments ASRU 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09453 2025-11-13 eess.SP 85%

LLM Enabled Beam Training for Pinching Antenna Systems (PASS)

Deqiao Gan, Xiaoxia Xu, Xiaohu Ge, Yuanwei Liu

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments submitted to IEEE journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24966 2025-10-30 cs.LG cs.AI cs.CL stat.ML 85%

Sequences of Logits Reveal the Low Rank Structure of Language Models

Noah Golowich, Allen Liu, Abhishek Shetty

机构 * Microsoft Research(微软研究院) UC Berkeley(加州大学伯克利分校) MIT(麻省理工学院)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24408 2025-10-29 cs.CR cs.NI 85%

Uncovering Gaps Between RFC Updates and TCP/IP Implementations: LLM-Facilitated Differential Checks on Intermediate Representations

Yifan Wu, Xuewei Feng, Yuxiang Yang, Ke Xu

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 15 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22892 2025-10-28 cs.RO cs.SY eess.SY 85%

Never Too Rigid to Reach: Adaptive Virtual Model Control with LLM- and Lyapunov-Based Reinforcement Learning

Jingzehua Xu, Yangyang Li, Yangfei Chen, Guanwen Xie, Shuai Zhang

机构 * Department of Engineering, University of Cambridge(剑桥大学工程系) Department of Electrical Engineering and Computer Science, Massachusetts Institute of Technology(麻省理工学院电气工程与计算机科学系) Zhejiang University-University of Illinois Urbana-Champaign Institute, Zhejiang University(浙江大学-伊利诺伊大学厄巴纳-香槟分校联合研究所) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际 Graduate School) Department of Data Science, New Jersey Institute of Technology(新泽西理工学院数据科学系)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09423 2025-10-22 cs.CV cs.RO 85%

Distilling LLM Prior to Flow Model for Generalizable Agent's Imagination in Object Goal Navigation

Badi Li, Ren-jie Lu, Yu Zhou, Jingke Meng, Wei-shi Zheng

机构 * Sun Yat-sen University(中山大学) The University of Hong Kong(香港大学) Key Laboratory of Machine Intelligence and Advanced Computing, Ministry of Education(教育部机器智能与高级计算重点实验室)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15729 2025-10-20 cs.IR 85%

FACE: A General Framework for Mapping Collaborative Filtering Embeddings into LLM Tokens

Chao Wang, Yixin Song, Jinhui Ye, Chuan Qin, Dazhong Shen, Lingfeng Liu, Xiang Wang, Yanyong Zhang

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11414 2025-10-14 cs.CR 85%

Uncertainty-Aware, Risk-Adaptive Access Control for Agentic Systems using an LLM-Judged TBAC Model

Charles Fleming, Ashish Kundu, Ramana Kompella

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02233 2025-10-10 cs.CL cs.AI cs.LG 85%

Enhancing LLM Reliability via Explicit Knowledge Boundary Modeling

Hang Zheng, Hongshen Xu, Yuncong Liu, Lu Chen, Pascale Fung, Kai Yu

机构 * X-LANCE Lab, School of Computer Science MoE Key Lab of Artificial Intelligence, SJTU AI Institute Shanghai Jiao Tong University, Shanghai, China(X-LANCE实验室,计算机科学学院,人工智能关键实验室,上海交通大学人工智能研究院,上海,中国) Jiangsu Key Lab of Language Computing, Suzhou, China(语言计算重点实验室,苏州,中国) AISpeech Co., Ltd., Suzhou, China(AISpeech公司,苏州,中国) Center for Artificial Intelligence Research (CAiRE) Hong Kong University of Science and Technology, Hong Kong, China(人工智能研究中心(CAiRE)香港科技大学,香港,中国) Suzhou Laboratory, Suzhou, China(苏州实验室,苏州,中国)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16975 2025-09-29 cs.LG cs.AI cs.CL 85%

Latent Concept Disentanglement in Transformer-based Language Models

Guan Zhe Hong, Bhavya Vasudeva, Vatsal Sharan, Cyrus Rashtchian, Prabhakar Raghavan, Rina Panigrahy

机构 * Purdue University(普渡大学) University of Southern California(南加州大学) Google(谷歌)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.17422 2025-09-08 cs.RO cs.CV 85%

Multimodal LLM Guided Exploration and Active Mapping using Fisher Information

Wen Jiang, Boshu Lei, Katrina Ashton, Kostas Daniilidis

机构 * University of Pennsylvania(宾夕法尼亚大学) Archimedes, Athena RC(阿基米德、阿提卡RC)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.12341 2025-08-14 cs.MM 85%

Multimodal LLM-based Query Paraphrasing for Video Search

Jiaxin Wu, Chong-Wah Ngo, Wing-Kwong Chan, Sheng-Hua Zhong, Xiong-Yong Wei, Qing Li

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22905 2025-08-01 cs.HC 85%

Exploring LLM-generated Culture-specific Affective Human-Robot Tactile Interaction

Qiaoqiao Ren, Tony Belpaeme

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.08493 2025-07-22 cs.RO 85%

Intelligent LiDAR Navigation: Leveraging External Information and Semantic Maps with LLM as Copilot

Fujing Xie, Jiajie Zhang, Sören Schwertfeger

机构 * ShanghaiTech University(上海科技大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted at IROS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏