arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7552 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7552 篇

2508.13908 2025-08-20 physics.ed-ph 75%

Translating the Force Concept Inventory in the age of AI

Marina Babayeva, Justin Dunlap, Marie Snětinová, Ralf Widenhorn

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13729 2025-08-20 cs.CL cs.AI cs.LG 75%

Prediction is not Explanation: Revisiting the Explanatory Capacity of Mapping Embeddings

Hanna Herasimchyk, Alhassan Abdelhalim, Sören Laue, Michaela Regneri

机构 * Universität Hamburg(汉堡大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 10 pages, 6 Figures. Published at ECAI 2025 in a version without the Appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07405 2025-08-12 cs.AI cs.CL cs.LG 75%

Generative AI for Strategic Plan Development

Jesse Ponnock

机构 * Johns Hopkins University(约翰霍普金斯大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 11 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01091 2025-08-05 cs.CY 75%

Disaggregated Health Data in LLMs: Evaluating Data Equity in the Context of Asian American Representation

Uvini Balasuriya Mudiyanselage, Bharat Jayprakash, Kookjin Lee, K. Hazel Kwon

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07360 2025-08-05 cs.CL cs.AI cs.LG 75%

Enhancing Time Series Forecasting via Multi-Level Text Alignment with LLMs

Taibiao Zhao, Xiaobing Chen, Mingxuan Sun

机构 * Louisiana State University(路易斯安那州立大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments This paper is accepted by DASFAA2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03542 2025-07-10 cs.CV 75%

Beyond Accuracy: Metrics that Uncover What Makes a 'Good' Visual Descriptor

Ethan Lin, Linxi Zhao, Atharva Sehgal, Jennifer J. Sun

机构 * Cornell University(康奈尔大学) University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 知识编辑与模型理解 :LLM(abstract);language model(abstract);foundation model(abstract)

Comments VisCon @ CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.17477 2025-07-10 cs.CL cs.AI cs.LG cs.SI 75%

Detecting mental disorder on social media: a ChatGPT-augmented explainable approach

Loris Belcastro, Riccardo Cantini, Fabrizio Marozzo, Domenico Talia, Paolo Trunfio

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Journal ref Online Social Networks and Media, 100321, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05607 2025-07-09 cs.RO 75%

Structured Task Solving via Modular Embodied Intelligence: A Case Study on Rubik's Cube

Chongshan Fan, Shenghai Yuan

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11576 2025-07-03 cs.CV 75%

DCBM: Data-Efficient Visual Concept Bottleneck Models

Katharina Prasse, Patrick Knab, Sascha Marton, Christian Bartelt, Margret Keuper

机构 * Data and Web Science Group, University of Mannheim, Mannheim, Germany(曼海姆大学数据与网络科学小组) Clausthal University of Technology, Clausthal, Germany(克虏格大学) Max-Planck-Institute for Informatics, Saarland Informatics Campus(马克斯·普朗克信息研究所)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.01299 2025-07-01 cs.CL cs.AI cs.LG 75%

The Effectiveness of LLMs as Annotators: A Comparative Overview and Empirical Analysis of Direct Representation

Maja Pavlovic, Massimo Poesio

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments LREC-COLING NLPerspectives workshop

Journal ref https://aclanthology.org/2024.nlperspectives-1.11/

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.04975 2025-06-24 cs.CV 75%

V2C-CBM: Building Concept Bottlenecks with Vision-to-Concept Tokenizer

Hangzhou He, Lei Zhu, Xinliang Zhang, Shuang Zeng, Qian Chen, Yanye Lu

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

Comments Accepted by AAAI2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17052 2025-06-23 cs.LG cs.AI cs.CL 75%

From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers

Jingtong Su, Julia Kempe, Karen Ullrich

机构 * NYU(纽约大学) Meta AI FAIR

专题命中 知识编辑与模型理解 :LLM(abstract);post-training(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14466 2025-06-18 cs.CR 75%

MalGuard: Towards Real-Time, Accurate, and Actionable Detection of Malicious Packages in PyPI Ecosystem

Xingan Gao, Xiaobing Sun, Sicong Cao, Kaifeng Huang, Di Wu, Xiaolei Liu, Xingwei Lin, Yang Xiang

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17514 2025-06-18 cs.LG cs.AI cs.CL 75%

SAE-V: Interpreting Multimodal Models for Enhanced Alignment

Hantao Lou, Changye Li, Jiaming Ji, Yaodong Yang

机构 * Institute for AI, Peking University, Beijing, China(人工智能研究院,北京大学,北京,中国) State Key Laboratory of General Artificial Intelligence, Institute for AI, Peking University, Beijing, China(通用人工智能国家重点实验室,人工智能研究院,北京大学,北京,中国)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 17 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07459 2025-06-11 cs.IR 75%

Why Uncertainty Estimation Methods Fall Short in RAG: An Axiomatic Analysis

Heydar Soudani, Evangelos Kanoulas, Faegheh Hasibi

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00653 2025-06-06 cs.LG cs.AI cs.CL 75%

Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models

Femi Bello, Anubrata Das, Fanzhi Zeng, Fangcong Yin, Liu Leqi

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00829 2025-06-04 cs.CL cs.AI cs.LG 75%

COMPKE: Complex Question Answering under Knowledge Editing

Keyuan Cheng, Zijian Kan, Zhixian He, Zhuoran Zhang, Muhammad Asif Ali, Ke Xu, Lijie Hu, Di Wang

机构 * Provable Responsible AI and Data Analytics (PRADA) Lab(可证明负责任的人工智能与数据分析实验室) King Abdullah University of Science and Technology(卡布斯大学) Peking University(北京大学) South China University of Technology(华南理工大学) Sun Yat-sen University(中山大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by ACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00088 2025-06-03 cs.CL cs.AI cs.LG 75%

HD-NDEs: Neural Differential Equations for Hallucination Detection in LLMs

Qing Li, Jiahui Geng, Zongxiong Chen, Derui Zhu, Yuxia Wang, Congbo Ma, Chenyang Lyu, Fakhri Karray

机构 * Mohamed bin Zayed University of Artificial Intelligence(莫扎德·本·泽亚德人工智能大学) Fraunhofer Institute for Open Communication Systems(弗劳恩霍夫开放通信系统研究所) Technical University of Munich(慕尼黑技术大学) New York University Abu Dhabi(纽约大学阿布扎克分校) Alibaba International Digital Commerce(阿里巴巴国际数字商业)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00082 2025-06-03 q-bio.GN cs.DB 75%

An AI-powered Knowledge Hub for Potato Functional Genomics

Jia Yuxin, Li Jinye, Jia Yudong, Li Futing, Su Xiaoqi, Luo Jilin, Dong Yarui, Sun Chunyan, Cui Qinghan, Wang Li, Li Axiu, Shang Yi, Zhu Yujuan, Huang Sanwen

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

Comments 11 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.03205 2025-06-03 cs.CL cs.AI cs.LG 75%

Anchored Answers: Unravelling Positional Bias in GPT-2's Multiple-Choice Questions

Ruizhe Li, Yanjun Gao

机构 * Department of Computing Science, University of Aberdeen, UK(阿伯丁大学计算机科学系) University of Colorado Anschutz Medical Campus, United States(科罗拉多大学安舒茨医学校区)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23960 2025-06-02 cs.LG cs.AI cs.CL 75%

Information Structure in Mappings: An Approach to Learning, Representation, and Generalisation

Henry Conklin

机构 * Henry Coxe Conklin(独立研究者)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments PhD Thesis, 204 pages; entropy estimation discussed from p.94

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22943 2025-05-30 cs.CL cs.AI cs.CV cs.LG cs.SD 75%

Can LLMs Deceive CLIP? Benchmarking Adversarial Compositionality of Pre-trained Multimodal Representation via Text Updates

Jaewoo Ahn, Heeseung Yun, Dayoon Ko, Gunhee Kim

机构 * Seoul National University(首尔国立大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ACL 2025 Main. Code is released at https://vision.snu.ac.kr/projects/mac

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17073 2025-05-26 cs.CL cs.AI cs.LG 75%

Mechanistic Interpretability of GPT-like Models on Summarization Tasks

Anurag Mishra

机构 * Rochester Institute of Technology(罗切斯特技术研究所)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 8 pages (6 content + 2 references/appendix), 6 figures, 2 tables; under review for the ACL 2025 Student Research Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01636 2025-05-22 cs.CL cs.AI cs.LG 75%

Lifelong Knowledge Editing requires Better Regularization

Akshat Gupta, Phudish Prateepamornkul, Maochuan Lu, Ahmed Alaa, Thomas Hartvigsen, Gopala Anumanchipalli

机构 * UC Berkeley(加州大学伯克利分校) SCB DataX(SCB数据科技) University of Virginia(弗吉尼亚大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14232 2025-05-21 cs.CV cs.AI cs.CL cs.LG 75%

CRCE: Coreference-Retention Concept Erasure in Text-to-Image Diffusion Models

Yuyang Xue, Edward Moroshko, Feng Chen, Jingyu Sun, Steven McDonagh, Sotirios A. Tsaftaris

机构 * School of Engineering University of Edinburgh(工程学院 苏格兰爱丁堡大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12826 2025-05-20 cs.CV 75%

Mitigating Hallucination in VideoLLMs via Temporal-Aware Activation Engineering

Jianfeng Cai, Wengang Zhou, Zongmeng Zhang, Jiale Hong, Nianji Zhan, Houqiang Li

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai Jiaotong University(上海交通大学) Merchants Union Consumer Finance Company Limited

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.09283 2025-05-15 cs.HC 75%

A Note on Semantic Diffusion

Alexander P. Ryjov, Alina A. Egorova

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

Comments 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.00153 2025-05-07 cs.CL cs.AI cs.LG 75%

Beyond Single Concept Vector: Modeling Concept Subspace in LLMs with Gaussian Distribution

Haiyan Zhao, Heng Zhao, Bo Shen, Ali Payani, Fan Yang, Mengnan Du

机构 * New Jersey Institute of Technology(新泽西理工学院) Wake Forest University(威克森林大学) Cisco Research(思科研究)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11114 2025-04-25 cs.CR 75%

JailbreakLens: Interpreting Jailbreak Mechanism in the Lens of Representation and Circuit

Zeqing He, Zhibo Wang, Zhixuan Chu, Huiyu Xu, Wenhui Zhang, Qinglong Wang, Rui Zheng

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

Comments 17 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13756 2025-04-21 cs.LG cs.AI cs.CL 75%

Scaling sparse feature circuit finding for in-context learning

Dmitrii Kharlapenko, Stepan Shabalin, Fazl Barez, Arthur Conmy, Neel Nanda

机构 * University of Oxford, UK(牛津大学) ETH Zurich, Switzerland(苏黎世联邦理工学院) Georgia Institute of Technology, US(佐治亚理工学院)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏