arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7552 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7552 篇

2509.15667 2025-09-22 cs.CL cs.SD eess.AS 77%

VOX-KRIKRI: Unifying Speech and Language through Continuous Fusion

Dimitrios Damianos, Leon Voukoutis, Georgios Paraskevopoulos, Vassilis Katsouros

机构 * Institute for Speech and Language Processing, Athena Research Center, Greece(语音与语言处理研究所,亚特兰蒂斯研究中心,希腊)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12661 2025-09-17 cs.CL 77%

Mitigating Strategy Preference Bias in Emotional Support Conversation via Uncertainty Estimations

Yougen Zhou, Qin Chen, Ningning Zhou, Jie Zhou, Xingjiao Wu, Liang He

机构 * Shanghai Institute of Artificial Intelligence for Education(上海人工智能教育研究院) School of Computer Science and Technology(计算机科学与技术学院) School of Psychology and Cognitive Science(心理学与认知科学学院) School of Pharmacy(药学院)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11369 2025-09-16 cs.LG 77%

Decoding Musical Origins: Distinguishing Human and AI Composers

Cheng-Yang Tsai, Tzu-Wei Huang, Shao-Yu Wei, Guan-Wei Chen, Hung-Ying Chu, Yu-Cheng Lin

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10875 2025-09-16 cs.AI cond-mat.soft 77%

Is the `Agent' Paradigm a Limiting Framework for Next-Generation Intelligent Systems?

Jesse Gardner, Vladimir A. Baulin

机构 * Active Inference Institute(主动推断研究所)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07190 2025-09-10 cs.CL cs.HC 77%

Rule-Based Moral Principles for Explaining Uncertainty in Natural Language Generation

Zahra Atf, Peter R Lewis

机构 * Faculty of Business and Information Technology(商业与信息技术学院) Ontario Tech University(安大略技术大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments This paper was accepted for presentation at the 35th IEEE International Conference on Collaborative Advances in Software and Computing. Conference website:https://conf.researchr.org/home/cascon-2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00328 2025-09-03 cs.RO cs.LG 77%

Mechanistic interpretability for steering vision-language-action models

Bear Häon, Kaylene Stocking, Ian Chuang, Claire Tomlin

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.LG

Comments CoRL 2025. Project website: https://vla-mech-interp.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.04648 2025-09-03 cs.GR cs.CL cs.CV 77%

FlairGPT: Repurposing LLMs for Interior Designs

Gabrielle Littlefair, Niladri Shekhar Dutt, Niloy J. Mitra

机构 * University College London(伦敦大学学院) Adobe Research(Adobe研究院)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments EUROGRAPHICS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21238 2025-09-01 cs.AI 77%

Addressing accuracy and hallucination of LLMs in Alzheimer's disease research through knowledge graphs

Tingxuan Xu, Jiarui Feng, Justin Melendez, Kaleigh Roberts, Donghong Cai, Mingfang Zhu, Donald Elbert, Yixin Chen, Randall J. Bateman

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20578 2025-08-29 cs.AI cs.CR 77%

Human-AI Collaborative Bot Detection in MMORPGs

Jaeman Son, Hyunsoo Kim

机构 * NCSOFT

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12964 2025-08-26 cs.CL 77%

Trust Me, I'm Wrong: LLMs Hallucinate with Certainty Despite Knowing the Answer

Adi Simhi, Itay Itzhak, Fazl Barez, Gabriel Stanovsky, Yonatan Belinkov

机构 * Technion – Israel Institute of Technology(技术ion-以色列理工学院) University of Oxford and WhiteBox(牛津大学和WhiteBox) School of Computer Science and Engineering, The Hebrew University of Jerusalem(耶路撒冷希伯来大学计算机科学与工程学院)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17735 2025-08-26 cs.CL 77%

SMITE: Enhancing Fairness in LLMs through Optimal In-Context Example Selection via Dynamic Validation

Garima Chhikara, Kripabandhu Ghosh, Abhijnan Chakraborty

机构 * Indian Institute of Technology Delhi, India(印度德里理工学院) Delhi Technological University, India(德里技术大学) Indian Institute of Science Education and Research Kolkata, India(印度科学教育与研究学院科希拉分校) Indian Institute of Technology Kharagpur, India(印度理工学院哈里科格分校)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16252 2025-08-19 cs.CL 77%

NormXLogit: The Head-on-Top Never Lies

Sina Abbasi, Mohammad Reza Modarres, Mohammad Taher Pilehvar

机构 * Tehran Institute for Advanced Studies, Khatam University, Iran(泰赫兰高级研究院,卡坦大学,伊朗) Cardiff University(卡迪夫大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Added comparisons on computational efficiency, included experiments on a new dataset with an additional evaluation metric for classification tasks, expanded explanations and discussions in the experiments, and presented a worked example for alignment metrics computation

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11933 2025-08-19 cs.CL 77%

CAMF: Collaborative Adversarial Multi-agent Framework for Machine Generated Text Detection

Yue Wang, Liesheng Wei, Yuxiang Wang

机构 * Stanford University(斯坦福大学) College of Information Technology(信息科技学院) School of Business(商学院)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09363 2025-08-14 cs.LG 77%

Resurrecting the Salmon: Rethinking Mechanistic Interpretability with Domain-Specific Sparse Autoencoders

Charles O'Neill, Mudith Jayasekara, Max Kirkby

机构 * Parsed, London, UK(伦敦大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08228 2025-08-12 cs.GR cs.AI 77%

LL3M: Large Language 3D Modelers

Sining Lu, Guan Chen, Nam Anh Dinh, Itai Lang, Ari Holtzman, Rana Hanocka

机构 * University of Chicago(芝加哥大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Our project page is at https://threedle.github.io/ll3m

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04530 2025-08-08 cs.CL 77%

Balancing Stylization and Truth via Disentangled Representation Steering

Chenglei Shen, Zhongxiang Sun, Teng Shi, Xiao Zhang, Jun Xu

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学 Gallagher人工智能学院)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23736 2025-08-01 stat.ML cs.LG 77%

DICOM De-Identification via Hybrid AI and Rule-Based Framework for Scalable, Uncertainty-Aware Redaction

Kyle Naddeo, Nikolas Koutsoubis, Rahul Krish, Ghulam Rasool, Nidhal Bouaynaya, Tony OSullivan, Raj Krish

机构 * Rowan University(罗文大学) Moffitt Cancer Center(莫菲特癌症中心) University of South Florida(佛罗里达州立大学) Impact Business Information Solutions, Inc(Impact商务信息解决方案公司)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments 15 pages, 6 figures,

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08450 2025-07-31 cs.CL 77%

IterKey: Iterative Keyword Generation with LLMs for Enhanced Retrieval Augmented Generation

Kazuki Hayashi, Hidetaka Kamigaito, Shinya Kouda, Taro Watanabe

机构 * Nara Institute of Science and Technology(奈良科学技術研究所) TDSE Inc.(TDSE公司)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21406 2025-07-30 cs.AI 77%

Shapley Uncertainty in Natural Language Generation

Meilin Zhu, Gaojie Jin, Xiaowei Huang, Lijun Zhang

机构 * University of Exeter(埃克塞特大学) University of Liverpool(利物浦大学) ISCAS(国际信息科学协会)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21141 2025-07-30 cs.AI 77%

The Geometry of Harmfulness in LLMs through Subconcept Probing

McNair Shah, Saleena Angeline, Adhitya Rajendra Kumar, Naitik Chheda, Kevin Zhu, Vasu Sharma, Sean O'Brien, Will Cai

机构 * Algoverse AI Research(Algoverse AI研究院) Berkeley(伯克利大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09389 2025-07-15 cs.AI cs.CY cs.IR 77%

Knowledge Conceptualization Impacts RAG Efficacy

Chris Davis Jaldi, Anmol Saini, Elham Ghiasi, O. Divine Eziolise, Cogan Shimizu

机构 * Wright State University(怀特州立大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.06949 2025-07-09 cs.SE cs.CL 77%

Towards Exception Safety Code Generation with Intermediate Representation Agents Framework

Xuanming Zhang, Yuxuan Chen, Yuan Yuan, Minlie Huang

机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校) Stanford University(斯坦福大学) Tsinghua University(清华大学) Beihang University(北航大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03998 2025-07-08 cs.AI 77%

Toward Better Generalisation in Uncertainty Estimators: Leveraging Data-Agnostic Features

Thuy An Ha, Bao Quoc Vo

机构 * Swinburne University of Technology(斯威本理工大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01594 2025-07-03 cs.CL 77%

Emotionally Intelligent Task-oriented Dialogue Systems: Architecture, Representation, and Optimisation

Shutong Feng, Hsien-chin Lin, Nurul Lubis, Carel van Niekerk, Michael Heck, Benjamin Ruppik, Renato Vukovic, Milica Gašić

机构 * Heinrich Heine University Düsseldorf(海因里希·海因大学杜塞尔多夫)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments 19 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20471 2025-06-26 cs.CL 77%

Probing AI Safety with Source Code

Ujwal Narayan, Shreyas Chaudhari, Ashwin Kalyan, Tanmay Rajpurohit, Karthik Narasimhan, Ameet Deshpande, Vishvak Murahari

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17864 2025-06-24 cs.CL 77%

QueueEDIT: Structural Self-Correction for Sequential Model Editing in LLMs

Taolin Zhang, Haidong Kang, Dongyang Li, Qizhou Chen, Chengyu Wang Xiaofeng He, Richang Hong

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.02397 2025-06-23 cs.CL 77%

Learning to Refine with Fine-Grained Natural Language Feedback

Manya Wadhwa, Xinyu Zhao, Junyi Jessy Li, Greg Durrett

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Code and models available at: https://github.com/ManyaWadhwa/DCR; Findings of EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11714 2025-06-19 cs.RO cs.AI 77%

Semantic-Geometric-Physical-Driven Robot Manipulation Skill Transfer via Skill Library and Tactile Representation

Mingchao Qi, Yuanjin Li, Xing Liu, Zhengxiong Liu, Panfeng Huang

机构 * Research Center for Intelligent Robotics, School of Astronautics, Northwestern Polytechnical University(智能机器人研究中心,航天学院,西北工业大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13978 2025-06-18 cs.CL 77%

AI shares emotion with humans across languages and cultures

Xiuwen Wu, Hao Wang, Zhiang Yan, Xiaohan Tang, Pengfei Xu, Wai-Ting Siok, Ping Li, Jia-Hong Gao, Bingjiang Lyu, Lang Qin

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12152 2025-06-17 cs.AI 77%

Because we have LLMs, we Can and Should Pursue Agentic Interpretability

Been Kim, John Hewitt, Neel Nanda, Noah Fiedel, Oyvind Tafjord

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏