arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7552 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7552 篇

2405.17703 2024-05-29 cs.LG cs.CL 79%

Mechanistic Interpretability of Binary and Ternary Transformers

Jason Li

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.15848 2024-04-29 cs.CL cs.LG 79%

Detecting Conceptual Abstraction in LLMs

Michaela Regneri, Alhassan Abdelhalim, Sören Laue

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Paper accepted at the LREC-COLING 2024 Conference (Paper ID: 1968) accepted-papers/" target="_blank" rel="noopener">https://lrec-coling-2024.org/list-of-accepted-papers/

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.10960 2024-04-18 cs.CL cs.AI 79%

Uncertainty-Based Abstention in LLMs Improves Safety and Reduces Hallucinations

Christian Tomani, Kamalika Chaudhuri, Ivan Evtimov, Daniel Cremers, Mark Ibrahim

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);RLHF(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.08170 2024-04-12 cs.LG cs.AI 79%

LLaGA: Large Language and Graph Assistant

Runjin Chen, Tong Zhao, Ajay Jaiswal, Neil Shah, Zhangyang Wang

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.09702 2024-04-09 cs.CL cs.AI 79%

Deceptive Semantic Shortcuts on Reasoning Chains: How Far Can Models Go without Hallucination?

Bangzheng Li, Ben Zhou, Fei Wang, Xingyu Fu, Dan Roth, Muhao Chen

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Work accepted by NAACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.19113 2024-03-29 cs.CL cs.AI 79%

FACTOID: FACtual enTailment fOr hallucInation Detection

Vipula Rawte, S. M Towhidul Islam Tonmoy, Krishnav Rajbangshi, Shravani Nag, Aman Chadha, Amit P. Sheth, Amitava Das

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.08851 2024-03-15 astro-ph.IM cs.CL cs.CV cs.IR cs.LG 79%

PAPERCLIP: Associating Astronomical Observations and Natural Language with Multi-Modal Models

Siddharth Mishra-Sharma, Yiding Song, Jesse Thaler

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.CL、cs.LG

Comments 17+6 pages, 3+1 figures, 5+2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.13641 2024-02-28 cs.CV cs.AI cs.CY cs.LG 79%

How Good is ChatGPT at Face Biometrics? A First Look into Recognition, Soft Biometrics, and Explainability

Ivan DeAndres-Tame, Ruben Tolosana, Ruben Vera-Rodriguez, Aythami Morales, Julian Fierrez, Javier Ortega-Garcia

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Journal ref IEEE Access, February 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.15631 2024-02-27 cs.CL cs.AI 79%

Fine-Grained Self-Endorsement Improves Factuality and Reasoning

Ante Wang, Linfeng Song, Baolin Peng, Ye Tian, Lifeng Jin, Haitao Mi, Jinsong Su, Dong Yu

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01769 2024-02-06 cs.CL cs.AI 79%

Redefining "Hallucination" in LLMs: Towards a psychology-informed framework for mitigating misinformation

Elijah Berberette, Jack Hutchins, Amir Sadovnik

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.17839 2024-02-01 cs.CL cs.AI cs.IR 79%

Global-Liar: Factuality of LLMs over Time and Geographic Regions

Shujaat Mirza, Bruno Coelho, Yuyuan Cui, Christina Pöpper, Damon McCoy

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 24 pages, 12 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.16577 2024-01-31 cs.CL cs.AI 79%

LLMs as On-demand Customizable Service

Souvika Sarkar, Mohammad Fakhruddin Babar, Monowar Hasan, Shubhra Kanti Karmaker

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.07110 2023-12-13 cs.CL cs.CR cs.LG 79%

LLMs Perform Poorly at Concept Extraction in Cyber-security Research Literature

Maxime Würsch, Andrei Kucharavy, Dimitri Percia David, Alain Mermoud

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 24 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.06647 2023-12-12 cs.CV cs.AI cs.LG 79%

4M: Massively Multimodal Masked Modeling

David Mizrahi, Roman Bachmann, Oğuzhan Fatih Kar, Teresa Yeo, Mingfei Gao, Afshin Dehghan, Amir Zamir

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.AI、cs.LG

Comments NeurIPS 2023 Spotlight. Project page at https://4m.epfl.ch/

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.05708 2023-12-12 cs.IR cs.AI cs.LG 79%

Context Tuning for Retrieval Augmented Generation

Raviteja Anantha, Tharun Bethi, Danil Vodianik, Srinivas Chappidi

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments preprint version

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.13230 2023-11-23 cs.CL cs.AI 79%

Enhancing Uncertainty-Based Hallucination Detection with Stronger Focus

Tianhang Zhang, Lin Qiu, Qipeng Guo, Cheng Deng, Yue Zhang, Zheng Zhang, Chenghu Zhou, Xinbing Wang, Luoyi Fu

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by EMNLP 2023 (main conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14928 2023-11-01 cs.CL cs.LG 79%

Towards Reliable Misinformation Mitigation: Generalization, Uncertainty, and GPT-4

Kellin Pelrine, Anne Imouza, Camille Thibault, Meilina Reksoprodjo, Caleb Gupta, Joel Christoph, Jean-François Godbout, Reihaneh Rabbany

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.10358 2023-10-17 cs.CL cs.AI 79%

Tabular Representation, Noisy Operators, and Impacts on Table Structure Understanding Tasks in LLMs

Ananya Singha, José Cambronero, Sumit Gulwani, Vu Le, Chris Parnin

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.01843 2022-09-16 cs.CV cs.AI cs.CL 79%

Visual Clues: Bridging Vision and Language Foundations for Image Paragraph Captioning

Yujia Xie, Luowei Zhou, Xiyang Dai, Lu Yuan, Nguyen Bach, Ce Liu, Michael Zeng

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.06462 2022-03-22 cs.LG cs.CL 79%

Low-Rank Softmax Can Have Unargmaxable Classes in Theory but Rarely in Practice

Andreas Grivas, Nikolay Bogoychev, Adam Lopez

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);small language model(abstract);分类 cs.CL、cs.LG

Comments Preprint of conference paper accepted at ACL 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02476 2025-10-08 cs.LG q-bio.QM 78%

Uncertainty-Guided Model Selection for Tabular Foundation Models in Biomolecule Efficacy Prediction

Jie Li, Andrew McCarthy, Zhizhuo Zhang, Stephen Young

机构 * AIML GSK

专题命中 知识编辑与模型理解 :foundation model(title,comments);分类 cs.LG;large language model(comments);language model(comments)

Comments Accepted by NeurIPS 2025 workshop: 2nd Workshop on Multi-modal Foundation Models and Large Language Models for Life Sciences

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03518 2025-09-04 cs.LG 78%

Can LLMs Lie? Investigation beyond Hallucination

Haoran Huan, Mihir Prabhudesai, Mengning Wu, Shantanu Jaiswal, Deepak Pathak

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 知识编辑与模型理解 :LLM(abstract,comments);large language model(abstract);language model(abstract);分类 cs.LG

Comments Website at https://llm-liar.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07122 2024-12-06 cs.CL 78%

SCAR: Sparse Conditioned Autoencoders for Concept Detection and Steering in LLMs

Ruben Härle, Felix Friedrich, Manuel Brack, Björn Deiseroth, Patrick Schramowski, Kristian Kersting

专题命中 知识编辑与模型理解 :language model(abstract,comments);LLM(abstract);large language model(abstract);分类 cs.CL

Comments Accepted at Socially Responsible Language Modelling Research (SoLaR) Workshop at NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18984 2026-08-20 cs.CV 新提交 78%

Uncertainty-Aware Art-Historical Dating with Vision-Language Models

基于视觉语言模型的不确定性感知艺术史年代测定

Stefanie Schneider, Peter Bell

机构 * Marburg University(马尔堡大学)

专题命中 知识编辑与模型理解 :language model(title,abstract)

AI总结 该研究针对艺术品年代测定中的时间纠缠问题,将其转化为不确定性感知回归任务,通过在Wikidata艺术品语料库上实验发现视觉语言模型(VLMs)在该任务上优于纯视觉自监督基线,但存在偏差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11474 2026-08-13 cs.CV 新提交 78%

Test-Time Hallucination Control in Large Vision-Language Models

大型视觉语言模型的测试时幻觉控制

Mehran Tamjidi, Hamidreza Dastmalchi, Ali Cheraghian, Mohammadreza Alimoradijazi, Aijun An, Hossein Rahmani

机构 * Australian National University(澳大利亚国立大学) The University of New South Wales(新南威尔士大学) University of Technology Sydney(悉尼科技大学) York University(约克大学) Lancaster University(兰卡斯特大学)

专题命中 知识编辑与模型理解 :language model(title,abstract)

AI总结 针对大型视觉语言模型的物体幻觉问题,提出无训练的测试时幻觉缓解(TTH)方法,通过令牌验证器模块等技术提升模型准确性与稳健性,通用性和实用性良好。

Comments Accepted at ECCV 2026 MUCG

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11024 2026-08-12 cs.CV 新提交 78%

When Visual Signals Mislead: A Mechanistic Study of Attribute Hallucination in Vision-Language Models

当视觉信号产生误导:视觉语言模型中属性幻觉的机制研究

Yufei Zhang, Chenlu Zhan, Hongwei Wang

机构 * Zhejiang University(浙江大学)

专题命中 知识编辑与模型理解 :language model(title,abstract)

AI总结 针对视觉语言模型的属性幻觉问题,提出VISOR框架,通过VSNR诊断区分失败模式并路由适配操作,在三类模型上减少属性假阳性且不依赖先验主导假设。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03730 2026-08-12 cs.CV 版本更新 78%

Beyond False Stability: High-Noise Drift Gating for Test-Time Adversarial Defenses in Vision-Language Models

超越虚假稳定性:面向视觉语言模型测试时对抗防御的高噪声漂移门控

Hashmat Shadab Malik, Muzammal Naseer, Salman Khan

机构 * Mohamed Bin Zayed University of AI, UAE(穆罕默德·本·扎耶德人工智能大学,阿联酋) Khalifa University, UAE(卡布斯大学,阿联酋) Australian National University, Australia(澳大利亚国立大学,澳大利亚)

专题命中 知识编辑与模型理解 :language model(title,abstract)

AI总结 针对视觉语言模型在测试时易受对抗攻击的问题,提出一种无训练、即插即用的高噪声漂移门控机制,通过检测高噪声下的特征不稳定性触发防御,改善了干净-鲁棒性权衡。

Journal ref The 37th British Machine Vision Conference (BMVC) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09427 2026-08-11 cs.CV 新提交 78%

Foundation Models are Implicit Deepfake Detectors

基础模型是隐式深度伪造检测器

Stefan Smeu, Dragos-Alexandru Boldisor, Elisabeta Oneata, Dan Oneata

机构 * AAAI Press(AAAI出版社)

专题命中 知识编辑与模型理解 :foundation model(title,abstract)

AI总结 该研究发现基础模型的特征幅度可区分真实与伪造媒体,将深度伪造检测建模为异常检测,简单统计指标即可达到竞争性能,且模型规模越大判别信号越强。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05945 2026-08-07 cs.CV 新提交 78%

Respect Your Zero-Shot Uncertainty: Conservative Calibration for Test-Time-Adapted Vision-Language Models

重视零样本不确定性:面向测试时自适应视觉-语言模型的保守校准

Jingyan Jiang, Yaru Sun, Xiao Chen, Jiazhen Huang, Caiting Li, Zhijian He, Yin Chen, Pingting Hao

专题命中 知识编辑与模型理解 :language model(title,abstract)

AI总结 针对测试时自适应(TTA)视觉-语言模型校准度下降的问题,提出零样本锚定熵校准(ZAEC)方法,通过最小温度缩放恢复锐化预测的零样本熵,在多模型多数据集上实现了更低的期望校准误差(ECE)。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05578 2026-08-07 cs.CR 新提交 78%

Detecting Safety Training Modification in Language Models via Activation Analysis

通过激活分析检测语言模型中的安全训练修改

Glen Messenger

专题命中 知识编辑与模型理解 :language model(title,abstract)

AI总结 本研究提出AMS工具,通过激活空间几何结构检测语言模型的安全训练修改,在14种模型配置上验证了其有效性,可区分四类安全训练修改中的前三者。

Journal ref IEEE Access, vol. 14, pp. 91723-91737, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏