arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7552 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7552 篇

2503.08688 2025-04-10 cs.CY 75%

Randomness, Not Representation: The Unreliability of Evaluating Cultural Alignment in LLMs

Ariba Khan, Stephen Casper, Dylan Hadfield-Menell

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02144 2025-04-04 cs.LG cs.AI cs.CL stat.ML 75%

Towards Interpretable Soft Prompts

Oam Patel, Jason Wang, Nikhil Shivakumar Nayak, Suraj Srinivas, Himabindu Lakkaraju

专题命中 知识编辑与模型理解 :LLM(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 9 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17990 2025-03-25 cs.IR 75%

SUNAR: Semantic Uncertainty based Neighborhood Aware Retrieval for Complex QA

V Venktesh, Mandeep Rathee, Avishek Anand

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

Comments Accepted at NAACL 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15871 2025-03-21 cs.CV 75%

MASH-VLM: Mitigating Action-Scene Hallucination in Video-LLMs through Disentangled Spatial-Temporal Representations

Kyungho Bae, Jinhyung Kim, Sihaeng Lee, Soonyoung Lee, Gunhee Lee, Jinwoo Choi

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

Comments Accepted for CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15672 2025-03-21 cs.CV cs.RO 75%

GASP: Unifying Geometric and Semantic Self-Supervised Pre-training for Autonomous Driving

William Ljungbergh, Adam Lilja, Adam Tonderski. Arvid Laveno Ling, Carl Lindström, Willem Verbeke, Junsheng Fu, Christoffer Petersson, Lars Hammarstrand, Michael Felsberg

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04703 2025-03-18 cs.CL cs.AI cs.LG 75%

Transformers Struggle to Learn to Search

Abulhair Saparov, Srushti Pawar, Shreyas Pimpalgaonkar, Nitish Joshi, Richard Yuanzhe Pang, Vishakh Padmakumar, Seyed Mehran Kazemi, Najoung Kim, He He

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Published as a conference paper at ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.17148 2025-03-05 cs.CL cs.AI cs.LG 75%

AxBench: Steering LLMs? Even Simple Baselines Outperform Sparse Autoencoders

Zhengxuan Wu, Aryaman Arora, Atticus Geiger, Zheng Wang, Jing Huang, Dan Jurafsky, Christopher D. Manning, Christopher Potts

专题命中 知识编辑与模型理解 :language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.01405 2025-03-04 cs.LG cs.AI cs.CL cs.CV cs.CY 75%

Representation Engineering: A Top-Down Approach to AI Transparency

Andy Zou, Long Phan, Sarah Chen, James Campbell, Phillip Guo, Richard Ren, Alexander Pan, Xuwang Yin, Mantas Mazeika, Ann-Kathrin Dombrowski, Shashwat Goel, Nathaniel Li, Michael J. Byun, Zifan Wang, Alex Mallen, Steven Basart, Sanmi Koyejo, Dawn Song, Matt Fredrikson, J. Zico Kolter, Dan Hendrycks

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Code is available at https://github.com/andyzoujm/representation-engineering

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20698 2025-03-03 cs.CV 75%

Towards General Visual-Linguistic Face Forgery Detection(V2)

Ke Sun, Shen Chen, Taiping Yao, Ziyin Zhou, Jiayi Ji, Xiaoshuai Sun, Chia-Wen Lin, Rongrong Ji

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);prompting(abstract)

Comments 8 pages, 5 figures, Accpet by CVPR2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11779 2025-02-25 cs.CL cs.AI cs.CV cs.LG cs.MM 75%

MLLM can see? Dynamic Correction Decoding for Hallucination Mitigation

Chenxi Wang, Xiang Chen, Ningyu Zhang, Bozhong Tian, Haoming Xu, Shumin Deng, Huajun Chen

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15801 2025-02-25 cs.LG cs.AI cs.CL 75%

An explainable transformer circuit for compositional generalization

Cheng Tang, Brenden Lake, Mehrdad Jazayeri

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15677 2025-02-24 cs.CL cs.AI cs.LG 75%

FLEKE: Federated Locate-then-Edit Knowledge Editing

Zongkai Zhao, Guozeng Xu, Xiuhua Li, Kaiwen Wei, Jiang Zhong

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.06331 2025-02-04 cs.CL cs.AI cs.LG 75%

Locate-then-edit for Multi-hop Factual Recall under Knowledge Editing

Zhuoran Zhang, Yongxiang Li, Zijian Kan, Keyuan Cheng, Lijie Hu, Di Wang

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 24 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09475 2025-01-17 cs.SE 75%

Guided Debugging of Auto-Translated Code Using Differential Testing

Shengnan Wu, Xinyu Sun, Xin Wang, Yangfan Zhou

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.04947 2025-01-10 cs.CV 75%

Seeing with Partial Certainty: Conformal Prediction for Robotic Scene Recognition in Built Environments

Yifan Xu, Vineet Kamat, Carol Menassa

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

Comments 10 pages, 4 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15494 2024-12-23 cs.IR 75%

PolySmart and VIREO @ TRECVid 2024 Ad-hoc Video Search

Jiaxin Wu, Chong-Wah Ngo, Xiao-Yong Wei, Qing Li

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04936 2024-12-09 cs.CL cs.AI cs.LG 75%

Probing the contents of semantic representations from text, behavior, and brain data using the psychNorms metabase

Zak Hussain, Rui Mata, Ben R. Newell, Dirk U. Wulff

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 13 pages, 5 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16105 2024-12-06 cs.LG cs.AI cs.CL 75%

Adaptive Circuit Behavior and Generalization in Mechanistic Interpretability

Jatin Nainani, Sankaran Vaidyanathan, AJ Yeung, Kartik Gupta, David Jensen

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 10 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.08074 2024-12-03 cs.LG cs.AI cs.CL cs.CV 75%

A Concept-Based Explainability Framework for Large Multimodal Models

Jayneel Parekh, Pegah Khayatan, Mustafa Shukor, Alasdair Newson, Matthieu Cord

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.08359 2024-11-14 cs.CR 75%

MultiKG: Multi-Source Threat Intelligence Aggregation for High-Quality Knowledge Graph Representation of Attack Techniques

Jian Wang, Tiantian Zhu, Chunlin Xiong, Yan Chen

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

Comments 21 pages, 15 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05570 2024-11-05 cs.HC 75%

Conversate: Supporting Reflective Learning in Interview Practice Through Interactive Simulation and Dialogic Feedback

Taufiq Daryanto, Xiaohan Ding, Lance T. Wilhelm, Sophia Stil, Kirk McInnis Knutsen, Eugenia H. Rho

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03446 2024-10-23 cs.AI cs.CL cs.LG 75%

On Uncertainty In Natural Language Processing

Dennis Ulmer

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments PhD thesis

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05213 2024-10-21 cs.CL cs.AI cs.LG stat.ML 75%

On Subjective Uncertainty Quantification and Calibration in Natural Language Generation

Ziyu Wang, Chris Holmes

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.06024 2024-10-10 cs.LG cs.AI cs.CL cs.SC 75%

Jet Expansions of Residual Computation

Yihong Chen, Xiangxiang Xu, Yao Lu, Pontus Stenetorp, Luca Franceschi

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16484 2024-10-04 cs.RO 75%

BehAV: Behavioral Rule Guided Autonomy Using VLMs for Robot Navigation in Outdoor Scenes

Kasun Weerakoon, Mohamed Elnoor, Gershom Seneviratne, Vignesh Rajagopal, Senthil Hariharan Arul, Jing Liang, Mohamed Khalid M Jaffar, Dinesh Manocha

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.10122 2024-10-02 cs.CV 75%

Video-LLaVA: Learning United Visual Representation by Alignment Before Projection

Bin Lin, Yang Ye, Bin Zhu, Jiaxi Cui, Munan Ning, Peng Jin, Li Yuan

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14043 2024-09-24 cs.SD cs.CV eess.AS 75%

ECHO: Environmental Sound Classification with Hierarchical Ontology-guided Semi-Supervised Learning

Pranav Gupta, Raunak Sharma, Rashmi Kumari, Sri Krishna Aditya, Shwetank Choudhary, Sumit Kumar, Kanchana M, Thilagavathy R

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

Comments IEEE CONECCT 2024, Signal Processing and Pattern Recognition, Environmental Sound Classification, ESC

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.00737 2024-08-28 cs.CV 75%

LLM4GEN: Leveraging Semantic Representation of LLMs for Text-to-Image Generation

Mushui Liu, Yuhang Ma, Yang Zhen, Jun Dan, Yunlong Yu, Zeng Zhao, Zhipeng Hu, Bai Liu, Changjie Fan

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

Comments 11 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12276 2024-08-28 cs.IR 75%

Explain then Rank: Scale Calibration of Neural Rankers Using Natural Language Explanations from LLMs

Puxuan Yu, Daniel Cohen, Hemank Lamba, Joel Tetreault, Alex Jaimes

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.14236 2024-08-27 cs.CL cs.AI cs.LG 75%

DSTI at LLMs4OL 2024 Task A: Intrinsic versus extrinsic knowledge for type classification

Hanna Abi Akl

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 8 pages, 4 figures, accepted for the LLMs4OL challenge at the International Semantic Web Conference (ISWC) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏