arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

共收录 1732 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 幻觉与事实性 1732 篇

2507.22915 2025-08-01 cs.CL cs.AI 62%

Theoretical Foundations and Mitigation of Hallucination in Large Language Models

Esmail Gumaan

机构 * Department of Computer Science, University of Sana'a(桑加大学计算机科学系)

专题命中 幻觉与事实性 :alignment(abstract);分类 cs.CL、cs.AI

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14239 2025-07-22 cs.CL cs.AI 62%

CCL-XCoT: An Efficient Cross-Lingual Knowledge Transfer Method for Mitigating Hallucination Generation

Weihua Zheng, Roy Ka-Wei Lee, Zhengyuan Liu, Kui Wu, AiTi Aw, Bowei Zou

机构 * Institute for Infocomm Research (I 2 R), A*STAR, Singapore(信息与通信研究机构(I2R),A*STAR,新加坡)

专题命中 幻觉与事实性 :alignment(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.16215 2025-07-22 cs.AI cs.LG eess.SP 62%

Smarter Together: Combining Large Language Models and Small Models for Physiological Signals Visual Inspection

Huayu Li, Zhengxiao He, Xiwen Chen, Ci Zhang, Stuart F. Quan, William D. S. Killgore, Shu-Fen Wung, Chen X. Chen, Geng Yuan, Jin Lu, Ao Li

机构 * Department of Electrical and Computer Engineering, University of Arizona(电气与计算机工程系,亚利桑那大学) School of Computing, Clemson University(计算学院,克莱姆斯大学) School of Computing, University of Georgia(计算学院,佐治亚大学) Department of Medicine, University of Arizona(医学系,亚利桑那大学) Harvard Medical School and Brigham and Women’s Hospital(哈佛医学院和布里洛妇女医院) Department of Psychiatry, University of Arizona(精神病学系,亚利桑那大学) BIO5 Institute, University of Arizona(BIO5研究所,亚利桑那大学) College of Nursing, University of Arizona(护理学院,亚利桑那大学)

专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13411 2025-07-21 cs.CL cs.AI 62%

Aligning Knowledge Graphs and Language Models for Factual Accuracy

Nur A Zarin Nishat, Andrea Coletta, Luigi Bellomarini, Kossi Amouzouvi, Jens Lehmann, Sahar Vahdati

机构 * TIB – Leibniz Information Centre for Science and Technology(莱比锡信息科学与技术研究中心) Amazon, Germany(亚马逊公司)

专题命中 幻觉与事实性 :alignment(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09477 2025-07-17 cs.CL cs.AI 62%

Towards Agentic RAG with Deep Reasoning: A Survey of RAG-Reasoning Systems in LLMs

Yangning Li, Weizhi Zhang, Yuyao Yang, Wei-Chieh Huang, Yaozu Wu, Junyu Luo, Yuanchen Bei, Henry Peng Zou, Xiao Luo, Yusheng Zhao, Chunkit Chan, Yankai Chen, Zhongfen Deng, Yinghui Li, Hai-Tao Zheng, Dongyuan Li, Renhe Jiang, Ming Zhang, Yangqiu Song, Philip S. Yu

专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.CL、cs.AI

Comments submitted to ARR May

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10586 2025-07-16 cs.CL cs.AI 62%

AutoRAG-LoRA: Hallucination-Triggered Knowledge Retuning via Lightweight Adapters

Kaushik Dwivedi, Padmanabh Patanjali Mishra

机构 * BITS Pilani(比斯·皮兰大学) University of Adelaide(阿德莱德大学)

专题命中 幻觉与事实性 :alignment(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06893 2025-07-10 cs.CL cs.AI 62%

Developing and Maintaining an Open-Source Repository of AI Evaluations: Challenges and Insights

Alexandra Abbas, Celia Waggoner, Justin Olive

专题命中 幻觉与事实性 :safety(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04893 2025-07-08 cs.AI cs.CL cs.MA 62%

MARBLE: A Multi-Agent Rule-Based LLM Reasoning Engine for Accident Severity Prediction

Kaleem Ullah Qasim, Jiashu Zhang

机构 * School of Computing and Artificial Intelligence, Southwest Jiaotong University(计算机与人工智能学院,西南交通大学)

专题命中 幻觉与事实性 :safety(abstract);分类 cs.CL、cs.AI

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02595 2025-07-04 cs.CL cs.AI 62%

MPF: Aligning and Debiasing Language Models post Deployment via Multi Perspective Fusion

Xin Guan, PeiHsin Lin, Zekun Wu, Ze Wang, Ruibo Zhang, Emre Kazim, Adriano Koshiyama

机构 * University College London(伦敦大学学院) Center for long-term AI(长期人工智能中心)

专题命中 幻觉与事实性 :alignment(abstract);分类 cs.CL、cs.AI

Comments Accepted at ICML 2025 AIW Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00003 2025-07-02 cs.LG cs.AI cs.CR cs.NI 62%

Deciding When Not to Decide: Indeterminacy-Aware Intrusion Detection with NeutroSENSE

Eyhab Al-Masri

专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17296 2025-06-24 cs.CL cs.AI 62%

Semantic uncertainty in advanced decoding methods for LLM generation

Darius Foodeei, Simin Fan, Martin Jaggi

机构 * EPFL, Lausanne Switzerland(日内瓦联邦理工学院)

专题命中 幻觉与事实性 :alignment(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18242 2025-06-17 cs.CL cs.AI 62%

ShED-HD: A Shannon Entropy Distribution Framework for Lightweight Hallucination Detection on Edge Devices

Aneesh Vathul, Daniel Lee, Sheryl Chen, Arthi Tasmia

机构 * Stanford University(斯坦福大学)

专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11073 2025-06-16 cs.CL cs.AI cs.CV 62%

CLAIM: Mitigating Multilingual Object Hallucination in Large Vision-Language Models with Cross-Lingual Attention Intervention

Zekai Ye, Qiming Li, Xiaocheng Feng, Libo Qin, Yichong Huang, Baohang Li, Kui Jiang, Yang Xiang, Zhirui Zhang, Yunfei Lu, Duyu Tang, Dandan Tu, Bing Qin

机构 * Harbin Institute of Technology(哈尔滨工业大学) Peng Cheng Laboratory(鹏城实验室) Central South University(中南大学) Huawei Technologies Co., Ltd(华为技术有限公司)

专题命中 幻觉与事实性 :alignment(abstract);分类 cs.CL、cs.AI

Comments ACL2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07184 2025-06-10 cs.AI cs.CL cs.CV 62%

Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images

Liangliang You, Junchi Yao, Shu Yang, Guimin Hu, Lijie Hu, Di Wang

机构 * Provable Responsible AI and Data Analytics (PRADA) Lab(可证明负责任的人工智能与数据分析实验室) King Abdullah University of Science and Technology(国王阿卜杜勒阿齐兹大学) University of Electronic Science and Technology of China(中国电子科学技术大学) University of Copenhagen(哥本哈根大学)

专题命中 幻觉与事实性 :alignment(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14309 2025-06-05 cs.CL cs.AI 62%

LoGU: Long-form Generation with Uncertainty Expressions

Ruihan Yang, Caiqi Zhang, Zhisong Zhang, Xinting Huang, Sen Yang, Nigel Collier, Dong Yu, Deqing Yang

机构 * Fudan University(复旦大学) University of Cambridge(剑桥大学) Tencent AI Lab(腾讯AI实验室) The Chinese University of Hong Kong(香港中文大学)

专题命中 幻觉与事实性 :DPO(abstract);分类 cs.CL、cs.AI

Comments ACL 2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02863 2025-05-27 cs.CL cs.LG 62%

SteerConf: Steering LLMs for Confidence Elicitation

Ziang Zhou, Tianyuan Jin, Jieming Shi, Qing Li

专题命中 幻觉与事实性 :alignment(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07437 2025-05-13 cs.LG cs.AI cs.DB 62%

LEAD: Iterative Data Selection for Efficient LLM Instruction Tuning

Xiaotian Lin, Yanlin Qi, Yizhang Zhu, Themis Palpanas, Chengliang Chai, Nan Tang, Yuyu Luo

机构 * HKUST (GZ)(香港科技大学(广州)) Université Paris Cité(巴黎Cité大学) BIT(北京理工大学)

专题命中 幻觉与事实性 :alignment(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.06680 2025-05-13 cs.AI cs.HC cs.LG cs.SY eess.SY physics.soc-ph 62%

A Survey on Data-Driven Modeling of Human Drivers' Lane-Changing Decisions

Linxuan Huang, Dong-Fan Xie, Li Li, Zhengbing He

机构 * School of Systems Science, Beijing Jiaotong University(北京交通大学系统科学学院) Department of Automation, BNRist, Tsinghua University(清华大学自动化系) Laboratory for Information and Decision Systems, Massachusetts Institute of Technology(麻省理工学院信息与决策系统实验室)

专题命中 幻觉与事实性 :safety(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04651 2025-05-09 cs.CL cs.LG 62%

Scientific Hypothesis Generation and Validation: Methods, Datasets, and Future Directions

Adithya Kulkarni, Fatimah Alotaibi, Xinyue Zeng, Longfeng Wu, Tong Zeng, Barry Menglong Yao, Minqian Liu, Shuaicheng Zhang, Lifu Huang, Dawei Zhou

机构 * Virginia Tech(弗吉尼亚理工大学) University of California, Davis(加州大学戴维斯分校)

专题命中 幻觉与事实性 :alignment(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02874 2025-05-07 cs.LG cs.AI 62%

Uncertainty Quantification for Machine Learning in Healthcare: A Survey

L. Julián Lechuga López, Shaza Elsharief, Dhiyaa Al Jorf, Firas Darwish, Congbo Ma, Farah E. Shamout

机构 * New York University(纽约大学) New York University Abu Dhabi(纽约大学阿布扎赫尔分校)

专题命中 幻觉与事实性 :safety(abstract);分类 cs.AI、cs.LG

Comments 46 pages, 3 figures, 2 tables, AHLI Conference on Health, Inference, and Learning (CHIL)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00917 2025-05-05 stat.ME cs.AI cs.LG stat.ML 62%

Multivariate Conformal Selection

Tian Bai, Yue Zhao, Xiang Yu, Archer Y. Yang

专题命中 幻觉与事实性 :alignment(abstract);分类 cs.AI、cs.LG

Comments 25 pages, 4 figures. Accepted to ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00557 2025-05-02 cs.CL cs.AI 62%

Triggering Hallucinations in LLMs: A Quantitative Study of Prompt-Induced Hallucination in Large Language Models

Makoto Sato

专题命中 幻觉与事实性 :alignment(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09527 2025-04-23 cs.LG cs.CL 62%

Confidence Estimation for Error Detection in Text-to-SQL Systems

Oleg Somov, Elena Tutubalina

专题命中 幻觉与事实性 :alignment(abstract);分类 cs.CL、cs.LG

Comments 15 pages, 11 figures, to be published in AAAI 2025 Proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11986 2025-04-22 cs.CL cs.AI 62%

Large Language Models as Quasi-crystals: Coherence Without Repetition in Generative Text

Jose Manuel Guevara-Vela

机构 * School of Engineering and Physical Sciences, Heriot-Watt University(工程与物理科学学院,赫瑞斯泰大学)

专题命中 幻觉与事实性 :alignment(abstract);分类 cs.CL、cs.AI

Comments The discussion was restructured to add limitations to the analogy and other clarifications

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13644 2025-04-21 cs.AI cs.CL 62%

Exploring the Potential for Large Language Models to Demonstrate Rational Probabilistic Beliefs

Gabriel Freedman, Francesca Toni

机构 * Department of Computing, Imperial College London, UK(计算系,帝国理工学院伦敦分校)

专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.CL、cs.AI

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20826 2025-04-16 cs.CV cs.CL cs.LG eess.IV 62%

Exploring CLIP's Dense Knowledge for Weakly Supervised Semantic Segmentation

Zhiwei Yang, Yucong Meng, Kexue Fu, Feilong Tang, Shuo Wang, Zhijian Song

专题命中 幻觉与事实性 :alignment(abstract);分类 cs.CL、cs.LG

Comments CVPR2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.06465 2025-04-11 cs.CL cs.AI 62%

MedCT: A Clinical Terminology Graph for Generative AI Applications in Healthcare

Ye Chen, Dongdong Huang, Haoyun Xu, Cong Fu, Lin Sheng, Qingli Zhou, Yuqiang Shen, Kai Wang

专题命中 幻觉与事实性 :safety(abstract);分类 cs.CL、cs.AI

Comments Accepted into ICCS 2025 and published in Springer's LNCS Series

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13622 2025-04-09 cs.CL cs.AI 62%

REFIND at SemEval-2025 Task 3: Retrieval-Augmented Factuality Hallucination Detection in Large Language Models

DongGeon Lee, Hwanjo Yu

专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.CL、cs.AI

Comments Accepted to SemEval@ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03640 2025-04-07 cs.CL cs.AI cs.CV 62%

Bonsai: Interpretable Tree-Adaptive Grounded Reasoning

Kate Sanders, Benjamin Van Durme

专题命中 幻觉与事实性 :alignment(abstract);分类 cs.CL、cs.AI

Comments 9 pages, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03211 2025-04-07 cs.LG cs.AI cs.GT econ.TH 62%

Persuasive Calibration

Yiding Feng, Wei Tang

专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏