arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

共收录 7978 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 7978 篇

2508.07690 2026-01-22 cs.CL cs.AI 62%

LoSemB: Logic-Guided Semantic Bridging for Inductive Tool Retrieval

LoSemB:基于逻辑的语义桥接用于归纳工具检索

Luyao Zhuang, Qinggang Zhang, Huachi Zhou, Yujing Zhang, Xiao Huang

机构 * The Hong Kong Polytechnic University(香港理工大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 LoSemB通过逻辑引导的语义桥接框架,在无需重新训练的情况下实现高效归纳工具检索,缓解分布偏移和相似度检索的脆弱性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12785 2026-01-21 cs.LG cs.AI 62%

Distilling Time Series Foundation Models for Efficient Forecasting

压缩时间序列基础模型以实现高效预测

Yuqi Li, Kuiye Ding, Chuanguang Yang, Szu-Yu Chen, Yingli Tian

机构 * The City College of New York, City University of New York, USA(纽约城市学院,纽约城市大学) Institute of Computing Technology, Chinese Academy of Sciences, China(中国科学院计算技术研究所) Stevens Institute of Technology, USA(史蒂文斯理工学院)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 DistilTS是一种专为时间序列基础模型设计的蒸馏框架,通过时间跨度加权目标和时间对齐策略,在减少参数量的同时保持预测性能。

Comments Accepted by ICASSP-2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12711 2026-01-21 cs.AI cs.LG cs.SC 62%

Neurosymbolic LoRA: Why and When to Tune Weights vs. Rewrite Prompts

神经符号LoRA:为何以及何时调整权重 versus 重写提示

Kevin Wang, Neel P. Bhatt, Cong Liu, Junbo Li, Runjin Chen, Yihan Xi, Timothy Barclay, Alvaro Velasquez, Ufuk Topcu, Zhangyang Wang

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 神经符号LoRA结合数值和符号更新,提升语言模型微调的适应性和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05178 2026-01-21 cs.LG cs.AI cs.SC 62%

Auditable Unit-Aware Thresholds in Symbolic Regression via Logistic-Gated Operators

可审计的单元感知阈值在通过逻辑门运算符进行的符号回归中

Ou Deng, Ruichen Cong, Jianting Xu, Shoji Nishimura, Atsushi Ogihara, Qun Jin

机构 * Faculty of Human Sciences, Waseda University(早稻田大学人类科学系) Graduate School of Human Sciences, Waseda University(早稻田大学人类科学研究院)

专题命中 其他安全 :safety(abstract);分类 cs.AI、cs.LG

AI总结 LGO通过逻辑门运算符实现符号回归,将阈值提升为单元感知参数,提高医疗领域模型的可审计性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11560 2026-01-21 cs.IR cs.AI cs.LG 62%

DeepEvidence: Empowering Biomedical Discovery with Deep Knowledge Graph Research

DeepEvidence: 通过深度知识图谱研究赋能生物医学发现

Zifeng Wang, Zheng Chen, Ziwei Yang, Xuan Wang, Qiao Jin, Yifan Peng, Zhiyong Lu, Jimeng Sun

机构 * Keiji AI Institute of Scientific and Industrial Research, Osaka University(大阪大学科学工业研究所) Bioinformatics Center, Institute for Chemical Research, Kyoto University(京都大学化学研究所生物信息中心) Division of Intramural Research, National Library of Medicine, National Institutes of Health(国家卫生研究院生物医学图书馆内部研究部) Department of Population Health Sciences, Weill Cornell Medicine(韦尔·科恩医学中心流行病学与健康科学系) School of Computing and Data Science, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校计算机与数据科学学院)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 DeepEvidence通过深度知识图谱研究框架,系统化地连接异构生物医学资源,提升科学发现的效率和证据综合能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11342 2026-01-19 cs.LG cs.CL 62%

Unlocking the Potentials of Retrieval-Augmented Generation for Diffusion Language Models

解锁检索增强生成在扩散语言模型中的潜力

Chuanyue Yu, Jiahui Wang, Yuhan Li, Heng Chang, Ge Lan, Qingyun Sun, Jia Li, Jianxin Li, Ziwei Zhang

机构 * Nankai University(南开大学) Beihang University(北航) HKUST (Guangzhou)(香港科技大学(广州)) Huawei Technologies Co., Ltd.(华为技术有限公司)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.LG

AI总结 本文提出SPREAD框架,通过引入查询相关性引导的去噪策略,解决DLMs在RAG框架中生成精度低和语义漂移的问题。

Comments Preprints

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15372 2026-01-16 cs.IR cs.AI cs.CV cs.LG cs.MM 62%

Image Complexity-Aware Adaptive Retrieval for Efficient Vision-Language Models

面向高效视觉-语言模型的图像复杂度感知自适应检索

Mikel Williams-Lekuona, Georgina Cosma

机构 * Computer Science, Loughborough University, Loughborough, UK(计算机科学,洛桑大学,洛桑,英国)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 ICAR通过自适应计算方法提升视觉-语言模型效率,实现高效图像-文本匹配与复杂度评估。

Comments Camera-ready version for ECIR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11311 2026-01-15 eess.IV cs.AI cs.CV cs.LG 62%

Large-scale modality-invariant foundation models for brain MRI analysis: Application to lesion segmentation

大规模模态不变基础模型用于脑MRI分析:应用于病变分割

Petros Koutsouvelis, Matej Gazda, Leroy Volmer, Sina Amirrajab, Kamil Barbierik, Branislav Setlak, Jakub Gazda, Peter Drotar

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种大规模模态不变基础模型,用于提升脑MRI中病变分割的性能,通过自监督学习预训练并保留细粒度模态特定特征。

Comments Submitted to IEEE ISBI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2006.08832 2026-01-15 eess.SY cs.AI cs.CY cs.SY 62%

A Taxonomy and Review of Algorithms for Modeling and Predicting Human Driver Behavior

自动驾驶中人类驾驶行为建模与预测算法的分类与综述

Raunak P. Bhattacharyya, Kyle Brown, Juanran Wang, Katherine Driggs-Campbell, Mykel J. Kochenderfer

专题命中 其他安全 :safety(abstract);分类 cs.AI、cs.CY

AI总结 本文对自动驾驶中人类驾驶行为建模与预测算法进行了分类和综述,统一了意图估计、特质估计和运动预测方法,并指出了该领域未来的研究方向。

Comments This revision has been accepted for publication in the Proceedings of the IEEE. The final version is available on IEEE Xplore

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08634 2026-01-14 cs.CL cs.AI 62%

Moral Lenses, Political Coordinates: Towards Ideological Positioning of Morally Conditioned LLMs

道德透镜,政治坐标:迈向道德条件化大语言模型的意识形态定位

Chenchen Yuan, Bolei Ma, Zheyu Zhang, Bardh Prenkaj, Frauke Kreuter, Gjergji Kasneci

机构 * Technical University of Munich(慕尼黑技术大学) LMU Munich(慕尼黑大学) Munich Center for Machine Learning(慕尼黑机器学习中心)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 本研究通过道德条件化大语言模型,探索道德价值观与政治倾向之间的因果关系,揭示道德取向对政治坐标的影响,并提出更社会化的对齐方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08169 2026-01-14 cs.CL cs.LG 62%

Relational Knowledge Distillation Using Fine-tuned Function Vectors

基于微调函数向量的关系知识蒸馏

Andrea Kang, Yingnian Wu, Hongjing Lu

机构 * University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.LG

AI总结 通过微调函数向量提升关系知识表示,增强语言模型的类比推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08079 2026-01-14 cs.AI cs.CL cs.IR 62%

MemoBrain: Executive Memory as an Agentic Brain for Reasoning

MemoBrain: 作为推理代理的执行记忆脑

Hongjin Qian, Zhao Cao, Zheng Liu

机构 * Beijing Academy of Artificial Intelligence(北京人工智能研究院) Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 MemoBrain通过构建依赖感知的记忆模型,实现对长周期推理轨迹的显式认知控制,提升工具增强代理的推理连贯性和任务对齐性。

Comments Our codes are in https://github.com/qhjqhj00/MemoBrain

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07892 2026-01-14 cs.LG cs.AI 62%

Sherry: Hardware-Efficient 1.25-Bit Ternary Quantization via Fine-grained Sparsification

Sherry:通过细粒度稀疏化实现高效的1.25位三元量化

Hong Huang, Decheng Wu, Qiangqiang Hu, Guanghua Yu, Jinhai Yang, Jianchen Zhu, Xue Liu, Dapeng Wu

机构 * City University of Hong Kong(香港城市大学) Tencent(腾讯) McGill University(麦吉尔大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 Sherry通过细粒度稀疏化实现高效的1.25位三元量化,显著减少模型大小并提升推理速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04954 2026-01-14 cs.LG cs.AI 62%

Precision over Diversity: High-Precision Reward Generalizes to Robust Instruction Following

精确性胜过多样性:高精度奖励能泛化到稳健的指令跟随

Yirong Zeng, Yufei Liu, Xiao Ding, Yutai Hou, Yuxian Wang, Haonan Song, Wu Ning, Dandan Tu, Qixun Zhang, Bibo Cai, Yuxiang He, Ting Liu

机构 * Harbin Institute of Technology, SCIR(哈尔滨工业大学,SCIR) Peking University(北京大学) Huawei Technologies Co., Ltd(华为技术有限公司)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 本研究发现高精度奖励优于多样化的约束混合,提出数据导向的优化策略,提升指令跟随性能并减少训练时间。

Comments Under review, 13 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04948 2026-01-14 cs.CL cs.AI 62%

KaLM: Knowledge-aligned Autoregressive Language Modeling via Dual-view Knowledge Graph Contrastive Learning

KaLM: 通过双视角知识图谱对比学习实现知识对齐的自回归语言模型

Peng Yu, Cheng Deng, Beiya Dai, Xinbing Wang, Ying Wen

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 KaLM通过双视角知识图谱对比学习和三元组完成语言模型,实现LLMs与知识图谱的对齐,提升知识驱动任务的性能。

Comments The article has been accepted by Frontiers of Computer Science (FCS), with the DOI: {10.1007/s11704-026-50906-6}

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06875 2026-01-13 cs.AI cs.CL 62%

An Ubuntu-Guided Large Language Model Framework for Cognitive Behavioral Mental Health Dialogue

以Ubuntu为指导的认知行为大型语言模型框架用于认知行为心理健康对话

Sontaga G. Forane, Absalom E. Ezugwu, Kevin Igwe, Karen van den Berg

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 本文提出一种结合Ubuntu哲学与认知行为疗法的AI心理健康对话系统,旨在提升非洲语境下的文化敏感性和治疗效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06061 2026-01-13 cs.CY cs.AI 62%

AI Application Operations -- A Socio-Technical Framework for Data-driven Organizations

AI应用操作——数据驱动组织的社会技术框架

Daniel Jönsson, Mattias Tiger, Stefan Ekberg, Daniel Jakobsson, Mattias Jonhede, Fredrik Viksten

机构 * Linköping University(林海普大学) AI Sweden(AI瑞典) Swedish Transport Administration(瑞典交通管理局) Volvo Group(沃尔沃集团)

专题命中 其他安全 :safety(abstract);分类 cs.AI、cs.CY

AI总结 本文提出了一种社会技术框架,用于指导数据驱动组织从想法到生产的AI应用操作,强调持续监控和反馈机制以实现持续改进和价值实现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12704 2026-01-13 cs.CL cs.AI 62%

Flexible Realignment of Language Models

语言模型的灵活重校准

Wenhong Zhu, Ruobing Xie, Weinan Zhang, Rui Wang

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) Large Language Department, Tencent(腾讯大语言部门)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 本文提出灵活的重校准框架,通过训练和推理时的可控对齐方法,提升语言模型的性能和适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06472 2026-01-13 cs.CL cs.AI cs.CE cs.DL 62%

KARMA: Leveraging Multi-Agent LLMs for Automated Knowledge Graph Enrichment

KARMA:利用多智能体大语言模型实现知识图谱的自动化丰富

Yuxing Lu, Wei Wu, Xukai Zhao, Rui Peng, Jinzhuo Wang

机构 * Department of Big Data and Biomedical AI, Peking University(北京大学大数据与生物医学人工智能系) Wallace H. Coulter Department of Biomedical Engineering, Georgia Institute of Technology(佐治亚理工学院生物医学工程系) School of Architecture, Tsinghua University(清华大学建筑学院)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 KARMA通过多智能体大语言模型自动丰富知识图谱,有效识别新实体并提高正确性与一致性

Comments 24 pages, 3 figures, 2 tables

Journal ref Spotlight paper of NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05666 2026-01-12 cs.HC cs.AI cs.CY 62%

Advancing credit mobility through stakeholder-informed AI design and adoption

通过利益相关者导向的AI设计与采用推进信用流动性

Yerin Kwak, Siddharth Adelkar, Zachary A. Pardos

机构 * Berkeley School of Education, University of California, Berkeley, CA(伯克利教育学院,加州大学伯克利分校)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.CY

AI总结 本研究通过与纽约州立大学系统合作,利用AI提出课程衔接建议,提升学生学分流动性,减少人工审查成本,提高衔接效率。

Comments 17 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05459 2026-01-12 cs.CL cs.AI 62%

Do LLMs Need Inherent Reasoning Before Reinforcement Learning? A Study in Korean Self-Correction

LLMs是否需要在强化学习前具备内在推理能力?韩国自我修正研究

Hongjin Kim, Jaewook Lee, Kiyoung Lee, Jong-hun Shin, Soojong Lim, Oh-Woog Kwon

机构 * ETRI

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 本研究探讨LLMs在强化学习前是否需要具备内在推理能力,通过韩国自我修正研究发现,对齐模型内部推理与韩语输入关键,提升多语言推理效果。

Comments IJCNLP-AACL 2025 (Main), Outstanding Paper Award

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00970 2026-01-12 cs.CY cs.AI 62%

AI-Educational Development Loop (AI-EDL): A Conceptual Framework to Bridge AI Capabilities with Classical Educational Theories

AI教育发展循环(AI-EDL):一种将AI能力与经典教育理论相结合的概念框架

Ning Yu, Jie Zhang, Sandeep Mitra, Rebecca Smith, Adam Rich

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.CY

AI总结 AI-EDL框架通过结合经典教育理论与AI技术,提升学生学习效果,通过透明、自我调节和教学监督机制,实现反馈的即时性与具体性,促进学生成长。

Comments This work has been submitted to Journal of Educational Technology Systems. It is under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16282 2026-01-09 cs.LG cs.AI 62%

CALM: A CKA-Guided Adaptive Layer-Wise Modularization Framework for LLM Quantization

CALM: 一种基于CKA的自适应层级模块化框架用于LLM量化

Jinhao Zhang, Yunquan Zhang, Daning Chen, JunSun, Zicheng Yan

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) Zhejiang University(浙江大学) University of Science and Technology of China(中国科学技术大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 CALM提出一种基于CKA的自适应层级模块化框架,通过独立评估各层最佳量化策略,提升LLM量化效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04632 2026-01-09 cs.CL cs.AI 62%

From National Curricula to Cultural Awareness: Constructing Open-Ended Culture-Specific Question Answering Dataset

从国家课程到文化意识:构建开放性文化特定问答数据集

Haneul Yoo, Won Ik Cho, Geunhye Kim, Jiyoon Han

机构 * KAIST AI Center(韩国国立科学技术院人工智能中心) Samsung Electronics(三星电子) Hankuk University of Foreign Studies(韩国外语大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 本文提出CuCu框架,利用国家课程构建文化特定的开放性问答数据集KCaQA,以提升语言模型在文化对齐方面的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03534 2026-01-08 cs.CL cs.CV cs.HC cs.LG 62%

Persona-aware and Explainable Bikeability Assessment: A Vision-Language Model Approach

具有人格意识和可解释性的自行车适应性评估:一种视觉-语言模型方法

Yilong Dai, Ziyi Wang, Chenguang Wang, Kexin Zhou, Yiheng Qian, Susu Xu, Xiang Yan

机构 * University of Alabama(阿拉巴马大学) University of Maryland, College Park(马里兰大学学院公园分校) Stony Brook University(石溪大学) University of Florida(佛罗里达大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 其他安全 :safety(abstract);分类 cs.CL、cs.LG

AI总结 本文提出一种视觉-语言模型框架,通过人格意识和可解释性方法评估自行车适应性,解决道路环境复杂性和用户感知异质性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03802 2026-01-06 cs.LG cs.AI 62%

Balancing Fidelity and Plasticity: Aligning Mixed-Precision Fine-Tuning with Linguistic Hierarchies

在保真度与可塑性之间寻求平衡:将混合精度微调与语言层次结构对齐

Changhai Zhou, Shiyang Zhang, Yuhua Zhou, Qian Qiao, Jun Gao, Shichao Weng, Weizhong Zhang, Cheng Jin

机构 * Fudan University(复旦大学) Yale University(耶鲁大学) Zhejiang University(浙江大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 QR-Adaptor通过联合优化量化位宽和LoRA秩,解决混合精度微调中保真度与可塑性的平衡问题,实现内存与性能的高效资源分配。

Comments 18 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00994 2026-01-06 cs.AI cs.CY 62%

ElecTwit: A Framework for Studying Persuasion in Multi-Agent Social Systems

ElecTwit:多智能体社交系统中说服研究的框架

Michael Bao

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.CY

AI总结 ElecTwit通过模拟政治选举中的社交媒体互动,研究多智能体系统中说服现象的影响因素及不同模型架构对说服动态的作用。

Comments In proceedings of 2025 IEEE International Conference on Agentic AI (ICA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21576 2026-01-06 cs.CV cs.AI cs.LG 62%

Towards Long-window Anchoring in Vision-Language Model Distillation

迈向视觉-语言模型蒸馏中的长窗口锚定

Haoyi Zhou, Shuo Li, Tianyu Chen, Qi Song, Chonghan Gao, Jianxin Li

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 本文提出LAid方法,通过改进注意力机制和RoPE响应调节,提升视觉-语言模型的长上下文理解能力,使蒸馏模型的有效上下文窗口长度增加3.2倍。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04481 2026-01-05 cs.GR cs.AI cs.CL cs.MM 62%

Narrative-to-Scene Generation: An LLM-Driven Pipeline for 2D Game Environments

叙事到场景生成:一种由大语言模型驱动的2D游戏环境生成管道

Yi-Chun Chen, Arnav Jhala

机构 * Yale University(耶鲁大学) North Carolina State University(北卡罗来纳州立大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 本文提出了一种由大语言模型驱动的2D游戏环境生成方法,通过时间框架分析和空间谓词提取,实现从叙述到可玩场景的自动化生成。

Comments Camera-ready version of a paper accepted at the AIIDE 2025 Workshop on Experimental AI in Games (EXAG)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02941 2026-01-05 cs.CV cs.AI cs.CL cs.MM 62%

GameTileNet: A Semantic Dataset for Low-Resolution Game Art in Procedural Content Generation

GameTileNet:用于程序化内容生成的低分辨率游戏艺术语义数据集

Yi-Chun Chen, Arnav Jhala

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 GameTileNet通过视觉-语言对齐任务,为低分辨率游戏艺术提供语义标注,以支持基于叙事的程序化内容生成。

Comments Camera-ready version of a paper accepted for oral presentation at AIIDE 2025

详情

展开后加载摘要…

URL PDF HTML 收藏