arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

共收录 7978 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 7978 篇

2601.14157 2026-02-05 cs.SD cs.AI cs.LG 62%

ConceptCaps: a Distilled Concept Dataset for Interpretability in Music Models

ConceptCaps:用于音乐模型可解释性的精简概念数据集

Bruno Sienkiewicz, Łukasz Neumann, Mateusz Modrzejewski

机构 * Institute of Computer Science, Warsaw University of Technology(华沙技术大学计算机科学研究所)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 ConceptCaps通过分离语义建模与文本生成,提供一个包含21,000个音乐-标签三元组的数据集,用于提升音乐模型的可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19414 2026-02-05 cs.AI cs.LG 62%

Toward Multiphysics-Informed Machine Learning for Sustainable Data Center Operations: Intelligence Evolution with Deployable Solutions for Computing Infrastructure

迈向可持续数据中心运营的多物理场指导机器学习:面向计算基础设施的可部署解决方案的智能演进

Ruihang Wang, Qingang Zhang, Yonggang Wen, Stuart Kennedy

专题命中 其他安全 :safety(abstract);分类 cs.AI、cs.LG

AI总结 本文提出多物理场指导机器学习框架,用于提升数据中心运营的可持续性,通过整合物理先验与数据驱动模型,实现碳感知IT资源配置、智能冷却控制等关键应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03690 2026-02-04 cs.LG cs.AI 62%

LLM-Inspired Pretrain-Then-Finetune for Small-Data, Large-Scale Optimization

受大语言模型启发的小数据、大规模优化的预训练-微调方法

Zishi Zhang, Jinhui Han, Ming Hu, Yijie Peng

机构 * Guanghua School of Management, Peking University(北京大学光华管理学院) Rotman School of Management, University of Toronto(多伦多大学罗特曼管理学院)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种受大语言模型启发的预训练-微调方法,用于解决小数据下的大规模决策优化问题,通过预训练注入领域知识并利用合成数据,微调提升与真实数据的一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18939 2026-02-04 cs.LG cs.AI 62%

Damba-ST: Domain-Adaptive Mamba for Efficient Urban Spatio-Temporal Prediction

Damba-ST: 域自适应Mamba用于高效的都市时空预测

Rui An, Yifeng Zhang, Ziran Liang, Wenqi Fan, Yuxuan Liang, Xuequn Shang, Qing Li

机构 * Northwestern Polytechnical University(西北工业大学) The Hong Kong University of Science and Technology (Guangzhou)(香港理工大学(广州))

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 Damba-ST通过域自适应Mamba模型提升都市时空预测的效率与泛化能力,解决跨域泛化难题。

Comments Accepted by ICDE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02951 2026-02-04 cs.CV cs.AI cs.CL 62%

Nüwa: Mending the Spatial Integrity Torn by VLM Token Pruning

Nüwa: 通过VLM令牌剪枝修复空间完整性

Yihong Huang, Fei Ma, Yihua Shao, Jingcai Guo, Zitong Yu, Laizhong Cui, Qi Tian

机构 * Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(人工智能与数字经济广东实验室) School of Artificial Intelligence, Xidian University(西安电子科技大学人工智能学院) The Hong Kong Polytechnic University(香港理工大学) Great Bay University(大鹏大学) Shenzhen University(深圳大学) Huawei(华为)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 Nüwa通过两阶段令牌剪枝框架在保持空间完整性的同时实现高效特征聚合,提升VQA和视觉定位任务性能

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02891 2026-02-04 cs.LG cs.CL 62%

TraceNAS: Zero-shot LLM Pruning via Gradient Trace Correlation

TraceNAS: 通过梯度轨迹相关性实现零样本LLM剪枝

Prajna G. Malettira, Manish Nagaraj, Arjun Roy, Shubham Negi, Kaushik Roy

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.LG

AI总结 TraceNAS通过梯度轨迹相关性实现零样本LLM剪枝,高效发现高保真剪枝模型,减少GPU计算成本并提升模型性能。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01610 2026-02-03 cs.AI cs.LG 62%

ToPT: Task-Oriented Prompt Tuning for Urban Region Representation Learning

为城市区域表示学习设计的任务导向提示微调:ToPT

Zitao Guo, Changyang Jiang, Tianhong Zhao, Jinzhou Cao, Genan Dai, Bowen Zhang

机构 * College of Applied Science, Shenzhen University, Shenzhen, China(深圳大学应用科学学院) School of Artificial Intelligence, Shenzhen Technology University, Shenzhen, China(深圳科技大学人工智能学院)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 ToPT通过空间一致融合和任务对齐提升城市区域表示学习,实现任务导向的提示微调,提升多个城市任务的性能。

Comments The paper has been accepted by ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.13268 2026-02-03 q-bio.GN cs.AI cs.LG q-bio.QM 62%

Revolutionizing Genomics with Reinforcement Learning Techniques

用强化学习技术革新基因组学

Mohsen Karami, Khadijeh, Jahanian, Roohallah Alizadehsani, Iman Dehzangi, Juan M Gorriz, Yudong Zhang, Jia Wang, Farshid Hajati, Min Yang, Thantrira Porntaveetus, Hamid Alinejad-Rokny

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 本文探讨了强化学习在基因组学中的应用,包括基因调控网络、基因组组装和序列比对,并讨论了未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20245 2026-02-03 cs.CY cs.AI cs.HC 62%

How AI Impacts Skill Formation

人工智能如何影响技能形成

Judy Hanwen Shen, Alex Tamkin

机构 * Anthropic

专题命中 其他安全 :safety(abstract);分类 cs.AI、cs.CY

AI总结 研究发现人工智能辅助虽提升生产力,但损害技能学习,需谨慎使用以保护技能形成。

Comments V2: Fixed typos in Table 1 (Balance Table), corrected osf link

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22692 2026-02-02 cs.CL cs.AI cs.CR 62%

FNF: Functional Network Fingerprint for Large Language Models

FNF:大型语言模型的功能网络指纹

Yiheng Liu, Junhao Ning, Sichen Xia, Haiyang Sun, Yang Yang, Hanyang Chi, Xiaohui Gao, Ning Qiang, Bao Ge, Junwei Han, Xintao Hu

机构 * School of Automation, Northwestern Polytechnical University, Xi'an, China(自动化学院,西北工业大学,西安,中国) School of Physics and Information Technology, Shaanxi Normal University, Xi'an, China(物理与信息技术学院,陕西师范大学,西安,中国)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 FNF通过功能网络活动一致性检测LLM来源,提供非侵入性的知识产权保护方法。

Comments 13 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22657 2026-02-02 cs.CL cs.AI 62%

NAG: A Unified Native Architecture for Encoder-free Text-Graph Modeling in Language Models

NAG:一种用于语言模型中无编码文本图建模的统一原生架构

Haisong Gong, Zhibo Liu, Qiang Liu, Shu Wu, Liang Wang

机构 * New Laboratory of Pattern Recognition (NLPR), Institute of Automation, Chinese Academy of Sciences, Beijing, China School of Artificial Intelligence, University of Chinese Academy of Sciences (UCAS), Beijing, China School of Advanced Interdisciplinary Sciences, UCAS, Beijing, China

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 NAG提出一种统一的原生架构,将图处理内化于语言模型,通过自注意力机制和位置ID校准实现结构依赖和等价性,提升文本图建模的连贯性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22042 2026-02-02 cs.CL cs.AI 62%

Emotions Where Art Thou: Understanding and Characterizing the Emotional Latent Space of Large Language Models

情感在哪里?:理解并表征大语言模型的情感潜在空间

Benjamin Reichman, Adar Avsian, Larry Heck

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 研究揭示了大语言模型中情感的潜在空间结构,通过方向编码和跨语言一致性,展示了对情感的可控表征与可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03267 2026-02-02 cs.LG cs.AI 62%

PT$^2$-LLM: Post-Training Ternarization for Large Language Models

PT²-LLM:大语言模型的后训练三元化

Xianglong Yan, Chengzhu Bao, Zhiteng Li, Tianao Zhang, Kaicheng Yang, Haotong Qin, Ruobing Xie, Xingwu Sun, Yulun Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) ETH Zürich(苏黎世联邦理工学院) Tencent Hunyuan(腾讯文言)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 PT²-LLM通过后训练三元化技术,在降低内存成本的同时提升大语言模型的推理速度和效率。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02521 2026-02-02 cs.SD cs.AI cs.CL 62%

FLM-Audio: Natural Monologues Improves Native Full-Duplex Chatbots via Dual Training

FLM-Audio: 自然独白提升原生全双工聊天机器人通过双训练

Yiqun Yao, Xiang Li, Xin Jiang, Xuezhi Fang, Naitong Yu, Wenjia Ma, Aixin Sun, Yequan Wang

机构 * Beijing Academy of Artificial Intelligence, Beijing, China(北京人工智能研究院) Nanyang Technological University, Singapore(南洋理工大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 FLM-Audio通过双训练策略和连续独白提升全双工聊天机器人的响应质量和体验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22009 2026-01-30 cond-mat.mtrl-sci cs.AI cs.LG physics.comp-ph 62%

MEIDNet: Multimodal generative AI framework for inverse materials design

MEIDNet: 多模态生成式AI框架用于反向材料设计

Anand Babu, Rogério Almeida Gouvêa, Pierre Vandergheynst, Gian-Marco Rignanese

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 MEIDNet通过多模态生成式AI框架实现反向材料设计,利用对比学习提升学习效率,生成低带隙钙钛矿结构并验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23471 2026-01-30 cs.CL cs.AI 62%

Discovering Multi-Scale Semantic Structure in Text Corpora Using Density-Based Trees and LLM Embeddings

利用基于密度的树和大语言模型嵌入发现文本语料库的多尺度语义结构

Thomas Haschka, Joseph Bakarji

机构 * E020-04 Service Unit of High Performance Computing, DataLab, Campus IT, Technische Universität Wien(技术大学维也纳高性能计算服务单元,数据实验室,校园IT) Department of Mechanical Engineering, American University of Beirut(贝鲁特美国大学机械工程系)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 本文提出了一种基于密度的树和大语言模型嵌入的方法,用于发现文本语料库的多尺度语义结构,通过层次密度建模揭示主题之间的结构关系。

Comments 23 pages, 10 figures, further interactive visualizations available on https:// genealogy.sematlas.com/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17866 2026-01-30 cs.LG cs.AI 62%

Understanding Post-Training Structural Changes in Large Language Models

理解大型语言模型的训练后结构变化

Xinyu He, Xianghui Cao

机构 * School of Automation, Southeast University, Nanjing, China(自动化学院,东南大学,南京,中国)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 本研究通过SVD分析揭示了大型语言模型训练后参数空间的结构变化,发现奇异值缩放和奇异向量旋转机制,为理解训练后调节机制提供了新视角。

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.04177 2026-01-30 cs.CL cs.LG stat.ML 62%

Scaling Laws for Downstream Task Performance of Large Language Models

大语言模型下游任务性能的扩展定律

Berivan Isik, Natalia Ponomareva, Hussein Hazimeh, Dimitris Paparas, Sergei Vassilvitskii, Sanmi Koyejo

机构 * Google Research(谷歌研究) OpenAI(开放人工智能) Stanford University(斯坦福大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.LG

AI总结 本研究探讨了预训练数据规模和分布对齐对大语言模型下游任务性能的影响,揭示了扩展定律在迁移学习中的应用及翻译质量的预测方法。

Comments Published at the International Conference on Learning Representations (ICLR) 2025, with title: "Scaling Laws for Downstream Task Performance in Machine Translation"

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11558 2026-01-29 cs.CV cs.AI cs.CL 62%

DaMO: A Data-Efficient Multimodal Orchestrator for Temporal Reasoning with Video LLMs

DaMO:一种数据高效的多模态协调器,用于视频LLM的时序推理

Bo-Cheng Chiu, Jen-Jee Chen, Yu-Chee Tseng, Feng-Chi Chen, An-Zi Yen

机构 * College of Artificial Intelligence, National Yang Ming Chiao Tung University(人工智能学院,阳明交通大学) Institute of Population Health Sciences, National Health Research Institutes(人口健康科学研究所,国家健康研究院) Department of Computer Science, National Yang Ming Chiao Tung University(计算机科学系,阳明交通大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 DaMO是一种专为视频LLM设计的数据高效多模态协调器,通过时序感知Fuseformer和四阶段训练范式提升时序推理能力,实现更精确的多模态理解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20467 2026-01-29 cs.AI cs.CL 62%

CtrlCoT: Dual-Granularity Chain-of-Thought Compression for Controllable Reasoning

CtrlCoT:用于可控推理的双粒度推理链压缩

Zhenxuan Fan, Jie Cao, Yang Dai, Zheqi Lv, Wenqiao Zhang, Zhongle Xie, Peng LU, Beng Chin Ooi

机构 * Zhejiang University(浙江大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 CtrlCoT通过双粒度方法实现高效可控推理,结合语义抽象与标记级删除,提升推理效率和可靠性。

Comments 16 pages, 9 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14174 2026-01-29 cs.LG cs.AI 62%

Physics-Guided Multimodal Transformers are the Necessary Foundation for the Next Generation of Meteorological Science

物理引导的多模态Transformer是下一代气象科学的必要基础

Jing Han, Hanting Chen, Kai Han, Xiaomeng Huang, Wenjun Xu, Dacheng Tao, Ping Zhang

机构 * School of Artificial Intelligence, Beijing University of Posts Huawei Noah's Ark Lab Department of Earth System Science, Tsinghua University College of Computing \& Data Science, Nanyang Technological University State Key Laboratory of Networking Switching Technology, Beijing University of Posts

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 本文提出通过物理引导的多模态Transformer构建下一代气象科学的统一范式,以提升模型的科学一致性和物理约束能力。

Comments Perspective article

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15600 2026-01-28 cs.AI cs.CL 62%

Unleashing Scientific Reasoning for Bio-experimental Protocol Generation via Structured Component-based Reward Mechanism

通过结构化组件奖励机制解锁生物实验协议生成中的科学推理

Haoran Sun, Yankai Jiang, Zhenyu Tang, Yaning Pan, Shuang Gu, Zekai Lin, Lilong Wang, Wenjie Lou, Lei Liu, Lei Bai, Xiaosong Wang

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Fudan University(复旦大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 通过结构化组件奖励机制,Thoth在多个基准测试中超越了现有LLMs,实现了更准确的生物实验协议生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15580 2026-01-28 cs.LG cs.CL 62%

Language Models are Symbolic Learners in Arithmetic

语言模型在算术中是符号学习者

Chunyuan Deng, Zhiqi Li, Roy Xie, Ruidi Chang, Hanjie Chen

机构 * Department of Computer Science(计算机科学系) Rice University(里士满大学) College of Computing(计算学院) Georgia Institute of Technology(佐治亚理工学院) Duke University(杜克大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.LG

AI总结 本文研究语言模型在算术运算中通过学习符号捷径而非算法来掌握算术能力。

Comments TMLR 2026. Code at https://github.com/chili-lab/Symbolic-Arithmetic

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17022 2026-01-27 cs.MM cs.AI cs.CV cs.CY 62%

AI-based System for Transforming text and sound to Educational Videos

基于AI的将文本和声音转换为教育视频的系统

M. E. ElAlami, S. M. Khater, M. El. R. Rehan

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.CY

AI总结 本文提出基于GAN的AI系统,通过文本和语音转录、图像生成与视频合成,生成高质量的教育视频。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17016 2026-01-27 cs.CY cs.AI 62%

Measuring Political Stance and Consistency in Large Language Models

测量大型语言模型中的政治立场与一致性

Salah Feras Alali, Mohammad Nashat Maasfeh, Mucahid Kutlu, Saban Kardas

机构 * Department of Computer Science and Engineering(计算机科学与工程系) Qatar University(卡塔尔大学) Gulf Studies Center(海湾研究中心)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.CY

AI总结 本研究评估了九个大型语言模型在24个政治敏感问题上的立场和一致性,发现模型立场受提示技术影响,且某些问题立场稳定不变。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17005 2026-01-27 cs.CY cs.AI cs.ET 62%

From Noise to Insights: Enhancing Supply Chain Decision Support through AI-Based Survey Integrity Analytics

从噪声到洞察:通过基于AI的调查完整性分析增强供应链决策支持

Bhubalan Mani

机构 * Olathe, USA(美国奥拉特)

专题命中 其他安全 :safety(abstract);分类 cs.AI、cs.CY

AI总结 本文提出基于AI的调查完整性分析框架,通过机器学习识别虚假响应,提升供应链决策支持数据的可靠性。

Comments 2025 IEEE 4th World Conference on Applied Intelligence and Computing (AIC)

Journal ref 2025 IEEE 4th World Conference on Applied Intelligence and Computing (AIC), GB Nagar, Gwalior, India, 2025, pp. 565-570

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16390 2026-01-26 cs.CL cs.AI 62%

Cross-Lingual Activation Steering for Multilingual Language Models

多语言激活引导用于多语言语言模型

Rhitabrat Pokharel, Ameeta Agrawal, Tanay Nagar

机构 * Department of Computer Science, Portland State University, USA(波特兰州立大学计算机科学系)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 本文提出CLAS方法,通过激活引导提升多语言模型在非主导语言上的性能,无需修改模型权重。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16219 2026-01-26 cs.CL cs.AI 62%

Domain Specific Specialization in Low-Resource Settings: The Efficacy of Offline Response-Based Knowledge Distillation in Large Language Models

低资源环境下领域特定专业化:基于离线响应的知识蒸馏在大语言模型中的有效性

Erdem Aslan, Pakize Erdoğmuş

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 本文提出了一种基于离线响应的知识蒸馏方法,通过优化硬件资源,在低资源环境下实现高精度领域专用助手,验证了数据质量和结构对齐比数量更重要。

Comments 10 pages, 10 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11304 2026-01-23 cs.AI cs.CL cs.CV 62%

Leveraging Multimodal-LLMs Assisted by Instance Segmentation for Intelligent Traffic Monitoring

利用实例分割辅助的多模态大语言模型进行智能交通监控

Murat Arda Onsu, Poonam Lohan, Burak Kantarci, Aisha Syed, Matthew Andrews, Sean Kennedy

机构 * University of Ottawa(渥太华大学) Nokia Bell Labs(诺基亚贝尔实验室)

专题命中 其他安全 :safety(abstract);分类 cs.CL、cs.AI

AI总结 本文利用多模态大语言模型和实例分割技术,实现高准确率的交通监控系统,提升交通管理效率和安全性。

Comments 6 pages, 7 figures, submitted to 30th IEEE International Symposium on Computers and Communications (ISCC) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15286 2026-01-22 cs.CV cs.AI cs.LG cs.RO 62%

Iterative Refinement Improves Compositional Image Generation

迭代细化改进组合图像生成

Shantanu Jaiswal, Mihir Prabhudesai, Nikash Bhardwaj, Zheyang Qin, Amir Zadeh, Chuan Li, Katerina Fragkiadaki, Deepak Pathak

机构 * Carnegie Mellon University(卡内基梅隆大学) Lambda AI

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种迭代细化策略,通过视觉-语言模型反馈提升组合图像生成质量,实验显示在多个基准上均优于并行采样方法。

Comments Project webpage: https://iterative-img-gen.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏