arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-04-14 至 2026-04-14 共收录 162 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 41 篇

2511.09282 2026-04-14 cs.SD cs.CL 57%

End-to-end Contrastive Language-Speech Pretraining Model For Long-form Spoken Question Answering

端到端对比语言-语音预训练模型用于长形式语音问答

Jiliang Hu, Zuchao Li, Baoyuan Qi, Liu Guoming, Ping Wang

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 本文提出CLSR模型,通过将音频特征转换为文本表示,提升长音频问答任务的性能,实验表明其优于现有方法。

Comments 12 pages, 7 figures, accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10593 2026-04-14 cs.RO 50%

MonoEM-GS: Monocular Expectation-Maximization Gaussian Splatting SLAM

MonoEM-GS: 单目期望-最大化高斯点云SLAM

Evgenii Kruzhkov, Sven Behnke

机构 * Autonomous Intelligent Systems group, Computer Science Institute VI – Intelligent Systems and Robotics – and the Center for Robotics and the Lamarr Institute for Machine Learning and Artificial Intelligence, University of Bonn(波恩大学自主智能系统组、计算机科学研究所VI——智能系统与机器人学——以及机器人中心与拉马尔机器学习和人工智能研究所)

专题命中 其他安全 :alignment(abstract)

AI总结 MonoEM-GS通过整合几何预测到全局高斯点云表示中,解决视点依赖性和噪声问题,结合期望-最大化方法稳定几何并采用ICP对齐估计姿态,支持多模式特征参数化实现开放集分割等下游任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10524 2026-04-14 cs.CV 50%

FGML-DG: Feynman-Inspired Cognitive Science Paradigm for Cross-Domain Medical Image Segmentation

FGML-DG:受费曼启发的认知科学范式用于跨域医学图像分割

Yucheng Song, Chenxi Li, Haokang Ding, Zhining Liao, Zhifang Liao

机构 * School of Computer Science and Engineering, Central South University(中南大学计算机科学与工程学院)

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出FGML-DG范式,通过费曼学习法简化特征、设计元风格记忆机制及反馈驱动重训练,提升医学图像跨域分割性能。

Journal ref Volume 413: ECAI 2025, (3912-3919)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03402 2026-04-14 eess.IV cs.CV 50%

DRIFT: Deep Restoration, ISP Fusion, and Tone-mapping

DRIFT:深度恢复、ISP融合与色调映射

Soumendu Majee, Joshua Peter Ebenezer, Abhinau K. Venkataramanan, Weidi Liu, Thilo Balke, Zeeshan Nadir, Sreenithy Chandran, Seok-Jun Lee, Hamid Rahim Sheikh

机构 * Samsung Research America(三星美国研究院)

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出DRIFT方法,通过多帧处理网络和深度学习色调映射实现高效移动相机流水线,生成高质量RGB图像,验证了其在性能和效率上的优势。

Comments Proceedings of CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02736 2026-04-14 cs.CV 50%

THOM: Generating Physically Plausible Hand-Object Meshes From Text

THOM:从文本生成物理合理的手-物体网格

Uyoung Jeong, Yihalem Yimolal Tiruneh, Hyung Jin Chang, Seungryul Baek, Kwang In Kim

机构 * UNIST(蔚山科学技术院) University of Birmingham(伯明翰大学) POSTECH(浦项科技大学)

专题命中 其他安全 :alignment(abstract)

AI总结 THOM通过两阶段流程从文本生成物理合理的手-物体网格,无需模板网格,结合物理优化和视觉语言模型提升交互合理性。

Comments accepted to CVPR Findings 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16326 2026-04-14 cs.IR 50%

ARK: Answer-Centric Retriever Tuning via KG-augmented Curriculum Learning

ARK:通过知识图谱增强课程学习实现答案导向的检索器调优

Hang Ding, Jiawei Zhou, Haiyun Jiang

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出一种基于知识图谱增强课程学习的答案导向检索器调优框架,通过生成增强查询和逐步挑战的硬负样本,提升检索器区分关键证据的能力,实验表明在多个基准数据集上性能优于基线模型。

Comments ACL 2026 accepted as main. For source code, see https://github.com/valleysprings/ARK/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14543 2026-04-14 cs.CV 50%

Exploring Cross-Modal Flows for Few-Shot Learning

探索跨模态流用于少样本学习

Ziqi Jiang, Yanghao Wang, Long Chen

机构 * Department of CSE, The Hong Kong University of Science and Technology(香港科技大学计算机科学与工程系)

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出跨模态流匹配对齐(FMA)方法,通过多步调整提升跨模态对齐精度与鲁棒性,在多种基准和模型上均取得显著性能提升。

Comments Accepted by ICLR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03447 2026-04-14 cs.CV 50%

CoPS: Conditional Prompt Synthesis for Zero-Shot Anomaly Detection

CoPS:用于零样本异常检测的条件提示合成

Qiyu Chen, Zhen Qu, Wei Luo, Haiming Yao, Yunkang Cao, Yuxin Jiang, Yinan Duan, Huiyuan Luo, Chengkan Lv, Zhengtao Zhang

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) CASIVISION(中科视语) THU(清华大学) HNU(湖南大学) HUST(华中科技大学)

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出CoPS框架,通过动态提示合成提升零样本异常检测性能,利用视觉特征生成适应性状态模型,并在13个工业和医疗数据集上取得分类AUROC和分割AUROC的提升。

Comments Accepted by CVPR 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09754 2026-04-14 stat.AP 50%

Surface temperature extremes produced by huge machine learning hindcasts of summer 2023

由2023年夏季巨大机器学习预测产生的表面温度极值

Mark Risser, Ankur Mahesh, Joshua North, William D. Collins, Boris Bonev, Karthik Kashinath, Thorsten Kurth, Shashank Subramanian, Michael S. Pritchard

专题命中 其他安全 :safety(abstract)

AI总结 本文利用球面傅里叶神经算子机器学习模型生成7424个天气情景,研究2023年夏季极端高温事件,发现其极值温度在大部分地区不寻常,但在部分区域超出传统预测范围,凸显大规模模拟在预测湿热和干旱温度极值中的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09743 2026-04-14 eess.IV cs.CV 50%

Search-MIND: Training-Free Multi-Modal Medical Image Registration

Search-MIND: 无需训练的多模态医学图像配准

Boya Wang, Ruizhe Li, Chao Chen, Xin Chen

机构 * Lab for Uncertainty in Data and Decision Making (LUCID), Nottingham Biomedical Research Centre (BRC), School of Medicine, University of Nottingham, UK(英国诺丁汉大学医学院诺丁汉生物医学研究中心(BRC)数据与决策不确定性实验室(LUCID))

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出Search-MIND,一种无需训练的迭代优化框架,通过粗到细策略和两种新损失函数提升多模态医学图像配准的稳定性与精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09559 2026-04-14 cs.DC cs.OS cs.SE 50%

Interferences within a certifiable design methodology for high-performance multi-core platforms

可验证设计方法在高性能多核平台中的干扰问题

Mohamed Amine Khelassi, Felix Suchert, Abderaouf Amalou, Benjamin Lesage, Anika Christmann, Robin Hapka, Jeronimo Castrillon, Mihail Asavoae, Mathieu Jan, Claire Pagetti, Selma Saidi

专题命中 其他安全 :safety(abstract)

AI总结 本文提出一种综合不同抽象层次工具的方法,通过硬件建模、机器学习分析和编译优化,减少内存干扰以提升系统可预测性,从而简化多核系统在安全领域中的认证流程。

Journal ref 13th European Congress of Embedded Real Time Systems (ERTS), Feb 2026, Toulouse, France

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24251 2026-04-14 cs.SI 50%

GRAPHIA: Harnessing Social Graph Data to Enhance LLM-Based Social Simulation

GRAPHIA:利用社交图数据增强基于LLM的社会模拟

Jiarui Ji, Zehua Zhang, Zhewei Wei, Bin Tong, Guan Wang, Bo Zheng

专题命中 其他安全 :alignment(abstract)

AI总结 GRAPHIA通过强化学习利用社交图数据作为LLM训练的监督信号,提升社会模拟的微观和宏观对齐效果,实验显示其在多个真实网络中显著提高预测精度和社会现象复制能力。

Comments accepted by ACL26 main

详情

展开后加载摘要…

URL PDF HTML 收藏