arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-05-13 至 2026-05-13 共收录 102 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 28 篇

2507.16818 2026-05-13 cs.LG 57%

Evaluating Artificial Intelligence Algorithms for the Standardization of Transtibial Prosthetic Socket Shape Design

评估用于假肢套筒形状设计标准化的人工智能算法

C. H. E. Jordaan, M. van der Stelt, T. J. J. Maal, V. M. A. Stirler, R. Leijendekkers, T. Kachman, G. A. de Jong

机构 * D Lab, Radboud University Medical Centre(radboud大学医学中心3D实验室) Department of Trauma Surgery, Radboud University Medical Centre(radboud大学医学中心创伤外科部门) Department of Rehabilitation, Radboud University Medical Centre(radboud大学医学中心康复部门) Donders Centre for Cognition, Radboud University(radboud大学认知中心) Military Health Organisation, Ministry of Defence, Kromhout Kazerne(国防部军事医疗组织,克罗姆霍特凯尔内)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 本文研究了多种人工智能算法在假肢套筒设计标准化中的应用,通过三维扫描数据和机器学习模型,评估不同算法在预测套筒形状及适应性调整中的性能,发现随机森林模型在预测适应性调整时表现最优。

Journal ref Computer Methods and Programs in Biomedicine Update 9: 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11753 2026-05-13 cs.AI 57%

Towards Visually Grounded Multimodal Summarization via Cross-Modal Transformer and Gated Attention

迈向基于视觉的多模态摘要:通过跨模态Transformer和门控注意力

Abid Ali, Diego Molla-Aliod, Usman Naseem

机构 * School of Computing, Macquarie University(麦考瑞大学计算机学院)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文提出SPeCTrA-Sum框架,通过深度视觉处理器和轻量视觉相关性预测器实现文本摘要与图像选择,提升多模态摘要的视觉连贯性与准确性。

Comments Accepted to Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11659 2026-05-13 cs.CV cs.AI 57%

Reviving In-domain Fine-tuning Methods for Source-Free Cross-domain Few-shot Learning

复兴领域内微调方法以适用于无源跨领域少样本学习

Yaze Zhao, Yicong Liu, Yixiong Zou, Yuhua Li, Ruixuan Li

机构 * School of Computer Science and Technology, Huazhong University of Science and Technology(华中科技大学计算机科学与技术学院)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文研究跨领域少样本学习中领域内微调方法的性能,发现LoRA等适配器方法优于提示方法,提出Semantic Probe框架提升模态对齐和类别分离。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12164 2026-05-13 eess.IV physics.med-ph 50%

A Comparative Analysis of CT Degradation for LDCT Nodule Classification using Radiomics

基于放射组学的LDCT结节分类中CT退化比较分析

Jiaying Liu, Anna Corti, Valentina D. A. Corino, Luca Mainardi

专题命中 其他安全 :alignment(abstract)

AI总结 本文通过生成合成LDCT图像增强数据集,比较三种退化方法在结节分类中的性能,验证了使用CycleGAN生成的图像在分类任务中表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11939 2026-05-13 cs.CV 50%

Cluster-Aware Neural Collapse Prompt Tuning for Long-Tailed Generalization of Vision-Language Models

面向长尾泛化的眼视觉-语言模型集群感知神经崩溃提示微调

Boyang Guo, Liang Li, Lin Peng, Yuhan Gao, Xichun Sheng, Chenggang Yan

机构 * Hangzhou Dianzi University(杭州电子科技大学) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) The Hong Kong Polytechnic University(香港理工大学) Macao Polytechnic University(澳门理工学院) Zhejiang Provincial Key Laboratory of Low Altitude Ubiquitous Networking Technology, HDU(浙江省低空 ubiquitous 网络技术重点实验室,HDU)

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出集群感知神经崩溃提示微调方法,通过优化提示微调视觉-语言模型的长尾类判别能力,提升模型在类别不平衡数据集上的泛化性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17808 2026-05-13 cs.DC cs.PF 50%

Collaborative Processing for Multi-Tenant Inference on Memory-Constrained Edge TPUs

面向内存受限边缘TPU的多租户推理协作处理

Nathan Ng, Walid A. Hanafy, Prashanthi Kadambi, Balachandra Sunil, Ayush Gupta, David Irwin, Yogesh Simmhan, Prashant Shenoy

专题命中 其他安全 :safety(abstract)

AI总结 本文提出SwapLess系统,通过分析队列模型动态调整计算分配,降低多租户环境下边缘TPU的端到端延迟,单租户任务平均延迟降低63.8%,多租户任务降低77.4%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22663 2026-05-13 cs.CV 50%

AIA: Rethinking Architecture Decoupling Strategy In Unified Multimodal Model

AIA: 重新思考统一多模态模型中的架构解耦策略

Dian Zheng, Manyuan Zhang, Hongyu Li, Kai Zou, Hongbo Liu, Ziyu Guo, Kaituo Feng, Yexin Liu, Ying Luo, Hongsheng Li

机构 * MMLab, CUHK(CUHK多媒体实验室) Meituan(美团) USTC(中国科学技术大学) TJU(天津大学)

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出AIA损失函数,通过学习任务特定的多模态交互模式,缓解任务冲突而不依赖模型解耦,提升生成与理解性能。

Comments Project page: https://zhengdian1.github.io/AIA-project/ Code: https://github.com/zhengdian1/AIA

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22414 2026-05-13 cs.CV 50%

LucidFlux: Caption-Free Photo-Realistic Image Restoration via a Large-Scale Diffusion Transformer

LucidFlux:一种无需图像描述的高质量图像修复方法

Song Fei, Tian Ye, Lujia Wang, Lei Zhu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 其他安全 :alignment(abstract)

AI总结 LucidFlux通过大规模扩散变压器实现无描述图像修复,引入轻量双分支条件器和自适应调制方案,提升几何精度与纹理恢复,优于开源和商业基线。

Comments Project Page: https://w2genai-lab.github.io/LucidFlux

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11098 2026-05-13 cs.SD 50%

AffectCodec: Emotion-Preserving Neural Speech Codec for Expressive Speech Modeling

AffectCodec:用于表达性语音建模的情感保持神经语音编解码器

Jiacheng Shi, Hongfei Du, Xinyuan Song, Y. Alicia Hong, Yanfu Zhang, Ye Gao

机构 * College of William & Mary(威廉姆斯与玛丽学院) Emory University(埃默里大学) George Mason University(乔治·梅森大学)

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出AffectCodec,通过情感引导的神经语音编解码器在保持语义忠实和语调自然的同时,保留情感信息,提升语音重建、情感识别和文本到语音生成的性能。

Comments Accepted to ACL Findings 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08802 2026-05-13 cs.CV 50%

CoLVR: Enhancing Exploratory Latent Visual Reasoning via Contrastive Optimization

CoLVR: 通过对比优化增强探索性潜在视觉推理

Ziyang Ding, Linjian Meng, Yiming Wu, Yuhan Li, Yuhao Liu, Zhen Zhao

机构 * Shandong University(山东大学) Shanghai AI Laboratory(上海人工智能实验室) Nanjing University(南京大学) The University of Hong Kong(香港大学)

专题命中 其他安全 :alignment(abstract)

AI总结 CoLVR通过引入潜在对比训练框架,利用角度扰动引导学习多样化且探索性的表示,提升潜在视觉推理的探索能力,在VSP和Jigsaw任务中分别提升5.83%和8.00%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11321 2026-05-13 cs.CV 50%

KeyframeFace: Language-Driven Facial Animation via Semantic Keyframes

KeyframeFace: 通过语义关键帧实现语言驱动的面部动画

Jingchao Wu, Zejian Kang, Haibo Liu, Yuanchen Fei, Xiangru Huang

机构 * Westlake University(西湖大学) Nanjing University(南京大学) Zhejiang University(浙江大学) Hunan University(湖南大学)

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出KeyframeFace框架,通过语义关键帧实现语言驱动的面部动画,提升面部表情的精确控制与可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19207 2026-05-13 cs.CV 50%

Long Story Short: Disentangling Compositionality and Long-Caption Understanding in Contrastive VLMs

长话短说:在对比视觉语言模型中解构组合性与长描述理解

Israfel Salazar, Desmond Elliott, Yova Kementchedjhieva

机构 * Department of Computer Science, University of Copenhagen(哥本哈根大学计算机科学系) MBZUAI(马克斯·普朗克人工智能研究所)

专题命中 其他安全 :alignment(abstract)

AI总结 本文研究对比视觉语言模型中组合推理与长描述理解之间的关系,通过实验发现两者存在双向但敏感的关联,高质量数据和合理架构设计有助于提升模型泛化能力。

Comments To be published in Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏