arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-07-07 至 2026-07-07 共收录 187 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 32 篇

2607.04665 2026-07-07 cs.CV 新提交 50%

DiCE-CIR: Direct Composition Learning for Efficient Zero-Shot Composed Image Retrieval

DiCE-CIR:用于高效零样本合成图像检索的直接合成学习

Gwang-Ho Na, Ho-Joong Kim, Seong-Whan Lee

机构 * Institute of Information & Communications Technology Planning & Evaluation (IITP)(信息通信技术规划与评估研究所(IITP)) Department of Artificial Intelligence, Korea University(韩国大学人工智能系)

专题命中 其他安全 :alignment(abstract)

AI总结 研究零样本合成图像检索问题,提出直接合成学习方法DiCE-CIR,直接组合参考图像和编辑文本预测合成查询表示,用大语言模型自动构建训练样本,训练轻量级模块,实验表明其性能优且效率高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04559 2026-07-07 cs.CV 新提交 50%

QSVideo: Query-Conditioned Semantic Temporal Retrieval for Video Understanding

QSVideo:用于视频理解的查询条件语义时间检索

Wei Ao, Lan Wang, Vishnu Naresh Boddeti

机构 * Michigan State University(密歇根州立大学)

专题命中 其他安全 :alignment(abstract)

AI总结 针对视频理解中视觉语言模型性能随视频时长下降问题,提出QSVideo框架,通过查询条件语义排序器、联合优化相关性和多样性及时间对齐策略,提升视频VLM性能。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03470 2026-07-07 cs.CV 新提交 50%

PhysMirror: Physics-Aware Mirror Object Generation

物理镜像:物理感知镜像对象生成

Xuan-Bach Mai, Duy-Phuc Nguyen, Quoc-Van Le, Tam V. Nguyen, Thanh-Toan Do, Huu Le, Duong-Van Nguyen, Minh-Triet Tran, Trung-Nghia Le

机构 * University of Science, Ho Chi Minh City(胡志明市科学大学) Vietnam National University, Ho Chi Minh City(胡志明市越南国家大学) University of Dayton(代顿大学) Monash University(莫纳什大学) VinFast(VinFast公司) VinUniversity(Vin大学)

专题命中 其他安全 :alignment(abstract)

AI总结 针对现代文本到图像扩散模型合成物理精确镜像反射的挑战,提出物理感知生成框架PhysMirror,通过3D空间先验执行投影几何,引入评估指标,实验表明其在反射精度等方面优于基线。

Comments IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04493 2026-07-07 q-bio.NC math.DS 新提交 50%

Beyond DSA: Conjugacy-based Comparison of Dynamical Systems

超越DSA:基于共轭的动力系统比较

Prakhar Godara, Pang Shiang Tay, Marcelo G. Mattar

专题命中 其他安全 :alignment(abstract)

AI总结 研究比较两个动力系统是否实现相同计算的问题,指出DSA中正交对齐对拓扑共轭非必要非充分,提出基于共轭的相似性分析(CSA),证明其拟合对齐是相关合成算子的有限数据投影。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25596 2026-07-07 cs.DC cs.HC cs.MA cs.SI 50%

Volition-Guarded Multiagent Atomic Transactions: Describing People and their Machines

意志性多智能体原子事务:描述人与他们的机器

Andy Lewis-Pye, Ehud Shapiro

专题命中 其他安全 :safety(abstract)

AI总结 本文提出意志性多智能体原子事务作为描述人与机器协同系统的数学基础,通过人与机器的状态交互定义系统行为,为基层平台提供安全性和活力度量标准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02211 2026-07-07 cs.CV 版本更新 50%

TexTailor: Inference-Time Textual Guidance Tailoring for Multimodal Diffusion Transformers

TexTailor:用于多模态扩散变压器的推理时文本引导剪裁

Binglei Li, Mengping Yang, Zhiyu Tan, Junping Zhang, Hao Li

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) Shanghai Academy of AI for Science(上海人工智能科学研究院)

专题命中 其他安全 :alignment(abstract)

AI总结 研究基于变压器的扩散模型中不同模块与文本条件的交互。通过系统管道分析各模块功能,提出推理时逐块文本引导剪裁方法,提升文本图像对齐,有多种下游应用,实验表明优于基线。

Comments To appear in ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03463 2026-07-07 cs.SE 版本更新 50%

The Impact of Critique on LLM-Based Model Generation from Natural Language: The Case of Activity Diagrams

批判对基于大语言模型的自然语言模型生成的影响:以活动图为例

Parham Khamsepour, Mark Cole, Ish Ashraf, DaYuan Tan, Sandeep Puri, Mehrdad Sabetzadeh, Shiva Nejati

专题命中 其他安全 :alignment(abstract)

AI总结 研究基于大语言模型从自然语言描述自动化生成模型,提出LADEX流程,经批判-改进循环,设计变体研究其影响,用两种匹配器评估,实验表明循环可提升结构有效性等,算法结构检查更能实现结构一致性。

Comments Accepted in the Empirical Software Engineering (EMSE) Journal (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏