arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

共收录 2745 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 585 篇

2606.06853 2026-06-08 cs.CV cs.AI 新提交 57%

MotionEnhancer: Leveraging Video Diffusion for Motion-Enhanced Vision-Language Models

MotionEnhancer: 利用视频扩散模型增强运动感知的视觉-语言模型

Yifan Xu, Chao Zhang, Ruifei Ma, Fei Gao, Zhifei Yang, Jiaxing Qi, Zhipeng Chen

机构 * School of Computer Science and Engineering, Beihang University(北航计算机科学与工程学院) Beijing Digital Native Digital City Research Center(北京数字原生数字城研究中心) School of Computer Science, Peking University(北京大学计算机学院) School of Artificial Intelligence, Beijing University of Posts and Telecommunications(北京邮电大学人工智能学院)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 提出MotionEnhancer,通过从视频扩散模型中提取运动先验并利用注意力对齐增强视觉-语言模型的运动理解能力,无需额外参数或架构修改,在运动级视频理解基准上取得一致提升。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06531 2026-06-08 cs.AI quant-ph 新提交 57%

CARVE-Q: Quantum-Proposed, Classically Certified Interactive Driving Repair

CARVE-Q:量子提议、经典认证的交互式驾驶修复

Yifan Wang

专题命中 其他安全 :safety(abstract);分类 cs.AI

AI总结 针对被否决的驾驶操作,提出CARVE-Q架构,通过量子最小搜索加速修复格搜索,同时保持安全认证的经典性,实现可审计的交互修复。

Comments 9 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18465 2026-08-20 cs.HC cs.ET cs.IR 新提交 50%

Reducing Technician Search Burden: A Multimodal RAG for Cessna 172 Maintenance Manual

减轻技术人员的检索负担:面向赛斯纳172维护手册的多模态检索增强生成

Seongjun Ha, Md Rashedul Islam, Gaurav Nanda, Damon Lercel

专题命中 其他安全 :safety(abstract)

AI总结 本研究针对赛斯纳172维护手册,开发多模态检索增强生成流程,其多模态手册检索器召回率达93.37%,生成响应与基准答案语义相似度87.20%,可减轻技术人员检索负担。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18353 2026-08-20 eess.SY cs.MA cs.SY 新提交 50%

Model Predictive Supervisory Control for Hierarchical and Distributed UAS Traffic Management

面向分层分布式无人机交通管理的模型预测监督控制

Matheus P. Loures, Guilherme V. Raffo, Patrícia N. Pena

专题命中 其他安全 :safety(abstract)

AI总结 本研究提出分层模型预测监督控制(MPSC)框架,结合滚动时域最优控制与监督控制理论保障安全等特性,开发城市UTM模型,实现时变需求下取送任务的高效支持。

Comments 6 pages, 7 figures, IFAC conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17490 2026-08-19 cs.CV 新提交 50%

When More Foundation Models Means Less: Diagnosing and Addressing Multi-View Fusion Failure

当更多基础模型意味着更少时:诊断与解决多视图融合失效问题

Yibo Liu, Bowen Jiang

机构 * Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 其他安全 :alignment(abstract)

AI总结 针对多视图融合中融合编码器数量与性能非单调的问题,提出KAGES方法选择任务对齐的紧凑视图集,在多场景下提升AULC,优于DPP等选择方法。

Comments 26 pages, 4 figures. Code and results: https://github.com/yibol9768-alt/Quantifying-Representation-Reliability

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15875 2026-08-18 cs.RO 新提交 50%

GigaBrain-0.7: Scaling Embodied Foundation Models to Emergent Capabilities with a Three-System Architecture

GigaBrain-0.7:采用三系统架构扩展具身基础模型以获得涌现能力

GigaBrain Team, Angen Ye, Axiang Sun, Can Jin, Chenxi Cheng, Chong Shi, Dengke Shang, Dingqian Zhang, Guan Huang, Guangqiang Wang, Guangqing Ding, Guo Li, Hangcong Li, Hengyu Zhong, Hongtao Lu, Jianbo Qin, Jiming Mao, Jing Zhu, Jindi Lv, Jingzhi Cui, Junjie Xie, Junyi Bao, Kai Liu, Lei Yuan, Limin Long, Lv Feng, Mingming Yu, Peng Li, Pengfei Yi, Qi Li, Qianli Zhang, Qingfang Li, Qitang Hu, Rui Zhang, Shaoyan Sun, Shibo Sun, Shiying Duan, Tenghui Chen, Tianze Liu, Weijie Ke, Wenyao Xue, Xiaofeng Wang, Xiaoyu Tian, Xinyu Liu, Xinze Chen, Yang Wang, Yankai Wang, Yejun Zeng, Yifan Li, Yifei Nie, Yilong Li, Yilong Liu, Yongchao Feng, Yumeng Wang, Yun Ye, Zhichao Liu, Ziheng He, Zonghai Yang, Zheng Zhu

专题命中 其他安全 :alignment(abstract)

AI总结 研究针对VLA模型泛化不足问题,提出三系统架构的GigaBrain-0.7具身基础模型,扩展至37000小时异质具身数据,实现零样本等能力显著提升,将开源代码与权重。

Comments https://gigaai.cc/blog/gigabrain07

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15519 2026-08-18 cs.SI 新提交 50%

Topological collapse of higher-order interactions bottlenecks collective intelligence in AI agent societies

智能体社群中高阶相互作用的拓扑崩溃是集体智能的瓶颈

Shuo Lu, Weicheng Meng, Aijing Yu, Kun Shao, Jian Luan, Ran He, Jian Liang

专题命中 其他安全 :alignment(abstract)

AI总结 该研究发现AI智能体社群中高阶交互的拓扑崩溃会成为集体智能瓶颈,提出HIS和Φ指标,证实该瓶颈与模型无关,为人工社会设计提供了新方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15196 2026-08-18 cs.CV 新提交 50%

Anchor-Regularized Adaptation for Generalizable AI-Generated Image Detection with DINOv3

基于DINOv3的可泛化AI生成图像检测的锚点正则化适配方法

Hyeongjun Choi, Juhun Lee, Davide Cozzolino, Luisa Verdoliva, Simon S. Woo

机构 * Sungkyunkwan University(成均馆大学) University of Naples Federico II(那不勒斯费德里科二世大学) Secure Machines Lab Inc(Secure Machines Lab公司)

专题命中 其他安全 :alignment(abstract)

AI总结 针对AI生成图像检测中混合对齐与未对齐数据易扭曲预训练表示的问题,提出锚点正则化适配(ARA)方法,结合低秩适配与冻结锚点分类器,在9个基准测试中取得最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14893 2026-08-18 cs.SI physics.soc-ph 新提交 50%

Weaker Coherence, Weaker Reciprocity: Comparing the Semantic and Social Organization of Moltbook and Reddit

连贯性更弱,互惠性更弱:对比Moltbook与Reddit的语义及社交组织

Favio Di Ciocco, Lucas Díaz Celauro, Sebastián Pinto, Marcelo Kuperman, Pablo Balenzuela

专题命中 其他安全 :alignment(abstract)

AI总结 该研究对比AI智能体社交网络Moltbook与早期Reddit,发现Reddit在语义连贯性、多样性及交互互惠性上更优,且未被Moltbook复现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14301 2026-08-17 eess.SP 新提交 50%

Lightweight Beam Index Map Using Coupled Gaussian Mixture Models

基于耦合高斯混合模型的轻量波束索引图

Amar Kasibovic, Franz Weißer, Wolfgang Utschick

专题命中 其他安全 :alignment(abstract)

AI总结 该研究针对MIMO系统波束对齐问题,提出基于耦合高斯混合模型的轻量机器学习方法,构建波束索引图,在降低复杂度开销的同时,性能优于聚类指纹法且接近穷举搜索,适用于资源受限设备。

Comments 7 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13587 2026-08-17 cs.HC 新提交 50%

Student-ChatGPT Interaction Visible: Designing a Teacher Dashboard for EFL Writing Education

学生与ChatGPT交互可视化:为英语作为外语写作教育设计教师仪表盘

Minsun Kim, Seon Gyeom Kim, Suyoun Lee, Yoosang Yoon, Junho Myung, Haneul Yoo, Jieun Han, Hyunseung Lim, Yoonsu Kim, So-Yeon Ahn, Juho Kim, Alice Oh, Hwajung Hong, Tak Yeon Lee

专题命中 其他安全 :alignment(abstract)

AI总结 该研究设计了用于EFL写作教育的Prompt Analytics Dashboard,可追踪学生与LLM的交互,经教师测试后能降低监控负担并优化干预时机。

Journal ref Companion Proceedings 16th International Conference on Learning Analytics & Knowledge(LAK 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12857 2026-08-14 cs.HC 新提交 50%

PolyPresentation: A Multimodal AI Platform for Slide-Aware Iterative Presentation Practice

PolyPresentation:一种面向幻灯片感知迭代演示练习的多模态AI平台

Chen Chen, Jihao Li, Zhiyuan Wen, Tianhui Zhang, Di Zou, Jiannong Cao

专题命中 其他安全 :alignment(abstract)

AI总结 该研究针对现有AI演示排练工具缺乏幻灯片关联与迭代练习规划支持的问题,推出PolyPresentation多模态AI平台,经20次学术演示对比验证其能提供更优的演示改进支持。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12024 2026-08-13 cond-mat.other physics.ins-det 新提交 50%

Formally Verified Lock-Free Software Transactional Memory for Scientific Measurement

经形式化验证的用于科学测量的无锁软件事务内存

Kentaro Kitagawa

专题命中 其他安全 :safety(abstract)

AI总结 针对科学测量中线程并发访问共享分层状态的问题,提出经形式化验证的无锁STM,实现原子子树操作,通过TLA+和TLC验证属性,接口支持Python脚本与AI自动化,已应用于多种实验。

Comments 15 pages, 7 figures, submitted

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11013 2026-08-12 cs.CV 新提交 50%

Watching Synthetic Videos: Aligning Cross-modal Representations with Visual Synthesis for Zero-shot Video Captioning

观看合成视频:针对零样本视频字幕生成的视觉合成跨模态表征对齐

Liangyu Fu, Junbo Wang, Yuke Li, Ya Jing, Xuecheng Wu, Zhiyong Wang

机构 * School of Software, Northwestern Polytechnical University(西北工业大学软件学院) School of Information Science and Technology, Beijing University of Technology(北京工业大学信息科学与技术学院) School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院) School of Computer Science, The University of Sydney(悉尼大学计算机科学学院)

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出WSV零样本视频字幕生成框架,通过文本到视频生成模型、抛光器、提示器弥合跨模态差距,在三个公开数据集上取得了B@4 52、CIDEr 95.7的成绩。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10497 2026-08-12 cs.CV 新提交 50%

SapiensID 2.0: Aligning Human Recognition Foundation Models with Human Perception

SapiensID 2.0:将人类识别基础模型与人类感知对齐

Yiyang Su, Jie Zhu, Feng Liu, Anil K. Jain, Xiaoming Liu

专题命中 其他安全 :alignment(abstract)

AI总结 该研究针对现有人类识别模型与人类感知脱节的问题,提出兼具语义与时间感知的SapiensID 2.0框架,通过多项技术实现最优识别性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10769 2026-08-12 math.DG math.OC 新提交 50%

A Framework for Joint Affine and Diffeomorphic Image Registration

联合仿射与微分同胚图像配准的框架

Anton François, Rayane Mouhli, Thomas Pierron

专题命中 其他安全 :alignment(abstract)

AI总结 该研究提出联合仿射-微分同胚图像配准框架,含FA和DA模型,优化策略结合渐进仿射丰富与变分加权,在Dice重叠度上优于CARL等基线模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10844 2026-08-12 physics.bio-ph 新提交 50%

Impact of Higher-Order Interactions on Collective Motion

高阶相互作用对集体运动的影响

Maryam Masoumi, Amir Kargaran, Reza Jafari

专题命中 其他安全 :alignment(abstract)

AI总结 该研究提出含高阶对齐相互作用的广义Vicsek模型,发现其会引发不连续相变,需更高粒子密度维持集体有序,为理解活性物质相变及生物、合成系统集体行为提供了新参数。

Comments 6 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09821 2026-08-11 eess.SP 新提交 50%

An open-source, scalable workflow for organizing echosounder data for machine learning applications

面向机器学习应用的开源可扩展声呐数据处理工作流

Caesar Tuguinay, Wu-Jung Lee, Valentina Staneva, Elizabeth M. Phillips, Rebecca E. Thomas, Alicia Billings, Julia Clemons

专题命中 其他安全 :alignment(abstract)

AI总结 该研究提出一种两阶段开源工作流,基于Echopype和Echoregions库构建可扩展的机器学习就绪回声测深数据集,含数据划分与掩码创建,提供教程验证其可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08225 2026-08-11 eess.SP cs.SY eess.SY 新提交 50%

Toward Intelligent Skies: Signal Processing and AI Foundations of Low-Altitude Wireless Networks

迈向智能天空:低空无线网络的信号处理与人工智能基础

Weijie Yuan, Geng Sun, Jiacheng Wang, Jun Wu, Yuanhao Cui, Jiahui Li, Wei Zhang, George K. Karagiannidis, Sumei Sun, Yonina C. Eldar

专题命中 其他安全 :safety(abstract)

AI总结 本教程从AI与信号处理视角,全面阐述低空无线网络(LAWN)的架构基础、信号处理与AI技术,结合案例分析其融合应用,指出未来发展挑战与机遇。

Comments Invited Overview Paper in JSTSP

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08950 2026-08-11 cs.SE 新提交 50%

Independent Patch Verification for Coding Agents with a Bidirectional Reconstruct-and-Verify Framework

基于双向重构-验证框架的代码智能体独立补丁验证

Chenglin Li, Yisen Xu, Zehao Wang, Shin Hwei Tan, Tse-Hsun, Chen

专题命中 其他安全 :alignment(abstract)

AI总结 本研究针对代码智能体生成补丁后缺乏独立验证的问题,提出无需训练的RETRACE双向重构-验证框架,在SWE-bench Verified等基准上显著提升了代码补丁的正确性。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08701 2026-08-11 cs.RO 新提交 50%

Anchor-Based AI Approach for Pre-Crash Object Detection Utilizing Micro-Doppler Signatures in Automotive Radar

基于锚的人工智能方法:利用汽车雷达中的微多普勒特征进行碰撞前目标检测

Patrick Zaumseil, Rainer Engert, Dagmar Steinhauser, Jonathan Wache, Soumya Dewangan, Thomas Brandmeier

专题命中 其他安全 :safety(abstract)

AI总结 该研究提出基于锚的AI模型,结合雷达微多普勒特征与创新雷达图像膨胀技术,提升碰撞前目标检测性能,在动态场景中优于现有汽车雷达跟踪方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08663 2026-08-11 cs.HC cs.CV 新提交 50%

A Dynamic-Semantics Framework for Grounding Human Referring Expressions in Visual Perceptual Data

用于在视觉感知数据中建立人类指代表达式基础的动态语义框架

Joseph Bingham

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出动态语义框架,通过显式约定状态绑定集合与感知对齐流程,解决视觉-语言模型在词汇同步任务中的不足,在斯坦福重复参考游戏语料库上达到83.56%的top-5准确率,核心是透明符号层与可检查感知通道的结合。

Comments 23 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08462 2026-08-11 cs.AR 新提交 50%

ARMOR: Accelerating RTL Simulation by Mitigating the Front-End Bottleneck Using Node Compression

ARMOR:通过节点压缩缓解前端瓶颈以加速RTL仿真

Jiaping Tang, Jianan Mu, Zhiteng Chao, Jingzhong Wen, Jing Ye, Huawei Li

专题命中 其他安全 :alignment(abstract)

AI总结 ARMOR是一款通过节点压缩缓解前端瓶颈的高效RTL仿真器,利用比特级数据并行性压缩节点,在CPU和AI加速器设计上分别实现1.6倍和2.7倍加速。

Comments Accepted by 2026 59th IEEE/ACM International Symposium on Microarchitecture (MICRO)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08418 2026-08-11 cs.CV 新提交 50%

Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information

用于结合文本信息的图像聚类的深度模态共享自表达学习

Xianghan Meng, Wei He, Zhiyuan Huang, Chun-Guang Li

专题命中 其他安全 :alignment(abstract)

AI总结 提出DeepMORSE方法,通过模态共享自表达模型学习结合文本信息的图像聚类,在6个基准数据集上聚类性能提升超3%,且所学表示可迁移至下游任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07554 2026-08-11 cs.CV cs.RO 新提交 50%

Impact of Dataset Composition on Embedded Real-Time UAV Wildfire Detection Using Compact YOLO Models

数据集组成对采用轻量YOLO模型的嵌入式实时无人机野火检测的影响

Eduardo de los Santos, Andre S. Kelbouscas, Ricardo B. Grando, Bruna V. Guterres

机构 * Technological University of Uruguay(乌拉圭技术大学)

专题命中 其他安全 :alignment(abstract)

AI总结 该研究以轻量YOLO模型为对象,探究数据集组成对嵌入式实时无人机野火检测的影响,发现真实未增强数据集的检测性能最优,合成数据混合与图像增强均未提升部署效果,数据集真实性和领域对齐更具价值。

Comments Paper accepted at the ICCAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07279 2026-08-10 eess.SP 新提交 50%

Token Communication for Multimodal Large Language Model

多模态大语言模型的令牌通信

Jingkai Ying, Zhijin Qin, Yuan Shen, Khaled B. Letaief

专题命中 其他安全 :alignment(abstract)

AI总结 本文针对多模态大语言模型(MLLMs)的令牌传输问题,提出适配MLLMs的令牌通信框架,通过集成神经编解码器、两阶段语义对齐训练及自适应适配器,在相同传输数据量下实现更优任务性能。

Comments 13 pages, 11 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06170 2026-08-07 cs.RO cs.CV 新提交 50%

Prior-SG: Task and Prior Driven Region Segmentation for Scene Graphs in Arbitrarily-Structured Environments

Prior-SG:面向任意结构环境中场景图的任务与先验驱动区域分割

Giorgio Tonetti, Laurent Kneip, Abel Gawel, Marco Hutter

机构 * RAI Institute(RAI研究所) ETH Zurich(苏黎世联邦理工学院)

专题命中 其他安全 :alignment(abstract)

AI总结 提出Prior-SG框架,将场景图生成视为概率对齐问题,通过融合异构专家与拓扑先验提升任意结构环境的语义区域分割精度,实现零样本本体灵活性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05921 2026-08-07 cs.SE 新提交 50%

Sensor-Level Fault Diagnosis for Automotive Software Validation Using Large Language Models

基于大语言模型的汽车软件验证传感器级故障诊断

Mohammad Abboush, Hamza Ouarrad, Andreas Rausch

专题命中 其他安全 :safety(abstract)

AI总结 该研究提出两阶段框架,用经4-bit低秩适配的LLM对HIL平台的汽车传感器记录做故障诊断,最小模型准确率达81.6%,适配循环可在单商用加速器运行。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05221 2026-08-07 cs.RO 新提交 50%

A System for Train Condition Monitoring and Structural Health Assessment of Rail Vehicles

轨道车辆的列车状态监测与结构健康评估系统

Maximilian Posner, Martin Dazer, Daniela Lauer, Robert Winkler-Höhn, Mathilde Laporte, Tobias Herrmann, Martin Köppel

机构 * DB InfraGO AG(DB InfraGO股份公司) DB Systemtechnik(DB系统技术公司) MSG Ammendorf(MSG阿门多夫公司)

专题命中 其他安全 :safety(abstract)

AI总结 本文提出一种融合结构传感器技术与AI数据分析的系统,用于轨道车辆状态监测与撞击检测,可自动检测相关事件、支持状态维护及设计优化,助力干线铁路向全自动运行过渡。

Journal ref IEEE Intelligent Vehicles Symposium, Detroit, USA, Jun, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05763 2026-08-07 physics.geo-ph 新提交 50%

Foundation Model-Assisted Full Waveform Inversion

基础模型辅助的全波形反演

Mustafa Alfarhan, Matteo Ravasi, Fuqiang Chen, George Turkiyyah, David Keyes

专题命中 其他安全 :alignment(abstract)

AI总结 该研究提出用预训练地震基础模型SeisLM的特征构建全波形反演早期目标函数,通过实验验证其可避免周期跳变,提升反演效果,优于传统及混合损失工作流。

详情

展开后加载摘要…

URL PDF HTML 收藏