arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

共收录 557 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 557 篇

2606.08601 2026-06-09 cs.AI 新提交 57%

InA-Probe: Instruction-Aware Active Probing for Time Series Forecasting with LLMs

InA-Probe:面向LLM时间序列预测的指令感知主动探测

Peiliang Gong, Emadeldeen Eldele, Chenyu Liu, Ziyu Jia, Yi Ding, Xinliang Zhou, Lianchao Gu, Qi Zhu, Yang Liu, Daoqiang Zhang, Xiaoli Li

机构 * Nanyang Technological University(南洋理工大学) Khalifa University(哈利法大学) Nanjing University of Aeronautics and Astronautics(南京航空航天大学) Singapore University of Technology and Design(新加坡科技设计大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 提出指令感知主动探测(InA-Probe),通过多级指令注入和自适应查询生成,结合双阶段注意力机制,在7个基准上超越现有方法,跨域误差降低37%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08486 2026-06-09 cs.CL 新提交 57%

TRADE: Transducer-Augmented Decoder for Speech LLM

TRADE: 换能器增强的语音大语言模型解码器

Yun Tang, Shanil Puri, Shinji Watanabe, Subhabrata Mukherjee

机构 * Hippocratic AI Carnegie Mellon University(卡内基梅隆大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 提出TRADE模型,通过换能器分支增强多模态大语言模型,实现帧同步对齐与语言推理结合,支持流式和非流式解码,在多个基准上取得低词错误率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07866 2026-06-09 cs.AI cs.MA 新提交 57%

Overcoming the Regulatory Bottleneck via Agent-to-Agent Protocols: A Nuclear Case Study

通过智能体间协议克服监管瓶颈:以核能为例

Akshay J. Dave, David Grabaskas, Joseph A. Renevitz, Richard B. Vilim

机构 * Argonne National Laboratory(阿贡国家实验室) Idaho National Laboratory(爱达荷国家实验室)

专题命中 其他安全 :safety(abstract);分类 cs.AI

AI总结 提出监管上下文协议(RCP),一种智能体间通信标准,将监管与申请方之间的人工流程转为结构化、可审计的智能体通道,在核反应堆审批中降低成本50-77%、缩短时间65%。

Comments 26 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07642 2026-06-09 cs.CV cs.CY 新提交 57%

Do VLMs See What Sensors Feel? A Scalable Expert-Guided Design for Wheelchair Accessibility Assessment from Street View

视觉语言模型能否感知传感器所感?一种可扩展的专家引导设计用于从街景评估轮椅可达性

Dongdong Wang, Alina Hagen, Isabelle Gatmaitan, Hao Zhou, Yiwen Dong, Shabboo Valipoor, Vivian W. H. Wong, Lingyao Li

机构 * University of Florida(佛罗里达大学) University of South Florida(南佛罗里达大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 其他安全 :alignment(abstract);分类 cs.CY

AI总结 本文提出专家引导的检索增强框架,利用视觉语言模型从谷歌街景图像识别轮椅可达性障碍,通过GPS轮椅停留行为验证,表明VLM评分与移动摩擦部分一致,但细粒度障碍识别有限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07483 2026-06-08 cs.LG stat.ML 新提交 57%

Network Recovery from Cascade Data: A Debiased Jacobian-Based Machine Learning Approach

从级联数据中恢复网络:一种基于去偏雅可比矩阵的机器学习方法

Lei Huang

机构 * MIT Sloan School of Management(麻省理工学院斯隆管理学院)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 提出CascadeNet框架,通过去偏雅可比矩阵估计一步转移函数,无需指定扩散模型即可恢复隐藏影响网络,在模拟和COVID-19传播数据中优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07412 2026-06-08 cs.SE cs.AI 新提交 57%

Socratic-SWE: Self-Evolving Coding Agents via Trace-Derived Agent Skills

Socratic-SWE:通过轨迹衍生智能体技能实现自我进化的编码智能体

Chuan Xiao, Zhengbo Jiao, Shaobo Wang, Wei Wang, Bing Zhao, Hu Wei, Linfeng Zhang, Lin Qu

机构 * AI Data, Alibaba Group(阿里云数据) Shanghai Jiao Tong University(上海交通大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 提出Socratic-SWE闭环自进化框架,通过将智能体历史求解轨迹蒸馏为结构化技能,生成针对性修复任务,实现编码智能体的持续自我改进。

Comments 21 pages, 5 figures. Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07342 2026-06-08 cs.CL cs.NE 新提交 57%

LLM-Guided Evolution for Medical Decision Pipelines

LLM引导的医疗决策流程进化

Ivan Sviridov, Artem Oskin, Ivan Panin, Iaroslav Bespalov, Dmitry Dylov, Ivan Oseledets, Aleksandr Nesterov

机构 * Sber AI Lab(Sber AI实验室) AIRI

专题命中 其他安全 :safety(abstract);分类 cs.CL

AI总结 提出LLM引导的MAP-Elites进化方法,无需微调即可优化医疗决策流程,在分诊、咨询和图像分类任务中超越手工设计基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06893 2026-06-08 cs.AI 新提交 57%

Workflow-to-Skill: Skill Creation via Routing-Workflow-Semantics-Attachments Decomposition

工作流到技能:通过路由-工作流-语义-附件分解创建技能

Yuyang Zhang, Xinyuan Han, Xudong Jiang, Run Wang

机构 * Key Laboratory of Aerospace Information Security and Trusted Computing, Ministry of Education, School of Cyber Science and Engineering, Wuhan University(航天信息安全部门与可信计算重点实验室,教育部,网络安全科学与工程学院,武汉大学) Nanchang University(南昌大学)

专题命中 其他安全 :safety(abstract);分类 cs.AI

AI总结 提出RWSA中间表示和W2S框架,从异构交互证据中自动构建技能,通过分解工作流结构、执行语义和运行时附件,提升行为重放一致性10.5%。

Comments 10 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06853 2026-06-08 cs.CV cs.AI 新提交 57%

MotionEnhancer: Leveraging Video Diffusion for Motion-Enhanced Vision-Language Models

MotionEnhancer: 利用视频扩散模型增强运动感知的视觉-语言模型

Yifan Xu, Chao Zhang, Ruifei Ma, Fei Gao, Zhifei Yang, Jiaxing Qi, Zhipeng Chen

机构 * School of Computer Science and Engineering, Beihang University(北航计算机科学与工程学院) Beijing Digital Native Digital City Research Center(北京数字原生数字城研究中心) School of Computer Science, Peking University(北京大学计算机学院) School of Artificial Intelligence, Beijing University of Posts and Telecommunications(北京邮电大学人工智能学院)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 提出MotionEnhancer,通过从视频扩散模型中提取运动先验并利用注意力对齐增强视觉-语言模型的运动理解能力,无需额外参数或架构修改,在运动级视频理解基准上取得一致提升。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06531 2026-06-08 cs.AI quant-ph 新提交 57%

CARVE-Q: Quantum-Proposed, Classically Certified Interactive Driving Repair

CARVE-Q:量子提议、经典认证的交互式驾驶修复

Yifan Wang

专题命中 其他安全 :safety(abstract);分类 cs.AI

AI总结 针对被否决的驾驶操作,提出CARVE-Q架构,通过量子最小搜索加速修复格搜索,同时保持安全认证的经典性,实现可审计的交互修复。

Comments 9 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14301 2026-08-17 eess.SP 新提交 50%

Lightweight Beam Index Map Using Coupled Gaussian Mixture Models

基于耦合高斯混合模型的轻量波束索引图

Amar Kasibovic, Franz Weißer, Wolfgang Utschick

专题命中 其他安全 :alignment(abstract)

AI总结 该研究针对MIMO系统波束对齐问题,提出基于耦合高斯混合模型的轻量机器学习方法,构建波束索引图,在降低复杂度开销的同时,性能优于聚类指纹法且接近穷举搜索,适用于资源受限设备。

Comments 7 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13587 2026-08-17 cs.HC 新提交 50%

Student-ChatGPT Interaction Visible: Designing a Teacher Dashboard for EFL Writing Education

学生与ChatGPT交互可视化:为英语作为外语写作教育设计教师仪表盘

Minsun Kim, Seon Gyeom Kim, Suyoun Lee, Yoosang Yoon, Junho Myung, Haneul Yoo, Jieun Han, Hyunseung Lim, Yoonsu Kim, So-Yeon Ahn, Juho Kim, Alice Oh, Hwajung Hong, Tak Yeon Lee

专题命中 其他安全 :alignment(abstract)

AI总结 该研究设计了用于EFL写作教育的Prompt Analytics Dashboard,可追踪学生与LLM的交互,经教师测试后能降低监控负担并优化干预时机。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12857 2026-08-14 cs.HC 新提交 50%

PolyPresentation: A Multimodal AI Platform for Slide-Aware Iterative Presentation Practice

PolyPresentation:一种面向幻灯片感知迭代演示练习的多模态AI平台

Chen Chen, Jihao Li, Zhiyuan Wen, Tianhui Zhang, Di Zou, Jiannong Cao

专题命中 其他安全 :alignment(abstract)

AI总结 该研究针对现有AI演示排练工具缺乏幻灯片关联与迭代练习规划支持的问题,推出PolyPresentation多模态AI平台,经20次学术演示对比验证其能提供更优的演示改进支持。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12024 2026-08-13 cond-mat.other physics.ins-det 新提交 50%

Formally Verified Lock-Free Software Transactional Memory for Scientific Measurement

经形式化验证的用于科学测量的无锁软件事务内存

Kentaro Kitagawa

专题命中 其他安全 :safety(abstract)

AI总结 针对科学测量中线程并发访问共享分层状态的问题,提出经形式化验证的无锁STM,实现原子子树操作,通过TLA+和TLC验证属性,接口支持Python脚本与AI自动化,已应用于多种实验。

Comments 15 pages, 7 figures, submitted

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11013 2026-08-12 cs.CV 新提交 50%

Watching Synthetic Videos: Aligning Cross-modal Representations with Visual Synthesis for Zero-shot Video Captioning

观看合成视频:针对零样本视频字幕生成的视觉合成跨模态表征对齐

Liangyu Fu, Junbo Wang, Yuke Li, Ya Jing, Xuecheng Wu, Zhiyong Wang

机构 * School of Software, Northwestern Polytechnical University(西北工业大学软件学院) School of Information Science and Technology, Beijing University of Technology(北京工业大学信息科学与技术学院) School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院) School of Computer Science, The University of Sydney(悉尼大学计算机科学学院)

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出WSV零样本视频字幕生成框架,通过文本到视频生成模型、抛光器、提示器弥合跨模态差距,在三个公开数据集上取得了B@4 52、CIDEr 95.7的成绩。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10497 2026-08-12 cs.CV 新提交 50%

SapiensID 2.0: Aligning Human Recognition Foundation Models with Human Perception

SapiensID 2.0:将人类识别基础模型与人类感知对齐

Yiyang Su, Jie Zhu, Feng Liu, Anil K. Jain, Xiaoming Liu

专题命中 其他安全 :alignment(abstract)

AI总结 该研究针对现有人类识别模型与人类感知脱节的问题,提出兼具语义与时间感知的SapiensID 2.0框架,通过多项技术实现最优识别性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10769 2026-08-12 math.DG math.OC 新提交 50%

A Framework for Joint Affine and Diffeomorphic Image Registration

联合仿射与微分同胚图像配准的框架

Anton François, Rayane Mouhli, Thomas Pierron

专题命中 其他安全 :alignment(abstract)

AI总结 该研究提出联合仿射-微分同胚图像配准框架,含FA和DA模型,优化策略结合渐进仿射丰富与变分加权,在Dice重叠度上优于CARL等基线模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10844 2026-08-12 physics.bio-ph 新提交 50%

Impact of Higher-Order Interactions on Collective Motion

高阶相互作用对集体运动的影响

Maryam Masoumi, Amir Kargaran, Reza Jafari

专题命中 其他安全 :alignment(abstract)

AI总结 该研究提出含高阶对齐相互作用的广义Vicsek模型,发现其会引发不连续相变,需更高粒子密度维持集体有序,为理解活性物质相变及生物、合成系统集体行为提供了新参数。

Comments 6 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09821 2026-08-11 eess.SP 新提交 50%

An open-source, scalable workflow for organizing echosounder data for machine learning applications

面向机器学习应用的开源可扩展声呐数据处理工作流

Caesar Tuguinay, Wu-Jung Lee, Valentina Staneva, Elizabeth M. Phillips, Rebecca E. Thomas, Alicia Billings, Julia Clemons

专题命中 其他安全 :alignment(abstract)

AI总结 该研究提出一种两阶段开源工作流,基于Echopype和Echoregions库构建可扩展的机器学习就绪回声测深数据集,含数据划分与掩码创建,提供教程验证其可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08225 2026-08-11 eess.SP cs.SY eess.SY 新提交 50%

Toward Intelligent Skies: Signal Processing and AI Foundations of Low-Altitude Wireless Networks

迈向智能天空:低空无线网络的信号处理与人工智能基础

Weijie Yuan, Geng Sun, Jiacheng Wang, Jun Wu, Yuanhao Cui, Jiahui Li, Wei Zhang, George K. Karagiannidis, Sumei Sun, Yonina C. Eldar

专题命中 其他安全 :safety(abstract)

AI总结 本教程从AI与信号处理视角,全面阐述低空无线网络(LAWN)的架构基础、信号处理与AI技术,结合案例分析其融合应用,指出未来发展挑战与机遇。

Comments Invited Overview Paper in JSTSP

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08950 2026-08-11 cs.SE 新提交 50%

Independent Patch Verification for Coding Agents with a Bidirectional Reconstruct-and-Verify Framework

基于双向重构-验证框架的代码智能体独立补丁验证

Chenglin Li, Yisen Xu, Zehao Wang, Shin Hwei Tan, Tse-Hsun, Chen

专题命中 其他安全 :alignment(abstract)

AI总结 本研究针对代码智能体生成补丁后缺乏独立验证的问题,提出无需训练的RETRACE双向重构-验证框架,在SWE-bench Verified等基准上显著提升了代码补丁的正确性。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08701 2026-08-11 cs.RO 新提交 50%

Anchor-Based AI Approach for Pre-Crash Object Detection Utilizing Micro-Doppler Signatures in Automotive Radar

基于锚的人工智能方法:利用汽车雷达中的微多普勒特征进行碰撞前目标检测

Patrick Zaumseil, Rainer Engert, Dagmar Steinhauser, Jonathan Wache, Soumya Dewangan, Thomas Brandmeier

专题命中 其他安全 :safety(abstract)

AI总结 该研究提出基于锚的AI模型,结合雷达微多普勒特征与创新雷达图像膨胀技术,提升碰撞前目标检测性能,在动态场景中优于现有汽车雷达跟踪方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08663 2026-08-11 cs.HC cs.CV 新提交 50%

A Dynamic-Semantics Framework for Grounding Human Referring Expressions in Visual Perceptual Data

用于在视觉感知数据中建立人类指代表达式基础的动态语义框架

Joseph Bingham

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出动态语义框架,通过显式约定状态绑定集合与感知对齐流程,解决视觉-语言模型在词汇同步任务中的不足,在斯坦福重复参考游戏语料库上达到83.56%的top-5准确率,核心是透明符号层与可检查感知通道的结合。

Comments 23 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08462 2026-08-11 cs.AR 新提交 50%

ARMOR: Accelerating RTL Simulation by Mitigating the Front-End Bottleneck Using Node Compression

ARMOR:通过节点压缩缓解前端瓶颈以加速RTL仿真

Jiaping Tang, Jianan Mu, Zhiteng Chao, Jingzhong Wen, Jing Ye, Huawei Li

专题命中 其他安全 :alignment(abstract)

AI总结 ARMOR是一款通过节点压缩缓解前端瓶颈的高效RTL仿真器,利用比特级数据并行性压缩节点,在CPU和AI加速器设计上分别实现1.6倍和2.7倍加速。

Comments Accepted by 2026 59th IEEE/ACM International Symposium on Microarchitecture (MICRO)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08418 2026-08-11 cs.CV 新提交 50%

Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information

用于结合文本信息的图像聚类的深度模态共享自表达学习

Xianghan Meng, Wei He, Zhiyuan Huang, Chun-Guang Li

专题命中 其他安全 :alignment(abstract)

AI总结 提出DeepMORSE方法,通过模态共享自表达模型学习结合文本信息的图像聚类,在6个基准数据集上聚类性能提升超3%,且所学表示可迁移至下游任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07554 2026-08-11 cs.CV cs.RO 新提交 50%

Impact of Dataset Composition on Embedded Real-Time UAV Wildfire Detection Using Compact YOLO Models

数据集组成对采用轻量YOLO模型的嵌入式实时无人机野火检测的影响

Eduardo de los Santos, Andre S. Kelbouscas, Ricardo B. Grando, Bruna V. Guterres

机构 * Technological University of Uruguay(乌拉圭技术大学)

专题命中 其他安全 :alignment(abstract)

AI总结 该研究以轻量YOLO模型为对象,探究数据集组成对嵌入式实时无人机野火检测的影响,发现真实未增强数据集的检测性能最优,合成数据混合与图像增强均未提升部署效果,数据集真实性和领域对齐更具价值。

Comments Paper accepted at the ICCAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07279 2026-08-10 eess.SP 新提交 50%

Token Communication for Multimodal Large Language Model

多模态大语言模型的令牌通信

Jingkai Ying, Zhijin Qin, Yuan Shen, Khaled B. Letaief

专题命中 其他安全 :alignment(abstract)

AI总结 本文针对多模态大语言模型(MLLMs)的令牌传输问题,提出适配MLLMs的令牌通信框架,通过集成神经编解码器、两阶段语义对齐训练及自适应适配器,在相同传输数据量下实现更优任务性能。

Comments 13 pages, 11 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06722 2026-08-10 cs.HC 新提交 50%

CustomDance: Customized 3D Dance Generation with Coarse-to-Fine Human-Centered Interactive Control

CustomDance:基于以人为中心的粗到细交互式控制的定制化3D舞蹈生成

Xulong Tang, Kaixing Yang, Xiaohu Guo, Prabhakaran Balakrishnan, Rawan Alghofaili

专题命中 其他安全 :alignment(abstract)

AI总结 CustomDance是基于粗到细交互式控制的定制化3D舞蹈生成系统,通过三阶段流程实现AI辅助编舞,在定量和定性比较中优于基线,为用户提供全面控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06170 2026-08-07 cs.RO cs.CV 新提交 50%

Prior-SG: Task and Prior Driven Region Segmentation for Scene Graphs in Arbitrarily-Structured Environments

Prior-SG:面向任意结构环境中场景图的任务与先验驱动区域分割

Giorgio Tonetti, Laurent Kneip, Abel Gawel, Marco Hutter

机构 * RAI Institute(RAI研究所) ETH Zurich(苏黎世联邦理工学院)

专题命中 其他安全 :alignment(abstract)

AI总结 提出Prior-SG框架,将场景图生成视为概率对齐问题,通过融合异构专家与拓扑先验提升任意结构环境的语义区域分割精度,实现零样本本体灵活性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05921 2026-08-07 cs.SE 新提交 50%

Sensor-Level Fault Diagnosis for Automotive Software Validation Using Large Language Models

基于大语言模型的汽车软件验证传感器级故障诊断

Mohammad Abboush, Hamza Ouarrad, Andreas Rausch

专题命中 其他安全 :safety(abstract)

AI总结 该研究提出两阶段框架,用经4-bit低秩适配的LLM对HIL平台的汽车传感器记录做故障诊断,最小模型准确率达81.6%,适配循环可在单商用加速器运行。

详情

展开后加载摘要…

URL PDF HTML 收藏