arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-06-04 至 2026-06-04 共收录 134 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 50 篇

2602.22779 2026-06-04 cs.CV 50%

TrajTok: Learning Trajectory Tokens enables better Video Understanding

TrajTok: 学习轨迹令牌以实现更好的视频理解

Chenhao Zheng, Jieyu Zhang, Jianing Zhang, Weikai Huang, Ashutosh Kumar, Quan Kong, Oncel Tuzel, Chun-Liang Li, Ranjay Krishna

机构 * University of Washington(华盛顿大学) Allen Institute for Artificial Intelligence(人工智能研究院) Apple(苹果公司) Woven by Toyota, Inc(丰田纺织公司)

专题命中 其他安全 :alignment(abstract)

AI总结 提出TrajTok,一种端到端视频令牌化模块,通过隐式时空聚类生成对象轨迹令牌,提升视频理解效率与性能。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
1807.06172 2026-06-04 eess.SY cs.RO cs.SY 50%

Experimental Resilience Assessment of An Open-Source Driving Agent

开放源代码驾驶代理的实验韧性评估

Abu Hasnat Mohammad Rubaiyat, Yongming Qin, Homa Alemzadeh

机构 * Department of Electrical and Computer Engineering(电气与计算机工程系)

专题命中 其他安全 :safety(abstract)

AI总结 本文提出基于系统理论过程分析(STPA)的故障注入框架,用于评估开放源代码驾驶代理openpilot在不同环境条件和传感器数据故障下的韧性,通过战略性软件故障注入方法提高不安全场景的覆盖率,从而更有效地模拟安全关键故障并测试自动驾驶车辆。

Comments 10 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1709.01586 2026-06-04 eess.SY cs.MA cs.SY 50%

Robust Semi-Cooperative Multi-Agent Coordination in the Presence of Stochastic Disturbances

在随机扰动下鲁棒半合作多智能体协调

Kunal Garg, Dongkun Han, Dimitra Panagou

专题命中 其他安全 :safety(abstract)

AI总结 本文提出了一种鲁棒分布式协调协议,用于在存在随机不确定性时生成无碰撞轨迹的多个单轮机器人。基于先前的半合作协调工作,重新设计协调控制器以对抗一类状态(风)扰动和测量噪声,并通过分析证明了安全性和收敛性,仿真结果展示了所提方案的有效性。

Comments K. Garg, D. Han and D. Panagou "Robust Semi-Cooperative Multi-Agent Coordination in the Presence of Stochastic Disturbances", 56th IEEE Conf. on Decision and Control, Melbourne, Australia, December 2017

详情

展开后加载摘要…

URL PDF HTML 收藏
1905.04937 2026-06-04 eess.SY cs.SY 50%

Explicit approximation of stochastic optimal feedback control for combined therapy of cancer

癌症联合治疗中随机最优反馈控制的显式近似

Mazen Alamir

专题命中 其他安全 :safety(abstract)

AI总结 本文提出了一种可操作的方法来近似癌症联合免疫化学治疗中的随机最优反馈治疗,通过固定点值迭代近似求解随机动态规划方程,并通过引入与方差相关的惩罚项来改善结果,以应对成本函数中安全约束软化的后果。

详情

展开后加载摘要…

URL PDF HTML 收藏
1903.07738 2026-06-04 eess.SY cs.SY 50%

Predicting Stochastic Human Forward Reachable Sets Based on Learned Human Behavior

基于学习人类行为预测随机人类前向可达集

Jennifer Shih

专题命中 其他安全 :safety(abstract)

AI总结 本文提出了一种基于学习人类行为预测随机人类前向可达集的方法,利用Hamilton-Jacobi可达性理论提升预测准确性,并展示了如何生成具有不同安全概率的随机可达集以适应新场景。

Comments American Control Conference 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
1810.11380 2026-06-04 eess.SY cs.SY 50%

YatSim: an Open-Source Simulator For Testing Consensus-based Control Strategies in Urban Traffic Networks

YatSim:用于测试基于共识的控制策略的城市交通网络仿真器

Alexander Martin Dethof, Fabio Molinari

专题命中 其他安全 :safety(abstract)

AI总结 本文提出YatSim,一个开源程序,用于模拟城市交通网络中的基于共识的控制策略。该程序通过执行改进的共识拍卖算法来实现车辆在交叉口的优先通行协议,并利用车载模型预测控制器避免碰撞。

Comments Open-source program documentation

详情

展开后加载摘要…

URL PDF HTML 收藏
1810.09952 2026-06-04 eess.SY cs.HC cs.SY 50%

Agent-Based Modeling and Simulation of Connected and Automated Vehicles Using Game Engine: A Cooperative On-Ramp Merging Study

基于游戏引擎的连接和自动化车辆的代理建模与仿真:一种合作匝道合并研究

Ziran Wang, BaekGyu Kim, Hiromitsu Kobayashi, Guoyuan Wu, Matthew J. Barth

专题命中 其他安全 :safety(abstract)

AI总结 本文提出了一种基于游戏引擎Unity3D的连接和自动化车辆(CAVs)的代理建模与仿真方法,通过分布式共识协议研究了合作匝道合并问题,并与人类在回路模拟进行了比较,结果显示该协议在减少旅行时间、能源消耗和污染物排放方面具有显著优势。

Comments 14 pages, 6 figures. 2019 Transportation Research Board Annual Meeting

详情

展开后加载摘要…

URL PDF HTML 收藏
1809.00109 2026-06-04 eess.SY cs.SY 50%

Multi-UAV Continuum Deformation Flight Optimization in Cluttered Urban Environments

多无人机连续变形飞行优化在复杂城市环境中的应用

Hossein Rastgoftar, Ella Atkins

专题命中 其他安全 :safety(abstract)

AI总结 本文研究了在人口密集且几何受限区域中无人机群的协同运动优化,将无人机视为可变形体的粒子,通过同胚连续变形函数定义协调方式,确保无人机在复杂环境中安全移动。

Comments 15 pages. The paper is now under review of the 2019 AIAA SciTech conference

详情

展开后加载摘要…

URL PDF HTML 收藏
1802.09921 2026-06-04 eess.SY cs.SY 50%

Approximating the Region of Multi-Task Coordination via the Optimal Lyapunov-Like Barrier Function

通过最优Lyapunov-like障碍函数近似多任务协调区域

Dongkun Han, Lixing Huang, Dimitra Panagou

专题命中 其他安全 :safety(abstract)

AI总结 本文研究多智能体系统在避碰、保持连通性和收敛到目标点的多任务协调安全区域,提出利用Lyapunov-like障碍函数子level集近似该区域,并通过系统搜索最优障碍函数以最大化区域估计。

Comments 8 pages. arXiv admin note: text overlap with arXiv:1709.00615

详情

展开后加载摘要…

URL PDF HTML 收藏
1503.04894 2026-06-04 cs.RO cs.MA cs.SY eess.SY 50%

Biomimetic Algorithms for Coordinated Motion: Theory and Implementation

仿生算法协调运动:理论与实现

Udit Halder, Biswadip Dey

专题命中 其他安全 :alignment(abstract)

AI总结 本文基于生物飞行行为,提出两种覆盖与聚群策略,通过轮式机器人与Vicon系统验证了运动伪装理论,并展示了基于局部信息的拓扑速度对齐方法,证明了生物启发在多智能体机器人系统中的应用价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
1603.05200 2026-06-04 eess.SY cs.MA cs.SY 50%

Multi-Vehicle Collision Avoidance via Hamilton-Jacobi Reachability and Mixed Integer Programming

多车避障 via 霍尔-雅可比可达性与混合整数规划

Mo Chen, Jennifer C. Shih, Claire J. Tomlin

专题命中 其他安全 :safety(abstract)

AI总结 本文提出利用霍尔-雅可比可达性与混合整数规划解决多车避障问题,提供安全保证并克服了传统方法在大规模系统中的可扩展性限制。

Comments To Appear in IEEE Conference in Decision and Control 2016

详情

展开后加载摘要…

URL PDF HTML 收藏
1604.07849 2026-06-04 cs.RO cs.SY eess.SY math.OC 50%

Distributed rotational and translational maneuvering of rigid formations and their applications

分布式刚体编队的旋转和翻译 maneuvering 及其应用

Hector Garcia de Marina, Bayu Jayawardhana, Ming Cao

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出一种分布式控制器,通过引入距离约束参数实现编队与运动控制,允许恒定集体翻译、旋转或组合,同时保证编队形状无畸变,应用于编队对齐和目标追踪。

Comments 14 pages

Journal ref Robotics, IEEE Transactions on, Volume 32, Issue 3, Pages 684 - 696, Year 2016

详情

展开后加载摘要…

URL PDF HTML 收藏
1506.05235 2026-06-04 eess.SY cs.MA cs.SY 50%

On the Adoption of Multi-Agent Systems for the Development of Industrial Control Networks

多智能体系统在工业控制系统网络开发中的应用

Hosny A. Abbas, Samir I. Shaheen, Mohammed H. Amin

专题命中 其他安全 :safety(abstract)

AI总结 本文研究了多智能体系统在工业控制系统网络中的应用,提出了一种分层的智能体架构,通过智能体协作提升对传统控制系统局限性的处理能力,实现全局同步与安全计划。

Comments 9 pages; ICAS 2015

详情

展开后加载摘要…

URL PDF HTML 收藏
1312.5202 2026-06-04 eess.SY cs.SY 50%

Consensus in the presence of interference

在干扰下的共识

Usman A. Khan, Shuchin Aeron

专题命中 其他安全 :alignment(abstract)

AI总结 本文研究了在存在网络干扰的情况下任意向量的分布式平均共识策略。通过将干扰转化为代数结构,修改标准协议以在干扰子空间的互补子空间中达到平均值。利用信息对齐技术,使传输对齐于干扰的零空间,从而实现共识。

Comments Submitted for peer-reviewed publication

详情

展开后加载摘要…

URL PDF HTML 收藏