V2X System Architecture Utilizing Hybrid Gaussian Process-based Model Structures
专题命中 安全训练 :safety(abstract);分类 cs.LG
Comments Accepted for Oral Presentation at the 13th IEEE Systems Conference (SysCon 2019)
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
专题命中 安全训练 :safety(abstract);分类 cs.LG
Comments Accepted for Oral Presentation at the 13th IEEE Systems Conference (SysCon 2019)
专题命中 安全训练 :safety(abstract);分类 cs.LG
Comments 8 pages. Submitted to 2019 AAAI Spring Symposium on Verification of Neural Networks
专题命中 安全训练 :safety(abstract);分类 cs.LG
Comments Machine Learning for Health (ML4H) Workshop at NeurIPS 2018 arXiv:1811.07216
专题命中 安全训练 :safety(abstract);分类 cs.LG
专题命中 安全训练 :safety(abstract);分类 cs.AI
Comments 8 pages
专题命中 安全训练 :alignment(abstract);分类 cs.CY
Comments 6 pages
专题命中 安全训练 :safety(abstract);分类 cs.AI
专题命中 安全训练 :safety(abstract);分类 cs.AI
专题命中 安全训练 :safety(abstract);分类 cs.LG
Comments Videos of our experiments are available at: https://sites.google.com/site/mlleavenotrace/
专题命中 安全训练 :trustworthy(abstract);分类 cs.LG
Comments 9 pages, 10 figures
专题命中 安全训练 :safety(abstract);分类 cs.LG
Comments Accepted to ICML 2017
专题命中 安全训练 :safety(abstract);分类 cs.AI
Comments arXiv admin note: text overlap with arXiv:1501.05120
Journal ref European Journal of Scientific Research, ISSN 1450-216X / 1450-202X Vol.117 No.1 January, 2014, pp. 35-55
专题命中 安全训练 :safety(abstract);分类 cs.LG
Comments 15 pages, 2 figures
专题命中 安全训练 :safety(abstract,journal_ref)
Journal ref 2024 IEEE International Conference on Vehicular Electronics and Safety (ICVES)
专题命中 安全训练 :safety(abstract,comments)
Comments Accepted to the 2024 European Control Conference. See Section VI.B (in particular, Theorem 1, Proposition 2, and Remark 2) for updates incorporating new results (from Reference 3) on almost-sure safety of ZCBFs
机构 * University of California, Berkeley(加州大学伯克利分校) ; Columbia University(哥伦比亚大学) ; Johns Hopkins University(约翰霍普金斯大学)
专题命中 安全训练 :alignment(comments,journal_ref);分类 cs.AI、cs.LG
Comments Accepted by ICML 2025 Workshop on Models of Human Feedback for AI Alignment
Journal ref ICML 2025 Workshop on Models of Human Feedback for AI Alignment
专题命中 安全训练 :safety(abstract)
Comments 5 pages,3 figures, 1 table, CVPR DriveX workshop
Journal ref DriveX Workshop at IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2026
简短公告:拜占庭SMR中隐藏状态授权的公平绑定
专题命中 安全训练 :safety(abstract)
AI总结 针对拜占庭SMR中隐藏状态授权问题,提出公平预留/使用协议,满足授权安全性与先到者活性,解决隐藏资源安全动态分配问题。
Comments Accepted at DISC 2026
面向多区域住宅建筑节能HVAC控制的安全深度强化学习
专题命中 安全训练 :safety(abstract)
AI总结 该研究针对多区域住宅建筑HVAC控制的能耗-安全问题,提出带安全认证的深度强化学习框架,在仿真中训练PPO与SAC智能体,验证了其在降低能耗、减少舒适度违规方面的有效性及安全保证的可行性。
Comments 6 pages, 5 figures. Accepted to IEEE Conference on Control Technology and Applications (CCTA) 2026
先见后答:面向视觉语言模型的无训练视觉层分析
机构 * Leibniz Universität Hannover(汉诺威莱布尼茨大学) ; University of Bath(巴斯大学)
专题命中 安全训练 :alignment(abstract)
AI总结 该研究提出无需训练的视觉数据集熵(VDE)方法,可预测视觉语言模型的最优视觉层,缩小搜索范围,相比GW距离更具实用性。
Comments ECCVW'26 eXCV
面向6G AI-RAN的深度强化学习:一项综合调查
专题命中 安全训练 :trustworthy(abstract)
AI总结 本文针对6G开放AI-RAN,首次开展深度强化学习(DRL)综合调查,梳理DRL基础、O-RAN感知框架、DRL应用分类及相关研究方向,填补了DRL方法论与O-RAN部署间的系统关联空白。
通过以世界模型为中心的自主智能体探索具身智能的认知-物理极限
机构 * K2 Holding, L.L.C(K2控股有限责任公司)
专题命中 安全训练 :safety(abstract)
AI总结 该研究提出以世界模型为中心的自主赛车智能体,结合实车与模拟实验,探索具身智能的认知-物理极限,提升了交互成功率与泛化能力,为安全部署提供边界感知方法。
安全起始:极端风险下决策的优化算法配置
专题命中 安全训练 :safety(abstract)
AI总结 针对极端风险下的随机优化问题,提出基于安全起始的解决方案,结合方差缩减保障运行时间,在投资组合优化和神经网络鲁棒分类中验证了方法有效性。
DiSCo:用于共享自主的扩散序列助手
机构 * University of California, Los Angeles(加州大学洛杉矶分校)
专题命中 安全训练 :alignment(abstract)
AI总结 DiSCo通过扩散策略规划与用户动作一致的动作序列,提升复杂系统控制性能,适用于模拟驾驶和机械臂任务。
Comments 10 pages, 5 figures, HRI '26: Proceedings of the 21st ACM/IEEE International Conference on Human-Robot Interaction
SkillJack:自进化智能体中的持续性技能后门
专题命中 安全训练 :safety(abstract)
AI总结 该研究提出SkillJack攻击,利用自进化智能体的经验转技能流水线植入持续性恶意技能,在SkillX和Anything2Skill上验证其低检测率、高成功率,揭示技能演化为新攻击面。
强化学习目标到达控制与保证Lyapunov-like稳定器的移动机器人
机构 * Faculty of Engineering(工程学院) ; Natural Sciences(自然科学) ; Tampere University(塔尔库大学)
专题命中 安全训练 :safety(abstract)
AI总结 本文提出一种基于强化学习的控制框架,通过Lyapunov-like稳定器保证移动机器人在无结构环境中的目标到达,提升目标到达率至99%
TriCLE:面向边缘部署的细粒度聚类的三模态视觉-语言推理
机构 * Clark Atlanta University(克拉克亚特兰大大学) ; United International University(国际大学) ; North South University(北南大学)
专题命中 安全训练 :alignment(abstract)
AI总结 TriCLE是面向边缘部署的三模态视觉-语言系统,通过生成伪热视图和伪激光雷达深度,结合对齐策略实现细粒度飞机聚类,适配8GB内存边缘设备,验证与测试均取得良好性能。
深度强化学习:从第一性原理到推理模型
专题命中 安全训练 :safety(abstract)
AI总结 本书介绍深度强化学习从经典方法到各类算法及多领域应用的演进,融合基础与研究视角,面向具备相关基础的学生、研究者和工程师。
打破舍入陷阱:保护LLM免受量化条件后门攻击
专题命中 安全训练 :alignment(abstract)
AI总结 提出QuantGuard方法,通过可微舍入控制变量和误差引导的舍入反转约束等机制,在仅使用少量校准数据且不修改量化算法的情况下,阻断后门激活路径,有效降低攻击成功率至接近干净模型水平。
从C到地道Rust:Theseus之船智能体翻译
专题命中 安全训练 :safety(abstract)
AI总结 本文提出一种智能体AI驱动的结构化C到Rust迁移工作流,先生成语义保留的非地道Rust基线,再逐步重写为地道Rust,经12.5千行代码的iodine验证可实现可靠迁移。