arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-08-11 至 2026-08-11 共收录 192 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 39 篇

2608.09821 2026-08-11 eess.SP 新提交 50%

An open-source, scalable workflow for organizing echosounder data for machine learning applications

面向机器学习应用的开源可扩展声呐数据处理工作流

Caesar Tuguinay, Wu-Jung Lee, Valentina Staneva, Elizabeth M. Phillips, Rebecca E. Thomas, Alicia Billings, Julia Clemons

专题命中 其他安全 :alignment(abstract)

AI总结 该研究提出一种两阶段开源工作流,基于Echopype和Echoregions库构建可扩展的机器学习就绪回声测深数据集,含数据划分与掩码创建,提供教程验证其可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08225 2026-08-11 eess.SP cs.SY eess.SY 新提交 50%

Toward Intelligent Skies: Signal Processing and AI Foundations of Low-Altitude Wireless Networks

迈向智能天空:低空无线网络的信号处理与人工智能基础

Weijie Yuan, Geng Sun, Jiacheng Wang, Jun Wu, Yuanhao Cui, Jiahui Li, Wei Zhang, George K. Karagiannidis, Sumei Sun, Yonina C. Eldar

专题命中 其他安全 :safety(abstract)

AI总结 本教程从AI与信号处理视角,全面阐述低空无线网络(LAWN)的架构基础、信号处理与AI技术,结合案例分析其融合应用,指出未来发展挑战与机遇。

Comments Invited Overview Paper in JSTSP

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08950 2026-08-11 cs.SE 新提交 50%

Independent Patch Verification for Coding Agents with a Bidirectional Reconstruct-and-Verify Framework

基于双向重构-验证框架的代码智能体独立补丁验证

Chenglin Li, Yisen Xu, Zehao Wang, Shin Hwei Tan, Tse-Hsun, Chen

专题命中 其他安全 :alignment(abstract)

AI总结 本研究针对代码智能体生成补丁后缺乏独立验证的问题,提出无需训练的RETRACE双向重构-验证框架,在SWE-bench Verified等基准上显著提升了代码补丁的正确性。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08701 2026-08-11 cs.RO 新提交 50%

Anchor-Based AI Approach for Pre-Crash Object Detection Utilizing Micro-Doppler Signatures in Automotive Radar

基于锚的人工智能方法:利用汽车雷达中的微多普勒特征进行碰撞前目标检测

Patrick Zaumseil, Rainer Engert, Dagmar Steinhauser, Jonathan Wache, Soumya Dewangan, Thomas Brandmeier

专题命中 其他安全 :safety(abstract)

AI总结 该研究提出基于锚的AI模型,结合雷达微多普勒特征与创新雷达图像膨胀技术,提升碰撞前目标检测性能,在动态场景中优于现有汽车雷达跟踪方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08663 2026-08-11 cs.HC cs.CV 新提交 50%

A Dynamic-Semantics Framework for Grounding Human Referring Expressions in Visual Perceptual Data

用于在视觉感知数据中建立人类指代表达式基础的动态语义框架

Joseph Bingham

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出动态语义框架,通过显式约定状态绑定集合与感知对齐流程,解决视觉-语言模型在词汇同步任务中的不足,在斯坦福重复参考游戏语料库上达到83.56%的top-5准确率,核心是透明符号层与可检查感知通道的结合。

Comments 23 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08462 2026-08-11 cs.AR 新提交 50%

ARMOR: Accelerating RTL Simulation by Mitigating the Front-End Bottleneck Using Node Compression

ARMOR:通过节点压缩缓解前端瓶颈以加速RTL仿真

Jiaping Tang, Jianan Mu, Zhiteng Chao, Jingzhong Wen, Jing Ye, Huawei Li

专题命中 其他安全 :alignment(abstract)

AI总结 ARMOR是一款通过节点压缩缓解前端瓶颈的高效RTL仿真器,利用比特级数据并行性压缩节点,在CPU和AI加速器设计上分别实现1.6倍和2.7倍加速。

Comments Accepted by 2026 59th IEEE/ACM International Symposium on Microarchitecture (MICRO)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08418 2026-08-11 cs.CV 新提交 50%

Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information

用于结合文本信息的图像聚类的深度模态共享自表达学习

Xianghan Meng, Wei He, Zhiyuan Huang, Chun-Guang Li

专题命中 其他安全 :alignment(abstract)

AI总结 提出DeepMORSE方法,通过模态共享自表达模型学习结合文本信息的图像聚类,在6个基准数据集上聚类性能提升超3%,且所学表示可迁移至下游任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07554 2026-08-11 cs.CV cs.RO 新提交 50%

Impact of Dataset Composition on Embedded Real-Time UAV Wildfire Detection Using Compact YOLO Models

数据集组成对采用轻量YOLO模型的嵌入式实时无人机野火检测的影响

Eduardo de los Santos, Andre S. Kelbouscas, Ricardo B. Grando, Bruna V. Guterres

机构 * Technological University of Uruguay(乌拉圭技术大学)

专题命中 其他安全 :alignment(abstract)

AI总结 该研究以轻量YOLO模型为对象,探究数据集组成对嵌入式实时无人机野火检测的影响,发现真实未增强数据集的检测性能最优,合成数据混合与图像增强均未提升部署效果,数据集真实性和领域对齐更具价值。

Comments Paper accepted at the ICCAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06939 2026-08-11 cs.CV 版本更新 50%

Degradation-Aware Prompt Learning with Cross-Modal Compensation for Adverse Weather Removal

面向恶劣天气去除的退化感知跨模态补偿提示学习

Wanshu Fan, Yunzhe Zhang, Yue Shen, Liyan Wang, Jing Qin, Kin-Man Lam, Cong Wang, Jinshan Pan

机构 * School of Software Engineering, Dalian University(大连大学软件工程学院) School of Mathematical Sciences, Dalian University of Technology(大连理工大学数学科学学院) The Hong Kong Polytechnic University(香港理工大学) University of California, San Francisco(加利福尼亚大学旧金山分校) School of Computer Science and Engineering, Nanjing University of Science and Technology(南京理工大学计算机科学与工程学院)

专题命中 其他安全 :alignment(abstract)

AI总结 该研究针对恶劣天气导致图像退化影响视觉系统可靠性的问题,提出 DCMPC-Net 模型,通过跨模态提示补偿实现鲁棒的恶劣天气图像修复,性能优于现有最先进方法。

Comments Accepted for publication in IEEE Transactions on Image Processing. The code is available at: https://github.com/fanamber831/DCMPC-Net

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18566 2026-08-11 eess.SY cs.SY 版本更新 50%

HJ-Gauss: A Monte-Carlo HJ Reachability Scheme

HJ-Gauss: 一种蒙特卡洛HJ可达性方案

Lekan Molu, Venkatraman Renganathan, Namhoon Cho

专题命中 其他安全 :safety(abstract)

AI总结 本文提出了一种基于局部PDE线性化的方法,通过冻结系数采样方案解决高维系统中经典网格基HJ求解器内存消耗大的问题,实现了存储和网格无关的算法,适用于高维可达性分析。

Comments NeurIPS 2026 Submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22632 2026-08-11 cs.IR 版本更新 50%

Fine-grained Semantics Integration for Large Language Model-based Recommendation

细粒度语义集成用于基于大语言模型的推荐

Jiawei Feng, Xiaoyu Kong, Leheng Sheng, Bin Wu, Chao Yi, Feifang Yang, Xiang-Rong Sheng, Han Zhu, Xiang Wang, Jiancan Wu, Xiangnan He

专题命中 其他安全 :alignment(abstract)

AI总结 TS-Rec通过细粒度语义集成提升基于LLM的推荐系统性能

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03847 2026-08-11 cs.SI 50%

Event-aware analysis of cross-city visitor flows using large language models and social media data

Xiaohan Wang, Zhan Zhao, Ruiyu Wang, Yang Xu

专题命中 其他安全 :safety(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏