arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-03-30 至 2026-03-30 共收录 6 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 6 篇

2510.03223 2026-03-30 cs.CL cs.AI 62%

Attention-Aligned Reasoning for Large Language Models

面向大语言模型的注意力对齐推理

Hongxiang Zhang, Yuan Tian, Tianyi Zhang

机构 * Purdue University(普渡大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 本文提出ATAR方法,通过利用推理结构引导LLM注意力,提升复杂任务处理性能,实验显示在六个基准上表现优于现有方法,且非推理模型性能可与推理模型媲美。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08222 2026-03-30 cs.AI 57%

Selection, Reflection and Self-Refinement: Revisit Reasoning Tasks via a Causal Lens

选择、反思与自我完善:通过因果视角重新审视推理任务

Yunlong Deng, Boyang Sun, Yan Li, Lingjing Kong, Zeyu Tang, Kun Zhang, Guangyi Chen

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Carnegie Mellon University(卡内基梅隆大学) Stanford University(斯坦福大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文从因果视角重新审视推理任务,将其视为选择机制,通过引入潜变量反馈提升对潜在依赖关系的学习,显著提升了Sudoku和Maze任务的推理准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25931 2026-03-30 cs.CV cs.AI 57%

DiReCT: Disentangled Regularization of Contrastive Trajectories for Physics-Refined Video Generation

DiReCT:对比轨迹解耦的对比正则化用于物理精细视频生成

Abolfazl Meyarian, Amin Karimi Monsefi, Rajiv Ramnath, Ser-Nam Lim

机构 * Path Robotics The Ohio State University(俄亥俄州立大学) University of Central Florida(中佛罗里达大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文提出DiReCT方法,通过解耦对比轨迹正则化提升物理精细视频生成的物理合理性,改进VideoPhy的物理常识评分。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13622 2026-03-30 cs.CV cs.AI 57%

CARPE: Context-Aware Image Representation Prioritization via Ensemble for Large Vision-Language Models

CARPE:通过集成实现上下文感知的图像表示优先级

Donghee Lee, Rui Cai, Zhe Zhao

机构 * University of California, Davis(加州大学戴维斯分校)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 CARPE通过集成机制增强大视觉-语言模型对视觉和文本模态的自适应加权能力,提升图像分类和多模态任务表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24399 2026-03-30 eess.SY cs.SY 50%

Autonomous Detection and Coverage of Unknown Target Areas by Multi-Agent Systems

多智能体系统自主探测和未知目标区域覆盖

Jie Song, Yang Bai, Mikhail Svinin, Naoki Wakamiya

专题命中 其他安全 :safety(abstract)

AI总结 本文提出了一种新型多智能体覆盖控制算法,使智能体能自主探测目标区域并协同实现全面覆盖,结合密度驱动机制与CVT实现最优空间分布,利用CBFs确保安全性和效率。

Comments 8 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25819 2026-03-30 cs.CV 50%

Geo$^\textbf{2}$: Geometry-Guided Cross-view Geo-Localization and Image Synthesis

Geo²:基于几何的跨视角地理定位与图像合成

Yancheng Zhang, Xiaohan Zhang, Guangyu Sun, Zonglin Lyu, Safwan Wshah, Chen Chen

机构 * Institute of Artificial Intelligence, University of Central Florida(中佛罗里达大学人工智能研究所) University of Vermont(佛蒙特大学)

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出Geo²框架,利用几何先验知识联合完成跨视角地理定位和双向图像合成,通过共享3D感知潜在空间和GeoFlow模型提升性能。

Journal ref 2026 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR)

详情

展开后加载摘要…

URL PDF HTML 收藏