arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

共收录 557 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 557 篇

2608.05221 2026-08-07 cs.RO 新提交 50%

A System for Train Condition Monitoring and Structural Health Assessment of Rail Vehicles

轨道车辆的列车状态监测与结构健康评估系统

Maximilian Posner, Martin Dazer, Daniela Lauer, Robert Winkler-Höhn, Mathilde Laporte, Tobias Herrmann, Martin Köppel

机构 * DB InfraGO AG(DB InfraGO股份公司) DB Systemtechnik(DB系统技术公司) MSG Ammendorf(MSG阿门多夫公司)

专题命中 其他安全 :safety(abstract)

AI总结 本文提出一种融合结构传感器技术与AI数据分析的系统,用于轨道车辆状态监测与撞击检测,可自动检测相关事件、支持状态维护及设计优化,助力干线铁路向全自动运行过渡。

Journal ref IEEE Intelligent Vehicles Symposium, Detroit, USA, Jun, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05763 2026-08-07 physics.geo-ph 新提交 50%

Foundation Model-Assisted Full Waveform Inversion

基础模型辅助的全波形反演

Mustafa Alfarhan, Matteo Ravasi, Fuqiang Chen, George Turkiyyah, David Keyes

专题命中 其他安全 :alignment(abstract)

AI总结 该研究提出用预训练地震基础模型SeisLM的特征构建全波形反演早期目标函数,通过实验验证其可避免周期跳变,提升反演效果,优于传统及混合损失工作流。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04622 2026-08-06 cs.CV 新提交 50%

DAC-Pose: Dual-Agent Collaborative Framework for Pose-Guided Human Generation

DAC-Pose:用于姿态引导人体生成的双智能体协作框架

Haotian Yang, Zhile Yang, Huiyu Zhou, Xin Sun

机构 * Faculty of Data Science, City University of Macau(澳门城市大学数据科学学院) Shenzhen University of Advanced Technology(深圳理工大学) Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院) School of Computing and Mathematical Sciences, University of Leicester(莱斯特大学计算与数学科学学院)

专题命中 其他安全 :alignment(abstract)

AI总结 针对姿态引导人体生成在剧烈视角变化下的视觉伪影问题,提出双智能体协作框架DAC-Pose,通过PSR与DAVE智能体的反馈循环实现高保真合成,在DeepFashion和Market-1501基准上验证了其优越性。

Comments Code is available at DAC-Pose" target="_blank" rel="noopener">https://github.com/AIVRC/DAC-Pose

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04483 2026-08-06 cs.CV 新提交 50%

Not All Redundant Tokens Are Alike: Analyzing Visual Token Pruning through Token Roles

并非所有冗余视觉标记都相同:通过标记角色分析视觉标记剪枝

Hyeonyu Kim, Sehwan Lim, Youngwon Choi, Taeyoun Kwon, Jaejin Kim

机构 * Maum AI Inc.(Maum AI公司)

专题命中 其他安全 :alignment(abstract)

AI总结 本研究针对视觉-语言模型(VLMs)的视觉标记剪枝问题,通过EmbedLens分析标记角色,发现代表性剪枝方法存在标记角色偏差但与下游性能无直接关联,优化角色分配后表明保留非活跃标记可维持或提升性能,为剪枝方法优化提供了新视角。

Comments Accepted to ECCV 2026 workshop, UniWorld

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04318 2026-08-06 cs.MA 新提交 50%

Responsibility in Multi-Agent Sequential Decision-Making: Comparing Human Judgments to Formal Models of Causal Attribution

多智能体序贯决策中的责任归属:人类判断与因果归因形式模型的比较

Nripsuta Ani Saxena, Stelios Triantafyllou, Goran Radanović

专题命中 其他安全 :alignment(abstract)

AI总结 本研究对比了多智能体序贯决策中责任归因的形式模型与人类判断的契合度,通过大规模调查和Goofspiel实验识别出影响人类责任判断的关键因素。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03899 2026-08-05 cs.IR 新提交 50%

ATLAS: Learning to Recommend Across Unseen Domains

ATLAS:学习在未见域间进行推荐

Pervez Shaik, Prosenjit Biswas, Abhinav Thorat, Ravi Kolla, Niranjan Pedanekar

专题命中 其他安全 :alignment(abstract)

AI总结 ATLAS是一种多源推荐域泛化框架,无需目标域适配或LLM预训练,可从异构源域学习域不变表示,在未见域零样本推荐中优于多种基线,HitRate平均提升24%。

Comments 18 pages, 5 figures, 14 tables. Includes appendix with proofs and additional experiments

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03143 2026-08-05 cs.CV cs.RO 新提交 50%

From Routes to Steps: Separating Semantic Progress from Local Execution in Vision-and-Language Navigation

从路线到步骤:在视觉语言导航中分离语义进展与局部执行

Xiangyun Huang, Xiangchen Wang, Runfeng Lin, Yihao Xu, Kangyu Huang, Jiang Hengchen, Xiwang Dong, Lin Jiarong

专题命中 其他安全 :alignment(abstract)

AI总结 本研究针对视觉语言导航中进展与执行错误难区分的问题,提出Route2Step框架,通过步骤级接口分离语义进展跟踪与动作生成,在R2R-CE数据集上显著提升了导航性能,且在真实环境中具备实用性。

Comments 16 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03016 2026-08-05 cs.CV 新提交 50%

Clinically-Grounded Hierarchical Classification for Consistent Chest X-ray Interpretation

基于临床依据的分层分类用于一致性胸部X射线影像解读

Jong Hak Moon, Minjun Kim, Minjun Kim

机构 * Yeji X(艺智X)

专题命中 其他安全 :alignment(abstract)

AI总结 本研究针对胸部X射线解读的层级特性,提出CHASE框架,通过三级分类与多层级优化,提升了预测的一致性与性能。

Comments MICCAI 2026 Accepted. First & Corresponding author: Jong Hak Moon (jh.moon@yejix.com)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01988 2026-08-04 cs.CV 新提交 50%

Grounding and Explaining Visual Evidence for AI-Generated Image Detection in Human-Centric Scenes

面向以人为中心场景中AI生成图像检测的视觉证据定位与解释

Kun Guo, Yuzhou Yang, Haoyue Wang, Qichao Ying, Sheng Li, Zhenxing Qian

专题命中 其他安全 :alignment(abstract)

AI总结 针对以人为中心场景AI生成图像检测的证据定位与解释局限,提出HAVE数据集及PAVE框架,实现真伪预测、证据定位与解释生成,实验表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01896 2026-08-04 cs.CV 新提交 50%

GeoCore-9B: Towards Geo-Aware Generative Foundation Models in Earth Observation

GeoCore-9B:面向地球观测的地理感知生成基础模型

Jeonghyeok Do, Munchurl Kim

专题命中 其他安全 :alignment(abstract)

AI总结 本文针对现有EO生成模型的地理空间约束冲突问题,推出90亿参数的GeoCore-9B,采用Flow Matching的DiT与地理空间元数据条件生成,结合地理空间语义对齐损失,在多项EO任务上实现最优性能。

Comments Please visit our project page at https://kaist-viclab.github.io/GeoCore-9B_site/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01636 2026-08-04 cs.RO 新提交 50%

A Forward-Inverse Dynamic Game Framework for Enhanced Multi-Agent Trajectory Planning

用于增强多智能体轨迹规划的前向-逆向动态博弈框架

Tianle Liu, Youcheng Niu, Jing Zeng, Shuo Li, Jinming Xu

机构 * College of Control Science and Engineering, Zhejiang University(浙江大学控制科学与工程学院)

专题命中 其他安全 :safety(abstract)

AI总结 针对多智能体轨迹规划的动态博弈方法局限,本文提出带状态依赖权重的KL正则化动态博弈及上下文感知逆向博弈模块,经模拟与多机器人实验验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01335 2026-08-04 cs.HC 新提交 50%

PartInteractor: Intent-Driven Part-Aware 3D Authoring for Continuous Co-Creation in XR

PartInteractor:面向XR中持续协同创作的意图驱动、部件感知的三维创作工具

Jianan Jiang, Bin Li

专题命中 其他安全 :alignment(abstract)

AI总结 PartInteractor是支持语音、草图、图像输入的部件感知三维创作框架,将语义部件层级作为可操控单元,提升生成后控制与意图一致性,助力XR中持续人机协同创作。

Comments Accepted to ACM UIST 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01306 2026-08-04 cs.CV 新提交 50%

SPAE: Spectrally Guided Autoencoder for Pretrained Visual Latents

SPAE:用于预训练视觉隐层的频谱引导自编码器

Yibin Huang, Jixiang Hong, Zongzhao Li, Yuhan Dai, Zhibin Wang, Chunwei Wang, Jun Song, Chen Wang, Xiaofei Sun, Xiaoxiao Xu, Conghui Zhu

机构 * Alibaba Group(阿里巴巴集团) Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学高瓴人工智能学院)

专题命中 其他安全 :alignment(abstract)

AI总结 针对DiT生成隐层与编码器隐层的频谱不匹配问题,提出SPAE框架,通过紧凑瓶颈结构与通道级掩码策略实现隐层适配,在视觉理解、生成质量与重建保真度间取得良好平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00976 2026-08-04 cs.CV 新提交 50%

Location-Aware Fine-Grained Representation Learning for Medical Vision Foundation Models

面向医学视觉基础模型的位置感知细粒度表示学习

Myeongkyun Kang, Yanting Yang, Xiaoxiao Li

机构 * The University of British Columbia(不列颠哥伦比亚大学) Vector Institute(矢量研究所)

专题命中 其他安全 :alignment(abstract)

AI总结 本研究提出基于位置感知细粒度表示学习的医学视觉基础模型LoFi,构建大规模医学定位数据集MedG,在多项医学视觉任务中性能优于现有模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00775 2026-08-04 cs.RO cs.CV cs.HC 新提交 50%

ORCESTRA: VLM-driven Visual Robot programming in Mixed Reality

ORCESTRA:基于视觉语言模型的混合现实视觉机器人编程系统

Ivan Snegirev, Elizaveta Semenyakina, Mikhail Konenkov, Artem Lykov, Miguel Altamirano Cabrera, Dzmitry Tsetserukou

机构 * Skolkovo Institute of Science and Technology(斯科尔科沃科技学院) R&D Center, MWS(MWS研发中心)

专题命中 其他安全 :safety(abstract)

AI总结 ORCESTRA是一款混合现实系统,通过无代码路径点示教和语言引导控制实现机器人数字孪生编程,支持多种异构机器人,其混合现实验证可作为语言引导机器人物理部署前的安全层。

Comments 4 page, 3 figures, 1 table, ISMAR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00690 2026-08-04 cs.NI 新提交 50%

LLM-Assisted Coalition Formation for Cooperative Perception in Autonomous Driving

大语言模型辅助的自动驾驶协同感知联盟形成

Ahmad Sarlak, Hao Wang, Rahul Amin, Abolfazl Razi

专题命中 其他安全 :safety(abstract)

AI总结 该研究针对现有协同感知方法未优化车辆选择的问题,提出LLM辅助的联盟形成框架,结合DPP与ADMM优化,在OPV2V等数据集上实现更优性能与网络效率。

Comments Accepted for presentation at IEEE Global Communications Conference (GLOBECOM 2026), Cognitive Radio and AI-Enabled Networks Symposium

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00661 2026-08-04 cs.SE 新提交 50%

Unreliable in Practice? A Comprehensive Study of Errors in LLM-Generated Code

实践中不可靠?对大语言模型生成代码中的错误的综合研究

Rodrigo Pato Nogueira, Marco Vieira, João R. Campos

专题命中 其他安全 :safety(abstract)

AI总结 本研究分析7款LLMs生成的86726个含错代码样本,对比不同模型、语言的错误模式,发现大型模型也常犯简单错误,代码常省略关键安全检查,为提升LLM生成代码可靠性提供依据。

Comments Accepted for publication in the 37th IEEE International Symposium on Software Reliability Engineering (ISSRE) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29367 2026-08-03 cs.CV 新提交 50%

SatEdit: Mask-Conditioned Image Editing via VLM-Guided Segment Annotation

SatEdit:基于VLM引导的区域标注的掩码条件卫星图像编辑

Muhammad Talha, Muhammad Ahmed Amer

专题命中 其他安全 :alignment(abstract)

AI总结 SatEdit是基于VLM引导区域标注的卫星图像编辑框架,通过未标注图像构建监督信号,经LoRA微调后在对比中实现最高掩码区域语义对齐,为卫星图像编辑提供了数据高效的可行方案。

Comments 14 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29338 2026-08-03 cs.SE 新提交 50%

BRHC: Backend-driven Reactive Hypermedia Controls with a Statically Typed Kotlin DSL

BRHC:基于后端驱动的反应式超媒体控件与静态类型Kotlin DSL

Fernando Miguel Carvalho, Paulo Carvalho, Leonel Correia, Ricardo Gomes, Juho Vepsäläinen

专题命中 其他安全 :safety(abstract)

AI总结 本研究针对AI辅助编码生成Web应用的复杂性问题,提出基于Kotlin静态类型HTML DSL的后端驱动反应式Web应用方法,可减少JS需求并提升类型安全性。

Comments Submitted to Software: Practice and Experience (Wiley)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29136 2026-08-03 cs.CV 新提交 50%

On the Efficacy of Self-Supervised Point Cloud Encoders for Efficient 3D Large Language Models

自监督点云编码器在高效3D大语言模型中的效能研究

Yao Zheng, Tian Zhang

机构 * Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 其他安全 :alignment(abstract)

AI总结 该研究探究低成本自监督点云编码器能否替代昂贵多模态编码器用于3D-LLM,经实验发现其与架构存在强交互,为高性价比3D-LLM设计提供指南。

Comments 14 pages, 3 figures. This work has been previously released as a preprint on ChinaXiv (No. ChinaXiv:202607.00167, DOI: 10.12074/202607.00167)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28853 2026-08-03 cs.HC 新提交 50%

Spatial Visual Analytics for Multi-Document Summary Verification

面向多文档摘要验证的空间视觉分析技术

Jiahao Xu, Wei Liu, Yang Liu, Eric Krokos, Kirsten Whitley, Xuan Wang, Rebecca Faust, Chris North

专题命中 其他安全 :alignment(abstract)

AI总结 该研究针对多文档摘要验证难题,提出SVS视觉分析系统,含两种二维布局,实验表明其可提升验证准确性、降低工作量,SUMMARY-GUIDED布局综合表现最优。

Comments Accepted to IEEE VIS 2026; 13 pages, including appendices (11-page paper plus 2-page appendices)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28055 2026-07-31 cs.IR 新提交 50%

VIG-RL: Learning to Search and Insert for Verified Image Grounding

VIG-RL:学习搜索与插入以实现可验证的图像定位

Qinhan Yu, Jun Guang, Chong Chen, Wentao Zhang

专题命中 其他安全 :alignment(abstract)

AI总结 本文针对现有检索增强框架无法动态推理视觉证据插入时机与位置的问题,提出自主智能体框架VIG-RL,将相关工作流建模为主动决策过程,经强化学习优化后实现SOTA性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27136 2026-07-30 cs.IR 新提交 50%

KAMR: Grounding Generation via Knowledge-Aligned Multi-hop Retrieval

KAMR:基于知识对齐多跳检索的接地生成

Xiaochen Wang, Yuan Zhong, Haoyu Wang, Ting Wang, Fenglong Ma

专题命中 其他安全 :alignment(abstract)

AI总结 该研究针对多跳检索中三元组排序与监督缺失问题,提出KAMR知识对齐多跳检索器,通过构建部分对齐数据集优化对比目标,在多基准与LLM主干上提升了多跳检索和下游问答性能。

Comments Accepted by COLM'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27122 2026-07-30 cs.CV 新提交 50%

Towards Grounded GI Endoscopy VQA via Multi-Task Learning on Small VLMs

基于小型视觉语言模型多任务学习的 grounded 胃肠道内窥镜视觉问答研究

Itbaan Safwan, Ramail Khan, Muhammad Annas Shaikh, Muhammad Atif Tahir

机构 * Institute of Business and Administration(商业管理学院)

专题命中 其他安全 :alignment(abstract)

AI总结 该研究针对胃肠道内窥镜视觉问答任务,提出多任务微调方案,利用现有数据集构建辅助任务,微调小型视觉语言模型,实现了准确率提升与答案-图像区域对齐优化。

Comments Accepted at EMA4MICCAI 2026 (Workshop on Efficient Medical AI, MICCAI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26111 2026-07-30 cs.SE 新提交 50%

Validating ETCS Data with the B Mathematical Language: An Industrial Pipeline and a Blueprint for LLM Integration

用B数学语言验证ETCS数据:工业流水线与大语言模型集成蓝图

Thierry Lecomte, Vincent Germain

专题命中 其他安全 :safety(abstract)

AI总结 本文报告CLEARSY公司ValidAItion项目进展,将ERTMS操作模拟器与CLEARSY数据求解器桥接,用B语言验证ETCS数据,Claude生成规则库,工具链与人工审核裁决,形式化规则为事实来源,大模型为受管控助手。

Comments Submitted and accepted to DisCoRail @ISOLA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25355 2026-07-29 cs.SD 新提交 50%

From Semantics to Readout: Mechanistic Understanding of Audio Tokens after Fine-Tuning for Temporal Audio Grounding

从语义到读出:时间音频接地微调后音频令牌的机制理解

Yujian Ma, Jinqiu Sang, Ruizhe Li, Jiaao Yu, Ang Li

专题命中 其他安全 :alignment(abstract)

AI总结 研究大型音频语言模型中音频令牌在微调后的机制,通过四种分析研究其分层语义等,发现微调前已有潜在证据,微调后解码器更易访问事件信息,支持从语义到读出的解释,有助于解码器连接时间输出。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24617 2026-07-28 cs.IR 新提交 50%

LaRec: Unleashing LLM-based Latent Reasoning for Generative Recommendation

LaRec:释放基于大语言模型的生成式推荐中的潜在推理能力

Yu Xia, Zihan Lin, Wei Yang, Rui Zhong, Cheng Chen, Huan Ren, Yao Hu

专题命中 其他安全 :alignment(abstract)

AI总结 研究针对LLMs在推荐中现有方法的问题,提出LaRec框架。核心方法是通过潜在预训练赋予潜在推理能力,用个性化强化学习调整引导遍历多样推理路径。主要贡献是在多数据集实验中,以相当效率显著超越现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24611 2026-07-28 cs.CV 新提交 50%

Test-Time Adaptation via Dual Distillation for Videos Under Severe Distribution Shifts

通过双重蒸馏实现严重分布偏移下视频的测试时自适应

André Sacilotti, Samuel Felipe dos Santos, Jurandy Almeida

机构 * University of São Paulo(圣保罗大学) Federal University of São Carlos(圣卡洛斯联邦大学)

专题命中 其他安全 :alignment(abstract)

AI总结 研究针对视频在严重分布偏移下测试时自适应难题,提出双重蒸馏的测试时自适应框架TADD,依赖轻量级投影适配器及互补损失适应目标域,在多个视频动作识别基准测试中优于现有TTA基线,显著提升识别准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23930 2026-07-28 eess.SY cs.RO cs.SY 新提交 50%

Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping

通过可行动作映射桥接强化学习与最优控制

Stefan Richter, Alberto Giammarino, Guillem Torrente, Sam Blakeman, Peter Dürr

专题命中 其他安全 :safety(abstract)

AI总结 针对操作受约束动态系统,提出FAOC框架,整合RL与OC。通过计算高效映射算法,将RL动作转换为OCP可行参数集,兼顾安全性与灵活性。应用于机器人乒乓球运动规划,模拟实验显示其在样本效率和闭环性能上优于现有基准。

Comments 26 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23451 2026-07-28 cs.CV 新提交 50%

Multi-Modal Object Re-Identification with Prompt-S6 and Semantic-Aware Knowledge Guidance

基于Prompt-S6和语义感知知识引导的多模态目标重识别

Weixiang Zhou, Jiabei Zuo, Yuhao Wang, Cong Wang, Huchuan Lu, Zhixun Su

专题命中 其他安全 :alignment(abstract)

AI总结 研究多模态目标重识别问题,提出基于Prompt-S6和语义感知知识引导的PRISM框架,设计语义驱动令牌剪枝和渐进融合网络两个关键组件,有效抑制背景干扰,实现三模态对齐,提升多模态目标重识别的有效性和效率。

Comments Accepted by IEEE TIP 2026. The version of record may differ slightly

详情

展开后加载摘要…

URL PDF HTML 收藏