SARA: Semantically Adaptive Relational Alignment for Video Diffusion Models
SARA: 语义自适应关系对齐用于视频扩散模型
机构 * Tencent Hunyuan(腾讯文英)
专题命中 其他安全 :alignment(title,abstract)
AI总结 提出SARA方法,通过文本条件显著性引导令牌对监督,提升视频扩散模型的文本对齐和运动质量。
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
SARA: 语义自适应关系对齐用于视频扩散模型
机构 * Tencent Hunyuan(腾讯文英)
专题命中 其他安全 :alignment(title,abstract)
AI总结 提出SARA方法,通过文本条件显著性引导令牌对监督,提升视频扩散模型的文本对齐和运动质量。
保持几何结构的异质基础模型无监督对齐
机构 * Yunnan Normal University, Kunming, China(云南师范大学,昆明,中国) ; Kunming University of Science and Technology, Kunming, China(昆明理工大学,昆明,中国)
专题命中 其他安全 :alignment(title,abstract)
AI总结 提出GPUA框架,通过正交映射将视觉基础模型特征对齐到视觉语言模型语义空间,无需标签或参数更新,提升跨模型兼容性并在零样本识别与分割任务中取得显著增益。
Comments Accepted at ICML 2026
神经网络控制系统可达性分析与安全性验证
专题命中 其他安全 :safety(title,abstract)
AI总结 本文提出利用线性规划算法对神经网络控制器的可达集进行过近似,并结合常微分方程模型进行闭环系统可达集估计,最终通过检查估计可达集与不安全区域的交集实现神经网络控制系统的安全性验证。
Comments 21 pages, 6 figures
基于可达性的无人机编队安全性和目标满足性研究
专题命中 其他安全 :safety(title,abstract)
AI总结 本文提出利用空气高速路结构对无人机编队进行 tractable 分析,通过混合系统模型和 Hamilton-Jacobi 可达性方法,确保编队在不同模式转换中的安全性和目标满足性,同时通过仿真验证了该方法的有效性。
Comments American Institute of Aeronautics and Astronautics Journal of Guidance, Control, and Dynamics, January 30, 2017
SafeGuardPF: 保障安全的反应势场用于未知和动态环境中的移动机器人
专题命中 其他安全 :safety(title,abstract)
AI总结 本文提出SafeGuardPF方法,通过将反应势场运动控制器建模为混合自动机,并利用微分动态逻辑形式化验证其安全性,确保机器人在动态环境中避免碰撞。
Comments 8 pages, 9 figures, Submitted for publication in 2017 American Control Conference (ACC2017)
高维中对齐模型的稀疏控制
专题命中 其他安全 :alignment(title,abstract)
AI总结 本文提出在高维空间中通过随机线性映射降低维度,实现对共识涌现模型的稀疏控制,以高效引导系统趋近共识。
Comments 39 pages
GAP3D: 将VLM潜在表示与补丁级嵌入进行生成式对齐以实现3D生成
机构 * Polytimi Anna Gkotsi ; Andrii Zadaianchuk ; Mohammad Mahdi Derakhshani
专题命中 其他安全 :alignment(title,abstract)
AI总结 提出GAP3D,一种基于扩散的模块化方法,将VLM生成的潜在表示直接对齐到预训练图像编码器的完整补丁级特征空间,使冻结的下游生成模型能够利用VLM作为提示编码器,同时保持空间结构化的条件信号,在3D资产生成中无需大规模3D数据训练,并展现出多模态提示的零样本能力。
通过打破尾部对齐改进CLIP适应:用于源无关跨域小样本学习
机构 * School of Computer Science and Technology, Huazhong University of Science and Technology, Wuhan, China(华中科技大学计算机科学与技术学院) ; Institute of Artificial Intelligence, Huazhong University of Science and Technology, Wuhan, China(华中科技大学人工智能研究院)
专题命中 其他安全 :alignment(title,abstract)
AI总结 针对CLIP在跨域小样本学习中的性能下降问题,提出自适应尾头对齐策略(ATHA),通过有选择地削弱低相似度图像令牌的对齐来减少过拟合,在四个基准上取得最优结果。
Comments Accepted by ICML 2026
监督分类头作为语义原型:通过权重重用解锁视觉-语言对齐
机构 * Department of Computer Science and Artificial Intelligence, DaSCI Institute, University of Granada, Granada, Spain(计算机科学与人工智能系,DaSCI研究所,格拉纳达大学,格拉纳达,西班牙) ; Department of Mathematics ``Tullio Levi-Civita'', University of Padova, Padova, Italy(托里利-西维塔数学系,帕多瓦大学,帕多瓦,意大利)
专题命中 其他安全 :alignment(title,abstract)
AI总结 本文提出利用预训练视觉模型的分类头作为语义原型,通过权重重用实现视觉-语言对齐,提升跨模态检索、零样本和少样本分类任务的性能。
基于超高清图像合成的空间图对齐
机构 * Beihang University(北航大学)
专题命中 其他安全 :alignment(title,abstract)
AI总结 本文提出空间图对齐(SGA)方法,通过利用视觉基础模型的表示先验,保留LDMs的生成能力,解决超高清图像合成中生成质量与结构完整性之间的冲突,实现高质量的文本到图像合成。
Comments Technical Report
Tango3D: 向全局和局部2D-3D对应关系对齐迈进
机构 * HKUST(香港科技大学) ; Tencent Hunyuan(腾讯混元)
专题命中 其他安全 :alignment(title,abstract)
AI总结 本文提出Tango3D,一种统一密集对应和全局检索的3D基础模型,通过几何感知的2D视觉骨干网络和预训练的3D VAE将图像编码为2D片段,点云编码为3D标记,并映射到共享空间以实现局部像素-点对齐和全局语义对齐。
具有方向加权对齐的主动物质集体动力学
专题命中 其他安全 :alignment(title,abstract)
AI总结 研究一种具有速度依赖对齐规则的基于代理的自驱动粒子模型,通过调整对齐强度产生多种集体状态,包括无序气体态、有序编队、高密度阻塞态和具有活性晶体行为的密集有序移动簇。
Comments 8 pages, 5 figures
超越点对点匹配:为加速扩散变换器的结构表示对齐
机构 * University of Science and Technology of China(中国科学技术大学)
专题命中 其他安全 :alignment(title,abstract)
AI总结 本文提出sREPA框架,通过显式结构约束来对齐特征图的相对几何关系,以提高生成质量并加速收敛。
预训练到对齐学习范式以提高在稀少实地标签和合成到实地差距下的地球物理AI适用性:全球岸缘cline-thems中相对地质时间估计的案例研究
专题命中 其他安全 :alignment(title,abstract)
AI总结 本文提出了一种预训练到对齐的学习范式,通过整合自监督预训练、合成监督、先验驱动细化和领域适应微调,提升地球物理AI在稀少实地标签和合成到实地差距下的适用性,通过全球岸缘cline-thems中相对地质时间估计的案例研究验证了该范式的有效性。
Comments 50 pages, 9 figures
COAL: 基于反事实和观察增强的对齐学习用于判别性参照多目标跟踪
机构 * School of Automation, Southeast University, Nanjing, China(东南大学自动化学院,南京,中国) ; Key Laboratory of Measurement and Control of Complex Systems of Engineering, Ministry of Education, Nanjing, China(工程复杂系统测量与控制国家重点实验室,教育部,南京,中国) ; School of Physical & Mathematical Sciences, Nanyang Technological University, Singapore(南洋理工大学物理与数学科学学院,新加坡) ; Big Data Institute, Central South University, Changsha, China(中南大学大数据研究院,长沙,中国)
专题命中 其他安全 :alignment(title,abstract)
AI总结 COAL通过知识正则化解决RMOT中高判别性需求与稀疏语义监督的矛盾,引入显式语义注入和反事实学习提升多目标跟踪的判别能力。
RAPO++: 通过数据对齐和测试时缩放实现文本到视频生成的跨阶段提示优化
机构 * Shanghai Jiao Tong University(上海交通大学) ; Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
专题命中 其他安全 :alignment(title,abstract)
AI总结 RAPO++通过数据对齐和测试时缩放,结合训练数据对齐、测试时迭代缩放和大语言模型微调,提升文本到视频生成效果,无需修改生成基础模型。
Comments arXiv admin note: text overlap with arXiv:2504.11739
JACoP:联合对齐的合规多智能体预测
机构 * Rutgers University, New Brunswick(新泽西州罗格斯大学) ; The College of New Jersey(新泽西州学院)
专题命中 其他安全 :alignment(title,abstract)
AI总结 JACoP通过多阶段框架确保场景级合理性,结合锚点基于的智能体中心分析器和马尔可夫随机场对齐器,有效减少环境和社交冲突,提升多智能体轨迹预测的合规性与实用性。
Comments Accepted by CVPRF 2026
AutoSOUP:面向组件级内存安全验证的安全导向单元证明
专题命中 其他安全 :safety(title,abstract)
AI总结 AutoSOUP通过安全导向单元证明自动化组件级内存安全验证,结合确定性程序合成与LLM,生成可验证的证明以提高内存安全验证的自动化水平。
Comments 13 main pages, 7 appendix pages, 2 figures, 5 listings
超几何空间中的语义对齐用于开放词汇语义分割
机构 * Fulbright University Vietnam(富布赖特大学越南分校)
专题命中 其他安全 :alignment(title,abstract)
AI总结 本文提出HyRo框架,通过解耦超几何空间中的层次和语义对齐,提升开放词汇语义分割性能。
Comments Accepted to the PVUW Workshop at CVPR 2026. Project page: https://tmhoanggg.github.io/HyRo/
Proxy3D: 通过语义聚类和对齐实现视觉-语言模型的高效3D表示
机构 * Tsinghua University(清华大学) ; Panasonic AI Lab(松下人工智能实验室) ; Panasonic DX-CPS(松下DX-CPS) ; UC Berkeley(伯克利大学)
专题命中 其他安全 :alignment(title,abstract)
AI总结 本文提出Proxy3D方法,通过语义和几何编码器提取场景特征并进行语义感知聚类,生成紧凑且全面的3D代理表示,提升视觉-语言模型在3D视觉问答、视觉定位和空间智能任务中的性能。
Comments Accepted by CVPR 2026. Project page: https://wzzheng.net/Proxy3D
CommandSwarm: 为机器人群体提供安全意识的自然语言到行为树生成
专题命中 其他安全 :safety(title,abstract)
AI总结 本文提出CommandSwarm系统,通过多语言翻译、安全过滤和约束提示生成XML行为树,验证了紧凑量化领域适应的LLM在机器人群体控制中的有效性,强调了解析器接受和安全过滤的重要性。
因果涌现对齐假说:因果涌现与强化学习代理最终奖励对齐并预测
专题命中 其他安全 :alignment(title,abstract)
AI总结 研究探讨因果涌现与强化学习代理奖励之间的关系,发现因果涌现能预测最终奖励并促进表示动态与奖励提升对齐。
Comments 10 pages, 6 figures
无需编码对齐的解码对齐:对神经科学中相似性分析的批评
专题命中 其他安全 :alignment(title,abstract)
AI总结 本文指出解码相似性分析的局限性,揭示解码表示可能受少量神经元影响,提出编码 manifold 作为对比神经系统的补充工具。
Comments 40 pages, 27 figures
方向对齐与人类-大语言模型共写中的叙事自主性
专题命中 其他安全 :alignment(title,abstract)
AI总结 研究人类-大语言模型共写中的叙事自主性,探讨谁主导故事发展。通过87个共写故事分析,发现人类引入更多语义新颖性,而大语言模型则扩展人类元素,情感层面也呈现双向互动。
Comments 11 pages, 13 figures
重新思考语义协作整合:为什么对齐不够
专题命中 其他安全 :alignment(title,abstract)
AI总结 本文挑战了传统语义与协作表示对齐的假设,提出互补融合视角,强调共享与私有因素的区分,通过实验揭示语义与协作视图的低一致性及互补性,倡导以互补性为核心的推荐系统设计。
Comments Accepted by SIGIR 2026
基于ISO合规感知-计算-控制架构的LLM引导安全代理用于边缘机器人
机构 * Shanghai Jiao Tong University(上海交通大学) ; SIMMIR Tech(SIMMIR科技)
专题命中 其他安全 :safety(title,abstract)
AI总结 本文提出一种基于ISO合规架构的LLM引导安全代理,通过将安全规范转化为可执行谓词,实现边缘机器人中的功能安全,支持ISO 13849 Category 3和PL d的实用部署。
从某处获取标签:反思性标注用于情境化AI对齐
专题命中 其他安全 :alignment(title,abstract)
AI总结 本文通过反思性标注方法探讨 annotator 的社会位置如何影响标注判断,发现其能捕捉超越静态人口统计数据的元数据,并揭示标注者的位置谦逊与观点转变。
弥合时空:解耦的时空对齐用于视频定位
机构 * Shanghai Jiao Tong University(上海交通大学) ; ZTE Corporation(中兴通讯)
专题命中 其他安全 :alignment(title,abstract)
AI总结 本文提出Bridge-STG框架,通过解耦时空定位并保持语义连贯性,解决视频定位中时空对齐和视觉token冗余问题,实验表明其在多个基准上达到SOTA性能。
MApLe:多实例诊断报告与大医学图像的对齐
机构 * Computational Imaging Research Lab, Department of Biomedical Imaging and Image-guided Therapy, Medical University of Vienna(计算成像研究实验室,生物医学成像与影像引导治疗系,维也纳医学大学) ; Comprehensive Center for Artificial Intelligence in Medicine, Medical University of Vienna(医学人工智能综合中心,维也纳医学大学) ; Medical Anomaly Detection (MANO) Group, Computational Imaging Research (CIR), Department of Biomedical Imaging and Image-guided Therapy, Medical University of Vienna(医学异常检测(MANO)组,计算成像研究(CIR),生物医学成像与影像引导治疗系,维也纳医学大学) ; Department of Biomedical Imaging and Image-Guided Therapy, Medical University of Vienna(生物医学成像与影像引导治疗系,维也纳医学大学)
专题命中 其他安全 :alignment(title,abstract)
AI总结 MApLe通过多任务多实例对齐方法,解决诊断报告与图像局部区域的关联问题,提升医学图像与文本的对齐性能。
Comments Accepted for MIDL 2026; Reviews available at https://openreview.net/forum?id=M8OO3CRbL9#discussion
TIPSv2:通过增强的补丁-文本对齐推进视觉-语言预训练
机构 * Google(谷歌) ; DeepMind(深度Mind)
专题命中 其他安全 :alignment(title,abstract)
AI总结 本文提出TIPSv2,通过改进的预训练方法提升视觉-语言模型的补丁-文本对齐能力,实验表明其在多种任务和数据集上表现优异。
Comments CVPR2026 camera-ready + appendix