arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-07-15 至 2026-07-15 共收录 12 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 12 篇

2607.12086 2026-07-15 cs.CL cs.CY cs.MA cs.SI 新提交 62%

CityBehavEx: A Scalable and Empirically Validated LLM-Assisted Urban Simulation Platform

CityBehavEx:一个可扩展且经过实证验证的基于大语言模型的城市模拟平台

Gustavo H. Santos, Aline Viana, Thiago H Silva

机构 * UTFPR(巴拉那联邦理工大学) Inria(法国国家信息与自动化研究所) University of Toronto(多伦多大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.CY

AI总结 CityBehavEx平台针对基于大语言模型的城市模拟器扩展成本高和验证薄弱问题,结合人类出行模型与交叉编码器,实现大规模模拟,能生成更贴合现实的出行模式,还允许用户进行多种操作及验证。

Comments 10 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11893 2026-07-15 cs.CL cs.AI 新提交 62%

I'm Sorry, but I Can't Help with Braille: Revealing Accessibility Failures in State-of-the-Art LLMs

对不起,我无法处理盲文:揭示当前最先进语言模型中的无障碍性缺陷

Abdullah Abdullah

机构 * orinu Inc.(奥里努公司)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 研究评估先进语言模型在韩语-盲文翻译上的表现,发现其存在缺陷。通过人工标注数据集测试,发现输出差且不稳定。对比发现,对小模型进行监督微调效果更好,揭示了当前语言模型的局限,证明特定监督的有效性。

Comments Accepted at the LTEDI Workshop at ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12180 2026-07-15 cs.HC cs.AI 新提交 57%

TRAIL: A Platform for Configurable Human--AI Teaming Experiments

TRAIL:一个用于可配置人机协作实验的平台

Mohammad Amin Samadi, Pedro Martins De Bastos, Jaeyoon Choi, Spencer JaQuay, Seehee Park, Nia Nixon

机构 * School of Education, University of California, Irvine(加州大学伊文斯分校教育学院)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 研究人工智能队友设计属性对团队的影响,TRAIL平台将大五人格等与多种实验方法结合,在课堂部署中实现纵向链式实验、文本相似性分析等,发现不同人格代理对团队有不同影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11899 2026-07-15 physics.ao-ph cs.LG 新提交 57%

Predictive Modeling of High-Altitude Clear Air Turbulence in the United States: A Machine Learning Approach

美国高空晴空湍流的预测建模:一种机器学习方法

Kadir Gokdeniz, Irem Ulku

专题命中 其他安全 :safety(abstract);分类 cs.LG

AI总结 该研究利用机器学习模型,基于飞行员报告、ERA5再分析数据和飞机空气动力学参数,对美国200 - 350百帕压力水平下的高空晴空湍流进行预测建模,梯度提升算法表现最佳,强调了地理坐标等因素作用,凸显机器学习在CAT预测中的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12682 2026-07-15 cs.LG 版本更新 57%

RAFP: Identifying LLM Lineages via Rare-Region Fingerprints

RAFP:通过稀有区域指纹识别大语言模型谱系

Yun-Yun Tsai, Jia Hao Liang, Chuan Guo, Junfeng Yang, Laurens van der Maaten

机构 * Department of Computer Science, Columbia University, USA(哥伦比亚大学计算机科学系) Meta, USA(Meta公司)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 针对大语言模型所有权验证需求,提出RAFP框架,利用稀有区域指纹识别模型谱系。该方法非侵入性,通过离散梯度优化构建指纹,理论分析表明其在微调下似然变化有界,实验显示在黑盒设置中性能优于基线。

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12460 2026-07-15 cs.SE 新提交 50%

CodeOwl: Automatic Generation of Tiered Parsons Problems for Introductory Programming

CodeOwl:用于编程入门的分层帕森斯问题自动生成

Luca Cisternino, Florian Obermüller, Gordon Fraser

专题命中 其他安全 :alignment(abstract)

AI总结 针对编程教育中学习者异质性难题,介绍CodeOwl这一人工智能驱动工具自动生成分层帕森斯问题,经混合方法框架评估,该工具生成的问题难度提升效果好,获专家、教师和学生认可,不过教师和学生也分别提出了改进意见。

Comments To appear at the 38th CSEE&T

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12429 2026-07-15 cs.CV 新提交 50%

More Than Where You Are: Learning Semantics, Structure, and Geometry from Cross-View Localization

不仅仅是你在哪里:从跨视图定位中学习语义、结构和几何

Mao Chen, Xiangkai Zhang, Zhiyong Liu, Chuankai Liu, Xu Yang

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) Beijing Aerospace Control Center(北京航天飞行控制中心)

专题命中 其他安全 :alignment(abstract)

AI总结 研究如何在极端视角变化下通过跨视图定位让模型学习语义、结构和几何。提出CROSS框架,克服现有方法局限,经实验验证该框架在跨视图定位中性能最优,能有效学习多方面内容。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12418 2026-07-15 cs.CV 新提交 50%

MQAdapter: Multi-Modal Quantum Adapter for Coarse-to-Fine VLM Fine-tuning

MQAdapter:用于从粗到细的视觉语言模型微调的多模态量子适配器

Yumiao Zhao, Bo Jiang, Min Lu, Xiao Wang, Jin Tang

机构 * Anhui University(安徽大学) Origin Quantum Computing Company Limited(本源量子计算有限公司)

专题命中 其他安全 :alignment(abstract)

AI总结 针对视觉语言模型在少样本学习中细粒度区分不足的问题,提出多模态量子适配器MQAdapter。先检索Top-K候选类别作语义锚点,再用跨模态量子学习机制,利用量子特性建模高阶交互,细化视觉特征,参数高效且能集成现有算法提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12221 2026-07-15 cs.HC 新提交 50%

From Chaos to Clarity: A Framework for Program-Level AI Learning Outcomes

从混乱到清晰:程序级人工智能学习成果框架

Grace Barkhuff, Ian Pruitt, William Gregory Johnson, Rodrigo Borela, Ben Rydal Shapiro, Anu G. Bourgeois

专题命中 其他安全 :alignment(abstract)

AI总结 针对高等教育中缺乏明确人工智能准备界定结构的问题,提出程序级人工智能学习成果(PLAI-LOs)框架,通过工件级GenAI政策实施,为高等教育从分散规则走向清晰、以学习为中心的战略提供路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12193 2026-07-15 cs.HC cs.CV 新提交 50%

Compos3D: Interactive Part-Based Composition for Creative Control in Generative 3D Models

Compos3D:用于生成式3D模型中创意控制的基于部件的交互式合成

Faraz Faruqi, Sean J. Liu, George Fitzmaurice, Justin Matejka

机构 * Autodesk Research(Autodesk研究院)

专题命中 其他安全 :alignment(abstract)

AI总结 研究针对生成式3D建模中控制有限问题,提出Compos3D系统,通过重新混合部件实现创意控制。用户从提示生成候选,选择部件组装,系统合成模型。用户研究表明该方法能带来更好控制、意图匹配和满意度,还给出了未来工作流程设计建议。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08072 2026-07-15 cs.CV cs.RO 版本更新 50%

Post-Training in End-to-End Autonomous Driving

端到端自动驾驶中的训练后处理

Ruining Yang, Muxing Wang, Yixiao Chen, Tongfei Guo, Yi Xu, Can Cui, Zichong Yang, Yitian Zhang, Ziran Wang, Yun Fu, Lili Su

机构 * Northeastern University(东北大学) Purdue University(普渡大学)

专题命中 其他安全 :safety(abstract)

AI总结 探讨端到端自动驾驶中训练后处理技术,针对传统方法不足,将现有文献按监督形式分四类,阐述各分类的能力、局限与挑战,助力系统理解该领域并推动相关研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11470 2026-07-15 cs.CV 版本更新 50%

Sat2RealCity: Geometry-Aware and Appearance-Controllable 3D Urban Generation from Satellite Imagery

Sat2RealCity:基于卫星图像的几何感知与外观可控的3D城市生成

Xinliang Wang, Yijie Kang, Zhenyu Wu, Yifeng Shi

机构 * KE Holdings Inc.(KE控股公司) Beijing, China(中国北京)

专题命中 其他安全 :alignment(abstract)

AI总结 针对卫星图像3D城市生成问题,Sat2RealCity框架利用对象级3D生成先验,通过分解城市为地理定位建筑实体,结合构建的数据集,引入空间定位策略、设计外观引导机制及构建语义管道,实现良好的地理对齐、风格一致和资产合成。

Comments The first two authors contributed equally. The fourth author is the corresponding author

详情

展开后加载摘要…

URL PDF HTML 收藏