arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

共收录 1738 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 幻觉与事实性 1738 篇

2607.26647 2026-07-30 cs.CV 新提交 50%

Anchoring and Steering Diffusion: Enhancing the Faithfulness of Text-to-Image Generation at Inference Time

锚定与引导扩散:在推理时提升文生图生成的忠实度

Xinyi Wang, Yuyang Huang, Yalin Su, Pengcheng Luan, Tao Zhang, Feiming Wei, Wenxian Yu

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 幻觉与事实性 :alignment(abstract)

AI总结 提出无训练框架AnchorSteer,通过语义锚定与反射引导组件改进文生图扩散模型的推理,在GenEval等基准上提升文本-图像对齐性能且保持视觉质量。

Comments Accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16580 2026-07-21 stat.AP cs.CE cs.SE 新提交 50%

Automating structural reliability analysis with a multi-agent large language model framework

使用多智能体大语言模型框架实现结构可靠性分析自动化

Jaehwan Jeon, Chang Hee Lee, Taeyong Kim

专题命中 幻觉与事实性 :safety(abstract)

AI总结 研究提出多智能体大语言模型框架,通过专门智能体处理结构可靠性分析流程,用QLoRA微调方法规划器,由确定性求解器计算结果,降低专业知识壁垒,保持计算可信度,实现结构可靠性分析自动化。

Comments 41 pages, 10 figures. Submitted to Automation in Construction

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16841 2026-07-21 cs.CV cs.MM 新提交 50%

Look Clearly Before Answering: Mitigating Hallucinations in LVLMs via Saliency-Driven Perceptual Realignment

回答前看清楚:通过显著性驱动的感知重新对齐减轻LVLMs中的幻觉

Pengxu Chen, Yao Zhu, Guangming Zhu, Jun Sheng, Jincai Huang, Xiangyang Ji, Liang Zhang

机构 * Xidian University(西安电子科技大学) Tsinghua University(清华大学) Shanghai Road Transport Development Center(上海市道路运输发展中心) Hunan Institute of Advanced Technology(湖南先进技术研究院)

专题命中 幻觉与事实性 :alignment(abstract)

AI总结 研究针对LVLMs易产生幻觉问题,提出无需训练的SDPR框架,通过显著性驱动注意力重新分配、缓存对齐及先验约束对比解码,整体对齐视觉意识,在多基准测试中优于现有方法,无需额外训练且开销小。

Comments Accepted by ACM Multimedia 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09815 2026-07-17 cs.RO cs.CV 版本更新 50%

RASR: Range-Aware Scale Recovery for Metric UAV Navigation

RASR:用于度量无人机导航的距离感知尺度恢复

Hongtao Liang, Xinyu Shao, Chenxu Wang, Yiyao Wan, Jiahuan Ji, Fangwei Ye, Fuhui Zhou, Qihui Wu

机构 * College of Electronic and Information Engineering, Nanjing University of Aeronautics and Astronautics(南京航空航天大学电子信息工程学院) Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Noah Ark Lab, Huawei(华为诺亚方舟实验室) College of Automation Engineering, Nanjing University of Aeronautics and Astronautics(南京航空航天大学自动化工程学院) College of Artificial Intelligence, Nanjing University of Aeronautics and Astronautics(南京航空航天大学人工智能学院) College of Computer Science and Technology, Nanjing University of Aeronautics and Astronautics(南京航空航天大学计算机科学与技术学院)

专题命中 幻觉与事实性 :alignment(abstract)

AI总结 研究在GNSS信号阻断时无人机精确最后一米导航问题,提出RASR方法,将尺度恢复核心与校准模块分离,核心压缩几何成描述符并全局校准,校准模块进行残差校正和对齐,在PairUAV评估中取得较好结果。

Comments 5 pages, 4 figures. Technical report for the UAVM 2026 PairUAV Challenge

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13447 2026-07-16 eess.SY cs.SY 新提交 50%

Machine Learning Challenges in Intelligent Unmanned Aerial Vehicle Operations in Developing Economie

发展中经济体智能无人机操作中的机器学习挑战

Isuru Munasinghe, Nethmi Pathirana, Charitha Dombawala, Asanka Perera, Akila Pemasiri

专题命中 幻觉与事实性 :safety(abstract)

AI总结 探讨发展中经济体无人机智能操作面临的机器学习挑战,涉及导航、感知等核心功能领域,因资源、环境等因素受限,凸显了实验性能与实际部署间的差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09774 2026-07-14 cs.DL 新提交 50%

Hallucination Detector: A hybrid LLM and Semantic Scholar tool calling for detecting hallucination in scientific literature on AtomGPT.org

幻觉检测器:一种用于在AtomGPT.org上检测科学文献中幻觉的混合大语言模型和语义学者工具调用

Harichandana Neralla, Jaehyung Lee, Aldo H. Romero, Kamal Choudhary

专题命中 幻觉与事实性 :trustworthy(abstract)

AI总结 研究针对大语言模型用于科学写作时出现的虚构参考文献问题,提出结合大语言模型字段提取与语义学者结构化检索的AtomGPT参考文献检查器,经基准测试能可靠标记多数幻觉引用,保障文献引用可信度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2004.04663 2026-07-13 cs.CE math.ST stat.TH 50%

The ICSCREAM methodology: Identification of penalizing configurations in computer experiments using screening and metamodel -- Applications in thermal-hydraulics

ICSCREAM方法:利用筛查和元模型识别计算机实验中的惩罚配置——热力学-流体力学应用

A. Marrel, Bertrand Iooss, V Chabridon

专题命中 幻觉与事实性 :safety(abstract)

AI总结 ICSCREAM方法通过全局敏感性分析和元模型技术,高效识别热力学-流体力学事故模拟中的临界配置,减少计算成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04728 2026-07-10 cs.HC 50%

A Multi-Agent Framework for Democratizing XR Content Creation in K-12 Classrooms

面向K-12教室的多智能体框架:民主化XR内容创作

Yuan Chang, Zhu Li, Jiaming Qu

专题命中 幻觉与事实性 :safety(abstract)

AI总结 本文提出多智能体XR创作框架,通过四个专业代理解决K-12教育中XR内容创作的技术障碍和生成AI的幻觉风险,实现教育内容的安全生成与教学增强。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26306 2026-07-09 physics.optics cs.SY eess.SY 新提交 50%

Fiber Bragg grating-based acoustic sensing system enabled by ML-trained, sub-picometer-tunable hybrid III-V/SiN lasers

基于光纤布拉格光栅的声学传感系统:采用机器学习训练、亚皮米可调谐混合III-V/SiN激光器

Prabhav Gaur, Premanand Chandramani, Yossef Ehrlichman, Mohammed Alshamari, Yufei Chu, Abu Mitul, John Simons, Ibrahim G. Yayla, Ming Han, Ashok V. Krishnamoorthy

专题命中 幻觉与事实性 :alignment(abstract)

AI总结 提出一种机器学习训练的混合III-V/SiN可调谐激光器,实现亚皮米级波长控制,用于光纤布拉格光栅声学传感系统,实现高灵敏度、多通道分布式声发射检测与自适应空间定位。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28862 2026-07-07 cs.CV 版本更新 50%

HKVLM: Faithful Query--Region Binding for Frozen-Detector Visual Grounding

HKVLM:通过将语言查询绑定到冻结检测器实现忠实推理定位

Bo Ma

机构 * Bo Ma

专题命中 幻觉与事实性 :alignment(abstract)

AI总结 提出HKVLM框架,通过将定位从语言路径中分离,利用冻结检测器和语言模型,仅训练轻量对齐钩子实现推理定位,在少样本冷启动场景下显著提升定位精度并减少幻觉。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08566 2026-07-01 cond-mat.soft cond-mat.stat-mech 版本更新 50%

Homing through Reinforcement Learning

通过强化学习实现归巢

Riya Singh, Pratikshya Jena, Anish Kumar, Shradha Mishra

专题命中 幻觉与事实性 :alignment(abstract)

AI总结 提出强化学习框架模拟连续二维域中的自适应归巢,发现平均归巢时间随旋转扩散强度呈非单调变化,且RL智能体比主动布朗粒子更快、更定向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14711 2026-06-16 cs.DC 新提交 50%

SWARM-LLM: Collaborative Inference for Edge-based Small Language Models

SWARM-LLM:基于边缘的小语言模型的协同推理

Mostafa Dahshan, Quazi Mamun, Tanmoy Debnath

专题命中 幻觉与事实性 :safety(abstract)

AI总结 提出SWARM-LLM路由协作层,通过轻量级不确定性估计和安全信号,在边缘SLM、对等SLM协作和云端FM之间动态选择查询处理方式,实现精度、延迟和成本的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13113 2026-06-12 eess.SY cs.RO cs.SY 新提交 50%

MPC for underactuated spacecraft control with a Lyapunov supervised physics-informed neural network correction layer

基于李雅普诺夫监督的物理信息神经网络校正层的欠驱动航天器MPC控制

Amirhossein Ayanmanesh Motlaghmofrad, Carlo Cena, Mauro Martini, Marcello Chiaberge

机构 * Politecnico di Torino(托斯纳理工学院) Argotec S.R.L.(Argotec公司)

专题命中 幻觉与事实性 :safety(abstract)

AI总结 针对欠驱动航天器姿态控制,提出一种分层架构,结合非线性模型预测控制、物理信息神经网络和李雅普诺夫监督机制,在不确定性下降低稳态误差并保持鲁棒性。

Comments Accepted at SPAICE (AI in and for Space) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06998 2026-06-11 cond-mat.other 版本更新 50%

Identifying Topological Invariants of Non-Hermitian Systems via Domain-Adaptive Multimodal Model for Mathematics

通过数学多模态模型识别非厄密系统拓扑不变量

Jiuchun Meng, Lichao Sun, Xiumei Wang, Dandan Zhu, Xingping Zhou

专题命中 幻觉与事实性 :alignment(abstract)

AI总结 本文提出利用多模态模型识别非厄密系统拓扑不变量,通过输入哈密顿量的本征值和本征向量,结合数学大语言模型进行复杂计算和推理,有效提取拓扑信息。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02274 2026-06-09 cs.RO 版本更新 50%

Dexterity-BEV: Aligning 3D World and Actions for Generalizable Robot Policies Learning

Dexterity-BEV: 对齐3D世界与动作以实现通用机器人策略学习

Huayi Zhou, Wei Gao, Dekun Lu, Ruiji Liu, Zhanqi Zhang, Ziyang Zhang, Jian Chen, Wenlve Zhou, Sheng Xu, Shumin Li, Kangyi Guo, Shichen Xu, Zixin Huang, Yongyi Su, Kui Jia

机构 * DexForce Technology(德克斯技术公司) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

专题命中 幻觉与事实性 :alignment(abstract)

AI总结 提出Dexterity-BEV框架,通过对齐顶点图和顶点谱的3D表示以及鸟瞰图对齐,解决2D基础模型在3D操作中的局限性,提升机器人策略的泛化能力。

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05491 2026-06-05 cs.CV cs.RO 50%

Unpaired RGB-Thermal Gaussian-Splatting Using Visual Geometric Transformers

无配对RGB-热成像高斯泼溅使用视觉几何变换器

Jean Cordonnier, Chenghao Xu, Olga Fink, Malcolm Mielle

机构 * Ecole Polytechnique Federale de Lausanne(瑞士联邦理工学院洛桑分校) Schindler EPFL Lab(施耐德EPFL实验室)

专题命中 幻觉与事实性 :alignment(abstract)

AI总结 提出一种无配对RGB-热成像新视角合成框架,利用VGGT估计各模态相机位姿并通过Procrustes对齐,结合多模态3D高斯泼溅实现联合重建,在保持RGB保真度的同时实现热成像视图合成。

Comments Accepted at ICRA 2026's Workshop MM-SpatialAI: Multi-Modal Spatial AI for Robust Navigation and Open-World Understanding

详情

展开后加载摘要…

URL PDF HTML 收藏
1705.10702 2026-06-04 eess.SY cs.SY math.OC 50%

Cautious Model Predictive Control using Gaussian Process Regression

基于高斯过程回归的谨慎模型预测控制

Lukas Hewing, Juraj Kabzan, Melanie N. Zeilinger

专题命中 幻觉与事实性 :safety(abstract)

AI总结 本文提出了一种结合高斯过程回归的模型预测控制方法,用于建模非线性动力系统,通过考虑残余不确定性来实现安全控制。

Comments Published in IEEE Transactions on Control Systems Technology

详情

展开后加载摘要…

URL PDF HTML 收藏
1905.08095 2026-06-04 eess.SY cs.SY 50%

Control Theory Meets POMDPs: A Hybrid Systems Approach

控制理论与POMDPs的交汇:一种混合系统方法

Mohamadreza Ahmadi, Nils Jansen, Bo Wu, Ufuk Topcu

专题命中 幻觉与事实性 :safety(abstract)

AI总结 本文提出了一种将控制理论应用于POMDPs的方法,通过混合系统方法确定POMDPs的可达信念空间,并利用Lyapunov函数的子水平集进行过估计,同时提出屏障证书定理以验证安全性和最优性要求。

Comments arXiv admin note: text overlap with arXiv:1810.00093

详情

展开后加载摘要…

URL PDF HTML 收藏
1902.05607 2026-06-04 eess.SY cs.SY 50%

Learning for DC-OPF: Classifying active sets using neural nets

为直流最优功率流学习:利用神经网络分类主动集

Deepjyoti Deka, Sidhant Misra

专题命中 幻觉与事实性 :safety(abstract)

AI总结 本文提出利用神经网络分类算法学习不确定性实现与最优解主动集之间的映射,从而提高实时预测的计算效率,并在IEEE PES PGLib-OPF基准库中多个系统上展示了该方法的优异性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
1807.03823 2026-06-04 eess.SY cs.SY 50%

Verification of Uncertain POMDPs Using Barrier Certificates

使用屏障证书验证不确定POMDPs

Mohamadreza Ahmadi, Murat Cubuktepe, Nils Jansen, Ufuk Topcu

专题命中 幻觉与事实性 :safety(abstract)

AI总结 本文研究不确定POMDPs的验证问题,通过将POMDP转化为切换系统并利用屏障证书方法,结合求和平方编程实现最优性和安全性的验证,以火星探测器为例验证方法有效性。

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03593 2026-06-03 cs.SE cs.RO 50%

Making Embodied AI Reliable: A Community Agenda from Testing to Formal Verification

使具身AI可靠:从测试到形式验证的社区议程

Xi Zheng, Dulanga Weerakoon, Yintong Huo, Teresa Yeo, Guy Van Den Broeck, Vijay Ganesh, Daniel Neider, Biplav Srivastava, Ivan Ruchkin, Archan Misra, Corina Pasareanu

机构 * University of Waterloo(滑铁卢大学) Universityinceton University(普林斯顿大学)

专题命中 幻觉与事实性 :trustworthy(abstract)

AI总结 本文基于AAAI'26 Bridge Program讨论,提出通过集成测试、形式验证和运行时保证的神经符号方法,解决具身AI在开放世界中的生命周期可靠性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25844 2026-05-26 cs.CR cs.DC cs.GT 50%

Proof of Useful Attestation: A Consensus Primitive for Attestation-Native Chains

有用证明证明:一种面向证明原生链的共识原语

Stefan Stefanović

专题命中 幻觉与事实性 :safety(abstract)

AI总结 提出Proof of Useful Attestation (PoUA)共识机制,通过将证明处理质量纳入共识权重,解决通用权益证明链对证明工作漠视的问题,并给出经济成本下界和防御策略。

Comments 62 pages, 9 figures. Reference simulator with 196+ passing tests at https://github.com/ligate-io/ligate-research/tree/main/prototypes/poua-sim

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25524 2026-05-26 cs.CV 50%

ProSR: Process-Shaped Spatial Reasoning for Reliable Chain-of-Thought in VLMs

ProSR: 面向可靠思维链的过程塑造空间推理方法

Jiangyang Li, Cong Wan, Changjie Wu, Songlin Dong, Lingjun Zhang, Linzhe Shi, Xu Wang, Zhiheng Ma, Hang Zhang, Mu Xu, Yihong Gong

机构 * Xi’an Jiaotong University(西安交通大学) Amap, Alibaba Group(阿里巴巴集团Amap) Tsinghua University(清华大学) Shenzhen University of Advanced Technology(深圳大学先进技术学院)

专题命中 幻觉与事实性 :alignment(abstract)

AI总结 针对视觉语言模型在空间推理中存在的虚假基础与尾部不稳定性问题,提出ProSR框架,通过反事实不变性惩罚和尾部漂移惩罚优化推理过程,提升答案准确率及轨迹稳定性与视觉依赖性。

Comments 19 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22322 2026-05-22 cs.RO 50%

How can reasoning capability empower the AI copilot robot in endoscopic surgery

推理能力如何赋能内窥手术中的AI助手机器人

Guankun Wang, Long Bai, Hongliang Ren

机构 * Department of Electronic Engineering(电子工程系)

专题命中 幻觉与事实性 :safety(abstract)

AI总结 本文研究了推理能力在内窥手术中AI助手机器人中的应用,提出通过整合多模态线索、解读手术意图和推断隐藏组织动态来提高手术的精确性、安全性和可持续性。

Comments Accepted by npj digital medicine

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21434 2026-05-21 cs.SE 50%

Agentic Model Checking

代理模型检查

Youcheng Sun, Jiawen Liu, Daniel Kroening, Jason Xue

专题命中 幻觉与事实性 :safety(abstract)

AI总结 本文提出了一种代理模型检查方法,结合LLM代理与受限模型检查后端,通过代理提出任务并由求解器验证,以解决LLM生成系统代码的验证难题,包括规范缺失和安全合同隐式编码的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21309 2026-05-21 cs.CV cs.RO 50%

Hyper-V2X: Hypernetworks for Estimating Epistemic and Aleatoric Uncertainty in Cooperative Bird's-Eye-View Semantic Segmentation

Hyper-V2X: 基于超网络的协作鸟瞰图语义分割中epistemic和aleatoric不确定性的估计

Abhishek Dinkar Jagtap, Sanath Tiptur Sadashivaiah, Andreas Festag

机构 * CARISSMA Institute for Electric, COnnected, and Secure Mobility (C-ECOS), Technische Hochschule Ingolstadt(CARISSMA电动、连接与安全移动研究所(C-ECOS)、因戈尔施塔特技术大学) University of Applied Sciences Aschaffenburg(阿施发堡应用科学大学)

专题命中 幻觉与事实性 :safety(abstract)

AI总结 本文提出Hyper-V2X框架,通过超网络估计协作V2X感知中的epistemic和aleatoric不确定性,采用部分权重生成方案和V2X上下文嵌入模块,条件化贝叶斯超网络生成随机鸟瞰图分割的权重分布,提升感知可靠性。

Comments Accepted for IEEE Intelligent Vehicle Symposium (IV) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.02759 2026-05-19 cs.RO cs.CV 50%

DynoSLAM: Dynamic SLAM with Generative Graph Neural Networks for Real-World Social Navigation

DynoSLAM:基于生成图神经网络的动态SLAM用于现实世界的社交导航

Danil Tokhchukov, Veronika Morozova, Gonzalo Ferrer

机构 * Applied AI Institute(应用人工智能研究所)

专题命中 幻觉与事实性 :safety(abstract)

AI总结 本文提出DynoSLAM,通过整合社交感知图神经网络,解决动态环境中SLAM的不确定性问题,提升机器人在拥挤环境中的导航能力。

Comments Code & Project page at https://github.com/makriot/dynoslam

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10130 2026-05-12 cs.CV 50%

Thermal-Det: Language-Guided Cross-Modal Distillation for Open-Vocabulary Thermal Object Detection

Thermal-Det: 语言引导的跨模态蒸馏用于开放词汇热成像目标检测

Yasiru Ranasinghe, Elim Schenck, Florence Yellin, Shuowen Hu, Christopher Funk, Vishal M. Patel

机构 * Johns Hopkins University(约翰霍普金斯大学) Kitware DEVCOM Army Research Laboratory(国防部陆军研究实验室)

专题命中 幻觉与事实性 :alignment(abstract)

AI总结 本文提出Thermal-Det,首个针对热成像的开放词汇检测器,通过合成数据集和跨模态蒸馏提升热成像目标检测性能,实验显示在公开基准上取得2-4%的AP提升。

Comments Accepted at CVPR 26

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08031 2026-05-11 cs.CV 50%

Object Hallucination-Free Reinforcement Unlearning for Vision-Language Models

面向视觉语言模型的无对象幻觉强化反学习

Kaidi Jia, Yujie Lin, Chengyi Yang, Jiayao Ma, Jinsong Su

机构 * Xiamen University(厦门大学)

专题命中 幻觉与事实性 :alignment(abstract)

AI总结 本文提出HFRU框架,通过视觉编码器深度语义删除,结合对齐破坏与GRPO优化,实现高效反学习,减少对象幻觉,实验显示在目标识别和人脸识别任务中性能优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06988 2026-05-11 cs.MA cs.IT cs.RO math.IT 50%

The Cost of Consensus: Malignant Epistemic Herding and Adaptive Gating in Distributed Multi-Agent Search

共识的成本:恶意认知从众与自适应门控在分布式多智能体搜索中的问题

David Farr, Iain Cruickshank, Kate Starbird, Jevin West

机构 * Information School, University of Washington(华盛顿大学信息学院) Computer Science, Carnegie Mellon University(卡内基梅隆大学计算机科学系) Human Centered Design Engineering, University of Washington(华盛顿大学人本设计工程系)

专题命中 幻觉与事实性 :alignment(abstract)

AI总结 研究探讨了在分布式多智能体搜索中,通信频率和内容如何共同影响集体信念状态,提出认知对齐的概念,分析了通信设计对集体推理的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏