arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-03-19 至 2026-03-19 共收录 18 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 18 篇

2603.16872 2026-03-19 cs.CL cs.CY 76%

Trust, Safety, and Accuracy: Assessing LLMs for Routine Maternity Advice

信任、安全与准确性:评估LLMs用于常规产科咨询

V Sai Divya, A Bhanusree, Rimjhim, K Venkata Krishna Rao

机构 * National Institute of Technology, Warangal, India(印度战争格尔国家理工学院)

专题命中 其他安全 :safety(title);分类 cs.CL、cs.CY

AI总结 本研究评估了LLMs在提供可靠且易懂的产科信息方面的表现,发现Perplexity在语义上与专家接近,而ChatGPT-4o在文本清晰度和医学术语使用上更优,为偏远地区产科教育提供了可行的AI解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18002 2026-03-19 cs.CV cs.AI cs.CL 62%

Loc3R-VLM: Language-based Localization and 3D Reasoning with Vision-Language Models

Loc3R-VLM:基于语言的定位与3D推理的视觉语言模型

Kevin Qu, Haozhe Qi, Mihai Dusmanu, Mahdi Rad, Rui Wang, Marc Pollefeys

机构 * Microsoft Spatial AI Lab(微软空间AI实验室) ETH Zurich(苏黎世联邦理工学院) EPFL(苏黎世联邦理工学院)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 Loc3R-VLM通过结合全局布局重建和显式情境建模,提升视觉语言模型的3D空间理解能力,在语言定位和3D问答任务中取得最优性能。

Comments Project Page: https://kevinqu7.github.io/loc3r-vlm

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16901 2026-03-19 cs.LG cs.AI 62%

From Language to Action in Arabic: Reliable Structured Tool Calling via Data-Centric Fine-Tuning

从阿拉伯语到行动:通过数据驱动的微调实现可靠的结构化工具调用

Omer Nacar, Deema Alquffari, Saleh Alsharideh, Adeem AlOtaibi, Abdulaziz Alabdulkarim, Leen Alhazmi, Nada Alomar, Wareef Alzubaidi, Nada Alsultan, Ahmed Alrabghi, Demah Alhoshan, Rana Alsayyari, Hamed Alruwaili, Albaraa Jaafar, Khaled Alusmani, Abdulaziz Alsohimy, Munirah Alsubaie, Shahd Aldukhayil, Arwa Alali, Yazeed BinShihah, Razan Alsulaymi, Nourah Alhumaid, Razan Abdulsalam, Reem Alamoudi, Mohammed Alkhalifa

机构 * Tuwaiq Academy(图瓦伊克学院) Tahakom(塔哈科姆) Wakeb Company(沃克公司) Qatmeer Co.(卡提迈尔公司) NCGR Vision Bank(视觉银行)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 本文提出AISA-AR-FunctionCall框架,通过数据审计、模式修复和提示重构等方法,显著提升阿拉伯语函数调用模型的稳定性与准确性,减少解析失败率并提高功能名称识别精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17969 2026-03-19 cs.RO cs.AI 57%

Specification-Aware Distribution Shaping for Robotics Foundation Models

面向规范的机器人基础模型分布塑形

Sadık Bera Yüksel, Derya Aksaray

专题命中 其他安全 :safety(abstract);分类 cs.AI

AI总结 本文提出一种面向规范的机器人基础模型分布优化框架,通过在预训练模型执行中强制满足信号时序逻辑约束,提升机器人在复杂任务中的安全性和合规性。

Comments 8 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13698 2026-03-19 cs.RO cs.AI 57%

SAATT Nav: a Socially Aware Autonomous Transparent Transportation Navigation Framework for Wheelchairs

SAATT Nav:面向轮椅的社交感知自主透明交通导航框架

Yutong Zhang, Shaiv Y. Mehra, Bradley S. Duerstock, Juan P. Wachs

机构 * Edwardson School of Industrial Engineering, Purdue University(帕克大学工业工程学院) Weldon School of Biomedical Engineering, Purdue University(帕克大学生物医学工程学院)

专题命中 其他安全 :safety(abstract);分类 cs.AI

AI总结 本文提出SAATT导航框架,通过整合大语言模型实现社交感知与决策透明,提升轮椅用户的导航安全性与信任度。

Comments 8 pages, 4 figures, 2 tables, 1 algorithm. Submitted to IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17533 2026-03-19 cs.IR cs.LG 57%

A Unified Language Model for Large Scale Search, Recommendation, and Reasoning

大规模检索、推荐与推理的统一语言模型

Marco De Nadai, Edoardo D'Amico, Max Lefarov, Alexandre Tamborrino, Divita Vohra, Mark VanMiddlesworth, Shawn Lin, Jacqueline Wood, Jan Stypka, Eliza Klyce, Keshi Dai, Timothy Christopher Heath, Martin D. Gould, Yves Raimond, Sandeep Ghael, Tony Jebara, Andreas Damianou, Vladan Radosavljevic, Paul N. Bennett, Mounia Lalmas, Praveen Chandar

机构 * Spotify

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 本文提出NEO框架,通过将预训练解码器模型适应为工具无关的生成器,实现多领域实体、用户和语言的联合推理,展示了在大规模目录上的推荐、搜索和用户理解任务中的优越性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17208 2026-03-19 cs.CL cs.PL 57%

SYMDIREC: A Neuro-Symbolic Divide-Retrieve-Conquer Framework for Enhanced RTL Synthesis and Summarization

SYMDIREC:一种用于增强RTL综合与摘要的神经符号分割-检索-解决框架

Prashanth Vijayaraghavan, Apoorva Nitsure, Luyao Shi, Charles Mackin, Ashutosh Jadhav, David Beymer, Ehsan Degan, Vandana Mukherjee

机构 * IBM Research(IBM研究院)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 SYMDIREC通过结合符号规划与LLM推理,提升RTL综合与摘要的准确性,实现比基线方法更高的Pass@1率和ROUGE-L分数。

Journal ref EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16983 2026-03-19 cs.LG cs.LO 57%

Formal verification of tree-based machine learning models for lateral spreading

基于树形机器学习模型的横向扩展形式验证

Krishna Kumar

专题命中 其他安全 :safety(abstract);分类 cs.LG

AI总结 本文通过SMT求解器对树形模型进行形式验证,确保地质灾害预测模型在输入域内满足物理规范,展示约束应用如何提升物理一致性,揭示准确率与合规性的权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19995 2026-03-19 cs.MA cs.CL 57%

Communication to Completion: Modeling Collaborative Workflows with Intelligent Multi-Agent Communication

通信至完成:利用智能多智能体通信建模协作流程

Yiming Lu, Xun Wang, Simin Ma, Shujian Liu, Sathish Reddy Indurthi, Song Wang, Haoyun Deng, Fei Liu, Kaiqiang Song

机构 * Emory University(埃默里大学) Zoom Video Communications(Zoom视频通讯)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 本文提出C2C框架,通过建模通信为受限资源提升协作效率,实验表明成本意识策略使效率提升超40%,揭示出智能体自然采用管理者为中心的协调模式。

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17965 2026-03-19 cs.CV 50%

LaDe: Unified Multi-Layered Graphic Media Generation and Decomposition

LaDe:统一的多层图形媒体生成与分解

Vlad-Constantin Lungu-Stan, Ionut Mironica, Mariana-Iuliana Georgescu

机构 * Adobe Research(Adobe研究院)

专题命中 其他安全 :alignment(abstract)

AI总结 LaDe通过结合LLM提示扩展器、4D RoPE位置编码的潜在扩散变换器和RGBA VAE,实现灵活的多层媒体设计生成与分解,提升文本到多层媒体设计的对齐能力。

Comments 18 pages (main + supp)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16736 2026-03-19 cs.CV 50%

World Reconstruction From Inconsistent Views

从不一致视角重建世界

Lukas Höllein, Matthias Nießner

机构 * Technical University of Munich, Germany(慕尼黑技术大学)

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出一种非刚性对齐方法,通过全局一致坐标框架生成清晰点云,提升视频扩散模型在3D世界重建中的性能。

Comments project website: https://lukashoel.github.io/video_to_world video: https://www.youtube.com/watch?v=qXnUwhVmBzA code: https://github.com/lukasHoel/video_to_world

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07231 2026-03-19 cs.CV 50%

Semi-supervised Shelter Mapping for WASH Accessibility Assessment in Rohingya Refugee Camps

半监督庇护所制图用于罗兴亚难民营地WASH可及性评估

Kyeongjin Ahn, YongHun Suh, Sungwon Han, Jeasurk Yang, Hannes Taubenböck, Meeyoung Cha

机构 * School of Computing, Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院计算学院) Data Science for Humanity Group, Max Planck Institute for Security and Privacy (MPI-SP)(安全与隐私研究所数据科学为人类小组) Meta, California, United States(美国加州Meta公司) German Aerospace Center (DLR), Earth Observation Center (EOC)(德国航天中心地球观测中心) Institute of Geography and Geology, Earth Observation Research Cluster (EORC), Würzburg University(弗赖堡大学地理与地质研究所,地球观测研究集群)

专题命中 其他安全 :safety(abstract)

AI总结 本文提出半监督分割框架,利用SAM模型对多时相亚米分辨率遥感图像进行庇护所制图,提升复杂营地环境中的检测性能,并揭示WASH可及性下降及性别不平等问题。

Comments 22 pages, 13 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17625 2026-03-19 cs.CV 50%

S-VGGT: Structure-Aware Subscene Decomposition for Scalable 3D Foundation Models

S-VGGT:面向可扩展3D基础模型的结构感知子场景分解

Xinze Li, Pengxu Chen, Yiyuan Wang, Weifeng Su, Wentao Cheng

机构 * Beijing Normal-Hong Kong Baptist University(北京师范大学-香港 Baptist大学) Jilin University(吉林大学) Hong Kong Baptist University(香港 Baptist大学) Guangdong Provincial Key Laboratory of Interdisciplinary Research and Application for Data Science(广东省交叉学科研究与数据科学应用重点实验室)

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出S-VGGT方法,通过结构层面的冗余消除,解决3D基础模型中全局注意力带来的二次计算成本问题,实现高效且稳定的子场景划分与处理。

Comments 7 pages, 5 figures. Accepted by ICME 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17520 2026-03-19 cs.CV 50%

PCA-Seg: Revisiting Cost Aggregation for Open-Vocabulary Semantic and Part Segmentation

PCA-Seg:重新审视开放词汇语义和部分分割中的成本聚合

Jianjian Yin, Tao Chen, Yi Chen, Gensheng Pei, Xiangbo Shu, Yazhou Yao, Fumin Shen

机构 * Nanjing University of Science and Technology(南京理工大学) Nanjing Normal University(南京师范大学) Department of Electrical and Computer Engineering, Sungkyunkwan University(成均馆大学电子与计算机工程系) University of Electronic Science and Technology of China(电子科技大学) State Key Laboratory of Intelligent Manufacturing of Advanced Construction Machinery(先进施工机械智能制造国家重点实验室)

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出PCA-Seg方法,通过并行成本聚合缓解类级语义与空间上下文之间的知识干扰,提升开放词汇语义和部分分割性能。

Comments Accepted by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17326 2026-03-19 cs.CV 50%

FineViT: Progressively Unlocking Fine-Grained Perception with Dense Recaptions

FineViT: 通过密集描述逐步解锁细粒度感知

Peisen Zhao, Xiaopeng Zhang, Mingxing Xu, Ruoyu Sun, Zewei Du, Dunzheng Wang, Guanghao Zheng, Haohang Xu, Zhibo Zhang, Yuhang Zhang, Yi Ai, Lin Liu, Qi Tian

机构 * Huawei Inc.(华为公司)

专题命中 其他安全 :alignment(abstract)

AI总结 FineViT通过密集描述逐步训练,提升细粒度视觉感知能力,在长上下文检索中表现优异,超越现有多模态视觉编码器。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17178 2026-03-19 cs.CV 50%

Patient4D: Temporally Consistent Patient Body Mesh Recovery from Monocular Operating Room Video

Patient4D: 从单目手术室视频中恢复时间一致的患者身体网格

Mingxiao Tu, Hoijoon Jung, Alireza Moghadam, Andre Kyme, Jinman Kim

机构 * University of Sydney(悉尼大学)

专题命中 其他安全 :alignment(abstract)

AI总结 Patient4D通过利用时间一致性先验,结合轻量几何机制和姿态锁定,提升手术AR中单目视频的患者身体网格恢复性能,实验表明其在遮挡条件下表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17079 2026-03-19 cs.CV 50%

ACE-LoRA: Graph-Attentive Context Enhancement for Parameter-Efficient Adaptation of Medical Vision-Language Models

ACE-LoRA:图注意上下文增强用于医疗视觉-语言模型的参数高效适应

M. Arda Aydın, Melih B. Yilmaz, Aykut Koç, Tolga Çukur

机构 * Bilkent University(比尔肯特大学) National Magnetic Resonance Research Center (UMRAM)(国家磁共振研究所以及UMRAM)

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出ACE-LoRA框架,通过整合LoRA模块和ACE-HGNN模块,提升医疗VLM的零样本泛化能力,解决领域特异性与泛化能力的平衡问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06231 2026-03-19 cs.CV 50%

RSRefSeg 2: Decoupling Referring Remote Sensing Image Segmentation with Foundation Models

RSRefSeg 2: 解耦引用遥感图像分割与基础模型

Keyan Chen, Chenyang Liu, Bowen Chen, Jiafan Zhang, Zhengxia Zou, Zhenwei Shi

机构 * Beihang University(北京航空航天大学)

专题命中 其他安全 :alignment(abstract)

AI总结 RSRefSeg 2通过解耦传统三阶段流程,提出双阶段协作框架,结合CLIP的跨模态对齐与SAM的分割泛化能力,提升遥感图像分割精度与复杂语义解释能力。

Journal ref IEEE Transactions on Geoscience and Remote Sensing, vol. 64, pp. 1-20, 2026, Art no. 4700420

详情

展开后加载摘要…

URL PDF HTML 收藏