arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

共收录 1836 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. AI治理与伦理 1836 篇

2602.22419 2026-03-31 cs.CV 50%

CLIP Is Shortsighted: Paying Attention Beyond the First Sentence

CLIP存在短视:超越第一句话的注意力分配

Marc-Antoine Lavoie, Anas Mahmoud, Aldo Zaimi, Arsene Fansi Tchango, Steven L. Waslander

机构 * University of Toronto Robotics Institute(多伦多大学机器人研究所) Mila - Quebec AI Institute(Mila - 魁北克人工智能研究所)

专题命中 AI治理与伦理 :alignment(abstract)

AI总结 CLIP模型在大规模数据上通过图像-文本对比学习获取可迁移的多模态特征,但其预训练过程偏向于短描述,导致复杂场景对齐不足。本文提出DeBias-CLIP,通过去除摘要句和子采样提升对齐效果,实现更优的长文本检索和鲁棒性。

Comments 20 pages, 15 figures, to be published in the CVPR 2026 proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20237 2026-03-30 q-fin.ST 50%

Temporal Coverage Bias in Financial Panel Data: A Coverage-Aware Structuring Framework with Evidence from the Dhaka Stock Exchange

金融面板数据中的时间覆盖偏差:一种覆盖意识的结构化框架及达卡证券交易所的实证研究

Tashreef Muhammad

专题命中 AI治理与伦理 :alignment(abstract)

AI总结 本文提出一种覆盖意识的结构化框架,用于解决金融面板数据中因时间覆盖不一致导致的偏差问题,并通过达卡证券交易所的数据验证了该方法对收益率动态和波动性的影响。

Comments 16 pages, 7 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02569 2026-03-30 cs.HC cs.RO 50%

Reframing Human-Robot Interaction Through Extended Reality: Unlocking Safer, Smarter, and More Empathic Interactions with Virtual Robots and Foundation Models

通过扩展现实重新定义人机交互:利用虚拟机器人和基础模型实现更安全、更智能和更具同理心的交互

Yuchong Zhang, Yong Ma, Danica Kragic

机构 * Division of Robotics, Perception, and Learning, KTH Royal Institute of Technology(KTH皇家理工学院机器人、感知与学习部) Department of Clinical Medicine, University of Bergen(卑尔根大学临床医学系)

专题命中 AI治理与伦理 :safety(abstract)

AI总结 本文探讨通过扩展现实技术,利用基础模型驱动的虚拟机器人实现更安全、智能和具同理心的人机交互,同时讨论多模态大模型在认知和情感交互中的应用及潜在风险。

Comments This paper is under review

Journal ref Empathic Computing, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22612 2026-03-25 cs.CR cs.HC 50%

BioShield: A Context-Aware Firewall for Securing Bio-LLMs

BioShield: 一种面向生物大语言模型的上下文感知防火墙

Protiva Das, Sovon Chakraborty, Sidhant Narula, Lucas Potter, Xavier-Lewis Palmer, Pratip Rana, Daniel Takabi, Mohammad Ghasemigol

专题命中 AI治理与伦理 :safety(abstract)

AI总结 BioShield通过上下文感知的提示扫描和响应验证,为生物领域大语言模型提供多层次安全防护,有效防止双重用途攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21386 2026-03-24 cs.CV 50%

Mitigating Objectness Bias and Region-to-Text Misalignment for Open-Vocabulary Panoptic Segmentation

缓解对象性偏差和区域到文本对齐问题以实现开放词汇全景分割

Nikolay Kormushev, Josip Šarić, Matej Kristan

机构 * University of Ljubljana(卢布尔雅那大学) ETH Zurich(苏黎世联邦理工学院) University of Zagreb(扎格reb大学) Faculty of Comp. and Inf. Science(计算机与信息科学系) Dept. of Computer Science(计算机科学系) Faculty of Elec. Eng. and Computing(电子工程与计算科学系)

专题命中 AI治理与伦理 :alignment(abstract)

AI总结 本文提出OVRCOAT框架,通过CLIP条件对象性调整和开放词汇掩码到文本细化,解决开放词汇全景分割中的对象性偏差和区域对齐问题,提升分割性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16099 2026-03-18 cs.CV 50%

OneWorld: Taming Scene Generation with 3D Unified Representation Autoencoder

OneWorld: 通过3D统一表示自编码器驯服场景生成

Sensen Gao, Zhaoqing Wang, Qihang Cao, Dongdong Yu, Changhu Wang, Tongliang Liu, Mingming Gong, Jiawang Bian

机构 * Mohamed bin Zayed University of Artificial Intelligence(莫扎德·本·泽亚德人工智能大学) AISphere Shanghai Jiao Tong University(上海交通大学) University of Melbourne(墨尔本大学) Nanyang Technological University(南洋理工大学)

专题命中 AI治理与伦理 :alignment(abstract)

AI总结 OneWorld通过3D统一表示自编码器直接在3D空间中进行扩散,解决跨视角一致性和几何一致性问题,实验表明其生成的3D场景质量优于现有2D方法。

Comments Code: https://github.com/SensenGao/OneWorld

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12600 2026-03-16 cs.HC 50%

How GenAI Mentor Configurations Shape Early Collaborative Dynamics: A Classroom Comparison of Individual and Shared Agents

生成式人工智能导师配置如何塑造早期协作动态:个体与共享代理的课堂比较

Siyu Zha, Weijing Liu, Fei Qin, Jie Cao, Yanjin Wang, Yujia Liu, Kaiyi Zhang, Jiangtao Gong, Yingqing Xu

专题命中 AI治理与伦理 :alignment(abstract)

AI总结 研究探讨了生成式人工智能配置对课堂协作调节的影响,发现共享AI促进收敛性协作,而个体AI则导致更分散的互动模式,需教师更多干预。

Comments 26 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12406 2026-03-16 cs.SE 50%

Team Diversity Promotes Software Fairness: An Experiment on Fairness-Aware Requirements Prioritization

团队多样性促进软件公平性:一项关于公平意识需求优先级排序的实验

Cleyton Magalhes, Ronnie de Souza Santos, Bimpe Ayoola, Brody Stuart-Verner, Italo Santos

专题命中 AI治理与伦理 :alignment(abstract)

AI总结 研究探讨了软件团队多样性对需求优先级排序中公平意识行为的影响,发现多样性团队更一致地拒绝存在公平风险的故事,且决策理由更强调包容性和伦理责任。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04916 2026-03-13 cs.SE 50%

Classifier or Prompt: A Case Study on Legal Requirements Traceability

分类器或提示:关于法律要求可追溯性的案例研究

Romina Etezadi, Sallam Abualhaija, Chetan Arora, Lionel Briand

专题命中 AI治理与伦理 :safety(abstract)

AI总结 本文提出Kashif和RICE_LRT两种方法,分别通过分类器和提示工程解决法律要求的可追溯性问题,实验表明Kashif在F2得分上优于基线,RICE_LRT在更复杂的GDPR文档中表现更优。

Comments 32 pages, 7 figues

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10773 2026-03-12 cs.HC 50%

AI-Generated Rubric Interfaces: K-12 Teachers' Perceptions and Practices

AI生成的评分标准界面:K-12教师的感知与实践

Bahare Riahi, Sayali Patukale, Joy Niranjan, Yogya Koneru, Tiffany Barnes, Veronica Cateté

专题命中 AI治理与伦理 :alignment(abstract)

AI总结 本研究探讨了K-12教师在使用AI生成评分标准时的感知与实践,发现AI生成的评分标准在结构和清晰度上有帮助,但需要教师监督以确保准确性和相关性。

Comments 20 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08397 2026-03-10 eess.AS 50%

NLE: Non-autoregressive LLM-based ASR by Transcript Editing

NLE:基于大语言模型的语音识别的非自回归方法通过转录编辑

Avihu Dekel, Samuel Thomas, Takashi Fukada, George Saon

专题命中 AI治理与伦理 :alignment(abstract)

AI总结 NLE通过非自回归方法实现高效语音识别,利用转录编辑技术在保持准确性的同时显著提升处理速度,适用于实时应用场景。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01450 2026-03-03 cs.CV 50%

Deepfake Forensics Adapter: A Dual-Stream Network for Generalizable Deepfake Detection

深度伪造取证适配器:一种通用深度伪造检测的双流网络

Jianfeng Liao, Yichen Wei, Raymond Chan Ching Bon, Shulan Wang, Kam-Pui Chow, Kwok-Yan Lam

机构 * Shenzhen Technology University(深圳技术大学) Singapore Institute of Technology(新加坡理工学院) The University of Hong Kong(香港大学) Nanyang Technological University(南洋理工大学)

专题命中 AI治理与伦理 :safety(abstract)

AI总结 本文提出深度伪造取证适配器,通过双流网络结合CLIP模型实现高效通用深度伪造检测。

Comments Accepted at ICDF2C 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.16953 2026-03-03 cs.CV 50%

Towards Real Zero-Shot Camouflaged Object Segmentation without Camouflaged Annotations

面向无遮蔽标注的零样本遮蔽物分割

Cheng Lei, Jie Fan, Xinran Li, Tianzhu Xiang, Ao Li, Ce Zhu, Le Zhang

机构 * University of Electronic Science and Technology of China(电子科学与技术大学) Space42

专题命中 AI治理与伦理 :alignment(abstract)

AI总结 本文提出了一种无需遮蔽标注的零样本遮蔽物分割框架,通过结合MIM、M-LLM和MFA机制,实现高效分割与快速推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04334 2026-02-20 cs.HC 50%

Human-controllable AI: Meaningful Human Control

可受人类控制的AI:有意义的人类控制

Chengke Liu, Wei Xu

专题命中 AI治理与伦理 :alignment(abstract)

AI总结 本文提出有意义的人类控制(MHC)作为AI发展的重要原则,强调技术设计、治理和人类共同作用的重要性,旨在实现人类中心的AI发展。

Comments 52 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09369 2026-02-13 cs.CR 50%

Timing and Memory Telemetry on GPUs for AI Governance

GPU上的定时和内存遥测用于AI治理

Saleh K. Monfared, Fatemeh Ganji, Dan Holcomb, Shahin Tajik

专题命中 AI治理与伦理 :alignment(abstract)

AI总结 通过GPU定时和内存遥测技术,实现对大规模AI计算资源的治理,以确保资源使用符合政策和法律要求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07312 2026-02-10 cs.HC 50%

Navigating Algorithmic Opacity: Folk Theories and User Agency in Semi-Autonomous Vehicles

穿越算法隐匿性:半自动驾驶车辆中用户自主性的folk理论

Yehuda Perry, Tawfiq Ammari

专题命中 AI治理与伦理 :safety(abstract)

AI总结 研究探讨了半自动驾驶车辆司机如何通过folk理论理解算法行为,揭示了司机在算法治理中的被动地位,并提出参与式算法治理框架以提升透明度和用户参与度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03155 2026-02-04 cs.HC 50%

Is It Possible to Make Chatbots Virtuous? Investigating a Virtue-Based Design Methodology Applied to LLMs

能否使聊天机器人变得有德性?探讨一种基于德性的设计方法应用于大语言模型

Matthew P. Lad, Louisa Conwill, Megan Levis Scheirer

专题命中 AI治理与伦理 :safety(abstract)

AI总结 本文探讨了基于德性的设计方法在大语言模型中的应用,通过伦理设计模式的编目和评估,提出了一种提升LLM伦理性的设计框架,并指出其在准确性和安全性方面的优势及潜在实施挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10220 2026-01-16 cs.SE 50%

Agentic Pipelines in Embedded Software Engineering: Emerging Practices and Challenges

嵌入式软件工程中的代理流水线:新兴实践与挑战

Simin Sun, Miroslaw Staron

专题命中 AI治理与伦理 :safety(abstract)

AI总结 本文探讨嵌入式软件工程中生成式AI的整合挑战与实践,通过专家访谈揭示代理流水线的发展与可持续采用策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07051 2026-01-13 cs.SE 50%

Between Policy and Practice: GenAI Adoption in Agile Software Development Teams

在政策与实践之间:生成式AI在敏捷软件开发团队中的采用

Michael Neumann, Lasse Bischof, Nic Elias Hinz, Luca Stockmann, Dennis Schrader, Ana Carolina Ahaus, Erim Can Demirci, Benjamin Gabel, Maria Rauschenberger, Philipp Diebold, Henning Fritzemeier, Adam Przybylek

专题命中 AI治理与伦理 :alignment(abstract)

AI总结 本研究探讨了生成式AI在敏捷软件开发团队中的实际采用情况,发现其主要用于创意任务和文档协助,但面临数据隐私和治理等障碍,需通过TOE框架协调政策与实践以实现有效整合。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05555 2026-01-12 cs.SE 50%

An Empirical Study of Policy-as-Code Adoption in Open-Source Software Projects

对开源软件项目中政策即代码采用的实证研究

Patrick Loic Foalem, Foutse Khomh, Leuson Da Silva, Ettore Merlo

专题命中 AI治理与伦理 :trustworthy(abstract)

AI总结 本文通过分析399个开源项目,揭示了政策即代码工具在治理、配置控制和文档中的广泛应用,并提出了包含5类15子类的分类法,为未来研究提供实证基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00762 2026-01-05 cs.SE cs.HC 50%

AI Where It Matters: Where, Why, and How Developers Want AI Support in Daily Work

AI 何时重要:开发者在日常工作中需要 AI 支持的地点、原因和方式

Rudrajit Choudhuri, Carmen Badea, Christian Bird, Jenna Butler, Rob DeLine, Brian Houck

专题命中 AI治理与伦理 :alignment(abstract)

AI总结 本文通过研究开发者在日常工作中对AI支持的需求,揭示了AI在不同任务中的应用模式及负责任AI的优先事项。

Comments ICSE-SEIP'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.22876 2025-12-23 cs.MA 50%

Cooperation as a Black Box: Conceptual Fluctuation and Diagnostic Tools for Misalignment in MAS

协作作为黑箱:多智能体系统中概念波动与对齐偏差的诊断工具

Shayak Nandi, Fernanda M. Eliott

专题命中 AI治理与伦理 :alignment(abstract)

AI总结 本文提出马赛克框架,用于诊断多智能体系统中概念波动与对齐偏差,强调术语一致性与道德基础以确保系统技术与道德对齐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18234 2025-12-23 cs.HC 50%

The Social Blindspot in Human-AI Collaboration: How Undetected AI Personas Reshape Team Dynamics

人机协作中的社会盲区:未被识别的人工智能角色如何重塑团队动态

Lixiang Yan, Xibin Han, Yu Zhang, Samuel Greiff, Inge Molenaar, Roberto Martinez-Maldonado, Yizhou Fan, Linxuan Zhao, Xinyu Li, Yueqiao Jin, Dragan Gašević

专题命中 AI治理与伦理 :safety(abstract)

AI总结 研究发现AI通过人格设定影响团队协作,即使用户未察觉其存在,揭示了社会盲区现象。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08374 2025-12-10 cs.CV 50%

The Unseen Bias: How Norm Discrepancy in Pre-Norm MLLMs Leads to Visual Information Loss

看不见的偏见:预规范MLLM中规范差异如何导致视觉信息丢失

Bozhou Li, Xinda Xue, Sihan Yang, Yang Shi, Xinlong Chen, Yushuo Guan, Yuanxing Zhang, Wentao Zhang

机构 * Peking University(北京大学) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Xi’an Jiaotong University(西安交通大学) Kling Team, Kuaishou Technology(快手科技 Kling 团队)

专题命中 AI治理与伦理 :alignment(abstract)

AI总结 本文揭示了预规范MLLM中规范差异导致的视觉信息丢失问题,并提出通过插入层规范层来解决这一问题,提升模型整体能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03439 2025-12-04 cs.IR 50%

LLM as Explainable Re-Ranker for Recommendation System

大语言模型作为可解释的重排序器用于推荐系统

Yaqi Wang, Haojia Sun, Shuting Zhang

专题命中 AI治理与伦理 :alignment(abstract)

AI总结 本文提出利用大语言模型作为可解释的重排序器,结合传统推荐模型提升推荐系统的准确性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03180 2025-12-04 cs.MA cs.ET 50%

AGENTSAFE: A Unified Framework for Ethical Assurance and Governance in Agentic AI

AGENTSAFE:面向代理AI的统一伦理保障与治理框架

Rafflesia Khan, Declan Joyce, Mansura Habiba

专题命中 AI治理与伦理 :safety(abstract)

AI总结 AGENTSAFE提出一个统一的治理框架,通过风险分类转化为可操作的设计、运行时和审计控制,提供可衡量的预部署保障,并通过运行时治理和问责机制建立代理AI生态系统的信任。

Comments 12 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02562 2025-12-03 eess.SY cs.SY 50%

Intervention Strategies for Fairness and Efficiency at Autonomous Single-Intersection Traffic Flows

自主单交叉口交通流的公平性与效率干预策略

Salman Ghori, Ania Adil, Melkior Ornik, Eric Feron

专题命中 AI治理与伦理 :safety(abstract)

AI总结 本文提出了一种基于混合整数线性规划的干预策略,用于在无信号灯的交叉口上优化自主代理的公平性与效率,通过仿真验证早干预和公平性意识控制的效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01571 2025-12-02 cs.NI 50%

Velocity-Adaptive Access Scheme for Semantic-Aware Vehicular Networks: Joint Fairness and AoI Optimization

面向语义感知车联网的自适应接入方案:公平性与信息年龄优化的联合优化

Xiao Xu, Qiong Wu, Pingyi Fan, Kezhi Wang, Nan Cheng, Wen Chen, Khaled B. Letaief

专题命中 AI治理与伦理 :safety(abstract)

AI总结 本文提出一种面向语义感知车联网的自适应接入方案,通过联合优化公平性与信息年龄,利用顺序凸近似和大语言模型算法提升通信效率与安全性。

Comments This paper has been submitted to IEEE transactions on moblie computing

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00428 2025-12-02 cs.CV 50%

Recognizing Pneumonia in Real-World Chest X-rays with a Classifier Trained with Images Synthetically Generated by Nano Banana

用Nano Banana生成的合成图像训练分类器以在真实世界胸片中识别肺炎

Jiachuan Peng, Kyle Lam, Jianing Qiu

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) University of Oxford(牛津大学) Imperial College London(伦敦帝国学院)

专题命中 AI治理与伦理 :alignment(abstract)

AI总结 利用Nano Banana生成的合成图像训练分类器,实现在真实世界胸片中识别肺炎,取得较高AUROC和AUPR,但存在提示设计和数据对齐的挑战。

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21579 2025-12-01 cs.CV 50%

Harmony: Harmonizing Audio and Video Generation through Cross-Task Synergy

Harmony: 通过跨任务协同实现音频和视频生成

Teng Hu, Zhentao Yu, Guozhen Zhang, Zihan Su, Zhengguang Zhou, Youliang Zhang, Yuan Zhou, Qinglin Lu, Ran Yi

机构 * Shanghai Jiao Tong University(上海交通大学) Tencent Hunyuan Project(腾讯文心项目)

专题命中 AI治理与伦理 :alignment(abstract)

AI总结 Harmony通过跨任务协同机制和同步增强CFG,实现高效音频视频同步生成。

详情

展开后加载摘要…

URL PDF HTML 收藏