arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

共收录 128 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. AI治理与伦理 128 篇

2608.06112 2026-08-07 cs.AI cs.CL cs.LG cs.MA 新提交 67%

From Siloed Algorithms to Compliance-First Agentic Platforms: A Multi-Layered Architecture for Hospital AI Systems

从孤立算法到合规优先的智能体平台:面向医院AI系统的多层架构

Manideep Dhar, Ritwik Singh, Sharat Chandra Kumar Manikonda

专题命中 AI治理与伦理 :safety(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 针对医院AI部署孤立、规模化难的问题,提出含智能体编排、合规策略、隐私保护数据层的多层架构,通过原型验证可减少任务耗时与文档工作量,为医院AI平台建设提供实用蓝图。

Comments Peer-reviewed published article

Journal ref IJISRT, 11-2026(5), IJISRT26MAY1651

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28934 2026-08-03 cs.CL cs.AI cs.CY 新提交 67%

FairFund-Bench: Evaluating Distributive Bias in LLM Resource Allocation

FairFund-Bench:评估大语言模型资源分配中的分配偏差

Martin Lukk

机构 * University of Toronto(多伦多大学)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI、cs.CY

AI总结 FairFund-Bench基准通过调整审计格式等特征,发现LLM资源分配的偏差受审计类型影响,且因果框架效应强于人口统计效应,可用于评估LLM的分配偏差。

Comments 19 pages, 7 figures. Code and data: https://github.com/martinlukk/fairfund-bench

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07359 2026-07-09 cs.CR 新提交 67%

The AI Resilience Gap: Bringing Artificial Intelligence Inside the Operational Resilience Perimeter

人工智能弹性差距:将人工智能纳入运营弹性范围

Jonathan Shelby

专题命中 AI治理与伦理 :safety(abstract);trustworthy(abstract)

AI总结 研究人工智能在受监管公司应用中运营弹性不足问题,提出人工智能弹性框架,通过依赖映射等方法将人工智能依赖纳入运营弹性范围,弥补监管逻辑差距,为相关人员提供可操作路径。

Comments 11 pages, 2 Figures, 4 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07612 2026-06-09 cs.CY cs.AI cs.LG 新提交 67%

Position: Anthropomorphic Misalignment Research Needs Stronger Evidence

立场:拟人化错位研究需要更强证据

Vansh Gupta, Peter Nutter, Samuel Stante, Andreas Krause, Florian Tramèr, Lukas Fluri, Xin Chen, Anna Hedström

机构 * University of Cambridge(剑桥大学)

专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY、cs.LG

AI总结 本文指出拟人化错位研究(AMR)在概念模糊、数据不鲁棒、实验设计不足等问题上存在证据薄弱,提出证据层级框架和诊断清单以提升方法论严谨性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12166 2026-08-13 cs.CY cs.AI cs.SY eess.SY 新提交 62%

Co-constructing sociotechnical AI governance: participatory system mapping using algorithm registers

协同构建社会技术型AI治理:利用算法登记册的参与式系统映射

Íñigo de Troya, Maurus Enbergs, Neelke Doorn, Roel Dobbe

专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY

AI总结 本文以荷兰某城市算法登记册为案例,通过多利益相关者参与式映射结合STPA分析,揭示登记册的遮蔽性,为多元社会技术型AI治理提供新视角。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07786 2026-08-11 cs.AI cs.LG 新提交 62%

Who Built This Model? Tracing LLM Lineage via Spectral Fingerprints in Weight Space

谁构建了这个模型?通过权重空间中的光谱指纹追踪大语言模型(LLM)谱系

Yiwei Chen, Bingqi Shang, Sijia Liu

机构 * Michigan State University(密歇根州立大学)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 本研究提出几何指纹框架,通过权重空间的光谱能量和子空间对齐分析,实现对110余个开源权重LLM对的谱系区分,为模型溯源提供稳健可解释的信号。

Comments Accepted to COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29071 2026-08-03 cs.LG cs.AI 新提交 62%

Federated Foundation Models Fine-Tuning with Heterogeneous Compressed Clients

采用异构压缩客户端的联邦基础模型微调

Shengkun Zhu, Jinshan Zeng, Zhihua Allen-Zhao, Mayi Xu, Quanqing Xu, Wei Ren, Qiang Yang, Yang Liu

机构 * The Hong Kong Polytechnic University(香港理工大学) OceanBase, Ant Group(蚂蚁集团OceanBase) School of Management, Xi’an Jiaotong University(西安交通大学管理学院) School of Mathematics and Statistics, Xidian University(西安电子科技大学数学与统计学院) School of Computer Science, Wuhan University(武汉大学计算机学院) School of Computer Science, China University of Geosciences(中国地质大学计算机学院)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 针对基础模型联邦学习的资源不对称问题,提出FedSLM框架,通过SVD分解等技术实现异构压缩客户端的联邦微调,实验显示其在多基准上优于现有基线且客户端内存需求更低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26068 2026-07-30 econ.GN cs.AI cs.CY q-fin.EC 新提交 62%

The Human Utility Factor: A Computable Welfare Metric That Reframes AI Governance as a Constrained Optimisation Problem

人类效用因子:一种可计算的福利度量,将AI治理重新构建为约束优化问题

Sivasathivel Kandasamy

专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY

AI总结 研究提出人类效用因子(HUF)这一可计算福利度量,将AI治理转化为约束优化问题,经多智能体强化学习评估,发现需明确约束再分配以避免高自动化均衡损害社会目标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26067 2026-07-30 cs.CY cs.AI 新提交 62%

The Easy Trap: Why LLMs Underestimate Misconception-Driven Difficulty

易陷阱:为何大语言模型低估由误解驱动的难度

Amanda La Hadi, Muhammad Johan Alibasa, Guanliang Chen, A. Taufiq Asyhari

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.CY

AI总结 该研究发现,用于教育评估难度估计的LLM会系统性低估由学习者误解驱动的数学题难度,提出“易陷阱”现象,其仅能捕捉难度大致排序,无法反映学生实际认知难度。

Comments This paper poster presented on 19th Educational Data Mining Conference 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24391 2026-07-28 cs.CY cs.AI 新提交 62%

Regulating for AI Legitimacy

规范人工智能的合法性

Gilad Abiri

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.CY

AI总结 研究人工智能治理中合法性这一自主监管目标,指出其与对齐不同。分析人工智能合法性在透明度、私人权力和行政自动化方面的问题,探讨法律作用并提出整合、熟悉度、争议三个原则以解决相关问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21063 2026-07-24 cs.CL cs.CY cs.HC 新提交 62%

QuantiBias: Benchmarking Quantization-Induced Bias in LLMs

QuantiBias:量化大语言模型中量化诱导偏差的基准测试

Emilio Ferrara

机构 * University of Southern California(南加州大学)

专题命中 AI治理与伦理 :safety(abstract);分类 cs.CL、cs.CY

AI总结 研究大语言模型量化中的偏差问题,提出QuantiBias基准测试,通过结合多种控制和对比有无推理的构建来评估偏差,发现量化器按无偏差预防信号的数据分配精度,推理对部分偏差有减半效果,强调需重新评估量化模型的开放式偏差。

Comments Benchmark protocol on Hugging Face: https://huggingface.co/datasets/emilioferrara/quantibias

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16130 2026-07-20 cs.CY cs.AI cs.SY eess.SY 新提交 62%

A Methodology for Auditable Trustworthiness Levels in AI Lifecycle Governance

人工智能生命周期治理中可审计可信度水平的一种方法

Andrea Ferrario

机构 * Institute of Biomedical Ethics and History of Medicine, University of Zürich(生物医学伦理与医学史研究所,苏黎世大学) SUPSI, Dalle Molle Institute for Artificial Intelligence (IDSIA)(SUPSI人工智能研究所) ETH Zürich(苏黎世联邦理工学院)

专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.AI、cs.CY

AI总结 研究人工智能治理中系统可信度判断问题,提出轻量级方法,含形式框架与治理程序两部分,用决策树建模,能产生可信度平台等,通过合成轨迹说明方法可支持合规文档编制和生命周期监测。

Comments 32 pages; 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15282 2026-07-20 cs.HC cs.AI cs.CL 新提交 62%

Empathy as Predictive Misalignment Tolerance: A Co-Regulation Framework and the Regime Structure of Dialogue Repair

作为预测性偏差容忍度的同理心:一个协同调节框架和对话修复的机制结构

Molood Arman

机构 * Independent Researcher(独立研究者)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 研究将同理心重新定义为预测性偏差容忍度,提出解释性错误容忍(IET)框架,通过两个计算探针评估。结果发现修复存在依赖机制的结构,揭示噪声水平等因素间相互作用,表明长时间互动中同理心是调节分歧动态,促使共情AI设计转向管理解释距离。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14353 2026-07-17 cs.CY cs.AI cs.SY eess.SY 新提交 62%

Unsafe at any AUC: Unlearned Lessons from Sociotechnical Disasters for Responsible AI

在任何AUC下都不安全:从社会技术灾难中汲取的关于负责任人工智能的未吸取教训

Joshua A. Kroll, Andrew Smart, R. Stuart Geiger, Abigail Z. Jacobs

专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY

AI总结 研究从切尔诺贝利等社会技术灾难中汲取未吸取的教训,探讨其对人工智能的启示,指出人工智能开发和使用可在组织风险处理、需求责任追溯及整体安全方法等方面受益,以避免类似灾难在现代系统中重演。

Comments Accepted to the Harvard Data Science Review, Volume 8(3), Summer 2026

Journal ref Harvard Data Science Review, Volume 8(3), Summer 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14309 2026-07-17 cs.AI cs.CY 新提交 62%

Traccia: An OpenTelemetry-Based Governance Platform for AI Systems

Traccia:一个基于OpenTelemetry的人工智能系统治理平台

Nutan Kumar Naik, Aditya Kumar Saroj, Vijay Prasad Poudel, Saurav Samantray, Abhishek Patel

机构 * National Institute of Technology Rourkela(鲁尔基国立技术学院)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.CY

AI总结 研究针对大语言模型和人工智能驱动智能体发展带来的软件治理问题,提出基于OpenTelemetry构建多层次人工智能治理堆栈Traccia,通过添加遥测数据等解决对齐问题,自动创建合规证据包,为企业管理自主人工智能系统创建机器可读基础。

Comments 26 pages, 2 figures, 3 tables, Declaration of generative AI and AI-assisted technologies in the writing process, Declaration of competing interest

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09749 2026-07-14 eess.SP cs.AI cs.LG 新提交 62%

MorphologyFM: A Foundation Model for Morphology-Aware Representation Learning from ECG and Pulse Oximetry Waveforms

MorphologyFM:一种用于从心电图和脉搏血氧波形中进行形态感知表示学习的基础模型

Saiyang Feng, Yuanyun Zhang, Shi Li

机构 * University of the Chinese Academy of Sciences(中国科学院大学) Columbia University(哥伦比亚大学)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 研究针对现有生理波形方法未保留临床意义波形形态的问题,提出多模态基础模型MorphologyFM,通过形态感知自监督学习目标预训练,结合多种技术学习相关表示,在多下游任务中表现优于其他方法,证明联合建模更具可转移性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06269 2026-07-10 cs.AI cs.CL 新提交 62%

From Application-Layer Simulation to Native Meta-Architecture: Structural Tension as an Endogenous Driver for Heterogeneous AI Evolution

从应用层模拟到原生元架构:结构张力作为异构人工智能进化的内生驱动因素

Heting Mao

机构 * Shanghai Lixin University of Accounting and Finance(上海立信会计金融大学)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 研究针对大语言模型无状态需应用层模拟的问题,提出理论框架,引入结构张力、离线循环回路、推理时可塑性三种机制,使模型实例能演化出不同拓扑结构,构成异构智能生态,重新定位治理为架构智能主要标准。

Comments 17 pages, 1 equation, no figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05163 2026-07-07 cs.CY cs.AI 新提交 62%

Open Problems in AI Incident Governance

AI事件治理中的开放问题

Harleen Kaur Sidhu, Rebecca Scholefield, Nour Annan, Kevin Hernandez, Isabel Nieh Hou, Abdulrahman Alshaikhi, Ze Shen Chin, Rokas Gipiškis

机构 * Independent(独立) Sorbonne University(索邦大学) Rice University(里奇大学) Columbia University(哥伦比亚大学) AI Standards Lab(人工智能标准实验室) Vilnius University(维尔纽斯大学)

专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY

AI总结 针对部署后AI系统的未预期故障,该研究梳理现有AI事件治理框架,发现其在定义、分类等方面缺乏一致性,为后续相关规范完善提供参考。

Comments Accepted to ICML Technical AI Governance Research workshop 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03510 2026-07-07 cs.SE cs.AI cs.CY 新提交 62%

CAGE-1: Control, Assurance, and Governance Evaluation for Enterprise Agentic AI

CAGE-1:企业智能代理人工智能的控制、保证和治理评估

Roopam W. Sure

机构 * Independent technical report(独立技术报告)

专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY

AI总结 研究企业人工智能从实验转向运营工作流带来的评估问题,介绍CAGE-1评估框架,评估多方面内容,引入预绑定保证,用于判断企业代理是否可部署。

Comments 17 pages, 3 figures; independent technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02245 2026-07-03 cs.AI cs.CY cs.HC 新提交 62%

Copewell: A Multi-Agent Swarm Architecture for Equitable Mental Wellness Support

Copewell: 一种用于公平心理健康支持的多智能体群体架构

Seren Yenikent, Jack Vinijtrongjit, Katherine Ng

机构 * Copewell

专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY

AI总结 提出Copewell多智能体群体系统,通过多源评估、情感映射和双模式干预,扩大心理健康支持的可及性,并融入隐私优先和伦理监督设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00415 2026-07-02 cs.CL cs.LG 新提交 62%

A Mechanistic View of Authority Hierarchy in LLM Sycophancy

LLM 谄媚中权威层级的机制性视角

Emil Joswin, Srujananjali Medicherla, Priyanka Mary Mammen

机构 * Independent Research(独立研究)

专题命中 AI治理与伦理 :safety(abstract);分类 cs.CL、cs.LG

AI总结 通过受控医疗QA实验,发现LLM按感知权威程度分级响应,机制是特定后期层中正确答案表征被权威信号主动擦除,且该擦除与权威水平成比例、抵抗均值向量干预、仅部分可逆。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30657 2026-07-01 cs.CY cs.AI 新提交 62%

AI for Quality Assurance in the Operating Room

手术室中用于质量保证的人工智能

Pietro Mascagni, Lalith Sharan, Deepak Alapatt, Nicolas Padoy

机构 * Fondazione Policlinico Universitario Agostino Gemelli IRCCS(阿戈斯蒂诺·杰梅利大学综合医院基金会IRCCS) Institute of Image-Guided Surgery, HU-Strasbourg(斯特拉斯堡大学医院图像引导外科研究所) University of Strasbourg, CNRS, INSERM, ICube, UMR7357(斯特拉斯堡大学,法国国家科学研究中心,法国国家健康与医学研究院,ICube实验室,UMR7357) Scialytics SAS(Scialytics SAS公司)

专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY

AI总结 本文提出AI赋能的手术质量保证框架,利用手术视频数据实现术中质量持续评估与改进,并讨论了关键挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26203 2026-06-26 cs.AI cs.CY cs.MA cs.SI 新提交 62%

Agentic Analysis for Agentic Infrastructure: An LLM-Powered Pipeline for Comparative Governance of DAO and Corporate AI Protocols

面向代理基础设施的代理分析:基于LLM的DAO与企业AI协议比较治理管道

Yutian Wang, Luyao Zhang

机构 * Duke Kunshan University(昆山杜克大学)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.CY

AI总结 提出LLM驱动的比较分析管道,结合自动标注、神经主题建模和多层网络分析,研究DAO与企业AI协议的治理结构,发现开放治理促进主题收敛但参与不平等普遍存在。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22097 2026-06-23 cs.CL cs.AI 新提交 62%

Plurification in/of language technology -- The integration of culture in next-generation AI

语言技术中的/对语言技术的净化——下一代AI中的文化整合

Gertraud Koch, Fausto Giunchiglia

机构 * University of Hamburg(汉堡大学) University of Trento(特伦托大学)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 本文探讨如何在自然语言处理中操作化“文化”,提出文化对齐需要多元认识论,而非仅添加“其他文化”示例,并通过技术活动五层模型分析现有方法,指出多数方法仅停留在输出或表征层面,需转向反思性多元社会技术路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20699 2026-06-23 cs.MA cs.AI cs.CY 新提交 62%

Structural Distinguishability of Static and Adaptive Policy Regimes in Agent-Based Regulatory Simulation

基于智能体的监管模拟中静态与自适应政策机制的结构可区分性

Roberto Garrone

机构 * Open University of Cyprus(塞浦路斯开放大学)

专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY

AI总结 本文通过可配置的排放监管ABM基准,比较四种政策-智能体机制,揭示自适应政策与智能体交互导致监管结论差异,提出机制可区分性评估方法。

Comments 19 pages, 4 figures, 9 tables. Simulation-based methodological study

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18649 2026-06-19 cs.MA cs.CL cs.CY 新提交 62%

Gender Bias in LLM Hiring Decisions: Evidence from a Japanese Context and Evaluation of Mitigation Strategies

LLM招聘决策中的性别偏见:来自日本语境的证据及缓解策略评估

Serena A. Hoffstedde, Machiko Hirota, Akshara Nadayanur Sathis Kanna, Rihito Kotani, Ujwal Kumar, Gabriele Trovato, Phan Xuan Tan

机构 * Shibaura Institute of Technology, Tokyo, Japan(Shibaura技术学院,东京,日本) Amsterdam University of Applied Sciences, Amsterdam, Netherlands(阿姆斯特丹应用科学大学,阿姆斯特丹,荷兰) University of Pennsylvania, Philadelphia, USA(宾夕法尼亚大学,费城,美国) Carnegie Mellon University, Pittsburgh, USA(卡内基梅隆大学,匹兹堡,美国) Keio University, Tokyo, Japan(庆应大学,东京,日本)

专题命中 AI治理与伦理 :safety(abstract);分类 cs.CL、cs.CY

AI总结 本研究通过60份日本履历书格式的简历和5个先进LLM,发现所有模型均存在显著的亲女性偏见,且简单的提示指令无法缓解,而移除姓名几乎完全消除该偏见。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16407 2026-06-16 cs.CL cs.LG 新提交 62%

A Mechanistic Understanding of Pronoun Fidelity in LLMs

对大型语言模型中代词忠实性的机制理解

Katharina Trinley, Jesujoba O. Alabi, Dietrich Klakow, Vagrant Gautam

机构 * Saarland University(萨尔大学) Heidelberg Institute for Theoretical Studies(海德堡理论研究所)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.LG

AI总结 通过因果分析发现,代词忠实性由组实体绑定、近因偏差和刻板印象偏差三种因果子空间共同作用,解释了91-99.5%的行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13693 2026-06-16 cs.CY cs.AI 新提交 62%

Limited Marginal Benefit of Reasoning-Heavy LLM Deployment in ESG Narrative Scoring: A 4-Model Consensus Study on Japanese Listed Firms

ESG叙述评分中重度推理LLM部署的有限边际收益:一项关于日本上市公司的4模型共识研究

Hiroyuki Kokubu

机构 * Kansai University(关西大学)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.CY

AI总结 通过4模型共识设计,研究在ESG叙述评分中,重度推理模型相比非推理模型是否带来显著收益,发现其边际收益有限且成本高昂。

Comments 12 pages. Earlier version available on SSRN, Abstract ID 6683303

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12420 2026-06-12 cs.CY cs.AI 新提交 62%

Eigenism: Ethics for a Human-AI Future

Eigenism:人类与人工智能未来的伦理学

Dan Hendrycks

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.CY

AI总结 提出Eigenism伦理框架,将身份视为分级分布的信息模式,通过加权求和评估AI的福祉,并推广至人类,为AI对齐提供“身份工程”新路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11218 2026-06-11 cs.CY cs.AI 新提交 62%

An Ethical eValuation Agent (EeVA): Results of a Proof-of-Concept Test on a Prototype Agentic-like Workflow to Assist Ethical Deliberations

伦理评估代理(EeVA):在原型类代理工作流中辅助伦理审议的概念验证测试结果

Stephen Milford, B. Zara Malgir, Miguel Vazquez

机构 * Institute for Biomedical Ethics, Basel University(伦理研究所,巴塞尔大学) North-West University(北开普大学) Barcelona Supercomputing Center(巴塞罗那超级计算中心)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.CY

AI总结 提出基于LLM的类代理工作流EeVA,通过10种伦理框架评估用例,生成结构化评估与综合,促进伦理反思而非给出绝对答案,在三个案例中验证了可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏