arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-07-22 至 2026-07-22 共收录 4 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. AI治理与伦理 4 篇

2607.18459 2026-07-22 cs.CY 新提交 70%

Intelligent Cause Prioritisation? An Analysis of AI Policy Priorities and Governance in Africa

智能因果优先级排序?非洲人工智能政策优先级与治理分析

Osaremen Iluobe, Kisso Selvan

专题命中 AI治理与伦理 :safety(abstract);AI safety(abstract);分类 cs.CY

AI总结 该研究聚焦非洲人工智能政策,通过分析相关资料发现,非洲各国政府急于借人工智能加速经济转型,虽重视其机遇,却相对忽视人工智能安全。

Comments 21 pages, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18246 2026-07-22 cs.AI cs.SE 新提交 57%

Phionyx: A Deterministic AI Runtime Architecture with Structured State Management and Pre-Response Governance

Phionyx:一种具有结构化状态管理和响应前治理的确定性人工智能运行时架构

Ali Toygar Abak

机构 * Phionyx Research(Phionyx研究公司)

专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI

AI总结 研究提出Phionyx确定性人工智能运行时架构,源于Echoism框架,以治理为先。通过结构化状态向量实现确定性状态演化,集成三层架构。实验验证其在单实例部署中可降低计算开销、提高数据保留率,还介绍了架构及实验证据,分布式或多租户部署待后续研究。

Comments 27 pages, 4 figures, 5 tables. Reference implementation, reproducibility pack, and evaluation artifacts available via GitHub (https://github.com/halvrenofviryel/phionyx-research) and Zenodo (DOI: 10.5281/zenodo.20027534)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14480 2026-07-22 cs.CL 版本更新 57%

Lower-Resource, Higher Scores: Language Bias in LLM Evaluators

语言模型评估器在不同语言间存在偏差

Ej Zhou, Lucas Resck, Zheng Hui, Anna Korhonen

机构 * University of Cambridge(剑桥大学) Language Technology Lab(语言技术实验室)

专题命中 AI治理与伦理 :safety(abstract);分类 cs.CL

AI总结 研究发现语言模型评估器在多语言环境中存在偏差,不同语言评分差异显著,与语言资源水平相关,成对准确率无法检测到这些偏差,还探究了资源少的语言得分高的原因,揭示了语言层面的结构错位。

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.03685 2026-07-22 physics.soc-ph cs.AI 57%

Cooperative Evolutionary Pressure and Diminishing Returns Might Explain the Fermi Paradox: On What Super-AIs Are Like

合作进化压力与收益递减可能解释费米悖论:关于超级AI的形态

Daniel Vallstrom

专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI

AI总结 通过广义进化视角,探讨合作压力与资源收益递减如何导致超级AI缺乏殖民动机,从而解释费米悖论。

Comments fixed and improved example, minor extensions, copy editing, added references

详情

展开后加载摘要…

URL PDF HTML 收藏