arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-04-10 至 2026-04-10 共收录 2 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. AI治理与伦理 2 篇

2603.21354 2026-04-10 cs.LG cs.DC 70%

The Workload-Router-Pool Architecture for LLM Inference Optimization: A Vision Paper from the vLLM Semantic Router Project

面向LLM推理优化的负载-路由-池架构:来自vLLM语义路由项目的愿景论文

Huamin Chen, Xunzhuo Liu, Bowei He, Fuyuan Lyu, Yankai Chen, Xue Liu, Yuhan Liu, Junchen Jiang

机构 * McGill University(麦吉尔大学) University of Chicago(芝加哥大学)

专题命中 AI治理与伦理 :safety(abstract);jailbreak(abstract);分类 cs.LG

AI总结 本文提出Workload-Router-Pool架构,通过负载、路由、池三个维度优化LLM推理,结合路由策略与负载特征,解决多任务、多模态、多代理场景下的推理效率与安全性问题。

Comments Vision Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07591 2026-04-10 stat.ME cs.AI cs.CL cs.LG stat.ML 67%

From Ground Truth to Measurement: A Statistical Framework for Human Labeling

从真实数据到测量:人类标注的统计框架

Robert Chew, Stephanie Eckman, Christoph Kern, Frauke Kreuter

机构 * RTI International(RTI国际) University of Maryland(马里兰大学) LMU Munich(慕尼黑大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出统计框架,将标注过程视为测量过程,分解标注结果中的变异来源,为数据驱动的机器学习提供指导。

详情

展开后加载摘要…

URL PDF HTML 收藏