arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-08-06 至 2026-08-06 共收录 92 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 17 篇

2608.04318 2026-08-06 cs.MA 新提交 50%

Responsibility in Multi-Agent Sequential Decision-Making: Comparing Human Judgments to Formal Models of Causal Attribution

多智能体序贯决策中的责任归属:人类判断与因果归因形式模型的比较

Nripsuta Ani Saxena, Stelios Triantafyllou, Goran Radanović

专题命中 其他安全 :alignment(abstract)

AI总结 本研究对比了多智能体序贯决策中责任归因的形式模型与人类判断的契合度,通过大规模调查和Goofspiel实验识别出影响人类责任判断的关键因素。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26368 2026-08-06 cs.NI 版本更新 50%

Introducing Large Language Models into the Design Flow of Time-Sensitive Networking

将大语言模型引入时间敏感网络的设计流程

Rubi Debnath, Luxi Zhao, Mohammadreza Barzegaran, Paul Pop, Sebastian Steinhorst

专题命中 其他安全 :safety(abstract)

AI总结 针对配置优化TSN网络的挑战,通过跨模型案例研究评估现有大语言模型能力,提出LLM辅助编排框架,介绍构建模块与管道,分析实际部署机会与局限,为评估LLM辅助TSN编排可行性提供路线图。

详情

展开后加载摘要…

URL PDF HTML 收藏