Recognition Without Mitigation: Ethical Frameworks in Autonomous Offensive-LLM Agent Research
自主渗透测试代理研究中的伦理声明
专题命中 AI治理与伦理 :safety(abstract)
AI总结 本文分析利用大语言模型进行进攻性安全研究的论文,探讨伦理考量的表达与合理性,揭示学术社区在创新与伦理责任之间的平衡现状。
Comments Accepted at AutonomousCyber 2026
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
自主渗透测试代理研究中的伦理声明
专题命中 AI治理与伦理 :safety(abstract)
AI总结 本文分析利用大语言模型进行进攻性安全研究的论文,探讨伦理考量的表达与合理性,揭示学术社区在创新与伦理责任之间的平衡现状。
Comments Accepted at AutonomousCyber 2026
通过透明性和可追溯性弥合人工智能辅助科学软件开发的差距
专题命中 AI治理与伦理 :safety(abstract)
AI总结 本文探讨了在严格软件质量保证背景下如何负责任地使用人工智能辅助科学软件开发,提出了一种结构化框架用于AI辅助的验证与验证案例开发,以确保软件质量。
Comments 11 figures, 25 main pages (42 total pages including supplementary materials)
DobicVLM:通过群体相对策略优化使胸部X光报告生成与临床基础的程序化奖励保持一致
机构 * Dobic Health(多比克健康公司) ; University of Ibadan(伊巴丹大学)
专题命中 AI治理与伦理 :alignment(abstract)
AI总结 研究针对自动胸部X光报告生成难题,提出DobicVLM模型,结合监督微调、GRPO及临床奖励,用可解释规则组件执行标准,经训练和评估,该模型多数标准优于Gemini 2.5 Flash,证明GRPO在资源受限设置中的价值。
移动-然后-操作:用于类人机器人操作的行为相位
机构 * Hangzhou Institute for Advanced Study, University of Chinese Academy of Sciences, Hangzhou, China.(杭州高等研究院,中国科学院大学,中国杭州) ; University of Science and Technology of China, Hefei, China.(中国科学技术大学,中国合肥) ; School of Aritificial intelligence, Institute of Artificial Intelligence, University of Science and Technology Beijing, Beijing, China(人工智能学院,人工智能研究院,北京科技大学,中国北京)
专题命中 AI治理与伦理 :alignment(abstract)
AI总结 本文提出Move-Then-Operate框架,将机器人操作分为粗略移动和接触关键交互两个阶段,通过双专家策略提升操作精度与效率。
Comments 15 pages, 10 figures
多智能体LLM治理:SDN-IoT防御中安全的两时间尺度强化学习
专题命中 AI治理与伦理 :safety(abstract)
AI总结 提出两时间尺度SDN-IoT防御方案,快时间尺度使用PPO智能体进行控制器感知的缓解,慢时间尺度使用多智能体LLM治理引擎生成可审计的策略更新,在保证安全约束下提升防御性能。
公平性审计代理系统在早发性结直肠癌检测中缓解偏见的消融研究
专题命中 AI治理与伦理 :safety(abstract)
AI总结 提出双代理架构(领域专家代理+公平性顾问代理),通过消融实验比较不同配置下大语言模型在公平性审计中的表现,发现带RAG的代理系统在识别差异方面语义相似度最高。
利用具身体 agent:运行时治理以实现政策约束执行
机构 * School of Software, Harbin Institute of Technology(哈尔滨工业大学软件学院) ; School of Computer Science and Technology, Harbin Institute of Technology(哈尔滨工业大学计算机科学与技术学院) ; School of Mathematical and Computer Sciences, Heriot-Watt University, Malaysia Campus(赫瑞-沃德大学马来西亚校区数学与计算机科学学院) ; School of Future Science and Engineering, Soochow University(苏州大学未来科学与工程学院) ; Fraunhofer Institute for Applied Information Technology(弗劳恩霍夫应用信息技术研究所)
专题命中 AI治理与伦理 :safety(abstract)
AI总结 本文提出了一种政策约束执行框架,通过将 agent 认知与执行监督分离,增强了具身体 agent 的运行时治理能力,通过 1000 次随机模拟验证,显著提高了对未经授权动作的拦截率和系统恢复成功率。
Comments 36 pages, 3 figures, 10 tables