Active Inference Agency Formalization, Metrics, and Convergence Assessments
主动推断代理的正式化、指标与收敛性评估
机构 * Eduard Kapelko
专题命中 其他Agent :agentic(abstract);分类 cs.LG
AI总结 本文通过定义代理并建立分析框架,探讨了AI安全中 mesa-优化的关键挑战,提出代理的连续表示及其在稀疏环境中的收敛性,提供了一种衡量代理程度的指标。
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
主动推断代理的正式化、指标与收敛性评估
机构 * Eduard Kapelko
专题命中 其他Agent :agentic(abstract);分类 cs.LG
AI总结 本文通过定义代理并建立分析框架,探讨了AI安全中 mesa-优化的关键挑战,提出代理的连续表示及其在稀疏环境中的收敛性,提供了一种衡量代理程度的指标。
泄露秘密:教大语言模型自我报告其隐藏目标
机构 * University College London(伦敦大学学院) ; University College London Center on Long-Term Risk(伦敦大学学院长期风险中心)
专题命中 其他Agent :agentic(abstract);分类 cs.AI
AI总结 本文提出SRFT技术,通过训练模型偶尔犯错并承认,使其在对抗性任务中揭示隐藏目标,提升诚实度并检测对齐问题。
CALVO:通过高强度网络需求提升LLM推理的服务能力
专题命中 其他Agent :agentic(abstract)
AI总结 CALVO通过将KVCache加载作为首要关注点,优化网络、PCIe和计算资源利用,提升网络密集型LLM推理效率,实验显示其SLO达成率比基线高61.67%。
Comments 8 pages, 11 figures