From Prompts to Contracts: Harness Engineering for Auditable Enterprise LLM Agents
从提示到契约:用于可审计企业大语言模型代理的 harness 工程
机构 * AI Leadership Research Center(人工智能领导力研究中心)
专题命中 安全训练 :safety(abstract);分类 cs.CL、cs.AI
AI总结 研究针对企业大语言模型应用从原型到产品化的需求,提出 harness 工程方法,在韩国企业数据切片上实例化并评估三个问题,包括契约保留、模型替换检查及代码执行效果,形成可将原型转为可审计应用的工程模式。
Comments 32 pages, 6 figures, 16 tables. Reference implementation and evaluation artifacts: https://github.com/hammerbaki/enterprise-llm-agent-harness (archived at https://doi.org/10.5281/zenodo.21269426)