系列文章见: 《回忆AI时代-从图灵机到人工智能》
什么是Harness
2026年2月,OpenAI工程师Ryan Lopopolo发表了一篇颇具影响力的文章《Harness Engineering: Leveraging Codex in an Agent-First World》。
文中披露了一组令人印象深刻的数据,一个小团队仅用了5个月,借助Codex自动完成了约100万行代码、创建了1500个PR,整个过程中几乎没有人工编写任何代码。这并非实验室里的Demo,而是一套已经拥有内部日活用户的真实生产系统。OpenAI将这种全新的AI开发模式称为Harness Engineering。
Harness的本意
Harness原本是一个英语单词,意思是马具、挽具。一匹马再强壮,如果没有马鞍、缰绳和车架,就无法稳定地拉动车辆,更无法按照人的意图完成复杂任务。
如果把AI大模型比作一匹拥有巨大潜力的骏马,那么Harness就相当于驾驭它的一整套装备——不仅包括缰绳和马鞍,还包括马车、驾驶规则以及控制系统。它负责让模型的能力真正转化为稳定、可靠、可持续的生产力。
AI编程中的Harness
在AI编程领域,Harness并不是模型本身,而是围绕模型构建的一整套工程化支撑系统。
它包含了模型之外所有用于约束、增强、管理和协同模型工作的基础设施,使原本只能进行单次推理的大模型,能够持续、稳定地完成复杂的软件开发任务。可以把它理解为:
1 | Harness = 模型之外的一切工程能力。 |
这些能力通常包括:
- 为模型提供上下文(Context)和提示词(Prompt);
- 调用各种工具(Tools)和外部 API;
- 管理记忆(Memory)和长期状态;
- 自动执行、测试、调试代码;
- 与 Git、PR、CI/CD 等开发流程集成;
- 控制任务规划、权限、安全和错误恢复;
- 协调多个 Agent 协同完成复杂任务。
因此,真正决定AI能否参与大型软件工程的,不仅仅是模型本身,更重要的是这套围绕模型构建的 Harness。可以说,模型负责“思考”,而 Harness 负责“让思考真正落地执行”。随着AI Agent的快速发展,业界越来越认同一个观点Agent = LLM + Harness其中,LLM提供智能,而Harness 提供工程能力,二者结合,才能让AI从一个“会回答问题的大模型”,成长为一个真正能够独立完成工作的智能体(Agent)。