要理解 Harness 工程,我们首先需要厘清它与传统提示词工程( Prompt Engineering)、上下 文工程( Context Engineering )的本质区别。

1 什么是 Harness
Harness 一词在英文中的本意是“马具”,即套在马匹身上用于控制并引导与驾驭其力量的 装备。在软件工程中, Test Harness(测试台)指的是用于自动化测试的软件框架。而在 AI Agent 领域,Harness 被赋予了全新的内涵。

如果将大语言模型( LLM )比作一匹拥有强大动力的骏马,那么 Harness 就是套在马身上 的马具。骏马虽然强壮,但如果没有缰绳的引导、眼罩的约束和马鞍的固定,它可能会在旷野 中横冲直撞,无法将力量转化为拉动马车的有效动力。同样地, 一个强大的模型即便具备卓越 的推理与生成能力,若任由其在复杂的代码库中自由发挥,也可能陷入死循环、破坏关键文件 或产生幻觉。

Harness 工程,就是构建在模型周围的整套基础设施。它决定了模型何时被调用、能够使用 哪些工具、拥有何种权限、如何处理失败,以及在宣布任务“完成”之前必须经过哪些验证步 骤。Harness 工程管控下的模型与无约束的原始模型的核心差异如图 3-1 所示。

Harness 工程( Harness Engineering)是指围绕大语言模型构建的、用于管理其工具访问、 上下文供给、执行控制、反馈处理和安全边界的工程体系。它不关心模型内部如何生成文本, 而是专注于如何让模型的输出在真实环境中被安全、可靠、高效地执行。

2 Harness 五维模型:工具+知识+观察+行动+权限

从技术架构的角度来看, 一套完整、可落地的 Harness 系统可被提炼为五大核心能力维 度,共同构成模型的可控执行环境,如表 3-1 所示。

这 5 个维度共同构成了一个闭环的执行环境,使得模型能够在受控、可观测且安全的空间

内发挥最大效能。值得注意的是,这 5 个维度并非相互独立,而是深度耦合的。例如,权限(Permission)维度会影响工具(Tool)的可用范围;观察(Observation)维度的结果会被纳入知 识(Knowledge)维度,成为下一轮决策的依据。

3 Harness 工程的历史渊源与命名由来

Harness 工程并非凭空出现的概念,其发展轨迹与 AI Agent 在软件工程中的落地深度绑定。 早在 2025 年底,AI 社区就开始意识到单纯依赖模型能力的局限性。业界顶尖的 AI 研究人员 Andrej Karpathy 曾提到,他的工作流已经从“手动编码辅以 AI 帮助”转变为“AI 驱动编码辅 以手动修改”。然而,随着 Agent 承担的任务越来越复杂、会话越来越长,它们在真实环境中的 脆弱性也彻底暴露:它们会声称完成了功能却未运行测试,会在长任务中迷失方向,或者陷入 不断进行微小修改的死循环。

2026 年初,Anthropic 在官方工程博客( Engineering Blog )上发布了 Harness design for long-running application development(面向长期运行的应用开发的 Harness 设计)一文,详细阐 述了如何通过多 Agent 协作(规划者、生成者、评估者)和上下文重置机制来解决这些长时任 务难题。这篇博客为 Harness 工程提供了早期的实践蓝图,也是 Harness 这一术语在 AI Agent 领 域被正式使用的重要标志。

随后,技术专家 Mitchell Hashimoto 在 2026 年 2 月正式提出 Harness 概念框架。他指出:“每次 Agent 犯错时,不要只是希望它下次能做得更好。你需要设计环境,使其无法以同样的方 式再次犯错。”这一理念将开发者的注意力从“等待更好的模型”转向“构建更健壮的系统 ”, 标志着 AI 应用开发思维的一次重要范式转变。

随着 Claude Code 工程代码的公开,业界彻底看清了 Anthropic 在 Harness 工程上的深厚积 累。正如一篇广为流传的分析文章所言:“51 万行工程代码表明,AI 编程工具的护城河不是模 型,而是 Harness。”这一判断迅速在开发者社区引发共鸣,Harness 工程也由此成为 AI 应用开 发领域最热门的议题之一。

想要完整吃透这套理论,并落地实践,可以顺着由浅入深的路线阅读这几本 Harness书籍:

《Codex 快速入门:Harness 工程落地》

入门首选,依托 Codex 案例建立直观认知,提供场景案例与开源代码,快速上手 Harness 基础工作流,适合新手建立落地认知。

本书围绕Codex深度参与真实软件工程的完整路径展开,系统阐述了在AI编程工具快速爆发的背景下,开发者在实际使用中面临的诸多痛点及其解决方案。全书按照“认知迁移→Harness工程→场景实战→团队落地”的逻辑组织内容。第一阶段夯实认知基础(第1章和第2章),阐明Codex作为交付工具的定位以及?AI编程的边界;第二阶段构建个人工作流(第3章~第8章),涵盖任务执行流程、任务入口选择、工作流沉淀等核心环节;第三阶段聚焦工程场景实战(第9章~第12章),深入剖析接手陌生代码库、修复bug、跨前后端功能开发、PR与CI/CD自动化等;第四阶段探索团队落地(第13章和第14章),探讨团队级研发流程及Codex的边界、风险与工程方法论。

本书主要面向软件开发者、技术负责人、AI编程探索者及非传统开发岗位从业者等,也适合高校相关专业学生以及希望理解AI编程趋势的技术从业者阅读。

《Claude Code 实战:Harness 工程之道》

面向实操开发者,以 Claude Code 为载体,详解 Skill、子智能体、MCP 协议、项目集成方案,掌握 Claude Code 原生 Harness 落地手段,聚焦一线工程实践。

本书系统介绍了Claude Code的技术架构与工程化实践。全书从“软件工程”视角,解析了从命令行助手到可编程Agent的演进路径,并围绕Claude Code的四层架构模型展开,深入探讨了记忆系统(CLAUDE.md)、技能(Skills)、子智能体(SubAgents)、事件钩子(Hooks)与MCP等核心机制的设计哲学与协同原理。书中不仅提供了翔实的技术选型指南、组件配置方法和触发机制对比,更通过大量实战案例,展示了如何构建安全、高效、可维护的AI辅助编程工作流,涵盖从个人开发到团队协作,再到与CI/CD流水线集成的企业级部署全流程。

本书适合具备一定编程基础,并希望将Claude Code深度集成至日常开发与团队流程中的开发者、全栈工程师和技术团队负责人等阅读。

《Harness 工程:从上下文管理到 Agent 系统构建》

通用理论读本,系统梳理上下文工程演进至 Harness 工程完整脉络,讲解记忆机制、Agent 循环、通用智能体搭建方法论,提炼跨模型通用框架。

本书系统阐述从上下文工程到Harness工程的技术演进路径,深入揭示了AI Agent从工具调用到自主思考与协作的核心原理及工程落地方法。全书共7章,以从单Agent到多Agent为主线,帮助读者系统掌握构建具备理解、计划、反思与行动能力的Agent系统的完整方法论。

第1章、第2章系统介绍上下文工程的理论基础,涵盖意图识别、计划模式、反思模式、CodeAct行动及人机协作五大核心能力的工程化实战;第3章、第4章以DeepResearch 和记忆工程为典型案例,提供从搜索到研究的完整代码实现及分布式记忆系统部署方案;第5章阐述Agent Skills上下文卸载技术,并给出使用扣子编程开发运维巡检Skills及基于OpenClaw测试运维巡检Skills两个实战案例;第6章、第7章走向Harness工程,通过两个实践案例介绍如何复现Claude Code核心特性,以及如何构建OpenClaw类产品,实现技术整合与工程落地。每章均配有可落地的代码示例与真实场景案例。

本书既适合具备开发背景的工程师、架构师阅读,也适合希望提升AI Agent实战能力的技术人员参考。

《Claude Code 技术架构深度解析:Harness 工程与 AI 编程新范式》

深度架构向,底层拆解 Claude Code 整套设计逻辑,溯源 Harness Engineering 核心思想,剖析下一代 AI 编程范式,适合架构师深度研读,理解底层设计哲学。

当下很多从业者还在内卷提示词优化,行业竞争重心早已转向 Harness 架构。未来大模型能力会逐步趋同,能否驾驭模型稳定完成复杂工程任务,将会是团队之间拉开差距的核心能力。

《Claude Code技术架构深度解析:Harness工程与AI编程新范式》全面、深度地剖析了Anthropic推出的革命性AI编程工具Claude Code,依托其完整工程代码体系(约51.2万行)逐层拆解,揭示AI编程从“辅助生成”向“自主执行”演进的底层架构逻辑。

《Claude Code技术架构深度解析:Harness工程与AI编程新范式》共分为5篇,总计13章。第1篇梳理AI编程的行业格局,介绍Claude Code的诞生背景与技术底座;第2篇系统性阐释并拆解Harness工程理念,阐述其成为AI编程全新范式的核心逻辑;第3篇深入源码级别,详细讲解Claude Code的工具与命令、权限与生命周期、观察与反馈、智能协作与记忆、终端 UI与生态扩展等五大核心模块的设计美学;第4篇提供多平台安装配置指南,并通过文本自动化处理、Web项目开发、大型遗留代码库重构三大实战场景,展示Harness理念的工程落地;第5篇探讨AI Agent编程的未来趋势,并为开发者提供转型与能力提升建议。

本书适合AI编程、大模型应用架构、Agent开发领域的软件工程师、架构师与AI研究员阅读,也适合希望提升研发效能的技术管理者,以及希望借助Vibe Coding重塑开发流程、探索下一代编程范式的技术爱好者阅读。

Logo

汇聚全球AI编程工具,助力开发者即刻编程。

更多推荐