Skip to content

Agent Engineering

智能体工程概述:四层模型(prompt ⊂ context ⊂ harness ⊂ loop)与 agent = model + harness。

Updated View as Markdown

Agent Engineering

Agent Engineering 是把 Agent 从“能跑的 Demo”变成“能上生产系统”的工程学科。核心公式:Agent = Model + Harness。模型负责推理和生成,Harness 负责其余一切:工具执行、权限、上下文、状态、观测、评测。

模型能力决定上限,Harness 决定这个上限能否稳定复现。很多团队花几个月优化 Prompt 和模型选择,交付依然脆弱,问题往往出在 Harness。

四层模型

Agent 工程可以拆成四个递进的层次:

四层递进模型

  • Prompt Engineering:指令的表达。System Prompt 结构、Few-shot、工具描述、缓存布局
  • Context Engineering:上下文的管理。在正确时间把正确信息以正确结构交给模型,包括选择、压缩、隔离
  • Harness Engineering:运行的边界。工具执行、权限管线、沙箱、状态恢复、可观测性
  • Loop Engineering:循环的控制。终止条件、失败出口、预算、验证、maker/checker 分离

四层的关系是递进的:Prompt 决定模型每轮如何思考,Context 决定它看到什么,Harness 决定它能不能做,Loop 决定它何时停。没有好的 loop 设计,前三层再好也只是单次任务的工具。

每一层都编码了一个假设:模型单独做不好什么。模型能力升级后,Harness 要重新评估,过去必要的补丁可能变成新的复杂度。

本篇目录

  • Prompt Engineering:指令怎么写
  • Context Engineering:上下文怎么管
  • Harness Engineering:边界怎么立
  • Loop Engineering:循环怎么控
  • Agent Memory:记忆怎么存
  • Agent 评估:效果怎么量化
  • 安全与 Guardrails:风险怎么兜

面试追问

  1. Agent = Model + Harness 怎么理解? 模型负责推理,Harness 负责工具、权限、上下文、状态、观测。模型决定想做什么,Harness 决定能不能做、做到哪、有没有记录
  2. 四层模型是什么? Prompt(指令)⊂ Context(信息)⊂ Harness(边界)⊂ Loop(循环)。递进关系,后一层建立在前一层之上
  3. 为什么说 Harness 决定上限? 模型能力是必要不充分条件。上下文污染、工具调用不可靠、没有安全网,再强的模型也白搭
  4. 模型升级后要做什么? 重新评估 Harness。有些过去为了弥补模型短板打的补丁,模型变强后成了复杂度,该删
  5. 四层从哪开始学? 从下往上:先写好 Prompt,再管 Context,再立 Harness 边界,再设计 Loop 控制。生产问题排查也按这个顺序
Navigation

Type to search…

↑↓ navigate↵ selectEsc close