← FengTechs

Agent Harness 的 15 个硬需求

📅 2026-06-18 Agent 架构 生产级 Harness X
🐦 X: @XAMTO_AI · Jun 18, 2026

Amto (@XAMTO_AI) 推荐,Mike Piccolo(@mfpiccolo)在 iii.dev 发表的文章。核心观点:现有 Agent 框架(LangChain、LangGraph、OpenAI SDK、Anthropic SDK、CrewAI、AutoGen)本质上是错的——一个单体框架捆绑了 10-12 个不同职责,当某个组件不匹配时你只能 fork 或绕路。

替代方案:一组独立、可替换的 worker,通过单一原语 iii.trigger() 连接,每个 worker 独立版本化、独立部署。


一个 Agent Harness 必须做的 15 件事

1接受 turn 请求并持久化
2解析模型供应商的凭据
3查找模型能力(视觉、工具、流式、上下文窗口)
4驱动每轮状态机(provision → stream → run tools → steer → teardown)
5加载 skill 主体(函数请求格式、错误码、用法说明)
6组装系统提示词(模式段 + 身份前缀 + skills 附录)
7流式输出 token 给客户端
8在每次 tool call 前检查策略
9暂停需要人工审批的 tool call
10跟踪 LLM 花费(按 workspace / agent 做预算)
11在 tool call 前后运行 hooks(日志、脱敏、副作用)
12持久化会话为分支树(fork 和 resume)
13上下文窗口满时压缩会话历史
14为 UI 发出事件流
15贯穿每一步的 OpenTelemetry 追踪

iii 架构:11 个 Worker

Worker职责
iii-directorySkill & prompt 注册中心
harness策略检查、事件推送
turn-orchestrator11 状态的状态机,驱动每轮对话
approval-gate人工审批入口
session分支会话存储
llm-budget花费限制 + 预警
hook-fanout通用发布-收集
auth-credentials凭据保险库
models-catalog模型能力目录
provider-*Anthropic / OpenAI / Kimi / LM Studio
context-compaction历史压缩

关键洞见


关键链接