【标杆 Harness 横评】从 Claude Code 到 Pi:5 大 Coding Agent Harness 在 6 件套上的设计哲学与机制差异
从 5 个主流 Coding Agent Harness 内部源码(Claude Code 136k⭐ + Codex 95k⭐ + Hermes 209k⭐ + OpenClaw 381k⭐ + Pi 67k⭐)出发,把 Harness 6 件套当坐标系,逐一拆解 5 个底座 Harness 的内核机制差异。
从 5 个主流 Coding Agent Harness 内部源码(Claude Code 136k⭐ + Codex 95k⭐ + Hermes 209k⭐ + OpenClaw 381k⭐ + Pi 67k⭐)出发,把 Harness 6 件套当坐标系,逐一拆解 5 个底座 Harness 的内核机制差异。
深入剖析 zai-org/Open-AutoGLM 的核心架构与设计原理。这是智谱 AI 开源的「Phone Agent」框架,用 9B 视觉语言模型理解手机屏幕,通过 ADB/HDC/WDA 三协议驱动 Android/HarmonyOS/iOS,覆盖 think→action→tool→loop 主循环、置信度阈值、敏感操作接管、相对坐标归一化等关键设计。
深入剖析 zai-org/Open-AutoGLM 的核心架构与设计原理。这是智谱 AI 开源的「Phone Agent」框架,用 9B 视觉语言模型理解手机屏幕,通过 ADB/HDC/WDA 三协议驱动 Android/HarmonyOS/iOS,覆盖 think→action→tool→loop 主循环、置信度阈值、敏感操作接管、相对坐标归一化等关键设计。
从 BerriAI/litellm(52,608⭐,2026-07-05 最新提交,100+ LLM 厂商 AI Gateway)出发,深度对比 Hook/Event 系统设计哲学:LiteLLM CustomLogger + CustomBatchLogger 异步队列 vs LangChain BaseCallbackHandler 多继承 Mixin vs Langfuse Ingestion 三段式 + 双库双写 vs OpenLIT OpenTelemetry-native 单一抽象;详解 4 个可运行代码(自定义 logger、批处理队列、agentic loop patch、OpenTelemetry exporter)。
从 omnigent-ai/omnigent(6.1k⭐,2026-07-03 最新提交,Apache-2.0)出发,深度解析 Harness 6 件套完成后"横向对比"阶段的 Meta-Harness 设计:22 个内置 Harness 的能力矩阵(IntegrationMode × Elicitation × Resume × EffortFamily × ModelFamily × AuthModel 六轴)、HarnessContribution Python Entry Point 插件协议、bwrap + seccomp 双层 OS 级沙箱(含 K8s RuntimeDefault 同源 syscall denylist + 多 ABI 防御)、L7 Egress Proxy + Credential Swap-on-Access 凭据隔离、Policy Engine 组合求值(FILTER-GATE-DISPATCH-COMPOSE 四步)。
深度剖析 mlflow/mlflow 仓库(⭐26.8k,月下载量 6000 万+)的核心架构:从 2018 年的 ML 实验跟踪工具,演进为 2026 年覆盖 Tracing、Evaluation、Prompts、Agent Serving 四大支柱的开源 AI 工程平台。剖析其 OTel 12 套 schema 转换器、可对齐的人类反馈 Judge、ResponsesAgent OpenAI 兼容服务器、AIMD 自适应限流器等核心设计。
从 microsoft/mcp-gateway(725⭐,MIT,C# ASP.NET Core 8)出发,深度解析 Harness 6 件套中"MCP"组件的工程化实现:双向数据/控制面分离、Session 三元组绑定对抗劫持、Path canonicalization 对抗 symlink 逃逸、Bash denylist + Sandbox 环境变量最小化。
深度剖析 Panniantong/Agent-Reach(48.3k stars)的 Channel + Backend 双层路由架构:15 个内置频道(Twitter/YouTube/Reddit/Bilibili/小红书/雪球/V2EX/小宇宙/LinkedIn/Exa Search)、ordered backends 候选探活两段式、probe_command 五态机(ok/missing/broken/timeout/error)区分 which() 假阳性、Cookie 浏览器自动提取、Whisper Groq→OpenAI 回退、OpenCLI/yt-dlp/twitter-cli/bili-cli 多后端灾备、MCP 双向接入、doctor 体检系统的工程化实现。这是一份把「让 Agent 能上网」从 prompt 玩具变成 SRE 级基础设施的实战解构。
从 microsoft/agent-governance-toolkit(4.5k⭐,2026-07-01 最新提交)的 Sub-Agent 维度切入,深度解析 Harness 6 件套中"Sub-Agent 失败恢复"组件的工程化实现:Cascade Circuit Breaker 三态机、Saga Step Handoff + 补偿动作、Face/Hands Kernel Trust Boundary、Kill Switch 6 类触发原因、指数退避 + Jitter 重试、Reversibility 四级评估、Deterministic Trust Root。
深度剖析 builderz-labs/mission-control(⭐5.5k, MIT)的核心架构:一套自托管的 AI Agent 编排控制平面,内置 SQLite + 32 个面板 SPA、四层 Eval 引擎、Skills Hub 安全扫描器,以及覆盖 OpenClaw/CrewAI/LangGraph/AutoGen/Claude SDK 的统一 Framework Adapter 抽象层。