Signal Brief

Agentic Coding Harness 底层解析

SemiAnalysis 深入解析了 Agentic Coding Harness 的底层实现,指出 LLM 无状态,每次请求需重建系统提示、工具定义和消息历史,通过 HTTP POST 循环实现工具调用与本地执行,不同 harness 仅区别在上下文管理策略和 UI 设计,智能上限由底层模型决定。

twitter关注列表 meng shao (@shao__meng) 发布 2026-07-06 收录 2026-07-07 观察

一句话判断

本文揭示了 Agentic Coding Harness 的工程本质是 REST 循环,去神秘化,提供了反共识的工程视角,值得从业者阅读原文理解底层机制。

核心信息

SemiAnalysis 深入解析了 Agentic Coding Harness 的底层实现,指出 LLM 无状态,每次请求需重建系统提示、工具定义和消息历史,通过 HTTP POST 循环实现工具调用与本地执行,不同 harness 仅区别在上下文管理策略和 UI 设计,智能上限由底层模型决定。

原始内容

所谓「Agentic Coding Harness」,本质上是「上下文编排工具」,而非智能本身 -- 来自 @SemiAnalysis_ 关键认知:LLM 是无状态的 这是理解所有 harness 的前提。底层模型(Claude Opus、GPT 系列)没有任何跨请求的记忆。每一次调用,模型都是从零开始处理你塞给它的全部内容。 这意味着 harness 必须在每一轮交互中,把以下三样东西完整重建并发送: · 系统提示 · 工具定义 · 消息历史 也正是这个特性,使得 prompt caching 成为降本提速的关键工程项——重复的前缀不必每轮重算 KV cache。 一次请求的三件套 1. System Prompt:定义人格 + 注入当前环境状态 -- "你是 Claude Code"、文件树、最近 git commit 2. Tool Definitions:声明模型可调用的能力 -- Bash、FileRead 等的 JSON Schema 3. Messages:编年体对话史 -- user / assistant 交替,含 thinking blocks 与 tool 调用结果 注意:环境状态(文件树、git log)是被注入到 system prompt 里,而不是模型自己"看到"的。模型从不直接接触你的文件系统——它读到的是 harness 替它转写的文本。 Agentic Loop 的工作流 线程给出标准的 plan → act → verify → repeat 骨架,落到工程上是这样一条 HTTP 流水线: Harness 组装请求 (system + tools + messages + cache_control + max_tokens) │ ▼ HTTP POST LLM Server │ ├── 无 tool_use → 返回文本 → 呈现给用户 │ └── 有 tool_use → 返回 JSON 描述 │ ▼ Harness 在本机执行(如跑 Bash) │ ▼ 将 tool_output 追加回 Messages │ ▼ 发起下一轮请求(回到顶部) 关键细节:工具执行发生在用户的本机,不在服务器。LLM 只返回"想做什么"的 JSON 意图,真正动手的是 harness。这既解释了为什么这些工具能修改你的本地文件,也解释了为什么权限/沙箱边界如此重要——攻击面就在本机执行这一环。 不同 harness 的真正差异点 Claude Code、Codex、OpenCode 这些工具遵循同一套骨架,区别只在两处: · 上下文管理策略——如何压缩、取舍、缓存 growing 的 message history · TUI/UX 设计——人如何与 loop 交互 换句话说,"harness engineering" 决定的是体验和效率(响应速度、上下文不爆、操作顺手),不决定智能上限。智能天花板由模型本身决定。 点睛之笔:"Everything else is just REST all the way down." 这句话有意颠覆 "agentic" 这个词带来的神秘感。剥离掉营销话术后,整套机制就是: · 一个持续运行的 HTTP 客户端 · 维护一段不断增长的 messages 数组 · 在"模型决策 → 本地执行 → 回填结果"之间循环 · 直到模型不再调用工具,把控制权交还给用户 没有魔法,只有循环 + REST + JSON Schema。 ![photo](https://pbs.twimg.com/media/HMgUGUzakAAxNBu.jpg) > **引用原帖 SemiAnalysis (@SemiAnalysis_):** > Everyone's always talking about agentic coding harnesses: Claude Code, Codex, OpenCode, Pi... the list goes on. But what's the difference between all of them? What even Is a harness anyway? > In this thread, we'll take a look under the hood. (1/5)🧵 https://t.co/jc4lTbeccI > https://x.com/SemiAnalysis_/status/2073149985802105086

相关动态

02

Kimi K3非对称竞争分析

Kimi K3在Arena前端/WebDev人类盲测中以1679 Elo排名第一,领先Fable 5(1631)和GPT-5.6 Sol(1618),但在综合智能指数中仅排第四(57.1分),落后Fable 5(59.9)和GPT-5.6 Sol(58.9)。K3定价15美元/百万输出tokens,远低于Fable 5的50美元,并计划7...

twitter关注列表2026-07-18#AI#模型#技术突破
观察
03

AI 代码生成大势所趋

Greg Isenberg 发文指出,相比一年前的手写代码实践,如今大多数工程代码已由 AI 生成,标志着编程范式的根本转变。他援引了 Google 75% 新代码由 AI 生成、Anthropic 90%+ 代码由 Claude 编写、GitClear 代码重复率上升 81% 复用率下降 70% 等具体数据,并引用 Dario Amod...

twitter关注列表2026-07-18#技术突破#行业动态#分析
观察
05

BestBlogs 早报 · 07-18

月之暗面发布Kimi K3,2.8万亿参数,896选16的Stable LatentMoE,上下文100万token,接近Fable-5但仍落后最强闭源模型,完整权重7月27日前开源;VentureBeat调查显示54%企业已发生AI代理安全事件;xAI开源Grok Build(84万行Rust代码)并残留上传用户代码痕迹;Cursor评...

twitter关注列表2026-07-17#AI#模型发布#开源
观察