<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:content="http://purl.org/rss/1.0/modules/content/">
  <channel>
    <title>开源 on Z&#39;s Blog</title>
    <link>https://blog.zhangky.com/tags/%E5%BC%80%E6%BA%90/</link>
    <description>Recent content in 开源 on Z&#39;s Blog</description>
    <image>
      <title>Z&#39;s Blog</title>
      <url>https://blog.zhangky.com/images/logo.svg</url>
      <link>https://blog.zhangky.com/images/logo.svg</link>
    </image>
    <generator>Hugo -- 0.160.1</generator>
    <language>zh-cn</language>
    <lastBuildDate>Mon, 17 Aug 2026 06:31:20 +0800</lastBuildDate>
    <atom:link href="https://blog.zhangky.com/tags/%E5%BC%80%E6%BA%90/index.xml" rel="self" type="application/rss+xml" />
    <item>
      <title>Harness的最佳实践：DSH的64天启示录</title>
      <link>https://blog.zhangky.com/posts/2026/08/2026-08-17-harness-best-practices-dsh-revelations/</link>
      <pubDate>Mon, 17 Aug 2026 06:31:20 +0800</pubDate>
      <guid>https://blog.zhangky.com/posts/2026/08/2026-08-17-harness-best-practices-dsh-revelations/</guid>
      <description>&lt;p&gt;前一篇文章我做了 DeepSeek Harness（DSH）的 git 考古，拆解了它 64 天 12293 次提交背后的构建哲学——&lt;a href=&#34;https://blog.zhangky.com/posts/deepseek-harness-archaeology/&#34;&gt;《用Agent造Agent：DeepSeek Harness的64天考古与自进化路径》&lt;/a&gt;。那篇是「DSH 是什么、怎么造的」。这篇是「DSH 的经验怎么用」——把那 64 天里被验证过的工程判断，提炼成普通团队可以落地的 AI 辅助开发实践。&lt;/p&gt;
&lt;p&gt;先说清楚为什么值得这么做。DSH 不是又一个「我们用了 AI 写代码所以快」的故事。如果只是这个，Copilot 上市五年了，行业早该被颠覆。DSH 真正反常理的是：一个不到 20 人的团队，用 64 天长出一个 221 包的 agent 运行时，工程严谨度却高得不像 AI 写的——100% 测试覆盖率门、运行时断言强制不变量、设计决策可追溯到每个 commit。这不是「AI 写代码快」，是「harness 思维组织 AI 开发」。&lt;/p&gt;
&lt;h2 id=&#34;这件事恰恰是所有正在探索ai辅助研发甚至是ai主导研发的工程团队乃至技术leader或负责人们日日琢磨的核心命题如何让ai提速的同时守住工程严谨的底线如何把ai从脱缰的效率工具驯化为可控的研发协作者正因如此这套从dsh-64天实战中淬炼出的方法论绝非空泛的理论而是值得每一支团队深思拆解并落地的可行路径&#34;&gt;这件事，恰恰是所有正在探索AI辅助研发（甚至是AI主导研发）的工程团队、乃至技术Leader或负责人们日日琢磨的核心命题——如何让AI提速的同时，守住工程严谨的底线；如何把AI从「脱缰的效率工具」驯化为「可控的研发协作者」。正因如此，这套从DSH 64天实战中淬炼出的方法论，绝非空泛的理论，而是值得每一支团队深思、拆解并落地的可行路径。&lt;/h2&gt;
&lt;h2 id=&#34;一认知转变从用-ai-写代码到用-harness-组织-ai-开发&#34;&gt;一、认知转变：从「用 AI 写代码」到「用 harness 组织 AI 开发」&lt;/h2&gt;
&lt;p&gt;市场上有四个比较成熟的 AI 辅助开发流派，先把它们摆清楚：&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;流派一：Copilot/Cursor 模式——AI 当打字员&lt;/strong&gt;。人主导写代码，AI 补全和局部重构。这是目前最普及的模式，门槛低，但天花板也低——AI 只能在人画的圈子里做事，产出节奏受限于人的审查速度。&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;流派二：Claude Code/Codex 单 agent 模式——AI 当执行者&lt;/strong&gt;。人给一个任务描述，AI 执行多步任务（改多个文件、跑测试、修 bug）。这是 Cursor Composer、Claude Code 的典型用法。天花板比流派一高，但问题是 agent 会自己跑偏，没有不变量挡着，跑几次就积累一堆边界情况。&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;流派三：Aider 模式——git commit 驱动&lt;/strong&gt;。AI pair programmer，每次改动自动 commit，人通过 git history 审查。这个模式把 git 当成 AI 产出的审计层，是个好思路，但它只管「改了什么」，不管「为什么这么改」和「规则有没有被破坏」。&lt;/p&gt;</description>
    </item>
    <item>
      <title>用Agent造Agent：DeepSeek Harness的64天考古与自进化路径</title>
      <link>https://blog.zhangky.com/posts/2026/08/2026-08-16-deepseek-harness-git-archaeology/</link>
      <pubDate>Sun, 16 Aug 2026 21:06:09 +0800</pubDate>
      <guid>https://blog.zhangky.com/posts/2026/08/2026-08-16-deepseek-harness-git-archaeology/</guid>
      <description>&lt;p&gt;网上已经有不少技术博主在拆 DSH 的架构图，把它和 Claude Code、Codex CLI 并列比较，论证这套「一切皆插件」机制的优雅和影响力——这些分析有它们的道理，我也认同 DSH 的设计水准。但我想看的不是它&lt;strong&gt;长什么样&lt;/strong&gt;，而是另一个更工程化的问题：&lt;strong&gt;这样一个被 DeepSeek 视为战略级产品的 agent harness，是怎么在 64 天里被造出来的？&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;答案写在仓库的 commit 历史里。从 6 月 10 日第一条提交到 8 月 13 日公开发布，64 天，12293 次提交，日均 192 次。这不是人类节奏，是 AI 辅助开发在版本控制系统里留下的沉积物。我用 git 考古翻了一遍这个仓库，反推一件更底层的事：&lt;strong&gt;顶级团队是怎么用 Agent 造出最强 Agent 的&lt;/strong&gt;。事实上，Anthropic 的 Claude Code 团队和 OpenAI 的 Codex 团队大概率也是这么干的——只是他们的开发过程不公开。这次 DSH 把整个仓库开源，给了我们一个可以近距离观察顶级 AI 团队研发范式的窗口。这是我写这篇文章的起点。&lt;/p&gt;
&lt;p&gt;三天前我写林俊旸把 20 亿估值押给 Agent，结论是他选了一条「模型 + 环境」的工程路线。文章里我反复引用 Lilian Weng 的判断：Claude Code、Codex 之所以强，不是因为底模最强，而是 Harness 设计最成熟。那篇文章发出去之后我一直在想一个更具体的问题：harness 到底长什么样？&lt;/p&gt;
&lt;p&gt;8 月 13 日，DeepSeek 给了一个可以拆解的样本。他们把内部那个叫 DeepSeek Harness（&lt;code&gt;dsh&lt;/code&gt;）的 agent 运行时开源了，MIT 协议，221 个 npm 包。和它同步发布的还有 DeepSeek-V4-Pro 正式版，以及一篇 80 多页的论文《A Programming Paradigm for Spatiotemporal Composability》。&lt;/p&gt;</description>
    </item>
  </channel>
</rss>
