<?xml version="1.0" encoding="utf-8" standalone="yes" ?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
  <channel>
    <title>Rust | Francis Du</title>
    <link>https://francisdu.com/tags/rust/</link>
      <atom:link href="https://francisdu.com/tags/rust/index.xml" rel="self" type="application/rss+xml" />
    <description>💻Data Engineer | 🦀 Rustacean | 📷 Photographer | 🤖Vibe Coder</description>
    <generator>Hugo 0.166.0</generator><language>zh-CN</language><copyright>© Francis Du</copyright><lastBuildDate>Sat, 19 Sep 2026 15:32:00 +0800</lastBuildDate>
    <item>
      <title>wcode v0.8：我开始把仓库当成一个 Engineering Digital Twin</title>
      <link>https://francisdu.com/blog/wcode-v0-8/</link>
      <pubDate>Sat, 19 Sep 2026 15:32:00 +0800</pubDate>
      <guid>https://francisdu.com/blog/wcode-v0-8/</guid>
      <description>&lt;p&gt;0.7 做完以后，wcode 已经能让 Agent 比较安全地读仓库、改文件、跑验证，也能把 Design State、Software Graph、Evidence 和 Reconciliation 留下来。&lt;/p&gt;
&lt;p&gt;但我自己用它时还有一个很明显的问题：&lt;/p&gt;
&lt;blockquote&gt;
&lt;p&gt;Agent 能操作这个仓库，不代表人能快速看懂这个仓库现在是什么状态。&lt;/p&gt;
&lt;/blockquote&gt;
&lt;p&gt;很多时候我还是会回到 IDE：看目录、找调用方、翻测试、对照 Git Diff，再回 wcode 看验证。几套视图各自都对，但它们没有真正收成同一个工程模型。&lt;/p&gt;
&lt;p&gt;所以 0.8 我想做的不是“再加几个 MCP Tool”，而是把这些东西往一个方向收：&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;把仓库当成一个可以观测、查询、回看，而且知道自己证据精度的 Engineering Digital Twin。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;现在最新版本已经是 &lt;strong&gt;v0.8.1&lt;/strong&gt;。0.8.0 把这个骨架搭起来，0.8.1 又把 Decision Plane 和 Jev 的边界收紧了一轮。&lt;/p&gt;
&lt;figure class=&#34;content-image&#34;&gt;&lt;img src=&#34;https://francisdu.com/img/wcode/wcode-intro-intelligence-stack.zh-CN.svg&#34; alt=&#34;wcode 的工程智能栈：从仓库事实、图关系到验证证据&#34;loading=&#34;lazy&#34; decoding=&#34;async&#34;&gt;&lt;/figure&gt;&lt;h2 id=&#34;code-graph-不再只是把节点画出来&#34;&gt;Code Graph 不再只是“把节点画出来”&lt;a class=&#34;heading-anchor&#34; href=&#34;#code-graph-%e4%b8%8d%e5%86%8d%e5%8f%aa%e6%98%af%e6%8a%8a%e8%8a%82%e7%82%b9%e7%94%bb%e5%87%ba%e6%9d%a5&#34; aria-label=&#34;章节链接：Code Graph 不再只是“把节点画出来”&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;我以前一直对“代码图谱”这件事有点警惕。&lt;/p&gt;
&lt;p&gt;最容易做的是把函数、文件、模块全画成一个大球。看起来信息很多，实际用的时候还是不知道：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;这个关系从哪里来的；&lt;/li&gt;
&lt;li&gt;是 Tree-sitter 看出来的，还是 LSP 确认的；&lt;/li&gt;
&lt;li&gt;是设计里声明的，还是 Runtime 真跑过；&lt;/li&gt;
&lt;li&gt;这个调用关系属于当前代码，还是旧 Snapshot；&lt;/li&gt;
&lt;li&gt;它和这次 Working Tree 改动到底有没有关系。&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;0.8 里我把 Code Graph 放进了 &lt;strong&gt;Engineering Architecture&lt;/strong&gt;，而不是再加一个顶层页面。&lt;/p&gt;
&lt;p&gt;架构还是主视图。Code Graph 只是继续往下钻的一层。&lt;/p&gt;
&lt;p&gt;现在可以从一个符号看 callers、callees、references、dependencies、implementation ownership、tests、requirements，以及 verification / proof context。&lt;/p&gt;
&lt;p&gt;但我不允许它无限扩张。Calls、Impact、All Evidence 都有 depth、node、edge 的硬上限，UI 也按“上游 → 当前节点 → 下游”来排，不做无限节点球。&lt;/p&gt;
&lt;p&gt;更重要的是，每条关系都保留自己的 &lt;strong&gt;provenance&lt;/strong&gt; 和 &lt;strong&gt;precision&lt;/strong&gt;。&lt;/p&gt;
&lt;p&gt;Declared、Syntax、Semantic/LSP、Runtime、Deterministic、Heuristic 不会最后被压成一句“confidence: high”。&lt;/p&gt;
&lt;p&gt;我宁可界面告诉我“这条边只是 syntax 推断”，也不想让一个漂亮的图把不确定性藏掉。&lt;/p&gt;
&lt;h3 id=&#34;graph-history-也进来了&#34;&gt;Graph History 也进来了&lt;a class=&#34;heading-anchor&#34; href=&#34;#graph-history-%e4%b9%9f%e8%bf%9b%e6%9d%a5%e4%ba%86&#34; aria-label=&#34;章节链接：Graph History 也进来了&#34;&gt;#&lt;/a&gt;&lt;/h3&gt;
&lt;p&gt;0.8 的 Code Graph 可以直接切历史 Snapshot。&lt;/p&gt;
&lt;p&gt;这个功能我自己很喜欢，因为它解决的不是“现在代码怎么连”，而是：&lt;/p&gt;
&lt;blockquote&gt;
&lt;p&gt;这条关系以前是不是也存在？&lt;/p&gt;
&lt;/blockquote&gt;
&lt;p&gt;切换 Snapshot 后只是只读时间旅行，不会重新扫描仓库，也不会改当前状态。&lt;/p&gt;
&lt;p&gt;对 Agent 来说这能做 impact/context；对人来说它更像一个工程历史视图。&lt;/p&gt;
&lt;h2 id=&#34;observatory-终于没那么吵了&#34;&gt;Observatory 终于没那么吵了&lt;a class=&#34;heading-anchor&#34; href=&#34;#observatory-%e7%bb%88%e4%ba%8e%e6%b2%a1%e9%82%a3%e4%b9%88%e5%90%b5%e4%ba%86&#34; aria-label=&#34;章节链接：Observatory 终于没那么吵了&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;0.7 时代的 Observatory 有一个很烦的问题：浏览器为了拿新状态，可能连续触发比较重的 Snapshot。&lt;/p&gt;
&lt;p&gt;功能没错，但体感很差。&lt;/p&gt;
&lt;p&gt;0.8 改成每个 Workspace 同时最多只有一个后台重快照。已经有缓存就先给缓存，同时带上 Revision Stamp，明确告诉前端 cached、current、refreshing。&lt;/p&gt;
&lt;p&gt;浏览器自己只做轻量探测，不再 fan-out 一组重请求。&lt;/p&gt;
&lt;p&gt;我顺便把 UI 的层级也重新整理了一次。&lt;/p&gt;
&lt;p&gt;第一眼只看 Project Pulse 和状态；第二眼才看指标、关系、时间线；Evidence 和 Inspector 放到第三层。&lt;/p&gt;
&lt;p&gt;Stale、Unknown、Inconclusive、Failed、Unverified 也不能再长得像绿色 Passing Proof。&lt;/p&gt;
&lt;p&gt;这是个很小的规则，但对“工程控制面”很重要：&lt;strong&gt;UI 不能比底层证据更自信。&lt;/strong&gt;&lt;/p&gt;
&lt;h2 id=&#34;我开始真的把它叫-engineering-digital-twin&#34;&gt;我开始真的把它叫 Engineering Digital Twin&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e6%88%91%e5%bc%80%e5%a7%8b%e7%9c%9f%e7%9a%84%e6%8a%8a%e5%ae%83%e5%8f%ab-engineering-digital-twin&#34; aria-label=&#34;章节链接：我开始真的把它叫 Engineering Digital Twin&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;这个名字以前我其实不太敢用。&lt;/p&gt;
&lt;p&gt;如果只是把代码索引成图，我觉得叫 Digital Twin 有点虚。&lt;/p&gt;
&lt;p&gt;0.8 以后我觉得它开始接近这个词了，因为看到的不再只有 Source：&lt;/p&gt;
&lt;pre&gt;&lt;code&gt;Design State
    ↓
Implementation ownership
    ↓
Syntax / Semantic / Runtime relations
    ↓
Working Tree changes
    ↓
Drift / Risk / Impact
    ↓
Verification / Evidence
&lt;/code&gt;&lt;/pre&gt;
&lt;p&gt;这些东西不是复制一份新的“项目数据库”出来。&lt;/p&gt;
&lt;p&gt;源码、Git、Design State 和 Evidence 仍然各自是事实来源。Digital Twin 只是把它们组织成一个可查询的只读工程视图。&lt;/p&gt;
&lt;p&gt;这点我刻意没有放松。否则最后很容易出现第二份 mutable project state，然后你开始不知道到底应该信代码，还是信“数字孪生”。&lt;/p&gt;
&lt;figure class=&#34;content-image&#34;&gt;&lt;img src=&#34;https://francisdu.com/img/wcode/wcode-intro-engineering-loop.zh-CN.svg&#34; alt=&#34;wcode 的工程闭环：Context、Graph、Change、Verification 与 Evidence&#34;loading=&#34;lazy&#34; decoding=&#34;async&#34;&gt;&lt;/figure&gt;&lt;h2 id=&#34;decision-plane-也在-08-里真正成形了&#34;&gt;Decision Plane 也在 0.8 里真正成形了&lt;a class=&#34;heading-anchor&#34; href=&#34;#decision-plane-%e4%b9%9f%e5%9c%a8-08-%e9%87%8c%e7%9c%9f%e6%ad%a3%e6%88%90%e5%bd%a2%e4%ba%86&#34; aria-label=&#34;章节链接：Decision Plane 也在 0.8 里真正成形了&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;另一个我花时间很多的东西是 &lt;strong&gt;Decision Plane&lt;/strong&gt;。&lt;/p&gt;
&lt;p&gt;Coding Agent 有很多判断其实没必要直接交给大模型：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;Context 够不够；&lt;/li&gt;
&lt;li&gt;要不要继续 Retrieval；&lt;/li&gt;
&lt;li&gt;跨文件关系是不是安全修改前的必要证据；&lt;/li&gt;
&lt;li&gt;是否应该增加 Verification；&lt;/li&gt;
&lt;li&gt;当前状态是不是应该 abstain。&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;0.8 把这类判断收成了 provider-neutral 的结构化信号：Probability、Choice、Score。&lt;/p&gt;
&lt;p&gt;但这里最重要的不是“可以接一个小模型”。&lt;/p&gt;
&lt;p&gt;最重要的是 &lt;strong&gt;Decision Plane 没有拿到安全边界的最终权限&lt;/strong&gt;。&lt;/p&gt;
&lt;p&gt;Authorization、Workspace Boundary、SHA Precondition、Evidence、Risk-derived Verification、Human Approval 还是确定性的。&lt;/p&gt;
&lt;p&gt;Decision Plane 可以说“我建议多查一点”，但不能说：&lt;/p&gt;
&lt;blockquote&gt;
&lt;p&gt;我有 0.93 confidence，所以这个 SHA 不用检查了。&lt;/p&gt;
&lt;/blockquote&gt;
&lt;p&gt;这种路我一开始就不想走。&lt;/p&gt;
&lt;h2 id=&#34;engineering-fitness-不再拿自己的-readiness-当答案&#34;&gt;Engineering Fitness 不再拿自己的 readiness 当答案&lt;a class=&#34;heading-anchor&#34; href=&#34;#engineering-fitness-%e4%b8%8d%e5%86%8d%e6%8b%bf%e8%87%aa%e5%b7%b1%e7%9a%84-readiness-%e5%bd%93%e7%ad%94%e6%a1%88&#34; aria-label=&#34;章节链接：Engineering Fitness 不再拿自己的 readiness 当答案&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;Decision Plane 如果没有独立评测，很容易变成自己给自己打分。&lt;/p&gt;
&lt;p&gt;所以 0.8 的 Context Sufficiency 改成对照独立写的 &lt;strong&gt;Engineering Fitness Gold&lt;/strong&gt;。&lt;/p&gt;
&lt;p&gt;我关心的不只是“有没有找到文件”，而是：&lt;/p&gt;
&lt;ol&gt;
&lt;li&gt;Required Identity 有没有找到；&lt;/li&gt;
&lt;li&gt;完整 Source Body 有没有交给 Agent；&lt;/li&gt;
&lt;li&gt;SHA 是不是新鲜；&lt;/li&gt;
&lt;li&gt;真要编辑时需要的 Edit Inputs 有没有齐。&lt;/li&gt;
&lt;/ol&gt;
&lt;p&gt;0.8.0 发布时那组 60-case model-free diagnostic 里，1K cold / warm 的 Required Identity Recall、Complete Body Recall、Fresh SHA Recall 都是 &lt;strong&gt;100%&lt;/strong&gt;；58 个可写 Eligible Case 里 &lt;strong&gt;58/58&lt;/strong&gt; 都拿到了完整 Edit Inputs。&lt;/p&gt;
&lt;p&gt;Decision baseline 的 Brier 是 &lt;strong&gt;0.018846&lt;/strong&gt;，False Stop 和 False Continue 都是 &lt;strong&gt;0&lt;/strong&gt;。&lt;/p&gt;
&lt;p&gt;我不会把这组数写成“wcode 已经解决 Context Engineering”。&lt;/p&gt;
&lt;p&gt;它只是一个比较有用的基线：以后我改 Retrieval、Ranking、Budget 或 Decision Plane 时，至少有一组不依赖主模型的东西可以告诉我是不是把基本能力改坏了。&lt;/p&gt;
&lt;h2 id=&#34;jev-在-081-里被我又收窄了一次&#34;&gt;Jev 在 0.8.1 里被我又收窄了一次&lt;a class=&#34;heading-anchor&#34; href=&#34;#jev-%e5%9c%a8-081-%e9%87%8c%e8%a2%ab%e6%88%91%e5%8f%88%e6%94%b6%e7%aa%84%e4%ba%86%e4%b8%80%e6%ac%a1&#34; aria-label=&#34;章节链接：Jev 在 0.8.1 里被我又收窄了一次&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;0.8.0 已经能让 Decision Plane 比较 baseline 和 candidate provider。&lt;/p&gt;
&lt;p&gt;到了 0.8.1，我把外部语义 Provider 的命名统一成了 &lt;strong&gt;Jev&lt;/strong&gt;，本地无模型层就叫 &lt;strong&gt;Decision Plane&lt;/strong&gt;，主模型继续叫 &lt;strong&gt;Reasoning Model&lt;/strong&gt;。&lt;/p&gt;
&lt;p&gt;更重要的是，问题本身也重新写了一轮。&lt;/p&gt;
&lt;p&gt;比如我原来会问：&lt;/p&gt;
&lt;blockquote&gt;
&lt;p&gt;semantic navigation 有没有帮助？&lt;/p&gt;
&lt;/blockquote&gt;
&lt;p&gt;这个问题太宽了。&lt;/p&gt;
&lt;p&gt;在 Coding Agent 里，看看更多关系几乎永远“有帮助”。于是 Provider 很容易一直建议继续查。&lt;/p&gt;
&lt;p&gt;0.8.1 的问题变成更窄的边界：&lt;/p&gt;
&lt;blockquote&gt;
&lt;p&gt;semantic relationships 是不是安全修改前的必要证据？&lt;/p&gt;
&lt;/blockquote&gt;
&lt;p&gt;Choice 也不再只有“继续/不继续”，而是把正反 criteria 写清楚，并加入 other_review。&lt;/p&gt;
&lt;p&gt;不完整、低集中度、边界不清楚的状态就 abstain，回去收集证据。&lt;/p&gt;
&lt;p&gt;当前 Agent Context 的 Jev question set 是 wcode.agent_context@3。&lt;/p&gt;
&lt;h3 id=&#34;jev-只能-increase-only&#34;&gt;Jev 只能 increase-only&lt;a class=&#34;heading-anchor&#34; href=&#34;#jev-%e5%8f%aa%e8%83%bd-increase-only&#34; aria-label=&#34;章节链接：Jev 只能 increase-only&#34;&gt;#&lt;/a&gt;&lt;/h3&gt;
&lt;p&gt;Jev 现在可以要求更多 Retrieval、Semantic Navigation、更多 Verification，或者继续 Reasoning。&lt;/p&gt;
&lt;p&gt;但不能减少 deterministic baseline 要求的工作。&lt;/p&gt;
&lt;p&gt;尤其是 edit_then_verify：只有 baseline 本来就允许同一动作时，Jev 才能同意；它自己不能把一个 Unknown 状态升级成“可以编辑”。&lt;/p&gt;
&lt;p&gt;而且 Jev advisory 如果会把 Agent Context 撑过预算，先丢的是 advisory，不是 Source、SHA、Test 或 Risk Evidence。&lt;/p&gt;
&lt;p&gt;这也是我现在比较满意的一点：&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;外部 Provider 挂掉，wcode 少一层建议；它不会少一层安全。&lt;/strong&gt;&lt;/p&gt;
&lt;h2 id=&#34;shadow-ab-比换掉-baseline更适合我现在的阶段&#34;&gt;Shadow A/B 比“换掉 baseline”更适合我现在的阶段&lt;a class=&#34;heading-anchor&#34; href=&#34;#shadow-ab-%e6%af%94%e6%8d%a2%e6%8e%89-baseline%e6%9b%b4%e9%80%82%e5%90%88%e6%88%91%e7%8e%b0%e5%9c%a8%e7%9a%84%e9%98%b6%e6%ae%b5&#34; aria-label=&#34;章节链接：Shadow A/B 比“换掉 baseline”更适合我现在的阶段&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;0.8 没有直接让 Jev 接管 Decision Plane。&lt;/p&gt;
&lt;p&gt;同一个不可变 DecisionRequest 会同时给 baseline 和 candidate，然后记录 shared / missing signal、probability / score delta、Choice disagreement、shape mismatch 和 safety-policy violation。&lt;/p&gt;
&lt;p&gt;这更像 Shadow A/B。&lt;/p&gt;
&lt;p&gt;我先看它在哪些状态下和 baseline 不一样，再决定它有没有资格影响 Runtime。&lt;/p&gt;
&lt;p&gt;这种做法慢一点，但比“API 接通了 → 默认启用 → 看线上有没有出事”靠谱很多。&lt;/p&gt;
&lt;h2 id=&#34;仓库扫描也终于统一尊重-ignore&#34;&gt;仓库扫描也终于统一尊重 Ignore&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e4%bb%93%e5%ba%93%e6%89%ab%e6%8f%8f%e4%b9%9f%e7%bb%88%e4%ba%8e%e7%bb%9f%e4%b8%80%e5%b0%8a%e9%87%8d-ignore&#34; aria-label=&#34;章节链接：仓库扫描也终于统一尊重 Ignore&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;这部分不太显眼，但实际体感提升很大。&lt;/p&gt;
&lt;p&gt;以前 Source Scan、Search、Index、Status、Subspace Discovery 各自有自己的遍历路径，很容易出现一条链路避开 target，另一条链路又进去。&lt;/p&gt;
&lt;p&gt;0.8 把这些统一到 Ignore-aware Walker。&lt;/p&gt;
&lt;p&gt;默认遵守 .gitignore、.ignore、Git info exclude、global exclude 和 protected paths。target、node_modules、cache、常见 build output 也会在 traversal 前就剪掉。&lt;/p&gt;
&lt;p&gt;但 explicit intent 还是优先：你明确指定一个 ignored path，Read/Search 仍然可以在边界内访问。&lt;/p&gt;
&lt;p&gt;我不想为了性能把“用户明确叫我读这个文件”也一起吞掉。&lt;/p&gt;
&lt;h2 id=&#34;tui-现在更像任务控制面&#34;&gt;TUI 现在更像任务控制面&lt;a class=&#34;heading-anchor&#34; href=&#34;#tui-%e7%8e%b0%e5%9c%a8%e6%9b%b4%e5%83%8f%e4%bb%bb%e5%8a%a1%e6%8e%a7%e5%88%b6%e9%9d%a2&#34; aria-label=&#34;章节链接：TUI 现在更像任务控制面&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;0.8 的 TUI 我也砍了一些东西。&lt;/p&gt;
&lt;p&gt;宽终端现在是 70/30：Workspace Activity 占主画布，Engineering / connection state 放右侧。&lt;/p&gt;
&lt;p&gt;右边只留四条主要状态：&lt;/p&gt;
&lt;pre&gt;&lt;code&gt;ARCH
DRIFT
PROOF
MODEL
&lt;/code&gt;&lt;/pre&gt;
&lt;p&gt;中等和窄终端干脆不常驻 Engineering Pulse，让任务本身优先。&lt;/p&gt;
&lt;p&gt;我越来越觉得 TUI 的任务不是把所有指标都塞进去，而是回答三个问题：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;现在 Agent 在干什么；&lt;/li&gt;
&lt;li&gt;有没有卡在权限/验证/运行时；&lt;/li&gt;
&lt;li&gt;我什么时候需要介入。&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;详细 Architecture 和 Proof 还是可以进 Engineering Console 看。&lt;/p&gt;
&lt;h2 id=&#34;081-还修了两个看起来正确的-ui-问题&#34;&gt;0.8.1 还修了两个“看起来正确”的 UI 问题&lt;a class=&#34;heading-anchor&#34; href=&#34;#081-%e8%bf%98%e4%bf%ae%e4%ba%86%e4%b8%a4%e4%b8%aa%e7%9c%8b%e8%b5%b7%e6%9d%a5%e6%ad%a3%e7%a1%ae%e7%9a%84-ui-%e9%97%ae%e9%a2%98&#34; aria-label=&#34;章节链接：0.8.1 还修了两个“看起来正确”的 UI 问题&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;这两个问题很典型。&lt;/p&gt;
&lt;p&gt;Code Graph 发请求时有 query / mode / depth / snapshot。旧响应晚回来时，只看“请求成功”是不够的；它必须和当前四个语义参数全部一致，才能发布到 UI。&lt;/p&gt;
&lt;p&gt;Access 页面也类似。Workspace、Commands、Authorizations 三路状态要原子发布。只要其中一路 shape validation 失败，就整组保持 Unknown。&lt;/p&gt;
&lt;p&gt;否则最危险的不是页面报错，而是页面展示一个&lt;strong&gt;部分正确、看起来又很完整&lt;/strong&gt;的状态。&lt;/p&gt;
&lt;p&gt;这和我前面说的其实是同一件事：&lt;/p&gt;
&lt;blockquote&gt;
&lt;p&gt;工程 UI 不能比证据更确定。&lt;/p&gt;
&lt;/blockquote&gt;
&lt;h2 id=&#34;08-没有改变我最早那条边界&#34;&gt;0.8 没有改变我最早那条边界&lt;a class=&#34;heading-anchor&#34; href=&#34;#08-%e6%b2%a1%e6%9c%89%e6%94%b9%e5%8f%98%e6%88%91%e6%9c%80%e6%97%a9%e9%82%a3%e6%9d%a1%e8%be%b9%e7%95%8c&#34; aria-label=&#34;章节链接：0.8 没有改变我最早那条边界&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;从 0.3 到 0.8，wcode 上层已经变了很多。&lt;/p&gt;
&lt;p&gt;但几条底层原则我没有准备改：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;Workspace Root 仍然是边界；&lt;/li&gt;
&lt;li&gt;修改仍然绑定 SHA；&lt;/li&gt;
&lt;li&gt;Full Access 只能由 Operator 明确选择；&lt;/li&gt;
&lt;li&gt;Decision Plane 不能授权；&lt;/li&gt;
&lt;li&gt;Jev 不能降低 Verification；&lt;/li&gt;
&lt;li&gt;Cancellation 不等于 Rollback；&lt;/li&gt;
&lt;li&gt;Verification Evidence 必须绑定具体 Revision。&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;Engineering Digital Twin 也是只读层。它不会因为“图里看起来应该这样”就去改项目。&lt;/p&gt;
&lt;figure class=&#34;content-image&#34;&gt;&lt;img src=&#34;https://francisdu.com/img/wcode/wcode-intro-verification-mesh.zh-CN.svg&#34; alt=&#34;wcode 的验证网格：确定性检查、独立 Review 与证据绑定&#34;loading=&#34;lazy&#34; decoding=&#34;async&#34;&gt;&lt;/figure&gt;&lt;h2 id=&#34;这次版本跨度其实挺大&#34;&gt;这次版本跨度其实挺大&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e8%bf%99%e6%ac%a1%e7%89%88%e6%9c%ac%e8%b7%a8%e5%ba%a6%e5%85%b6%e5%ae%9e%e6%8c%ba%e5%a4%a7&#34; aria-label=&#34;章节链接：这次版本跨度其实挺大&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;从 v0.7.6 到 v0.8.0，Git Diff 跨了 &lt;strong&gt;135 个文件，约 +7,364 / -775 行&lt;/strong&gt;。&lt;/p&gt;
&lt;p&gt;我一开始也以为这会是一个“Code Graph + Observatory UI”的版本。&lt;/p&gt;
&lt;p&gt;写到后面才发现，真正牵动的是整条链：&lt;/p&gt;
&lt;pre&gt;&lt;code&gt;Repository scan
    ↓
Context
    ↓
Graph / Digital Twin
    ↓
Decision Plane
    ↓
Edit boundary
    ↓
Verification
    ↓
Evidence
    ↓
Human observability
&lt;/code&gt;&lt;/pre&gt;
&lt;p&gt;所以最后我把 0.8 的主题定成了 &lt;strong&gt;Engineering Digital Twin&lt;/strong&gt;，而不是 Code Graph。&lt;/p&gt;
&lt;p&gt;Code Graph 只是其中一个入口。&lt;/p&gt;
&lt;h2 id=&#34;现在是-081&#34;&gt;现在是 0.8.1&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e7%8e%b0%e5%9c%a8%e6%98%af-081&#34; aria-label=&#34;章节链接：现在是 0.8.1&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;v0.8.0 是 9 月 19 日发布的 Engineering Digital Twin 版本；同一天我又发了 v0.8.1，主要把 Jev Decision Plane、命名和 WebUI state truthfulness 收紧。&lt;/p&gt;
&lt;p&gt;如果你只想看版本说明：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;&lt;a href=&#34;https://wcode.francis.run/zh/docs/releases/v0.8.0/&#34;&gt;v0.8.0 — Engineering Digital Twin&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href=&#34;https://wcode.francis.run/zh/docs/releases/v0.8.1/&#34;&gt;v0.8.1 — Jev Decision Plane 加固&lt;/a&gt;&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;如果问我 0.8 最重要的变化是什么，我现在会说：&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;以前 wcode 主要是在帮助 Agent 安全地操作仓库；0.8 开始，我希望 Agent 和人看到的是同一份、带证据来源和精度的工程状态。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;这件事还远没做完，但方向终于比较清楚了。&lt;/p&gt;
</description>
    </item>
    
    <item>
      <title>wcode 是怎么从一个 MCP Bridge 变成现在这样的</title>
      <link>https://francisdu.com/blog/what-is-wcode/</link>
      <pubDate>Sat, 12 Sep 2026 05:40:00 +0800</pubDate>
      <guid>https://francisdu.com/blog/what-is-wcode/</guid>
      <description>&lt;p class=&#34;project-logo&#34;&gt;&lt;a href=&#34;https://wcode.francis.run/&#34; target=&#34;_blank&#34; rel=&#34;noopener&#34; title=&#34;wcode 文档&#34;&gt;&lt;img src=&#34;https://francisdu.com/img/wcode/wcode-logo.svg&#34; alt=&#34;wcode&#34; width=&#34;320&#34; height=&#34;96&#34;&gt;&lt;/a&gt;&lt;/p&gt;
&lt;p class=&#34;project-links&#34;&gt;&lt;a href=&#34;https://github.com/francis-du/wcode&#34; target=&#34;_blank&#34; rel=&#34;noopener&#34;&gt;GitHub ↗&lt;/a&gt;&lt;a href=&#34;https://wcode.francis.run/zh/docs/&#34; target=&#34;_blank&#34; rel=&#34;noopener&#34;&gt;文档 ↗&lt;/a&gt;&lt;/p&gt;
&lt;p&gt;我做 wcode 的起点，其实不是想再做一个 Coding Agent。&lt;/p&gt;
&lt;p&gt;最开始的想法很简单：把网页里已经能直接用的模型拿来写代码，同时让它们能读到我电脑上的真实仓库。模型在浏览器里，代码却在本地。稍微复杂一点的问题，我就得复制文件、上传压缩包、解释目录结构；代码一改，前面传进去的内容马上又旧了。&lt;/p&gt;
&lt;p&gt;所以第一版 wcode 更像一座桥。它把本地仓库通过工具接给网页端模型，让模型可以自己搜索文件、读代码、做修改、跑检查。后来 MCP 出现，这件事有了更标准的连接方式，但真正让我继续往下做的，并不是“终于能连上了”。&lt;/p&gt;
&lt;p&gt;连接打通以后，另一个问题反而越来越明显：Agent 到底是怎么读代码的？&lt;/p&gt;
&lt;p&gt;不少 Code CLI 在仓库发现阶段会大量使用 &lt;code&gt;grep&lt;/code&gt;、&lt;code&gt;ripgrep&lt;/code&gt;、文件列表和各种 shell 命令。这个做法本身没问题，我自己也一直在用。它很快，找一个字符串、文件名或者明显的符号时甚至就是最合适的办法。&lt;/p&gt;
&lt;p&gt;问题在下一步。&lt;/p&gt;
&lt;p&gt;搜索返回的是“这里命中了几段文本”。模型还得自己从这些片段里重新拼出：哪个才是真正的定义、两个同名符号是不是一回事、谁在调用谁、改这一处会波及哪里、对应测试在哪、某条关系到底只是文本上看起来像，还是语言服务器真的确认过。&lt;/p&gt;
&lt;p&gt;模型越强，这种做法当然越能工作，但本质上还是把大量仓库理解工作重新丢回了 Context Window。仓库一大、同名符号一多、跨模块调用一复杂，误判就很容易从这里开始。&lt;/p&gt;
&lt;p&gt;wcode 后来就是从这里开始变的。我不再只加命令，而是开始单独处理“模型怎么读一个仓库”这件事。&lt;/p&gt;
&lt;h2 id=&#34;后来我开始管-agent-怎么读仓库&#34;&gt;后来我开始管 Agent 怎么读仓库&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e5%90%8e%e6%9d%a5%e6%88%91%e5%bc%80%e5%a7%8b%e7%ae%a1-agent-%e6%80%8e%e4%b9%88%e8%af%bb%e4%bb%93%e5%ba%93&#34; aria-label=&#34;章节链接：后来我开始管 Agent 怎么读仓库&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;现在的 wcode 仍然会用文本搜索，而且普通定位默认就应该走便宜的路径。问“&lt;code&gt;FooConfig&lt;/code&gt; 在哪”，没必要为了显得高级就启动一整套语义分析。&lt;/p&gt;
&lt;p&gt;但问题一旦变成“谁调用它”“这个实现有哪些引用”“改这里会影响什么”“哪个测试真正覆盖这条行为”，纯文本命中就不够了。wcode 会先用 Tree-sitter 建立稳定的语法结构，需要跨文件语义关系时再使用可用的 Warm LSP；同时把 Git 当前状态、Design State、测试入口和已经知道的软件图关系一起带进来。&lt;/p&gt;
&lt;p&gt;最后交给模型的，不只是几段搜出来的源码，而是一份有边界的任务上下文：相关符号和精确范围、引用或调用关系、关联测试、当前修改、项目约束，以及这些信息来自哪里、是什么精度、对应哪个版本。&lt;/p&gt;
&lt;p&gt;可以把两种读取方式粗略理解成：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;&lt;strong&gt;常见文本发现链路&lt;/strong&gt;：任务 → &lt;code&gt;grep/ripgrep&lt;/code&gt; / 文件切片 → 命中文本 → 模型自己重建代码关系。&lt;/li&gt;
&lt;li&gt;&lt;strong&gt;wcode 的链路&lt;/strong&gt;：任务 → 便宜定位 → 按需解析语法/语义关系 → 整理成任务上下文 → 模型基于带来源和精度的证据继续推理。&lt;/li&gt;
&lt;/ul&gt;
&lt;figure class=&#34;content-image&#34;&gt;
  &lt;img src=&#34;https://francisdu.com/img/wcode/wcode-intro-intelligence-stack.zh-CN.svg&#34; alt=&#34;文本搜索式代码发现与 wcode 仓库读取方式的对比&#34; width=&#34;1600&#34; height=&#34;960&#34; loading=&#34;lazy&#34; decoding=&#34;async&#34;&gt;
  &lt;figcaption&gt;wcode 不是为了淘汰 grep。精确定位时搜索通常就是正确工具；需要结构、调用、实现、影响或验证关系时，再增加更强的代码理解。&lt;/figcaption&gt;
&lt;/figure&gt;
&lt;p&gt;拿一个很普通的例子：给列表接口增加“按状态筛选”。只搜接口名，很容易找到 Handler，却未必会顺着参数定义、查询构造、调用方和测试一路看完。&lt;code&gt;agent_context&lt;/code&gt; 会先围绕当前任务整理相关实现、测试、项目约定和可用的检查入口；如果任务明确需要 Caller、Reference、Implementation 或 Impact，Readiness 再提示 Agent 使用语义导航。&lt;/p&gt;
&lt;p&gt;这点对我很重要：&lt;strong&gt;不是每个问题都做最重的分析，而是让模型知道什么时候搜索已经够了，什么时候必须继续确认代码关系。&lt;/strong&gt; 工具能证明到哪一层，就只说到哪一层。Tree-sitter 的语法事实不会包装成编译器语义；LSP 不可用时也不会假装已经找全了调用方。&lt;/p&gt;
&lt;h2 id=&#34;接上仓库以后还得防止改错&#34;&gt;接上仓库以后，还得防止改错&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e6%8e%a5%e4%b8%8a%e4%bb%93%e5%ba%93%e4%bb%a5%e5%90%8e%e8%bf%98%e5%be%97%e9%98%b2%e6%ad%a2%e6%94%b9%e9%94%99&#34; aria-label=&#34;章节链接：接上仓库以后，还得防止改错&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;继续拿筛选接口这个例子。Agent 读完文件，正在生成修改时，我也可能在编辑同一个文件。&lt;/p&gt;
&lt;p&gt;如果它直接把旧版本上的修改写回来，就可能覆盖我刚加的内容。所以 wcode 读文件时会返回一个 SHA，可以把它理解成文件内容的指纹。编辑时必须带上这个指纹；内容已经变了，旧编辑就会被拒绝，Agent 要重新读。&lt;/p&gt;
&lt;p&gt;修改也需要控制范围。读几个互不相关的文件可以一起做；两次修改都要动同一个文件，就不能随便同时写。改完之后，用 &lt;code&gt;review_changes&lt;/code&gt; 看实际差异，再用 &lt;code&gt;verify_project&lt;/code&gt; 跑项目里已有的检查。&lt;/p&gt;
&lt;figure class=&#34;content-image&#34;&gt;
  &lt;img src=&#34;https://francisdu.com/img/wcode/wcode-intro-engineering-loop.zh-CN.svg&#34; alt=&#34;一次代码修改的流程：找依据、修改文件、检查结果，再继续下一步&#34; width=&#34;1600&#34; height=&#34;900&#34; loading=&#34;lazy&#34; decoding=&#34;async&#34;&gt;
  &lt;figcaption&gt;我希望一次任务最后能回答：改了哪里，检查过什么，还有什么没确认。&lt;/figcaption&gt;
&lt;/figure&gt;
&lt;p&gt;wcode 文档里把这一层叫作“工程控制面”。落到日常使用，就是把文件、操作记录和检查结果留清楚。换一个模型或者接着做下一轮，也能查到前面发生过什么。&lt;/p&gt;
&lt;h2 id=&#34;测试通过也得看是哪一次修改&#34;&gt;测试通过，也得看是哪一次修改&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e6%b5%8b%e8%af%95%e9%80%9a%e8%bf%87%e4%b9%9f%e5%be%97%e7%9c%8b%e6%98%af%e5%93%aa%e4%b8%80%e6%ac%a1%e4%bf%ae%e6%94%b9&#34; aria-label=&#34;章节链接：测试通过，也得看是哪一次修改&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;给接口加了筛选条件，测试通过了。接着又调整参数解析，却没有再跑测试。这时，前面的通过记录只能说明前一个版本通过了。&lt;/p&gt;
&lt;p&gt;wcode 会把检查结果和当时的代码、设计版本关联起来。界面里的几个状态也有区别：找到测试文件，只能算“有对应检查”；真正运行过、结果通过、结果仍适用于当前版本，是后面的几件事。&lt;/p&gt;
&lt;figure class=&#34;content-image&#34;&gt;&lt;img src=&#34;https://francisdu.com/img/wcode/wcode-intro-evidence_hu_53064a9df2e7669f.webp&#34; alt=&#34;wcode 验证页面：查看检查有没有执行、结果是否通过，以及是否对应当前版本&#34;loading=&#34;lazy&#34; decoding=&#34;async&#34; srcset=&#34;https://francisdu.com/img/wcode/wcode-intro-evidence_hu_53064a9df2e7669f.webp 960w, https://francisdu.com/img/wcode/wcode-intro-evidence_hu_3aad68b05435b458.webp 1800w&#34; sizes=&#34;(max-width: 900px) calc(100vw - 32px), 900px&#34; width=&#34;3420&#34; height=&#34;2426&#34;&gt;&lt;/figure&gt;&lt;p&gt;检查本身也要选对。这个博客用 Hugo 生成网页，写完 Markdown 以后，至少要真正构建一次，确认中英文页面都生成了、图片能找到、原来的地址没有变。只看文字没有语法错误，证明不了这些事情。&lt;/p&gt;
&lt;p&gt;对代码项目，则需要运行相应的编译、测试或其他项目检查。涉及更大风险的改动，可以按配置增加更深入的验证。下图列出了这些通道，并不是每次修改都要把它们全部跑一遍。&lt;/p&gt;
&lt;figure class=&#34;content-image&#34;&gt;
  &lt;img src=&#34;https://francisdu.com/img/wcode/wcode-intro-verification-mesh.zh-CN.svg&#34; alt=&#34;wcode 如何根据改动选择检查，并保存对应版本的执行结果&#34; width=&#34;1600&#34; height=&#34;940&#34; loading=&#34;lazy&#34; decoding=&#34;async&#34;&gt;
  &lt;figcaption&gt;项目和验证计划决定哪些检查必须完成；缺少执行结果，不能靠一句“应该没问题”补上。&lt;/figcaption&gt;
&lt;/figure&gt;
&lt;p&gt;历史上的成功修改可以帮助下一次任务找方向，但旧测试结果不能一直沿用。这是我希望 wcode 替我记住的一件事。&lt;/p&gt;
&lt;h2 id=&#34;项目里的规矩得有地方放&#34;&gt;项目里的规矩，得有地方放&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e9%a1%b9%e7%9b%ae%e9%87%8c%e7%9a%84%e8%a7%84%e7%9f%a9%e5%be%97%e6%9c%89%e5%9c%b0%e6%96%b9%e6%94%be&#34; aria-label=&#34;章节链接：项目里的规矩，得有地方放&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;有些要求从一段代码里看不出来。&lt;/p&gt;
&lt;p&gt;比如这个博客，中文页面一直在根路径，英文放在 &lt;code&gt;/en/&lt;/code&gt;；摄影 Gallery 有自己的页面和脚本；改文章时要保留原来的公开地址。Agent 如果不知道这些约定，很容易在完成眼前任务时，顺手改掉别的行为。&lt;/p&gt;
&lt;p&gt;wcode 可以把这类要求写进仓库的 &lt;code&gt;.wcode/&lt;/code&gt; 目录。文档把它们称为 Design State，里面记录需求、组件、约束和验收条件。之后查项目、分析一次修改的影响时，可以把这些要求一起带出来。&lt;/p&gt;
&lt;p&gt;工程观测台默认打开架构页面。从这里可以看组件对应哪些源码、关联哪些需求，以及分析工具发现了哪些依赖。&lt;/p&gt;
&lt;figure class=&#34;content-image&#34;&gt;&lt;img src=&#34;https://francisdu.com/img/wcode/wcode-intro-architecture_hu_a639e2cce8d6a6c5.webp&#34; alt=&#34;wcode 工程架构页面：查看组件、源码归属、需求与依赖关系&#34;loading=&#34;lazy&#34; decoding=&#34;async&#34; srcset=&#34;https://francisdu.com/img/wcode/wcode-intro-architecture_hu_a639e2cce8d6a6c5.webp 960w, https://francisdu.com/img/wcode/wcode-intro-architecture_hu_76554f90b45fd0d1.webp 1800w&#34; sizes=&#34;(max-width: 900px) calc(100vw - 32px), 900px&#34; width=&#34;3420&#34; height=&#34;2850&#34;&gt;&lt;/figure&gt;&lt;p&gt;这些记录需要跟着项目维护。图画出来了，不代表架构就没有问题；它的用处是让原来散在文件和讨论里的信息，有一个可以一起核对的地方。&lt;/p&gt;
&lt;h2 id=&#34;它能访问什么由谁决定&#34;&gt;它能访问什么，由谁决定&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e5%ae%83%e8%83%bd%e8%ae%bf%e9%97%ae%e4%bb%80%e4%b9%88%e7%94%b1%e8%b0%81%e5%86%b3%e5%ae%9a&#34; aria-label=&#34;章节链接：它能访问什么，由谁决定&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;wcode 围绕选定的 Workspace 工作，也就是这次允许访问的项目范围。文件操作会检查路径、受保护位置和不安全的链接，已有文件的修改还要检查内容指纹。&lt;/p&gt;
&lt;p&gt;命令另有规则。常见、有明确边界的开发命令可以直接运行；需要额外信任的操作，会进入本地授权流程。访问页面可以查看具体请求，由操作者决定是否允许。更宽的会话授权或 Full Access，也需要操作者明确选择。&lt;/p&gt;
&lt;figure class=&#34;content-image&#34;&gt;
  &lt;img src=&#34;https://francisdu.com/img/wcode/wcode-intro-security-boundary.zh-CN.svg&#34; alt=&#34;AI 客户端到本地仓库之间的检查：连接认证、命令授权和文件访问范围&#34; width=&#34;1600&#34; height=&#34;920&#34; loading=&#34;lazy&#34; decoding=&#34;async&#34;&gt;
  &lt;figcaption&gt;能连接到 wcode，不等于可以执行任意命令或访问任意文件。&lt;/figcaption&gt;
&lt;/figure&gt;
&lt;figure class=&#34;content-image&#34;&gt;&lt;img src=&#34;https://francisdu.com/img/wcode/wcode-intro-access_hu_b12189c6e90c7fb.webp&#34; alt=&#34;wcode 访问管理页面：查看当前项目的权限和待处理授权请求&#34;loading=&#34;lazy&#34; decoding=&#34;async&#34; srcset=&#34;https://francisdu.com/img/wcode/wcode-intro-access_hu_b12189c6e90c7fb.webp 960w, https://francisdu.com/img/wcode/wcode-intro-access_hu_2dedf3cc804655ae.webp 1800w&#34; sizes=&#34;(max-width: 900px) calc(100vw - 32px), 900px&#34; width=&#34;3420&#34; height=&#34;2290&#34;&gt;&lt;/figure&gt;&lt;p&gt;本地客户端可以用 stdio 启动 wcode；远程客户端通过 OAuth 连接运行中的服务。这两种接法提供同一套仓库能力。文件操作发生在仓库所在机器，使用云端模型时，读出的代码仍会作为工具结果交给对应客户端。&lt;/p&gt;
&lt;p&gt;wcode 的这些检查属于工具和仓库层，并不等同于操作系统沙箱。&lt;/p&gt;
&lt;h2 id=&#34;界面里能看到什么&#34;&gt;界面里能看到什么&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e7%95%8c%e9%9d%a2%e9%87%8c%e8%83%bd%e7%9c%8b%e5%88%b0%e4%bb%80%e4%b9%88&#34; aria-label=&#34;章节链接：界面里能看到什么&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;我主要用界面确认工作进行到哪里。&lt;/p&gt;
&lt;p&gt;终端面板能看到连接、当前项目、任务和授权请求。按 &lt;code&gt;W&lt;/code&gt; 打开工程观测台，按 &lt;code&gt;O&lt;/code&gt; 打开设置页面。观测台里可以看架构、当前修改、需求和项目文件，也可以查看前面提到的验证记录。&lt;/p&gt;
&lt;p&gt;任务慢下来时，&lt;strong&gt;任务活动&lt;/strong&gt;页面会更有用。它把排队时间和实际执行时间分开，也显示子进程和资源使用情况。一个命令迟迟没结束，可能是在等运行机会，也可能是真的执行了很久，处理办法不一样。&lt;/p&gt;
&lt;figure class=&#34;content-image&#34;&gt;&lt;img src=&#34;https://francisdu.com/img/wcode/wcode-intro-activity_hu_2317004a5debedc0.webp&#34; alt=&#34;wcode 任务活动页面：查看任务在排队还是执行，以及工具调用和资源使用情况&#34;loading=&#34;lazy&#34; decoding=&#34;async&#34; srcset=&#34;https://francisdu.com/img/wcode/wcode-intro-activity_hu_2317004a5debedc0.webp 960w, https://francisdu.com/img/wcode/wcode-intro-activity_hu_43c09591b7bea99a.webp 1800w&#34; sizes=&#34;(max-width: 900px) calc(100vw - 32px), 900px&#34; width=&#34;3420&#34; height=&#34;3328&#34;&gt;&lt;/figure&gt;&lt;p&gt;wcode 也分别限制 CPU 工作、文件读写和子进程的并发量。互不依赖的事情可以一起做，机器也要留有余量。这部分仍然需要结合实际任务观察，不能只看一个并发数字。&lt;/p&gt;
&lt;h2 id=&#34;怎么开始用&#34;&gt;怎么开始用&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e6%80%8e%e4%b9%88%e5%bc%80%e5%a7%8b%e7%94%a8&#34; aria-label=&#34;章节链接：怎么开始用&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;如果你已经有习惯使用的 AI 编程助手，可以拿一个自己熟悉的项目试试。先做一个小修改，比较容易判断工具找的代码对不对、修改有没有跑偏。&lt;/p&gt;
&lt;p&gt;macOS 和 Linux 可以用发布版安装脚本：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-bash&#34; data-lang=&#34;bash&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;curl -fsSL https://raw.githubusercontent.com/francis-du/wcode/main/install.sh | sh
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;Windows 的安装方法见&lt;a href=&#34;https://wcode.francis.run/zh/docs/getting-started/&#34;&gt;快速开始&lt;/a&gt;。装好后，在项目目录里运行：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-bash&#34; data-lang=&#34;bash&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;wcode setup
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;按提示选择全局或当前项目配置，再重新连接 Agent。本地 stdio 模式由客户端启动进程；需要终端面板、网页界面或远程接入时，运行 &lt;code&gt;wcode&lt;/code&gt;。远程接入使用程序显示的当前 MCP 地址，并完成 OAuth，详细步骤见&lt;a href=&#34;https://wcode.francis.run/zh/docs/code-agent-integrations/&#34;&gt;客户端集成文档&lt;/a&gt;。&lt;/p&gt;
&lt;p&gt;第一轮不用把所有功能都配置好。先跑一个最小闭环：&lt;/p&gt;
&lt;ol&gt;
&lt;li&gt;让 Agent 找到一处实现；&lt;/li&gt;
&lt;li&gt;改一个行为；&lt;/li&gt;
&lt;li&gt;跑对应检查；&lt;/li&gt;
&lt;li&gt;自己看一遍 diff。&lt;/li&gt;
&lt;/ol&gt;
&lt;p&gt;接下来再把确实需要反复遵守的项目约定写进 &lt;code&gt;.wcode/&lt;/code&gt;。&lt;/p&gt;
&lt;p&gt;&lt;a href=&#34;https://github.com/francis-du/wcode&#34;&gt;源码在 GitHub&lt;/a&gt;，安装和接入说明放在&lt;a href=&#34;https://wcode.francis.run/zh/docs/&#34;&gt;项目文档&lt;/a&gt;里。模型仍然由你正在使用的服务提供，wcode 负责连接和处理仓库这一侧的工作。&lt;/p&gt;
</description>
    </item>
    
    <item>
      <title>wcode v0.6.2：我不再拿 SLOTS 当性能了</title>
      <link>https://francisdu.com/blog/wcode-v0-6-2/</link>
      <pubDate>Sat, 12 Sep 2026 05:32:00 +0800</pubDate>
      <guid>https://francisdu.com/blog/wcode-v0-6-2/</guid>
      <description>&lt;p&gt;前几天我一直盯着 wcode 的并发面板看。&lt;/p&gt;
&lt;p&gt;&lt;code&gt;SLOTS&lt;/code&gt; 32，&lt;code&gt;PEAK&lt;/code&gt; 看起来也不低，但实际跑起来还是有一种很奇怪的感觉：数字挺忙，任务不一定真快。&lt;/p&gt;
&lt;p&gt;我把执行链拆开看了一遍，问题就清楚了。&lt;/p&gt;
&lt;p&gt;外层 Tool Slot 只表示请求已经准入。CPU、文件 I/O、&lt;code&gt;cargo&lt;/code&gt;、&lt;code&gt;git&lt;/code&gt;、Language Server 还有各自的线程池或队列，外面 32 个槽位全亮，并不代表里面 32 份工作都在向前跑。&lt;/p&gt;
&lt;p&gt;0.6.2 先把这些资源分开计量和限制。&lt;/p&gt;
&lt;figure class=&#34;content-image&#34;&gt;&lt;img src=&#34;https://francisdu.com/img/wcode/wcode-observatory-full_hu_2e0fc54b6ad597b6.webp&#34; alt=&#34;wcode Project Observatory&#34;loading=&#34;lazy&#34; decoding=&#34;async&#34; srcset=&#34;https://francisdu.com/img/wcode/wcode-observatory-full_hu_2e0fc54b6ad597b6.webp 960w, https://francisdu.com/img/wcode/wcode-observatory-full_hu_77a4ca195d4c7462.webp 1600w&#34; sizes=&#34;(max-width: 900px) calc(100vw - 32px), 900px&#34; width=&#34;1600&#34; height=&#34;5017&#34;&gt;&lt;/figure&gt;&lt;h2 id=&#34;slotscpuio子进程是四件事&#34;&gt;SLOTS、CPU、I/O、子进程是四件事&lt;a class=&#34;heading-anchor&#34; href=&#34;#slotscpuio%e5%ad%90%e8%bf%9b%e7%a8%8b%e6%98%af%e5%9b%9b%e4%bb%b6%e4%ba%8b&#34; aria-label=&#34;章节链接：SLOTS、CPU、I/O、子进程是四件事&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;现在我更愿意把执行路径看成：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Tool admission
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;      ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Foreground CPU budget
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;      ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Bounded file I/O pool
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;      ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Child process / Git probe queues
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;它们有不同的瓶颈。&lt;/p&gt;
&lt;p&gt;前台 CPU 工作线程会取硬件并行度、8 个线程、内存推导上限和请求并行度的最小值。阻塞线程池上限提高到 64，是为了不让大量独立阻塞请求被隐藏的较小线程上限卡住。&lt;/p&gt;
&lt;p&gt;独立文件修改走共享、有界的 I/O Pool；固定形式的 Git 状态和差异检查走独立 Probe Queue，不再和重型编译器进程抢同一组名额。&lt;/p&gt;
&lt;p&gt;默认资源预算下，重型子进程仍然是很小的并发数。因为同时启动 20 个 &lt;code&gt;cargo&lt;/code&gt; 不会 magically 变快，只会把机器打爆。&lt;/p&gt;
&lt;h2 id=&#34;我专门撤回过一个看起来更并行的优化&#34;&gt;我专门撤回过一个“看起来更并行”的优化&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e6%88%91%e4%b8%93%e9%97%a8%e6%92%a4%e5%9b%9e%e8%bf%87%e4%b8%80%e4%b8%aa%e7%9c%8b%e8%b5%b7%e6%9d%a5%e6%9b%b4%e5%b9%b6%e8%a1%8c%e7%9a%84%e4%bc%98%e5%8c%96&#34; aria-label=&#34;章节链接：我专门撤回过一个“看起来更并行”的优化&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;这轮有一件事我觉得挺重要：我试过把热读取也放进更宽的线程池，结果本地配对实验更慢。&lt;/p&gt;
&lt;p&gt;所以撤回了。&lt;/p&gt;
&lt;p&gt;做 Agent Runtime 很容易有一种冲动：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;线程更多 = 更快
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;队列更深 = 吞吐更高
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;并发数更大 = Agent 更强
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;配对结果不好看就撤回。0.6.2 后面的资源调整也基本按这个标准做：先把不同类型的工作隔开，别靠调大一个统一并发值解决所有问题。&lt;/p&gt;
&lt;h2 id=&#34;32-个命令排队时我还希望-read-能进去&#34;&gt;32 个命令排队时，我还希望 Read 能进去&lt;a class=&#34;heading-anchor&#34; href=&#34;#32-%e4%b8%aa%e5%91%bd%e4%bb%a4%e6%8e%92%e9%98%9f%e6%97%b6%e6%88%91%e8%bf%98%e5%b8%8c%e6%9c%9b-read-%e8%83%bd%e8%bf%9b%e5%8e%bb&#34; aria-label=&#34;章节链接：32 个命令排队时，我还希望 Read 能进去&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;如果所有 Tool Slot 都被执行进程占满，Agent 连 &lt;code&gt;read_file&lt;/code&gt;、状态查询这种轻操作都进不来，系统就会出现另一种死锁感。&lt;/p&gt;
&lt;p&gt;所以执行进程类工具在拿总 Tool Slot 前，还要先拿一层 Execution Admission。&lt;/p&gt;
&lt;p&gt;总量是 32 时，执行类请求最多占 28 个槽位，给非执行工具留四个受控余量。单槽位配置则保留一个可用名额，不会把自己完全饿死。&lt;/p&gt;
&lt;p&gt;它不保证固定延迟，但编译队列再长，&lt;code&gt;read_file&lt;/code&gt; 和状态查询至少还有机会进来。&lt;/p&gt;
&lt;h2 id=&#34;明确的错误位置不应该先全仓搜索&#34;&gt;明确的错误位置，不应该先全仓搜索&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e6%98%8e%e7%a1%ae%e7%9a%84%e9%94%99%e8%af%af%e4%bd%8d%e7%bd%ae%e4%b8%8d%e5%ba%94%e8%af%a5%e5%85%88%e5%85%a8%e4%bb%93%e6%90%9c%e7%b4%a2&#34; aria-label=&#34;章节链接：明确的错误位置，不应该先全仓搜索&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;性能不只在 Scheduler。&lt;/p&gt;
&lt;p&gt;我调真实任务时发现另一个很浪费的路径：模型已经拿到了这种信息：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;error[E0308] at src/runtime/harness/context_budget.rs:33:9
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;结果 &lt;code&gt;agent_context&lt;/code&gt; 还先做一遍广域符号检索，再回来读这个明确位置。&lt;/p&gt;
&lt;p&gt;这顺序反了。&lt;/p&gt;
&lt;p&gt;现在带文件和行号的诊断会先经过 Workspace 保护解析，然后直接保留对应源码原文、行范围和 SHA 编辑前置条件。简单位置查询可以暂缓 Repo Graph 扩展；调用方、Impact、架构或显式 Scope 查询仍然走深入路径。&lt;/p&gt;
&lt;p&gt;缺失位置也不会先把一堆无关文件索引起来再告诉我“没找到”。&lt;/p&gt;
&lt;p&gt;这类任务现在先吃掉已有的精确位置，只有问题真的需要跨文件关系时才继续扩图。&lt;/p&gt;
&lt;h2 id=&#34;同一个冷索引也不应该被重复建-10-次&#34;&gt;同一个冷索引也不应该被重复建 10 次&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e5%90%8c%e4%b8%80%e4%b8%aa%e5%86%b7%e7%b4%a2%e5%bc%95%e4%b9%9f%e4%b8%8d%e5%ba%94%e8%af%a5%e8%a2%ab%e9%87%8d%e5%a4%8d%e5%bb%ba-10-%e6%ac%a1&#34; aria-label=&#34;章节链接：同一个冷索引也不应该被重复建 10 次&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;并发 Agent 很容易同时问同一个文件。&lt;/p&gt;
&lt;p&gt;以前多个冷查询可能一起发现“没有索引”，然后各自开始建。&lt;/p&gt;
&lt;p&gt;现在同一 Workspace、同一文件的冷查询会共享正在进行的索引构建。不同文件仍然可以独立执行；失效和版本变化会阻止旧构建结果晚到后重新污染缓存。&lt;/p&gt;
&lt;p&gt;这里没有做增量 Tree-sitter，也没有引入全仓快照，只是把同一份冷索引的重复构建合掉。&lt;/p&gt;
&lt;h2 id=&#34;symbol_context-开始对自己返回的版本负责&#34;&gt;&lt;code&gt;symbol_context&lt;/code&gt; 开始对自己返回的版本负责&lt;a class=&#34;heading-anchor&#34; href=&#34;#symbol_context-%e5%bc%80%e5%a7%8b%e5%af%b9%e8%87%aa%e5%b7%b1%e8%bf%94%e5%9b%9e%e7%9a%84%e7%89%88%e6%9c%ac%e8%b4%9f%e8%b4%a3&#34; aria-label=&#34;章节链接：symbol_context 开始对自己返回的版本负责&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;另一个一致性问题是：索引说 Symbol 在 A，但真正读正文时文件已经变了。&lt;/p&gt;
&lt;p&gt;如果这时还把旧签名和新正文拼成一个结果，Agent 会拿到一个内部自相矛盾的 Context。&lt;/p&gt;
&lt;p&gt;现在 &lt;code&gt;symbol_context&lt;/code&gt; 会核对符号信息和正文是不是同一文件版本。发现旧索引最多重新获取一次；文件持续变化、拿不到稳定版本时，就明确失败。&lt;/p&gt;
&lt;p&gt;我宁愿返回“现在无法稳定读取”，也不想返回一个看起来完整的 Frankenstein Context。&lt;/p&gt;
&lt;h2 id=&#34;验证计划不能静默只跑前八项&#34;&gt;验证计划不能静默只跑前八项&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e9%aa%8c%e8%af%81%e8%ae%a1%e5%88%92%e4%b8%8d%e8%83%bd%e9%9d%99%e9%bb%98%e5%8f%aa%e8%b7%91%e5%89%8d%e5%85%ab%e9%a1%b9&#34; aria-label=&#34;章节链接：验证计划不能静默只跑前八项&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;0.6.2 还修了一个更严重的问题。&lt;/p&gt;
&lt;p&gt;混合语言仓库里，完整验证可能推导出十几项检查。旧路径有一处会静默只取前八项。&lt;/p&gt;
&lt;p&gt;这类优化最危险的地方不是少跑了几个命令，而是上层可能还把已经执行的前缀描述成“完整验证”。&lt;/p&gt;
&lt;p&gt;现在先构造完整计划，整体上限是 32。超限就&lt;strong&gt;在派发前失败&lt;/strong&gt;，明确告诉调用者没有执行检查，而不是偷偷截断。&lt;/p&gt;
&lt;p&gt;验证历史也会在一次请求里共享代码 Revision 和 Evidence Snapshot，减少重复扫描；结果要同时匹配 Code 和 Design State 才能展示为当前有效。&lt;/p&gt;
&lt;p&gt;窄范围检查不能把宽范围失败抹掉，时间戳冲突按失败关闭。Evidence 缺失或扫描截断，也不能被解释成通过。&lt;/p&gt;
&lt;h2 id=&#34;verify_project-可以断线以后再查&#34;&gt;&lt;code&gt;verify_project&lt;/code&gt; 可以断线以后再查&lt;a class=&#34;heading-anchor&#34; href=&#34;#verify_project-%e5%8f%af%e4%bb%a5%e6%96%ad%e7%ba%bf%e4%bb%a5%e5%90%8e%e5%86%8d%e6%9f%a5&#34; aria-label=&#34;章节链接：verify_project 可以断线以后再查&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;项目验证现在还复用了 MCP Tasks 扩展。&lt;/p&gt;
&lt;p&gt;客户端支持 Tasks 时，服务端可以先持久化任务并返回 &lt;code&gt;taskId&lt;/code&gt;，验证继续由 Runtime 管理。客户端断线后，可以拿同一个 ID 查询状态。&lt;/p&gt;
&lt;p&gt;这里我刻意没有加一个模型可见的 &lt;code&gt;async=true&lt;/code&gt; 参数，也没有把断线等同于自动重试。&lt;/p&gt;
&lt;p&gt;因为对带副作用的系统来说，最危险的一句话就是：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;没收到响应，那再执行一遍吧。
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;完成状态只表示底层工具返回了结果，不等于检查通过；调用者还必须读真正的 &lt;code&gt;passed&lt;/code&gt; / error 状态。&lt;/p&gt;
&lt;h2 id=&#34;配置终于开始收敛&#34;&gt;配置终于开始收敛&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e9%85%8d%e7%bd%ae%e7%bb%88%e4%ba%8e%e5%bc%80%e5%a7%8b%e6%94%b6%e6%95%9b&#34; aria-label=&#34;章节链接：配置终于开始收敛&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;wcode 可调参数越来越多以后，另一个问题也很明显：高级参数是给调试和特殊机器用的，不应该逼所有人启动时手写一排数字。&lt;/p&gt;
&lt;p&gt;所以现在有三档常用性能配置：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;balanced
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;fast
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;light
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;也可以先预览：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-bash&#34; data-lang=&#34;bash&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;wcode setup --performance fast --dry-run
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;wcode --show-config
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;真的执行 Setup 才会保存审核过的启动选项。&lt;/p&gt;
&lt;p&gt;同时新增了：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-bash&#34; data-lang=&#34;bash&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;wcode help-all
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;wcode help-all setup
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;wcode help-all --json
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;它直接从真实 CLI Parser 生成完整命令和参数目录，包括隐藏高级选项、短参数、别名、默认值和枚举值。&lt;/p&gt;
&lt;p&gt;普通 &lt;code&gt;--help&lt;/code&gt; 继续保持短。我不想为了“可发现性”把日常帮助页重新塞成说明书。&lt;/p&gt;
&lt;h2 id=&#34;webui-首屏也一起收了&#34;&gt;WebUI 首屏也一起收了&lt;a class=&#34;heading-anchor&#34; href=&#34;#webui-%e9%a6%96%e5%b1%8f%e4%b9%9f%e4%b8%80%e8%b5%b7%e6%94%b6%e4%ba%86&#34; aria-label=&#34;章节链接：WebUI 首屏也一起收了&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;Observatory 这轮主要改首屏信息层级。&lt;/p&gt;
&lt;p&gt;现在执行活动、待批准请求、工作树变更、当前有效验证结果分开显示。Architecture 入口改成可搜索组件卡片和详情 Inspector，Design / Implementation / Overlay 图仍然保留，但不再要求用户先读一张很大的图才能知道项目现在发生了什么。&lt;/p&gt;
&lt;p&gt;活动刷新也和慢项目刷新拆开。页面隐藏时停止轮询；共享进程资源和当前项目任务分开标记；“没有采样”不再画成“0”。&lt;/p&gt;
&lt;p&gt;我主要想避免一件事：没有数据时别画成一个看起来很健康的数字。&lt;/p&gt;
&lt;h2 id=&#34;做完以后我给自己留了几条检查项&#34;&gt;做完以后，我给自己留了几条检查项&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e5%81%9a%e5%ae%8c%e4%bb%a5%e5%90%8e%e6%88%91%e7%bb%99%e8%87%aa%e5%b7%b1%e7%95%99%e4%ba%86%e5%87%a0%e6%9d%a1%e6%a3%80%e6%9f%a5%e9%a1%b9&#34; aria-label=&#34;章节链接：做完以后，我给自己留了几条检查项&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;我最后给自己留下几条明确的检查项：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;Slot 数不等于吞吐；&lt;/li&gt;
&lt;li&gt;拿到文件和行号，先读明确位置；&lt;/li&gt;
&lt;li&gt;Verification mapped 和 executed 分开；&lt;/li&gt;
&lt;li&gt;Task completed 和 checks passed 分开；&lt;/li&gt;
&lt;li&gt;断线不自动重放；&lt;/li&gt;
&lt;li&gt;没有采样就显示 unknown。&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;0.6.2 没有一个单独的大功能，更多是在把这些边界钉死。对我来说，这比再加一批 Tool 更实际。&lt;/p&gt;
</description>
    </item>
    
    <item>
      <title>wcode v0.6.1：`parallel_tools` 不再按层等</title>
      <link>https://francisdu.com/blog/wcode-v0-6-1/</link>
      <pubDate>Sat, 12 Sep 2026 05:31:00 +0800</pubDate>
      <guid>https://francisdu.com/blog/wcode-v0-6-1/</guid>
      <description>&lt;p&gt;&lt;a href=&#34;https://francisdu.com/blog/wcode-v0-6/&#34;&gt;v0.6&lt;/a&gt; 开始在 &lt;code&gt;agent_context&lt;/code&gt; 里标出可以并行的工作。接着我去看 Runtime 本身，发现 &lt;code&gt;parallel_tools&lt;/code&gt; 虽然已经有依赖图，执行时还保留着按层推进的做法。&lt;/p&gt;
&lt;p&gt;例如：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;A ─→ C
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;B ─────────→ D
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;假设 A 100ms 完成，B 要 5s，C 只依赖 A。&lt;/p&gt;
&lt;p&gt;按“层”执行时，很容易变成：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;第一层：A + B
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;        ↓ 等两者都结束
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;第二层：C + D
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;C 明明在 100ms 时已经 Ready，却因为一个和自己无关的 B，被迫多等几秒。&lt;/p&gt;
&lt;p&gt;所以 v0.6.1 我把调度器改成了 completion-driven。&lt;/p&gt;
&lt;figure class=&#34;content-image&#34;&gt;&lt;img src=&#34;https://francisdu.com/img/wcode/wcode-tui_hu_13e59e78ee0ce797.webp&#34; alt=&#34;wcode TUI&#34;loading=&#34;lazy&#34; decoding=&#34;async&#34; srcset=&#34;https://francisdu.com/img/wcode/wcode-tui_hu_13e59e78ee0ce797.webp 960w, https://francisdu.com/img/wcode/wcode-tui_hu_6437a17a51f06ca3.webp 1800w&#34; sizes=&#34;(max-width: 900px) calc(100vw - 32px), 900px&#34; width=&#34;3420&#34; height=&#34;2146&#34;&gt;&lt;/figure&gt;&lt;h2 id=&#34;ready-的任务不应该等同层慢分支&#34;&gt;Ready 的任务不应该等同层慢分支&lt;a class=&#34;heading-anchor&#34; href=&#34;#ready-%e7%9a%84%e4%bb%bb%e5%8a%a1%e4%b8%8d%e5%ba%94%e8%af%a5%e7%ad%89%e5%90%8c%e5%b1%82%e6%85%a2%e5%88%86%e6%94%af&#34; aria-label=&#34;章节链接：Ready 的任务不应该等同层慢分支&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;现在 Scheduler 只看一个问题：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;这个任务自己的前置依赖是不是已经完成？
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;满足就进入 Ready Queue。&lt;/p&gt;
&lt;p&gt;实际任务图通常不整齐。一个慢测试、一个大文件读取、一个外部命令，不该顺手把无关分支也拖住。&lt;/p&gt;
&lt;h2 id=&#34;失败也只应该污染依赖它的分支&#34;&gt;失败也只应该污染依赖它的分支&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e5%a4%b1%e8%b4%a5%e4%b9%9f%e5%8f%aa%e5%ba%94%e8%af%a5%e6%b1%a1%e6%9f%93%e4%be%9d%e8%b5%96%e5%ae%83%e7%9a%84%e5%88%86%e6%94%af&#34; aria-label=&#34;章节链接：失败也只应该污染依赖它的分支&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;同样的原则也用在失败上。&lt;/p&gt;
&lt;p&gt;如果：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;A → C
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;B → D
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;A 失败，那么 C 应该被 Skip，因为它的前置不成立；但 B 和 D 不应该跟着一起失败。&lt;/p&gt;
&lt;p&gt;所以运行时会区分依赖失败导致的 Skip、当前任务自己的运行失败，以及完全独立、仍然可以继续的分支。&lt;/p&gt;
&lt;p&gt;这对批量读取、搜索、验证尤其重要。Agent 不应该因为一个不存在的可选文件，就失去其他已经能确定的结果。&lt;/p&gt;
&lt;h2 id=&#34;partial-不能假装-complete&#34;&gt;Partial 不能假装 Complete&lt;a class=&#34;heading-anchor&#34; href=&#34;#partial-%e4%b8%8d%e8%83%bd%e5%81%87%e8%a3%85-complete&#34; aria-label=&#34;章节链接：Partial 不能假装 Complete&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;这轮我把批处理结果的语义也重新收紧了。&lt;/p&gt;
&lt;p&gt;批量读、创建、编辑、移动会明确报告：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;complete
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;partial
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;failed
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;并保留逐项结果。&lt;/p&gt;
&lt;p&gt;如果一个批次只完成了一部分，MCP Result 会保守地带错误标记，依赖整个批次的后续任务不能把它当作完整输入。独立分支仍然继续。&lt;/p&gt;
&lt;p&gt;重试也不应该重放整个批次。先核对状态，只重试失败项。这对写操作尤其重要，因为“请求失败”不等于“所有副作用都没发生”。&lt;/p&gt;
&lt;h2 id=&#34;并行写入最怕错误合并&#34;&gt;并行写入最怕错误合并&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e5%b9%b6%e8%a1%8c%e5%86%99%e5%85%a5%e6%9c%80%e6%80%95%e9%94%99%e8%af%af%e5%90%88%e5%b9%b6&#34; aria-label=&#34;章节链接：并行写入最怕错误合并&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;为了减少 Tool Call，wcode 会在安全条件满足时合并部分文件编辑。&lt;/p&gt;
&lt;p&gt;这里我宁愿少合并一点。&lt;/p&gt;
&lt;p&gt;同一个文件、同一个 SHA 的 Edit，如果中间隔着一个依赖 Read、Move 或其他会改变语义的操作，就不能跨过去合并。否则 Scheduler 会把原本有先后关系的工作偷偷变成一个事务。&lt;/p&gt;
&lt;p&gt;合并前也会检查既有的 128 项编辑上限，不能因为优化路径就绕过原来的安全边界。&lt;/p&gt;
&lt;p&gt;如果一次优化改掉了原本的先后关系，那就已经不是调度优化了。&lt;/p&gt;
&lt;h2 id=&#34;cancel-也必须真的往下传&#34;&gt;Cancel 也必须真的往下传&lt;a class=&#34;heading-anchor&#34; href=&#34;#cancel-%e4%b9%9f%e5%bf%85%e9%a1%bb%e7%9c%9f%e7%9a%84%e5%be%80%e4%b8%8b%e4%bc%a0&#34; aria-label=&#34;章节链接：Cancel 也必须真的往下传&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;异步系统里还有一个很烦的问题：外层任务取消了，不代表里面已经排队的工作自动消失。&lt;/p&gt;
&lt;p&gt;如果父请求断开，而子任务还在队列里，最糟的情况是用户以为“已经取消”，几秒后某个写操作才突然开始。&lt;/p&gt;
&lt;p&gt;v0.6.1 把取消传播继续往下压：父任务取消会取消仍在排队的子任务；持久 MCP Task 被取消或 TTL 过期，也会取消它拥有的执行任务。&lt;/p&gt;
&lt;p&gt;已经开始的阻塞文件操作不会假装回滚。这条边界也要说清楚。&lt;/p&gt;
&lt;h2 id=&#34;并发许可要跟真实工作走&#34;&gt;并发许可要跟真实工作走&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e5%b9%b6%e5%8f%91%e8%ae%b8%e5%8f%af%e8%a6%81%e8%b7%9f%e7%9c%9f%e5%ae%9e%e5%b7%a5%e4%bd%9c%e8%b5%b0&#34; aria-label=&#34;章节链接：并发许可要跟真实工作走&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;以前还有一种容易让面板数据看起来比实际更漂亮的情况：外层 Future 被取消以后，如果并发许可提前释放，但底层阻塞工作其实还在跑，就会出现“系统看起来有空位，实际上旧工作没结束”。&lt;/p&gt;
&lt;p&gt;现在已经启动的阻塞工作会继续持有对应许可，直到结束或异常退出。排队工作取消则会释放预留。&lt;/p&gt;
&lt;p&gt;我更愿意让数字难看一点，也不想让 Scheduler 对自己的真实资源状态撒谎。&lt;/p&gt;
&lt;h2 id=&#34;context-也继续往目标优先收紧&#34;&gt;Context 也继续往目标优先收紧&lt;a class=&#34;heading-anchor&#34; href=&#34;#context-%e4%b9%9f%e7%bb%a7%e7%bb%ad%e5%be%80%e7%9b%ae%e6%a0%87%e4%bc%98%e5%85%88%e6%94%b6%e7%b4%a7&#34; aria-label=&#34;章节链接：Context 也继续往目标优先收紧&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;顺手还改了一轮 &lt;code&gt;agent_context&lt;/code&gt; 的候选排序：精确定义优先于相似辅助函数；直接目标文件优先于按字母排在前面的 Design 映射；并行建议开始结合当前 Scope、活动 Worklist Lane 和运行时并发上限，而不是固定最多四路。&lt;/p&gt;
&lt;p&gt;Lane 数只用来给 Agent 提示，并不能证明两件事真的独立。最后仍然由真实资源和依赖决定能不能一起跑。&lt;/p&gt;
&lt;h2 id=&#34;observatory-不再把有映射当已验证&#34;&gt;Observatory 不再把“有映射”当“已验证”&lt;a class=&#34;heading-anchor&#34; href=&#34;#observatory-%e4%b8%8d%e5%86%8d%e6%8a%8a%e6%9c%89%e6%98%a0%e5%b0%84%e5%bd%93%e5%b7%b2%e9%aa%8c%e8%af%81&#34; aria-label=&#34;章节链接：Observatory 不再把“有映射”当“已验证”&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;Project Observatory 这轮还修了一个我很在意的表达问题。&lt;/p&gt;
&lt;p&gt;以前“某个 Requirement 有 Verification 映射”和“这个 Revision 上真的执行并通过了验证”在视觉上太容易靠近。&lt;/p&gt;
&lt;p&gt;现在会明确区分：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;verification mapped
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;executed
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;passed
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;fresh proof
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;因为有测试文件，不等于测试跑过；测试跑过，也不等于它属于现在这份代码。&lt;/p&gt;
&lt;h2 id=&#34;这版主要把无意义等待拿掉&#34;&gt;这版主要把无意义等待拿掉&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e8%bf%99%e7%89%88%e4%b8%bb%e8%a6%81%e6%8a%8a%e6%97%a0%e6%84%8f%e4%b9%89%e7%ad%89%e5%be%85%e6%8b%bf%e6%8e%89&#34; aria-label=&#34;章节链接：这版主要把无意义等待拿掉&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;v0.6.1 基本都在修执行语义：Ready 就进队列，失败只截断依赖分支，Partial 明确报告 Partial，Cancel 继续往子任务传，许可跟着真实工作释放。&lt;/p&gt;
&lt;p&gt;它不会把本来串行的任务凭空变快，但长任务里少掉几次无关等待，体感很明显。&lt;/p&gt;
&lt;p&gt;再往后到 v0.6.2，我又继续拆了一个误区：&lt;strong&gt;外层 &lt;code&gt;SLOTS&lt;/code&gt; 很高，不代表真实吞吐就高。&lt;/strong&gt;&lt;/p&gt;
</description>
    </item>
    
    <item>
      <title>wcode v0.6：哪些工具调用可以一起跑</title>
      <link>https://francisdu.com/blog/wcode-v0-6/</link>
      <pubDate>Sat, 12 Sep 2026 05:30:00 +0800</pubDate>
      <guid>https://francisdu.com/blog/wcode-v0-6/</guid>
      <description>&lt;p&gt;&lt;a href=&#34;https://francisdu.com/blog/wcode-v0-5/&#34;&gt;v0.5&lt;/a&gt; 做完 Warm LSP Runtime 以后，我原本打算继续补 Semantic。&lt;/p&gt;
&lt;p&gt;实际拿 wcode 连续写了几轮代码，先暴露出来的却是执行节奏：模型已经知道几件事互不依赖，还是经常按顺序一个个调用工具。&lt;/p&gt;
&lt;p&gt;例如一个普通修改，前面经常同时存在几条工作：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;读目标文件
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;查相关测试
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;看项目约束
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;确认调用方
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;检查工作树
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;这些动作很多没有依赖关系。如果 Prompt 只写一句“可以并行”，模型仍然很容易串着做。&lt;/p&gt;
&lt;p&gt;v0.6 就从这里开始改。我想让 Harness 少给模型一层猜测：当前任务有哪些入口，哪些可以一起做，哪些必须等前一步完成。&lt;/p&gt;
&lt;figure class=&#34;content-image&#34;&gt;&lt;img src=&#34;https://francisdu.com/img/wcode/wcode-architecture_hu_92a8fd07f12ae64a.webp&#34; alt=&#34;wcode Architecture&#34;loading=&#34;lazy&#34; decoding=&#34;async&#34; srcset=&#34;https://francisdu.com/img/wcode/wcode-architecture_hu_92a8fd07f12ae64a.webp 960w, https://francisdu.com/img/wcode/wcode-architecture_hu_3f3f08e508cea449.webp 1800w&#34; sizes=&#34;(max-width: 900px) calc(100vw - 32px), 900px&#34; width=&#34;3232&#34; height=&#34;1932&#34;&gt;&lt;/figure&gt;&lt;h2 id=&#34;agent_context-不再只是一包上下文&#34;&gt;&lt;code&gt;agent_context&lt;/code&gt; 不再只是一包上下文&lt;a class=&#34;heading-anchor&#34; href=&#34;#agent_context-%e4%b8%8d%e5%86%8d%e5%8f%aa%e6%98%af%e4%b8%80%e5%8c%85%e4%b8%8a%e4%b8%8b%e6%96%87&#34; aria-label=&#34;章节链接：agent_context 不再只是一包上下文&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;最早的 &lt;code&gt;agent_context&lt;/code&gt; 主要解决 Context 成本。&lt;/p&gt;
&lt;p&gt;它把 Design State、Repo Map、目标源码、SHA、验证入口和项目约束压进一个有界包里，让模型不用每次从根目录重新理解一遍。&lt;/p&gt;
&lt;p&gt;到了 v0.6，我给这份 Context 又加了一层执行信息：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;你现在应该做什么？
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;哪些动作可以一起做？
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;哪些动作有真实依赖？
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;哪些文件已经是可编辑目标？
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;哪些 Semantic Provider 已经可用？
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;这次修改应该控制在多大范围？
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;所以 Context 里开始明确带 Minimal-change Strategy、Complexity Budget、Active Worklist、Hot Source、Semantic Provider Readiness、绑定当前 Revision 的文件 SHA、候选 Dependency Lane，以及推荐并发数和立即并行的执行指引。&lt;/p&gt;
&lt;p&gt;现在这份 Context 除了描述仓库，也会把这次任务已经确定的执行入口一起带出来。&lt;/p&gt;
&lt;h2 id=&#34;parallel-first-不等于把槽位占满&#34;&gt;Parallel-first 不等于“把槽位占满”&lt;a class=&#34;heading-anchor&#34; href=&#34;#parallel-first-%e4%b8%8d%e7%ad%89%e4%ba%8e%e6%8a%8a%e6%a7%bd%e4%bd%8d%e5%8d%a0%e6%bb%a1&#34; aria-label=&#34;章节链接：Parallel-first 不等于“把槽位占满”&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;并行最容易做成一个漂亮但没什么用的数字。多发几个 Tool Call 很简单，麻烦的是先确认它们之间到底有没有依赖：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;独立 Discovery     ─┐
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;独立 Read          ─┼─→ 同时开始
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;独立 Review        ─┤
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;独立 Check         ─┘
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;需要前置结果的 Edit ───→ 等依赖满足再开始
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;同一文件冲突写入     ───→ 串行
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;授权后才能执行的命令 ───→ 等批准
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;v0.6 的规则很直接：先看依赖，再决定哪些调用一起发。&lt;/p&gt;
&lt;p&gt;v0.6 的 Skill 和 Agent 工作流也开始明确要求：Host 支持并行调用时，应该尽早把独立的 Discovery、Read、Review、Check，以及不重叠 Edit 发出去。&lt;/p&gt;
&lt;h2 id=&#34;我不想让模型自己猜仓库结构&#34;&gt;我不想让模型自己猜仓库结构&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e6%88%91%e4%b8%8d%e6%83%b3%e8%ae%a9%e6%a8%a1%e5%9e%8b%e8%87%aa%e5%b7%b1%e7%8c%9c%e4%bb%93%e5%ba%93%e7%bb%93%e6%9e%84&#34; aria-label=&#34;章节链接：我不想让模型自己猜仓库结构&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;以前 Agent 虽然拿到了很多能力，但仍然可能自己脑补：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;这个项目大概是 Rust + Web？
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;这个目录看起来可能是 UI？
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;这里应该跑 cargo test？
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;那个 Language Server 应该已经能用了？
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;这种猜测单次看没什么，长任务里会不断累积。&lt;/p&gt;
&lt;p&gt;所以 Task-ready Context 会更主动地把已经确定的东西摆出来。目标文件是谁，就把目标文件和 SHA 放前面；当前 Scope 是什么，就把相关源码和 Worklist Lane 放前面；Semantic Provider 还没准备好，就明确说没准备好。&lt;/p&gt;
&lt;p&gt;我在 &lt;a href=&#34;https://francisdu.com/blog/wcode-software-graph/&#34;&gt;Software Graph&lt;/a&gt; 那篇里写过一次：Tree-sitter、LSP、Runtime 是不同精度的事实。&lt;/p&gt;
&lt;p&gt;执行层也照这个规则。Provider 没准备好就明确标出来，不用一个模糊状态让模型自己猜。&lt;/p&gt;
&lt;h2 id=&#34;lsp-也开始按真实安全边界工作&#34;&gt;LSP 也开始按真实安全边界工作&lt;a class=&#34;heading-anchor&#34; href=&#34;#lsp-%e4%b9%9f%e5%bc%80%e5%a7%8b%e6%8c%89%e7%9c%9f%e5%ae%9e%e5%ae%89%e5%85%a8%e8%be%b9%e7%95%8c%e5%b7%a5%e4%bd%9c&#34; aria-label=&#34;章节链接：LSP 也开始按真实安全边界工作&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;v0.5 把 LSP 做成了 Warm Semantic Runtime。&lt;/p&gt;
&lt;p&gt;v0.6 又补了一层：Server Discovery、Binary Identity、Bounded Warm Session、Source Revision Sync 和 Safety Profile。&lt;/p&gt;
&lt;p&gt;Language Server 不是纯文本查询器。它可能读取项目配置、调用构建系统、加载插件，甚至间接触发仓库里的代码。&lt;/p&gt;
&lt;p&gt;所以“机器上装了 rust-analyzer”不等于“Agent 可以无条件启动 rust-analyzer”。如果某个 Server 没有明确的 Automatic Safety Profile，wcode 会 Fail Closed，然后进入精确授权流程。&lt;/p&gt;
&lt;h2 id=&#34;命令授权从允许禁止变成精确指纹&#34;&gt;命令授权从“允许/禁止”变成精确指纹&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e5%91%bd%e4%bb%a4%e6%8e%88%e6%9d%83%e4%bb%8e%e5%85%81%e8%ae%b8%e7%a6%81%e6%ad%a2%e5%8f%98%e6%88%90%e7%b2%be%e7%a1%ae%e6%8c%87%e7%ba%b9&#34; aria-label=&#34;章节链接：命令授权从“允许/禁止”变成精确指纹&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;v0.6 还有一块变化，我自己用起来很明显：本地探查命令少打断了，但真正可能执行仓库代码或者产生副作用的命令，也不再只有“永久拒绝”这一条路。&lt;/p&gt;
&lt;p&gt;只要没有撞上硬安全边界，就可以生成一次精确的 &lt;code&gt;RiskyExecution&lt;/code&gt; 请求。&lt;/p&gt;
&lt;p&gt;批准绑定的是：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Workspace
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Program
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Arguments
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Working Directory
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;我批准一次 &lt;code&gt;cargo test --locked&lt;/code&gt;，不代表顺便批准 &lt;code&gt;cargo publish&lt;/code&gt;，更不代表给 Agent 无限 Full Access。&lt;/p&gt;
&lt;p&gt;Shell、Workspace Escape、Protected Path、凭据或配置重定向、Host-wide Tool Mutation、Package Publication / Ownership，以及明显破坏性的基础设施操作，仍然是硬边界。&lt;/p&gt;
&lt;p&gt;我最后留下了一段很实用的中间地带：动作本身允许，但这一次要执行的 Workspace、Program、Arguments 和 Working Directory 必须让我看清楚再批。&lt;/p&gt;
&lt;h2 id=&#34;这版主要在收执行摩擦&#34;&gt;这版主要在收执行摩擦&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e8%bf%99%e7%89%88%e4%b8%bb%e8%a6%81%e5%9c%a8%e6%94%b6%e6%89%a7%e8%a1%8c%e6%91%a9%e6%93%a6&#34; aria-label=&#34;章节链接：这版主要在收执行摩擦&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;&lt;code&gt;parallel&lt;/code&gt;、&lt;code&gt;context&lt;/code&gt;、&lt;code&gt;LSP&lt;/code&gt;、&lt;code&gt;authorization&lt;/code&gt; 这些改动看起来分散，实际都来自我自己使用时反复碰到的几类浪费：模型重复确认已经知道的事实、明明可以并行却串着查、语义服务状态不清楚、命令到了最后一步才发现权限不够。&lt;/p&gt;
&lt;p&gt;v0.6 做的就是把这些信息提前放进 Runtime 能确定的位置，尽量少让模型靠 Prompt 猜。&lt;/p&gt;
&lt;p&gt;我也不会给 v0.6 编一个“通用提速百分比”。真实收益取决于任务图、仓库、Host 是否支持并行调用，以及 Semantic Session 是否已经热起来。&lt;/p&gt;
&lt;p&gt;后面的 v0.6.1，我又继续把 &lt;code&gt;parallel_tools&lt;/code&gt; 调度器改了一轮。那次处理的是另一个更底层的问题：&lt;strong&gt;并行任务不应该因为同一层里有一个慢分支，就集体等它。&lt;/strong&gt;&lt;/p&gt;
</description>
    </item>
    
    <item>
      <title>wcode v0.5：LSP 不再每次现启</title>
      <link>https://francisdu.com/blog/wcode-v0-5/</link>
      <pubDate>Sun, 30 Aug 2026 17:30:00 +0800</pubDate>
      <guid>https://francisdu.com/blog/wcode-v0-5/</guid>
      <description>&lt;p&gt;v0.4 做完以后，我以为 wcode 写代码这条主链已经比较顺了。&lt;/p&gt;
&lt;p&gt;那一版主要解决 Context 成本：&lt;code&gt;agent_context&lt;/code&gt; 变成 Coding Entry，Repo Map 有了 Cache 和 Scope，简单任务不需要每次把整个项目重新理解一遍。&lt;/p&gt;
&lt;p&gt;但真的继续拿它写代码，很快又遇到另一个问题。&lt;/p&gt;
&lt;p&gt;不是“找不到函数”。&lt;/p&gt;
&lt;p&gt;Tree-sitter 和 Search 对定位其实已经很好用了。&lt;/p&gt;
&lt;p&gt;真正麻烦的是这种问题：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;谁在调用这个函数？
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;这个 Trait 到底有哪些实现？
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;改这个 Symbol 会影响哪些跨文件 Reference？
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;这个调用关系是同名文本，还是类型系统真正解析出来的？
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;这种时候，grep 能找到很多东西，但不一定完整；Tree-sitter 能告诉我语法结构，但它也不应该假装自己知道类型系统。&lt;/p&gt;
&lt;p&gt;所以 v0.5 没继续堆零散的 LSP API，我直接把 Language Server 的生命周期重新做了一遍，让它可以受限地常驻和复用。&lt;/p&gt;
&lt;figure class=&#34;content-image&#34;&gt;&lt;img src=&#34;https://francisdu.com/img/wcode/wcode-architecture_hu_92a8fd07f12ae64a.webp&#34; alt=&#34;wcode Architecture&#34;loading=&#34;lazy&#34; decoding=&#34;async&#34; srcset=&#34;https://francisdu.com/img/wcode/wcode-architecture_hu_92a8fd07f12ae64a.webp 960w, https://francisdu.com/img/wcode/wcode-architecture_hu_3f3f08e508cea449.webp 1800w&#34; sizes=&#34;(max-width: 900px) calc(100vw - 32px), 900px&#34; width=&#34;3232&#34; height=&#34;1932&#34;&gt;&lt;/figure&gt;&lt;h2 id=&#34;我为什么没有把所有查询都切到-lsp&#34;&gt;我为什么没有把所有查询都切到 LSP&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e6%88%91%e4%b8%ba%e4%bb%80%e4%b9%88%e6%b2%a1%e6%9c%89%e6%8a%8a%e6%89%80%e6%9c%89%e6%9f%a5%e8%af%a2%e9%83%bd%e5%88%87%e5%88%b0-lsp&#34; aria-label=&#34;章节链接：我为什么没有把所有查询都切到 LSP&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;最直接的做法其实很诱人：&lt;/p&gt;
&lt;blockquote&gt;
&lt;p&gt;既然 Language Server 更懂代码，那以后 Definition、Search、Reference、Call 全走 LSP 不就好了？&lt;/p&gt;
&lt;/blockquote&gt;
&lt;p&gt;我试着沿这个方向想了一轮，最后放弃了。&lt;/p&gt;
&lt;p&gt;原因是 Agent Coding 里有两类完全不同的问题。&lt;/p&gt;
&lt;p&gt;第一类只是定位：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;这个函数在哪？
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;这个 Struct 定义在哪？
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;哪个文件包含这个字符串？
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;这类问题 Tree-sitter / Search 很便宜，而且稳定，不需要启动项目语义环境。&lt;/p&gt;
&lt;p&gt;第二类才是真正需要 Semantic Completeness 的关系问题：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;references
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;implementations
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;incoming callers
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;outgoing callees
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;rename impact
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;如果为了第一类问题也默认走 Language Server，就会把一个本来很便宜的定位动作变成进程启动、Initialize、Document Sync、Semantic Query。&lt;/p&gt;
&lt;p&gt;而 Agent 还有一个额外成本：Tool Result 最后会进入 Context。&lt;/p&gt;
&lt;p&gt;所以我现在更愿意把两层能力分开：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;                ┌──────────────────────┐
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;                │     agent_context     │
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;                └──────────┬───────────┘
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;                           │
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;                普通定位   │   跨文件关系
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;                           │
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;          ┌────────────────┴───────────────┐
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;          ↓                                ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;find_symbol / search_code          semantic_navigation
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Tree-sitter / text search                 │
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;          │                               ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;          │                       Warm LSP Session
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;          └──────────────┬────────────────┘
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;                         ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;                    edit / review
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;                         ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;                    verify_project
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;不是“LSP 比 grep 高级，所以替掉 grep”。&lt;/p&gt;
&lt;p&gt;而是让每一层只解决它真正擅长的问题。&lt;/p&gt;
&lt;h2 id=&#34;以前的-lsp-其实还是一次性工具&#34;&gt;以前的 LSP 其实还是一次性工具&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e4%bb%a5%e5%89%8d%e7%9a%84-lsp-%e5%85%b6%e5%ae%9e%e8%bf%98%e6%98%af%e4%b8%80%e6%ac%a1%e6%80%a7%e5%b7%a5%e5%85%b7&#34; aria-label=&#34;章节链接：以前的 LSP 其实还是一次性工具&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;wcode 之前已经能跑 Language Server。&lt;/p&gt;
&lt;p&gt;但生命周期很像一个 Batch Job：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;start provider
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;initialize
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;didOpen
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Document Symbol
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Call Hierarchy
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Implementation
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;shutdown
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;它适合定期补 Software Graph。&lt;/p&gt;
&lt;p&gt;但如果 Agent 紧接着又问一次 Reference，就要重新付一遍启动成本。&lt;/p&gt;
&lt;p&gt;更关键的是，这种模型下“Semantic Provider”在架构上仍然只是一个索引器，不是真正的 Runtime。&lt;/p&gt;
&lt;p&gt;v0.5 把这个生命周期改了。&lt;/p&gt;
&lt;p&gt;现在 Harness 里有一个有界 Session Pool：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Workspace
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;   ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Provider + Binary Identity
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;   ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Warm Session Slot
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;   ├── graph refresh
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;   ├── semantic_navigation
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;   ├── didChange
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;   └── didClose
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;同一个 Workspace 下，后台 Graph Indexing 和前台 Navigation 会复用同一个 Provider Process。&lt;/p&gt;
&lt;p&gt;如果 &lt;code&gt;rust-analyzer&lt;/code&gt; 已经 Warm，第二次查 Caller 不需要再启动一遍。&lt;/p&gt;
&lt;h2 id=&#34;warm-不等于永远不关&#34;&gt;Warm 不等于永远不关&lt;a class=&#34;heading-anchor&#34; href=&#34;#warm-%e4%b8%8d%e7%ad%89%e4%ba%8e%e6%b0%b8%e8%bf%9c%e4%b8%8d%e5%85%b3&#34; aria-label=&#34;章节链接：Warm 不等于永远不关&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;我不想为了省启动成本，最后在后台养一堆永远不会退出的 Language Server。&lt;/p&gt;
&lt;p&gt;所以这个 Pool 从一开始就是 Bounded 的。&lt;/p&gt;
&lt;p&gt;它有几条约束：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;Session 数量有上限；&lt;/li&gt;
&lt;li&gt;Idle Slot 会淘汰；&lt;/li&gt;
&lt;li&gt;同一个 Slot 的 JSON-RPC Stream 串行处理；&lt;/li&gt;
&lt;li&gt;Provider Process 死掉以后重建；&lt;/li&gt;
&lt;li&gt;Provider Binary Identity 变了以后重建；&lt;/li&gt;
&lt;li&gt;Workspace Key 不共享到别的项目；&lt;/li&gt;
&lt;li&gt;离开当前有界索引集合的 Document 会 &lt;code&gt;didClose&lt;/code&gt;。&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;发版前我专门沿这条生命周期又审了一遍，结果真的抓到一个边界 Bug：最初的 Idle Eviction 其实是 Lazy 的，只有下一次有人访问 Session Pool 时才会 Prune；更糟一点，容量满时如果直接从 Map 里移除“最旧 Slot”，这个 Slot 可能还被一个 Active Request 持有，于是 Map 看起来仍然只有 16 个，实际进程却可能短暂跑到第 17 个。&lt;/p&gt;
&lt;p&gt;最后我把规则改成了更保守的版本：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Idle + unleased
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  → 可以 prune
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;capacity full + 有 unleased slot
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  → 只驱逐 unleased slot
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;capacity full + 全部 leased
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  → fail closed / retry
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;provider binary changed + old slot still leased
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  → 等当前 request 结束
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  → 再替换
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;Background Semantic Coordinator 也会周期性主动 Prune，所以即使是没有 TUI 交互的 &lt;code&gt;mcp-stdio&lt;/code&gt;，Idle Bound 也不是一句文档里的承诺。&lt;/p&gt;
&lt;p&gt;源码变化也不是简单把 Process 杀掉重启。&lt;/p&gt;
&lt;p&gt;现在不是强行给所有 Server 发同一种 Notification，而是先看它在 &lt;code&gt;initialize&lt;/code&gt; 里声明的 &lt;code&gt;textDocumentSync&lt;/code&gt;：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Full
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  → Open 发完整内容
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  → Change 发整文档
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Incremental
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  → Open 发完整内容
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  → Change 用旧文档范围做合法 replacement
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  → Range 按协商的 UTF-8 / UTF-16 / UTF-32 算
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;None / openClose=false
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  → 不硬发 Server 没声明支持的 Notification
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  → Server 继续从磁盘读取
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;只有 Server 要求 Open/Close Sync 时才发 &lt;code&gt;didOpen&lt;/code&gt; / &lt;code&gt;didClose&lt;/code&gt;。这才比较像我理解的“常驻语义层”：它既知道当前 Document Revision，也尊重每个 Language Server 自己的同步协议，而不是假定 Rust 能工作的 Change Shape 对 22 种语言都成立。&lt;/p&gt;
&lt;h2 id=&#34;semantic_navigation-不让-agent-自己算-utf-16&#34;&gt;&lt;code&gt;semantic_navigation&lt;/code&gt; 不让 Agent 自己算 UTF-16&lt;a class=&#34;heading-anchor&#34; href=&#34;#semantic_navigation-%e4%b8%8d%e8%ae%a9-agent-%e8%87%aa%e5%b7%b1%e7%ae%97-utf-16&#34; aria-label=&#34;章节链接：semantic_navigation 不让 Agent 自己算 UTF-16&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;做 Agent Tool 时，我越来越不喜欢把底层协议细节原样扔给模型。&lt;/p&gt;
&lt;p&gt;原始 LSP 通常希望调用方给：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;file URI
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;line
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;character
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;position encoding
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;然后不同 Server 还可能用 UTF-8 / UTF-16 Position Encoding。&lt;/p&gt;
&lt;p&gt;让模型自己根据源码去算 UTF-16 Offset，我觉得完全是在浪费模型能力，而且很容易在非 ASCII 代码里漂掉。&lt;/p&gt;
&lt;p&gt;所以 v0.5 的 &lt;code&gt;semantic_navigation&lt;/code&gt; 主入口是：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;path + symbol
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;wcode 自己先用 Tree-sitter 找 Symbol 的精确位置，再根据 Language Server Initialize 时协商到的 Encoding 转换 Position。&lt;/p&gt;
&lt;p&gt;Agent 只需要表达意图：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;definition
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;hover
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;references
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;incoming_calls
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;outgoing_calls
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;implementations
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;impact
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;真正已经持有精确 Position 的调用方，也可以继续传 &lt;code&gt;line + character&lt;/code&gt;。&lt;/p&gt;
&lt;p&gt;这件事看起来很小，但我觉得它代表一个方向：&lt;/p&gt;
&lt;blockquote&gt;
&lt;p&gt;&lt;strong&gt;LSP Primitive 不应该直接等于 Agent Primitive。&lt;/strong&gt;&lt;/p&gt;
&lt;/blockquote&gt;
&lt;p&gt;Agent Tool 应该封装成模型真正想问的问题，而不是要求模型先学会协议的坐标系。&lt;/p&gt;
&lt;p&gt;这里发版审计又抓到另一个我不愿意留到 0.5.1 的问题：最早实现里，如果 Server 声明支持 &lt;code&gt;references&lt;/code&gt;，但这次 Request 实际 Timeout / Error，结果路径可能最后只留下一个空数组。对 Agent 来说，“请求失败”和“确实没有 Reference”完全不是一件事。&lt;/p&gt;
&lt;p&gt;所以现在 Result 会明确分成：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;unsupported
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  → Server 没这个能力
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;failures
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  → Server 有能力，但这次 LSP Request 失败
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;relationships = []
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  → Request 成功，真的没有匹配关系
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;我尤其不想让失败被当成 Negative Semantic Evidence。语义系统最危险的不是“不知道”，而是失败以后还表现得像自己很确定。&lt;/p&gt;
&lt;h2 id=&#34;22-种语言不能只有-rust-真正跑得通&#34;&gt;22 种语言，不能只有 Rust 真正跑得通&lt;a class=&#34;heading-anchor&#34; href=&#34;#22-%e7%a7%8d%e8%af%ad%e8%a8%80%e4%b8%8d%e8%83%bd%e5%8f%aa%e6%9c%89-rust-%e7%9c%9f%e6%ad%a3%e8%b7%91%e5%be%97%e9%80%9a&#34; aria-label=&#34;章节链接：22 种语言，不能只有 Rust 真正跑得通&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;发版前我又给这版加了一条更苛刻的要求：&lt;/p&gt;
&lt;blockquote&gt;
&lt;p&gt;&lt;strong&gt;既然 wcode 对外说 Syntax Index 支持 22 种语言，那 LSP 层也不能只把 rust-analyzer 做扎实，其他语言只在 Registry 里挂个名字。&lt;/strong&gt;&lt;/p&gt;
&lt;/blockquote&gt;
&lt;p&gt;这次审计以后，我把“支持”拆成了三个完全不同的概念：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Compatibility
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  → wcode 有没有正确的 Provider Adapter / Command / Language ID
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Installation
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  → 用户机器上有没有真的装这个 Language Server
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Live Semantic
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  → 这个已安装 Server 有没有真实 initialize 并回答当前 Revision
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;只有第一层是 wcode 在 Build/Test 阶段能 100% 保证的。&lt;/p&gt;
&lt;p&gt;第二层取决于用户机器。&lt;/p&gt;
&lt;p&gt;第三层必须等 Runtime 真正和 Server 完成 LSP Handshake 以后才能成立。&lt;/p&gt;
&lt;p&gt;所以 v0.5 现在要求 22 种 Indexed Language &lt;strong&gt;每一种恰好只有一个 Canonical LSP Launch Profile&lt;/strong&gt;，并用测试把映射和 Provider-specific Argument 锁死。除此之外，我还加了一层跨平台 stdio Mock LSP：每一个 Canonical Profile 都会真的 Spawn 一个子进程，完成 &lt;code&gt;initialize&lt;/code&gt;、Capability Negotiation、Open/Change/Close 和 Hover JSON-RPC 往返，而不是只检查数组里的字符串：&lt;/p&gt;
&lt;table&gt;
	&lt;thead&gt;
			&lt;tr&gt;
					&lt;th&gt;Language&lt;/th&gt;
					&lt;th&gt;Canonical LSP&lt;/th&gt;
			&lt;/tr&gt;
	&lt;/thead&gt;
	&lt;tbody&gt;
			&lt;tr&gt;
					&lt;td&gt;Bash&lt;/td&gt;
					&lt;td&gt;&lt;code&gt;bash-language-server start&lt;/code&gt;&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;C / C++&lt;/td&gt;
					&lt;td&gt;&lt;code&gt;clangd&lt;/code&gt;&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;C#&lt;/td&gt;
					&lt;td&gt;&lt;code&gt;csharp-ls&lt;/code&gt;&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;CSS&lt;/td&gt;
					&lt;td&gt;&lt;code&gt;vscode-css-language-server --stdio&lt;/code&gt;&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;Dart&lt;/td&gt;
					&lt;td&gt;&lt;code&gt;dart language-server --protocol=lsp&lt;/code&gt;&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;Elixir&lt;/td&gt;
					&lt;td&gt;ElixirLS &lt;code&gt;language_server.sh&lt;/code&gt; / Wrapper&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;Go&lt;/td&gt;
					&lt;td&gt;&lt;code&gt;gopls serve&lt;/code&gt;&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;HTML&lt;/td&gt;
					&lt;td&gt;&lt;code&gt;vscode-html-language-server --stdio&lt;/code&gt;&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;Java&lt;/td&gt;
					&lt;td&gt;&lt;code&gt;jdtls -data &amp;lt;unique state&amp;gt;&lt;/code&gt;&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;JavaScript / TypeScript / TSX&lt;/td&gt;
					&lt;td&gt;&lt;code&gt;typescript-language-server --stdio&lt;/code&gt;&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;Lua&lt;/td&gt;
					&lt;td&gt;&lt;code&gt;lua-language-server&lt;/code&gt;&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;OCaml / Interface&lt;/td&gt;
					&lt;td&gt;&lt;code&gt;ocamllsp&lt;/code&gt;&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;PHP&lt;/td&gt;
					&lt;td&gt;&lt;code&gt;phpactor language-server&lt;/code&gt;&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;Python&lt;/td&gt;
					&lt;td&gt;&lt;code&gt;pyright-langserver --stdio&lt;/code&gt;&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;R&lt;/td&gt;
					&lt;td&gt;&lt;code&gt;R --no-echo -e languageserver::run()&lt;/code&gt;&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;Ruby&lt;/td&gt;
					&lt;td&gt;&lt;code&gt;ruby-lsp&lt;/code&gt;&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;Rust&lt;/td&gt;
					&lt;td&gt;&lt;code&gt;rust-analyzer&lt;/code&gt;&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;Swift&lt;/td&gt;
					&lt;td&gt;&lt;code&gt;sourcekit-lsp&lt;/code&gt;&lt;/td&gt;
			&lt;/tr&gt;
	&lt;/tbody&gt;
&lt;/table&gt;
&lt;p&gt;而且这次不是把旧 Registry 原样拿来写测试。&lt;/p&gt;
&lt;p&gt;我对着各家的当前启动方式重新过了一遍，确实发现了几个容易变成“纸面支持”的地方：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;Go 明确改成 &lt;code&gt;gopls serve&lt;/code&gt;；&lt;/li&gt;
&lt;li&gt;JDT LS 会拿一个 Workspace + Runtime 唯一的用户级 &lt;code&gt;-data&lt;/code&gt; 目录，避免两个项目或两个 wcode Process 共用 JDT State；&lt;/li&gt;
&lt;li&gt;Dart 使用 &lt;code&gt;dart language-server --protocol=lsp&lt;/code&gt;，并带上 wcode 的 Client ID / Version；&lt;/li&gt;
&lt;li&gt;Elixir 同时识别官方 &lt;code&gt;language_server.sh&lt;/code&gt;、Windows Wrapper 和常见发行版 &lt;code&gt;elixir-ls&lt;/code&gt;；&lt;/li&gt;
&lt;li&gt;LuaLS 对 Symlink 启动比较特殊，所以不能照抄 rustup Proxy 的处理方式，发现 Symlink 时会执行 Canonical Target；&lt;/li&gt;
&lt;li&gt;OmniSharp 的 &lt;code&gt;-lsp&lt;/code&gt; 不再被拿来凑 C# Fallback 数量，C# Canonical 路径只认 &lt;code&gt;csharp-ls&lt;/code&gt;。&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;真正有意义的 Alternate 只留了三个：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;PHP     phpactor → intelephense
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Python  pyright  → pylsp
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Ruby    ruby-lsp → solargraph
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;更重要的是，Fallback 不是只存在配置表里。&lt;/p&gt;
&lt;p&gt;现在 &lt;code&gt;semantic_navigation&lt;/code&gt; 和手工 &lt;code&gt;semantic_provider_refresh&lt;/code&gt; 都会在：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;canonical executable exists
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;        ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;initialize fails
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;        ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;try installed alternate
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;但 Alternate 不会继承 Canonical Provider 的授权。&lt;/p&gt;
&lt;p&gt;如果它属于非 Automatic Provider，就必须拿自己的 Workspace + Provider + Binary Identity Trust；Refresh 成功切换以后，结果里还会显式记录 &lt;code&gt;fallbacks&lt;/code&gt;。&lt;/p&gt;
&lt;p&gt;所以这里我想表达的不是“wcode 自带 22 个 Language Server”。&lt;/p&gt;
&lt;p&gt;它当然没有。&lt;/p&gt;
&lt;p&gt;而是：&lt;strong&gt;22/22 的 Adapter Contract、stdio Framing 和 Provider-specific Launch Profile 是 wcode 自己要负责的；External Server 是否安装要诚实报告；Semantic Precision 只有那份真实 Binary Live Initialize + 当前 Revision Response 以后才成立。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;这比在 README 里写一个长长的“Supported Languages”列表可靠得多。&lt;/p&gt;
&lt;h2 id=&#34;默认开启以后安全边界反而要更严格&#34;&gt;默认开启以后，安全边界反而要更严格&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e9%bb%98%e8%ae%a4%e5%bc%80%e5%90%af%e4%bb%a5%e5%90%8e%e5%ae%89%e5%85%a8%e8%be%b9%e7%95%8c%e5%8f%8d%e8%80%8c%e8%a6%81%e6%9b%b4%e4%b8%a5%e6%a0%bc&#34; aria-label=&#34;章节链接：默认开启以后，安全边界反而要更严格&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;这次另一个比较大的决定，是 Hardened Semantic 默认开启。&lt;/p&gt;
&lt;p&gt;也就是说普通启动：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-bash&#34; data-lang=&#34;bash&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;wcode --workspace &lt;span style=&#34;color:#a31515&#34;&gt;&amp;#34;&lt;/span&gt;$PWD&lt;span style=&#34;color:#a31515&#34;&gt;&amp;#34;&lt;/span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;如果项目里有 Rust，而且系统里有可用的 &lt;code&gt;rust-analyzer&lt;/code&gt;，wcode 会自动维护这条 Semantic Lane。&lt;/p&gt;
&lt;p&gt;但我没有把“所有 LSP 默认信任”一起打开。&lt;/p&gt;
&lt;p&gt;v0.5 当前只有 &lt;code&gt;rust-analyzer&lt;/code&gt; 进入 Automatic Profile。&lt;/p&gt;
&lt;p&gt;因为 Language Server 和普通 Parser 不一样：它会读项目配置，有些 Server 甚至可能间接执行 Repository-controlled Code。&lt;/p&gt;
&lt;p&gt;所以默认 Profile 做了几层限制：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;Executable 必须解析到 Workspace 外；&lt;/li&gt;
&lt;li&gt;Workspace 里的假 &lt;code&gt;rust-analyzer&lt;/code&gt; 不会被执行；&lt;/li&gt;
&lt;li&gt;Credential 和 Execution-injection Environment Variable 会清理；&lt;/li&gt;
&lt;li&gt;Build Script 关闭；&lt;/li&gt;
&lt;li&gt;Proc Macro 关闭；&lt;/li&gt;
&lt;li&gt;Cargo Auto Reload 关闭；&lt;/li&gt;
&lt;li&gt;Check-on-save 关闭；&lt;/li&gt;
&lt;li&gt;Result 最后仍重新经过 Workspace Boundary Filter。&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;这不是 OS Sandbox。&lt;/p&gt;
&lt;p&gt;我不想用“安全模式”这种词让人误以为 Language Server 完全没有执行面。&lt;/p&gt;
&lt;p&gt;它只是一个我愿意默认打开的、被明显收窄过的 Profile。&lt;/p&gt;
&lt;p&gt;如果是 &lt;code&gt;clangd&lt;/code&gt;、Pyright、gopls 或其他当前还没有 Hardened Profile 的 Provider，仍然需要显式 &lt;code&gt;RiskyExecution&lt;/code&gt; Trust。&lt;/p&gt;
&lt;p&gt;而且 Warm Session 出现以后，授权语义也跟着变了。&lt;/p&gt;
&lt;p&gt;以前一次性 Provider 可以按某次 Refresh Operation 授权。&lt;/p&gt;
&lt;p&gt;现在 Process 会被复用，真正准确的 Trust 应该是：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Workspace
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  + Provider
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  + current Provider Binary Identity
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;这个 Binary Identity 也不能漏。发版审计时我发现，第一版 Provider-session Fingerprint 只绑定了 Provider ID；如果 PATH 上同名 Provider Binary 被替换，Session Key 会重建，但旧授权理论上仍可能继续适用。现在 Authorization 和 Warm Session 使用同一套 Provider Binary Identity：Executable 被替换以后，旧 Grant 不会继承过去。&lt;/p&gt;
&lt;p&gt;因此同一份已批准 Provider 可以被 Refresh 和 Navigation 复用，不会每问一次 Reference 又弹一次权限；但它也不会顺手授权替换后的 Binary。&lt;/p&gt;
&lt;p&gt;如果完全不希望 wcode 启动第一方 Language Server：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-bash&#34; data-lang=&#34;bash&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;wcode --workspace &lt;span style=&#34;color:#a31515&#34;&gt;&amp;#34;&lt;/span&gt;$PWD&lt;span style=&#34;color:#a31515&#34;&gt;&amp;#34;&lt;/span&gt; --no-semantic
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;Tree-sitter / Search 仍然都在。&lt;/p&gt;
&lt;h2 id=&#34;后台自动维护也不能绕过全局资源边界&#34;&gt;后台自动维护也不能绕过全局资源边界&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e5%90%8e%e5%8f%b0%e8%87%aa%e5%8a%a8%e7%bb%b4%e6%8a%a4%e4%b9%9f%e4%b8%8d%e8%83%bd%e7%bb%95%e8%bf%87%e5%85%a8%e5%b1%80%e8%b5%84%e6%ba%90%e8%be%b9%e7%95%8c&#34; aria-label=&#34;章节链接：后台自动维护也不能绕过全局资源边界&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;另一个我不想接受的状态是：&lt;/p&gt;
&lt;blockquote&gt;
&lt;p&gt;前台 Tool 都有 Global Semaphore，后台 Semantic Worker 却偷偷无限跑。&lt;/p&gt;
&lt;/blockquote&gt;
&lt;p&gt;那 TUI 上看到的并发数就会是假的。&lt;/p&gt;
&lt;p&gt;所以 Background Semantic Maintainer 也必须先拿 Harness Permit，再真正进入 Running。&lt;/p&gt;
&lt;p&gt;生命周期还是：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;queued
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;acquire global permit
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;running
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;completed / failed
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;Broad Workspace 下面如果还有具体 Project Subspace，也只让最具体的 Leaf Workspace 启动自动 Semantic Worker。&lt;/p&gt;
&lt;p&gt;不然我把 &lt;code&gt;~/Code&lt;/code&gt; 暴露给 wcode 时，父目录和十几个子项目会同时索引同一批源码。&lt;/p&gt;
&lt;p&gt;这种优化不会出现在“支持哪些 LSP”的 Feature List 里，但我觉得比多支持一个 Server 更重要。&lt;/p&gt;
&lt;h2 id=&#34;tui-现在能看出-warm-到底有没有生效&#34;&gt;TUI 现在能看出 Warm 到底有没有生效&lt;a class=&#34;heading-anchor&#34; href=&#34;#tui-%e7%8e%b0%e5%9c%a8%e8%83%bd%e7%9c%8b%e5%87%ba-warm-%e5%88%b0%e5%ba%95%e6%9c%89%e6%b2%a1%e6%9c%89%e7%94%9f%e6%95%88&#34; aria-label=&#34;章节链接：TUI 现在能看出 Warm 到底有没有生效&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;以前 TUI 的 LSP 状态主要是：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;available / runnable
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;fresh / stale
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;v0.5 现在还会显示：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;warm sessions
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;synced documents
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;provider starts
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;semantic queries
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;我特意加这些，不是为了让 Dashboard 再多几个数字。&lt;/p&gt;
&lt;p&gt;而是 Warm Runtime 最容易出现一种假优化：代码里写了 Cache，但实际上每次 Query 还是重启 Process。&lt;/p&gt;
&lt;p&gt;如果 Session Start 一直涨、Query 也一直涨，那我就知道复用没有真的工作。&lt;/p&gt;
&lt;p&gt;可观测性是性能优化的一部分，不是最后补的 UI。&lt;/p&gt;
&lt;figure class=&#34;content-image&#34;&gt;&lt;img src=&#34;https://francisdu.com/img/wcode/wcode-tui_hu_13e59e78ee0ce797.webp&#34; alt=&#34;wcode TUI&#34;loading=&#34;lazy&#34; decoding=&#34;async&#34; srcset=&#34;https://francisdu.com/img/wcode/wcode-tui_hu_13e59e78ee0ce797.webp 960w, https://francisdu.com/img/wcode/wcode-tui_hu_6437a17a51f06ca3.webp 1800w&#34; sizes=&#34;(max-width: 900px) calc(100vw - 32px), 900px&#34; width=&#34;3420&#34; height=&#34;2146&#34;&gt;&lt;/figure&gt;&lt;h2 id=&#34;v04-和-v05-的差别&#34;&gt;v0.4 和 v0.5 的差别&lt;a class=&#34;heading-anchor&#34; href=&#34;#v04-%e5%92%8c-v05-%e7%9a%84%e5%b7%ae%e5%88%ab&#34; aria-label=&#34;章节链接：v0.4 和 v0.5 的差别&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;如果 v0.4 是“让 Intelligence 不要变成 Context Tax”，v0.5 更像是“让语义能力真正进入日常 Coding Hot Path”。&lt;/p&gt;
&lt;table&gt;
	&lt;thead&gt;
			&lt;tr&gt;
					&lt;th&gt;&lt;/th&gt;
					&lt;th&gt;v0.4&lt;/th&gt;
					&lt;th&gt;v0.5&lt;/th&gt;
			&lt;/tr&gt;
	&lt;/thead&gt;
	&lt;tbody&gt;
			&lt;tr&gt;
					&lt;td&gt;Semantic Provider&lt;/td&gt;
					&lt;td&gt;有界 Batch Refresh&lt;/td&gt;
					&lt;td&gt;Bounded Warm Runtime&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;LSP Process&lt;/td&gt;
					&lt;td&gt;Refresh 后退出&lt;/td&gt;
					&lt;td&gt;Workspace Session 复用&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;Document Sync&lt;/td&gt;
					&lt;td&gt;&lt;code&gt;didOpen&lt;/code&gt; 为主&lt;/td&gt;
					&lt;td&gt;Server-declared Full / Incremental / None&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;Agent Navigation&lt;/td&gt;
					&lt;td&gt;Syntax + Graph Context&lt;/td&gt;
					&lt;td&gt;&lt;code&gt;semantic_navigation&lt;/code&gt;&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;Default Routing&lt;/td&gt;
					&lt;td&gt;&lt;code&gt;agent_context&lt;/code&gt; + Tree-sitter&lt;/td&gt;
					&lt;td&gt;Localization 走 Syntax，Relationship 才走 LSP&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;Automatic Trust&lt;/td&gt;
					&lt;td&gt;LSP 需要显式 Trust&lt;/td&gt;
					&lt;td&gt;Hardened &lt;code&gt;rust-analyzer&lt;/code&gt; 默认开启&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;Non-auto LSP&lt;/td&gt;
					&lt;td&gt;Exact Refresh Trust&lt;/td&gt;
					&lt;td&gt;Workspace + Provider Session &lt;code&gt;RiskyExecution&lt;/code&gt;&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;TUI&lt;/td&gt;
					&lt;td&gt;available / fresh&lt;/td&gt;
					&lt;td&gt;available → launch-ready → live + warm/fresh&lt;/td&gt;
			&lt;/tr&gt;
	&lt;/tbody&gt;
&lt;/table&gt;
&lt;p&gt;我觉得这已经不是 0.4.x 的 Patch。&lt;/p&gt;
&lt;p&gt;所以版本直接到了 &lt;strong&gt;v0.5.0&lt;/strong&gt;。&lt;/p&gt;
&lt;h2 id=&#34;这次发版我也把-release-boundary-再收紧了一次&#34;&gt;这次发版我也把 Release Boundary 再收紧了一次&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e8%bf%99%e6%ac%a1%e5%8f%91%e7%89%88%e6%88%91%e4%b9%9f%e6%8a%8a-release-boundary-%e5%86%8d%e6%94%b6%e7%b4%a7%e4%ba%86%e4%b8%80%e6%ac%a1&#34; aria-label=&#34;章节链接：这次发版我也把 Release Boundary 再收紧了一次&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;Milestone Release 最怕的不是功能没写完，而是“仓库里的版本看起来有六个答案”。&lt;/p&gt;
&lt;p&gt;wcode 现在除了 Cargo Version，还有 Agent Plugin / Marketplace Manifest。&lt;/p&gt;
&lt;p&gt;v0.5 发版前我把它们统一成同一个版本，并且不只依赖 CI Shell Script 检查。&lt;/p&gt;
&lt;p&gt;Unit Test 也会验证：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Cargo package version
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  == plugin.json
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  == Claude plugin
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  == Codex plugin
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  == ZCode plugin
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  == root marketplace
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  == plugin marketplace
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;Release Workflow 还会再独立检查一次，然后跑：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Design / Traceability / Product Scope gate
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Format
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Check
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Clippy --all-targets
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Linux test
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;macOS test
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Windows test
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Linux / macOS / Windows release build
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;binary --version
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;SHA256SUMS
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;这次 Tag 前最后一轮本地 Full Gate 是：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;git diff --check                       ✅
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;cargo check --locked                   ✅
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;cargo fmt --check                      ✅
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;cargo test --locked                    ✅ 270 passed / 0 failed
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;cargo clippy --locked -- -D warnings   ✅
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;cargo build --release --locked         ✅
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;这里的 270 个核心测试已经包含 22 个 Canonical Profile 的真实 stdio Mock-LSP Initialize Contract、Full/Incremental/None Document Sync、Warm Session Capacity/Idle、Provider Binary Trust、Fallback 和 Navigation Failure Semantics。&lt;/p&gt;
&lt;p&gt;我仍然不想把“本机 cargo test 绿了”直接等同于“Release 已经成立”。&lt;/p&gt;
&lt;p&gt;真正发布的是 Tagged Revision 和对应 Artifact；Linux/macOS/Windows 的最终跨平台结论继续交给 Tag CI。&lt;/p&gt;
&lt;h2 id=&#34;最后&#34;&gt;最后&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e6%9c%80%e5%90%8e&#34; aria-label=&#34;章节链接：最后&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;wcode 最开始只是我为了让 Web AI 安全碰本地代码写的一层 MCP Bridge。&lt;/p&gt;
&lt;p&gt;后来它慢慢有了 Design State、Software Graph、Verification、Evidence、Reconciliation。&lt;/p&gt;
&lt;p&gt;v0.4 我开始对 Agent 的 Context 成本负责。&lt;/p&gt;
&lt;p&gt;到 v0.5，我又多了一层判断：&lt;/p&gt;
&lt;blockquote&gt;
&lt;p&gt;&lt;strong&gt;代码智能不应该只有“便宜但不完整”和“准确但每次很重”两个极端。&lt;/strong&gt;&lt;/p&gt;
&lt;/blockquote&gt;
&lt;p&gt;Tree-sitter / Search 可以一直做便宜、稳定的定位底座。&lt;/p&gt;
&lt;p&gt;Language Server 则应该在真正需要关系完整性的地方，以受限、可复用、可观测的 Runtime 形式出现。&lt;/p&gt;
&lt;p&gt;不是把所有东西都升级成 LSP。&lt;/p&gt;
&lt;p&gt;而是让 Agent 知道：什么时候 Syntax 已经够了，什么时候值得支付 Semantic Cost。&lt;/p&gt;
&lt;p&gt;这应该会是后面 wcode Semantic Runtime 继续扩展其他语言时最重要的一条原则。&lt;/p&gt;
&lt;p&gt;代码：&lt;a href=&#34;https://github.com/francis-du/wcode&#34;&gt;https://github.com/francis-du/wcode&lt;/a&gt;&lt;/p&gt;
&lt;p&gt;文档：&lt;a href=&#34;https://wcode.francis.run/&#34;&gt;https://wcode.francis.run/&lt;/a&gt;&lt;/p&gt;
&lt;p&gt;v0.5.0 Release Notes：&lt;a href=&#34;https://wcode.francis.run/docs/releases/v0.5.0/&#34;&gt;https://wcode.francis.run/docs/releases/v0.5.0/&lt;/a&gt;&lt;/p&gt;
</description>
    </item>
    
    <item>
      <title>wcode v0.4：我开始压 Context 和 Tool Call</title>
      <link>https://francisdu.com/blog/wcode-v0-4/</link>
      <pubDate>Thu, 27 Aug 2026 23:55:00 +0800</pubDate>
      <guid>https://francisdu.com/blog/wcode-v0-4/</guid>
      <description>&lt;p&gt;v0.3 做完以后，wcode 已经有 Design State、Software Graph、Traceability、Risk、Verification、Evidence、Reconciliation 和 Project Observatory。&lt;/p&gt;
&lt;p&gt;从“能力列表”看，其实已经很多了。&lt;/p&gt;
&lt;p&gt;但我拿它真的去写几个项目以后，最明显的问题反而很朴素：Agent 已经知道怎么做了，前面还是花了太多 Context 和 Tool Call。&lt;/p&gt;
&lt;p&gt;所以 v0.4 我先没加新的大能力，主要把写代码这条默认路径重新压了一遍。&lt;/p&gt;
&lt;figure class=&#34;content-image&#34;&gt;&lt;img src=&#34;https://francisdu.com/img/wcode/wcode-tui_hu_13e59e78ee0ce797.webp&#34; alt=&#34;wcode 最新终端实时面板&#34;loading=&#34;lazy&#34; decoding=&#34;async&#34; srcset=&#34;https://francisdu.com/img/wcode/wcode-tui_hu_13e59e78ee0ce797.webp 960w, https://francisdu.com/img/wcode/wcode-tui_hu_6437a17a51f06ca3.webp 1800w&#34; sizes=&#34;(max-width: 900px) calc(100vw - 32px), 900px&#34; width=&#34;3420&#34; height=&#34;2146&#34;&gt;&lt;/figure&gt;&lt;h2 id=&#34;v04-先不加大功能&#34;&gt;v0.4 先不加大功能&lt;a class=&#34;heading-anchor&#34; href=&#34;#v04-%e5%85%88%e4%b8%8d%e5%8a%a0%e5%a4%a7%e5%8a%9f%e8%83%bd&#34; aria-label=&#34;章节链接：v0.4 先不加大功能&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;v0.3 我最关心的是“软件状态能不能留下来”。&lt;/p&gt;
&lt;p&gt;所以那一版的主线是：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Design State
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;   ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Software Graph
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;   ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Drift / Impact / Risk
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;   ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Verification / Evidence
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;   ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Reconciliation
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;这些东西 v0.4 都还在。&lt;/p&gt;
&lt;p&gt;但如果一个 Agent 每次只是改两行代码，也要先完整走一遍 Design、Graph、Traceability、Risk，再查 Symbol、再读文件，那这套系统会越来越像“为了完整而完整”。&lt;/p&gt;
&lt;p&gt;我不想让 Intelligence 本身变成新的 Context Tax。&lt;/p&gt;
&lt;p&gt;所以 v0.4 的默认 Coding Path 变成了：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;agent_context
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;必要时补 symbol_context
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;apply_edits / apply_file_edits
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;review_changes
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;verify_project
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;更深的 Design、Graph、Risk、Reconciliation 还在，但变成按任务需要进入，而不是每次启动都强制付费。&lt;/p&gt;
&lt;h2 id=&#34;agent_context-成了真正的-coding-entry-point&#34;&gt;&lt;code&gt;agent_context&lt;/code&gt; 成了真正的 Coding Entry Point&lt;a class=&#34;heading-anchor&#34; href=&#34;#agent_context-%e6%88%90%e4%ba%86%e7%9c%9f%e6%ad%a3%e7%9a%84-coding-entry-point&#34; aria-label=&#34;章节链接：agent_context 成了真正的 Coding Entry Point&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;这一版我加了一个 Agent Context Compiler。&lt;/p&gt;
&lt;p&gt;它不是简单把几个 Tool Result 拼起来，而是尝试一次返回“现在就可以开始修改”的最小上下文。&lt;/p&gt;
&lt;p&gt;一个典型结果里会有：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;任务相关 Design / Constraint
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Direct Target
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Exact SHA
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Scoped Repo Map
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Related Symbol / Test
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Working-tree Advisory
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Readiness
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Next Actions
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;必要时的 Hot Source
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;我最在意的是最后几个东西。&lt;/p&gt;
&lt;p&gt;以前 Agent 经常出现这种链：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;project_context
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;→ search
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;→ find_symbol
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;→ read_file
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;→ 再 search
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;→ 再 read_file
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;→ edit
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;每一步都合理，但累计起来 Tool Round-trip 很多，而且每次响应都会重新占一部分 Context。&lt;/p&gt;
&lt;p&gt;现在如果任务足够明确，&lt;code&gt;agent_context&lt;/code&gt; 可以直接把最强目标连同 SHA 和一小段 Hot Source 带回来。&lt;/p&gt;
&lt;p&gt;常见的小修改就能变成：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;agent_context → edit
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;这对我来说比“又多支持一个 Tool”有意义得多。&lt;/p&gt;
&lt;h2 id=&#34;context-budget-不应该永远是一个固定数字&#34;&gt;Context Budget 不应该永远是一个固定数字&lt;a class=&#34;heading-anchor&#34; href=&#34;#context-budget-%e4%b8%8d%e5%ba%94%e8%af%a5%e6%b0%b8%e8%bf%9c%e6%98%af%e4%b8%80%e4%b8%aa%e5%9b%ba%e5%ae%9a%e6%95%b0%e5%ad%97&#34; aria-label=&#34;章节链接：Context Budget 不应该永远是一个固定数字&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;以前 &lt;code&gt;software_context&lt;/code&gt; 更像一个固定预算的 Query。&lt;/p&gt;
&lt;p&gt;但真实 Coding Task 差别很大。&lt;/p&gt;
&lt;p&gt;改一个错误文案和改一个跨 Runtime / MCP / Workspace 的安全问题，不应该拿同样大的上下文。&lt;/p&gt;
&lt;p&gt;所以 v0.4 里，&lt;code&gt;agent_context&lt;/code&gt; 在不显式传 Budget 时会做 Adaptive Budget。&lt;/p&gt;
&lt;p&gt;大致思路是：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;明确单点任务
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  → 小 Context
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;目标不确定 / 跨模块
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  → 给更多 Context
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;始终有 Hard Bound
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;这个优化看起来不如 Graph 或 Verification “大”，但 Agent 每一次调用都会碰到它。&lt;/p&gt;
&lt;p&gt;我现在越来越觉得，做 Agent Runtime 不能只优化模型能不能完成任务，还要开始对&lt;strong&gt;每次完成任务花了多少上下文&lt;/strong&gt;负责。&lt;/p&gt;
&lt;h2 id=&#34;repo-map-也不能每次扫完整仓库&#34;&gt;Repo Map 也不能每次扫完整仓库&lt;a class=&#34;heading-anchor&#34; href=&#34;#repo-map-%e4%b9%9f%e4%b8%8d%e8%83%bd%e6%af%8f%e6%ac%a1%e6%89%ab%e5%ae%8c%e6%95%b4%e4%bb%93%e5%ba%93&#34; aria-label=&#34;章节链接：Repo Map 也不能每次扫完整仓库&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;Agent Context 里最容易膨胀的是 Repo Map。&lt;/p&gt;
&lt;p&gt;如果一句任务已经明确属于 &lt;code&gt;workspace&lt;/code&gt; Scope，而且目标文件也很直接，再把 Runtime、UI、Graph、Verification 全仓库结构都送进去没有意义。&lt;/p&gt;
&lt;p&gt;所以现在 Repo Map 有几层变化：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;Scope-aware；&lt;/li&gt;
&lt;li&gt;Cold Build 时尽量只构造相关区域；&lt;/li&gt;
&lt;li&gt;Structure 按 Revision Cache；&lt;/li&gt;
&lt;li&gt;每个 Query 只重算 Ranking；&lt;/li&gt;
&lt;li&gt;多 Query Symbol Search 对一个 Source Root 只扫描一次；&lt;/li&gt;
&lt;li&gt;Fresh Semantic / Runtime Evidence 可以提高相关 Caller / Dependency 排名；&lt;/li&gt;
&lt;li&gt;Semantic Revision 过期以后自动退回 Syntax，不继续拿旧事实指导 Agent。&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;我还把这些东西做了 Telemetry。&lt;/p&gt;
&lt;p&gt;TUI 现在可以看到 Agent Context Calls、平均 Model-visible Token、Repo-map Cache Hit，以及大概省掉了多少 Context。&lt;/p&gt;
&lt;p&gt;不是为了做一个漂亮数字，而是我想以后优化时至少知道自己到底有没有真的减少模型负担。&lt;/p&gt;
&lt;h2 id=&#34;project-observatory-终于先讲架构而不是先讲需求列表&#34;&gt;Project Observatory 终于先讲架构，而不是先讲需求列表&lt;a class=&#34;heading-anchor&#34; href=&#34;#project-observatory-%e7%bb%88%e4%ba%8e%e5%85%88%e8%ae%b2%e6%9e%b6%e6%9e%84%e8%80%8c%e4%b8%8d%e6%98%af%e5%85%88%e8%ae%b2%e9%9c%80%e6%b1%82%e5%88%97%e8%a1%a8&#34; aria-label=&#34;章节链接：Project Observatory 终于先讲架构，而不是先讲需求列表&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;v0.3 的 Project Observatory 已经从“Graph 球图”改成了 Requirement-first。&lt;/p&gt;
&lt;p&gt;到 v0.4 我又改了一次。&lt;/p&gt;
&lt;p&gt;现在进去先看到的是&lt;strong&gt;整体 Component Architecture&lt;/strong&gt;。&lt;/p&gt;
&lt;p&gt;原因也很简单：&lt;/p&gt;
&lt;p&gt;当我要理解一个陌生项目时，我通常第一句不是：&lt;/p&gt;
&lt;blockquote&gt;
&lt;p&gt;这个 Requirement 现在状态怎么样？&lt;/p&gt;
&lt;/blockquote&gt;
&lt;p&gt;而是：&lt;/p&gt;
&lt;blockquote&gt;
&lt;p&gt;这个项目到底分成哪几块，它们怎么依赖？&lt;/p&gt;
&lt;/blockquote&gt;
&lt;p&gt;所以现在 Observatory 会先把 Design 里声明的 Dependency 和代码里真实观测到的 Relationship 叠在一起。&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Design Architecture
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;        +
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Observed Implementation
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;        ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Overlay
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;并且继续保留 Provider / Precision。&lt;/p&gt;
&lt;p&gt;这点我没有妥协：Tree-sitter 没看到某个关系，不等于关系不存在；只有真实 Semantic / Runtime / Deterministic Evidence 才能把某些 Observed Drift 升级成更强的判断。&lt;/p&gt;
&lt;p&gt;UI 里也不再给一个模糊的“Health Score”，而是拆成可以解释的：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;Observed Drift；&lt;/li&gt;
&lt;li&gt;Evidence Coverage；&lt;/li&gt;
&lt;li&gt;Implementation Coverage。&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;我更愿意看到几个不完美但能解释的指标，也不想看到一个 87 分却不知道为什么是 87。&lt;/p&gt;
&lt;h2 id=&#34;我还是不想给-agent-一个-shell但开发命令不能太残废&#34;&gt;我还是不想给 Agent 一个 Shell，但开发命令不能太残废&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e6%88%91%e8%bf%98%e6%98%af%e4%b8%8d%e6%83%b3%e7%bb%99-agent-%e4%b8%80%e4%b8%aa-shell%e4%bd%86%e5%bc%80%e5%8f%91%e5%91%bd%e4%bb%a4%e4%b8%8d%e8%83%bd%e5%a4%aa%e6%ae%8b%e5%ba%9f&#34; aria-label=&#34;章节链接：我还是不想给 Agent 一个 Shell，但开发命令不能太残废&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;wcode 一直坚持 No-shell Boundary。&lt;/p&gt;
&lt;p&gt;但 v0.3 之后我自己使用时也碰到一个现实问题：真正开发不可能永远只有 &lt;code&gt;cargo test&lt;/code&gt; 和 &lt;code&gt;git status&lt;/code&gt;。&lt;/p&gt;
&lt;p&gt;所以 v0.4 扩了很多 Command Policy，不过方向不是“放开命令”，而是&lt;strong&gt;给具体工具写具体策略&lt;/strong&gt;。&lt;/p&gt;
&lt;p&gt;Git 现在可以在精确授权后执行：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;git add &amp;lt;explicit paths&amp;gt;
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;git commit -m &amp;lt;message&amp;gt;
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;git push &amp;lt;remote&amp;gt; &amp;lt;ref&amp;gt;
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;但 Force Push、Delete Ref、Mirror、Reset/Restore 这类形态仍然直接挡掉。&lt;/p&gt;
&lt;p&gt;Push 如果被批准，也只允许通过固定的非交互 SSH 方式使用当前 SSH Agent，不会顺手把 Credential Helper 或 HTTPS Token 暴露给模型。&lt;/p&gt;
&lt;p&gt;&lt;code&gt;gh&lt;/code&gt; 也不是整个二进制一次性放开。&lt;/p&gt;
&lt;p&gt;PR、Issue、Workflow、Release、Merge、Run 都有自己的 bounded shape；&lt;code&gt;gh auth&lt;/code&gt;、&lt;code&gt;gh api&lt;/code&gt;、Secret、Variable、Extension 这些边界仍然封死。&lt;/p&gt;
&lt;p&gt;另外补了不少真实开发里常见的 CLI：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;fd / jq
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;cmake / ninja
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;dotnet / mvn / gradle
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;swift / zig
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;pre-commit / act
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;cargo-nextest
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Git LFS
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;uv / ruff / biome / deno
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;docker / kubectl / terraform
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;我希望最终状态是：&lt;strong&gt;Agent 能正常开发，但“能正常开发”不等于“给它一个 Terminal”。&lt;/strong&gt;&lt;/p&gt;
&lt;h2 id=&#34;tunnel-也不应该因为一个-provider-挂了就不能用&#34;&gt;Tunnel 也不应该因为一个 Provider 挂了就不能用&lt;a class=&#34;heading-anchor&#34; href=&#34;#tunnel-%e4%b9%9f%e4%b8%8d%e5%ba%94%e8%af%a5%e5%9b%a0%e4%b8%ba%e4%b8%80%e4%b8%aa-provider-%e6%8c%82%e4%ba%86%e5%b0%b1%e4%b8%8d%e8%83%bd%e7%94%a8&#34; aria-label=&#34;章节链接：Tunnel 也不应该因为一个 Provider 挂了就不能用&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;wcode 最早的 Remote MCP 默认依赖 Cloudflare Quick Tunnel。&lt;/p&gt;
&lt;p&gt;它很好用，但单 Provider 依赖太脆。&lt;/p&gt;
&lt;p&gt;v0.4 现在的 Auto Path 是：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Cloudflare
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;   ↓ fail / missing
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;localhost.run
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;   ↓ fail
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Pinggy
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;后两个直接走 OpenSSH Reverse Forwarding，不需要为了启动 wcode 再自动安装一个 Tunnel Client。&lt;/p&gt;
&lt;p&gt;而且拿到 Public URL 还不算成功。&lt;/p&gt;
&lt;p&gt;Candidate URL 必须真的访问到&lt;strong&gt;当前这个 wcode Runtime 的 instance-matched &lt;code&gt;/healthz&lt;/code&gt;&lt;/strong&gt;，否则不会被当作可用 Tunnel。&lt;/p&gt;
&lt;p&gt;这解决的是一个很现实的问题：&lt;/p&gt;
&lt;blockquote&gt;
&lt;p&gt;Remote MCP 的网络入口应该是可恢复的基础设施，而不是“某个第三方命令今天能不能跑”。&lt;/p&gt;
&lt;/blockquote&gt;
&lt;h2 id=&#34;这次顺手把几个越来越大的文件拆掉了&#34;&gt;这次顺手把几个越来越大的文件拆掉了&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e8%bf%99%e6%ac%a1%e9%a1%ba%e6%89%8b%e6%8a%8a%e5%87%a0%e4%b8%aa%e8%b6%8a%e6%9d%a5%e8%b6%8a%e5%a4%a7%e7%9a%84%e6%96%87%e4%bb%b6%e6%8b%86%e6%8e%89%e4%ba%86&#34; aria-label=&#34;章节链接：这次顺手把几个越来越大的文件拆掉了&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;做性能和 Agent Context 的过程中，有几个文件又开始长得不太舒服：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;&lt;code&gt;main.rs&lt;/code&gt;；&lt;/li&gt;
&lt;li&gt;&lt;code&gt;harness.rs&lt;/code&gt;；&lt;/li&gt;
&lt;li&gt;Monitor；&lt;/li&gt;
&lt;li&gt;&lt;code&gt;command_policy.rs&lt;/code&gt;。&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;所以 v0.4 也做了一轮责任拆分。&lt;/p&gt;
&lt;p&gt;现在 Tunnel、Harness Profile、Agent Context、Repo Map、Monitor State 都已经单独落文件。&lt;/p&gt;
&lt;p&gt;发版前最后又把 Command Policy 拆成：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;command_policy/
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;├── git.rs
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;├── github.rs
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;├── infrastructure.rs
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;└── dev_tools.rs
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;我没有为了“模块化”去造新的抽象层，主要目的是别让安全策略继续堆在一个 1500 行文件里。&lt;/p&gt;
&lt;p&gt;这类代码最怕两件事：模型每次要读一大坨上下文，以及多人/多 Agent 修改时冲突越来越集中。&lt;/p&gt;
&lt;h2 id=&#34;mcp-自己也补了一次异常隔离&#34;&gt;MCP 自己也补了一次异常隔离&lt;a class=&#34;heading-anchor&#34; href=&#34;#mcp-%e8%87%aa%e5%b7%b1%e4%b9%9f%e8%a1%a5%e4%ba%86%e4%b8%80%e6%ac%a1%e5%bc%82%e5%b8%b8%e9%9a%94%e7%a6%bb&#34; aria-label=&#34;章节链接：MCP 自己也补了一次异常隔离&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;发版前我碰到过一次很典型的问题：多个 Tool 突然一起报 &lt;code&gt;ExceptionGroup: unhandled errors in a TaskGroup&lt;/code&gt;。&lt;/p&gt;
&lt;p&gt;受影响的不只是某一个业务 Tool，&lt;code&gt;workspace_info&lt;/code&gt;、&lt;code&gt;read_file&lt;/code&gt;、&lt;code&gt;run_command&lt;/code&gt;、&lt;code&gt;review_changes&lt;/code&gt; 都会一起失效。&lt;/p&gt;
&lt;p&gt;这个现象说明问题已经不是 Tool 业务逻辑，而是请求隔离边界。&lt;/p&gt;
&lt;p&gt;v0.4 最后补了一层统一的 Request Task Isolation：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;HTTP 单请求独立 Task；&lt;/li&gt;
&lt;li&gt;stdio 单请求独立 Task；&lt;/li&gt;
&lt;li&gt;Child Panic / Cancellation / JoinError 转成正常 JSON-RPC Error；&lt;/li&gt;
&lt;li&gt;Durable MCP Task Worker 的 Child Failure 也落成 Task Failure；&lt;/li&gt;
&lt;li&gt;一个 Child 失败以后，后续独立 Tool 仍然可以继续工作。&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;Release Profile 也不再使用 &lt;code&gt;panic=abort&lt;/code&gt;，否则“捕获一个 Child Panic 并保持 Session 可用”在 Release Binary 里根本做不到。&lt;/p&gt;
&lt;p&gt;这个修复对正常路径没有什么新 UI，但我觉得它很重要：&lt;strong&gt;Tool Failure 应该是一次调用失败，不应该升级成整个 Agent Session 坏掉。&lt;/strong&gt;&lt;/p&gt;
&lt;h2 id=&#34;v04-我会怎么概括&#34;&gt;v0.4 我会怎么概括&lt;a class=&#34;heading-anchor&#34; href=&#34;#v04-%e6%88%91%e4%bc%9a%e6%80%8e%e4%b9%88%e6%a6%82%e6%8b%ac&#34; aria-label=&#34;章节链接：v0.4 我会怎么概括&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;如果 v0.3 是“把软件状态接起来”，v0.4 更像是“让这套状态真正适合每天写代码”。&lt;/p&gt;
&lt;table&gt;
	&lt;thead&gt;
			&lt;tr&gt;
					&lt;th&gt;&lt;/th&gt;
					&lt;th&gt;v0.3&lt;/th&gt;
					&lt;th&gt;v0.4&lt;/th&gt;
			&lt;/tr&gt;
	&lt;/thead&gt;
	&lt;tbody&gt;
			&lt;tr&gt;
					&lt;td&gt;Coding Entry&lt;/td&gt;
					&lt;td&gt;多 Tool 组合&lt;/td&gt;
					&lt;td&gt;&lt;code&gt;agent_context&lt;/code&gt;&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;Context&lt;/td&gt;
					&lt;td&gt;固定/通用&lt;/td&gt;
					&lt;td&gt;Adaptive + Scope-aware&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;Repo Map&lt;/td&gt;
					&lt;td&gt;任务时构建&lt;/td&gt;
					&lt;td&gt;Revision Cache + Query Ranking&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;Source Read&lt;/td&gt;
					&lt;td&gt;多一步读取&lt;/td&gt;
					&lt;td&gt;Direct Match 可带 Hot Source&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;Observatory&lt;/td&gt;
					&lt;td&gt;Requirement-first&lt;/td&gt;
					&lt;td&gt;Architecture-first → Requirement Drill-down&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;Command Policy&lt;/td&gt;
					&lt;td&gt;基础安全命令 + Selective Approval&lt;/td&gt;
					&lt;td&gt;Git/GitHub/Dev CLI 的精确 bounded policy&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;Tunnel&lt;/td&gt;
					&lt;td&gt;Cloudflare 为主&lt;/td&gt;
					&lt;td&gt;Cloudflare → localhost.run → Pinggy&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;Runtime Failure&lt;/td&gt;
					&lt;td&gt;各路径自行处理&lt;/td&gt;
					&lt;td&gt;MCP Request / Child Task Isolation&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;Maintainability&lt;/td&gt;
					&lt;td&gt;拆主 Runtime Cluster&lt;/td&gt;
					&lt;td&gt;继续拆 Agent Context / Tunnel / Monitor / Command Policy&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;Verification&lt;/td&gt;
					&lt;td&gt;Full Gate&lt;/td&gt;
					&lt;td&gt;Full Gate + 文档 EN/ZH parity regression&lt;/td&gt;
			&lt;/tr&gt;
	&lt;/tbody&gt;
&lt;/table&gt;
&lt;p&gt;发版前最后一次本地 Full Gate 是：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;git diff --check                       ✅
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;cargo check --locked                   ✅
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;cargo fmt --check                      ✅
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;cargo test --locked                    ✅ 210 passed
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;cargo clippy --locked -- -D warnings   ✅
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;cargo build --release --locked         ✅
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;Design / Traceability 也还是完整的：Requirement → Component、Design → Implementation、Acceptance → Verification 都是 100%。&lt;/p&gt;
&lt;p&gt;当然，本地绿色只是发版准备；真正的 Release 还是要以 Tagged Revision 和 CI / Release Artifact 为准。&lt;/p&gt;
&lt;h2 id=&#34;最后&#34;&gt;最后&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e6%9c%80%e5%90%8e&#34; aria-label=&#34;章节链接：最后&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;v0.3 的时候我觉得 wcode 真正有意思的地方，是它开始不只关心“代码能不能被 Agent 改”，而是开始关心“软件为什么变成现在这样”。&lt;/p&gt;
&lt;p&gt;v0.4 又让我多了一层判断：&lt;/p&gt;
&lt;blockquote&gt;
&lt;p&gt;&lt;strong&gt;如果这些 Intelligence 每次都让 Agent 付出很高的上下文和工具往返成本，它最终也不会成为默认工作流。&lt;/strong&gt;&lt;/p&gt;
&lt;/blockquote&gt;
&lt;p&gt;所以这一版看起来没有 v0.3 那么像一次产品方向转弯。&lt;/p&gt;
&lt;p&gt;但对我自己每天用它写代码的体验来说，变化反而更直接。&lt;/p&gt;
&lt;p&gt;现在我希望大部分任务都从一句 Goal 开始，拿到一个足够小但能动手的 Context，然后尽快 Edit、Review、Verify。&lt;/p&gt;
&lt;p&gt;复杂任务再把 Graph、Risk、Reconciliation 拉进来。&lt;/p&gt;
&lt;p&gt;不是让 Agent 每次都理解整个软件世界，而是让它&lt;strong&gt;在需要的时候，拿到刚好足够可靠的那部分。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;代码：&lt;a href=&#34;https://github.com/francis-du/wcode&#34;&gt;https://github.com/francis-du/wcode&lt;/a&gt;&lt;/p&gt;
&lt;p&gt;文档：&lt;a href=&#34;https://wcode.francis.run/&#34;&gt;https://wcode.francis.run/&lt;/a&gt;&lt;/p&gt;
</description>
    </item>
    
    <item>
      <title>我把 wcode 写代码这条链又压快了一轮</title>
      <link>https://francisdu.com/blog/wcode-performance/</link>
      <pubDate>Wed, 26 Aug 2026 23:40:00 +0800</pubDate>
      <guid>https://francisdu.com/blog/wcode-performance/</guid>
      <description>&lt;p&gt;最近我拿 wcode 去几个别的项目里实际写代码，最明显的感受不是“功能还缺什么”，而是还不够快。&lt;/p&gt;
&lt;p&gt;这个“慢”很容易全甩给模型。&lt;/p&gt;
&lt;p&gt;但我看了一轮调用链以后，发现里面有不少完全是 Runtime 自己造成的等待。&lt;/p&gt;
&lt;p&gt;模型可能已经知道要改哪几个文件了，结果后面还在重复遍历、重复强制落盘、串行扫描，或者一个一个发 Tool Call。&lt;/p&gt;
&lt;p&gt;这些东西单次看都不大，Agent 连续改几十个文件时就很明显。&lt;/p&gt;
&lt;p&gt;所以这一轮我没有继续加新的 Intelligence 能力，先把写代码的热路径压了一遍。&lt;/p&gt;
&lt;figure class=&#34;content-image&#34;&gt;&lt;img src=&#34;https://francisdu.com/img/wcode/wcode-tui_hu_13e59e78ee0ce797.webp&#34; alt=&#34;wcode 最新终端实时面板&#34;loading=&#34;lazy&#34; decoding=&#34;async&#34; srcset=&#34;https://francisdu.com/img/wcode/wcode-tui_hu_13e59e78ee0ce797.webp 960w, https://francisdu.com/img/wcode/wcode-tui_hu_6437a17a51f06ca3.webp 1800w&#34; sizes=&#34;(max-width: 900px) calc(100vw - 32px), 900px&#34; width=&#34;3420&#34; height=&#34;2146&#34;&gt;&lt;/figure&gt;&lt;h2 id=&#34;第一处每个小编辑都-fsync-太贵了&#34;&gt;第一处：每个小编辑都 &lt;code&gt;fsync&lt;/code&gt; 太贵了&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e7%ac%ac%e4%b8%80%e5%a4%84%e6%af%8f%e4%b8%aa%e5%b0%8f%e7%bc%96%e8%be%91%e9%83%bd-fsync-%e5%a4%aa%e8%b4%b5%e4%ba%86&#34; aria-label=&#34;章节链接：第一处：每个小编辑都 fsync 太贵了&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;wcode 的文件写入一直比较保守。&lt;/p&gt;
&lt;p&gt;已有文件不是原地 &lt;code&gt;truncate&lt;/code&gt;，而是：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;read + verify SHA
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;      ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;create temp file in same directory
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;      ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;write content
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;      ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;atomic replace
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;这个设计我不准备改。&lt;/p&gt;
&lt;p&gt;真正拖速度的是之前为了追求磁盘级耐久性，还会做：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;temp file sync_all
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;rename
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;parent directory sync_all
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;也就是说，一个很小的 &lt;code&gt;apply_edits&lt;/code&gt; 也可能触发两次强制刷盘。&lt;/p&gt;
&lt;p&gt;在本地 SSD 上偶尔看不明显，但到了 macOS APFS、虚拟机、网络盘或者 Windows，一连串小 edit 的 latency 会直接堆起来。&lt;/p&gt;
&lt;p&gt;这里我重新看了 Design State 的约束。&lt;/p&gt;
&lt;p&gt;wcode 真正必须保证的是：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;SHA stale-write protection
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;same-directory atomic replacement
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;create-new cannot overwrite raced target
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;path / symlink / hardlink safety
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;它不是数据库，也没有承诺“每一个 Agent 小编辑在机器突然断电后都必须已经物理落盘”。&lt;/p&gt;
&lt;p&gt;所以现在交互式 Coding Path 去掉了每个小写入的强制 data + directory fsync。&lt;/p&gt;
&lt;p&gt;Atomic Replace 还在。&lt;/p&gt;
&lt;p&gt;这两个概念不要混在一起：&lt;strong&gt;原子性保留了，强制持久化延迟拿掉了。&lt;/strong&gt;&lt;/p&gt;
&lt;h2 id=&#34;第二处project_context-原来有两个串行全仓库扫描&#34;&gt;第二处：&lt;code&gt;project_context&lt;/code&gt; 原来有两个串行全仓库扫描&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e7%ac%ac%e4%ba%8c%e5%a4%84project_context-%e5%8e%9f%e6%9d%a5%e6%9c%89%e4%b8%a4%e4%b8%aa%e4%b8%b2%e8%a1%8c%e5%85%a8%e4%bb%93%e5%ba%93%e6%89%ab%e6%8f%8f&#34; aria-label=&#34;章节链接：第二处：project_context 原来有两个串行全仓库扫描&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;Agent 进入一个新项目以后，我通常希望它先跑 &lt;code&gt;project_context&lt;/code&gt;。&lt;/p&gt;
&lt;p&gt;这里会做不少事情：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;找 Manifest；&lt;/li&gt;
&lt;li&gt;读 Repository Guidance；&lt;/li&gt;
&lt;li&gt;推导 Verification Checks；&lt;/li&gt;
&lt;li&gt;跑 Convention；&lt;/li&gt;
&lt;li&gt;跑 Language Quality Matrix。&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;Profile 本身已经有 Cache。&lt;/p&gt;
&lt;p&gt;但 Convention 和 Language Quality 之前还是串行执行。&lt;/p&gt;
&lt;p&gt;这两个操作都可能扫一遍仓库。&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Convention Scan
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;      ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Language Quality Scan
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;其实它们之间没有数据依赖。&lt;/p&gt;
&lt;p&gt;现在直接 &lt;code&gt;rayon::join&lt;/code&gt;：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;        ┌─ Convention Scan
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;context ┤
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;        └─ Language Quality Scan
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;结果语义不变，但大仓库第一次进入时的 wall-clock 更合理。&lt;/p&gt;
&lt;h2 id=&#34;第三处搜索不应该先收集完整文件列表&#34;&gt;第三处：搜索不应该先收集完整文件列表&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e7%ac%ac%e4%b8%89%e5%a4%84%e6%90%9c%e7%b4%a2%e4%b8%8d%e5%ba%94%e8%af%a5%e5%85%88%e6%94%b6%e9%9b%86%e5%ae%8c%e6%95%b4%e6%96%87%e4%bb%b6%e5%88%97%e8%a1%a8&#34; aria-label=&#34;章节链接：第三处：搜索不应该先收集完整文件列表&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;以前 &lt;code&gt;search_code/search_many&lt;/code&gt; 的逻辑大致是：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;WalkDir 整个目录
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;      ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;收集 Vec&amp;lt;PathBuf&amp;gt;
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;      ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Rayon 并行读文件
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;      ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;搜索
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;这意味着哪怕我要的前几十条结果很快就能找到，也要先把目录完整走完并分配一个 Path Vec。&lt;/p&gt;
&lt;p&gt;现在改成了边遍历边送给 Rayon Worker：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;WalkDir → par_bridge → read/search
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;一旦结果数量够了，后续 Worker 可以尽早退出。&lt;/p&gt;
&lt;p&gt;大仓库里这类改动比在小 Fixture 上测出来的数字更有意义。&lt;/p&gt;
&lt;h2 id=&#34;第四处同文件多个-edit-不应该重复建-line-index&#34;&gt;第四处：同文件多个 Edit 不应该重复建 Line Index&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e7%ac%ac%e5%9b%9b%e5%a4%84%e5%90%8c%e6%96%87%e4%bb%b6%e5%a4%9a%e4%b8%aa-edit-%e4%b8%8d%e5%ba%94%e8%af%a5%e9%87%8d%e5%a4%8d%e5%bb%ba-line-index&#34; aria-label=&#34;章节链接：第四处：同文件多个 Edit 不应该重复建 Line Index&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;&lt;code&gt;apply_edits&lt;/code&gt; 支持一次对同一个原始 SHA 做多处编辑。&lt;/p&gt;
&lt;p&gt;如果每个 Edit 都带 &lt;code&gt;start_line/end_line&lt;/code&gt;，以前每一条都会重新遍历整份内容去算行首 Byte Offset。&lt;/p&gt;
&lt;p&gt;也就是 N 个 Edit，可能做 N 次 Line Scan。&lt;/p&gt;
&lt;p&gt;现在只要这一批里有人用了 Line Bound，就先建一次 Line Start Index，所有 Edit 共享。&lt;/p&gt;
&lt;p&gt;对于几千行文件一次改很多位置，这属于很便宜但应该做的优化。&lt;/p&gt;
&lt;h2 id=&#34;第五处read_file-不需要为整份文件保存-vecstr&#34;&gt;第五处：&lt;code&gt;read_file&lt;/code&gt; 不需要为整份文件保存 &lt;code&gt;Vec&amp;lt;&amp;amp;str&amp;gt;&lt;/code&gt;&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e7%ac%ac%e4%ba%94%e5%a4%84read_file-%e4%b8%8d%e9%9c%80%e8%a6%81%e4%b8%ba%e6%95%b4%e4%bb%bd%e6%96%87%e4%bb%b6%e4%bf%9d%e5%ad%98-vecstr&#34; aria-label=&#34;章节链接：第五处：read_file 不需要为整份文件保存 Vec&amp;lt;&amp;amp;str&amp;gt;&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;读取工具有 1 MiB 上限，所以以前直接：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-rust&#34; data-lang=&#34;rust&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;&lt;span style=&#34;color:#00f&#34;&gt;let&lt;/span&gt; lines: Vec&amp;lt;&amp;amp;&lt;span style=&#34;color:#2b91af&#34;&gt;str&lt;/span&gt;&amp;gt; = content.lines().collect();
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;功能完全没问题。&lt;/p&gt;
&lt;p&gt;但 Agent 大多数时候只拿 100～500 行。&lt;/p&gt;
&lt;p&gt;现在先算总行数，再只对需要返回的 Range 做 &lt;code&gt;skip/take&lt;/code&gt;。&lt;/p&gt;
&lt;p&gt;不是一个惊人的 Benchmark，但这是典型的 Runtime Hot Path：每一次都跑，能少一次完整分配就少一次。&lt;/p&gt;
&lt;h2 id=&#34;第六处默认并行度再往上提&#34;&gt;第六处：默认并行度再往上提&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e7%ac%ac%e5%85%ad%e5%a4%84%e9%bb%98%e8%ae%a4%e5%b9%b6%e8%a1%8c%e5%ba%a6%e5%86%8d%e5%be%80%e4%b8%8a%e6%8f%90&#34; aria-label=&#34;章节链接：第六处：默认并行度再往上提&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;之前默认值是：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;logical CPU × 8
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;clamp 64..128
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;现在改成：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;logical CPU × 12
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;clamp 96..192
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;Harness 的硬上限仍然是 256，CLI 还是可以显式：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-bash&#34; data-lang=&#34;bash&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;wcode -j 256
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;为什么不直接默认 256？&lt;/p&gt;
&lt;p&gt;因为这个 Semaphore 不只有小文件 IO，还会承载一部分 CPU 和外部进程任务。&lt;/p&gt;
&lt;p&gt;我希望默认更激进，但不是把所有机器都当成 32 核工作站。&lt;/p&gt;
&lt;p&gt;8 核现在默认 96，10 核 120，16 核及以上最多到 192。&lt;/p&gt;
&lt;p&gt;这个档位更适合 Agent 一次并行导航和修改多个文件。&lt;/p&gt;
&lt;h2 id=&#34;第七处连统计响应有多大也不该复制整份-json&#34;&gt;第七处：连“统计响应有多大”也不该复制整份 JSON&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e7%ac%ac%e4%b8%83%e5%a4%84%e8%bf%9e%e7%bb%9f%e8%ae%a1%e5%93%8d%e5%ba%94%e6%9c%89%e5%a4%9a%e5%a4%a7%e4%b9%9f%e4%b8%8d%e8%af%a5%e5%a4%8d%e5%88%b6%e6%95%b4%e4%bb%bd-json&#34; aria-label=&#34;章节链接：第七处：连“统计响应有多大”也不该复制整份 JSON&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;TUI 会展示请求、响应和 Token Economy，所以 Tool Runtime 要知道每次调用大概传了多少字节。&lt;/p&gt;
&lt;p&gt;以前这个指标是这样算的：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Value
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;serde_json::to_vec
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;拿 Vec.len()
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Vec 丢掉
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;也就是说，真正响应以后，为了统计长度又临时分配并序列化了一份 JSON。&lt;/p&gt;
&lt;p&gt;小结果没什么感觉，但 &lt;code&gt;parallel_tools&lt;/code&gt;、Graph、Project Context 这类 &lt;code&gt;structuredContent&lt;/code&gt; 大时，这就是纯粹的额外内存和 CPU。&lt;/p&gt;
&lt;p&gt;现在改成一个只实现 &lt;code&gt;Write&lt;/code&gt; 的 Byte Counter，让 &lt;code&gt;serde_json::to_writer&lt;/code&gt; 流过去，只累加字节数，不保存第二份 Buffer。&lt;/p&gt;
&lt;p&gt;协议内容完全不变，Monitor 指标也不变，但每个 Tool Call 少一次只为计数存在的临时分配。&lt;/p&gt;
&lt;h2 id=&#34;单个函数快了还不够&#34;&gt;单个函数快了还不够&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e5%8d%95%e4%b8%aa%e5%87%bd%e6%95%b0%e5%bf%ab%e4%ba%86%e8%bf%98%e4%b8%8d%e5%a4%9f&#34; aria-label=&#34;章节链接：单个函数快了还不够&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;Runtime 再快，如果 Agent 还是：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;read A
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;edit A
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;read B
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;edit B
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;read C
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;edit C
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;MCP Round Trip 一样会浪费很多时间。&lt;/p&gt;
&lt;p&gt;所以 Project Context 的 Workflow 现在会明确提示：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;同文件多个修改 → apply_edits
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;多个已知现有文件 → apply_file_edits
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;多个新文件 → create_files
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;已知互不依赖的任务 → parallel_tools
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;一次遍历能解决 → search_many / read_files
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;我越来越觉得 Tool Harness 的性能不是单个函数跑多快。&lt;/p&gt;
&lt;p&gt;它至少有三层：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;模型要不要一次提出足够完整的操作
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;            ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Tool Runtime 能不能批量/并行调度
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;            ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;底层文件和索引操作有没有多余工作
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;只优化最后一层，体感还是会卡。&lt;/p&gt;
&lt;h2 id=&#34;安全检查没有为了速度删掉&#34;&gt;安全检查没有为了速度删掉&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e5%ae%89%e5%85%a8%e6%a3%80%e6%9f%a5%e6%b2%a1%e6%9c%89%e4%b8%ba%e4%ba%86%e9%80%9f%e5%ba%a6%e5%88%a0%e6%8e%89&#34; aria-label=&#34;章节链接：安全检查没有为了速度删掉&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;性能优化最容易走到另一个极端：觉得 &lt;code&gt;canonicalize&lt;/code&gt;、SHA、Symlink Check、Lock 都贵，干脆少查一点。&lt;/p&gt;
&lt;p&gt;这轮我没有这么做。&lt;/p&gt;
&lt;p&gt;保留的边界包括：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;Workspace Root；&lt;/li&gt;
&lt;li&gt;Protected Path；&lt;/li&gt;
&lt;li&gt;Parent Traversal；&lt;/li&gt;
&lt;li&gt;Symlink Component；&lt;/li&gt;
&lt;li&gt;Unix Hard Link Write；&lt;/li&gt;
&lt;li&gt;SHA-256 stale revision；&lt;/li&gt;
&lt;li&gt;写锁后的路径重新解析；&lt;/li&gt;
&lt;li&gt;Atomic Replace；&lt;/li&gt;
&lt;li&gt;No-shell Command；&lt;/li&gt;
&lt;li&gt;Pending Authorization。&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;我拿掉的是重复工作和不必要的同步，不是安全模型。&lt;/p&gt;
&lt;h2 id=&#34;现在还剩什么可以继续优化&#34;&gt;现在还剩什么可以继续优化&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e7%8e%b0%e5%9c%a8%e8%bf%98%e5%89%a9%e4%bb%80%e4%b9%88%e5%8f%af%e4%bb%a5%e7%bb%a7%e7%bb%ad%e4%bc%98%e5%8c%96&#34; aria-label=&#34;章节链接：现在还剩什么可以继续优化&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;这一轮之后，我觉得还有几块值得继续盯：&lt;/p&gt;
&lt;ol&gt;
&lt;li&gt;&lt;code&gt;project_context&lt;/code&gt; 的两个仓库扫描虽然并行了，但未来最好共享一次 File Inventory，而不是各走一遍目录。&lt;/li&gt;
&lt;li&gt;MCP Tool Result 为兼容 &lt;code&gt;content + structuredContent&lt;/code&gt; 本身仍会保留两种表示；这和已经去掉的“仅为统计字节数再序列化一次”不是一回事，大结果仍有进一步优化空间。&lt;/li&gt;
&lt;li&gt;Software Graph 第一次建立时，Language/Tree-sitter Parser 初始化和目录候选选择还可以继续做更细的缓存。&lt;/li&gt;
&lt;li&gt;Monitor 的指标必须保持便宜，不能为了展示吞吐量反过来拖 Tool Call。&lt;/li&gt;
&lt;li&gt;多 Workspace 同时工作时，需要继续观察 Rayon、Tokio &lt;code&gt;spawn_blocking&lt;/code&gt; 和全局 Semaphore 三层调度会不会互相争资源。&lt;/li&gt;
&lt;/ol&gt;
&lt;p&gt;我不准备为了追一个漂亮 Benchmark 把这些全部一次性复杂化。&lt;/p&gt;
&lt;p&gt;我现在还是拿真实项目当标准：哪一步明显在等，就把那一步拆出来。&lt;/p&gt;
&lt;p&gt;这也是我现在优化 wcode 的方式。&lt;/p&gt;
&lt;p&gt;v0.3 的整体变化见 &lt;a href=&#34;https://francisdu.com/blog/wcode-v0-3/&#34;&gt;wcode v0.3：从本地代码桥到 Software Intelligence Runtime&lt;/a&gt;。&lt;/p&gt;
</description>
    </item>
    
    <item>
      <title>wcode v0.3：它已经不只是一个 MCP Bridge 了</title>
      <link>https://francisdu.com/blog/wcode-v0-3/</link>
      <pubDate>Wed, 26 Aug 2026 23:30:00 +0800</pubDate>
      <guid>https://francisdu.com/blog/wcode-v0-3/</guid>
      <description>&lt;p&gt;wcode 的 v0.3 是一次比较明显的方向变化。&lt;/p&gt;
&lt;p&gt;v0.2 发布时，我给它的定位还很简单：一个轻量的 Code Agent plugin，把已经在用的 AI Client 接到本地仓库。&lt;/p&gt;
&lt;p&gt;这个定位没有消失。Remote MCP、OAuth、Workspace、Tree-sitter、代码读写、Git Review 和 Verification 这些底层能力都还在。&lt;/p&gt;
&lt;p&gt;但如果只看 v0.3 的代码和界面，它已经不太像一个“桥”了。&lt;/p&gt;
&lt;p&gt;到 v0.3，我已经不太把它当成一个单纯的“桥”了。模型还是写代码，wcode 开始额外保存设计、变化、风险和验证这些仓库状态。&lt;/p&gt;
&lt;figure class=&#34;content-image&#34;&gt;&lt;img src=&#34;https://francisdu.com/img/wcode/wcode-tui_hu_13e59e78ee0ce797.webp&#34; alt=&#34;wcode 最新终端实时面板&#34;loading=&#34;lazy&#34; decoding=&#34;async&#34; srcset=&#34;https://francisdu.com/img/wcode/wcode-tui_hu_13e59e78ee0ce797.webp 960w, https://francisdu.com/img/wcode/wcode-tui_hu_6437a17a51f06ca3.webp 1800w&#34; sizes=&#34;(max-width: 900px) calc(100vw - 32px), 900px&#34; width=&#34;3420&#34; height=&#34;2146&#34;&gt;&lt;/figure&gt;&lt;h2 id=&#34;v02-当时解决了什么&#34;&gt;v0.2 当时解决了什么&lt;a class=&#34;heading-anchor&#34; href=&#34;#v02-%e5%bd%93%e6%97%b6%e8%a7%a3%e5%86%b3%e4%ba%86%e4%bb%80%e4%b9%88&#34; aria-label=&#34;章节链接：v0.2 当时解决了什么&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;我重新看了一遍 &lt;code&gt;v0.2&lt;/code&gt; Tag 里的 README。&lt;/p&gt;
&lt;p&gt;当时的主线非常明确：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;AI Client
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;   │
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;   │ Remote MCP + OAuth
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;   ▼
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;wcode
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;   │
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;   ├─ search
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;   ├─ symbols
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;   ├─ read / edit
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;   ├─ project context
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;   ├─ git review
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;   └─ verification
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;   │
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;   ▼
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;configured workspace roots
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;一句话就是：&lt;strong&gt;不要再造一个 Agent，把本地代码能力安全地提供给现有 Agent。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;v0.2 已经有不少我现在仍然很看重的基础：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;一个 Rust 原生二进制；&lt;/li&gt;
&lt;li&gt;Remote MCP + OAuth 2.1 / PKCE；&lt;/li&gt;
&lt;li&gt;Cloudflare Quick Tunnel；&lt;/li&gt;
&lt;li&gt;多客户端接入；&lt;/li&gt;
&lt;li&gt;Workspace Root 隔离；&lt;/li&gt;
&lt;li&gt;Tree-sitter Symbol Navigation；&lt;/li&gt;
&lt;li&gt;SHA-256 Guarded Edit；&lt;/li&gt;
&lt;li&gt;Git-aware Review；&lt;/li&gt;
&lt;li&gt;有界并发和实时 TUI。&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;但它回答的主要还是：&lt;/p&gt;
&lt;blockquote&gt;
&lt;p&gt;模型怎么安全地碰本地代码？&lt;/p&gt;
&lt;/blockquote&gt;
&lt;p&gt;v0.3 想回答的问题已经变成：&lt;/p&gt;
&lt;blockquote&gt;
&lt;p&gt;多个模型、人和工具不断修改一个项目以后，怎么还知道这个软件为什么是现在这样？&lt;/p&gt;
&lt;/blockquote&gt;
&lt;h2 id=&#34;这版我先把-design-state-接进来了&#34;&gt;这版我先把 Design State 接进来了&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e8%bf%99%e7%89%88%e6%88%91%e5%85%88%e6%8a%8a-design-state-%e6%8e%a5%e8%bf%9b%e6%9d%a5%e4%ba%86&#34; aria-label=&#34;章节链接：这版我先把 Design State 接进来了&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;v0.3 里最重要的东西不是某个新 Tool，而是 &lt;code&gt;.wcode&lt;/code&gt; Design State。&lt;/p&gt;
&lt;p&gt;它把长期应该稳定存在的意图放进仓库：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Requirement
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Component
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Constraint
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Acceptance Criterion
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Decision
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;这些东西不是 Markdown 里的描述，而是带稳定 ID 和关系的结构化 Desired State。&lt;/p&gt;
&lt;p&gt;于是一个功能可以真的形成链路：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Requirement
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Component responsibility
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;File / Symbol
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Acceptance Criterion
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Test / Verification
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;这也是为什么 v0.3 之后，wcode 不再只是给模型提供 &lt;code&gt;read_file&lt;/code&gt; / &lt;code&gt;apply_edits&lt;/code&gt;。&lt;/p&gt;
&lt;p&gt;Agent 可以先从需求和设计开始理解，再落到代码。&lt;/p&gt;
&lt;h2 id=&#34;product-scope-把大仓库重新分区&#34;&gt;Product Scope 把大仓库重新分区&lt;a class=&#34;heading-anchor&#34; href=&#34;#product-scope-%e6%8a%8a%e5%a4%a7%e4%bb%93%e5%ba%93%e9%87%8d%e6%96%b0%e5%88%86%e5%8c%ba&#34; aria-label=&#34;章节链接：Product Scope 把大仓库重新分区&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;只做 Design State 还不够。&lt;/p&gt;
&lt;p&gt;仓库一大，Agent 还是很容易把整个项目看成一个平面目录。&lt;/p&gt;
&lt;p&gt;所以 v0.3 有了 canonical Product Scope Registry：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;runtime
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;integrations
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;workspace
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;design
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;graph
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;semantics
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;traceability
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;risk
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;verification
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;evidence
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;reconciliation
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;experience
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;它同时参与源码架构分类、&lt;code&gt;scope_status&lt;/code&gt;、&lt;code&gt;software_context&lt;/code&gt;、MCP Tool Metadata 和 Agent Workflow。&lt;/p&gt;
&lt;p&gt;我现在给 Agent 一个任务时，可以先确定它属于哪个 Product Scope，再缩小上下文。&lt;/p&gt;
&lt;p&gt;这比“先 grep 全仓库再说”稳定很多。&lt;/p&gt;
&lt;h2 id=&#34;software-graph-不再只是一个索引&#34;&gt;Software Graph 不再只是一个索引&lt;a class=&#34;heading-anchor&#34; href=&#34;#software-graph-%e4%b8%8d%e5%86%8d%e5%8f%aa%e6%98%af%e4%b8%80%e4%b8%aa%e7%b4%a2%e5%bc%95&#34; aria-label=&#34;章节链接：Software Graph 不再只是一个索引&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;Tree-sitter 仍然是 always-on 的语法底座，但 v0.3 把 Graph 扩成了可以混合多种 Provenance 的 Software Digital Twin。&lt;/p&gt;
&lt;p&gt;基础事实仍明确标注：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;provider = tree-sitter
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;precision = syntax
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;如果真实 Language Server 返回 Document Symbol、Call Hierarchy 或 Implementation，才会进入 semantic precision。&lt;/p&gt;
&lt;p&gt;外部 SCIP / Compiler / Runtime Provider 也可以进入同一张 Graph，但每条关系都保留自己的 Provider、Precision 和 Revision。&lt;/p&gt;
&lt;p&gt;Graph 现在还会保留 meaningful revision history，可以看节点和关系到底怎么变，而不是只看当前快照。&lt;/p&gt;
&lt;h2 id=&#34;v03-的主界面不是-graph-球图&#34;&gt;v0.3 的主界面不是 Graph 球图&lt;a class=&#34;heading-anchor&#34; href=&#34;#v03-%e7%9a%84%e4%b8%bb%e7%95%8c%e9%9d%a2%e4%b8%8d%e6%98%af-graph-%e7%90%83%e5%9b%be&#34; aria-label=&#34;章节链接：v0.3 的主界面不是 Graph 球图&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;我做过一版能拖、能缩放的 Graph Canvas。&lt;/p&gt;
&lt;p&gt;后来删掉主视图了。&lt;/p&gt;
&lt;p&gt;不是 Graph 没用了，而是“看一团节点”不是我真正想解决的问题。&lt;/p&gt;
&lt;p&gt;现在 WebUI 是 requirement-first 的 &lt;strong&gt;Project Observatory&lt;/strong&gt;：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Desired State
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Actual State
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Change
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Proof
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Convergence
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;一个 Requirement 下面可以直接看到：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;功能意图；&lt;/li&gt;
&lt;li&gt;Component 责任和声明依赖；&lt;/li&gt;
&lt;li&gt;当前真实实现；&lt;/li&gt;
&lt;li&gt;Acceptance / Verification；&lt;/li&gt;
&lt;li&gt;Constraint / ADR；&lt;/li&gt;
&lt;li&gt;当前 Git Change；&lt;/li&gt;
&lt;li&gt;Evidence；&lt;/li&gt;
&lt;li&gt;Convergence Blocker；&lt;/li&gt;
&lt;li&gt;Graph Revision。&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;TUI 按 &lt;code&gt;W&lt;/code&gt; 会直接打开当前焦点 Workspace 的 Project Observatory。&lt;/p&gt;
&lt;h2 id=&#34;verification-从跑过测试变成-evidence&#34;&gt;Verification 从“跑过测试”变成 Evidence&lt;a class=&#34;heading-anchor&#34; href=&#34;#verification-%e4%bb%8e%e8%b7%91%e8%bf%87%e6%b5%8b%e8%af%95%e5%8f%98%e6%88%90-evidence&#34; aria-label=&#34;章节链接：Verification 从“跑过测试”变成 Evidence&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;v0.2 已经有 &lt;code&gt;verify_project&lt;/code&gt;。&lt;/p&gt;
&lt;p&gt;v0.3 里 Verification 的变化，不是多跑几个命令，而是&lt;strong&gt;结果开始有身份和 Revision&lt;/strong&gt;。&lt;/p&gt;
&lt;p&gt;现在可以记录：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;谁产生的 Evidence
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;针对哪个 Code Revision
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;针对哪个 Design Revision
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;使用什么 Policy
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;结果是 Pass / Fail / Disagree / Inconclusive
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;Property、Mutation、Fuzz、Runtime Canary、Blind Reviewer 和 Human Approval 也进入同一套 Verification Mesh。&lt;/p&gt;
&lt;p&gt;最重要的是：新的 Pass 不会把另一个 Producer 的 Fail 擦掉。&lt;/p&gt;
&lt;p&gt;分歧就是 Evidence，而不是需要被 UI 平均掉的噪音。&lt;/p&gt;
&lt;h2 id=&#34;reconciliation-把一次聊天变成可继续的状态&#34;&gt;Reconciliation 把“一次聊天”变成可继续的状态&lt;a class=&#34;heading-anchor&#34; href=&#34;#reconciliation-%e6%8a%8a%e4%b8%80%e6%ac%a1%e8%81%8a%e5%a4%a9%e5%8f%98%e6%88%90%e5%8f%af%e7%bb%a7%e7%bb%ad%e7%9a%84%e7%8a%b6%e6%80%81&#34; aria-label=&#34;章节链接：Reconciliation 把“一次聊天”变成可继续的状态&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;v0.2 的典型开发闭环更像：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;read → edit → test → done
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;v0.3 开始把“什么时候真的算 done”做成显式状态。&lt;/p&gt;
&lt;p&gt;Reconciliation Plan 会把 Drift、Impact、Risk、Implementation 和 Verification Requirement 组织成有依赖的任务。&lt;/p&gt;
&lt;p&gt;这些任务可以 Claim、Submit、Retry，并且持久化。&lt;/p&gt;
&lt;p&gt;所以一个模型写代码、另一个模型 Review、第三个模型补测试，不需要共享同一个聊天上下文。&lt;/p&gt;
&lt;p&gt;它们面对的是同一个软件状态和同一组 Evidence。&lt;/p&gt;
&lt;h2 id=&#34;workspace-权限也比-v02-更细&#34;&gt;Workspace 权限也比 v0.2 更细&lt;a class=&#34;heading-anchor&#34; href=&#34;#workspace-%e6%9d%83%e9%99%90%e4%b9%9f%e6%af%94-v02-%e6%9b%b4%e7%bb%86&#34; aria-label=&#34;章节链接：Workspace 权限也比 v0.2 更细&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;v0.2 的安全模型已经强调：不给模型一个 Shell。&lt;/p&gt;
&lt;p&gt;v0.3 继续保留这个原则，但授权粒度细了很多。&lt;/p&gt;
&lt;p&gt;现在模型如果请求一个还没有授权的裸可执行程序，例如：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;hugo
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;flutter
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;deno
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;mvn
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;gradle
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;wcode 不会因为它不在默认列表里直接永久拒绝，而是生成一个当前 Workspace 的 &lt;code&gt;CommandAccess&lt;/code&gt; Pending Request。&lt;/p&gt;
&lt;p&gt;TUI 会显示待授权列表：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;↑/↓ 选择
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Y    批准当前请求
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;N    拒绝当前请求
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;Project Observatory 的 Access Panel 也能处理同一批 Pending Request，并管理 Workspace 和已授权命令。&lt;/p&gt;
&lt;p&gt;批准的是&lt;strong&gt;这个 Workspace 的这个 Program&lt;/strong&gt;，不是开放一个 Shell。&lt;/p&gt;
&lt;p&gt;&lt;code&gt;bash&lt;/code&gt;、&lt;code&gt;sh&lt;/code&gt;、&lt;code&gt;pwsh&lt;/code&gt;、&lt;code&gt;cmd&lt;/code&gt; 这类 Shell Interpreter，以及带路径的 Program Name，仍然是硬边界。&lt;/p&gt;
&lt;p&gt;Repository-aware Argument 还可能再触发单独的 &lt;code&gt;RiskyExecution&lt;/code&gt; 授权。&lt;/p&gt;
&lt;p&gt;删除则仍然更严格：exact one-shot。&lt;/p&gt;
&lt;h2 id=&#34;并发和写入也做了实际性能优化&#34;&gt;并发和写入也做了实际性能优化&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e5%b9%b6%e5%8f%91%e5%92%8c%e5%86%99%e5%85%a5%e4%b9%9f%e5%81%9a%e4%ba%86%e5%ae%9e%e9%99%85%e6%80%a7%e8%83%bd%e4%bc%98%e5%8c%96&#34; aria-label=&#34;章节链接：并发和写入也做了实际性能优化&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;v0.2 已经支持有界并发，但 v0.3 的 Scheduler 已经可以理解 Read / Write / Create / Move / Delete 的路径冲突。&lt;/p&gt;
&lt;p&gt;当前默认全局并行度调整成：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;logical CPU × 12
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;clamp 96..192
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;hard max 256
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;同一个文件的多个 &lt;code&gt;apply_edits&lt;/code&gt; 如果 SHA 相同、Range 不冲突，可以先合并再提交。&lt;/p&gt;
&lt;p&gt;另外这次还专门处理了我在真实项目里感觉到的“写代码还是慢”：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;交互式小文件写入保留同目录临时文件 + atomic replace，但不再每次都强制 data fsync + directory fsync；&lt;/li&gt;
&lt;li&gt;&lt;code&gt;project_context&lt;/code&gt; 的 Convention Scan 和 Language Quality Scan 并行执行；&lt;/li&gt;
&lt;li&gt;&lt;code&gt;search_code/search_many&lt;/code&gt; 改成目录遍历过程中直接进入并行搜索，不再先收集完整文件列表；&lt;/li&gt;
&lt;li&gt;多 Edit 共享一次 Line Index；&lt;/li&gt;
&lt;li&gt;&lt;code&gt;read_file&lt;/code&gt; 不再先给整个文件分配一份 Line Vector；&lt;/li&gt;
&lt;li&gt;Project Context 会明确让 Agent 优先用 &lt;code&gt;apply_file_edits&lt;/code&gt; / &lt;code&gt;create_files&lt;/code&gt; 做批量写入。&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;安全边界没有因为这些优化被拿掉：SHA、Atomic Replace、Path Isolation、Symlink / Hardlink、Protected Path 仍然存在。&lt;/p&gt;
&lt;h2 id=&#34;v02--v03我会怎么概括&#34;&gt;v0.2 → v0.3，我会怎么概括&lt;a class=&#34;heading-anchor&#34; href=&#34;#v02--v03%e6%88%91%e4%bc%9a%e6%80%8e%e4%b9%88%e6%a6%82%e6%8b%ac&#34; aria-label=&#34;章节链接：v0.2 → v0.3，我会怎么概括&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;如果只留一张表，大概是这样：&lt;/p&gt;
&lt;table&gt;
	&lt;thead&gt;
			&lt;tr&gt;
					&lt;th&gt;&lt;/th&gt;
					&lt;th&gt;v0.2&lt;/th&gt;
					&lt;th&gt;v0.3&lt;/th&gt;
			&lt;/tr&gt;
	&lt;/thead&gt;
	&lt;tbody&gt;
			&lt;tr&gt;
					&lt;td&gt;产品中心&lt;/td&gt;
					&lt;td&gt;Local Code Bridge&lt;/td&gt;
					&lt;td&gt;Software Intelligence Runtime&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;模型关系&lt;/td&gt;
					&lt;td&gt;给现有 Agent 本地工具&lt;/td&gt;
					&lt;td&gt;模型是可替换 Builder / Reviewer&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;Desired State&lt;/td&gt;
					&lt;td&gt;无&lt;/td&gt;
					&lt;td&gt;Design State&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;源码边界&lt;/td&gt;
					&lt;td&gt;Workspace&lt;/td&gt;
					&lt;td&gt;Workspace + Product Scope&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;Code Intelligence&lt;/td&gt;
					&lt;td&gt;Tree-sitter Symbol&lt;/td&gt;
					&lt;td&gt;Composite Software Graph + Provider Provenance&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;改动理解&lt;/td&gt;
					&lt;td&gt;Git Review&lt;/td&gt;
					&lt;td&gt;Drift + Impact + Risk&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;验证&lt;/td&gt;
					&lt;td&gt;Project-native checks&lt;/td&gt;
					&lt;td&gt;Verification Mesh + Revision-exact Evidence&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;长任务&lt;/td&gt;
					&lt;td&gt;普通 Tool Call&lt;/td&gt;
					&lt;td&gt;MCP 2026 Durable Tasks&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;完成状态&lt;/td&gt;
					&lt;td&gt;一次调用结束&lt;/td&gt;
					&lt;td&gt;Reconciliation / Convergence&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;UI&lt;/td&gt;
					&lt;td&gt;TUI + Setup Hub&lt;/td&gt;
					&lt;td&gt;TUI + Setup Hub + Project Observatory&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;授权&lt;/td&gt;
					&lt;td&gt;粗粒度 Trust Flag&lt;/td&gt;
					&lt;td&gt;Pending Request + TUI/WebUI selective approval&lt;/td&gt;
			&lt;/tr&gt;
	&lt;/tbody&gt;
&lt;/table&gt;
&lt;p&gt;v0.2 解决的是“把 AI 接进来”。&lt;/p&gt;
&lt;p&gt;v0.3 更像是在回答：“接进来以后，怎么让这个项目长期不失控。”&lt;/p&gt;
&lt;p&gt;我现在觉得这才是 wcode 真正有意思的方向。&lt;/p&gt;
&lt;p&gt;相关实现细节可以继续看 &lt;a href=&#34;https://francisdu.com/blog/wcode-2026/&#34;&gt;wcode 最近做成什么样了&lt;/a&gt;、&lt;a href=&#34;https://francisdu.com/blog/wcode-design-state/&#34;&gt;Design State&lt;/a&gt;、&lt;a href=&#34;https://francisdu.com/blog/wcode-verification/&#34;&gt;Verification&lt;/a&gt;、&lt;a href=&#34;https://francisdu.com/blog/wcode-authorization/&#34;&gt;授权中心&lt;/a&gt; 和 &lt;a href=&#34;https://francisdu.com/blog/wcode-security/&#34;&gt;Security&lt;/a&gt;。&lt;/p&gt;
&lt;p&gt;后续的写代码热路径、Agent Context、Architecture-first Observatory 和精确命令策略，继续写在 &lt;a href=&#34;https://francisdu.com/blog/wcode-v0-4/&#34;&gt;wcode v0.4：开始为 Agent 的上下文成本负责&lt;/a&gt;。&lt;/p&gt;
</description>
    </item>
    
    <item>
      <title>wcode：我还是不想给 Agent 一个 Shell</title>
      <link>https://francisdu.com/blog/wcode-security/</link>
      <pubDate>Wed, 26 Aug 2026 03:17:00 +0800</pubDate>
      <guid>https://francisdu.com/blog/wcode-security/</guid>
      <description>&lt;p&gt;wcode 第一版里，我花时间最多的其实不是 MCP。&lt;/p&gt;
&lt;p&gt;是 Workspace。&lt;/p&gt;
&lt;p&gt;因为把模型接到本地仓库以后，最危险的从来不是它看错一个函数，而是 Tool Runtime 的边界没守住。&lt;/p&gt;
&lt;p&gt;上层现在已经有 Design State、Graph、Reconciliation、Verification，复杂了很多。但越往上加东西，我越不想动底下这几条线。&lt;/p&gt;
&lt;figure class=&#34;content-image&#34;&gt;&lt;img src=&#34;https://francisdu.com/img/wcode/wcode-access-management_hu_ac447683faaa24eb.webp&#34; alt=&#34;wcode 授权与访问控制界面&#34;loading=&#34;lazy&#34; decoding=&#34;async&#34; srcset=&#34;https://francisdu.com/img/wcode/wcode-access-management_hu_ac447683faaa24eb.webp 960w, https://francisdu.com/img/wcode/wcode-access-management_hu_e5f2de5679dfbc7e.webp 1600w&#34; sizes=&#34;(max-width: 900px) calc(100vw - 32px), 900px&#34; width=&#34;1600&#34; height=&#34;1000&#34;&gt;&lt;/figure&gt;&lt;h2 id=&#34;root-不是字符串前缀&#34;&gt;Root 不是字符串前缀&lt;a class=&#34;heading-anchor&#34; href=&#34;#root-%e4%b8%8d%e6%98%af%e5%ad%97%e7%ac%a6%e4%b8%b2%e5%89%8d%e7%bc%80&#34; aria-label=&#34;章节链接：Root 不是字符串前缀&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;最偷懒的 Workspace 隔离大概是：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;path.starts_with(workspace_root)
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;这当然不够。&lt;/p&gt;
&lt;p&gt;wcode 启动时会先 Canonicalize Root，文件系统根目录、Home 这种过大的范围默认不接受，多个 Workspace 也不能随便父子重叠。&lt;/p&gt;
&lt;p&gt;后续文件操作还会重新确认 Root。&lt;/p&gt;
&lt;p&gt;Unix 上会记 Device / Inode，所以服务启动以后，如果同一个路径被换成了另一个目录，字符串虽然没变，身份已经变了，也会停下来。&lt;/p&gt;
&lt;p&gt;模型传进来的路径只能是相对路径。&lt;/p&gt;
&lt;p&gt;&lt;code&gt;..&lt;/code&gt;、绝对路径、Windows Prefix、受保护的凭据和 VCS 路径，都是 Workspace 层直接挡，不靠 Agent 自觉。&lt;/p&gt;
&lt;h2 id=&#34;symlink-是我早期低估过的坑&#34;&gt;Symlink 是我早期低估过的坑&lt;a class=&#34;heading-anchor&#34; href=&#34;#symlink-%e6%98%af%e6%88%91%e6%97%a9%e6%9c%9f%e4%bd%8e%e4%bc%b0%e8%bf%87%e7%9a%84%e5%9d%91&#34; aria-label=&#34;章节链接：Symlink 是我早期低估过的坑&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;只拦 &lt;code&gt;..&lt;/code&gt; 看起来像是做了 Path Traversal 防护，实际上一个 Symlink 就能把你带出去。&lt;/p&gt;
&lt;p&gt;所以 Workspace Path 的 Component 里有 Symlink，直接拒绝。&lt;/p&gt;
&lt;p&gt;已有文件和新文件还不能完全用同一种检查方式。&lt;/p&gt;
&lt;p&gt;已有文件能解析最终目标；新文件的叶子还不存在，只能先确认父目录安全，再创建。&lt;/p&gt;
&lt;p&gt;Unix 上写 Hard Link 也有限制，因为同一个 inode 可能从另一个名字被修改。&lt;/p&gt;
&lt;p&gt;这些逻辑写起来比一个 &lt;code&gt;canonicalize()&lt;/code&gt; 麻烦很多，但这是我不太愿意“简化”的地方。&lt;/p&gt;
&lt;h2 id=&#34;sha-是防-agent-和我互相踩代码&#34;&gt;SHA 是防 Agent 和我互相踩代码&lt;a class=&#34;heading-anchor&#34; href=&#34;#sha-%e6%98%af%e9%98%b2-agent-%e5%92%8c%e6%88%91%e4%ba%92%e7%9b%b8%e8%b8%a9%e4%bb%a3%e7%a0%81&#34; aria-label=&#34;章节链接：SHA 是防 Agent 和我互相踩代码&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;文件读出来以后，wcode 会给当前 SHA-256。&lt;/p&gt;
&lt;p&gt;后面修改已有文件，必须把这个 SHA 带回来。&lt;/p&gt;
&lt;p&gt;这个机制最常见的用途不是防攻击，而是防一个很普通的并发场景：Agent 读了版本 A，在它思考时我手动改成了版本 B，它最后还拿 A 的上下文回来写。&lt;/p&gt;
&lt;p&gt;没有 SHA，很容易把我的 B 一起覆盖掉。&lt;/p&gt;
&lt;p&gt;真正提交写入前还会拿锁、重新解析路径、重新读内容、再校一次 Hash。&lt;/p&gt;
&lt;p&gt;最后用同目录临时文件做原子替换，而不是直接 &lt;code&gt;truncate&lt;/code&gt; 原文件。&lt;/p&gt;
&lt;p&gt;这层我实际遇到过几次救命的情况，所以一直保留得很死。&lt;/p&gt;
&lt;h2 id=&#34;delete-后来加了但故意做得很烦&#34;&gt;Delete 后来加了，但故意做得很烦&lt;a class=&#34;heading-anchor&#34; href=&#34;#delete-%e5%90%8e%e6%9d%a5%e5%8a%a0%e4%ba%86%e4%bd%86%e6%95%85%e6%84%8f%e5%81%9a%e5%be%97%e5%be%88%e7%83%a6&#34; aria-label=&#34;章节链接：Delete 后来加了，但故意做得很烦&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;第一版 wcode 干脆没有 Delete Tool。&lt;/p&gt;
&lt;p&gt;后来实际 Coding Workflow 里确实有删除文件的需要，所以最终还是加了 &lt;code&gt;delete_path&lt;/code&gt;。&lt;/p&gt;
&lt;p&gt;但它不是普通 Write。&lt;/p&gt;
&lt;p&gt;第一次调用只会产生一个本地 Authorization Request。我要在 TUI 或受保护的 Project Observatory 里批准这个&lt;strong&gt;精确操作&lt;/strong&gt;，Agent 再重试。&lt;/p&gt;
&lt;p&gt;而且授权是 one-shot。&lt;/p&gt;
&lt;p&gt;普通文件删除要求当前 SHA；目录只能删空目录；递归删、Workspace Root、Protected Path、Symlink、Hard-linked File 都不开放。&lt;/p&gt;
&lt;p&gt;这会让“帮我顺便清理十几个目录”没那么丝滑。&lt;/p&gt;
&lt;p&gt;我接受这个麻烦。&lt;/p&gt;
&lt;p&gt;恢复一个误删目录比多确认几次麻烦得多。&lt;/p&gt;
&lt;h2 id=&#34;run_command-还是不经过-shell&#34;&gt;&lt;code&gt;run_command&lt;/code&gt; 还是不经过 Shell&lt;a class=&#34;heading-anchor&#34; href=&#34;#run_command-%e8%bf%98%e6%98%af%e4%b8%8d%e7%bb%8f%e8%bf%87-shell&#34; aria-label=&#34;章节链接：run_command 还是不经过 Shell&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;这一条从第一版到现在没变。&lt;/p&gt;
&lt;p&gt;命令执行是：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;program + args[]
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;不是：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;/bin/sh -c &amp;#34;...&amp;#34;
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;所以：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;&amp;amp;&amp;amp;
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;|
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;&amp;gt;
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;$(...)
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;这些语法根本没有解释器去理解。&lt;/p&gt;
&lt;p&gt;默认预授权 Command Policy 仍然很窄，主要是受约束的 Git / ripgrep，以及 Harness 能确定形状的工程检查。&lt;/p&gt;
&lt;p&gt;但现在“默认没授权”不等于“永远不能授权”。模型如果请求一个合法的裸可执行程序名，例如 &lt;code&gt;hugo&lt;/code&gt;、&lt;code&gt;flutter&lt;/code&gt;、&lt;code&gt;deno&lt;/code&gt;、&lt;code&gt;mvn&lt;/code&gt;，第一次会生成当前 Workspace 的 &lt;code&gt;CommandAccess&lt;/code&gt; Pending Request。TUI 里可以用 ↑/↓ 选中某一条，&lt;code&gt;Y&lt;/code&gt; 只批准选中的请求、&lt;code&gt;N&lt;/code&gt; 只拒绝选中的请求；Project Observatory 的 Access Panel 也能处理同一批 Pending Request。&lt;/p&gt;
&lt;p&gt;批准后只是把这个 Program 加进当前 Workspace 的运行时授权，不是开放 Shell。&lt;code&gt;bash&lt;/code&gt;、&lt;code&gt;sh&lt;/code&gt;、&lt;code&gt;pwsh&lt;/code&gt;、&lt;code&gt;cmd&lt;/code&gt; 这类 Shell Interpreter 和带路径 Program Name 仍然硬拒绝；Argument 继续经过 Workspace Escape、Protected Path 和具体 Command Policy 检查。&lt;/p&gt;
&lt;p&gt;Git Mutation 会被挡，敏感环境变量会清掉，输出有限制，进程有 Timeout。&lt;/p&gt;
&lt;p&gt;我一直不认同“既然模型已经能写代码，不如直接给它 Terminal”这种推导。&lt;/p&gt;
&lt;p&gt;写代码能力和拿到一个继承了我所有环境的 Shell，不是一个权限级别。&lt;/p&gt;
&lt;h2 id=&#34;高风险执行现在可以按操作授权&#34;&gt;高风险执行现在可以按操作授权&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e9%ab%98%e9%a3%8e%e9%99%a9%e6%89%a7%e8%a1%8c%e7%8e%b0%e5%9c%a8%e5%8f%af%e4%bb%a5%e6%8c%89%e6%93%8d%e4%bd%9c%e6%8e%88%e6%9d%83&#34; aria-label=&#34;章节链接：高风险执行现在可以按操作授权&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;这一块和第一版相比变过。&lt;/p&gt;
&lt;p&gt;以前要跑 Language Server、Runtime Executor 这类 repository-aware 操作，基本就是启动时加：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;--allow-risky-exec
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;这个开关现在还在，含义更像“这个 wcode 进程我整体信任，可以做这类执行”。&lt;/p&gt;
&lt;p&gt;但我不一定每次都想放这么宽。&lt;/p&gt;
&lt;p&gt;现在具体的 Risky Execution 也可以先触发本地 Authorization Request。我在 TUI 或受保护 WebUI 里批准当前 Session 的精确 operation，再让 Agent 重试。&lt;/p&gt;
&lt;p&gt;例如我只想允许一次 Semantic Refresh，就不必顺便授权后面所有仓库执行。&lt;/p&gt;
&lt;p&gt;这和 &lt;code&gt;CommandAccess&lt;/code&gt; 是两层：前者决定“这个 Program 能不能在这个 Workspace 出现”，后者继续决定“当前这组 repository-aware 参数是否值得信任”。&lt;/p&gt;
&lt;p&gt;这不是 OS Sandbox。&lt;/p&gt;
&lt;p&gt;只是把“你信不信这个仓库里的代码会被执行”从一个粗开关拆得更细一点。&lt;/p&gt;
&lt;h2 id=&#34;并发写入也不是谁先抢到锁谁赢&#34;&gt;并发写入也不是谁先抢到锁谁赢&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e5%b9%b6%e5%8f%91%e5%86%99%e5%85%a5%e4%b9%9f%e4%b8%8d%e6%98%af%e8%b0%81%e5%85%88%e6%8a%a2%e5%88%b0%e9%94%81%e8%b0%81%e8%b5%a2&#34; aria-label=&#34;章节链接：并发写入也不是谁先抢到锁谁赢&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;现在 &lt;code&gt;parallel_tools&lt;/code&gt; 能处理一部分独立 Workspace Write，这又多了一个安全问题：两个任务到底能不能同时跑。&lt;/p&gt;
&lt;p&gt;Scheduler 会先建立 Path Resource Model。&lt;/p&gt;
&lt;p&gt;如果两个操作碰同一个文件，或者 Move / Delete / Create 之间有父子路径依赖，就排序，不硬并发。&lt;/p&gt;
&lt;p&gt;同文件 &lt;code&gt;apply_edits&lt;/code&gt; 只有 SHA 一样、Edit Range 不冲突时才会合并成一次原子提交。&lt;/p&gt;
&lt;p&gt;我不想让“支持并发”最后变成“把 race condition 交给文件锁处理”。&lt;/p&gt;
&lt;p&gt;能不能并发应该在执行前就尽量说清楚。&lt;/p&gt;
&lt;h2 id=&#34;安全边界不能只写在-prompt-里&#34;&gt;安全边界不能只写在 Prompt 里&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e5%ae%89%e5%85%a8%e8%be%b9%e7%95%8c%e4%b8%8d%e8%83%bd%e5%8f%aa%e5%86%99%e5%9c%a8-prompt-%e9%87%8c&#34; aria-label=&#34;章节链接：安全边界不能只写在 Prompt 里&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;我还是会在 Skill 和 Agent Instructions 里写：不要逃出 Workspace，不要绕过授权，不要自己扩大 risky execution。&lt;/p&gt;
&lt;p&gt;但这些只能算工作习惯。&lt;/p&gt;
&lt;p&gt;真正的安全边界必须在 Tool Runtime。&lt;/p&gt;
&lt;p&gt;模型理解错了、Prompt Injection 进来了、路径算错了，最后应该撞在 Workspace Policy / Authorization / Command Policy 上。&lt;/p&gt;
&lt;p&gt;而不是靠一句：&lt;/p&gt;
&lt;blockquote&gt;
&lt;p&gt;请严格遵守安全规则。&lt;/p&gt;
&lt;/blockquote&gt;
&lt;p&gt;上层功能越多，我越觉得这一点重要。&lt;/p&gt;
&lt;p&gt;Agent 可以很聪明，也可以犯很离谱的错。底层权限最好对这两种情况都一样冷淡。&lt;/p&gt;
&lt;p&gt;这一组文章从 &lt;a href=&#34;https://francisdu.com/blog/wcode-2026/&#34;&gt;最新版总览&lt;/a&gt; 开始。授权队列、&lt;code&gt;CommandAccess&lt;/code&gt; 和 TUI/WebUI 的交互细节单独写在 &lt;a href=&#34;https://francisdu.com/blog/wcode-authorization/&#34;&gt;授权中心：模型可以提权限，但不能替我批准&lt;/a&gt;。第一版关于 OAuth、Tunnel、MCP 请求链路和早期 Workspace 实现的记录还在 &lt;a href=&#34;https://francisdu.com/blog/wcode/&#34;&gt;这里&lt;/a&gt;。&lt;/p&gt;
</description>
    </item>
    
    <item>
      <title>wcode 里，我把 MCP 和 Skill 分开了</title>
      <link>https://francisdu.com/blog/wcode-mcp-agent/</link>
      <pubDate>Wed, 26 Aug 2026 03:16:00 +0800</pubDate>
      <guid>https://francisdu.com/blog/wcode-mcp-agent/</guid>
      <description>&lt;p&gt;第一版 wcode 基本是围着 MCP 写的。&lt;/p&gt;
&lt;p&gt;那时候最核心的问题是：Web 端模型怎么安全访问本地代码。&lt;/p&gt;
&lt;p&gt;现在 Software Intelligence、Verification、Reconciliation 都长出来以后，MCP 在项目里的位置反而更简单了。&lt;/p&gt;
&lt;p&gt;它就是能力接口。&lt;/p&gt;
&lt;h2 id=&#34;本地-agent-没必要绕公网&#34;&gt;本地 Agent 没必要绕公网&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e6%9c%ac%e5%9c%b0-agent-%e6%b2%a1%e5%bf%85%e8%a6%81%e7%bb%95%e5%85%ac%e7%bd%91&#34; aria-label=&#34;章节链接：本地 Agent 没必要绕公网&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;如果 Agent 本身就在本机，比如 Claude Code、Codex、Grok Build 这类，没必要为了调用本地仓库先走一圈 Tunnel 和 OAuth。&lt;/p&gt;
&lt;p&gt;直接：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-bash&#34; data-lang=&#34;bash&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;wcode --workspace /absolute/path/to/repository mcp-stdio
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;stdio 和 HTTP 后面没有两套业务实现。&lt;/p&gt;
&lt;p&gt;最终用的还是同一个：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Workspace
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Harness
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Software Intelligence
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Verification / Evidence
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Tools
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Prompts
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Resources
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Tasks
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;Transport 不一样，能力边界应该一样。&lt;/p&gt;
&lt;p&gt;这件事我比较在意，因为很多工具做到后面会出现“本地模式一套，Remote 模式另一套”，最后修安全问题要修两遍。&lt;/p&gt;
&lt;h2 id=&#34;web--cloud-还是-http--oauth&#34;&gt;Web / Cloud 还是 HTTP + OAuth&lt;a class=&#34;heading-anchor&#34; href=&#34;#web--cloud-%e8%bf%98%e6%98%af-http--oauth&#34; aria-label=&#34;章节链接：Web / Cloud 还是 HTTP &amp;#43; OAuth&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;ChatGPT、Grok Web、Claude Web 这类产品从云端访问本机，还是需要公网可达地址。&lt;/p&gt;
&lt;p&gt;所以第一版里的 Streamable HTTP、OAuth、PKCE、Resource Binding、Quick Tunnel 都还在。&lt;/p&gt;
&lt;p&gt;这些底层细节我在 &lt;a href=&#34;https://francisdu.com/blog/wcode/&#34;&gt;第一版文章&lt;/a&gt; 写过，这里不展开。&lt;/p&gt;
&lt;p&gt;后面主要补的是协议兼容和长任务。&lt;/p&gt;
&lt;p&gt;现代 MCP 请求可以声明 Tasks Extension。现在只把确实可能很慢的操作做成 Durable Task，例如：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;semantic_provider_refresh
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;verification_execute_stages
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;客户端声明 Tasks，就可以拿 Handle 后轮询；不声明，仍然走同步调用。&lt;/p&gt;
&lt;p&gt;我不想为了跟最新协议，把还能正常工作的客户端全部逼着一起升级。&lt;/p&gt;
&lt;h2 id=&#34;tool-现在也带-product-scope-信息&#34;&gt;Tool 现在也带 Product Scope 信息&lt;a class=&#34;heading-anchor&#34; href=&#34;#tool-%e7%8e%b0%e5%9c%a8%e4%b9%9f%e5%b8%a6-product-scope-%e4%bf%a1%e6%81%af&#34; aria-label=&#34;章节链接：Tool 现在也带 Product Scope 信息&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;这块是后来才加的。&lt;/p&gt;
&lt;p&gt;wcode 自己的能力已经很多，如果 Agent 只看到几十个 Tool Name，很容易把它们理解成一张平面列表。&lt;/p&gt;
&lt;p&gt;现在 Product Scope Registry 会同时用于源码分区、&lt;code&gt;software_context&lt;/code&gt;、Semantic Scope 和 MCP Tool Metadata。&lt;/p&gt;
&lt;p&gt;也就是说，Agent 不只知道有个 &lt;code&gt;risk_status&lt;/code&gt;，还可以发现它属于哪些 Product Scope；&lt;code&gt;scope_status&lt;/code&gt; 也能直接看当前仓库源码映射和未归类文件。&lt;/p&gt;
&lt;p&gt;这不是为了给 Tool 多加标签。&lt;/p&gt;
&lt;p&gt;主要是让 Agent 在开始做事之前先知道“我现在在哪个能力边界里”，不要动不动就全仓库搜索。&lt;/p&gt;
&lt;h2 id=&#34;skill-不应该偷偷带执行权限&#34;&gt;Skill 不应该偷偷带执行权限&lt;a class=&#34;heading-anchor&#34; href=&#34;#skill-%e4%b8%8d%e5%ba%94%e8%af%a5%e5%81%b7%e5%81%b7%e5%b8%a6%e6%89%a7%e8%a1%8c%e6%9d%83%e9%99%90&#34; aria-label=&#34;章节链接：Skill 不应该偷偷带执行权限&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;现在可以导出一个 Agent Plugin / Skill：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-bash&#34; data-lang=&#34;bash&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;wcode --workspace &lt;span style=&#34;color:#a31515&#34;&gt;&amp;#34;&lt;/span&gt;$PWD&lt;span style=&#34;color:#a31515&#34;&gt;&amp;#34;&lt;/span&gt; agent-plugin --output wcode-agent-plugin
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;目录很小：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;wcode-agent-plugin/
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;├── plugin.json
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;├── .claude-plugin/
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;│   └── plugin.json
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;├── README.md
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;└── skills/
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    └── wcode-software-intelligence/
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;        └── SKILL.md
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;我故意没往里面塞 Hook、JS/Python Script、Credential，也没把 Workspace 配置偷偷写进去。&lt;/p&gt;
&lt;p&gt;我后来把这个边界总结成一句很普通的话：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Skill = workflow
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;MCP = capability
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;Skill 可以告诉 Agent 我希望它先做：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;workspace_info
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;scope_status
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;design_status
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;project_context
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;software_context(scopes=...)
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;修改以后再走 Review、Impact、Risk、Verification。&lt;/p&gt;
&lt;p&gt;但 Skill 自己不能因为“装上了”就突然得到 Shell、删除文件或者运行仓库程序的权限。&lt;/p&gt;
&lt;p&gt;权限还是 Runtime 的事。&lt;/p&gt;
&lt;h2 id=&#34;workspace-我一直要求显式&#34;&gt;Workspace 我一直要求显式&lt;a class=&#34;heading-anchor&#34; href=&#34;#workspace-%e6%88%91%e4%b8%80%e7%9b%b4%e8%a6%81%e6%b1%82%e6%98%be%e5%bc%8f&#34; aria-label=&#34;章节链接：Workspace 我一直要求显式&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;持久化 Agent 配置里，我更推荐写绝对路径：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-bash&#34; data-lang=&#34;bash&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;wcode --workspace /absolute/path/to/repository mcp-stdio
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;而不是让 Plugin 根据当前 &lt;code&gt;cwd&lt;/code&gt; 自动猜仓库。&lt;/p&gt;
&lt;p&gt;这不是审美问题。&lt;/p&gt;
&lt;p&gt;Agent 从子目录启动、Plugin 自己有工作目录、IDE 改了 Project Root，这些情况都很常见。自动向上找父目录一旦找错，影响的是权限边界，不只是路径显示不好看。&lt;/p&gt;
&lt;p&gt;所以 Workspace 是 wcode Runtime 的显式参数。&lt;/p&gt;
&lt;p&gt;Skill 不替我决定。&lt;/p&gt;
&lt;h2 id=&#34;授权也不交给-skill&#34;&gt;授权也不交给 Skill&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e6%8e%88%e6%9d%83%e4%b9%9f%e4%b8%8d%e4%ba%a4%e7%bb%99-skill&#34; aria-label=&#34;章节链接：授权也不交给 Skill&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;现在 wcode 对高风险执行和删除都有本地 Authorization Flow。&lt;/p&gt;
&lt;p&gt;例如一个 Language Server Refresh 如果没有预先通过 &lt;code&gt;--allow-risky-exec&lt;/code&gt; 放开，可以先产生 Authorization Request；我在 TUI 里批准后，Agent 再重试。&lt;/p&gt;
&lt;p&gt;Delete 则是 exact one-shot approval。&lt;/p&gt;
&lt;p&gt;这些动作 Skill 都不会自动替我确认。&lt;/p&gt;
&lt;p&gt;我觉得这一点很重要：Skill 可以告诉 Agent“遇到授权就说明原因并等待人处理”，但它不能为了让流程顺滑，顺手把信任边界也一起扩大。&lt;/p&gt;
&lt;h2 id=&#34;换模型这件事因此变得没那么重&#34;&gt;换模型这件事因此变得没那么重&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e6%8d%a2%e6%a8%a1%e5%9e%8b%e8%bf%99%e4%bb%b6%e4%ba%8b%e5%9b%a0%e6%ad%a4%e5%8f%98%e5%be%97%e6%b2%a1%e9%82%a3%e4%b9%88%e9%87%8d&#34; aria-label=&#34;章节链接：换模型这件事因此变得没那么重&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;以前我会比较在意某个 Agent 有没有自己独特的 Memory、Rule、Project Context。&lt;/p&gt;
&lt;p&gt;现在当然还是会在意模型能力，但项目状态不太想绑在它身上了。&lt;/p&gt;
&lt;p&gt;Verification Plan、Evidence、Reconciliation、Graph History、Semantic Registry 这些长期状态都留在 wcode。&lt;/p&gt;
&lt;p&gt;一个 Agent 只要能调用 MCP，就能接同一个 Workspace；安装同一份 Skill，只是更容易遵循同一套工作习惯。&lt;/p&gt;
&lt;p&gt;从 Claude 换到 Codex，或者 Web 端换成本地 Agent，模型上下文会变，但项目本身不应该跟着清零。&lt;/p&gt;
&lt;p&gt;这样换模型时轻松很多，MCP 也没有继续膨胀成一套自己的 Agent。&lt;/p&gt;
&lt;p&gt;最后还是会回到最底层的问题：这些 Agent 到底能在我的机器上做什么。Workspace、命令执行和授权的边界，我单独写在 &lt;a href=&#34;https://francisdu.com/blog/wcode-security/&#34;&gt;我还是不想给 Agent 一个 Shell&lt;/a&gt; 里。&lt;/p&gt;
</description>
    </item>
    
    <item>
      <title>wcode：我为什么开始把 edit file 往后放</title>
      <link>https://francisdu.com/blog/wcode-reconciliation/</link>
      <pubDate>Wed, 26 Aug 2026 03:15:00 +0800</pubDate>
      <guid>https://francisdu.com/blog/wcode-reconciliation/</guid>
      <description>&lt;p&gt;写 Coding Agent 很容易最后都收敛到几个工具：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;read_file
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;search
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;edit_file
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;run_test
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;第一版 wcode 也差不多。&lt;/p&gt;
&lt;p&gt;当时我花很多时间把这些工具做得安全一点：路径不能逃出 Workspace，写入有 SHA，命令不经过 Shell，验证有固定 Harness。&lt;/p&gt;
&lt;p&gt;这些当然还重要。&lt;/p&gt;
&lt;p&gt;但用久以后我发现，&lt;code&gt;edit_file&lt;/code&gt; 其实不是最难的部分。&lt;/p&gt;
&lt;p&gt;真正让我头疼的是一个稍微大一点的修改：为什么要改？这次到底影响什么？哪件事必须先做？什么时候算完成？如果一个模型做到一半退出了，第二个模型从哪里接？&lt;/p&gt;
&lt;p&gt;所以我后来开始把 &lt;code&gt;edit file&lt;/code&gt; 往后放，前面先补 Reconciliation。&lt;/p&gt;
&lt;h2 id=&#34;我先想要的是一个能恢复的-plan&#34;&gt;我先想要的是一个能恢复的 Plan&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e6%88%91%e5%85%88%e6%83%b3%e8%a6%81%e7%9a%84%e6%98%af%e4%b8%80%e4%b8%aa%e8%83%bd%e6%81%a2%e5%a4%8d%e7%9a%84-plan&#34; aria-label=&#34;章节链接：我先想要的是一个能恢复的 Plan&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;现在一条链大概是：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Design State
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Actual State / Git Change
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Drift
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Impact
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Risk
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Reconciliation Plan
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Verification / Human Approval
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Evidence
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;Plan 不是一句“修好这个问题”。&lt;/p&gt;
&lt;p&gt;它会带上这次 Design Change、发现的 Drift、Impact、Risk、Change Intent 和 Verification Requirement，然后再拆成有依赖的 Task。&lt;/p&gt;
&lt;p&gt;这听起来有点重，但原因其实很现实：聊天记录不适合拿来当长期工作状态。&lt;/p&gt;
&lt;h2 id=&#34;session-断掉比想象中常见&#34;&gt;Session 断掉比想象中常见&lt;a class=&#34;heading-anchor&#34; href=&#34;#session-%e6%96%ad%e6%8e%89%e6%af%94%e6%83%b3%e8%b1%a1%e4%b8%ad%e5%b8%b8%e8%a7%81&#34; aria-label=&#34;章节链接：Session 断掉比想象中常见&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;模型会换，工具会重连，Web Session 会过期，有时我自己也会中途停下来改别的东西。&lt;/p&gt;
&lt;p&gt;如果任务做到一半，所有进度都只存在上一段 Conversation 里，下一次基本又得从头解释。&lt;/p&gt;
&lt;p&gt;所以 Reconciliation Plan 和 Execution 都会持久化。&lt;/p&gt;
&lt;p&gt;执行者面对的是：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;claim
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;submit
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;retry
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;status
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;Claim 只能拿当前依赖已经满足的 Task。&lt;/p&gt;
&lt;p&gt;Submit 会留下执行结果和 Evidence。&lt;/p&gt;
&lt;p&gt;失败就是失败，不会因为任务“差不多做完了”自动翻成成功。要继续就 Retry。&lt;/p&gt;
&lt;p&gt;这套状态机没有多复杂，但它给不同模型之间提供了一个比聊天记录稳定得多的交接面。&lt;/p&gt;
&lt;h2 id=&#34;代码写完不等于修改完成&#34;&gt;“代码写完”不等于“修改完成”&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e4%bb%a3%e7%a0%81%e5%86%99%e5%ae%8c%e4%b8%8d%e7%ad%89%e4%ba%8e%e4%bf%ae%e6%94%b9%e5%ae%8c%e6%88%90&#34; aria-label=&#34;章节链接：“代码写完”不等于“修改完成”&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;我后来很想把这两个状态拆开。&lt;/p&gt;
&lt;p&gt;以前 Agent 写完最后一个 Patch，往往心理上任务就已经结束了，测试变成一个尾巴：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;TODO: run tests
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;Reconciliation 里 Verification 和 Human Approval 可以是实际的系统 Gate。&lt;/p&gt;
&lt;p&gt;只有对应 Evidence 到了，Task 才继续往后走。&lt;/p&gt;
&lt;p&gt;所以：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Implementation complete
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;和：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Change converged
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;不是同一个状态。&lt;/p&gt;
&lt;p&gt;这个区别在安全相关修改里尤其明显。代码可能十分钟前已经写完，但 Security Review、Maintainability Review、Full Verification 还没结束，那我就不希望系统把它显示成“完成”。&lt;/p&gt;
&lt;h2 id=&#34;plan-没有超级写权限&#34;&gt;Plan 没有超级写权限&lt;a class=&#34;heading-anchor&#34; href=&#34;#plan-%e6%b2%a1%e6%9c%89%e8%b6%85%e7%ba%a7%e5%86%99%e6%9d%83%e9%99%90&#34; aria-label=&#34;章节链接：Plan 没有超级写权限&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;Reconciliation 做到这里，很容易给它加一条捷径：既然 Plan 已经知道要改什么，那直接让执行器 Patch 不就行了。&lt;/p&gt;
&lt;p&gt;我没有这么做。&lt;/p&gt;
&lt;p&gt;真正的文件修改仍然走 Workspace 原来的边界：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Workspace root isolation
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;SHA-256 precondition
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;atomic write
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;symlink / hardlink safety
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;protected path policy
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;authorization
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;假设 Plan 是十分钟前生成的，这十分钟里我手动改了目标文件。&lt;/p&gt;
&lt;p&gt;执行者拿旧 SHA 去写，照样失败。&lt;/p&gt;
&lt;p&gt;Plan 不能因为“自己是计划”就压过现在的文件状态。&lt;/p&gt;
&lt;p&gt;这条限制看起来会让自动化麻烦一点，但我觉得值得。&lt;/p&gt;
&lt;h2 id=&#34;并行也没有直接全开&#34;&gt;并行也没有直接全开&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e5%b9%b6%e8%a1%8c%e4%b9%9f%e6%b2%a1%e6%9c%89%e7%9b%b4%e6%8e%a5%e5%85%a8%e5%bc%80&#34; aria-label=&#34;章节链接：并行也没有直接全开&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;现在 &lt;code&gt;parallel_tools&lt;/code&gt; 已经能处理不只是 Read/Discovery，也包括一部分独立的 Workspace Write。&lt;/p&gt;
&lt;p&gt;但不是把一堆写操作扔进 Tokio 就结束了。&lt;/p&gt;
&lt;p&gt;Scheduler 会先按路径做 Resource Model：哪些操作读同一个文件、哪些写同一个文件、Move / Delete / Create 有没有父子目录依赖。&lt;/p&gt;
&lt;p&gt;独立的可以 fan out；冲突的先排序。&lt;/p&gt;
&lt;p&gt;同一个文件上的 &lt;code&gt;apply_edits&lt;/code&gt; 只有在 SHA 一样、Edit 本身不冲突时才会合并成一次原子提交。&lt;/p&gt;
&lt;p&gt;这和 Reconciliation 的想法很接近：不是追求“看起来同时跑了很多东西”，而是先搞清楚哪些事情真的互相独立。&lt;/p&gt;
&lt;h2 id=&#34;continuous-reconciliation-我现在还是很谨慎&#34;&gt;Continuous Reconciliation 我现在还是很谨慎&lt;a class=&#34;heading-anchor&#34; href=&#34;#continuous-reconciliation-%e6%88%91%e7%8e%b0%e5%9c%a8%e8%bf%98%e6%98%af%e5%be%88%e8%b0%a8%e6%85%8e&#34; aria-label=&#34;章节链接：Continuous Reconciliation 我现在还是很谨慎&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;“Reconciliation” 这个词很容易让人联想到 Kubernetes Controller：不停观察 Desired / Actual，然后自动把实际状态修回去。&lt;/p&gt;
&lt;p&gt;wcode 确实有往这个方向走的设计，但我暂时不想让代码库也变成那种全自动 Controller。&lt;/p&gt;
&lt;p&gt;软件修改和副本数不一样。&lt;/p&gt;
&lt;p&gt;有些 Drift 很机械，可以自动发现；但“这里应该不应该改”“设计到底是不是变了”“这个抽象还值不值得留”，很多时候不适合无条件自动推进。&lt;/p&gt;
&lt;p&gt;所以我目前更关心的是把：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;观察
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;计划
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;执行
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;验证
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;证据
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;这几段先做成可靠的状态。&lt;/p&gt;
&lt;p&gt;自动化程度以后再加。&lt;/p&gt;
&lt;h2 id=&#34;不同模型终于不用共享一段脑内上下文&#34;&gt;不同模型终于不用共享一段脑内上下文&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e4%b8%8d%e5%90%8c%e6%a8%a1%e5%9e%8b%e7%bb%88%e4%ba%8e%e4%b8%8d%e7%94%a8%e5%85%b1%e4%ba%ab%e4%b8%80%e6%ae%b5%e8%84%91%e5%86%85%e4%b8%8a%e4%b8%8b%e6%96%87&#34; aria-label=&#34;章节链接：不同模型终于不用共享一段脑内上下文&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;这是我现在最喜欢 Reconciliation 的地方。&lt;/p&gt;
&lt;p&gt;一个模型可以做 Implementation，另一个做 Security Review，再换一个看 Maintainability 或补 Test。&lt;/p&gt;
&lt;p&gt;它们不需要彼此复述上一段 Chat。&lt;/p&gt;
&lt;p&gt;只要都通过 wcode，看到的是同一个 Requirement、同一个 Plan、同一个 revision 和同一组 Evidence。&lt;/p&gt;
&lt;p&gt;模型当然还是会有各自的判断差异，但至少“项目现在做到哪了”不必由模型自己记。&lt;/p&gt;
&lt;p&gt;再往外一层，就是怎么把这些能力交给不同 Agent，而又不把权限和工作流混在一起。我把这部分写在 &lt;a href=&#34;https://francisdu.com/blog/wcode-mcp-agent/&#34;&gt;MCP 负责能力，Skill 只负责工作习惯&lt;/a&gt; 里。&lt;/p&gt;
</description>
    </item>
    
    <item>
      <title>wcode：测试通过以后，我还想留下什么</title>
      <link>https://francisdu.com/blog/wcode-verification/</link>
      <pubDate>Wed, 26 Aug 2026 03:14:00 +0800</pubDate>
      <guid>https://francisdu.com/blog/wcode-verification/</guid>
      <description>&lt;p&gt;Coding Agent 很喜欢用一句话结束工作：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Tests passed.
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;以前我也觉得差不多够了。&lt;/p&gt;
&lt;p&gt;后来 wcode 自己改得越来越大，这句话开始经常让我不放心。&lt;/p&gt;
&lt;p&gt;到底跑了哪几个测试？是 quick 还是 full？测试的时候源码是不是当前 revision？有没有 Static Check？有没有 Mutation / Fuzz？两个 Reviewer 意见不一样怎么办？代码虽然能跑，但这次是不是又把一个文件堆大了几百行？&lt;/p&gt;
&lt;p&gt;所以最近我把 Verification 单独往前做了一层。&lt;/p&gt;
&lt;h2 id=&#34;最基础的还是项目自己的检查&#34;&gt;最基础的还是项目自己的检查&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e6%9c%80%e5%9f%ba%e7%a1%80%e7%9a%84%e8%bf%98%e6%98%af%e9%a1%b9%e7%9b%ae%e8%87%aa%e5%b7%b1%e7%9a%84%e6%a3%80%e6%9f%a5&#34; aria-label=&#34;章节链接：最基础的还是项目自己的检查&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;&lt;code&gt;verify_project&lt;/code&gt; 没有想发明新的测试框架。&lt;/p&gt;
&lt;p&gt;Harness 先看项目实际有什么，再推导检查。&lt;/p&gt;
&lt;p&gt;Rust 项目大概是：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;quick
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  git diff --check
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  cargo fmt --check
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  cargo check --locked
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;full
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  cargo test --locked
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  cargo clippy --locked -- -D warnings
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  cargo build --release --locked
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;Node 就看 &lt;code&gt;package.json&lt;/code&gt; 里真实存在的 script，Makefile 也只跑确实定义过的 target。&lt;/p&gt;
&lt;p&gt;这块我一直比较克制，因为“猜一个应该存在的命令然后执行”在 Agent 场景里不是好习惯。&lt;/p&gt;
&lt;h2 id=&#34;risk-决定要不要继续往下走&#34;&gt;Risk 决定要不要继续往下走&lt;a class=&#34;heading-anchor&#34; href=&#34;#risk-%e5%86%b3%e5%ae%9a%e8%a6%81%e4%b8%8d%e8%a6%81%e7%bb%a7%e7%bb%ad%e5%be%80%e4%b8%8b%e8%b5%b0&#34; aria-label=&#34;章节链接：Risk 决定要不要继续往下走&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;&lt;code&gt;verify_project&lt;/code&gt; 只是确定性基础检查。&lt;/p&gt;
&lt;p&gt;再往上是 Verification Plan。&lt;/p&gt;
&lt;p&gt;Plan 会根据这次变更的 Risk 决定要不要要求更多东西，例如：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;property
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;mutation
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;fuzz
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;runtime canary
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;human approval
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;independent reviewer
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;这些不是写在 Prompt 里的“建议最好跑一下”。&lt;/p&gt;
&lt;p&gt;如果 Plan 要求它，它就是 Gate。&lt;/p&gt;
&lt;h2 id=&#34;executor-registry-是因为每个语言都不一样&#34;&gt;Executor Registry 是因为每个语言都不一样&lt;a class=&#34;heading-anchor&#34; href=&#34;#executor-registry-%e6%98%af%e5%9b%a0%e4%b8%ba%e6%af%8f%e4%b8%aa%e8%af%ad%e8%a8%80%e9%83%bd%e4%b8%8d%e4%b8%80%e6%a0%b7&#34; aria-label=&#34;章节链接：Executor Registry 是因为每个语言都不一样&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;Property、Mutation、Fuzz 在不同生态里完全不是一回事。&lt;/p&gt;
&lt;p&gt;我不想在 Verification 里写一堆 &lt;code&gt;if rust ... else if python ...&lt;/code&gt;，所以做了统一的 Executor Registry。&lt;/p&gt;
&lt;p&gt;现在会识别一批常见工具，比如：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Rust      proptest / quickcheck / cargo-fuzz / cargo-mutants
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Python    Hypothesis / mutmut
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;JS / TS   fast-check / Stryker
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Java      jqwik / PIT
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;C#        FsCheck / Stryker
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;项目自己的验证程序也可以放到 &lt;code&gt;.wcode/executors.yaml&lt;/code&gt;。&lt;/p&gt;
&lt;p&gt;例如：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-yaml&#34; data-lang=&#34;yaml&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;schema_version: 1
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;executors:
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  - id: service-canary
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    stage: runtime_canary
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    languages: [go]
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    program: ./tools/check-canary
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    args: [--environment, staging]
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    cwd: .
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    timeout_seconds: 60
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;这里有个安全问题不能省：这些东西都会执行仓库控制的代码。&lt;/p&gt;
&lt;p&gt;以前我只有 &lt;code&gt;--allow-risky-exec&lt;/code&gt; 这个粗开关。现在仍然可以这么启动，适合我已经明确完全信任仓库的时候；但也可以让某个具体的 semantic refresh / runtime executor 先产生本地 Authorization Request，在 TUI 里批准这次 Session 里的精确操作，再重试。&lt;/p&gt;
&lt;p&gt;我更常用后者。&lt;/p&gt;
&lt;p&gt;只是跑一次工具，就没必要把整个进程后面的 risky execution 一起放开。&lt;/p&gt;
&lt;h2 id=&#34;maintainability-现在也是-gate&#34;&gt;Maintainability 现在也是 Gate&lt;a class=&#34;heading-anchor&#34; href=&#34;#maintainability-%e7%8e%b0%e5%9c%a8%e4%b9%9f%e6%98%af-gate&#34; aria-label=&#34;章节链接：Maintainability 现在也是 Gate&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;这一块是后面补的。&lt;/p&gt;
&lt;p&gt;我见过不少改动，测试全绿，功能也对，但代码明显开始往难维护的方向长。比如一个本来已经很大的文件又塞进去几百行，或者为了兼容一个特殊情况一路加 wrapper / branch，最后谁都不敢删。&lt;/p&gt;
&lt;p&gt;&lt;code&gt;review_changes&lt;/code&gt; 现在会先提供一些很笨但有用的结构信号：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;文件这次跨过 1,000 行
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;新增代码高度集中在一个源码文件
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;一次大改横跨多个 Product Scope
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;这些信号本身不能判定“代码烂”。&lt;/p&gt;
&lt;p&gt;所以 Medium 及以上 Risk 的 Plan 还会创建一个独立的 maintainability reviewer。&lt;/p&gt;
&lt;p&gt;它和 correctness reviewer 是两件事。&lt;/p&gt;
&lt;p&gt;Correctness Pass 不能替它签字。&lt;/p&gt;
&lt;p&gt;Maintainability Review 更关心的是：有没有更简单的做法、有没有散落的 special case、有没有多余的抽象层、有没有重复已有 helper、边界是不是开始泄漏。&lt;/p&gt;
&lt;p&gt;我不想用“测试通过”给这些问题盖章。&lt;/p&gt;
&lt;h2 id=&#34;reviewer-第一轮看不到别人怎么说&#34;&gt;Reviewer 第一轮看不到别人怎么说&lt;a class=&#34;heading-anchor&#34; href=&#34;#reviewer-%e7%ac%ac%e4%b8%80%e8%bd%ae%e7%9c%8b%e4%b8%8d%e5%88%b0%e5%88%ab%e4%ba%ba%e6%80%8e%e4%b9%88%e8%af%b4&#34; aria-label=&#34;章节链接：Reviewer 第一轮看不到别人怎么说&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;Verification Plan 可以创建多个独立 Reviewer Job。&lt;/p&gt;
&lt;p&gt;第一轮是 Blind Review。&lt;/p&gt;
&lt;p&gt;Reviewer A 不会先看到 Reviewer B 的结论。&lt;/p&gt;
&lt;p&gt;这个设计不是为了做什么复杂的多 Agent 社会实验，只是因为锚定效应太明显了。第二个 Reviewer 如果先看到第一个写着 Pass，经常会很自然地开始找理由支持它。&lt;/p&gt;
&lt;p&gt;如果最后一个 Pass、一个 Fail，wcode 不会算票数。&lt;/p&gt;
&lt;p&gt;会留下：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Disagree
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;争议就是争议。&lt;/p&gt;
&lt;p&gt;我宁愿停下来处理，也不想系统替我把它平均掉。&lt;/p&gt;
&lt;h2 id=&#34;真正想留下的是-evidence&#34;&gt;真正想留下的是 Evidence&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e7%9c%9f%e6%ad%a3%e6%83%b3%e7%95%99%e4%b8%8b%e7%9a%84%e6%98%af-evidence&#34; aria-label=&#34;章节链接：真正想留下的是 Evidence&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;Verification 最后要落成 Evidence。&lt;/p&gt;
&lt;p&gt;不是一句文本，而是带上下文的记录：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;producer
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;model
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;code revision
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;design revision
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;verification policy
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;result
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;confidence
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;timestamp
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;代码 revision 变了，旧 Plan 会被 stale blocker 卡住。&lt;/p&gt;
&lt;p&gt;不同 Stage Producer 也各自保留最新结果，一个 Runner 的 Pass 不会去覆盖另一个 Runner 的 Fail。&lt;/p&gt;
&lt;p&gt;现在 Stage 聚合是偏保守的：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Fail &amp;gt; Disagree &amp;gt; Inconclusive &amp;gt; Pass
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;验证系统如果非要选一个方向，我宁愿它烦一点，也别太乐观。&lt;/p&gt;
&lt;h2 id=&#34;这些运行状态没有塞进-git&#34;&gt;这些运行状态没有塞进 Git&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e8%bf%99%e4%ba%9b%e8%bf%90%e8%a1%8c%e7%8a%b6%e6%80%81%e6%b2%a1%e6%9c%89%e5%a1%9e%e8%bf%9b-git&#34; aria-label=&#34;章节链接：这些运行状态没有塞进 Git&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;Evidence、Verification Plan、Reviewer Job 这类状态会按 Workspace 持久化，但放在 wcode 自己的用户级 State 目录，不写进仓库。&lt;/p&gt;
&lt;p&gt;原因也简单。&lt;/p&gt;
&lt;p&gt;Git 里我想保留代码和 Design State。每跑一次测试都改仓库，只会制造一堆没必要的 Commit / Artifact 噪音。&lt;/p&gt;
&lt;p&gt;模型断开或者 wcode 重启以后，这些状态还能重新加载。&lt;/p&gt;
&lt;p&gt;这也是我后来开始做 Reconciliation 的前提：如果验证结果本身都只活在聊天里，那“换一个模型继续做”其实没有稳定交接面。&lt;/p&gt;
&lt;p&gt;Evidence 能留下来以后，长任务才有可能真正跨 Session 继续。也就是从这里，我开始认真做 &lt;a href=&#34;https://francisdu.com/blog/wcode-reconciliation/&#34;&gt;Reconciliation&lt;/a&gt;。&lt;/p&gt;
</description>
    </item>
    
    <item>
      <title>wcode：Git Diff 之外，我还想知道什么</title>
      <link>https://francisdu.com/blog/wcode-traceability/</link>
      <pubDate>Wed, 26 Aug 2026 03:13:00 +0800</pubDate>
      <guid>https://francisdu.com/blog/wcode-traceability/</guid>
      <description>&lt;p&gt;我做 Code Review 时很少只看 Diff。&lt;/p&gt;
&lt;p&gt;Diff 只是入口。&lt;/p&gt;
&lt;p&gt;看到一个函数被改，我脑子里会自动继续问：谁在调用它？这个模块原来为什么这么写？有没有对应测试？它是不是安全边界？这次只是重构，还是已经改变了设计？&lt;/p&gt;
&lt;p&gt;这些问题以前都靠人自己补。&lt;/p&gt;
&lt;p&gt;Agent 也一样，只不过它能补多少，很看这一次上下文有没有给够。&lt;/p&gt;
&lt;p&gt;所以做完 Design State 和 Software Graph 以后，我开始把其中一部分变成 wcode 可以直接算的东西。&lt;/p&gt;
&lt;h2 id=&#34;traceability-先回答最笨的问题&#34;&gt;Traceability 先回答最笨的问题&lt;a class=&#34;heading-anchor&#34; href=&#34;#traceability-%e5%85%88%e5%9b%9e%e7%ad%94%e6%9c%80%e7%ac%a8%e7%9a%84%e9%97%ae%e9%a2%98&#34; aria-label=&#34;章节链接：Traceability 先回答最笨的问题&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;&lt;code&gt;traceability_status&lt;/code&gt; 主要看几条链有没有断：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Requirement → Component
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Component → Implementation
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Acceptance Criterion → Verification
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;我一开始考虑过做一个总 Coverage。&lt;/p&gt;
&lt;p&gt;比如：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;87%
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;后来觉得没什么用。&lt;/p&gt;
&lt;p&gt;如果丢的是一个低优先级页面的 Acceptance，和丢的是 Workspace Root Isolation 的测试，显然不是同一件事。把它们平均成一个百分比，信息反而少了。&lt;/p&gt;
&lt;p&gt;所以现在直接分开报。&lt;/p&gt;
&lt;p&gt;我更想看到这种东西：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Requirement 还在
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Component 还在
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;但原来映射的 Symbol 已经搬走了
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;或者：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Acceptance 还指着一个已经改名的 test
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;这种错误没有多高级，但特别常见。&lt;/p&gt;
&lt;h2 id=&#34;product-scope-解决别把整个仓库都拖进来&#34;&gt;Product Scope 解决“别把整个仓库都拖进来”&lt;a class=&#34;heading-anchor&#34; href=&#34;#product-scope-%e8%a7%a3%e5%86%b3%e5%88%ab%e6%8a%8a%e6%95%b4%e4%b8%aa%e4%bb%93%e5%ba%93%e9%83%bd%e6%8b%96%e8%bf%9b%e6%9d%a5&#34; aria-label=&#34;章节链接：Product Scope 解决“别把整个仓库都拖进来”&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;wcode 后来又加了 Product Scope，因为只靠 Requirement 还不够。&lt;/p&gt;
&lt;p&gt;项目一大，Context 很容易横跨一堆不相关目录。&lt;/p&gt;
&lt;p&gt;现在我通常先跑 &lt;code&gt;scope_status&lt;/code&gt;，看看源码是怎么落在各个 Scope 里的，还有没有没归类的文件。真正做任务时，&lt;code&gt;software_context(scopes=...)&lt;/code&gt; 会把源码导航收窄到指定范围。&lt;/p&gt;
&lt;p&gt;例如我只在 &lt;code&gt;workspace&lt;/code&gt; / &lt;code&gt;risk&lt;/code&gt; 一类 Scope 里查，就不会顺手把 UI、Connector、Release 相关东西一起塞进来。&lt;/p&gt;
&lt;p&gt;这个功能对模型没有那么“惊艳”，但对长期项目很实用。Context 少一点，误判也少一点。&lt;/p&gt;
&lt;h2 id=&#34;drift-不是报错更像提醒&#34;&gt;Drift 不是报错，更像提醒&lt;a class=&#34;heading-anchor&#34; href=&#34;#drift-%e4%b8%8d%e6%98%af%e6%8a%a5%e9%94%99%e6%9b%b4%e5%83%8f%e6%8f%90%e9%86%92&#34; aria-label=&#34;章节链接：Drift 不是报错，更像提醒&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;Traceability 看的是“关系还通不通”，Drift 看的是“变化之后，两边是不是开始不一致”。&lt;/p&gt;
&lt;p&gt;现在大致有两类。&lt;/p&gt;
&lt;p&gt;一种是 Implementation Drift。&lt;/p&gt;
&lt;p&gt;Design 变了，代码没跟；或者原来声明的实现、验证链现在断了。&lt;/p&gt;
&lt;p&gt;另一种是 Design Drift。&lt;/p&gt;
&lt;p&gt;某个已经有 Design 身份的实现被改了，但这次 Design State 完全没动。&lt;/p&gt;
&lt;p&gt;第二种不能理解成“改代码必须改 YAML”。&lt;/p&gt;
&lt;p&gt;很多重构当然不需要改设计。&lt;/p&gt;
&lt;p&gt;所以它更像一句提醒：&lt;/p&gt;
&lt;blockquote&gt;
&lt;p&gt;这个地方在 Design State 里是有名字的，现在代码变了，确认一下原来的描述还成立。&lt;/p&gt;
&lt;/blockquote&gt;
&lt;p&gt;我不想把这种 heuristic 叫 formal verification。它没那么聪明。&lt;/p&gt;
&lt;h2 id=&#34;impact-是我真正天天想看的东西&#34;&gt;Impact 是我真正天天想看的东西&lt;a class=&#34;heading-anchor&#34; href=&#34;#impact-%e6%98%af%e6%88%91%e7%9c%9f%e6%ad%a3%e5%a4%a9%e5%a4%a9%e6%83%b3%e7%9c%8b%e7%9a%84%e4%b8%9c%e8%a5%bf&#34; aria-label=&#34;章节链接：Impact 是我真正天天想看的东西&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;Git 能给 Changed Paths，但 Review 时我通常还想看：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;碰到了哪些 Component
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;关联哪些 Requirement
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;哪些 Acceptance 需要重新验证
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;调用方有哪些
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;有没有 Public API 信号
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;有没有 Security Boundary
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;&lt;code&gt;impact_analysis&lt;/code&gt; 会从 Working Tree 开始，再沿 Composite Software Graph 往调用方扩。&lt;/p&gt;
&lt;p&gt;现在主要看 &lt;code&gt;Calls&lt;/code&gt; / &lt;code&gt;RuntimeCalls&lt;/code&gt; 这类关系。&lt;/p&gt;
&lt;p&gt;有 fresh LSP / Runtime Provider 就用更高精度的关系；没有就退到 Tree-sitter Syntax Edge。结果里会保留 Provider 和 Precision，不把不同来源混成一句“确定会影响”。&lt;/p&gt;
&lt;p&gt;这也是为什么前面 Software Graph 那篇我一直强调 provenance。&lt;/p&gt;
&lt;p&gt;没有 provenance，Impact 最后只剩一个很自信的列表，但没人知道它为什么这么判断。&lt;/p&gt;
&lt;h2 id=&#34;transitive-analysis-一定得有刹车&#34;&gt;Transitive Analysis 一定得有刹车&lt;a class=&#34;heading-anchor&#34; href=&#34;#transitive-analysis-%e4%b8%80%e5%ae%9a%e5%be%97%e6%9c%89%e5%88%b9%e8%bd%a6&#34; aria-label=&#34;章节链接：Transitive Analysis 一定得有刹车&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;调用图特别容易爆。&lt;/p&gt;
&lt;p&gt;一个底层 helper 可能被几百个地方用。如果“所有调用方的调用方再递归展开”没有上限，最后返回的 Context 比直接把仓库读一遍还离谱。&lt;/p&gt;
&lt;p&gt;所以 wcode 这类 Query 都是 bounded 的。&lt;/p&gt;
&lt;p&gt;到上限就明确返回：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;truncated = true
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;我宁愿看到一个“这里没展开完”，也不要看到一份看起来完整、其实只是因为上下文被截断而少东西的结果。&lt;/p&gt;
&lt;h2 id=&#34;review-里现在还会看代码是不是开始长歪&#34;&gt;Review 里现在还会看代码是不是开始长歪&lt;a class=&#34;heading-anchor&#34; href=&#34;#review-%e9%87%8c%e7%8e%b0%e5%9c%a8%e8%bf%98%e4%bc%9a%e7%9c%8b%e4%bb%a3%e7%a0%81%e6%98%af%e4%b8%8d%e6%98%af%e5%bc%80%e5%a7%8b%e9%95%bf%e6%ad%aa&#34; aria-label=&#34;章节链接：Review 里现在还会看代码是不是开始长歪&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;最近 &lt;code&gt;review_changes&lt;/code&gt; 又加了一些结构信号。&lt;/p&gt;
&lt;p&gt;例如：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;一个源码文件从 1,000 行以下跨到 1,000 行以上
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;大量净新增集中在一个文件
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;一次大改横跨多个 Product Scope
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;这些不会直接判“代码质量差”。&lt;/p&gt;
&lt;p&gt;它们只是进入 Risk，让后面的 Verification 决定是不是要增加 Maintainability Review。&lt;/p&gt;
&lt;p&gt;这个区别我觉得挺重要。&lt;/p&gt;
&lt;p&gt;工具可以很容易数行数，但“抽象是不是多余”“是不是出现了重复的 canonical helper”“是不是为了兼容又堆了一层 wrapper”，这些还是要 Review。&lt;/p&gt;
&lt;p&gt;所以确定性信号负责发现值得看一眼的地方，Reviewer 再判断是不是问题。&lt;/p&gt;
&lt;p&gt;现在 Project Observatory 也会把 Requirement、实现、Verification、Git Change 和依赖关系放在一起。我平时打开它，基本就是为了回答这篇文章标题那个问题：&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;Diff 之外，这次到底动了什么。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;Impact 算出来只是知道该看哪里，最后还是要落到“怎么证明这次改动真的可以”。Verification 和 Evidence 我放在 &lt;a href=&#34;https://francisdu.com/blog/wcode-verification/&#34;&gt;测试通过以后，我还想留下什么&lt;/a&gt; 里。&lt;/p&gt;
</description>
    </item>
    
    <item>
      <title>wcode 的 Software Graph：先承认自己不知道</title>
      <link>https://francisdu.com/blog/wcode-software-graph/</link>
      <pubDate>Wed, 26 Aug 2026 03:12:00 +0800</pubDate>
      <guid>https://francisdu.com/blog/wcode-software-graph/</guid>
      <description>&lt;p&gt;最早写 wcode 的代码索引时，我没想过要做什么 Software Graph。&lt;/p&gt;
&lt;p&gt;当时的问题很直接：模型一进大文件就喜欢整份读，几百上千行源码一股脑塞进上下文。于是我先做了 Tree-sitter，给它几个更小的入口：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;file_outline
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;find_symbol
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;symbol_context
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;这套东西到现在都还在，而且是我最喜欢的一层。便宜、稳定，不用启动项目。&lt;/p&gt;
&lt;p&gt;后来开始做 Impact，我才发现“临时查一下 Symbol”不够了。&lt;/p&gt;
&lt;p&gt;我需要知道 A 和 B 的关系，还需要知道这条关系是谁告诉我的、什么时候算出来的、源码变了以后还能不能信。&lt;/p&gt;
&lt;p&gt;这才有了 Software Graph。&lt;/p&gt;
&lt;h2 id=&#34;tree-sitter-知道的没有想象中那么多&#34;&gt;Tree-sitter 知道的没有想象中那么多&lt;a class=&#34;heading-anchor&#34; href=&#34;#tree-sitter-%e7%9f%a5%e9%81%93%e7%9a%84%e6%b2%a1%e6%9c%89%e6%83%b3%e8%b1%a1%e4%b8%ad%e9%82%a3%e4%b9%88%e5%a4%9a&#34; aria-label=&#34;章节链接：Tree-sitter 知道的没有想象中那么多&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;Tree-sitter 很适合做结构分析。&lt;/p&gt;
&lt;p&gt;定义在哪里、Range 是多少、Qualified Name 是什么，这些都比较稳。一些语法上能明确判断的调用关系，也可以抽出来。&lt;/p&gt;
&lt;p&gt;但它没有编译器的类型系统，也不会替我做宏展开、重载选择和动态分派。&lt;/p&gt;
&lt;p&gt;所以 Tree-sitter 产生的关系一直带着：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;provider = tree-sitter
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;precision = syntax
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;我后来越来越在意 &lt;code&gt;precision&lt;/code&gt; 这个词。&lt;/p&gt;
&lt;p&gt;做 Agent 工具时，很容易为了让返回结果“看起来更聪明”，把一个启发式结果包装得像确定事实。短期体验会很好，后面做 Impact、Risk 时却很危险，因为上层已经不知道底下到底有多靠谱。&lt;/p&gt;
&lt;p&gt;所以这里干脆先承认自己不知道。&lt;/p&gt;
&lt;h2 id=&#34;lsp-也不是装了就算-semantic&#34;&gt;LSP 也不是装了就算 semantic&lt;a class=&#34;heading-anchor&#34; href=&#34;#lsp-%e4%b9%9f%e4%b8%8d%e6%98%af%e8%a3%85%e4%ba%86%e5%b0%b1%e7%ae%97-semantic&#34; aria-label=&#34;章节链接：LSP 也不是装了就算 semantic&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;现在 wcode 有一套第一方 Semantic Provider，会探测 rust-analyzer、gopls、clangd、typescript-language-server、pyright 这些 Language Server。&lt;/p&gt;
&lt;p&gt;但“机器上有这个二进制”和“当前结果是 semantic”是两回事。&lt;/p&gt;
&lt;p&gt;只有 Language Server 真正启动、返回 Document Symbol / Call Hierarchy / Implementation，这些结果才进入 Graph，并标成：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;precision = semantic
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;Repository-aware Language Server 也不是默认无条件执行。&lt;/p&gt;
&lt;p&gt;它可能加载项目配置、Build Metadata、插件，甚至间接执行仓库里的东西。现在有两种授权方式：启动 wcode 时直接用 &lt;code&gt;--allow-risky-exec&lt;/code&gt; 做进程级放行；或者让具体 Refresh 先触发本地 Authorization Request，我在 TUI 里批准这个操作后再重试。&lt;/p&gt;
&lt;p&gt;后者是我后来补的，因为很多时候我只想临时跑一次 rust-analyzer，不想顺便把整个 Runtime 后面的高风险执行都放开。&lt;/p&gt;
&lt;h2 id=&#34;stale-semantic-比没有-semantic-更糟&#34;&gt;stale semantic 比没有 semantic 更糟&lt;a class=&#34;heading-anchor&#34; href=&#34;#stale-semantic-%e6%af%94%e6%b2%a1%e6%9c%89-semantic-%e6%9b%b4%e7%b3%9f&#34; aria-label=&#34;章节链接：stale semantic 比没有 semantic 更糟&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;这里有个很容易忽略的问题。&lt;/p&gt;
&lt;p&gt;假设上午跑过 rust-analyzer，拿到一组 Call Hierarchy；下午我已经把源码改了一大轮。如果 Impact 还拿上午的结果继续推导，它会表现得很“精准”，实际上精准地错了。&lt;/p&gt;
&lt;p&gt;所以第一方 LSP Fact 会带 &lt;code&gt;source_sha256&lt;/code&gt;。&lt;/p&gt;
&lt;p&gt;源码对不上，这个 Provider Revision 就会 stale。stale 的关系不会再进新的 Software Graph，也不会继续参与 &lt;code&gt;software_context&lt;/code&gt; 和 Impact。&lt;/p&gt;
&lt;p&gt;要用就重新 Refresh。&lt;/p&gt;
&lt;p&gt;这点比“自动保持 semantic 数据永远最新”笨一点，但边界清楚。&lt;/p&gt;
&lt;h2 id=&#34;同一条关系可以有几个答案&#34;&gt;同一条关系可以有几个答案&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e5%90%8c%e4%b8%80%e6%9d%a1%e5%85%b3%e7%b3%bb%e5%8f%af%e4%bb%a5%e6%9c%89%e5%87%a0%e4%b8%aa%e7%ad%94%e6%a1%88&#34; aria-label=&#34;章节链接：同一条关系可以有几个答案&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;Software Graph 没有试图把所有来源揉成一个最终真相。&lt;/p&gt;
&lt;p&gt;一条 Edge 会保留自己的：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;provider
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;precision
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;revision
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;attributes
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;所以同一个 &lt;code&gt;A -&amp;gt; B&lt;/code&gt; 完全可能同时有：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Tree-sitter syntax call
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;LSP semantic call
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Runtime observed call
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;它们不互相覆盖。&lt;/p&gt;
&lt;p&gt;如果以后接 SCIP、Compiler Index 或 Runtime Trace，也还是走同一个 provider-neutral contract。&lt;/p&gt;
&lt;p&gt;这样做的好处是，上层可以自己决定信谁。&lt;/p&gt;
&lt;p&gt;Impact 遇到真实 Runtime Edge，可以用真实运行关系；只有 Syntax Edge 也能继续工作，只是结果需要更保守。&lt;/p&gt;
&lt;h2 id=&#34;graph-history-解决的是另一个问题&#34;&gt;Graph History 解决的是另一个问题&lt;a class=&#34;heading-anchor&#34; href=&#34;#graph-history-%e8%a7%a3%e5%86%b3%e7%9a%84%e6%98%af%e5%8f%a6%e4%b8%80%e4%b8%aa%e9%97%ae%e9%a2%98&#34; aria-label=&#34;章节链接：Graph History 解决的是另一个问题&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;当 Graph 开始被拿来做分析以后，我还想看结构到底怎么变的。&lt;/p&gt;
&lt;p&gt;于是加了：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;graph_history
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;graph_query
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;graph_diff
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;这里没有每查询一次就存一份快照。图内容没变，就不制造历史噪音。&lt;/p&gt;
&lt;p&gt;Node 用稳定 ID 对齐。Edge 则按：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;from + to + kind + provider + precision
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;先找身份。&lt;/p&gt;
&lt;p&gt;如果只是 Revision 或 Attributes 变了，就算 &lt;code&gt;changed&lt;/code&gt;，而不是先删一条再新增一条。&lt;/p&gt;
&lt;p&gt;这类实现细节平时没什么存在感，但图一旦有几十版历史，没有稳定身份很快就看不下去了。&lt;/p&gt;
&lt;h2 id=&#34;我后来把-webui-的球图降级了&#34;&gt;我后来把 WebUI 的球图降级了&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e6%88%91%e5%90%8e%e6%9d%a5%e6%8a%8a-webui-%e7%9a%84%e7%90%83%e5%9b%be%e9%99%8d%e7%ba%a7%e4%ba%86&#34; aria-label=&#34;章节链接：我后来把 WebUI 的球图降级了&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;Software Graph 做完后，我也走过一个很自然的弯路：既然已经有图，那就在 WebUI 里画出来。&lt;/p&gt;
&lt;p&gt;于是有过一个能缩放、拖拽、点 Node 看 provenance 的 Graph Canvas。&lt;/p&gt;
&lt;p&gt;我自己打开几次以后发现，它更像 Debug Tool，不像项目管理页面。&lt;/p&gt;
&lt;p&gt;我真正想查的是某个 Requirement 现在由谁实现、Acceptance 在哪、设计依赖和代码依赖有没有分叉、最近改动碰到什么，而不是盯着几十个圆点猜哪条线比较重要。&lt;/p&gt;
&lt;p&gt;所以现在主 UI 已经改成 Project Observatory，按 Requirement 往下看 Feature、Component、Implementation、Verification 和 Git Change。&lt;/p&gt;
&lt;p&gt;低层 Graph 没消失。&lt;/p&gt;
&lt;p&gt;它仍然是 Context、Impact、历史 Diff 的数据来源，只是不再承担“解释整个项目”的视觉任务。&lt;/p&gt;
&lt;p&gt;做到这里我才确定一件事：底层有 Graph，不代表 UI 也应该是一团 Graph。&lt;/p&gt;
&lt;p&gt;Graph 到这里还只是底层事实。真正拿它去做 Review 时，问题会变成另一句：Diff 之外，这次到底动了什么。那部分我放在 &lt;a href=&#34;https://francisdu.com/blog/wcode-traceability/&#34;&gt;Git Diff 之外，我还想知道什么&lt;/a&gt; 里。&lt;/p&gt;
</description>
    </item>
    
    <item>
      <title>我为什么把 wcode 的需求写进仓库</title>
      <link>https://francisdu.com/blog/wcode-design-state/</link>
      <pubDate>Wed, 26 Aug 2026 03:11:00 +0800</pubDate>
      <guid>https://francisdu.com/blog/wcode-design-state/</guid>
      <description>&lt;p&gt;做 wcode 一段时间以后，我越来越不喜欢一种状态：代码里明明有很多约束，但这些约束只活在人脑里。&lt;/p&gt;
&lt;p&gt;比如 Workspace Root 为什么不能随便放宽，为什么 Symlink 要单独挡，为什么一个旧 SHA 不能继续写文件。代码看得出来“怎么做”，但不一定看得出来“为什么不能改成别的样子”。&lt;/p&gt;
&lt;p&gt;人长期待在项目里还好，换一个 Agent 进来，它看到的通常只有当前源码。&lt;/p&gt;
&lt;p&gt;于是我开始把一部分“为什么”写进仓库。&lt;/p&gt;
&lt;p&gt;不是 README，也不是另起一个 Wiki，而是一份机器也能读的 Design State。&lt;/p&gt;
&lt;h2 id=&#34;其实就是几份-yaml&#34;&gt;其实就是几份 YAML&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e5%85%b6%e5%ae%9e%e5%b0%b1%e6%98%af%e5%87%a0%e4%bb%bd-yaml&#34; aria-label=&#34;章节链接：其实就是几份 YAML&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;现在结构很普通：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;.wcode/
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;├── project.yaml
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;└── design/
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ├── product.yaml
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ├── requirements.yaml
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ├── components.yaml
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ├── constraints.yaml
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ├── acceptance.yaml
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    └── decisions.yaml
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;关键不在 YAML，而在稳定 ID。&lt;/p&gt;
&lt;p&gt;例如 Workspace Root Isolation 可以有一个 Requirement：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-yaml&#34; data-lang=&#34;yaml&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;- schema_version: 1
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  id: REQ-SEC-001
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  title: Workspace root isolation
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  intent: Remote models must never escape the configured workspace root.
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  priority: critical
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  implemented_by:
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    - component:workspace-security
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  acceptance:
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    - AC-SEC-001
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  constraints:
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    - CONSTRAINT-ROOT-ISOLATION
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;Component 再指到真实实现。现在 wcode 的目录已经拆过几轮，Workspace Root 相关实现就在：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-yaml&#34; data-lang=&#34;yaml&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;- schema_version: 1
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  id: component:workspace-security
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  name: Workspace Security
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  implementation:
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    - kind: symbol
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;      path: src/workspace/roots.rs
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;      symbol: Workspace::existing_path
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;Acceptance 最后落到测试：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-yaml&#34; data-lang=&#34;yaml&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;- schema_version: 1
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  id: AC-SEC-001
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  title: Workspace traversal is blocked
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  verification:
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    - kind: test
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;      path: src/workspace/mod.rs
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;      symbol: tests::blocks_path_traversal_and_stale_writes
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;最后能顺着一条真实链走下去：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;REQ-SEC-001
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;component:workspace-security
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;src/workspace/roots.rs::Workspace::existing_path
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;AC-SEC-001
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;src/workspace/mod.rs::tests::blocks_path_traversal_and_stale_writes
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;这件事看起来很朴素，但它改变了我给 Agent 下任务的方式。&lt;/p&gt;
&lt;p&gt;以前会说：&lt;/p&gt;
&lt;blockquote&gt;
&lt;p&gt;去看一下 workspace 相关代码，路径安全这里改一下。&lt;/p&gt;
&lt;/blockquote&gt;
&lt;p&gt;现在可以先从 Requirement 开始：&lt;/p&gt;
&lt;blockquote&gt;
&lt;p&gt;看一下 workspace root isolation 现在的实现、约束和验证。&lt;/p&gt;
&lt;/blockquote&gt;
&lt;p&gt;文件名反而是后面的事情。&lt;/p&gt;
&lt;h2 id=&#34;我不想维护第二份源码&#34;&gt;我不想维护第二份源码&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e6%88%91%e4%b8%8d%e6%83%b3%e7%bb%b4%e6%8a%a4%e7%ac%ac%e4%ba%8c%e4%bb%bd%e6%ba%90%e7%a0%81&#34; aria-label=&#34;章节链接：我不想维护第二份源码&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;Design State 最容易做过头。&lt;/p&gt;
&lt;p&gt;如果每个函数、每个类型、每条调用关系都要手工抄进 YAML，那这东西一定会烂掉。代码一重构，Design State 马上过期，最后大家只能一起假装它还可信。&lt;/p&gt;
&lt;p&gt;所以我现在只放那些值得稳定命名的东西：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Requirement
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Component responsibility
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Constraint
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Acceptance Criterion
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;重要 Decision
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;至于“这个函数现在调用谁”“某个模块里有哪些 Symbol”，让代码索引和 Software Graph 自己算。&lt;/p&gt;
&lt;p&gt;Design State 负责的是“应该是什么”，不是给源码做一份手写镜像。&lt;/p&gt;
&lt;h2 id=&#34;product-scope-是后来补的一层&#34;&gt;Product Scope 是后来补的一层&lt;a class=&#34;heading-anchor&#34; href=&#34;#product-scope-%e6%98%af%e5%90%8e%e6%9d%a5%e8%a1%a5%e7%9a%84%e4%b8%80%e5%b1%82&#34; aria-label=&#34;章节链接：Product Scope 是后来补的一层&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;项目拆大以后，我还遇到过另一个问题。&lt;/p&gt;
&lt;p&gt;Design State 能告诉我 Requirement 属于什么能力，但 Agent 做源码导航时仍然可能在整个仓库里乱跑。&lt;/p&gt;
&lt;p&gt;所以后来 wcode 又有了 Product Scope。&lt;/p&gt;
&lt;p&gt;它和 Design State 不是一回事。&lt;/p&gt;
&lt;p&gt;Design State 管稳定的产品意图，Product Scope 更像源码架构上的边界。现在 &lt;code&gt;scope_status&lt;/code&gt; 会检查源码落在哪些 Scope，还有没有没归类的文件；&lt;code&gt;software_context(scopes=...)&lt;/code&gt; 可以真的只在选定 Scope 里找相关源码。&lt;/p&gt;
&lt;p&gt;我自己用下来，两个东西刚好互补：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Design State：为什么有这个能力
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Product Scope：这类能力大致落在哪块源码
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Software Graph：代码现在实际怎么连
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;比起把所有东西都塞进一张图里，这样更容易维护。&lt;/p&gt;
&lt;h2 id=&#34;tree-sitter-解析到了也只能说明解析到了&#34;&gt;Tree-sitter 解析到了，也只能说明解析到了&lt;a class=&#34;heading-anchor&#34; href=&#34;#tree-sitter-%e8%a7%a3%e6%9e%90%e5%88%b0%e4%ba%86%e4%b9%9f%e5%8f%aa%e8%83%bd%e8%af%b4%e6%98%8e%e8%a7%a3%e6%9e%90%e5%88%b0%e4%ba%86&#34; aria-label=&#34;章节链接：Tree-sitter 解析到了，也只能说明解析到了&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;Component 和 Acceptance 可以引用 Symbol，但基础解析还是 Tree-sitter。&lt;/p&gt;
&lt;p&gt;所以结果会明确带：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;provider = tree-sitter
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;precision = syntax
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;这表示“这里有这个语法定义”，不是“编译器已经证明这就是最终绑定到的实现”。&lt;/p&gt;
&lt;p&gt;这种区别有时候很烦，尤其写展示页面时，直接写成“已解析”会好看很多。&lt;/p&gt;
&lt;p&gt;但我宁愿页面上多一个 &lt;code&gt;syntax&lt;/code&gt;，也不想让 Design State 借着结构化格式显得比底层事实更可靠。&lt;/p&gt;
&lt;h2 id=&#34;我最后还是让-wcode-管自己&#34;&gt;我最后还是让 wcode 管自己&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e6%88%91%e6%9c%80%e5%90%8e%e8%bf%98%e6%98%af%e8%ae%a9-wcode-%e7%ae%a1%e8%87%aa%e5%b7%b1&#34; aria-label=&#34;章节链接：我最后还是让 wcode 管自己&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;Design State 真正变得有用，是我开始拿它 Dogfood wcode 自己以后。&lt;/p&gt;
&lt;p&gt;源码一移动，Traceability 会暴露旧路径；Requirement 加了 Acceptance 但测试没接上，也会直接出现 Gap。现在 Project Observatory 里还能从 Requirement 一路看到 Component、当前实现、Verification 和这次 Git Change。&lt;/p&gt;
&lt;p&gt;这时候 &lt;code&gt;.wcode/design&lt;/code&gt; 才不是“又多了几份文档”。&lt;/p&gt;
&lt;p&gt;它真的进入了开发流程。&lt;/p&gt;
&lt;p&gt;当然它也会带来维护成本。改架构时，有时候代码改完还得回来修 Design mapping。这个成本我现在愿意付，因为不付的代价通常是几个月以后重新猜一遍为什么当初这么设计。&lt;/p&gt;
&lt;p&gt;下一篇是 &lt;a href=&#34;https://francisdu.com/blog/wcode-software-graph/&#34;&gt;Software Graph&lt;/a&gt;。Design State 解决“应该是什么”，Graph 解决的是另一个更麻烦的问题：代码现在到底是什么，而且我们对这个答案有多大把握。&lt;/p&gt;
</description>
    </item>
    
    <item>
      <title>wcode 最近做成什么样了</title>
      <link>https://francisdu.com/blog/wcode-2026/</link>
      <pubDate>Wed, 26 Aug 2026 03:10:00 +0800</pubDate>
      <guid>https://francisdu.com/blog/wcode-2026/</guid>
      <description>&lt;p&gt;我前几天写过一篇 &lt;a href=&#34;https://francisdu.com/blog/wcode/&#34;&gt;wcode 的第一版介绍&lt;/a&gt;。&lt;/p&gt;
&lt;p&gt;那篇写的是最早的 wcode：我想在 Web 端继续用自己喜欢的模型，又想让它们安全地碰到本地代码，所以做了 Remote MCP、OAuth、Workspace、Tree-sitter、文件修改和命令执行。&lt;/p&gt;
&lt;p&gt;这些东西现在都还在。&lt;/p&gt;
&lt;p&gt;但写完第一版没多久，我发现项目已经不是那篇文章里的样子了。&lt;/p&gt;
&lt;p&gt;底层没有推翻，反而越来越像基础设施。后来我反复改的其实是另一件事：一次代码修改结束以后，到底留下了什么。&lt;/p&gt;
&lt;p&gt;模型把代码改出来已经不算很难。难的是一个仓库被我、不同模型、不同工具来回改几十次以后，我还能不能回答这些问题：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;这段代码为什么必须这样？
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;它对应哪个需求？
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;这次修改实际碰到了哪些功能？
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;原来的约束还成立吗？
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;测试绿了，绿的是哪个 revision？
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;谁 review 过？
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;还有没有没处理完的东西？
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;Git 很擅长告诉我“哪里变了”，但它不会替我保存“为什么这么设计”。聊天记录更不适合做这个事情，换个模型基本就断了。&lt;/p&gt;
&lt;p&gt;所以最近 wcode 的重心慢慢从“给模型一套本地工具”，变成了“把软件本身的状态留下来”。&lt;/p&gt;
&lt;p&gt;现在粗略可以画成这样：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;.wcode Design State
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;        │
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;        ├── Requirement / Constraint / Acceptance
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;        │
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Product Scope ───── Source Code
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;        │              │
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;        └──── Software Graph
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;                    │
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;               Git Actual State
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;                    │
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;          Drift / Impact / Risk
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;                    │
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;          Reconciliation Plan
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;                    │
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;              Verification
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;                    │
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;                Evidence
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;这张图看起来比第一版复杂不少，但实际使用时反而更简单了：模型还是写代码，wcode 主要负责把它写代码前后那些容易丢掉的状态接起来。&lt;/p&gt;
&lt;figure class=&#34;content-image&#34;&gt;&lt;img src=&#34;https://francisdu.com/img/wcode/wcode-tui_hu_13e59e78ee0ce797.webp&#34; alt=&#34;wcode 最新终端实时面板&#34;loading=&#34;lazy&#34; decoding=&#34;async&#34; srcset=&#34;https://francisdu.com/img/wcode/wcode-tui_hu_13e59e78ee0ce797.webp 960w, https://francisdu.com/img/wcode/wcode-tui_hu_6437a17a51f06ca3.webp 1800w&#34; sizes=&#34;(max-width: 900px) calc(100vw - 32px), 900px&#34; width=&#34;3420&#34; height=&#34;2146&#34;&gt;&lt;/figure&gt;&lt;h2 id=&#34;我先把为什么放进仓库&#34;&gt;我先把“为什么”放进仓库&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e6%88%91%e5%85%88%e6%8a%8a%e4%b8%ba%e4%bb%80%e4%b9%88%e6%94%be%e8%bf%9b%e4%bb%93%e5%ba%93&#34; aria-label=&#34;章节链接：我先把“为什么”放进仓库&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;最先加的是 Design State。&lt;/p&gt;
&lt;p&gt;现在项目可以有一份 &lt;code&gt;.wcode&lt;/code&gt;：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;.wcode/
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;├── project.yaml
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;└── design/
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ├── product.yaml
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ├── requirements.yaml
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ├── components.yaml
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ├── constraints.yaml
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    ├── acceptance.yaml
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    └── decisions.yaml
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;我没有想把它做成另一种编程语言。里面主要是稳定 ID 和关系：Requirement 由哪个 Component 实现，Component 落在哪些代码上，Acceptance 最后由什么测试或检查来验证。&lt;/p&gt;
&lt;p&gt;这样我再改 Workspace Security 时，入口不一定非得是“先打开哪个 Rust 文件”。可以先问：这个 Requirement 现在的实现和验证在哪里。&lt;/p&gt;
&lt;p&gt;wcode 自己也在用这套 Design State。这个 Dogfood 很重要，因为只设计格式不用，很容易最后做出一堆看起来完整、实际没人愿意维护的 YAML。&lt;/p&gt;
&lt;h2 id=&#34;仓库大了以后我又加了-product-scope&#34;&gt;仓库大了以后，我又加了 Product Scope&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e4%bb%93%e5%ba%93%e5%a4%a7%e4%ba%86%e4%bb%a5%e5%90%8e%e6%88%91%e5%8f%88%e5%8a%a0%e4%ba%86-product-scope&#34; aria-label=&#34;章节链接：仓库大了以后，我又加了 Product Scope&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;后来代码继续长，另一个问题出来了。&lt;/p&gt;
&lt;p&gt;即使已经有 &lt;code&gt;software_context&lt;/code&gt;，一个任务如果每次都在整个仓库里找，返回的东西还是会越来越杂。尤其 wcode 自己同时有 Runtime、MCP、Workspace、Graph、Verification、UI，一句“看看安全问题”很容易把几个完全不同的模块一起捞回来。&lt;/p&gt;
&lt;p&gt;所以现在有一套固定的 Product Scope。&lt;/p&gt;
&lt;p&gt;它不是业务标签系统，更像 wcode 自己的能力分区。&lt;code&gt;scope_status&lt;/code&gt; 会告诉我源码现在落在哪些 Scope，还有哪些文件没有被归类；&lt;code&gt;software_context(scopes=...)&lt;/code&gt; 则可以真的把源码导航缩到选中的范围。&lt;/p&gt;
&lt;p&gt;这个功能的起因很朴素：我不想项目目录已经拆得很清楚了，Agent 进来以后又把它当成一个巨大的平面文件夹。&lt;/p&gt;
&lt;h2 id=&#34;software-graph-还在但我不再拿一团球当-ui&#34;&gt;Software Graph 还在，但我不再拿一团球当 UI&lt;a class=&#34;heading-anchor&#34; href=&#34;#software-graph-%e8%bf%98%e5%9c%a8%e4%bd%86%e6%88%91%e4%b8%8d%e5%86%8d%e6%8b%bf%e4%b8%80%e5%9b%a2%e7%90%83%e5%bd%93-ui&#34; aria-label=&#34;章节链接：Software Graph 还在，但我不再拿一团球当 UI&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;Tree-sitter 仍然是底座。&lt;/p&gt;
&lt;p&gt;它不需要启动项目，也不需要信任仓库配置，就能拿到定义、Range、Qualified Name 和一部分语法级调用关系。这些关系进入 Software Graph 时会老老实实写：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;provider = tree-sitter
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;precision = syntax
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;如果本机有对应 Language Server，而且我允许它运行，wcode 才会把真实返回的 Document Symbol、Call Hierarchy、Implementation 作为 semantic fact 加进去。&lt;/p&gt;
&lt;p&gt;源码变了以后，旧 LSP 结果会因为 Source Hash 不一致变成 stale，不再混进新的分析。&lt;/p&gt;
&lt;p&gt;Graph 也会留 meaningful history，可以看版本之间 Node / Edge 到底怎么变了。&lt;/p&gt;
&lt;p&gt;一开始我给 WebUI 做过一个可以拖拽、缩放、筛选的 Graph Canvas。技术上没什么问题，但我自己用几次就觉得没意思。&lt;/p&gt;
&lt;p&gt;我打开页面不是为了看一团会动的球。&lt;/p&gt;
&lt;p&gt;我想看的是：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;这个 Requirement 是什么
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;谁实现它
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;现在代码落在哪里
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Acceptance 怎么验证
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;这次 Git 改动碰了什么
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;设计依赖和代码依赖有没有对上
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;所以现在主界面已经换成 requirement-first 的 &lt;strong&gt;Project Observatory&lt;/strong&gt;。低层 Software Graph 还在，而且仍然参与 Impact、Context 和历史 Diff，只是不再被当成“产品首页”。&lt;/p&gt;
&lt;p&gt;这个改动我自己很喜欢。图是手段，不是目的。&lt;/p&gt;
&lt;h2 id=&#34;risk-不再只靠-prompt-提醒&#34;&gt;Risk 不再只靠 Prompt 提醒&lt;a class=&#34;heading-anchor&#34; href=&#34;#risk-%e4%b8%8d%e5%86%8d%e5%8f%aa%e9%9d%a0-prompt-%e6%8f%90%e9%86%92&#34; aria-label=&#34;章节链接：Risk 不再只靠 Prompt 提醒&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;以前让 Agent 改安全相关代码时，我经常会顺手补一句：&lt;/p&gt;
&lt;blockquote&gt;
&lt;p&gt;这个地方比较重要，多检查一下。&lt;/p&gt;
&lt;/blockquote&gt;
&lt;p&gt;现在回头看，这句话几乎没约束力。&lt;/p&gt;
&lt;p&gt;wcode 会把 Git Change、Traceability Gap、Drift、Design 里声明的风险以及一些结构性变化合起来，再决定 Verification 要走多深。&lt;/p&gt;
&lt;p&gt;最近还补了 Maintainability Review。&lt;/p&gt;
&lt;p&gt;例如一个文件这次改动后从 1,000 行以下跨到 1,000 行以上，或者大量代码集中长在一个文件里，或者一次变更横跨多个 Product Scope，&lt;code&gt;review_changes&lt;/code&gt; 会把它们作为结构信号提出来。&lt;/p&gt;
&lt;p&gt;这不是在声称“超过 1,000 行就一定烂”。它只是提醒：代码在往一个值得单独看一眼的方向长。&lt;/p&gt;
&lt;p&gt;Medium 及以上风险的 Verification Plan 还会有独立的 maintainability reviewer。Correctness 过了，不代表结构就可以不看。&lt;/p&gt;
&lt;h2 id=&#34;verification-现在会留下证据&#34;&gt;Verification 现在会留下证据&lt;a class=&#34;heading-anchor&#34; href=&#34;#verification-%e7%8e%b0%e5%9c%a8%e4%bc%9a%e7%95%99%e4%b8%8b%e8%af%81%e6%8d%ae&#34; aria-label=&#34;章节链接：Verification 现在会留下证据&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;&lt;code&gt;verify_project&lt;/code&gt; 还在做最普通的工程检查。&lt;/p&gt;
&lt;p&gt;Rust 项目仍然是这些：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;quick
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  git diff --check
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  cargo fmt --check
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  cargo check --locked
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;full
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  cargo test --locked
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  cargo clippy --locked -- -D warnings
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  cargo build --release --locked
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;更深一层的 Verification Plan 可以要求 Property、Mutation、Fuzz、Runtime Canary、独立 Reviewer 或 Human Approval。&lt;/p&gt;
&lt;p&gt;我以前最不喜欢 Agent 最后只留一句：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Tests passed.
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;现在 Verification 会形成 Evidence，至少能知道是谁产生的、针对哪个 code revision、哪个 design revision、什么 policy、结果是什么。&lt;/p&gt;
&lt;p&gt;Reviewer 结论冲突也不会被后来的 Pass 冲掉。冲突就是 &lt;code&gt;Disagree&lt;/code&gt;。&lt;/p&gt;
&lt;p&gt;“有争议”本身比“系统帮我平均成通过”更有用。&lt;/p&gt;
&lt;h2 id=&#34;reconciliation-是我最近改得最多的一块&#34;&gt;Reconciliation 是我最近改得最多的一块&lt;a class=&#34;heading-anchor&#34; href=&#34;#reconciliation-%e6%98%af%e6%88%91%e6%9c%80%e8%bf%91%e6%94%b9%e5%be%97%e6%9c%80%e5%a4%9a%e7%9a%84%e4%b8%80%e5%9d%97&#34; aria-label=&#34;章节链接：Reconciliation 是我最近改得最多的一块&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;早期 Coding Agent 的流程基本是：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;读 → 改 → 测 → 结束
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;现在我更关心“这个修改什么时候真的算结束”。&lt;/p&gt;
&lt;p&gt;Reconciliation Plan 会把 Drift、Impact、Risk、Change Intent 和 Verification Requirement 组织成有依赖的任务。执行状态可以 Claim、Submit、Retry，而且会持久化。&lt;/p&gt;
&lt;p&gt;所以一个模型做 Implementation，另一个模型来做 Security Review，再换一个补测试，不需要共享同一段聊天历史。&lt;/p&gt;
&lt;p&gt;它们面对的是同一个 Plan、同一个 revision、同一组 Evidence。&lt;/p&gt;
&lt;p&gt;不过 Reconciliation 没有一套隐藏的超级权限。真正改文件还是走 Workspace 的 Root、SHA、原子写入、Symlink/Hardlink 防护和授权逻辑。&lt;/p&gt;
&lt;p&gt;Plan 不能覆盖现实里的文件状态。&lt;/p&gt;
&lt;h2 id=&#34;有些权限我后来做得更细了&#34;&gt;有些权限我后来做得更细了&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e6%9c%89%e4%ba%9b%e6%9d%83%e9%99%90%e6%88%91%e5%90%8e%e6%9d%a5%e5%81%9a%e5%be%97%e6%9b%b4%e7%bb%86%e4%ba%86&#34; aria-label=&#34;章节链接：有些权限我后来做得更细了&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;第一版只有比较粗的 &lt;code&gt;--allow-risky-exec&lt;/code&gt;：启动时显式告诉 wcode，这个进程可以跑 repository-aware 的高风险执行。&lt;/p&gt;
&lt;p&gt;现在这条路径还在，但不是唯一方式。&lt;/p&gt;
&lt;p&gt;Language Server、Runtime Executor 这类操作，如果当前没有进程级授权，也可以先生成一个本地 Authorization Request。我在 TUI 或受保护 WebUI 里批准这个具体操作，再重试。&lt;/p&gt;
&lt;p&gt;现在还多了一层 &lt;code&gt;CommandAccess&lt;/code&gt;：模型请求一个当前 Workspace 尚未授权的裸可执行程序名时，会自动进入 Pending 列表。TUI 用 ↑/↓ 选择，&lt;code&gt;Y&lt;/code&gt; / &lt;code&gt;N&lt;/code&gt; 只处理当前选中请求；Project Observatory 也能逐条批准或拒绝，同时管理项目和已授权命令。批准某个 Program 不会开放 Shell，Shell Interpreter、路径逃逸和受保护资源仍是硬边界。&lt;/p&gt;
&lt;p&gt;删除更严格：&lt;code&gt;delete_path&lt;/code&gt; 只能删普通文件或空目录，文件还要带当前 SHA，而且授权是 exact one-shot，用完就没了。&lt;/p&gt;
&lt;p&gt;我更喜欢现在这个粒度。不是为了省一次确认，就把整个进程后面的高风险操作全部放开。&lt;/p&gt;
&lt;h2 id=&#34;mcp-反而退到了后面&#34;&gt;MCP 反而退到了后面&lt;a class=&#34;heading-anchor&#34; href=&#34;#mcp-%e5%8f%8d%e8%80%8c%e9%80%80%e5%88%b0%e4%ba%86%e5%90%8e%e9%9d%a2&#34; aria-label=&#34;章节链接：MCP 反而退到了后面&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;第一版文章里 MCP 是主角，现在它更像接口层。&lt;/p&gt;
&lt;p&gt;本地 Agent 直接走：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-bash&#34; data-lang=&#34;bash&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;wcode --workspace /absolute/path/to/repo mcp-stdio
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;Web / Cloud 端走 Streamable HTTP + OAuth。&lt;/p&gt;
&lt;p&gt;后面还是同一个 Workspace、Harness、Software Intelligence 和 Evidence Runtime。&lt;/p&gt;
&lt;p&gt;需要把工作习惯带到不同 Agent 时，可以导出一个很小的 Skill：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-bash&#34; data-lang=&#34;bash&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;wcode --workspace &lt;span style=&#34;color:#a31515&#34;&gt;&amp;#34;&lt;/span&gt;$PWD&lt;span style=&#34;color:#a31515&#34;&gt;&amp;#34;&lt;/span&gt; agent-plugin --output wcode-agent-plugin
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;它只有 Metadata 和 &lt;code&gt;SKILL.md&lt;/code&gt;，不会顺手塞 Hook、脚本、Credential，也不会替我猜 Workspace。&lt;/p&gt;
&lt;p&gt;Skill 告诉 Agent 怎么工作，MCP 决定它到底能做什么。我还是想把这两件事分开。&lt;/p&gt;
&lt;h2 id=&#34;现在我怎么用&#34;&gt;现在我怎么用&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e7%8e%b0%e5%9c%a8%e6%88%91%e6%80%8e%e4%b9%88%e7%94%a8&#34; aria-label=&#34;章节链接：现在我怎么用&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;平时还是：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-bash&#34; data-lang=&#34;bash&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;wcode --workspace &lt;span style=&#34;color:#a31515&#34;&gt;&amp;#34;&lt;/span&gt;$PWD&lt;span style=&#34;color:#a31515&#34;&gt;&amp;#34;&lt;/span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;进入一个不熟的仓库，我现在更习惯先看：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;workspace_info
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;scope_status
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;design_status
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;project_context
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;再根据任务选 Scope，用 &lt;code&gt;software_context&lt;/code&gt; 找代码。&lt;/p&gt;
&lt;p&gt;改完后才是：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;review_changes
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;→ drift_status / impact_analysis / risk_status
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;→ reconciliation / verification
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;→ evidence_status
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;TUI 里 &lt;code&gt;I&lt;/code&gt; 看 Intelligence，&lt;code&gt;W&lt;/code&gt; 打开 Project Observatory。&lt;/p&gt;
&lt;p&gt;这一套还在继续变，但方向已经和第一版很不一样了。第一版解决“怎么让模型安全地进仓库”，最近这些东西解决的是“它进来以后，项目怎么别越改越说不清楚”。&lt;/p&gt;
&lt;p&gt;后面几篇我分开写：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;&lt;a href=&#34;https://francisdu.com/blog/wcode-design-state/&#34;&gt;Design State：我为什么把需求写进仓库&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href=&#34;https://francisdu.com/blog/wcode-software-graph/&#34;&gt;Software Graph：先承认自己不知道&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href=&#34;https://francisdu.com/blog/wcode-traceability/&#34;&gt;Git Diff 之外，我还想知道什么&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href=&#34;https://francisdu.com/blog/wcode-verification/&#34;&gt;测试通过以后，我还想留下什么&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href=&#34;https://francisdu.com/blog/wcode-reconciliation/&#34;&gt;我为什么开始把 edit file 往后放&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href=&#34;https://francisdu.com/blog/wcode-mcp-agent/&#34;&gt;MCP 负责能力，Skill 只负责工作习惯&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href=&#34;https://francisdu.com/blog/wcode-security/&#34;&gt;我还是不想给 Agent 一个 Shell&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href=&#34;https://francisdu.com/blog/wcode-authorization/&#34;&gt;授权中心：模型可以提权限，但不能替我批准&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href=&#34;https://francisdu.com/blog/wcode-v0-3/&#34;&gt;wcode v0.3：从本地代码桥到 Software Intelligence Runtime&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href=&#34;https://francisdu.com/blog/wcode-v0-4/&#34;&gt;wcode v0.4：开始为 Agent 的上下文成本负责&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href=&#34;https://francisdu.com/blog/wcode-v0-5/&#34;&gt;wcode v0.5：我把 LSP 从一个工具，变成了 Agent 的常驻语义层&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href=&#34;https://francisdu.com/blog/wcode-performance/&#34;&gt;我把 wcode 写代码这条链又压快了一轮&lt;/a&gt;&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;代码在 &lt;a href=&#34;https://github.com/francis-du/wcode&#34;&gt;https://github.com/francis-du/wcode&lt;/a&gt;。&lt;/p&gt;
</description>
    </item>
    
    <item>
      <title>我写了 wcode：把 Web AI 接到本地代码库</title>
      <link>https://francisdu.com/blog/wcode/</link>
      <pubDate>Sun, 23 Aug 2026 18:30:00 +0800</pubDate>
      <guid>https://francisdu.com/blog/wcode/</guid>
      <description>&lt;p class=&#34;project-logo&#34;&gt;&lt;a href=&#34;https://wcode.francis.run/&#34; target=&#34;_blank&#34; rel=&#34;noopener&#34; title=&#34;打开 wcode 官网&#34;&gt;&lt;img src=&#34;https://francisdu.com/img/wcode/wcode-logo.svg&#34; alt=&#34;wcode 官网&#34; width=&#34;320&#34; height=&#34;96&#34;&gt;&lt;/a&gt;&lt;/p&gt;
&lt;p class=&#34;project-links&#34;&gt;&lt;a href=&#34;https://wcode.francis.run/&#34; target=&#34;_blank&#34; rel=&#34;noopener&#34;&gt;官网与文档 ↗&lt;/a&gt;&lt;a href=&#34;https://github.com/francis-du/wcode&#34; target=&#34;_blank&#34; rel=&#34;noopener&#34;&gt;GitHub ↗&lt;/a&gt;&lt;/p&gt;
&lt;blockquote&gt;
&lt;p&gt;这篇保留的是 wcode 第一版的实现状态，我不会跟着后续代码逐段回写。现在的版本已经继续做了 Design State、Product Scope、Verification、Evidence、Reconciliation 和 Project Observatory，见 &lt;a href=&#34;https://francisdu.com/blog/wcode-2026/&#34;&gt;wcode 最近做成什么样了&lt;/a&gt;。&lt;/p&gt;
&lt;/blockquote&gt;
&lt;p&gt;我平时会同时用几个 AI 的 Web 端。它们的模型和对话体验已经很好了，但一碰到本地项目，事情就变得很别扭：要么手动复制代码，要么换到另一个 Coding Agent，要么再申请 API Key、单独付一份 Token 账单。&lt;/p&gt;
&lt;p&gt;但我并不想再造一个 Agent。&lt;/p&gt;
&lt;p&gt;模型、上下文管理和 Agent Loop，Web 端都已经有了。我缺的只是一根管子，让它能在我允许的范围内读写本地代码。于是有了 &lt;a href=&#34;https://github.com/francis-du/wcode&#34;&gt;wcode&lt;/a&gt;：一个用 Rust 写的 Remote MCP Bridge。&lt;/p&gt;
&lt;p&gt;在项目目录里运行一个二进制，它会启动本地 MCP Server、OAuth、HTTPS Tunnel、配置页和终端监控。然后把生成的 &lt;code&gt;/mcp&lt;/code&gt; 地址加到 Grok、Claude、ChatGPT、Mistral 或其他支持 Remote MCP 的客户端里，就可以直接聊本地代码。&lt;/p&gt;
&lt;figure class=&#34;content-image&#34;&gt;&lt;img src=&#34;https://francisdu.com/img/wcode/wcode-tui_hu_13e59e78ee0ce797.webp&#34; alt=&#34;wcode 终端实时面板&#34;loading=&#34;lazy&#34; decoding=&#34;async&#34; srcset=&#34;https://francisdu.com/img/wcode/wcode-tui_hu_13e59e78ee0ce797.webp 960w, https://francisdu.com/img/wcode/wcode-tui_hu_6437a17a51f06ca3.webp 1800w&#34; sizes=&#34;(max-width: 900px) calc(100vw - 32px), 900px&#34; width=&#34;3420&#34; height=&#34;2146&#34;&gt;&lt;/figure&gt;&lt;p&gt;还有一个很现实的用法：&lt;strong&gt;薅 Web 端。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;如果一个 Web 产品允许在对话里接入自定义 MCP，那么模型继续用 Web 端提供的能力，代码搜索、读取、修改和验证则由本机的 wcode 完成。这样不需要为了 Code Agent 再配一套模型 API Key，也没有额外的按量 API Token 账单。&lt;/p&gt;
&lt;p&gt;这不是绕过平台限制。模型回复仍然受 Web 端自己的套餐、消息数、Credits、速率或上下文规则约束。准确地说，wcode 省掉的是“为了让 AI 访问本地代码，再买一份 API Token”的成本。&lt;/p&gt;
&lt;h2 id=&#34;wcode-只做桥接&#34;&gt;wcode 只做桥接&lt;a class=&#34;heading-anchor&#34; href=&#34;#wcode-%e5%8f%aa%e5%81%9a%e6%a1%a5%e6%8e%a5&#34; aria-label=&#34;章节链接：wcode 只做桥接&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;我一开始就给它定了边界：不负责选模型，不负责实现 Agent Loop，也不保存聊天记录。它只把 MCP 请求转换成受控的本地代码操作。&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Web AI / Coding Agent
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;          │
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;          │  Remote MCP + OAuth
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;          ▼
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;┌──────────────────────────────┐
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;│            wcode             │
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;│                              │
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;│ Auth ─ MCP ─ Tool Harness    │
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;│                 │            │
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;│       Code Index / Workspace │
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;└─────────────────┬────────────┘
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;                  │
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;                  ▼
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;          指定的代码目录
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;网络层用 Axum 和 Tokio，终端界面用 Ratatui，代码索引用 Tree-sitter。最后编译成一个原生二进制，没有数据库，也没有另外一组常驻服务。&lt;/p&gt;
&lt;p&gt;源码里的模块基本就是按照边界拆的：&lt;code&gt;auth.rs&lt;/code&gt; 管 OAuth，&lt;code&gt;mcp.rs&lt;/code&gt; 管协议和工具路由，&lt;code&gt;workspace.rs&lt;/code&gt; 管文件与命令安全，&lt;code&gt;code_index.rs&lt;/code&gt; 管语法索引，&lt;code&gt;harness.rs&lt;/code&gt; 管并发和项目级工作流，&lt;code&gt;monitor.rs&lt;/code&gt; 只记录并展示真实任务。&lt;/p&gt;
&lt;p&gt;启动时三个 Axum Router 会合到一起：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-rust&#34; data-lang=&#34;rust&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;&lt;span style=&#34;color:#00f&#34;&gt;let&lt;/span&gt; app = auth::router(auth.clone())
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    .merge(mcp::router(app_state))
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    .merge(control_router);
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;&lt;span style=&#34;color:#00f&#34;&gt;let&lt;/span&gt; server_task = tokio::spawn(&lt;span style=&#34;color:#00f&#34;&gt;async&lt;/span&gt; &lt;span style=&#34;color:#00f&#34;&gt;move&lt;/span&gt; {
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;    axum::serve(listener, app).&lt;span style=&#34;color:#00f&#34;&gt;await&lt;/span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;});
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;本地 Server 先启动，公网 Tunnel 后启动。这样即使 Cloudflare DNS 或 TLS 还在预热，本地服务和公网问题也不会搅在一起。&lt;/p&gt;
&lt;h2 id=&#34;一次-mcp-请求怎么进来&#34;&gt;一次 MCP 请求怎么进来&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e4%b8%80%e6%ac%a1-mcp-%e8%af%b7%e6%b1%82%e6%80%8e%e4%b9%88%e8%bf%9b%e6%9d%a5&#34; aria-label=&#34;章节链接：一次 MCP 请求怎么进来&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;wcode 的 &lt;code&gt;/mcp&lt;/code&gt; 不是拿到 URL 就能调用。一个请求真正进入工具层之前，要依次过四关：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Origin 是否匹配
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;        ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Bearer Token 是否有效，并绑定当前 Resource
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;        ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;MCP 协议版本是否支持
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;        ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Header、JSON-RPC method、_meta 是否一致
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;        ↓
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;tools/list 或 tools/call
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;MCP 生态还在快速变化，各个客户端升级并不同步。所以 wcode 里保留了两条路径：新协议走无状态 POST，老客户端仍然可以通过 &lt;code&gt;initialize&lt;/code&gt; 握手连接。未知版本会明确报错并返回支持的版本，不会悄悄猜一个版本继续跑。&lt;/p&gt;
&lt;p&gt;如果 HTTP 请求里带了 &lt;code&gt;Origin&lt;/code&gt;，wcode 会检查 Scheme、Host 和有效端口是否与公开 MCP 地址一致，同时拒绝额外的 Path、Query 和 Fragment。这不是普通的 CORS 装饰，主要是为了降低本地 HTTP Transport 被 DNS Rebinding 利用的风险。&lt;/p&gt;
&lt;p&gt;新协议的请求还会交叉检查 &lt;code&gt;Mcp-Method&lt;/code&gt; Header 和 JSON-RPC 的 &lt;code&gt;method&lt;/code&gt;。调用工具时，&lt;code&gt;Mcp-Name&lt;/code&gt; 也必须和 &lt;code&gt;params.name&lt;/code&gt; 对得上。协议边界宁愿多拒绝一次，也不应该模糊地接受两个互相矛盾的路由信息。&lt;/p&gt;
&lt;h2 id=&#34;oauth-为什么放在本地&#34;&gt;OAuth 为什么放在本地&lt;a class=&#34;heading-anchor&#34; href=&#34;#oauth-%e4%b8%ba%e4%bb%80%e4%b9%88%e6%94%be%e5%9c%a8%e6%9c%ac%e5%9c%b0&#34; aria-label=&#34;章节链接：OAuth 为什么放在本地&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;Grok、Claude 这类云端产品访问不到 &lt;code&gt;127.0.0.1&lt;/code&gt;，所以 wcode 默认会用 Cloudflare Quick Tunnel 创建临时 HTTPS 地址。但 Tunnel 只解决网络可达性，不负责授权。&lt;/p&gt;
&lt;p&gt;第一次访问 &lt;code&gt;/mcp&lt;/code&gt;，客户端会得到 &lt;code&gt;401&lt;/code&gt; 和 Protected Resource Metadata 地址：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-http&#34; data-lang=&#34;http&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;&lt;span style=&#34;color:#00f&#34;&gt;HTTP&lt;/span&gt;/1.1 401 Unauthorized
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;WWW-Authenticate: Bearer resource_metadata=&amp;#34;https://…/.well-known/oauth-protected-resource/mcp&amp;#34;, scope=&amp;#34;mcp&amp;#34;
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;后面的流程是标准 OAuth 2.1 + PKCE：客户端发现元数据、注册、打开授权页、交换 Authorization Code，最后拿到绑定当前 &lt;code&gt;/mcp&lt;/code&gt; Resource 的 Token。&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Client          /mcp          OAuth          Browser
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  │               │             │               │
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  ├─ POST ───────►│             │               │
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  │◄─ 401 + metadata ────────────┤               │
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  ├──────── register ───────────►│               │
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  ├──────── authorize + PKCE ───►├─ pairing ────►│
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  ├──────── exchange code ──────►│               │
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  │◄──────── access token ───────┤               │
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  └─ Bearer + tools/call ───────►│               │
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;授权页还要输入终端显示的六位验证码。只拿到临时公网 URL 的人，不能直接替你授权。Authorization Code 是单次、短时的，Refresh Token 会轮换，Redirect URI 只接受 HTTPS 或受约束的 Loopback 地址。&lt;/p&gt;
&lt;p&gt;MCP 新版更推荐 Client ID Metadata Document，但我没有默认抓取客户端随便给出的 Metadata URL。自动化是多了一点，同时也新开了一个出站网络、SSRF 和 DNS Rebinding 的口子。在没有完整处理这个信任边界之前，我更愿意保留 DCR 兼容路径。&lt;/p&gt;
&lt;figure class=&#34;content-image&#34;&gt;&lt;img src=&#34;https://francisdu.com/img/wcode/wcode-setup-hub_hu_dd9c03ed1e405294.webp&#34; alt=&#34;wcode Setup Hub&#34;loading=&#34;lazy&#34; decoding=&#34;async&#34; srcset=&#34;https://francisdu.com/img/wcode/wcode-setup-hub_hu_dd9c03ed1e405294.webp 960w, https://francisdu.com/img/wcode/wcode-setup-hub_hu_90866dee58816e01.webp 1600w&#34; sizes=&#34;(max-width: 900px) calc(100vw - 32px), 900px&#34; width=&#34;1600&#34; height=&#34;1000&#34;&gt;&lt;/figure&gt;&lt;p&gt;授权面板把项目、命令白名单和精确仓库操作的授权放在本地显式管理，模型不能批准自己的请求：&lt;/p&gt;
&lt;figure class=&#34;content-image&#34;&gt;&lt;img src=&#34;https://francisdu.com/img/wcode/wcode-access-management_hu_ac447683faaa24eb.webp&#34; alt=&#34;wcode 授权与访问控制&#34;loading=&#34;lazy&#34; decoding=&#34;async&#34; srcset=&#34;https://francisdu.com/img/wcode/wcode-access-management_hu_ac447683faaa24eb.webp 960w, https://francisdu.com/img/wcode/wcode-access-management_hu_e5f2de5679dfbc7e.webp 1600w&#34; sizes=&#34;(max-width: 900px) calc(100vw - 32px), 900px&#34; width=&#34;1600&#34; height=&#34;1000&#34;&gt;&lt;/figure&gt;&lt;h2 id=&#34;文件沙箱最麻烦的不是-&#34;&gt;文件沙箱最麻烦的不是 &lt;code&gt;../&lt;/code&gt;&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e6%96%87%e4%bb%b6%e6%b2%99%e7%ae%b1%e6%9c%80%e9%ba%bb%e7%83%a6%e7%9a%84%e4%b8%8d%e6%98%af-&#34; aria-label=&#34;章节链接：文件沙箱最麻烦的不是 ../&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;最早写 Workspace 层时，我很快发现：检查一下路径里有没有 &lt;code&gt;..&lt;/code&gt;，离“只能访问这个目录”还差得很远。&lt;/p&gt;
&lt;p&gt;每个工作区在启动时都会先 &lt;code&gt;canonicalize&lt;/code&gt;。文件系统根目录、Home 目录这类范围过大的 Root 默认拒绝；多个工作区如果是父子关系，也默认拒绝。在 Unix 上，wcode 还会记住 Root 的 Device/Inode。&lt;/p&gt;
&lt;p&gt;每次文件操作之前，Root 都要重新解析并核对身份。如果服务启动后，同一路径被换成了另一个目录，即使字符串完全没变，操作也会中止并要求重启。&lt;/p&gt;
&lt;p&gt;模型传进来的路径只能是相对路径，除此之外还会拒绝：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;&lt;code&gt;..&lt;/code&gt;、绝对路径和 Windows Prefix；&lt;/li&gt;
&lt;li&gt;含冒号的 Path Component，避免 Alternate Data Streams；&lt;/li&gt;
&lt;li&gt;&lt;code&gt;.git&lt;/code&gt;、&lt;code&gt;.env*&lt;/code&gt;、密钥和常见凭据位置；&lt;/li&gt;
&lt;li&gt;路径中的任意 Symlink Component；&lt;/li&gt;
&lt;li&gt;Unix 上指向多处的 Hard Link 写入。&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;已有文件和新文件也不能用同一套解析逻辑。已有文件可以 Canonicalize 到最终目标，再确认它仍在 Root 内；新文件的叶子还不存在，只能先解析父目录，然后确认父目录没有逃出去。&lt;/p&gt;
&lt;p&gt;读文件本身也有竞态。wcode 在读取前后各取一次 Metadata，比对长度和修改时间。如果中途变了，这次读取直接失败，让客户端重试。成功返回时会同时带一个 SHA-256，后续编辑必须使用它。&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;stat before → read → stat after → SHA-256
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;     │                 │
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;     └── 不相等就重试 ─┘
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;h2 id=&#34;防止-ai-用旧上下文覆盖新代码&#34;&gt;防止 AI 用旧上下文覆盖新代码&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e9%98%b2%e6%ad%a2-ai-%e7%94%a8%e6%97%a7%e4%b8%8a%e4%b8%8b%e6%96%87%e8%a6%86%e7%9b%96%e6%96%b0%e4%bb%a3%e7%a0%81&#34; aria-label=&#34;章节链接：防止 AI 用旧上下文覆盖新代码&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;假设模型读到了版本 A。在它思考的几秒里，我手动改成了版本 B。模型如果还按 A 去替换文本，很容易把我的改动一起覆盖掉。&lt;/p&gt;
&lt;p&gt;wcode 的写入同时用了三层保护：请求携带读取时的 SHA-256；同一个文件的并发写入使用一把进程内锁；真正拿到锁以后，再重新解析路径、读取文件并检查哈希。&lt;/p&gt;
&lt;p&gt;写入也不是直接 &lt;code&gt;truncate&lt;/code&gt; 原文件。它会在相同目录创建一个 &lt;code&gt;create_new&lt;/code&gt; 临时文件，写完 &lt;code&gt;sync_all&lt;/code&gt;，继承原权限，再原子替换目标。Unix 走同文件系统的 &lt;code&gt;rename&lt;/code&gt;；Windows 使用带 &lt;code&gt;REPLACE_EXISTING&lt;/code&gt; 和 &lt;code&gt;WRITE_THROUGH&lt;/code&gt; 的系统调用。最后再尽量同步父目录。&lt;/p&gt;
&lt;p&gt;创建文件是另一条路径。临时文件会以 Create-new 语义落到目标位置；如果另一个任务恰好先创建了同名文件，这次请求失败，不会覆盖它。&lt;/p&gt;
&lt;p&gt;另外我没有给模型 Delete Tool。大幅缩短现有文件也会被当成破坏性写入，除非用户显式开启 &lt;code&gt;--allow-destructive-writes&lt;/code&gt;。这不保证 AI 永远不犯错，但能把最难恢复的错误挡在默认路径之外。&lt;/p&gt;
&lt;h2 id=&#34;tree-sitter-只承诺语法精度&#34;&gt;Tree-sitter 只承诺语法精度&lt;a class=&#34;heading-anchor&#34; href=&#34;#tree-sitter-%e5%8f%aa%e6%89%bf%e8%af%ba%e8%af%ad%e6%b3%95%e7%b2%be%e5%ba%a6&#34; aria-label=&#34;章节链接：Tree-sitter 只承诺语法精度&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;如果工具只有全文搜索和 &lt;code&gt;read_file&lt;/code&gt;，模型很容易退化成“把整个文件发给我看看”。上下文浪费大，定位也不精确。&lt;/p&gt;
&lt;p&gt;wcode 内置 Tree-sitter，提供三个语法级工具：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;&lt;code&gt;file_outline&lt;/code&gt;：列出定义、签名和准确范围；&lt;/li&gt;
&lt;li&gt;&lt;code&gt;find_symbol&lt;/code&gt;：跨文件查找定义；&lt;/li&gt;
&lt;li&gt;&lt;code&gt;symbol_context&lt;/code&gt;：围绕一个符号返回有限正文、嵌套定义和语法调用。&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;索引是 Lazy 的。只有真正请求某个文件或符号时才解析；目录搜索会先做便宜的文本预过滤，再对候选源码建树。完整 AST Cache 最多保留 128 个文件，目录符号搜索最多扫描 50,000 个源文件。写入成功后，对应的 Symbol Record 和 AST 会立即失效。&lt;/p&gt;
&lt;p&gt;这里我刻意没有把结果包装成“语义理解”。所有模型可见的索引结果都写着：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-json&#34; data-lang=&#34;json&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;{
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  &amp;#34;provider&amp;#34;: &lt;span style=&#34;color:#a31515&#34;&gt;&amp;#34;tree-sitter&amp;#34;&lt;/span&gt;,
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  &amp;#34;precision&amp;#34;: &lt;span style=&#34;color:#a31515&#34;&gt;&amp;#34;syntax&amp;#34;&lt;/span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;}
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;它能回答哪里定义了函数、语法上出现了哪些调用，但不假装自己做了宏展开、类型推断、重载选择或动态分派。对 Agent 工具来说，明确能力边界比伪造一个很强的答案更重要。&lt;/p&gt;
&lt;h2 id=&#34;并发不是越满越好&#34;&gt;并发不是越满越好&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e5%b9%b6%e5%8f%91%e4%b8%8d%e6%98%af%e8%b6%8a%e6%bb%a1%e8%b6%8a%e5%a5%bd&#34; aria-label=&#34;章节链接：并发不是越满越好&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;wcode 只有一个全局 Tokio &lt;code&gt;Semaphore&lt;/code&gt;，所有真实工具任务都从这里拿 Permit。默认上限是逻辑 CPU 数的八倍，并 Clamp 到 64–128；也可以通过 &lt;code&gt;-j&lt;/code&gt; 调整，内部硬上限是 256。&lt;/p&gt;
&lt;p&gt;一条任务只走这几个状态：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;queued → acquire permit → running → completed / failed
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;&lt;code&gt;parallel_tools&lt;/code&gt;、&lt;code&gt;review_changes&lt;/code&gt; 和 &lt;code&gt;verify_project&lt;/code&gt; 这类组合工具有个容易踩的坑：父任务不能先占一个 Permit，再等子任务。否则当 &lt;code&gt;-j 1&lt;/code&gt; 时，父任务拿走唯一槽位，子任务永远跑不起来。&lt;/p&gt;
&lt;p&gt;所以组合工具本身不占父 Permit，每个真正做事的 Child 自己排队。&lt;code&gt;parallel_tools&lt;/code&gt; 只允许 Read/Discovery 操作，最多 128 个子任务；单个结果最多 512 KiB，总响应最多 8 MiB。&lt;/p&gt;
&lt;p&gt;另一方面，能一次遍历做完的工作没有必要强行并行。&lt;code&gt;search_many&lt;/code&gt; 和 &lt;code&gt;read_files&lt;/code&gt; 会优先做批量操作，减少 MCP Round Trip。互相依赖的编辑保持串行，Cargo Test、Clippy、Build 这类重任务也分阶段执行，避免一起争抢编译缓存。&lt;/p&gt;
&lt;p&gt;TUI 里的 Slots 和 Peak 就来自这些真实 Permit，不是 UI 模拟出来的繁忙程度。&lt;/p&gt;
&lt;h2 id=&#34;我不想给模型一个远程-shell&#34;&gt;我不想给模型一个远程 Shell&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e6%88%91%e4%b8%8d%e6%83%b3%e7%bb%99%e6%a8%a1%e5%9e%8b%e4%b8%80%e4%b8%aa%e8%bf%9c%e7%a8%8b-shell&#34; aria-label=&#34;章节链接：我不想给模型一个远程 Shell&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;&lt;code&gt;run_command&lt;/code&gt; 接收的是 Program 和 Argument Array，从来不经过 Shell。默认允许面很窄：受限制的 Git/ripgrep 只读操作，以及形状完全匹配的 &lt;code&gt;cargo fmt --check&lt;/code&gt;、&lt;code&gt;cargo check&lt;/code&gt;、&lt;code&gt;cargo check --locked&lt;/code&gt;。&lt;/p&gt;
&lt;p&gt;Git Mutation 始终阻止。子进程的 &lt;code&gt;GIT_*&lt;/code&gt; 状态会被清理，交互式 Prompt、Helper、外部 Diff 以及能改变仓库发现范围的配置也会被拒绝。stdout/stderr 有上限，执行有 Timeout，敏感环境变量不会传进去。&lt;/p&gt;
&lt;p&gt;为什么连 Build 和 Test 也不默认放开？因为 Cargo Build Script、Proc Macro、Makefile、Package Script 和测试代码都由仓库控制。“这是一个测试命令”不代表它安全。&lt;/p&gt;
&lt;p&gt;项目级验证走 &lt;code&gt;verify_project&lt;/code&gt;。Harness 会先识别 Cargo、Go、Node、Flutter、Make 等项目，再根据 Manifest 和仓库规则推导检查命令。只有通过 Exact-shape Validation 的命令，才会临时进入验证通道。便宜的检查可以重叠，编译重任务按阶段跑，返回给模型的诊断只保留有界尾部。&lt;/p&gt;
&lt;p&gt;&lt;code&gt;--allow-risky-exec&lt;/code&gt; 可以放宽命令策略，但它是一次明确的信任扩张，不是 OS Sandbox。我不希望为了让 Demo 看起来“什么都能跑”，把这个 Flag 默认打开。&lt;/p&gt;
&lt;h2 id=&#34;harness-不是一句-prompt&#34;&gt;Harness 不是一句 Prompt&lt;a class=&#34;heading-anchor&#34; href=&#34;#harness-%e4%b8%8d%e6%98%af%e4%b8%80%e5%8f%a5-prompt&#34; aria-label=&#34;章节链接：Harness 不是一句 Prompt&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;这里单独说一下 Harness，因为它不是在 System Prompt 里写一句“改完记得跑测试”。它是一层有状态、可执行、带边界的工程工作流。&lt;/p&gt;
&lt;p&gt;模型第一次进入仓库，应该先调用 &lt;code&gt;project_context&lt;/code&gt;。Harness 会查看根目录里的 Manifest 和 Lockfile，识别 Rust、Node、Python、Go、Make 等项目类型；同时按固定优先级读取 &lt;code&gt;AGENTS.md&lt;/code&gt;、&lt;code&gt;CLAUDE.md&lt;/code&gt;、&lt;code&gt;README.md&lt;/code&gt; 一类仓库说明。每个文件有行数和字符上限，所有说明还有总字符预算，内容仍然经过 Workspace 的敏感信息脱敏。&lt;/p&gt;
&lt;p&gt;识别结果会生成一个 &lt;code&gt;ProjectProfile&lt;/code&gt;，里面包括项目类型、Manifest、仓库规则、推荐检查和默认工作流。例如发现 &lt;code&gt;Cargo.toml&lt;/code&gt; 时，会推导：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;quick: git diff --check
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;quick: cargo fmt --check
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;quick: cargo check --locked
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;full:  cargo test --locked
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;full:  cargo clippy --locked -- -D warnings
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;full:  cargo build --release --locked
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;如果存在 &lt;code&gt;package.json&lt;/code&gt;，Harness 只读取实际存在的 &lt;code&gt;lint&lt;/code&gt;、&lt;code&gt;typecheck&lt;/code&gt;、&lt;code&gt;check&lt;/code&gt;、&lt;code&gt;format:check&lt;/code&gt;、&lt;code&gt;test&lt;/code&gt;、&lt;code&gt;build&lt;/code&gt; Script，并根据 Lockfile 选择 npm、pnpm、yarn 或 bun。Makefile 也只识别明确存在的 &lt;code&gt;check&lt;/code&gt;、&lt;code&gt;lint&lt;/code&gt;、&lt;code&gt;test&lt;/code&gt; Target，不凭空猜命令。&lt;/p&gt;
&lt;p&gt;Project Profile 会缓存，但不是永远不变。Fingerprint 来自 Manifest 和 Guidance 的 Metadata；这些文件变化后，下次请求会重新构建。构建发生在 Cache Lock 外面，避免一个大仓库的上下文发现阻塞其他 Workspace。写回缓存前再检查一次，解决并发请求重复构建时的竞态。&lt;/p&gt;
&lt;p&gt;&lt;code&gt;review_changes&lt;/code&gt; 也没有直接返回整份 Git Diff。它并行跑五个只读 Probe：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;git status
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;unstaged numstat     staged numstat
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;unstaged diff-check  staged diff-check
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;Harness 把结果合并成文件列表、增删行数和风险分类。改了源码却没改测试、动了认证或 Token 文件、改了 Manifest、删了测试、碰了 Migration/Workflow，都会产生对应 Finding。变更超过 25 个文件或约 1,000 行会提示拆分；风险再高一些时，会直接推荐 Full Verification。这里最多分析 500 个文件、保留 64 条 Finding，避免一个巨大 Working Tree 把上下文打爆。&lt;/p&gt;
&lt;p&gt;这些分析结果在 WebUI 里可以直接看到：当前变更、每个文件命中的 Requirement、代码统计和风险等级：&lt;/p&gt;
&lt;figure class=&#34;content-image&#34;&gt;&lt;img src=&#34;https://francisdu.com/img/wcode/wcode-workspace-intelligence_hu_24fb32e29a6a581a.webp&#34; alt=&#34;wcode 工作区智能视图&#34;loading=&#34;lazy&#34; decoding=&#34;async&#34; srcset=&#34;https://francisdu.com/img/wcode/wcode-workspace-intelligence_hu_24fb32e29a6a581a.webp 960w, https://francisdu.com/img/wcode/wcode-workspace-intelligence_hu_6e8fd5f6bd6bada.webp 1600w&#34; sizes=&#34;(max-width: 900px) calc(100vw - 32px), 900px&#34; width=&#34;1600&#34; height=&#34;1000&#34;&gt;&lt;/figure&gt;&lt;p&gt;&lt;code&gt;verify_project&lt;/code&gt; 接受 &lt;code&gt;quick&lt;/code&gt; 或 &lt;code&gt;full&lt;/code&gt;。它先把推导出的检查排序，再按 Phase 执行：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Phase 0  format / static check / diff check
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;   ↓ barrier
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Phase 1  tests
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;   ↓ barrier
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Phase 2  clippy
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;   ↓ barrier
&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;Phase 3  release build
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;同一个 Phase 内彼此独立的检查可以并发，不同 Phase 之间有 Barrier。这样既不把所有命令串行到底，也不会让 Test、Clippy 和 Release Build 同时争 Cargo Cache。每个检查仍然单独获取全局 Semaphore Permit，单独进入 Monitor，并返回 Exit Code、耗时与截断后的 stdout/stderr 尾部。&lt;/p&gt;
&lt;p&gt;最关键的是，&lt;code&gt;verify_project&lt;/code&gt; 不能借“自动验证”绕过命令策略。推导出的 Program 和 Args 还要经过内部 Exact-shape Validator，只临时放行这一条已经识别的命令，再委托给同一个 Workspace Command Policy。Harness 提供的是一条更容易走对的路，不是第二个后门。&lt;/p&gt;
&lt;p&gt;需求详情页把 Desired State → Actual State → Change → Proof → Convergence 排成一条链，验证证据挂在 Proof 一环：&lt;/p&gt;
&lt;figure class=&#34;content-image&#34;&gt;&lt;img src=&#34;https://francisdu.com/img/wcode/wcode-verification-detail_hu_11b6c44307e59389.webp&#34; alt=&#34;wcode 需求验证证据&#34;loading=&#34;lazy&#34; decoding=&#34;async&#34; srcset=&#34;https://francisdu.com/img/wcode/wcode-verification-detail_hu_11b6c44307e59389.webp 960w, https://francisdu.com/img/wcode/wcode-verification-detail_hu_a6a04b35e0461913.webp 1600w&#34; sizes=&#34;(max-width: 900px) calc(100vw - 32px), 900px&#34; width=&#34;1600&#34; height=&#34;1000&#34;&gt;&lt;/figure&gt;&lt;h2 id=&#34;tunnel-挂了以后怎么办&#34;&gt;Tunnel 挂了以后怎么办&lt;a class=&#34;heading-anchor&#34; href=&#34;#tunnel-%e6%8c%82%e4%ba%86%e4%bb%a5%e5%90%8e%e6%80%8e%e4%b9%88%e5%8a%9e&#34; aria-label=&#34;章节链接：Tunnel 挂了以后怎么办&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;每个 wcode 进程都有一个随机 &lt;code&gt;instance_id&lt;/code&gt;。&lt;code&gt;cloudflared&lt;/code&gt; 输出公网 URL 后，wcode 不会立刻显示 Ready，而是从公网请求 &lt;code&gt;/healthz&lt;/code&gt;。只有响应里的 &lt;code&gt;ok&lt;/code&gt; 为真，并且 &lt;code&gt;instance_id&lt;/code&gt; 与当前进程一致，才会打开 Setup Hub。&lt;/p&gt;
&lt;p&gt;这个检查主要防两个问题：Tunnel 的 DNS/TLS 还没准备好；或者同一台机器上的另一个 wcode 实例恰好能响应，造成假就绪。&lt;/p&gt;
&lt;p&gt;运行期间每 25 秒检查一次公网状态。连续失败三次，或者发现自己启动的 &lt;code&gt;cloudflared&lt;/code&gt; 子进程退出，就把整个 Runtime 当成恢复边界：先恢复终端，再停健康任务和本地 Server，Kill 并 Wait 子进程，最后用原参数重新启动。&lt;/p&gt;
&lt;p&gt;Quick Tunnel 重启后 URL 可能会变，所以 wcode 不会假装旧 OAuth 状态还能继续用。需要稳定地址时，应该配置自己的 Reverse Proxy，再通过 &lt;code&gt;--public-url&lt;/code&gt; 交给 wcode。&lt;/p&gt;
&lt;p&gt;&lt;code&gt;wcode restart&lt;/code&gt; 和 &lt;code&gt;wcode stop&lt;/code&gt; 复用了同一条 Graceful Shutdown 路径。控制接口有一枚 256-bit 本地随机 Token，保存在权限为 &lt;code&gt;0600&lt;/code&gt; 的 Runtime File 中，并做 Constant-time Compare。因为这条 Route 也可能被公网反向代理带出去，所以“它只在本机用”不能成为免认证的理由。&lt;/p&gt;
&lt;h2 id=&#34;tui-展示的都是真实状态&#34;&gt;TUI 展示的都是真实状态&lt;a class=&#34;heading-anchor&#34; href=&#34;#tui-%e5%b1%95%e7%a4%ba%e7%9a%84%e9%83%bd%e6%98%af%e7%9c%9f%e5%ae%9e%e7%8a%b6%e6%80%81&#34; aria-label=&#34;章节链接：TUI 展示的都是真实状态&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;Ratatui 面板里有本地服务、公网 Tunnel、OAuth、MCP 最近活动、工作区任务、队列、Slots、Peak 和吞吐量。&lt;/p&gt;
&lt;p&gt;这些数据来自同一个 &lt;code&gt;TaskTicket&lt;/code&gt; 生命周期：收到请求时入队，拿到 Permit 时运行，返回时完成或失败。如果异步任务异常 Drop，Ticket 也会结束记录，不会在面板上永久留下一个 Running。&lt;/p&gt;
&lt;p&gt;交互式终端使用 Alternate Screen 和 Raw Mode，并通过 RAII Guard 恢复鼠标捕获、光标和主屏幕。忙时大约 150 ms 刷新一次，闲时降到 500 ms。stdout 不是 TTY 或传入 &lt;code&gt;--no-monitor&lt;/code&gt; 时，就退化成普通日志。&lt;/p&gt;
&lt;p&gt;我不喜欢一些 Agent 产品为了显得很忙，凭空画出一堆并行任务。wcode 的原则很简单：没有发生的事，不显示。&lt;/p&gt;
&lt;p&gt;WebUI 侧遵循同一个原则。Project Observatory 把期望架构、实际依赖、漂移、证据与实现覆盖率放在同一个视图里：&lt;/p&gt;
&lt;figure class=&#34;content-image&#34;&gt;&lt;img src=&#34;https://francisdu.com/img/wcode/wcode-architecture_hu_92a8fd07f12ae64a.webp&#34; alt=&#34;wcode 架构总览&#34;loading=&#34;lazy&#34; decoding=&#34;async&#34; srcset=&#34;https://francisdu.com/img/wcode/wcode-architecture_hu_92a8fd07f12ae64a.webp 960w, https://francisdu.com/img/wcode/wcode-architecture_hu_3f3f08e508cea449.webp 1800w&#34; sizes=&#34;(max-width: 900px) calc(100vw - 32px), 900px&#34; width=&#34;3232&#34; height=&#34;1932&#34;&gt;&lt;/figure&gt;&lt;p&gt;完整页面从架构总览、需求详情、当前变更、代码统计到图快照历史，一图到底：&lt;/p&gt;
&lt;figure class=&#34;content-image&#34;&gt;&lt;img src=&#34;https://francisdu.com/img/wcode/wcode-observatory-full_hu_2e0fc54b6ad597b6.webp&#34; alt=&#34;wcode Project Observatory 整页&#34;loading=&#34;lazy&#34; decoding=&#34;async&#34; srcset=&#34;https://francisdu.com/img/wcode/wcode-observatory-full_hu_2e0fc54b6ad597b6.webp 960w, https://francisdu.com/img/wcode/wcode-observatory-full_hu_77a4ca195d4c7462.webp 1600w&#34; sizes=&#34;(max-width: 900px) calc(100vw - 32px), 900px&#34; width=&#34;1600&#34; height=&#34;5017&#34;&gt;&lt;/figure&gt;&lt;h2 id=&#34;怎么用&#34;&gt;怎么用&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e6%80%8e%e4%b9%88%e7%94%a8&#34; aria-label=&#34;章节链接：怎么用&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;macOS 和 Linux：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-bash&#34; data-lang=&#34;bash&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;curl -fsSL https://raw.githubusercontent.com/francis-du/wcode/main/install.sh | sh
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;Windows 有 PowerShell 安装脚本，也可以在源码目录直接构建：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-bash&#34; data-lang=&#34;bash&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;cargo install --path .
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;进入项目目录后运行：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-bash&#34; data-lang=&#34;bash&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;wcode --workspace &lt;span style=&#34;color:#a31515&#34;&gt;&amp;#34;&lt;/span&gt;$PWD&lt;span style=&#34;color:#a31515&#34;&gt;&amp;#34;&lt;/span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;要同时开放多个仓库，就重复 &lt;code&gt;--workspace&lt;/code&gt;：&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; style=&#34;background-color:#fff;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;&#34;&gt;&lt;code class=&#34;language-bash&#34; data-lang=&#34;bash&#34;&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;wcode &lt;span style=&#34;color:#a31515&#34;&gt;\
&lt;/span&gt;&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  --workspace ~/Code/backend &lt;span style=&#34;color:#a31515&#34;&gt;\
&lt;/span&gt;&lt;/span&gt;&lt;/span&gt;&lt;span style=&#34;display:flex;&#34;&gt;&lt;span&gt;  --workspace ~/Code/frontend
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;启动后，在 AI 客户端中添加终端显示的 &lt;code&gt;https://…/mcp&lt;/code&gt;，选择 OAuth，再在授权页输入六位配对码。&lt;/p&gt;
&lt;p&gt;只想读代码可以加 &lt;code&gt;--read-only&lt;/code&gt;；不允许执行命令可以加 &lt;code&gt;--no-exec&lt;/code&gt;；已经有固定反向代理，就使用 &lt;code&gt;--public-url https://your-domain.example&lt;/code&gt;。&lt;/p&gt;
&lt;h2 id=&#34;还没解决的东西&#34;&gt;还没解决的东西&lt;a class=&#34;heading-anchor&#34; href=&#34;#%e8%bf%98%e6%b2%a1%e8%a7%a3%e5%86%b3%e7%9a%84%e4%b8%9c%e8%a5%bf&#34; aria-label=&#34;章节链接：还没解决的东西&#34;&gt;#&lt;/a&gt;&lt;/h2&gt;
&lt;p&gt;wcode 现在已经能稳定完成我最初想做的事，但它当然不是终点。&lt;/p&gt;
&lt;p&gt;Quick Tunnel 适合零配置，不适合需要固定地址的长期部署；Tree-sitter 是跨语言的语法索引，不是 Language Server；不同 Web 产品对 Remote MCP 和 OAuth Discovery 的支持也一直在变化。即使一个客户端声称支持 Streamable HTTP，也不代表它已经能完整跑通 OAuth。&lt;/p&gt;
&lt;p&gt;接下来我会继续补客户端实测、协议兼容、代码索引精度、诊断和安全回归。至于模型和 Agent Loop，我还是不打算做。让 wcode 保持一座小而清楚的桥，比长成另一套平台更有价值。&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;&lt;a href=&#34;https://github.com/francis-du/wcode&#34;&gt;GitHub：francis-du/wcode&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;&lt;a href=&#34;https://wcode.francis.run/&#34;&gt;wcode 产品页、兼容矩阵与文档&lt;/a&gt;&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;代码留在本地，AI 客户端自己选。&lt;/p&gt;
</description>
    </item>
    
  </channel>
</rss>