七十亿 token。
一次现场事故。
token 不是结论。结论是:一次现场故障,变成设计裁决、机器可读约束、可复现拦截;同一张台账也把成本、代码规模与局限暴露出来。
七十亿 token 不是生产力奖杯,而是一条工程系统的痕迹:业务意图进入 harness,内环用上下文去实现与验证,活的 SDD 留住被学到的东西,最后由现场证据决定什么为真。
token 只有在绑定到仓库、代码规模、证据与失败边界时才有意义。没有映射,它只是虚荣账;有了映射,它显示系统把成本花在不确定性、迭代、上下文重载与纠错上。
格物 · Investigating Things
回到事物本身:会话库、测试、代码、电台行为,以及第一次测量为什么会错。
先看账单,再降低它的地位
账单有价值,是因为它能被核对;不是因为它很大。
记录总量
7,007,437,567七个 harness,41,257 轮,882 个会话。
缓存重读
95.2%6,670,776,092 个 token 是上下文重载,不是新文本产出。
新鲜部分
4.8%336,661,475 个新输入加输出;模型输出为 30,061,161。
有计价样本
$9.30 / BPi 记录 $15.11 对应 1,625,562,962 tokens。
| Harness | Tokens | 轮次 | 会话 | 来源 |
|---|---|---|---|---|
| claude-code | 3,129,411,481 | 21,648 | 194 | ~/.claude/projects/**/*.jsonl |
| pi | 1,625,562,962 | 8,719 | 60 | usage.totalTokens 与 cost |
| kimi-code | 1,201,837,537 | 9,769 | 229 | usage.record |
| codex | 547,796,667 | 717 | 116 | JSONL 与 threads.tokens_used 交叉核对 |
| mulerun | 471,558,325 | 181 | 181 | session.tokens_* |
| cursor | 27,079,705 | 217 | 96 | 非零 bubbleId:* |
| opencode | 4,190,890 | 6 | 6 | opencode.db |
七十亿是地板,不是总量
诚实的总量必须有两列:已记录与估算。两列不能合并。
iFlow
37,202 轮 assistant 都有 usage 字段,但全部为 0。按文本估算约 234,247,399 tokens,范围 187M-281M,不进入记录总量。
Hermes
记录了 292 会话、9,121 消息、4,336 工具调用,但 token_count 全部为 0。
Cursor/Qoder
Cursor 记录 27,079,705 tokens 但没有工作目录。Qoder 是严格重复子集,计入会重复 1,500,804 tokens。
留存窗口
Claude Code 最早从 2026-08-05 开始,而更早的仓库工作已不在留存窗口内。
加入估算后,地板值约为 7,241,684,966 tokens、87,580 次交互、1,359 个会话。它仍是地板,因为 Hermes 有交互但没有已记录 token。
第一个数字错了 16 亿
致知在格物:知识来自格物,不来自字段名。
第一次普查报出 5,380,941,148 tokens。它低估,因为我只搜了自己已知的位置;它也高估,因为我把语义并不平级的字段加在了一起。
Codex 修正
cached_input_tokens 是 input_tokens 的子集。修正后 transcript 为 547,796,667;独立数据库为 546,858,767。
Pi 修正
totalTokens 已经等于 input + output + cacheRead + cacheWrite;再加一次会把数值膨胀约一倍。
没有和第二来源对过账的数字,只是关于数字的假设。来源之间的不一致不是噪声,而是发现。
台子上已经插着的一根线
起点不是「做一个 AI 项目」,而是:FT-710 能不能只靠已经插着的 USB 线完成远程操作。
现场观察
FT-710 暴露 FT4222 SPI bridge,可获得约 21 fps 的真实频谱数据。
媒体路径
同一根线承载 48 kHz 双向 Opus 音频和完整 CAT 控制。
产品边界
不需要 SCU-LAN10,不需要这条路径上的 Hamlib,不需要第二台设备。
FT-710 达到 439 项自动化测试:Ran 439 tests in 10.675s / OK。源码基线 v1.8.1;Windows 安装包 v1.8.0。
没有 harness 的六个月
同一个人、同一批电台、同类现场问题,在没有知识落点时产出的是另一种东西。
iFlow 覆盖 2025-10-20 到 2026-04-16:185 会话、37,202 轮 assistant、六个模型后端。它产生过有用成果,包括 MRRC 祖先与 PSK Reporter 分析;但没有 AGENTS.md、没有版本化 SDD、没有机器可读约束注册表,也没有门禁。
王阳明格竹的故事,在这里可作为方法警告:极大的诚意,如果投到没有反馈通路的程序上,无法收敛。没有 harness 的早期工作就是这个形状。
致知 · Extending Knowledge
一次现场观察变成契约,契约变成门禁,许多门禁长成可复用本体。
约束在外,执行在内
这是工程机制页中与本事故有关的最小切片。
Harness
业务、技术、产品约束定义工作为何存在、哪些接口与安全边界重要、什么证据可以改变声明。
Loop
Echo -> Delta -> Product 里包含内环:Specify -> Implement -> Test -> Review -> Deploy / Observe -> Update SDD。
活的 SDD
SDD 连接意图、代码、测试、部署、已知问题与可复用决策。运行时加载契约,而不是陈旧副本。
内环由智能体使用真实仓库与真实门禁执行;意图、架构边界和证据是否充分的判断留在人手里。这就是智能体工程与前沿部署工程的边界。
现场故障变成可执行规则
这就是物格而后知至:物被格明,知识到来,然后知识必须能拦下一次错误编辑。
事故
在 FT-710 上,DN; 不是 DNR 查询;它会让当前 VFO 每次下移约 20 Hz,轮询会造成现场频漂。
裁决
事故成为 AD-014:DNR level 刻意不轮询。
$ python3 .agents/skills/sdd-guardian/harness/sdd_context.py check probe_b4_tmp.py
SDD-GUARDIAN: blocking violations found:
[BLOCK] cat-no-dn (AD-014; SDD V1.2 freq-drift incident) probe_b4_tmp.py:2: return c.query("DN;")
$ echo $?
2链条是:现场事故 -> SDD 裁决 -> 机器可读约束 -> mrrc_ft710 中的非零退出编辑前门禁。每一环都是工件,最后一环可用命令复现。
token 规模不跟 LOC 排序
关键问题不是「用了多少 AI」,而是内环在哪里反复重载上下文以消除不确定性。
| 仓库/工作桶 | Tokens | Tracked source lines | Tokens / line | 工程读法 |
|---|---|---|---|---|
| ft8 | 1,875,258,566 | 69,972 | 26,800 | 代码量小、风险密度高:DSP、时隙与 TX 保护。 |
| mrrc_ft710 | 1,275,611,389 | 728,632 | 1,751 | 大型 native/mobile tracked tree;纵向切片产出可复用契约。 |
| mrrc_modern | 1,260,804,213 | 744,195 | 1,694 | 平台抽象与三个电台 profile。 |
| MRRC | 1,150,197,250 | 150,345 | 7,650 | 通用族;历史最长,部分受留存截断。 |
| website | 819,343,926 | 35,816 | 22,876 | 证据对账、双语结构与跨站一致性。 |
| sunsdr | 64,490,898 | 38,361 | 1,681 | 电台服务端与客户端网站;大量协议学习早于留存日志。 |
| pskreporter | 54,409,498 | not available | n/a | 本机无独立 checkout,无法给可复核行数。 |
| efhw-knowledge | 45,949,584 | 22,425 | 2,049 | 阅读、综合与本体抽取。 |
| wfview | 23,459,822 | 172,509 | 136 | 参考树,本地 agent 投入小。 |
| 未归属工作桶 | 410,832,716 | n/a | n/a | 父目录会话与非无线电工作。 |
| 工作目录合计 | 6,980,357,862 | 1,962,255 counted | mixed | 无线电生态仓库本身:6,491,655,826 |
朱熹《大学章句》里的豁然贯通,在这里可作为积累类比:今日格一物,明日格一物,之后才固化。本体是在证据跨越产品边界重复出现之后才写出来的。
token 不衡量生产率,源码行数也不衡量难度。二者比值只能作为不确定性、上下文重载、证据对齐和安全边界工作的诊断信号。
知行合一 · Unity of Knowing and Acting
知而不行,只是未知;没有证据的行动,也不是知识。
发布也是证据工作
测试套在 2026-09-05 实跑,不是读文档得出。
| 产品族 | 命令 | 结果 |
|---|---|---|
| FT-710 | venv/bin/python -m unittest discover -s tests | Ran 439 tests / OK |
| Modern | venv/bin/python -m unittest discover -s tests | Ran 682 tests / FAILED (errors=1);macOS 上 Windows launcher import 限制。 |
| FT8 | venv/bin/python -m pytest tests -q --collect-only | 937 tests collected,收集数不是通过数。 |
部署规则也来自真实缺陷:远端 heredoc 加引号、因为 tar -x 不删除而显式远端删除、按站点精简备份、回滚提示只允许恢复单站目录。
台账自己也会过时
系统必须检查自己的证据,而不只是检查产品代码。
落地页漂移
V1.0 · 180+ tests -> v1.8.1 · 439 tests;v1.10.1 · 593 tests -> v1.12.1 · 682 tests;40 tests -> 937 collected。
证据台账漂移
v1.12.0 · 633 tests -> v1.12.1 · 682 tests。
约束元数据漂移
注册表版本落后于 SDD:V1.7 vs v1.8.0,V2.27 vs V2.30,V1.0 vs V1.8。
版本歧义
FT-710 源码是 v1.8.1,Windows package 是 v1.8.0。一个 version 字段必然错。
救场的是精确。一份带日期的证据记录,与一条当前状态声明,是不同工件,即便它们含同一个数字。
从未被交出去的部分
智能体承担执行;人保留意图、边界与判断。
不可压缩的门
硬件制板与台架、RF 安全、在用电台现场验证、发布标签,不能靠更多 token 买掉。
公开缺陷
FT710Mobile 仍保留未解决的 P0 PTT 安全问题。439 项服务端测试不能关闭客户端安全声明。
产品成熟度
- 设计目标
- 仿真结果
- 自动化测试
- 台架验证
- 现场验证
- 已发布/运行
- 已知问题
过程约束
- B1 注册表条目
- B2 spec / plan 轨迹
- B3 会话内执行
- B4 拦截已验证
B4 过程徽章永不提升产品声明。这就是为什么知而不行还不够,但行动本身也不等于知道。
离开电台后,什么仍可迁移
方法与领域无关:约束、执行、验证、记录,并让产品成熟度与过程证据分开。
先定义成功
实现前写验收条件和明确的非目标。
让约束机器可读
每条规则需要 severity、scope、patterns,以及指向决策或事故的引用。
加载活契约
引用 SDD 并在运行时切取,不复制进会过时的 prompt。
在写入前设门
在
mrrc_ft710中,编辑前门禁阻止缺陷;事后评审依赖有人注意。把事故变成规则
频漂 bug 成为 AD-014,再成为
cat-no-dn,再成为被拦下的编辑。每个数字都对账
第一次普查错了 16 亿,同一块盘上另一个数据库给出了修正。
保留两条阶梯
过程证据与产品成熟度是不同声明,必须分开。
每个数字都有边界
除另有说明,所有行的普查日期均为 2026-09-05。
| 类别 | 证据 |
|---|---|
| Token 台账 | claude-code 3,129,411,481 / 21,648 / 194;pi 1,625,562,962 / 8,719 / 60;kimi-code 1,201,837,537 / 9,769 / 229;codex 547,796,667 / 717 / 116;mulerun 471,558,325 / 181;cursor 27,079,705;opencode 4,190,890。合计 7,007,437,567 / 41,257 / 882。 |
| 排除或估算 | iflow 估算 234,247,399 tokens,范围 187M-281M;usage 全部记 0。Hermes:292 会话、9,121 消息、4,336 工具调用,但无 token 用量。Qoder 作为重复子集排除。 |
| 测试与约束 | FT-710 439 tests OK;Modern 682 tests,含一个 macOS 环境 error;FT8 937 tests collected。约束注册表:17、21、14 条,合计 52。 |
| 谱系 | mrrc_modern 与 mrrc_ft710 共享初始提交 9403e2e。mrrc_ft8 在初始提交 d4a7a32 同时引入 AGENTS.md、SDD 与 guardian skill。注册表增长包含 2bc3d30。 |
| 方法局限 | 归属使用各工具记录的工作目录。source-line 计数来自本机各 git root 的 git ls-files,统计常见文本/源码扩展名,排除生成依赖目录。模型标识符按 harness 自身记录。 |
| 古典出处 | 《大学》:“致知在格物,物格而后知至”。朱熹《大学章句》:“一旦豁然贯通焉”。王阳明《传习录》:格竹与“知而不行,只是未知”。这些是类比与框架,不是方法有效性的证据。 |
| 站内链接 | 智能体工程;工程机制;产品族:MRRC Universal、MRRC FT-710、MRRC Modern、SunMRRC、SunsdrMobile、MRRC-FT8、EFHW。 |