English
Intelligence · 证据台账

七十亿 token。
一次现场事故。

token 不是结论。结论是:一次现场故障,变成设计裁决、机器可读约束、可复现拦截;同一张台账也把成本、代码规模与局限暴露出来。

7,007,437,567 个已记录 token 已映射到仓库代码规模 拦截已复现 证据先于声明

BG1SB · · 约 18 分钟阅读

七十亿 token 不是生产力奖杯,而是一条工程系统的痕迹:业务意图进入 harness,内环用上下文去实现与验证,活的 SDD 留住被学到的东西,最后由现场证据决定什么为真。

主张

token 只有在绑定到仓库、代码规模、证据与失败边界时才有意义。没有映射,它只是虚荣账;有了映射,它显示系统把成本花在不确定性、迭代、上下文重载与纠错上。

卷一

格物 · Investigating Things

回到事物本身:会话库、测试、代码、电台行为,以及第一次测量为什么会错。

先看账单,再降低它的地位

账单有价值,是因为它能被核对;不是因为它很大。

记录总量

7,007,437,567

七个 harness,41,257 轮,882 个会话。

缓存重读

95.2%

6,670,776,092 个 token 是上下文重载,不是新文本产出。

新鲜部分

4.8%

336,661,475 个新输入加输出;模型输出为 30,061,161。

有计价样本

$9.30 / B

Pi 记录 $15.11 对应 1,625,562,962 tokens。

HarnessTokens轮次会话来源
claude-code3,129,411,48121,648194~/.claude/projects/**/*.jsonl
pi1,625,562,9628,71960usage.totalTokens 与 cost
kimi-code1,201,837,5379,769229usage.record
codex547,796,667717116JSONL 与 threads.tokens_used 交叉核对
mulerun471,558,325181181session.tokens_*
cursor27,079,70521796非零 bubbleId:*
opencode4,190,89066opencode.db
声明:已记录 token 总量。来源工件:七个本机会话存储。版本/提交:普查 2026-09-05。环境:macOS arm64。验证方法:JSONL 解析加 SQLite 核对。结果:7,007,437,567 tokens / 41,257 轮 / 882 会话。局限:仅本机留存;部分工具不记录用量。日期:2026-09-05。

七十亿是地板,不是总量

诚实的总量必须有两列:已记录与估算。两列不能合并。

iFlow

37,202 轮 assistant 都有 usage 字段,但全部为 0。按文本估算约 234,247,399 tokens,范围 187M-281M,不进入记录总量。

Hermes

记录了 292 会话、9,121 消息、4,336 工具调用,但 token_count 全部为 0。

Cursor/Qoder

Cursor 记录 27,079,705 tokens 但没有工作目录。Qoder 是严格重复子集,计入会重复 1,500,804 tokens。

留存窗口

Claude Code 最早从 2026-08-05 开始,而更早的仓库工作已不在留存窗口内。

推论

加入估算后,地板值约为 7,241,684,966 tokens、87,580 次交互、1,359 个会话。它仍是地板,因为 Hermes 有交互但没有已记录 token。

第一个数字错了 16 亿

致知在格物:知识来自格物,不来自字段名。

第一次普查报出 5,380,941,148 tokens。它低估,因为我只搜了自己已知的位置;它也高估,因为我把语义并不平级的字段加在了一起。

Codex 修正

cached_input_tokensinput_tokens 的子集。修正后 transcript 为 547,796,667;独立数据库为 546,858,767。

Pi 修正

totalTokens 已经等于 input + output + cacheRead + cacheWrite;再加一次会把数值膨胀约一倍。

主张

没有和第二来源对过账的数字,只是关于数字的假设。来源之间的不一致不是噪声,而是发现。

台子上已经插着的一根线

起点不是「做一个 AI 项目」,而是:FT-710 能不能只靠已经插着的 USB 线完成远程操作。

现场观察

FT-710 暴露 FT4222 SPI bridge,可获得约 21 fps 的真实频谱数据。

媒体路径

同一根线承载 48 kHz 双向 Opus 音频和完整 CAT 控制。

产品边界

不需要 SCU-LAN10,不需要这条路径上的 Hamlib,不需要第二台设备。

事实

FT-710 达到 439 项自动化测试:Ran 439 tests in 10.675s / OK。源码基线 v1.8.1;Windows 安装包 v1.8.0。

没有 harness 的六个月

同一个人、同一批电台、同类现场问题,在没有知识落点时产出的是另一种东西。

iFlow 覆盖 2025-10-20 到 2026-04-16:185 会话、37,202 轮 assistant、六个模型后端。它产生过有用成果,包括 MRRC 祖先与 PSK Reporter 分析;但没有 AGENTS.md、没有版本化 SDD、没有机器可读约束注册表,也没有门禁。

类比

王阳明格竹的故事,在这里可作为方法警告:极大的诚意,如果投到没有反馈通路的程序上,无法收敛。没有 harness 的早期工作就是这个形状。

卷二

致知 · Extending Knowledge

一次现场观察变成契约,契约变成门禁,许多门禁长成可复用本体。

约束在外,执行在内

这是工程机制页中与本事故有关的最小切片。

Harness

业务、技术、产品约束定义工作为何存在、哪些接口与安全边界重要、什么证据可以改变声明。

Loop

Echo -> Delta -> Product 里包含内环:Specify -> Implement -> Test -> Review -> Deploy / Observe -> Update SDD。

活的 SDD

SDD 连接意图、代码、测试、部署、已知问题与可复用决策。运行时加载契约,而不是陈旧副本。

事实

内环由智能体使用真实仓库与真实门禁执行;意图、架构边界和证据是否充分的判断留在人手里。这就是智能体工程与前沿部署工程的边界。

现场故障变成可执行规则

这就是物格而后知至:物被格明,知识到来,然后知识必须能拦下一次错误编辑。

事故

在 FT-710 上,DN; 不是 DNR 查询;它会让当前 VFO 每次下移约 20 Hz,轮询会造成现场频漂。

裁决

事故成为 AD-014:DNR level 刻意不轮询。

2026-09-05 复现拦截
$ python3 .agents/skills/sdd-guardian/harness/sdd_context.py check probe_b4_tmp.py
SDD-GUARDIAN: blocking violations found:
[BLOCK] cat-no-dn (AD-014; SDD V1.2 freq-drift incident) probe_b4_tmp.py:2: return c.query("DN;")
$ echo $?
2
事实

链条是:现场事故 -> SDD 裁决 -> 机器可读约束 -> mrrc_ft710 中的非零退出编辑前门禁。每一环都是工件,最后一环可用命令复现。

token 规模不跟 LOC 排序

关键问题不是「用了多少 AI」,而是内环在哪里反复重载上下文以消除不确定性。

仓库/工作桶TokensTracked source linesTokens / line工程读法
ft81,875,258,56669,97226,800代码量小、风险密度高:DSP、时隙与 TX 保护。
mrrc_ft7101,275,611,389728,6321,751大型 native/mobile tracked tree;纵向切片产出可复用契约。
mrrc_modern1,260,804,213744,1951,694平台抽象与三个电台 profile。
MRRC1,150,197,250150,3457,650通用族;历史最长,部分受留存截断。
website819,343,92635,81622,876证据对账、双语结构与跨站一致性。
sunsdr64,490,89838,3611,681电台服务端与客户端网站;大量协议学习早于留存日志。
pskreporter54,409,498not availablen/a本机无独立 checkout,无法给可复核行数。
efhw-knowledge45,949,58422,4252,049阅读、综合与本体抽取。
wfview23,459,822172,509136参考树,本地 agent 投入小。
未归属工作桶410,832,716n/an/a父目录会话与非无线电工作。
工作目录合计6,980,357,8621,962,255 countedmixed无线电生态仓库本身:6,491,655,826
类比

朱熹《大学章句》里的豁然贯通,在这里可作为积累类比:今日格一物,明日格一物,之后才固化。本体是在证据跨越产品边界重复出现之后才写出来的。

推论

token 不衡量生产率,源码行数也不衡量难度。二者比值只能作为不确定性、上下文重载、证据对齐和安全边界工作的诊断信号。

卷三

知行合一 · Unity of Knowing and Acting

知而不行,只是未知;没有证据的行动,也不是知识。

发布也是证据工作

测试套在 2026-09-05 实跑,不是读文档得出。

产品族命令结果
FT-710venv/bin/python -m unittest discover -s testsRan 439 tests / OK
Modernvenv/bin/python -m unittest discover -s testsRan 682 tests / FAILED (errors=1);macOS 上 Windows launcher import 限制。
FT8venv/bin/python -m pytest tests -q --collect-only937 tests collected,收集数不是通过数。
事实

部署规则也来自真实缺陷:远端 heredoc 加引号、因为 tar -x 不删除而显式远端删除、按站点精简备份、回滚提示只允许恢复单站目录。

台账自己也会过时

系统必须检查自己的证据,而不只是检查产品代码。

落地页漂移

V1.0 · 180+ tests -> v1.8.1 · 439 tests;v1.10.1 · 593 tests -> v1.12.1 · 682 tests;40 tests -> 937 collected。

证据台账漂移

v1.12.0 · 633 tests -> v1.12.1 · 682 tests。

约束元数据漂移

注册表版本落后于 SDD:V1.7 vs v1.8.0,V2.27 vs V2.30,V1.0 vs V1.8。

版本歧义

FT-710 源码是 v1.8.1,Windows package 是 v1.8.0。一个 version 字段必然错。

主张

救场的是精确。一份带日期的证据记录,与一条当前状态声明,是不同工件,即便它们含同一个数字。

从未被交出去的部分

智能体承担执行;人保留意图、边界与判断。

不可压缩的门

硬件制板与台架、RF 安全、在用电台现场验证、发布标签,不能靠更多 token 买掉。

公开缺陷

FT710Mobile 仍保留未解决的 P0 PTT 安全问题。439 项服务端测试不能关闭客户端安全声明。

产品成熟度

  1. 设计目标
  2. 仿真结果
  3. 自动化测试
  4. 台架验证
  5. 现场验证
  6. 已发布/运行
  7. 已知问题

过程约束

  1. B1 注册表条目
  2. B2 spec / plan 轨迹
  3. B3 会话内执行
  4. B4 拦截已验证

B4 过程徽章永不提升产品声明。这就是为什么知而不行还不够,但行动本身也不等于知道。

离开电台后,什么仍可迁移

方法与领域无关:约束、执行、验证、记录,并让产品成熟度与过程证据分开。

  1. 先定义成功

    实现前写验收条件和明确的非目标。

  2. 让约束机器可读

    每条规则需要 severity、scope、patterns,以及指向决策或事故的引用。

  3. 加载活契约

    引用 SDD 并在运行时切取,不复制进会过时的 prompt。

  4. 在写入前设门

    mrrc_ft710 中,编辑前门禁阻止缺陷;事后评审依赖有人注意。

  5. 把事故变成规则

    频漂 bug 成为 AD-014,再成为 cat-no-dn,再成为被拦下的编辑。

  6. 每个数字都对账

    第一次普查错了 16 亿,同一块盘上另一个数据库给出了修正。

  7. 保留两条阶梯

    过程证据与产品成熟度是不同声明,必须分开。

每个数字都有边界

除另有说明,所有行的普查日期均为 2026-09-05。

类别证据
Token 台账claude-code 3,129,411,481 / 21,648 / 194;pi 1,625,562,962 / 8,719 / 60;kimi-code 1,201,837,537 / 9,769 / 229;codex 547,796,667 / 717 / 116;mulerun 471,558,325 / 181;cursor 27,079,705;opencode 4,190,890。合计 7,007,437,567 / 41,257 / 882。
排除或估算iflow 估算 234,247,399 tokens,范围 187M-281M;usage 全部记 0。Hermes:292 会话、9,121 消息、4,336 工具调用,但无 token 用量。Qoder 作为重复子集排除。
测试与约束FT-710 439 tests OK;Modern 682 tests,含一个 macOS 环境 error;FT8 937 tests collected。约束注册表:17、21、14 条,合计 52。
谱系mrrc_modernmrrc_ft710 共享初始提交 9403e2emrrc_ft8 在初始提交 d4a7a32 同时引入 AGENTS.md、SDD 与 guardian skill。注册表增长包含 2bc3d30
方法局限归属使用各工具记录的工作目录。source-line 计数来自本机各 git root 的 git ls-files,统计常见文本/源码扩展名,排除生成依赖目录。模型标识符按 harness 自身记录。
古典出处《大学》:“致知在格物,物格而后知至”。朱熹《大学章句》:“一旦豁然贯通焉”。王阳明《传习录》:格竹与“知而不行,只是未知”。这些是类比与框架,不是方法有效性的证据。
站内链接智能体工程工程机制;产品族:MRRC UniversalMRRC FT-710MRRC ModernSunMRRCSunsdrMobileMRRC-FT8EFHW