>wangyr@context: ~$

作品十一

Praxis:知识工作纪律插件

2026-06 起 · 文件约定每天在手动用 · 十一处工作区留下八百四十二条调用记录

让 AI 写的方案、文档、分析、研究,也能像代码一样被验收。

动手前先写清什么算好;做完由另一个没参与的 AI 拿这份标准来判,不合格打回;我不用逐字读完成品才知道能不能用。

先写什么算好,做完由另一个 AI 来判,判过才能说完成 一件交付物 · 文件夹 目标.md 审过 · 我批准 计划.md 审过 · 我批准 单元一/ 标准.md先写:什么算好 产出.md · v1 打回 裁决一.md✗ 不通过 产出.md v2改产出,不改标准 裁决二.md✓ 通过 完成闸 · 没有裁决,不许说完成 完成闸开:有裁决,新鲜、独立、通过 执行者 AI $ 目标:写 目标.md $ 计划:写 计划.md $ 单元一 先写 标准.md 再写 产出.md · v1 读到不通过,改成 v2 审稿人 · 另一个 AI 审 目标.md ✓ 我批准 审 计划.md ✓ 我批准 拿 标准.md 对照 产出 v1 不通过:第二段没答判准 拿 标准.md 对照 产出 v2 通过:每段落到判准 六十人公司的就绪与发布核验 心理咨询分析系统按它走 Open Learning 的设计与里程碑
一件交付物:先写目标文件,审过、我批准;再拆成计划文件,再审一次;每个单元产出前先写标准文件,产出后由没参与的另一个 AI 拿标准裁决,第一次不通过打回重做,第二次通过;有了这份裁决,完成闸才开。自动循环。右边一格是它接上的三处,点标签能过去。

它帮我做四件事。

  • AI 动手前先交给我一页「什么算好、什么不能错」,这一页我叫标准文件。我批的是这一页,不是逐字读成品。见标准文件一节。
  • 做完由另一个没参与的 AI 拿标准文件来判,判的结果我叫裁决,不合格打回重做。到我手上的是判过一遍的版本。见裁决一节。
  • 大的交付物拆成几步,一步做完、判过,再做下一步;做到哪一步写在文件里,AI 的记忆丢了也能接上。见目标、计划、执行、文件约定四节。
  • 这套纪律每次开工自动到场,不靠我提醒。见会话钩子一节。

它是什么:装在 Claude Code 上的一个插件,把「定目标、拆计划、执行」三个层次各设一道检查,每次往下走都要过。

  • 三个层次我叫高度:目标高度答做什么、什么算好;计划高度答拆成哪几步;执行高度做出来。叫高度不叫阶段,因为做到一半可以退回上一层改,不算失败。
  • 层与层之间的检查我叫闸:不通过就不许往下走。
  • 两样东西撑起每道闸:标准文件,和裁决。裁决要指出通过或不通过落在产出的哪一段;一句不指向任何段落的「通过」不算裁决。
  • 插件里装的是一组「怎么做事」的技能、三个脚本、五份模板、一个会话钩子、一份文件约定。技能不教任何领域知识,只管一件交付物从目标到收尾怎么推进。
  • 它解决的问题:AI 做非代码的活时,惯性是拿到请求就开始产出,做完自己说「完成」。没有测试拦它,没有第二个 AI 看它。
  • 它参照了一套公开的开发工作流纪律。那套纪律让写代码有章法:先定目标,写计划,先写测试再写代码,独立审核,验证后再声称完成。我把每个环节从代码里抽出来,让它对文章、方案、研究、决策同样成立。

为什么这样做:知识工作没有测试,纪律不能只写在说明书里,要做进结构。

  • 写代码的纪律靠三样东西起作用:测试给出通过或不通过;审核由另一个 AI 做;写错的代码删掉重来。三样里只有第二样能搬到知识工作。
  • 只搬说明书,纪律会在惯性下被跳过。2026-07-09 的一次真实会话证明了这一点:三道闸的文字全在上下文里,AI 连续三次绕过。指令在眼前,AI 选择不执行。
  • 所以闸做成结构性依赖:下游拿不到上游的产物就停。说完成之前那道闸的硬输入是标准文件和裁决,缺一样就停在原地。
  • 它在我的真实项目里跑了两个半月,留下的记录见现状一节。

它和什么连着:进来的是一件交付物的目标,出去的全是文件,站上五件作品在用它。

它由三个高度、一组随时触发的质量技能、一份文件约定和一个会话钩子构成,下面按一件交付物走过的顺序讲。

  • 三个高度:目标、计划、执行。每个高度一到两个技能。
  • 随时触发的质量技能:先定标准、完成闸、审核、排错、隔离、收尾。完成闸是说完成之前的最后一道闸。条件一到就触发,不属于任何高度。
  • 一份文件约定,三个脚本,五份模板,一个会话钩子。
  • 顺序:全图,目标,计划,执行,标准文件,裁决,文件约定,会话钩子,然后是演化与现状。
  1. 全图:一件交付物怎么从目标走到交付,闸设在哪
  2. 目标:先写下做什么、什么算好,审过才往下
  3. 计划:拆成几步,每步带一条验收
  4. 执行:一步做完、判过,再做下一步
  5. 标准文件:产出前写下什么算好、什么不能错
  6. 裁决与完成闸:没有别人的裁决,不许说完成
  7. 文件约定:每样产物都是一个文件,记忆丢了也能接上
  8. 会话钩子:纪律每次开工自动到场
  9. 演化:两个半月,闸加了又拆
  10. 现状:分三档说

全图:一件交付物怎么从目标走到交付,闸设在哪

一件交付物走五步:写目标文件;拆成单元;每个单元交接、产出、裁决;过完成闸;收尾放回原位。

目标 目标文件 自审 · 独立审稿 · 我批准 过闸 回流 计划 计划文件 · 拆成单元 自审 · 独立审稿 · 我选方式 过闸 回流 执行 一个单元一次交接 台账记进度 执行高度里,每个单元走四步 写标准文件 产出前 执行者产出 读交接,写产出与报告 审稿人裁决 没参与产出的另一个 AI 完成闸 读到裁决才放行 不通过:派修复执行者,重审 耐久层 目标文件 · 计划文件 留下,进版本库 草稿层 台账 · 交接 · 产出 · 报告 · 标准 · 裁决 一个自忽略的目录,不进版本库 交付物 收尾时放回它自己的位置 不留在草稿层 文件约定:每样产物都是一个文件。上下文丢了,信台账与文件,不信记忆。 我 批目标 · 批计划 选执行方式
红色实线是必过的闸:目标到计划,计划到执行,裁决到完成。灰色虚线是回流与重审,两者都合法。红色竖虚线是我出手的位置:批准目标文件,批准计划文件,选执行方式。其余是文件在层与层之间流动。

每道闸防一种 AI 的惯性,各有自己的验法。

闸在哪防什么怎么验
要产出一件交付物时拿到请求就开写查有没有目标文件。没有,先定目标。这是查文件,不是判断题
目标文件写完目标写得两个人读会造出不同的东西自审;独立审稿人审;我批准。我提了修改,两道审重跑
计划文件写完计划里没写的选择被做错自审四项;独立审稿人对照目标文件审;我选执行方式
每个单元产出前先产出再定标准,标准必然通过查这个产物有没有自己的标准文件。没有,先写。项目有目标文件不算
每个单元产出后产出者自己宣布合格审稿人拿审核包(交接、产出、报告合成的一份文件)和标准文件出裁决:规格符合与否,质量通过与否。不过,修,重审
要说「完成」时没验就说完成完成闸查手上有没有一份针对这个产物的裁决:新鲜(裁决之后产物没再改过)、独立、通过。缺一样停
裁决通过后产物又被改改过的产物顶着旧裁决过关改过即未审,重审
全部单元做完每步都过,拼起来对不上目标终审(对整体的一次裁决)对照目标文件;收尾四选一
每次会话开始新会话里纪律不在场会话钩子把入口技能(决定这一轮该调哪个技能的那份说明书)全文注入;三道闸每轮重跑

插件由四层构成,缺一层就退化成建议。

我出手三次,看一次。

它参照的那套开发纪律,每个技能对应过去一个;抽的是内核,不是内容。

目标:先写下做什么、什么算好,审过才往下

没有目标文件不许产出,「目标够清楚了」不算理由。

琐碎的活只免文件,不免对齐,并且必须说出口。

计划:拆成几步,每步带一条验收

计划写给一个没有上下文、品味存疑的执行者;计划里没写的选择,就当它会被做错。

目标文件和计划文件头部印同一段交棒文字。

执行:一步做完、判过,再做下一步

一个单元一次交接,一个单元一份裁决,做完一个再做下一个,不许攒到最后一起验。

并行还是顺序,看单元之间有没有共享状态。

卡住就停,不猜。

标准文件:产出前写下什么算好、什么不能错

每个非琐碎产物产出前一份标准文件,两段:什么算好,什么不能错。

裁不了任何东西的写法能裁没列举过的情况的写法
有力的简介一个想法,先说读者得到什么。任何只因为好听而留下的句子删掉。
有说服力的备忘录决策者读一遍能说出建议是什么,以及它比另一个选项强在哪一点。
清楚的解释一个新手读一遍能用自己的话复述核心。

先定后产和先产后定不是同一件事换个顺序。

事实项写成失效时会被发现的形状。

失效时会被发现的写法,优于失效时没人知道的写法

「与来源表里的数字一致」失效时会被发现:打开表,数字不在,回来问。「数字是四百二十万」失效时没人知道:来源改了,检查照旧通过。

有限集上的正向属性优于开放集上的负向缺席

「这几处各写着 Y」优于「全文不出现 X」。开放集上的缺席永远证不完,换个说法就漏过去。用禁用词表冒充「文风直接」就是这个形状。

一个数字管一份清单,数字和清单要在同一口气里

条款写「四处」,清单在另一节或另一个文件里,清单一变数字就错,而且错了没有提示。基数最危险:它按字面通过,同时是错的。序数更容易暴露,但在它前面插入或重排,它会悄悄改指。

这三条 2026-07-30 一天里被同一类错逼出来:同一天同一类错犯了八次,全部由审稿人发现。经过见演化一节。

裁决与完成闸:没有别人的裁决,不许说完成

完成闸自己不判,它只在读到一份针对这个产物、新鲜、独立、通过的裁决之后,放行「完成」两个字。新鲜指裁决之后产物没再改过。

审稿人不是测试。

拿到反馈之后逐条评估,不表演同意。

文件约定:每样产物都是一个文件,记忆丢了也能接上

每样产物都是一个文件,不贴进对话;贴进对话的东西每轮都被重读,文件路径不会。

层放什么命运
耐久层目标文件,计划文件留下,随项目进版本库
草稿层台账,标准文件,交接文件,产出文件,报告文件,审核包,裁决一个自忽略的目录,不进版本库
真家交付物本身收尾技能把它放回它该在的位置,不留在草稿层

收尾不允许「基本做完」。

会话钩子:纪律每次开工自动到场

一个会话钩子,在每次开工时把入口技能全文注入,不是一行「去调用它」的提醒。入口技能是会话开始第一个加载的技能,只做一件事:判断这一轮该调哪个技能。

入口技能是一张调度表,不是摘要;三道闸每轮重跑。

要产出交付物而没有目标文件:先定目标入口闸
要产出一个非琐碎产物而它没有自己的标准文件:先写标准文件产物闸
要说完成而手上没有独立裁决:过完成闸完成闸

曾经有过第二个和第三个钩子,都拆了。

演化:两个半月,闸加了又拆

从 2026-06-25 起建到 08-12 最后一次提交,每一次改动都是一次收窄或反转,没有功能增长。

起建。每个技能是那套开发纪律里一个技能抽掉代码后的内核,装在项目目录里。只有先定标准这一个技能做了对照测试:拿掉它跑两次,两次都跳过定标准;装上翻转2026-06-25
审计:形式搬了,硬化装置没搬。「我描述了系统但没实现系统。」定下四层齐全才是纪律。调度表从十一条平级的触发条件改为一道入口闸加逐技能推进;会话钩子从一行指针改为全文注入。发现两套纪律插件同时注入时 AI 两套都忽略,摘掉参照的那套2026-06-29
写了二十一份压力测试场景,跑六个:没有技能时五个都答对。选择题测知识,不测行为;这个会话自身就是证据,我知道规则仍两次违反。二十一份全删,版本从 0.6.0 退回 0.5.02026-06-30
去掉集中的推进表和「随时触发」分类,改为每个技能的说明书自带前置条件和交叉引用,技能自己知道下一步2026-06-30
作品一的主控文件第八版把执行权交给它。目标文件改名:原来的英文名和日常业务里「下需求」一词撞车2026-07-01
线性链改三个高度。链只能把往前读成进步、往回读成断裂,表示不了迭代;改成三个高度任意方向移动,回流合法,闸每轮重跑而不是每个会话跑一次2026-07-02
删掉手写版本号,改用提交哈希;发到公开仓库。原因:版本号忘了改,安装副本悄悄落后源码,且无法验证线上跑的是哪一版。同日删掉每轮提示钩子,回到单钩子2026-07-06
真实事故:一个会话里三道闸的文字全在上下文里,AI 连续三次绕过。不是上下文丢失,指令在眼前,AI 选择不执行。根因:参照的纪律从不靠说明书的文字起作用,靠代码可测试。修法:标准文件成为完成闸的硬输入;产出者不自宣合格;加一个读会话记录的程序兜底2026-07-09 – 10
完成闸退成只读裁决的闸,不再自己出第二份裁决;派审稿人只留在审核技能里。之前完成闸自己再派一个审稿人,对同一产物审第二次2026-07-10
「先定成功」技能改名为「先定标准、产出、再核」,名字说全它管的整个环;执行者报告单独成文件2026-07-12
标准文件主轴重写。一个改文风的任务,标准被写成几个禁用词加检索:质量标准被写成了事实核查的形式。旧格式按「能不能机械判」分段并要求往机械那头挤,改为「什么算好 / 什么不能错」。同时:琐碎测试从篇幅打头改为利害打头;入口加轻量路径;「先撞坏草稿」从必填段降为习惯2026-07-29
同一天同一类错犯八次,全部由审稿人发现:事实项写成失效时没人知道的形状。三条写法进正文。同日「改过的产物就是没审过的产物」写进会犯错的四个位置,因为同一天同一个错我犯了三次,两次被机械兜底拦下2026-07-30
一个代码项目的流程切回参照的那套纪律。代码有测试当裁判,不需要代偿2026-08-05
机械兜底拆掉。最后一次提交2026-08-12

变的是强制的形态,没变的是三条纪律。

现状:分三档说

写这一页的日期是 2026-09-17。文件约定每天在手动用。三档分开说,不混。

在跑,有真实使用记录
  • 文件约定与三条纪律:标准文件、裁决记录、台账由我手动调用,九月新增四十份产出。九月的例子:一本书十八章的逐章精读,其中八章有独立裁决;一个播客的知识图谱,十三份按簇的评审记录加一份读者测试;两份日报各一份标准文件。
  • 六到八月经插件调度的交付物,精选几件:桌上那盏状态灯的采购、接线、固件、接入四个单元,每个单元一份独立裁决,见作品一;一份学习工作台的设计文档和前两个里程碑,见这一页;一份心理学疗法的内化笔记和行动手册;一个手机分诊页的前后端;作品二那家公司的项目是最重的使用者。
建了,不常跑或没走通
  • 会话钩子与机械闸:公开仓库在,最后一次提交 08-12。
  • 压力测试场景:建了,删了。
  • 使用记录的汇总看板脚本:跑过一次。
  • 适配另一个 AI 运行时的清单:写了,没测。
设计中或未测得
  • 「五个新会话连续通过」的行为测试从未跑成:它要在干净会话里由人跑,不能在写它的那个会话里自测。
  • 排错技能对多因、不可复现的失败没有路径:一篇没传开的稿子、一次没转化的活动不能重跑。记在待办里。

数字只报能证明系统真实存在的。

公开仓库的提交,2026-07-06 到 08-12十四次
留下调用记录的工作区十一处
技能调用记录,2026-06-30 到 08-29,AI 自报八百四十二条
留下记录的会话二百五十三个
有目标文件的交付物,不含插件自身一百二十七份
标准文件二百八十七份
按统一命名的裁决记录一百四十三份
执行者交接文件二百四十三份
进度台账,其中十八份标记已收口三十八份
九月草稿层新增的文件,2026-09-02 到 09-14四十份

仓库开源在 GitHub。作品一的主控文件第八版把执行权交给它、第九版收回;作品二那家公司的项目是它最重的使用者。它背后的想法怎么来的,见思考。