作品八
我读过的东西,下次提问时能直接用上。
AI 把每篇读过的文章提炼成概念、实体、综合三类页,和旧页连好;我问一个问题,AI 先读总目录再读页,好的答案归档回来;读过的东西越积越有用,不是越积越找不到。
它帮我做的,是收藏做不到的事:读过的东西被再次用到。
它是什么:一个由 AI 写、我读的知识页文件夹,一套让 AI 维护它的流程,一套 harness。
为什么可信:写的不自己宣布合格;无人值守时限速,跑坏了能查到是哪一步。
它做到五件事。
它和什么连着:上游是收件箱的卡片和存量文件,下游是个人 AI 操作系统的记忆层和我在会话里的提问。
它由三层资料、三个动作、两个定时任务构成,下面按一篇文章走过的顺序讲。
前四步是入库,后两步是使用;闭环在第六步:查询里的好答案归档成新页,下一次查询读得到它。
三层资料各归一个写入者:原始资料我写或我剪藏,知识页 AI 写,技能说明我和 AI 一起改。
| 层 | 是什么 | 谁写 | 实际是什么 |
|---|---|---|---|
| 原始资料 | 我读过、决定留下的东西 | 我,或剪藏工具 | 收件箱里的文章、书的章节、项目与领域文件夹里的文档。留在原处,AI 只读正文,只改文件头的标记 |
| 知识页 | 从原始资料提炼出的页面 | AI | 一个独立文件夹,三个子目录各放一类页,加一份总目录、一份操作日志 |
| 技能说明 | 告诉 AI 入库、查询、检查各怎么做,页面长什么样 | 我和 AI | 一份技能说明,一份页面格式规范,一份批处理指令 |
三个动作都由 AI 执行;我出现在两格:入口定进不进,出口提问和判断答案值不值得留。
两个定时任务各管一个入口,共用同一份批处理指令。
| 定时任务 | 扫哪里 | 什么时候 | 每批几篇 | 现在 |
|---|---|---|---|---|
| 日班 | 收件箱里两个开关都拨上的文章 | 每天凌晨一点,两点硬停 | 一篇 | 2026-09-08 停 |
| 夜班 | 项目、领域、资源三个文件夹里没盖章的存量文件 | 每晚九点到凌晨四点,每小时补触发一次 | 五篇并行 | 2026-04-14 停 |
进不进知识页由人判断,AI 不替我决定;判断的动作压到最轻,一个开关或一行字。
两类原始资料各有一个入口,举手的方式不同。
「读过」这道门槛是后加的,它让日班停了产。
存量文件的举手行由 AI 逐篇评估后写入,不做成工具。
知识页存的是可复用的知识,不是原文摘要;一篇原文产生几页,取决于它有几个能独立成页的东西。
页分三类,因为知识有三种组织形态,和原始资料是多对多的关系。
| 类型 | 回答的问题 | 固定段落 | 怎么长 |
|---|---|---|---|
| 概念页 | 某个东西是什么 | 定义 · 核心特征 · 适用场景 · 相关页面 · 来源 | 跨来源合并:几篇文章讲同一个概念,合成一页 |
| 实体页 | 某个人、工具、公司、项目是什么样 | 概述 · 关键信息 · 相关页面 · 来源 | 随新资料加厚:每篇提到它的文章往里补一段 |
| 综合页 | 某个问题的结论是什么 | 背景 · 对比分析 · 结论建议 · 相关页面 · 来源 | 由分析产生:一篇文章的论证,或一次查询的答案 |
段落标题写死,AI 不许自由命名。
每页头部固定六个字段,来源要在页面底部看得见。
一次入库要改的不只是知识页,还有四样记录,缺一样系统就不知道自己做过什么。
页与页之间用双向链接,新页出现时旧页也要改。
盖章放在最后一步,是为了失败可重来。
检查分三层:批次内核验每批必跑,验收标准每篇一份,健康检查扫全库。
核验守住的是「不破坏」,它抓不住「漏了」;漏掉的问题堆在日志里等健康检查。
写这一页时,我用脚本把健康检查该查的东西实测了一遍,数字在现状一节。
定时任务跑在我自己的电脑上,每批开一个独立的 AI 会话;不用云端定时,因为云端碰不到本地文件。
夜班上线三天就撞了两个问题,重设计从审计开始。
「睡到凌晨一点」被删掉,因为它把一次观察到的数字写死成了架构假设。
限速的另外三个参数同时收窄,全部往「少而稳」调。
| 参数 | 原来 | 改成 | 理由 |
|---|---|---|---|
| 夜班窗口 | 晚九点到早九点 | 晚九点到凌晨四点 | 凌晨四点后电脑多半在睡,窗口是空的;七小时刚好覆盖一次五小时的用量回补 |
| 成功后冷却 | 十秒 | 三分钟 | 把消耗节奏拉开,降低短时间内达到上限的概率。理论吞吐降到原来的四分之一,用量上限本来就是硬上限,实际差距小 |
| 失败后出队 | 无条件出队 | 只在成功时出队 | 失败的批留在队列里,下轮重试 |
| 触发方式 | 晚九点整点触发 | 每小时触发,白天直接退出 | 整点错过就丢;每小时触发在电脑醒来后能补上 |
日班在七月又收窄一次:从一批五篇改成一批一篇。
没解决的一条:定时任务依赖电脑醒着,电脑整晚休眠时夜班一次也不会触发。
查询不用向量检索,AI 先读总目录的简述定位相关页,再读页合成答案。
查询最常发生在阅读中:读书读到接不上的地方,提问触发一次页面更新。
已知缺口:查询靠总目录里的词,总目录里没有的词就找不到。
harness 不提炼也不查询,只让 AI 维护知识页时每一步都在界内:什么进来、往哪写、写成什么形状、失败了怎么办,各有一处定了;八项各守一层。
| 项 | 做了什么 | 约束哪一层 |
|---|---|---|
| 入口归人 | 进不进由我标记,AI 不替我决定;存量文件 AI 只做预筛,入库仍等我定。防的是知识页里混进我没判断过的东西 | 入库的入口:原始资料哪些进来 |
| 原文正文只读 | AI 只往知识页写,在原文里只改文件头的标记,不碰正文。防的是来源被改坏,页面无法回指原文 | 三层资料里的原始资料 |
| 段落标题写死 | 三类页的段落标题序列写在指令里,不许添加规范之外的段。防的是格式漂移,检查只能靠人读 | 知识页的外形 |
| 四样同步,盖章最后 | 总目录、日志、来源、盖章按固定顺序写,前三样全成功才盖章;盖过章的文件下次跳过。防的是半途失败的文章被当成已完成,系统不知道自己做过什么 | 入库的收尾:系统对自己做过什么的记录 |
| 总目录单写 | 并行入库时各批只写知识页,总目录和日志只由一处写。防的是并行的几批互相覆盖同一份总目录 | 总目录与操作日志 |
| 写与核验分开 | 写页的 AI 不核验;另一个 AI 按入库前写好的验收标准逐条判,全过才算。防的是 AI 自己宣布合格 | 检查这个动作 |
| 失败不出队,撞上限就等 | 只在成功时出队,失败的留在队里;撞到用量上限就等;每批有花费上限,窗口到点硬停。防的是失败空转删光队列、撞上限反复重试、一批超支拖累别批 | 两个定时任务 |
| 每批独立会话,步骤单源 | 每批新开一个会话;发给它的指令只说对哪几个文件入库,步骤只写在技能说明里。防的是上下文越积越大、崩一次全丢,和步骤两处要同步改 | 两个定时任务与技能说明 |
从 2026-04-05 到 09-08,三次收窄:入口从 AI 全量扫收成文件举手,批次从五篇并行收成一篇一批,运行从无人值守夜里跑收成停掉定时、手动入库。
没变的是分工和格式,变的是每一处「AI 自己决定」都收回给了我,或收成了更小的单位。
写这一页的日期是 2026-09-17。三档分开说,不混。
数字只报能证明系统真实存在的,全部从文件里读出或 2026-09-17 实测。
它是作品一记忆层的一部分,那一页讲它在整个系统里站哪。判断外化那条思路后来搬进了一家公司,见作品二。它背后的想法怎么来的,见思考。