主题
知识库Karpathy契合度评估
评估时点:2026-08-04。对照蓝本 karpathy-llm-wiki(已归档于 B10-剪藏/karpathy-llm-wiki)。 核心问题:当前知识库在 "架构" 和 "执行" 两个维度上,分别契合到什么程度?
一句话结论
架构高度契合(≈4.5/5),执行处于复利曲线的起点(≈1.5/5),且存在一个结构性失衡:1571 篇面试库是 raw 黑洞,wiki 几乎没从它蒸馏出任何东西。
改名、分层、纪律手册这些 "骨架" 都对;但 Karpathy 真正的价值主张——wiki 随每个源复利增长——目前基本没发生。当前状态更靠近他明确反对的 "RAG 式囤料" 反模式,而非 "编译一次、持续维护" 的 wiki 模式。
当前量化基线
| 指标 | 数值 | 含义 |
|---|---|---|
| Raw 源(B*) | 1590 篇 | B00/B10/B30/B40 共 19 篇 + B20-面试 1571 篇 |
| Wiki 页(A*) | 6 篇正文 + 1 索引 | 2 对比 + 3 概念卡片 + 1 领域综述 |
| Wiki: Raw 比 | ≈0.4% | Karpathy 期望 "每个源触及 10-15 页",此处远低于 |
| Ingest 次数(log) | 3 | 仅试点:Karpathy 教程、ES 软文、pg_dump 教程 |
| Query 回灌次数 | 0 | 提问不沉淀为 wiki 页 |
| 真·Lint 次数 | 0 | 2 次 lint 实为 refactor/schema,非 wiki 健康巡检 |
逐条对照蓝本
✅ 完全契合(骨架正确)
- 三层架构映射干净:Raw(
B*) / Wiki(A00-百科) / Schema(AGENTS.md+README+log.md) 一一对应蓝本。 - Raw 不可变纪律:
AGENTS.md明确 " B* 只读、不删不改正文 ",与蓝本" immutable — LLM reads but never modifies " 一致。 - Wiki 由 AI 拥有:
A00-百科标注 AI 读写,人只读——符合 "you read it; the LLM writes it"。 - Schema 是共同演进的配置:
AGENTS.md首段即写 "与使用者共同演进",正是蓝本的 "co-evolve over time"。 - 三操作闭环定义完整:Ingest / Query / Lint 流程齐备,且作用域正确限定在 Raw↔Wiki,私有层(
M*)排除在外。 - log.md 可解析:带
## [日期] 操作类型 | 标题前缀,蓝本明确推荐这种可被 unix 工具 grep 的格式。 - Frontmatter + Dataview:蓝本 Tips 明确提到 Dataview 与 frontmatter,本库已落地。
- Git 化的 markdown 仓库:蓝本原话 "the wiki is just a git repo of markdown files",完全满足。
- MOC 即 index 替代:用各
README.md当文件夹首页 + Dataview 动态列表,是 index.md 的可用变体。
🟡 偏离但合理(扩展,非违规)
- M 私有层:蓝本没有私有层(他的假设是个人、可全量入 wiki)。但企业/客户数据场景必须隔离。本库用 "首字母 M 即停止" 实现,正交且不破坏三层架构,是必要且优雅的扩展。
- T 工具 / Z 待分拣:脚本与暂存区,蓝本未提但属合理工程扩展(蓝本也说 "pick what's useful")。
- 面试库作为 Raw:把 1571 篇面试题当 raw 源,方向没错;问题在于 "只囤不蒸馏"(见下)。
❌ 关键缺口(不符合 / 未执行)
- 复利比崩坏(最核心):1590 raw : 6 wiki ≈ 0.4%。Karpathy 的核心论断是 "the wiki is a persistent, compounding artifact… keeps getting richer with every source"。当前 wiki 几乎静态,正在滑向他所反对的 "每次提问现拼答案、不积累" 反模式。
- 1571 面试文件 → 0 wiki 页:这是全库最大的未开发杠杆。要么 明确决策 "面试库视为已结构化 raw、冻结不蒸馏",要么开始从高频概念(Redis Cluster、pg 备份、k8s 等)蒸馏概念卡片。两者都行,但不能 "既不蒸馏也不决策"。
- Query 零回灌:log 中 query 0 次。蓝本强调 "good answers can be filed back into the wiki as new pages"——分析、对比、新连接都不该消失在聊天记录里。本库
AGENTS.md5.2 第 3 条也写了,但还没执行过。 - Lint 没真正跑过:2 次 lint 都是 refactor/schema 演进,没有一次针对 wiki 健康(矛盾/孤儿页/概念缺页/缺失交叉引用/私有泄漏巡检)。
- 索引形态偏弱:
A00-百科/README.md是 "目录地图",不是蓝本要求的 "每页一行摘要 + 来源" 的真·index。wiki 长大后需补成可定位的目录。 - 缺搜索工具:蓝本说 ~100 源/数百页后需要 qmd 之类本地搜索。当前 wiki 小不急,但 raw 已达 1590,检索 raw 时其实已经需要。
- 剪藏大量未处理:
B10-剪藏15 篇只摄入了试点几篇,其余仍是未处理 raw。
维度评分
| 维度 | 评分 | 说明 |
|---|---|---|
| 架构映射 | 5/5 | Raw/Wiki/Schema 干净对应 |
| Raw 不可变纪律 | 5/5 | 明确只读 |
| Schema 完备度 | 5/5 | AGENTS 含铁律/工作流/模板 |
| 私有边界 | 5/5 | M 规则是加分项 |
| 操作闭环定义 | 4/5 | Query 回灌、Lint 实操缺失 |
| 索引/检索 | 2/5 | 无真·index、无搜索工具 |
| 实际复利(wiki 增长) | 1/5 | 0.4% 比,近静态 |
| 总评 | 架构 4.5 / 执行 1.5 | 骨架满分,血肉刚开始 |
行动建议(优先级)
- P0 — 给面试库定性:蒸馏(从高频概念出卡片)还是冻结(标记为已结构化 raw)?不决策 = 默认囤料。
- P0 — 建立 "每问必回灌" 纪律:本次评估本身就该落为 wiki 页(即本页),示范 Query→file-back。
- P1 — 批量摄入:
B10-剪藏剩余 12 篇 + 从面试库蒸馏前 N 个高频技术概念。 - P1 — 升级索引:把
A00-百科/README.md补成 "每页一行摘要+来源" 的真·index。 - P2 — 跑一次真 Lint:矛盾 / 孤儿页 / 概念缺页 / 私有泄漏巡检。
- P2 — 评估 qmd 本地搜索:raw 已超千,检索需要。
关联
- 蓝本:karpathy-llm-wiki
- 搭建法:Obsidian自生长知识库搭建法
- 概念:自生长知识库
- 纪律手册:AGENTS · 顶层地图:README · 日志:log