Skip to content

知识库Karpathy契合度评估

评估时点:2026-08-04。对照蓝本 karpathy-llm-wiki(已归档于 B10-剪藏/karpathy-llm-wiki)。 核心问题:当前知识库在 "架构" 和 "执行" 两个维度上,分别契合到什么程度?

一句话结论

架构高度契合(≈4.5/5),执行处于复利曲线的起点(≈1.5/5),且存在一个结构性失衡:1571 篇面试库是 raw 黑洞,wiki 几乎没从它蒸馏出任何东西。

改名、分层、纪律手册这些 "骨架" 都对;但 Karpathy 真正的价值主张——wiki 随每个源复利增长——目前基本没发生。当前状态更靠近他明确反对的 "RAG 式囤料" 反模式,而非 "编译一次、持续维护" 的 wiki 模式。

当前量化基线

指标数值含义
Raw 源(B*)1590 篇B00/B10/B30/B40 共 19 篇 + B20-面试 1571 篇
Wiki 页(A*)6 篇正文 + 1 索引2 对比 + 3 概念卡片 + 1 领域综述
Wiki: Raw 比≈0.4%Karpathy 期望 "每个源触及 10-15 页",此处远低于
Ingest 次数(log)3仅试点:Karpathy 教程、ES 软文、pg_dump 教程
Query 回灌次数0提问不沉淀为 wiki 页
真·Lint 次数02 次 lint 实为 refactor/schema,非 wiki 健康巡检

逐条对照蓝本

✅ 完全契合(骨架正确)

  1. 三层架构映射干净:Raw(B*) / Wiki(A00-百科) / Schema(AGENTS.md+README+log.md) 一一对应蓝本。
  2. Raw 不可变纪律AGENTS.md 明确 " B* 只读、不删不改正文 ",与蓝本" immutable — LLM reads but never modifies " 一致。
  3. Wiki 由 AI 拥有A00-百科 标注 AI 读写,人只读——符合 "you read it; the LLM writes it"。
  4. Schema 是共同演进的配置AGENTS.md 首段即写 "与使用者共同演进",正是蓝本的 "co-evolve over time"。
  5. 三操作闭环定义完整:Ingest / Query / Lint 流程齐备,且作用域正确限定在 Raw↔Wiki,私有层(M*)排除在外。
  6. log.md 可解析:带 ## [日期] 操作类型 | 标题 前缀,蓝本明确推荐这种可被 unix 工具 grep 的格式。
  7. Frontmatter + Dataview:蓝本 Tips 明确提到 Dataview 与 frontmatter,本库已落地。
  8. Git 化的 markdown 仓库:蓝本原话 "the wiki is just a git repo of markdown files",完全满足。
  9. MOC 即 index 替代:用各 README.md 当文件夹首页 + Dataview 动态列表,是 index.md 的可用变体。

🟡 偏离但合理(扩展,非违规)

  1. M 私有层:蓝本没有私有层(他的假设是个人、可全量入 wiki)。但企业/客户数据场景必须隔离。本库用 "首字母 M 即停止" 实现,正交且不破坏三层架构,是必要且优雅的扩展。
  2. T 工具 / Z 待分拣:脚本与暂存区,蓝本未提但属合理工程扩展(蓝本也说 "pick what's useful")。
  3. 面试库作为 Raw:把 1571 篇面试题当 raw 源,方向没错;问题在于 "只囤不蒸馏"(见下)。

❌ 关键缺口(不符合 / 未执行)

  1. 复利比崩坏(最核心):1590 raw : 6 wiki ≈ 0.4%。Karpathy 的核心论断是 "the wiki is a persistent, compounding artifact… keeps getting richer with every source"。当前 wiki 几乎静态,正在滑向他所反对的 "每次提问现拼答案、不积累" 反模式。
  2. 1571 面试文件 → 0 wiki 页:这是全库最大的未开发杠杆。要么 明确决策 "面试库视为已结构化 raw、冻结不蒸馏",要么开始从高频概念(Redis Cluster、pg 备份、k8s 等)蒸馏概念卡片。两者都行,但不能 "既不蒸馏也不决策"。
  3. Query 零回灌:log 中 query 0 次。蓝本强调 "good answers can be filed back into the wiki as new pages"——分析、对比、新连接都不该消失在聊天记录里。本库 AGENTS.md 5.2 第 3 条也写了,但还没执行过。
  4. Lint 没真正跑过:2 次 lint 都是 refactor/schema 演进,没有一次针对 wiki 健康(矛盾/孤儿页/概念缺页/缺失交叉引用/私有泄漏巡检)。
  5. 索引形态偏弱A00-百科/README.md 是 "目录地图",不是蓝本要求的 "每页一行摘要 + 来源" 的真·index。wiki 长大后需补成可定位的目录。
  6. 缺搜索工具:蓝本说 ~100 源/数百页后需要 qmd 之类本地搜索。当前 wiki 小不急,但 raw 已达 1590,检索 raw 时其实已经需要。
  7. 剪藏大量未处理B10-剪藏 15 篇只摄入了试点几篇,其余仍是未处理 raw。

维度评分

维度评分说明
架构映射5/5Raw/Wiki/Schema 干净对应
Raw 不可变纪律5/5明确只读
Schema 完备度5/5AGENTS 含铁律/工作流/模板
私有边界5/5M 规则是加分项
操作闭环定义4/5Query 回灌、Lint 实操缺失
索引/检索2/5无真·index、无搜索工具
实际复利(wiki 增长)1/50.4% 比,近静态
总评架构 4.5 / 执行 1.5骨架满分,血肉刚开始

行动建议(优先级)

  • P0 — 给面试库定性:蒸馏(从高频概念出卡片)还是冻结(标记为已结构化 raw)?不决策 = 默认囤料。
  • P0 — 建立 "每问必回灌" 纪律:本次评估本身就该落为 wiki 页(即本页),示范 Query→file-back。
  • P1 — 批量摄入B10-剪藏 剩余 12 篇 + 从面试库蒸馏前 N 个高频技术概念。
  • P1 — 升级索引:把 A00-百科/README.md 补成 "每页一行摘要+来源" 的真·index。
  • P2 — 跑一次真 Lint:矛盾 / 孤儿页 / 概念缺页 / 私有泄漏巡检。
  • P2 — 评估 qmd 本地搜索:raw 已超千,检索需要。

关联

最近更新