
llm-knowledge-bases
以 LLM 为知识编译器的个人知识库构建方法
本条目整理自一份关于 Andrej Karpathy 个人知识库构建方法的技术拆解报告。报告指出,Karpathy 于 2026 年 4 月公开分享了一套基于 LLM 的知识库构建方法,其核心是从“操作代码”转向“操作知识”,将 LLM 视为知识库的核心引擎。系统采用五层架构:数据摄取层将网页、论文、代码等原始数据统一收集到 raw/ 目录;知识编译层由 LLM 将原始数据“编译”为结构化的 Markdown Wiki,包括摘要、概念文章、反向链接和索引文件;查看与浏览层使用 Obsidian 作为前端;问答层通过 LLM Agent 检索知识库并生成结构化回答;维护层通过 LLM 健康检查确保知识库一致性。报告强调,在约 40 万词的规模下,LLM 可以自动维护索引,无需传统 RAG 组件。每次查询的结果会回写知识库,实现增量增强。
09.08