拓十年匠心定制 · 商业建站与技术教学双线并行 咨询热线:400-886-1026 service@lmnt.cn
ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

用 Claude Code 让 LLM 自己维护个人 Wiki:TaoToken 配置与 Markdown 知识库落地

用 Claude Code 让 LLM 自己维护个人 Wiki:TaoToken 配置与 Markdown 知识库落地 1. 从 Reddit 那个「LLM 自维护 Wiki」说起先把这个项目的核心讲清楚它让 Claude Code 这类 Agent 把每次查到的、推理出来的结论以 Markdown 文件的形式写进一个本地目录下次遇到相关问题先翻这个目录而不是让模型重新猜一遍。适合谁适合已经在用 Claude Code 写代码、做笔记但每次问领域问题都要重新贴上下文的人也适合想把零散笔记变成「活知识库」的开发者。我最早是在 Reddit 上刷到这个思路的作者受 Karpathy 一个 gist 的启发做了一套叫 llm-wiki 的东西。它的工作流其实不复杂你把原始资料丢进.raw/目录让 Agent 去 ingest摄取它会读内容、抽概念、生成 Markdown 页面、在页面之间建链接还会检查新知识和旧知识有没有冲突。之后你提问时Agent 优先查 Wiki命中就直接用已有知识回答没命中再回退到模型本身。这里有个关键点容易被忽略这套东西能跑起来前提是 Agent 有一个稳定、统一的模型通道。因为 ingest 一次可能要连续调很多轮模型中途换 Key、换端点、限流报错整个流程就断了。所以这篇不讲怎么「白嫖」而是讲怎么用 TaoToken 把 Key 和 API 通道统一起来再配 Claude Code 的settings.json最后演示一次 Wiki 条目的生成和校验。2. TaoToken 前置统一 Key 与 API 通道TaoToken 在这里扮演的角色是「一个 Key 走通多个模型」。你不需要在 Claude Code 里为不同模型维护多套环境变量也不用担心某个端点突然不可用导致 ingest 中断。官网在 https://taotoken.net/?utm_sourcetaotoken_aicg_blog_endutm_mediumcsdnutm_campaignrewriteutm_content API 入口是 https://taotoken.net/api 这个不加 UTM。你需要先拿到一个 API Key。登录后进控制台在 API Keys 页面创建一个复制出来。这个 Key 后面会写进 Claude Code 的配置里。注意Key 只显示一次丢了就重建别截图发群里。关于模型选择TaoToken 的模型对话页面可以让你先手动试几个模型确认哪个在「结构化抽取」这类任务上表现稳。我的经验是ingest 这种要抽概念、建链接的任务对模型的指令遵循能力要求比纯聊天高先用对话页面测一轮再写进配置能省很多返工。如果你打算长期跑 Agent、每天都有 ingest 任务可以看下 Coding Plan它更适合高频编码和 Agent 场景比按次调用更划算。入口在 https://taotoken.net/coding-plan?utm_sourcetaotoken_aicg_blog_endutm_mediumcsdnutm_campaignrewrite 。3. 可复制配置settings.json 骨架与 CC Switch 切换Claude Code 的配置核心是settings.json。下面这份骨架你可以直接抄把ANTHROPIC_BASE_URL指向 TaoToken 的 API 地址ANTHROPIC_API_KEY填你刚创建的 Key。{ env: { ANTHROPIC_BASE_URL: https://taotoken.net/api, ANTHROPIC_API_KEY: sk-你的TaoToken密钥, ANTHROPIC_MODEL: claude-sonnet-4-20250514, ANTHROPIC_SMALL_FAST_MODEL: claude-3-5-haiku-20241022 }, permissions: { allow: [ Read, Write, Edit, Bash(mkdir:*), Bash(ls:*), Bash(cat:*), Bash(grep:*) ], deny: [] } }几个参数说明一下。ANTHROPIC_BASE_URL必须是https://taotoken.net/api不要带路径后缀Claude Code 会自己拼/v1/messages。ANTHROPIC_MODEL是主模型负责 ingest 和生成ANTHROPIC_SMALL_FAST_MODEL是轻量模型负责一些快速判断比如「这个问题要不要查 Wiki」。permissions.allow里我特意放了Write和Edit因为 Wiki 维护本质就是让 Agent 写文件不放行它就没法落地。如果你要在多个配置之间切换比如公司项目用一套、个人 Wiki 用一套可以用 CC Switch 这类工具管理。它的逻辑是维护多个 profile每个 profile 对应一份settings.json切换时替换当前生效的配置。操作上就是新建一个 profile把上面这份 JSON 粘进去命名成llm-wiki之后一键切换。切换完记得重启 Claude Code 会话环境变量才会重新加载。注意不要把 Key 硬编码进会提交到 Git 的文件里。settings.json建议放在用户级配置目录或者用.gitignore排除。4. 验证请求跑通一次 Wiki 条目生成与校验配置写完先别急着上完整项目用最小步骤验证通道是通的。第一步在终端里直接发一个请求确认 Key 和端点没问题curl https://taotoken.net/api/v1/messages \ -H x-api-key: sk-你的TaoToken密钥 \ -H anthropic-version: 2023-06-01 \ -H content-type: application/json \ -d { model: claude-sonnet-4-20250514, max_tokens: 256, messages: [ {role: user, content: 用一句话解释什么是 Markdown 知识库} ] }返回里有content数组且带文本说明通道通了。如果返回 401检查 Key返回 404检查ANTHROPIC_BASE_URL是不是写成了带/v1的地址。第二步搭一个最小的 Wiki 目录结构mkdir -p ~/llm-wiki/.raw ~/llm-wiki/wiki echo # 原始资料TaoToken 是什么 ~/llm-wiki/.raw/taotoken.md echo TaoToken 提供统一的模型 API 通道一个 Key 可调用多个模型。 ~/llm-wiki/.raw/taotoken.md第三步在~/llm-wiki目录下启动 Claude Code给它一条 ingest 指令。指令要写清楚输入目录、输出目录、页面格式读取 .raw/ 目录下的所有 Markdown 文件为每个核心概念在 wiki/ 目录下生成一个独立页面。 页面格式要求 1. 文件名用概念名的小写连字符形式如 tao-token.md 2. 页面顶部用一级标题写概念名 3. 正文分「定义」「要点」「相关概念」三节 4. 「相关概念」里用 [[概念名]] 的形式建立链接 5. 如果 wiki/ 下已存在同名页面对比新旧内容冲突处在页面底部加「## 冲突待确认」小节 完成后列出你生成了哪些文件。跑完之后wiki/下应该出现tao-token.md。打开看一眼结构对不对、链接有没有建。这就是一次完整的「生成 校验」闭环。校验这步别省Agent 偶尔会把概念名写错导致链接指向不存在的页面。第四步验证「查询优先走 Wiki」。新开一个会话问一个和刚才资料相关的问题观察 Agent 有没有先去读wiki/目录。如果它直接回答而没读文件说明你的规则文件比如CLAUDE.md里没写清楚优先级补一条「回答领域问题前先检索 wiki/ 目录」即可。5. 本篇常见错排查报错一401 Unauthorized。九成是 Key 错了或者带了多余空格。检查settings.json里ANTHROPIC_API_KEY的值重新从控制台复制一次。也有可能是 Key 被删了去 API Keys 页面确认状态。报错二404 Not Found。检查ANTHROPIC_BASE_URL。正确值是https://taotoken.net/api不要写成https://taotoken.net/api/v1也不要漏掉https。Claude Code 内部会拼完整路径你多写一段就 404。报错三Agent 不写文件只在对话里输出内容。这是权限问题。settings.json的permissions.allow里必须有Write和Edit。如果用的是项目级配置确认当前目录下的.claude/settings.json覆盖了用户级配置。报错四ingest 跑到一半停了。大概率是单次请求 token 超了或者模型输出被截断。把.raw/里的文件拆小一次 ingest 一个文件同时在指令里加一句「如果内容过长分多次写入每次写完确认文件已保存」。报错五Wiki 页面之间链接错乱。这是模型对概念命名不一致导致的。在CLAUDE.md里固定一条命名规则比如「所有概念名用中文链接用[[中文名]]」让 Agent 每次生成前先读一遍已有页面的文件名列表。报错六切换 profile 后配置没生效。CC Switch 切换的是配置文件但已经运行的 Claude Code 会话不会热加载。退出当前会话重新进一次。如果还不行检查切换后的settings.json路径是不是 Claude Code 实际读取的那个。6. 把通道固定下来让 Wiki 自己长这套东西跑通之后你会发现真正的瓶颈不在 Agent 逻辑而在模型通道的稳定性。ingest 是长链条任务一次要调几十轮模型中间任何一次限流或超时都会让整个流程断掉而断掉之后你很难判断是模型的问题还是配置的问题。所以把 Key 和端点统一到 TaoToken本质上是在减少变量——出问题时你只需要排查一处。日常使用上我的建议是给 Wiki 单独建一个目录和代码项目分开CLAUDE.md里写清楚 ingest 规则和查询优先级。每次丢新资料进.raw/之后跑一次 ingest然后花两分钟翻一下新生成的页面确认链接和结构没问题。这个「人工校验」环节短期内别去掉Agent 的自维护能力还没到完全可信的程度。如果你还没创建 Key去 https://taotoken.net/api-keys?utm_sourcetaotoken_aicg_blog_endutm_mediumcsdnutm_campaignrewrite 建一个接入细节可以对照 https://taotoken.net/doc?utm_sourcetaotoken_aicg_blog_endutm_mediumcsdnutm_campaignrewrite 里的说明。想先手动试模型再写进配置的用模型对话页面 https://taotoken.net/chat?utm_sourcetaotoken_aicg_blog_endutm_mediumcsdnutm_campaignrewrite 测一轮。长期跑 Agent 的Coding Plan 在 https://taotoken.net/coding-plan?utm_sourcetaotoken_aicg_blog_endutm_mediumcsdnutm_campaignrewrite 。Claude Code 相关的接入配置参考 https://taotoken.net/claude-code?utm_sourcetaotoken_aicg_blog_endutm_mediumcsdnutm_campaignrewrite 。最后留一个我踩过的坑别一上来就把几百篇笔记全丢进.raw/。先拿三五篇跑通确认页面格式、链接规则、冲突检测都符合预期再批量处理。批量 ingest 出问题时回滚成本很高而小步验证几乎不花时间。
返回列表