十年匠心定制 · 商业建站与技术教学双线并行 咨询热线:400-886-1026 service@lmnt.cn
ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

Claude Code Router 多模型智能路由:3 步把日常代码请求打到更便宜的模型上

Claude Code Router 多模型智能路由:3 步把日常代码请求打到更便宜的模型上 Claude Code Router 多模型智能路由3 步把日常代码请求打到更便宜的模型上【免费下载链接】claude-code-routerOne local control plane for every AI agent: route across models, fuse new capabilities, orchestrate tools, and stay fully in control.项目地址: https://gitcode.com/GitHub_Trending/cl/claude-code-router您是不是也有过这种时刻Claude Code、Codex、Kimi CLI 各连一家供应商想换个模型要翻遍每个 Agent 的配置文件某家 API 一限流当天所有请求集体变红。Claude Code RouterCCR做的事情是在您本机127.0.0.1:3456放一个多模型智能路由网关所有编程 Agent 都指向这一个入口模型选择、失败降级、Token 和成本核算全部交给它统一处理。 真正的问题不是选哪个模型而是请求该去哪里CCR 把自己定位成本地控制平面而不只是一个转发代理。它接在您和供应商之间承担四件事统一入口Claude Code、Codex、Grok CLI、Kimi CLI、OpenCode 等客户端保持原样工作只需把端点指向 CCR 网关配置集中在一个地方维护。协议转换网关支持 OpenAI Chat/Responses、Anthropic Messages、Gemini 等协议Claude Code 用 Anthropic 协议进来的请求可以落到 OpenAI 兼容的供应商上协议差异由 CCR 抹平。失败兜底内置重试、凭据池、Key 轮换和有序 Fallback限流或超时不再意味着整条请求链报废。可观测每次请求最终命中哪个供应商、哪个模型、耗时多少、花了多少 Token日志页里一行一行可查。理解这层关系后后面的配置其实就三步起服务、加供应商、定路由。 3 步从安装到第一条路由两种启动方式桌面端或 CLI桌面端是官方推荐路径下载对应 macOS、Windows 或 Linux 版本启动即可模型网关默认监听http://127.0.0.1:3456。如果您习惯命令行或服务器环境用 npm CLI 更轻npm install -g musistudio/claude-code-router ccr ui要求 Node.js 22启动后浏览器打开http://127.0.0.1:3458是管理界面模型网关仍在 3456 端口。Docker 部署则一行docker compose up -d --build管理界面同样在 3458。三行配置把 Ollama 接进路由拉一个本地代码模型在管理界面供应商 → 添加供应商里选自定义端点。对应到配置字段就是三样东西{ name: ollama, api_base_url: http://localhost:11434/v1, models: [qwen2.5-coder:latest] }内置供应商预设OpenRouter、DeepSeek、Mistral、Moonshot 等在添加时直接选省去填端点见 providers/presets/。保存后打开服务点启动再到Agent 配置里给 Claude Code 指定默认模型并应用档案。发一条真实请求日志页立刻能看到最终命中的供应商和模型——路由已经通了。 算一笔账高频请求走本地难请求留云端路由的价值不在用免费模型而在把流量按价值分层。以日常使用强度为例云端按常见 API 单价估算本地模型电费可忽略请求类型全部直连云端经 CCR 路由后差别日常代码补全每次计费高频路由到本地模型省约 99%简单重构、注释生成强模型单价路由到低成本模型省 80% 以上复杂架构推理强模型单价仍走强模型质量不降云端限流 / 超时请求直接失败自动重试 Fallback请求保持可用最后一行容易被忽略限流时 CCR 会按您配的顺序切到备用模型重试而不是把错误抛给终端上正在等回显的 Agent。这是路由区别于简单换 API 地址的关键。️ 每条请求去了哪控制台里看得一清二楚配好之后您花在调配置上的时间会远少于花在看日志上的时间。界面左侧管理供应商与模型右侧编排路由规则请求进来按列表顺序匹配第一条命中的启用规则决定改写方向。日志页则逐条记录最终供应商、模型、状态、耗时、Token 与成本估算——这条请求到底花没花钱不再靠猜。托盘和状态栏组件可以常驻显示当前模型与用量开会时扫一眼就知道今天烧了多少 Token。Subagent 自动挑便宜模型Claude Code 派生 Subagent、Task 或 Workflow 时CCR 会读取模型页里每个模型填写的 Description把哪些模型适合什么任务注入到 Agent 工具说明里。Claude Code 据此为派生请求写上模型标签CCR 提取标签后把请求路由到指定模型。写一句适合低成本并行任务的 Description大量后台子任务就会自动流向便宜模型主推理请求不动。条件表达不了时写一段 Node.js 脚本Header/Body 条件 改写的组合覆盖不了的需求灰度分流、查外部策略再决定模型可以把规则类型切成Node.js 脚本脚本在独立 Worker 里异步执行10–30000 毫秒超时异常或超时走 fail-open 继续下一条规则不会卡死整个网关。规则细节和完整字段见 路由文档。 落地团队里怎么用起来共享供应商配置在Settings导出备份新成员导入即可复用同一套供应商与路由规则不用口头传 API Key。后台任务走本地模型批量重命名、日志整理、代码搜索这类高频低难度请求用路由规则指到 Ollama 模型。Key 放凭据池多个 Key 或共享额度时启用凭据池与轮换限流命中一个 Key 自动切下一个。CCR 把哪个模型、哪家供应商、失败了怎么办从散落在各客户端的配置项收拢成一张您能在本地随时查看的路由表。现在就去供应商页接入那个最便宜的模型把日常补全指过去。跑顺之后再加一条 Fallback 规则这套链路就稳了。【免费下载链接】claude-code-routerOne local control plane for every AI agent: route across models, fuse new capabilities, orchestrate tools, and stay fully in control.项目地址: https://gitcode.com/GitHub_Trending/cl/claude-code-router创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表