
Claude Code Router 快速接入 Gemini 实战【免费下载链接】claude-code-routerOne local control plane for every AI agent: route across models, fuse new capabilities, orchestrate tools, and stay fully in control.项目地址: https://gitcode.com/GitHub_Trending/cl/claude-code-routerClaude Code 直连 Gemini 的 API第一个请求就是 404因为两边协议根本不通。Claude Code Router 是一个本地模型网关跑在你自己的机器上接管 Claude Code 等编程 Agent 的请求再转发给你选定的供应商。接 Gemini、调路由、看成本都在一个界面里完成。 Claude Code 为什么不能直连 GeminiClaude Code 客户端只认 Anthropic 的 Messages 协议请求字段、工具调用格式、流式响应结构都是按它写的。Gemini 的原生接口是另一套 Generate Content 协议字段名和工具定义都不一样。把 Base URL 直接换成 Google 的端点请求体到了对方那里就是无法解析的格式。Claude Code Router 的做法是在中间做翻译。它在本机 3456 端口开一个 Anthropic 兼容入口Claude Code 照常指向这里网关收到请求后按供应商配置转成 Gemini 协议发出去再把响应转回客户端能懂的格式。你不用改 Claude Code 的任何配置也不用为每家供应商单独维护一份环境变量。这套机制不只服务 Gemini。项目内置了 25 个供应商预设DeepSeek、Moonshot、OpenRouter 等都能按添加供应商一个动作接入Codex、Kimi CLI、OpenCode 这些客户端也走同一个网关。换模型供应商只是改路由的事日常工作流不用动。 3 分钟跑通 Gemini 最小配置npm 全局安装后一条命令启动管理界面要求 Node.js 22 及以上版本npm install -g musistudio/claude-code-router ccr ui浏览器打开 127.0.0.1:3458 后按顺序做三件事。供应商页点添加供应商选内置的 Gemini 预设填 API Key勾选 gemini-2.5-flash 和 gemini-2.5-pro 两个模型不放心就点检测连通性它会发一个真实测试请求验证 Key 和模型名是否可用。然后在服务页点启动模型网关开始监听 127.0.0.1:3456。再到 Agent 配置页启用 Claude Code 档案把默认模型指向上面勾选的模型并应用。到这一步链路就通了在 Claude Code 里随便问一句话日志页会出现第一条请求记录着最终供应商、模型、状态码和耗时。请求里的模型名如果没被识别内置路由会把它落到 Agent 档案设置的默认模型上不用手动兜底。⚖️ 路由策略怎么调路由页把请求按用途分成几档Default 处理主对话Background 处理后台任务Think 处理深度思考Long Context 处理超长上下文Web Search 处理搜索类请求。全部指向同一个模型时网关就是个纯转发层真正省钱省力的玩法是分档。请求类型推荐模型理由主对话gemini-2.5-flash快便宜深度思考gemini-2.5-pro推理更强长上下文gemini-2.5-pro窗口更大搜索请求gemini-2.5-flash延迟低Long Context 档旁边有个 Context Threshold填 60000 表示输入超过 6 万 token 才切到长上下文模型短请求继续走默认的 flash。这样日常对话不会误入贵模型成本曲线立刻平缓下来。更复杂的需求交给自定义规则。规则按列表顺序匹配第一条命中的启用规则改写请求条件可以基于请求头或 body 字段也可以写成 Node.js 脚本读完整请求后动态返回目标模型。每条规则都能配自己的失败回退——上游超时或报错时按你指定的顺序换下一个模型重试而不是把错误直接抛回客户端。 用请求日志核对真实成本路由调完不等于没问题日志页才是对账单。每条请求都会记录最终命中的供应商和模型、状态码、耗时、输入输出 token 和估算成本概览页按今天、24 小时或 7 天汇总还能看到缓存命中率和总花费。哪个模型在实际吃 token看一眼就清楚。如果 Key 有额度上限可以在供应商高级设置里展开凭据池给每条 Key 配限额达到上限后网关自动跳过这条 Key换同供应商的其他凭据继续发请求{ rpm: 60, tpm: 100000 }rpm 是每分钟请求数上限tpm 是每分钟 token 上限。配了限额之后超限不会让请求失败而是静默换 Key。跑批量任务时这一点很关键不会因为某个 Key 撞墙就整批报错。️ 排错速查401、格式与超时现象先看什么处理401API Key重填后重测404模型 ID对照上游模型列表502供应商为空添加后重启服务响应慢模型档位切 flash 系列502 值得单独说明刚装完还没加供应商时网关的 /health 返回 502 是预期行为不是故障。管理界面能打开也不代表网关可用以供应商是否配置完成、服务是否启动为准。401 基本只跟 Key 本身有关重新填一遍再测连通性即可定位。最小配置跑通后剩下的工作就是按任务分档、按日志核账。供应商字段与路由规则的完整说明见 供应商配置 和 智能路由。【免费下载链接】claude-code-routerOne local control plane for every AI agent: route across models, fuse new capabilities, orchestrate tools, and stay fully in control.项目地址: https://gitcode.com/GitHub_Trending/cl/claude-code-router创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考