9router
统一路由和令牌节省工具,将 Claude Code、Cursor 等 AI 编码工具连接到 40+ 免费/付费 AI 模型提供商,并自动降级回退。亮点在于内嵌 RTK 令牌压缩器,可节省 20-40% 输入令牌,且免费提供商(如 Kiro)提供无限制使用,配合多层级回退策略实现零中断编码体验。对于想白嫖或降低 AI 编码成本的开发者来说非常实用。
README

9Router - 免费 AI 路由 & Token 节省器
编码永不停歇。借助 RTK 节省 20-40% token,并自动回退到免费及廉价 AI 模型。
将您的所有 AI 代码工具(Claude Code、Cursor、Antigravity、Copilot、Codex、Gemini、OpenCode、Cline、OpenClaw……)连接到 40+ 个 AI 提供商和 100+ 个模型。
🇻🇳 Tiếng Việt • 🇨🇳 中文 • 🇯🇵 日本語
🤔 为什么选择 9Router?
停止浪费金钱、token 和撞到限制:
- ❌ 订阅配额每月用不完就过期
- ❌ 速率限制打断编码进程
- ❌ 工具输出(git diff、grep、ls……)快速消耗 token
- ❌ 昂贵的 API(每个提供商 $20-50/月)
- ❌ 在提供商之间手动切换
9Router 解决了这些问题:
- ✅ RTK Token 节省器 - 自动压缩 tool_result 内容,每次请求节省 20-40% token
- ✅ 最大化订阅价值 - 跟踪配额,在重置前用完每一分
- ✅ 自动回退 - 订阅 → 廉价 → 免费,零停机
- ✅ 多账户 - 每个提供商下账户间的轮询
- ✅ 通用 - 适用于 Claude Code、Codex、Cursor、Cline 以及任何 CLI 工具
🔄 工作原理
┌─────────────┐
│ 你的 CLI │ (Claude Code, Codex, OpenClaw, Cursor, Cline...)
│ 工具 │
└──────┬──────┘
│ http://localhost:20128/v1
↓
┌─────────────────────────────────────────────┐
│ 9Router (智能路由) │
│ • RTK Token 节省器 (削减 tool_result token) │
│ • 格式转换 (OpenAI ↔ Claude) │
│ • 配额跟踪 │
│ • 自动 token 刷新 │
└──────┬──────────────────────────────────────┘
│
├─→ [第1层: 订阅] Claude Code, Codex, GitHub Copilot
│ ↓ 配额耗尽
├─→ [第2层: 廉价] GLM ($0.6/1M), MiniMax ($0.2/1M)
│ ↓ 预算上限
└─→ [第3层: 免费] Kiro, OpenCode Free, Vertex ($300 credits)
结果:编码永不停歇,最小化成本 + 通过 RTK 节省 20-40% token
⚡ 快速开始
1. 全局安装:
npm install -g 9router
9router
🎉 仪表盘在 http://localhost:20128 打开
2. 连接免费提供商(无需注册):
仪表盘 → 提供商 → 连接 Kiro AI(免费无限 Claude)或 OpenCode Free(无需认证)→ 完成!
3. 在 CLI 工具中使用:
Claude Code/Codex/OpenClaw/Cursor/Cline 设置:
Endpoint: http://localhost:20128/v1
API Key: [从仪表盘复制]
Model: kr/claude-sonnet-4.5
就这样! 使用免费 AI 模型开始编码。
替代方案:从源代码(此仓库)运行:
此仓库包是私有的(9router-app),因此从源代码/Docker 运行是预期的本地开发路径。
cp .env.example .env
npm install
PORT=20128 NEXT_PUBLIC_BASE_URL=http://localhost:20128 npm run dev
生产模式:
npm run build
PORT=20128 HOSTNAME=0.0.0.0 NEXT_PUBLIC_BASE_URL=http://localhost:20128 npm run start
默认 URL:
- 仪表盘:
http://localhost:20128/dashboard - 兼容 OpenAI 的 API:
http://localhost:20128/v1
视频指南
🇺🇸 英文 9Router + Claude Code FREE 设置 作者 Build AI With Hamid |
🇻🇳 Tiếng Việt 使用 9Router 为 OpenClaw 节省 LLM 费用 作者 Mì AI |
🇺🇸 英文 Claude Code FREE Forever — 无限模型 作者 Build AI With Hamid |
🇺🇸 英文 使用 9Router 🚀 免费设置 Claude CLI 作者 CodeVerse Soban |
🇻🇳 Tiếng Việt 从 A 到 Z 安装 OpenClaw Free + 9Router 作者 Mai Gia |
🇺🇸 英文 免费 OpenClaw + Claude Opus 4.6 作者 Build AI With Hamid |
🎬 制作了关于 9Router 的视频? 提交一个 Pull Request 将您的视频添加到此部分 — 我们会合并!
🛠️ 支持的 CLI 工具
9Router 与所有主流 AI 编码工具无缝协作:
![]() Claude-Code |
![]() OpenClaw |
![]() Codex |
![]() OpenCode |
![]() Cursor |
![]() Antigravity |
![]() Cline |
![]() Continue |
![]() Droid |
![]() Roo |
![]() Copilot |
![]() Kilo Code |
🌐 支持的提供商
🔐 OAuth 提供商
![]() Claude-Code |
![]() Antigravity |
![]() Codex |
![]() GitHub |
![]() Cursor |
🆓 免费提供商
![]() Kiro AI Claude 4.5 + GLM-5 + MiniMax 无限免费 |
![]() OpenCode Free 无需认证 • 自动获取模型 无限免费 |
![]() Vertex AI Gemini 3 Pro + GLM-5 + DeepSeek $300 免费额度 |
注意: iFlow、Qwen 和 Gemini CLI 的免费层于 2026 年停止。请改用 Kiro / OpenCode Free / Vertex。
🔑 API Key 提供商(40+)
![]() OpenRouter |
![]() GLM |
![]() Kimi |
![]() MiniMax |
![]() OpenAI |
![]() Anthropic |
![]() Gemini |
![]() DeepSeek |
![]() Groq |
![]() xAI |
![]() Mistral |
![]() Perplexity |
![]() Together AI |
![]() Fireworks |
![]() Cerebras |
![]() Cohere |
![]() NVIDIA |
SiliconFlow |
……以及 20+ 个更多提供商,包括 Nebius、Chutes、Hyperbolic 以及自定义 OpenAI/Anthropic 兼容端点
💡 关键特性
| 特性 | 作用 | 为何重要 |
|---|---|---|
| 🚀 RTK Token 节省器 (RTK ⭐40K) | 在发送给 LLM 之前压缩工具输出(git diff、grep、ls、tree……) |
每次请求节省 20-40% 输入 tokens |
| 🪨 原始人模式 (Caveman ⭐52K) | 注入原始人风格提示 → LLM 回复简洁,保留技术内容 | 节省 高达 65% 输出 tokens |
| 🎯 智能三层回退 | 自动路由:订阅 → 廉价 → 免费 | 编码不停歇,零停机 |
| 📊 实时配额跟踪 | 实时 token 计数 + 重置倒计时 | 最大化订阅价值 |
| 🔄 格式转换 | OpenAI ↔ Claude ↔ Gemini ↔ Cursor ↔ Kiro ↔ Vertex | 适用于任何 CLI 工具 |
| 👥 多账户支持 | 每个提供商可添加多个账户 | 负载均衡 + 冗余 |
| 🔄 自动 Token 刷新 | OAuth token 自动刷新 | 无需手动重新登录 |
| 🎨 自定义组合 | 创建无限模型组合 | 按需定制回退策略 |
| 📝 请求日志 | 调试模式,记录完整请求/响应日志 | 轻松排查问题 |
| 💾 云端同步 | 跨设备同步配置 | 任何地方使用相同设置 |
| 📊 使用分析 | 跟踪 tokens、成本、随时间变化趋势 | 优化支出 |
| 🌐 随处部署 | 本地、VPS、Docker、Cloudflare Workers | 灵活的部署选项 |
🚀 RTK Token 节省器
工具输出(git diff、grep、find、ls、tree、日志转储……)通常会消耗你 30-50% 的 prompt 预算。RTK 在请求到达 LLM 之前检测它们并应用智能、无损压缩:
- 过滤器:
git-diff、git-status、grep、find、ls、tree、dedup-log、smart-truncate、read-numbered、search-list - 自动检测: 无需配置——RTK 查看每个
tool_result的前 1KB 并选择正确的过滤器。 - 安全设计: 如果过滤器失败、抛出错误或使输出变大,RTK 会静默保留原始文本。错误永远不会破坏你的请求。
- 通用: 适用于所有格式(OpenAI、Claude、Gemini、Cursor、Kiro、OpenAI Responses),因为它在任何格式转换之前运行。
- 默认开启: 可随时在仪表盘 → 端点设置中切换。
不使用 RTK:向 LLM 发送 47K tokens
使用 RTK: 向 LLM 发送 28K tokens (节省 40% · 上下文相同 · 答案相同)
🎯 智能三层回退
创建具有自动回退的组合:
组合:"my-coding-stack"
1. cc/claude-opus-4-6 (你的订阅)
2. glm/glm-4.7 (廉价备份, $0.6/1M)
3. if/kimi-k2-thinking (免费回退)
→ 当配额用完或出现错误时自动切换
📊 实时配额跟踪
- 每个提供商的 token 消耗
- 重置倒计时(5 小时、每天、每周)
- 付费层的成本估算
- 月度支出报告
🔄 格式转换
格式间无缝转换:
- OpenAI ↔ Claude ↔ Gemini ↔ Cursor ↔ Kiro ↔ Vertex ↔ Antigravity ↔ Ollama ↔ OpenAI Responses
- 你的 CLI 工具发送 OpenAI 格式 → 9Router 转换 → 提供商接收原生格式
- 适用于任何支持自定义 OpenAI 端点的工具
👥 多账户支持
- 每个提供商添加多个账户
- 自动轮询或基于优先级的路由
- 当一个账户达到配额时回退到下一个账户
🔄 自动 Token 刷新
- OAuth token 在过期前自动刷新
- 无需手动重新认证
- 跨所有提供商的无缝体验
🎨 自定义组合
- 创建无限模型组合
- 混合订阅、廉价和免费层
- 为组合命名以便快速访问
- 通过云端同步在设备间共享组合
📝 请求日志
- 启用调试模式以获取完整的请求/响应日志
- 跟踪 API 调用、headers 和 payloads
- 排查集成问题
- 导出日志用于分析
💾 云端同步
- 跨设备同步提供商、组合和设置
- 自动后台同步
- 安全加密存储
- 从任何地方访问你的设置
云端运行时说明
- 在生产环境中优先使用服务器端云变量:
BASE_URL(同步调度器使用的内部回调 URL)CLOUD_URL(云端同步端点基础 URL)
NEXT_PUBLIC_BASE_URL和NEXT_PUBLIC_CLOUD_URL仍支持兼容性/UI,但服务器运行时现在优先使用BASE_URL/CLOUD_URL。- 云端同步请求现在使用超时 + 快速失败行为,以避免云端 DNS/网络不可用时 UI 挂起。
📊 使用分析
- 跟踪每个提供商和模型的 token 使用情况
- 成本估算和支出趋势
- 月度报告和洞察
- 优化你的 AI 支出
💡 重要提示 - 理解仪表盘成本:
使用分析中显示的“成本”仅用于跟踪和比较目的。 9Router 本身从不向你收费。你只直接向提供商付款(如果使用付费服务)。
示例: 如果你的仪表盘显示“总成本 $290”,而你在使用 iFlow 模型,这表示 如果直接使用付费 API 你将支付的价格。你的实际成本 = $0(iFlow 是免费无限制的)。
将其视为一个“节省追踪器”,显示你通过使用免费模型或经过 9Router 路由节省了多少!
🌐 随处部署
- 💻 本地 - 默认,可离线工作
- ☁️ VPS/云 - 跨设备共享
- 🐳 Docker - 一键部署
- 🚀 Cloudflare Workers - 全球边缘网络
💰 快速价格概览
| 层 | 提供商 | 成本 | 配额重置 | 最适合 |
|---|---|---|---|---|
| 🚀 TOKEN 节省器 | RTK(内置) | 免费 | 常开 | 每个请求节省 20-40% tokens |
| 💳 订阅 | Claude Code (Pro/Max) | $20-200/月 | 5小时 + 每周 | 已订阅用户 |
| Codex (Plus/Pro) | $20-200/月 | 5小时 + 每周 | OpenAI 用户 | |
| GitHub Copilot | $10-19/月 | 每月 | GitHub 用户 | |
| Cursor IDE | $20/月 | 每月 | Cursor 用户 | |
| 💰 廉价 | GLM-5.1 / GLM-4.7 | $0.6/1M | 每天上午10点 | 预算备份 |
| MiniMax M2.7 | $0.2/1M | 5小时滚动 | 最便宜选项 | |
| Kimi K2.5 | $9/月固定 | 1000万 tokens/月 | 可预测成本 | |
| 🆓 免费 | Kiro AI | $0 | 无限 | 免费 Claude 4.5 + GLM-5 + MiniMax |
| OpenCode Free | $0 | 无限 | 无需认证,自动获取模型 | |
| Vertex AI | $300 额度 | 新 GCP 账户 | Gemini 3 Pro + DeepSeek + GLM-5 |
💡 专业提示: RTK + Kiro AI + OpenCode Free 组合 = $0 成本 + 20-40% token 节省!
📊 理解 9Router 成本与计费
9Router 计费现实:
✅ 9Router 软件 = 永远免费(开源,从不收费)
✅ 仪表盘“成本” = 仅显示/跟踪(非实际账单)
✅ 你直接向提供商付费(订阅或 API 费用)
✅ 免费提供商保持免费(iFlow, Kiro, Qwen = $0 无限)
❌ 9Router 从不发送发票或向你的卡收费
成本显示如何工作:
仪表盘显示估计成本,就像你直接使用付费 API 一样。这不是计费——它是一个比较工具,展示你的节省。
示例场景:
仪表盘显示:
• 总请求数:1,662
• 总 Tokens:47M
• 显示成本:$290
实际检查:
• 提供商:iFlow(无限免费)
• 实际支付:$0.00
• $290 意味着:你通过使用免费模型节省的金额!
支付规则:
- 订阅提供商(Claude Code, Codex):通过他们的网站直接支付
- 廉价提供商(GLM, MiniMax):直接支付,9Router 只是路由
- 免费提供商(iFlow, Kiro, Qwen):真正永远免费,无隐藏费用
- 9Router:从不收费,永远
🎯 使用场景
场景 1:"我有 Claude Pro 订阅"
问题: 配额过期未用,重度编码时速率限制
解决方案:
组合:"最大化-claude"
1. cc/claude-opus-4-7 (充分利用订阅)
2. glm/glm-5.1 (配额耗尽时的廉价备份)
3. kr/claude-sonnet-4.5 (免费紧急回退)
月成本:$20(订阅)+ ~$5(备份)= $25 总计
vs. $20 + 撞到限制 = 沮丧
场景 2:"我想要零成本"
问题: 付不起订阅,需要可靠的 AI 编码
解决方案:
组合:"永远免费"
1. kr/claude-sonnet-4.5 (Claude 4.5 免费无限)
2. kr/glm-5 (通过 Kiro 免费使用 GLM-5)
3. oc/<auto> (OpenCode Free,无需认证)
月成本:$0
质量:生产级模型 + RTK 节省 20-40% tokens
场景 3:"我需要 24/7 编码,没有中断"
问题: 截止日期,不能承受宕机
解决方案:
组合:"始终在线"
1. cc/claude-opus-4-7 (最佳质量)
2. cx/gpt-5.5 (第二个订阅)
3. glm/glm-5.1 (廉价,每天重置)
4. minimax/MiniMax-M2.7 (最便宜,5小时重置)
5. kr/claude-sonnet-4.5 (免费无限)
结果:5 层回退 = 零停机
月成本:$20-200(订阅)+ $10






























