OmniRoute
免费AI网关,聚合236家AI提供商(50+免费),通过单一端点接入Claude Code、Cursor、Cline等工具。亮点:RTK+Caveman叠加压缩可节省15-95% token;17种路由策略自动回退,无需中断;支持MCP/A2A协议和70+工具;3级代理绕过地理限制。零成本起步,适合白嫖各种免费模型。
README

🚀 OmniRoute — 免费 AI 网关
永不停歇编码。通过一个端点,将每个 AI 工具连接到 236 个提供商 — 50+ 免费。
将 Claude Code、Codex、Cursor、Cline、Copilot 和 Antigravity 接入免费的 Claude / GPT / Gemini。自动回退。
RTK + Caveman 压缩可节省 15–95% 的 token。永不会达到限制。
每月约 16 亿免费 token — 使用注册积分后,第一个月最多可达约 21 亿 — 聚合了免费层级,再加上永久免费、无限额提供商的超长尾巴,以及上述压缩让每一分更耐用。(我们如何计算 →)
💬 加入社区
问题、提供商提示、路线图和支持 → Discord · Telegram · WhatsApp 🌍 全球 / 🇧🇷 巴西
🚀 快速开始 • 🎯 组合 • 🌐 提供商 • 🔌 CLI 与 MCP • 🗜️ 压缩 • 🌍 网站
💥 我们的承诺 • 🤔 为什么 • 🏆 独特之处 • 🤖 兼容的 CLI • 🖥️ 运行环境 • 🔒 隐私 • 🎬 实际演示 • 📚 探索更多 • 📧 支持
🌐 支持 41+ 种语言| 🇺🇸 | 🇧🇷 | 🇪🇸 | 🇫🇷 | 🇮🇹 | 🇷🇺 | 🇨🇳 | 🇹🇼 | 🇩🇪 | 🇯🇵 | 🇰🇷 | 🇮🇳 |
| 🇹🇭 | 🇻🇳 | 🇮🇩 | 🇲🇾 | 🇵🇭 | 🇸🇦 | 🇮🇱 | 🇦🇿 | 🇺🇦 | 🇵🇱 | 🇨🇿 | |
| 🇳🇱 | 🇧🇬 | 🇩🇰 | 🇫🇮 | 🇳🇴 | 🇸🇪 | 🇭🇺 | 🇷🇴 | 🇸🇰 | 🇵🇹 |
💰 每月约 16 亿免费 Token
手动堆叠免费 tier 是很痛苦的 — 数十个 SDK、数十种速率限制,而且你不知道自己实际有多少。OmniRoute 将 40+ 提供商池 / 500+ 模型的有文档记录的免费 tier 聚合为一个诚实的数字,并在仪表盘 (
/dashboard/free-tiers) 上实时显示。
- 每月约 16 亿免费 token(稳态)— 使用注册积分后,第一个月最多可达约 21 亿。
- 池去重,诚实 — 我们对每个共享免费池只计一次,因此标题不会像竞争对手声称的数十亿那样因速率限制上限而膨胀。(如果 24/7 计算每个速率限制,读数会达到约 100 亿;我们不发布这个数字。)
- 加上不可计数部分 — 永久免费、无 token 上限的提供商(SiliconFlow、Z.AI GLM-Flash、Kilo、OpenCode Zen……)以及 $10 的 OpenRouter 充值,可解锁 +2400 万/月,两者都单独列出,从不夸大标题。
- 按模型细分、本月已使用/剩余实时显示,以及每个提供商的透明条款标记。
预览模拟图 — 一旦
/dashboard/free-tiers页面得到验证,将替换为真实截图。完整方法论(池去重、积分 tier、提供商条款):docs/reference/FREE_TIERS.md。
💥 我们的承诺
一个端点。236 个提供商。 永不停歇地构建 — 让 OmniRoute 为你挑选最便宜且能正常工作的那个。
| 🚫 永不会达到限制 毫秒级在 236 个提供商之间自动回退。配额耗尽?下一个提供商接管 — 零停机。 |
💸 节省高达 95% 的 token RTK + Caveman 堆叠压缩减少 15–95% 的合格 token(工具密集型会话平均约 89%)。 |
🆓 $0 起步 50+ 个提供免费 tier 的提供商,11 个**永久**免费(Kiro、Qoder、Pollinations、LongCat……)。无需信用卡。 |
| 🔌 每个工具都能工作 16+ 个编码 agent — Claude Code、Codex、Cursor、Cline、Copilot、Antigravity — 通过一个配置。 |
🧩 一个端点 OpenAI ↔ Claude ↔ Gemini ↔ Responses API 翻译。将任何工具指向 /v1,它就能工作。 |
🛡️ 生产级 断路器、TLS 伪装、MCP(87 个工具)、A2A、记忆、护栏、评测。14,965 个测试。 |
🤔 为什么选择 OmniRoute?
不再同时管理 10 个仪表盘、失效的 API key 和意外账单。
| ❌ 日常痛点 | ✅ OmniRoute 如何解决 |
|---|---|
| 📉 订阅配额每月未用完就过期 | 最大化订阅 — 跟踪配额,在重置前用完每个 token |
| 🛑 速率限制打断你编码 | 4 层自动回退 — 订阅 → API → 便宜 → 免费,毫秒级 |
🔥 工具输出(git diff、grep、日志)消耗 token |
RTK + Caveman 压缩 — 每次请求节省 15–95% 合格 token |
| 💸 昂贵的 API(每个提供商每月 $20–50) | 成本优化路由 — 自动路由到最便宜的可行模型 |
| 🧰 每个 AI 工具都想要自己的设置 | 一个端点,每个工具,一个仪表盘 |
| 🌍 AI 在你所在国家被屏蔽 | 3 层代理 + TLS 指纹伪装 — 从任何地方使用 AI |
┌──────────────────────────────────────────────────────────┐
│ 你的 IDE / CLI (Claude Code, Cursor, Cline…) │
└─────────────────────────┬──────────────────────────────────┘
│ http://localhost:20128/v1
▼
┌──────────────────────────────────────────────────────────┐
│ OmniRoute — 智能路由器 │
│ RTK + Caveman 压缩 · 17 种路由策略 │
│ 断路器 · TLS 伪装 · MCP · A2A · 护栏 │
└─────────────────────────┬──────────────────────────────────┘
┌─────────────┬────┴────────┬─────────────┐
▼ Tier 1 ▼ Tier 2 ▼ Tier 3 ▼ Tier 4
订阅 API Key 便宜 免费
Claude Code, DeepSeek, GLM $0.5, Kiro, Qoder,
Codex, Copilot Groq, xAI MiniMax $0.2 Pollinations
配额耗尽? ───▶ 预算用完? ─▶ 预算用完? ─▶ 始终开启
🎯 组合 — 旗舰功能
组合 (combo) 是 OmniRoute 自动跨模型路由的链。配额用尽、提供商失败或成本飙升 — 组合会静默滑动到下一个模型。这就是 OmniRoute 坚不可摧的原因。 🛡️
⚡ 零配置 — 只需使用 auto
无需创建组合。将模型设置为 auto(或变体),OmniRoute 会根据你连接的提供商实时打分,构建虚拟组合:
| 模型 ID | 优化目标 |
|---|---|
auto |
🎯 平衡默认(LKGP — 坚持使用你最后一个好用的提供商) |
auto/coding |
🧑💻 代码生成时质量优先权重 |
auto/fast |
⚡ 最低延迟优先 |
auto/cheap |
💰 每个 token 最便宜优先 |
auto/offline |
🔋 最多配额/速率限制余量优先 |
auto/smart |
🔭 质量优先 + 10% 探索以发现更好的模型 |
🔀 或者自己构建 — 17 种路由策略
| 目标 | 策略 / 组合 |
|---|---|
| 🥇 用完订阅再付费 | priority / fill-first |
| ⚖️ 在账号间分散负载 | round-robin · weighted · p2c · least-used |
| 💸 始终使用最便宜的可行模型 | cost-optimized · auto/cheap |
| 🧠 在模型间移交长上下文 | context-relay · context-optimized |
| 🎲 随机化 / 隐私路由 | random · strict-random |
| 🧬 分发到面板 + 评委综合 | fusion |
| 📊 根据剩余配额余量路由 | reset-window · headroom |
| 🤖 让它变智能 | auto(9 因子评分)· lkgp · reset-aware |
自动组合引擎根据 9 个因子(健康度、配额、成本、延迟、成功率、新鲜度……)对每个候选进行评分 — 参见 docs/routing/AUTO-COMBO.md。
🧱 内置韧性(3 个独立层)
| 层 | 范围 | 作用 |
|---|---|---|
| 🔌 断路器 | 整个提供商 | 停止反复击打上游失败的提供商;自动探测以恢复 |
| 💤 连接冷却 | 一个账号 / key | 跳过速率受限的 key,同时其他 key 继续服务 |
| 🎯 模型锁定 | 提供商 + 模型 | 仅隔离一个受配额限制的模型,而不是整个连接 |
Combo: "always-on" 策略: priority
1. cc/claude-opus-4-7 ← 订阅(完全使用)
2. cx/gpt-5.5 ← 第二个订阅
3. glm/glm-5.1 ← 便宜备份($0.5/1M)
4. kr/claude-sonnet-4.5 ← 免费,无限(永不失败)
结果: 4 层回退 = 零停机
🏆 OmniRoute 的独特之处
| 特性 | OmniRoute | 其他路由器 |
|---|---|---|
| 🌐 提供商 | 231 | 20–100 |
| 🆓 免费提供商 | 50+(11 个永久免费) | 1–5 |
| 🔀 路由策略 | 17(priority、weighted、cost-optimized、context-relay、fusion……) | 1–3 |
| 🗜️ Token 压缩 | RTK + Caveman 堆叠(15–95%) | 无 / 20–40% |
| 🧰 内置 MCP 服务器 | 87 个工具、3 种传输、30 个作用域 | 少见 |
| 🤝 A2A agent 协议 | 6 项技能、JSON-RPC 2.0 | 无 |
| 🧠 记忆(FTS5 + 向量) | 是 | 少见 |
| 🛡️ 护栏(PII、注入、视觉) | 是 | 少见 |
| ☁️ 云端 agent | Codex、Devin、Jules | 无 |
| 🥷 TLS 指纹伪装 | 通过 wreq-js 的 JA3/JA4 | 无 |
| 🖥️ 多平台 | Web · Desktop · Termux · PWA | 仅 Web |
| 🌍 i18n | 42 个语言包 | 0–4 |
📊 与 LiteLLM、OpenRouter 和 Portkey 的详细比较 → docs/comparison/OMNIROUTE_VS_ALTERNATIVES.md
✨ 最新动态
从 v3.8.20 → v3.8.41 的重点内容。完整历史记录在
CHANGELOG.md。
- ⚖️ 配额共享路由 — 一种专用的组合策略,根据可用配额在账号间分配负载:赤字轮询调度、每个连接的
max_concurrent加冷却等待队列、多窗口用量桶(5小时/7天/每个模型)、每个 (key,model) 上限、用于 prompt-cache 完整性的会话粘性,以及基于上游 token 使用头的主动饱和。→ 韧性指南 - 🤖 一键 CLI/agent 设置 — 专用
setup-*命令配置每个编码工具通过 OmniRoute 路由(Claude Code、Codex、Cline、Continue、Cursor、Roo Code、Kilo Code、Crush、Goose、Qwen Code、Aider、OpenCode);omniroute launch/omniroute launch-codex是零配置启动器。→ CLI 集成指南 - 🛰️ 远程模式 — 从任何机器使用作用域访问 token 驱动远程 OmniRoute(
omniroute connect/omniroute contexts/omniroute tokens),加上omniroute login antigravity辅助工具,在你自己的机器上运行 Google "native/desktop" OAuth 并将凭证 blob 粘贴到远程/VPS 安装(其中环回重定向不可访问)。→ 远程模式 - 🧭 更智能的自动路由 — OpenRouter 风格的
auto/<category>:<tier>组合(例如auto/coding:fast、auto/reasoning:pro),Fusion 策略(并行分发到一组模型,然后通过评委综合),任务感知路由(根据任务类型选择最合适的连接),每个请求的X-Route-Model覆盖,实时 Arena-ELO + models.dev 模型智能,每步账号白名单,提供商通配符组合步骤,嵌套组合引用执行,粘性加权选择,以及web_search感知路由。→ 自动组合 - 🗜️ 可插拔压缩 — 由 9 个可组合引擎组成的异步管道,包括 Compression Studios、LLMLingua-2 ONNX 引擎和启发式/SLM 双层 Ultra、RTK、委托式 Anthropic Context Editing、输出样式(输出轴导向:简洁散文/少代码/简洁 CJK)、自适应上下文预算拨盘(仅扩展到恰好适应上下文窗口所需程度)、每个请求的
x-omniroute-compression控制、可选的离线评测框架、一键 Headroom 代理生命周期管理(从仪表盘,支持 Docker sidecar)、合成压缩游乐场(Play 通道 + A/B 比较,附带美元上限的保真度裁决)、可选的每步保真度门控(在有损引擎降级 prompt 之前拒绝它)、最佳 N 候选编码器(GCF vs TOON — 保留较短者,在工作室中附带 A/B 字节/ token 表)、CCR 范围/grep/统计检索(精确提取已存储块的字节/行切片或摘要,而无需重新展开它),以及带有命名配置文件和活动配置文件选择器的统一面板。→ 压缩 - 🕵️ 透明 MITM 解密 (TPROXY) — 捕获并翻译忽略代理环境变量的 CLI 流量,附带每个 SNI 的证书颁发机构和信任存储安装程序。→ MITM/TPROXY
- 💸 无处不在的成本遥测 — 每个端点(包括媒体)上的
X-OmniRoute-*成本/使用头、非 token 成本引擎、缓存命中X-OmniRoute-Cost-Saved头,以及每个 key 的 USD 支出配额。→ API 参考 - 🧠 你控制的记忆 — 可选的 int8 向量量化(Qdrant + sqlite-vec),默认关闭记忆,以及每个请求的
x-omniroute-no-memory头。→ 记忆 - 🛡️ 安全 — 跨所有 LLM 路由的 prompt 注入防护(附带红队套件),加上免费的 DuckDuckGo 最后手段网络搜索。→ 护栏
- 🤝 更多提供商和 agent — Cursor Cloud Agent(第 4 个云端 agent)、CodeBuddy CN(
copilot.tencent.com)、Google Flow 视频生成提供商、新网关 DGrid 和 Pioneer AI(Fastino Labs)、入站 xAI Grok 翻译器加 Grok Build (xAI) 及其 OAuth 导入 token 流程、GitHub Copilot 提供商上的 GPT-4 / GPT-4o-mini、多模型 Factory Droid、ZenMux Free(会话 cookie 免费 tier)、Alibaba DashScope 文本转视频(wan2.7-t2v)、刷新后的 236 提供商目录(OrcaRouter、Wafer AI、OpenAdapter、dit.ai、TokenRouter……)、Vertex AI 媒体生成(语音/转录/音乐/视频),以及一键从 CLIProxyAPI(~/.cli-proxy-api/)导入账号。→ 提供商 - ⚡ 本地性能 & 基础设施 — 一键本地 Redis 启动器(
omniroute redis up,加上仪表盘 Redis 面板)、一键 Cloudflare Workers 和 Deno Deploy 中继部署器,已连接到代理池,以及可选的 Bifrost Go sidecar,它卸载最热的中继路径(BIFROST_BASE_URL,超时时自动回退到 TypeScript 路径) — 现在带有中继后端选择器(OMNIROUTE_RELAY_BACKEND=ts|bifrost|auto),因此/v1/relay端点保持稳定表面,同时内部选择最快的后端。→ 环境
🤖 兼容的 CLI 和编码 Agent
一个配置 —
http://localhost:20128/v1— 然后每个 AI IDE 或 CLI 都运行在免费和低成本的模型上。
Claude Code |
Codex CLI |
![]() Cursor |
![]() Copilot |
![]() Continue |
OpenCode |
Kilo Code |
Droid |
<


