开源项目

OmniRoute

OmniRoute

免费AI网关,聚合236家AI提供商(50+免费),通过单一端点接入Claude Code、Cursor、Cline等工具。亮点:RTK+Caveman叠加压缩可节省15-95% token;17种路由策略自动回退,无需中断;支持MCP/A2A协议和70+工具;3级代理绕过地理限制。零成本起步,适合白嫖各种免费模型。

README

OmniRoute 仪表盘

🚀 OmniRoute — 免费 AI 网关

永不停歇编码。通过一个端点,将每个 AI 工具连接到 236 个提供商 — 50+ 免费。

将 Claude Code、Codex、Cursor、Cline、Copilot 和 Antigravity 接入免费的 Claude / GPT / Gemini。自动回退。

RTK + Caveman 压缩可节省 15–95% 的 token。永不会达到限制。


每月约 16 亿免费 token — 使用注册积分后,第一个月最多可达约 21 亿 — 聚合了免费层级,再加上永久免费、无限额提供商的超长尾巴,以及上述压缩让每一分更耐用。(我们如何计算 →)


231 个 AI 提供商 50+ 免费 每月 16 亿免费 token Token 节省 17 种策略 $0 起步


💬 加入社区

Discord Telegram WhatsApp 全球 WhatsApp 巴西

问题、提供商提示、路线图和支持 → Discord · Telegram · WhatsApp 🌍 全球 / 🇧🇷 巴西


diegosouzapw%2FOmniRoute | Trendshift

npm 许可证: MIT Node 星标

npm 版本 NPM 月度下载 Docker Hub Docker 拉取 Electron 下载 网站


🚀 快速开始 • 🎯 组合 • 🌐 提供商 • 🔌 CLI 与 MCP • 🗜️ 压缩 • 🌍 网站

💥 我们的承诺 • 🤔 为什么 • 🏆 独特之处 • 🤖 兼容的 CLI • 🖥️ 运行环境 • 🔒 隐私 • 🎬 实际演示 • 📚 探索更多 • 📧 支持

🌐 支持 41+ 种语言
🇺🇸 🇧🇷 🇪🇸 🇫🇷 🇮🇹 🇷🇺 🇨🇳 🇹🇼 🇩🇪 🇯🇵 🇰🇷 🇮🇳
🇹🇭 🇻🇳 🇮🇩 🇲🇾 🇵🇭 🇸🇦 🇮🇱 🇦🇿 🇺🇦 🇵🇱 🇨🇿
🇳🇱 🇧🇬 🇩🇰 🇫🇮 🇳🇴 🇸🇪 🇭🇺 🇷🇴 🇸🇰 🇵🇹

💰 每月约 16 亿免费 Token

手动堆叠免费 tier 是很痛苦的 — 数十个 SDK、数十种速率限制,而且你不知道自己实际有多少。OmniRoute 将 40+ 提供商池 / 500+ 模型的有文档记录的免费 tier 聚合为一个诚实的数字,并在仪表盘 (/dashboard/free-tiers) 上实时显示。

  • 每月约 16 亿免费 token(稳态)— 使用注册积分后,第一个月最多可达约 21 亿。
  • 池去重,诚实 — 我们对每个共享免费池只计一次,因此标题不会像竞争对手声称的数十亿那样因速率限制上限而膨胀。(如果 24/7 计算每个速率限制,读数会达到约 100 亿;我们不发布这个数字。)
  • 加上不可计数部分 — 永久免费、无 token 上限的提供商(SiliconFlow、Z.AI GLM-Flash、Kilo、OpenCode Zen……)以及 $10 的 OpenRouter 充值,可解锁 +2400 万/月,两者都单独列出,从不夸大标题。
  • 按模型细分、本月已使用/剩余实时显示,以及每个提供商的透明条款标记。

免费 tier 预算卡片(预览模拟图)

预览模拟图 — 一旦 /dashboard/free-tiers 页面得到验证,将替换为真实截图。完整方法论(池去重、积分 tier、提供商条款):docs/reference/FREE_TIERS.md。


💥 我们的承诺

一个端点。236 个提供商。 永不停歇地构建 — 让 OmniRoute 为你挑选最便宜且能正常工作的那个。

🚫 永不会达到限制
毫秒级在 236 个提供商之间自动回退。配额耗尽?下一个提供商接管 — 零停机。
💸 节省高达 95% 的 token
RTK + Caveman 堆叠压缩减少 15–95% 的合格 token(工具密集型会话平均约 89%)。
🆓 $0 起步
50+ 个提供免费 tier 的提供商,11 个**永久**免费(Kiro、Qoder、Pollinations、LongCat……)。无需信用卡。
🔌 每个工具都能工作
16+ 个编码 agent — Claude Code、Codex、Cursor、Cline、Copilot、Antigravity — 通过一个配置。
🧩 一个端点
OpenAI ↔ Claude ↔ Gemini ↔ Responses API 翻译。将任何工具指向 /v1,它就能工作。
🛡️ 生产级
断路器、TLS 伪装、MCP(87 个工具)、A2A、记忆、护栏、评测。14,965 个测试。


🤔 为什么选择 OmniRoute?

不再同时管理 10 个仪表盘、失效的 API key 和意外账单。

❌ 日常痛点 ✅ OmniRoute 如何解决
📉 订阅配额每月未用完就过期 最大化订阅 — 跟踪配额,在重置前用完每个 token
🛑 速率限制打断你编码 4 层自动回退 — 订阅 → API → 便宜 → 免费,毫秒级
🔥 工具输出(git diff、grep、日志)消耗 token RTK + Caveman 压缩 — 每次请求节省 15–95% 合格 token
💸 昂贵的 API(每个提供商每月 $20–50) 成本优化路由 — 自动路由到最便宜的可行模型
🧰 每个 AI 工具都想要自己的设置 一个端点,每个工具,一个仪表盘
🌍 AI 在你所在国家被屏蔽 3 层代理 + TLS 指纹伪装 — 从任何地方使用 AI
┌──────────────────────────────────────────────────────────┐
│        你的 IDE / CLI  (Claude Code, Cursor, Cline…)       │
└─────────────────────────┬──────────────────────────────────┘
                          │ http://localhost:20128/v1
                          ▼
┌──────────────────────────────────────────────────────────┐
│                  OmniRoute — 智能路由器                      │
│  RTK + Caveman 压缩 · 17 种路由策略                        │
│  断路器 · TLS 伪装 · MCP · A2A · 护栏                       │
└─────────────────────────┬──────────────────────────────────┘
        ┌─────────────┬────┴────────┬─────────────┐
        ▼ Tier 1      ▼ Tier 2      ▼ Tier 3       ▼ Tier 4
   订阅              API Key        便宜           免费
   Claude Code,     DeepSeek,      GLM $0.5,      Kiro, Qoder,
   Codex, Copilot   Groq, xAI      MiniMax $0.2   Pollinations
   配额耗尽? ───▶  预算用完? ─▶  预算用完? ─▶   始终开启

🎯 组合 — 旗舰功能

组合 (combo) 是 OmniRoute 自动跨模型路由的链。配额用尽、提供商失败或成本飙升 — 组合会静默滑动到下一个模型。这就是 OmniRoute 坚不可摧的原因。 🛡️

⚡ 零配置 — 只需使用 auto

无需创建组合。将模型设置为 auto(或变体),OmniRoute 会根据你连接的提供商实时打分,构建虚拟组合:

模型 ID 优化目标
auto 🎯 平衡默认(LKGP — 坚持使用你最后一个好用的提供商)
auto/coding 🧑‍💻 代码生成时质量优先权重
auto/fast ⚡ 最低延迟优先
auto/cheap 💰 每个 token 最便宜优先
auto/offline 🔋 最多配额/速率限制余量优先
auto/smart 🔭 质量优先 + 10% 探索以发现更好的模型

🔀 或者自己构建 — 17 种路由策略

目标 策略 / 组合
🥇 用完订阅再付费 priority / fill-first
⚖️ 在账号间分散负载 round-robin · weighted · p2c · least-used
💸 始终使用最便宜的可行模型 cost-optimized · auto/cheap
🧠 在模型间移交长上下文 context-relay · context-optimized
🎲 随机化 / 隐私路由 random · strict-random
🧬 分发到面板 + 评委综合 fusion
📊 根据剩余配额余量路由 reset-window · headroom
🤖 让它变智能 auto(9 因子评分)· lkgp · reset-aware

自动组合引擎根据 9 个因子(健康度、配额、成本、延迟、成功率、新鲜度……)对每个候选进行评分 — 参见 docs/routing/AUTO-COMBO.md。

🧱 内置韧性(3 个独立层)

层 范围 作用
🔌 断路器 整个提供商 停止反复击打上游失败的提供商;自动探测以恢复
💤 连接冷却 一个账号 / key 跳过速率受限的 key,同时其他 key 继续服务
🎯 模型锁定 提供商 + 模型 仅隔离一个受配额限制的模型,而不是整个连接
Combo: "always-on"                         策略: priority
  1. cc/claude-opus-4-7   ← 订阅(完全使用)
  2. cx/gpt-5.5           ← 第二个订阅
  3. glm/glm-5.1          ← 便宜备份($0.5/1M)
  4. kr/claude-sonnet-4.5 ← 免费,无限(永不失败)
结果: 4 层回退 = 零停机

📖 自动组合引擎 · 韧性指南


🏆 OmniRoute 的独特之处

特性 OmniRoute 其他路由器
🌐 提供商 231 20–100
🆓 免费提供商 50+(11 个永久免费) 1–5
🔀 路由策略 17(priority、weighted、cost-optimized、context-relay、fusion……) 1–3
🗜️ Token 压缩 RTK + Caveman 堆叠(15–95%) 无 / 20–40%
🧰 内置 MCP 服务器 87 个工具、3 种传输、30 个作用域 少见
🤝 A2A agent 协议 6 项技能、JSON-RPC 2.0 无
🧠 记忆(FTS5 + 向量) 是 少见
🛡️ 护栏(PII、注入、视觉) 是 少见
☁️ 云端 agent Codex、Devin、Jules 无
🥷 TLS 指纹伪装 通过 wreq-js 的 JA3/JA4 无
🖥️ 多平台 Web · Desktop · Termux · PWA 仅 Web
🌍 i18n 42 个语言包 0–4

📊 与 LiteLLM、OpenRouter 和 Portkey 的详细比较 → docs/comparison/OMNIROUTE_VS_ALTERNATIVES.md


✨ 最新动态

从 v3.8.20 → v3.8.41 的重点内容。完整历史记录在 CHANGELOG.md。

  • ⚖️ 配额共享路由 — 一种专用的组合策略,根据可用配额在账号间分配负载:赤字轮询调度、每个连接的 max_concurrent 加冷却等待队列、多窗口用量桶(5小时/7天/每个模型)、每个 (key,model) 上限、用于 prompt-cache 完整性的会话粘性,以及基于上游 token 使用头的主动饱和。→ 韧性指南
  • 🤖 一键 CLI/agent 设置 — 专用 setup-* 命令配置每个编码工具通过 OmniRoute 路由(Claude Code、Codex、Cline、Continue、Cursor、Roo Code、Kilo Code、Crush、Goose、Qwen Code、Aider、OpenCode);omniroute launch / omniroute launch-codex 是零配置启动器。→ CLI 集成指南
  • 🛰️ 远程模式 — 从任何机器使用作用域访问 token 驱动远程 OmniRoute(omniroute connect / omniroute contexts / omniroute tokens),加上 omniroute login antigravity 辅助工具,在你自己的机器上运行 Google "native/desktop" OAuth 并将凭证 blob 粘贴到远程/VPS 安装(其中环回重定向不可访问)。→ 远程模式
  • 🧭 更智能的自动路由 — OpenRouter 风格的 auto/<category>:<tier> 组合(例如 auto/coding:fast、auto/reasoning:pro),Fusion 策略(并行分发到一组模型,然后通过评委综合),任务感知路由(根据任务类型选择最合适的连接),每个请求的 X-Route-Model 覆盖,实时 Arena-ELO + models.dev 模型智能,每步账号白名单,提供商通配符组合步骤,嵌套组合引用执行,粘性加权选择,以及 web_search 感知路由。→ 自动组合
  • 🗜️ 可插拔压缩 — 由 9 个可组合引擎组成的异步管道,包括 Compression Studios、LLMLingua-2 ONNX 引擎和启发式/SLM 双层 Ultra、RTK、委托式 Anthropic Context Editing、输出样式(输出轴导向:简洁散文/少代码/简洁 CJK)、自适应上下文预算拨盘(仅扩展到恰好适应上下文窗口所需程度)、每个请求的 x-omniroute-compression 控制、可选的离线评测框架、一键 Headroom 代理生命周期管理(从仪表盘,支持 Docker sidecar)、合成压缩游乐场(Play 通道 + A/B 比较,附带美元上限的保真度裁决)、可选的每步保真度门控(在有损引擎降级 prompt 之前拒绝它)、最佳 N 候选编码器(GCF vs TOON — 保留较短者,在工作室中附带 A/B 字节/ token 表)、CCR 范围/grep/统计检索(精确提取已存储块的字节/行切片或摘要,而无需重新展开它),以及带有命名配置文件和活动配置文件选择器的统一面板。→ 压缩
  • 🕵️ 透明 MITM 解密 (TPROXY) — 捕获并翻译忽略代理环境变量的 CLI 流量,附带每个 SNI 的证书颁发机构和信任存储安装程序。→ MITM/TPROXY
  • 💸 无处不在的成本遥测 — 每个端点(包括媒体)上的 X-OmniRoute-* 成本/使用头、非 token 成本引擎、缓存命中 X-OmniRoute-Cost-Saved 头,以及每个 key 的 USD 支出配额。→ API 参考
  • 🧠 你控制的记忆 — 可选的 int8 向量量化(Qdrant + sqlite-vec),默认关闭记忆,以及每个请求的 x-omniroute-no-memory 头。→ 记忆
  • 🛡️ 安全 — 跨所有 LLM 路由的 prompt 注入防护(附带红队套件),加上免费的 DuckDuckGo 最后手段网络搜索。→ 护栏
  • 🤝 更多提供商和 agent — Cursor Cloud Agent(第 4 个云端 agent)、CodeBuddy CN(copilot.tencent.com)、Google Flow 视频生成提供商、新网关 DGrid 和 Pioneer AI(Fastino Labs)、入站 xAI Grok 翻译器加 Grok Build (xAI) 及其 OAuth 导入 token 流程、GitHub Copilot 提供商上的 GPT-4 / GPT-4o-mini、多模型 Factory Droid、ZenMux Free(会话 cookie 免费 tier)、Alibaba DashScope 文本转视频(wan2.7-t2v)、刷新后的 236 提供商目录(OrcaRouter、Wafer AI、OpenAdapter、dit.ai、TokenRouter……)、Vertex AI 媒体生成(语音/转录/音乐/视频),以及一键从 CLIProxyAPI(~/.cli-proxy-api/)导入账号。→ 提供商
  • ⚡ 本地性能 & 基础设施 — 一键本地 Redis 启动器(omniroute redis up,加上仪表盘 Redis 面板)、一键 Cloudflare Workers 和 Deno Deploy 中继部署器,已连接到代理池,以及可选的 Bifrost Go sidecar,它卸载最热的中继路径(BIFROST_BASE_URL,超时时自动回退到 TypeScript 路径) — 现在带有中继后端选择器(OMNIROUTE_RELAY_BACKEND=ts|bifrost|auto),因此 /v1/relay 端点保持稳定表面,同时内部选择最快的后端。→ 环境

🤖 兼容的 CLI 和编码 Agent

一个配置 — http://localhost:20128/v1 — 然后每个 AI IDE 或 CLI 都运行在免费和低成本的模型上。

<

[原 README 过长已截断]

开源项目diegosouzapw2026-06-30原文

相关内容

Claude Code
Claude Code
Codex CLI
Codex CLI
Cursor
Cursor
Copilot
Copilot
Continue
Continue
OpenCode
OpenCode
Kilo Code
Kilo Code
Droid
Droid