热门产品

Edgee Fallback Models

Edgee Fallback Models

为Claude Code提供备用模型路由,当API不可用或限速时自动切换至其他模型,确保开发者编码助手持续运行。

Maker 说

朋友们好

我是 Sacha,@Edgee 的创始人。

两周前,Anthropic 宣布从 6 月 15 日起,你的程序化 Claude 使用量将被限制在每月 20 到 200 美元的额度池。对于重度 Claude Code 用户来说,这大概相当于推理能力被砍了 25 到 40 倍。
同样,Copilot 也从 6 月 1 日起转向按用量计费。

很多人对此很生气。我理解。但我们是开发者,面对市场变化,正确的回应是做出更好的工具,而不是抱怨。

我们在 Anthropic 公告前一周就开始构建 Fallback Models 功能了,因为受够了 Anthropic 的宕机。现在时间点碰巧正合适。

Fallback Models 功能的作用如下:

→ Anthropic 挂了?路由到 Kimi K2.6、GLM、Qwen、Gemma 或其他模型。

→ 额度用完了?同样,自动切换。

→ 想始终走固定路由?自己选模型。

你还可以一键回退到自己的 Bedrock、Vertex 或 Azure 账户。上层还是同一个 Claude Code,底层换成你自己的云,零代码改动。

对 Copilot、Codex 也是一样的。

它和我们的其他功能如何配合:

- 压缩:使用更少 token

- 团队:查看谁用了 token 以及用在什么地方

- Fallback Models:主模型不可用时继续工作

Fallback Models 随我们的 Team 计划发布。支撑这一切的压缩引擎可以免费试用,无需信用卡。

想问大家两个问题:

- 你真正想用哪些后备模型?

- 你的编程助手还应该处理哪些故障模式?

我会全天在评论区 🙏

edgee.ai/fallback-models

热门评论

PH 用户
对真正的痛点采取了聪明的方法。Claude Code在高峰时段的速率限制打断我工作流程的次数,多到我不愿意承认。好奇token压缩对输出质量的影响——它在处理长上下文窗口时表现好吗,还是说50%的节省是有代价的?
PH 用户
@fmerian 喜欢"压缩"这部分。大多数回退工具只是切换模型,然后你就会丢失一半的上下文。

在发送给Kimi/Qwen之前,你会重新压缩对话历史吗?还是保留完整上下文让模型自己处理?

如果这能正常运作,我的AI账单能减半。已点赞。
PH 用户
速率限制触发时的自动回退功能,总是需要我手动去写。祝发布顺利!
PH 用户
这种透明代理的方法很巧妙。在API层拦截意味着客户端无需更改,这一点很重要。我们在RetainSure曾花费大量时间调试会话中途的故障,而Claude的速率限制偏偏在最糟糕的时刻触发。你们如何跨模型标准化tool_use模式?Claude的格式不能清晰地映射到Qwen或Gemma,这种不匹配会悄悄降低智能体的输出质量。
PH 用户
祝贺发布!!这解决了开发者的一个实际问题,当Claude被速率限制或宕机时,他们承受不起停摆。用简单的回退模型保持编码持续运行,会让工作流感觉更稳定。
PH 用户
我们能设置回退顺序吗?你看,我想先给你一串我不花钱的LLM,最后没办法了再让OpenAI和Grok来榨干我最后一滴血。谢谢。
热门产品fmerian2026-05-24原文

相关内容