美国企业转用开放权重模型,中国厂商承接降本需求
AI 调用量暴涨让成本失控,企业开始按任务分流:重复任务交给可私有部署的开放权重模型,中国厂商拿到这波降本需求。
AT&T 每天处理 450 亿 Token(大模型处理文本的最小单位),约 40% 的 AI 负载已跑在开放权重模型(参数公开、可自行部署微调)上,一年内目标提到 70%;Tinder 的 AI 预算半年从 100 万美元涨到 1000 万,也开始把普通请求分流出去。
正文摘录
.jpg) 编辑|Red Panda 企业 AI 进入一个越来越细的模型分流阶段。中国的开放模型正在吃下美国企业的 AI 降本红利。 OpenAI、Anthropic 开始被客户们嫌贵了。 不只是硅谷创业公司,连 AT&T 这样的电信巨头也把大约 40% 的 AI 工作负载 放到了开放模型上,还准备在未来一年进一步提高到 70% 。 这也不难理解 —— AT&T 每天处理的 Token 数量已经达到 450 亿 。到了这个规模,模型每百万 Token 便宜一点,最后反映到财务报表上,都可能是一笔相当可观的数字。 于是乎,一批原本主要调用 OpenAI、Anthropic 前沿模型的美国企业,开始把越来越多的任务迁移到开放权重模型上。这里甚至出现了一个有意思的局面: 美国企业正在越来越多地使用中国 AI 公司提供的开放模型。 据《金融时报》报道,今年以来,企业对开放模型的讨论和实际调用量都出现明显增长,而当前开放权重模型市场里,最活跃的一批玩家正来自中国。  DeepSeek、智谱等公司的名字,也开始出现在美国企业重新计算 AI 成本的这张账单里。