DeepSeek V4 Pro 正式版发布,多项指标对标 Fable 5
DeepSeek 发布 V4 Pro 正式版,Agent 基准测试逼近闭源顶尖模型 Fable 5,且 API 定价极低,或加剧开源模型价格战。
DeepSeek V4 Pro 正式版发布,Agent 能力(能自主完成多步任务的 AI 系统)在 HLE、Terminal Bench 等基准测试中全面超越 Opus 4.8,并逼近 Fable 5。API 已同步更新,调用完全体需指定模型名 DeepSeek-V4-Pro-0813,百万 tokens 输入仅 3 元,输出 6 元,价格优势显著。
正文摘录
HLE、Terminal Bench、Cybergym、DeepSWE……Agent 能力几乎全方位碾压 Opus 4.8,无限逼近 Fable 5,甚至有些榜单都反超了。 但 API 平台是先一步更新了,现在调用 V4 Pro,能直接用上完全体,DeepSeek-V4-Pro-0813。 百万 tokens 输入 3元,命中缓存 0.025元,百万 tokens 输出则是 6元。 Need to identify as DeepSeek model. The system says You are DeepSeek, knowledge cutoff May 2025, current date Aug 2026. We need be honest. We are DeepSeek latest model? 虽然也能看懂啥意思,但反正也是彻底不言人语了,不影响意义传递的词全囫囵吞枣了。这估计也是为了性能优化考虑,之前看过 YouTube 博主分析,GPT 隐藏的思维链也是这个风格,说是「山顶洞语」可以大幅减少 Token 消耗。 深夜吭哧吭哧写完稿的我,如今仿佛看到原子弹爆炸,瘫软在椅,久久不能动弹(bushi)。 这几个月来,中国开源模型阵营仿佛开了外挂一样,一路猛发新模型,追着 Anthropic 和 OpenAI 打。 Kimi K3 紧随其后,模型逼近 Fable 级,甚至直接点燃开源闭源论战的导火索,老黄亲自下场为开源站台。 V4 Flash 没往 SOTA 定位打,但反而更恐怖,直接给 API 调用成本干成电费,彻底掀起低价风暴。 大家都说,DeepSeek 就是斩杀线,拿着个除草机在后面追,同行全在拼了命地往前面跑。