行业新闻

DeepSeek V4 Pro 与 Grok 4.6 同日发布,低价对标顶级模型

两大模型同日发布,性能逼近国际顶尖,价格却低一个数量级,行业竞争格局生变。

DeepSeek V4 Pro 与 Grok 4.6 同一天发布,在长任务智能体评测中逼近甚至反超 Fable 5 和 GPT-5.6;DeepSeek 输出价格仅为 GPT-5.6 的 1/35,首次让顶级模型能力进入低价区间。

正文摘录

![](https://aiera.com.cn/wp-content/uploads/2026/08/aieraimgbaad645d66.webp) 新智元报道 ![](https://aiera.com.cn/wp-content/uploads/2026/08/aieraimg3b253ef414-106.png) 今天,这一架太魔幻了! 一边是梁文锋,终于在凌晨放出了 DeepSeek V4 Pro 正式版。 另一边,马斯克砸下了下一代旗舰 Grok 4.6,主打一个成本低,性能强。 两大巨头,同一时间发布,火药味儿瞬间拉满。 ![](https://aiera.com.cn/wp-content/uploads/2026/08/aieraimg69b058a5a7.webp) 他们盯上的,几乎是同一件事—— 让模型能在长任务里持续调用工具、修改代码、验证结果,最后交付一个真正能用的成品。 ![](https://aiera.com.cn/wp-content/uploads/2026/08/aieraimgdf9d89c9b2-105.png) DeepSeek V4 Pro 来了 马斯克 Grok 4.6 出战 DeepSeek V4 Pro 正式版最亮眼的成绩,是在两项评测中拿下绝对第一,直接反杀 Fable 5。 - 网络安全智能体测试 CyberGym 拿到 83.3 分,超过 Fable 5 的 83.1 分、Opus 4.8 的 78.3 分。 - 自动化任务 AutomationBench 拿到 31.8 分,把 Fable 5 的 29.1 分和 Opus 4.8 的 27.2 分一起压了下去。 最「贴脸」的一次,则发生在 Terminal-Bench 2.1。

阅读原文(aiera.com.cn)→

行业新闻新智元2026-08-14原文

相关内容