行业新闻

谷歌发布 Gemini 4 Argon,主打长任务推理与网络安全防御

谷歌发布 Gemini 4 Argon,主打长任务推理与网络安全防御

谷歌发布 Gemini 4 Argon:百万 Token 输出上限主打长任务,跑分多项第一,但首批限量开放给安全防御方,性价比是主要卖点。

谷歌发布 Gemini 4 Argon,支持最高百万 Token 输出,面向编程、金融、法律等长流程任务;单题成本约降四成,输入每百万 Token 2 美元、输出 10 美元。首批仅向通过审核的网络安全防御团队开放,其余订阅用户分批放开。

正文摘录

更夸张的还在后头,单项任务成本最低可至 1.99美元 ,直接是 Astra 费用砍半。 最高百万 Token 输出上限 ,面向编程、金融和法律等复杂工作流,而且划重点,网络安全防御能力超牛掰。 Gemini 4 Argon 目前只开放给部分经过筛选的网络安全团队使用,其它订阅用户得一步步来。 劈柴哥、哈萨比斯还有接班人 Koray Kavukcuoglu,纷纷一键三连为其站台: 谷歌 is back! 这一年 OpenAI、Anthropic 是追着谷歌砍啊,放假前一周还连发 Opus 5.5、Sonnet 5.5、GPT-6.1 Sol 逼宫。 Argon 在衡量长期软件工程任务的 DeepSWE v1.1 上拿到 77.9%,高于 Claude Opus 5.5 的 74.2% 和 GPT-6 Astra 的 74.1%。 网络安全漏洞修复测试 CWE-bench v1 则拿到 68%,和 GPT-6 Astra 并列第一 。 Argon 以 68.90% 登顶 Vals Index 榜首,较 Gemini 3.8 Flash 实现大幅提升。 文本领域,Argon 在代码编写、高难度提示词、指令遵循、长查询以及创意写作赛道优势显著,以 1525 分位居 Text Arena 第一 。 在评测网页开发的 Code Arena 中排名第八 ,较 Gemini 3.8 Flash High 提升了 21 个名次,但依旧稍逊于 Claude 和 GPT 最新模型。 Artificial Analysis 测评中,Argon 和 GPT-6 Astra 旗鼓相当,高于 GPT-6.1 Sol 一分,提升主要来自于 更少的幻觉 和 更强的智能体能力 。

阅读原文(qbitai.com)→

行业新闻鹭羽2026-10-01原文

相关内容