Google 发布 Gemini 4 Argon,单次输出上限提至 100 万 Token
Google 发布 Gemini 4 Argon,把单次输出上限拉到 100 万 Token 并先给安全团队用,意味着大模型开始承接需要连续推理数小时的企业级长任务。
Google 推出新一代前沿模型 Gemini 4 Argon,定位面向软件工程、法律金融等长周期企业任务。单次输出上限从 6.4 万 Token 提到 100 万,且不直接对公众开放,先通过 Fairwind Program 提供给受信任的网络安全防御方。API 定价为输入每百万 Token 2 美元、输出 10 美元。
正文摘录
.jpg) 刚刚,Google 宣布推出新一代前沿模型 Gemini 4 Argon。 Google 将 Argon 定位为 面向复杂、长周期工作流的模型 ,重点覆盖软件工程、法律与金融等企业知识工作,以及网络安全防御。 与以往直接面向公众开放的方式不同,Argon 将采用分阶段发布策略。该模型将通过 Fairwind Program,首批提供给受信任的网络安全防御者。 价格方面,Argon API 的初始定价为每百万输入 Token 2 美元、每百万输出 Token 10 美元,缓存输入 Token 的价格比标准输入价格低 95%。 单次输出上限扩至 100 万 Token Gemini 4 Argon 最受关注的变化,是将 输出 Token 上限从此前的 6.4 万提升至 100 万 。 这里的 100 万 Token 指单次输出上限,和上下文窗口是两个指标。更高的输出空间意味着,模型可以在一条任务轨迹中持续推理,并生成数十万甚至接近百万 Token 的结果。这类能力主要面向大型代码迁移、深度研究和多步骤企业流程。  有网友指出,多数前沿模型的输出上限大约为 12.8 万 Token。