Gemini 3.6 Flash Family Gemini 3.6 Flash系列新模型为开发者提供高效低延迟的AI模型,用于构建可扩展的AI智能体。 热门评论 PH 用户祝贺 @sundar_pichaion 发布。看到 3.5 Flash Cyber 很兴奋。鉴于目前它只对政府/受信任的合作伙伴开放;路线图上是否有更广泛的开放计划,还是考虑到双重用途风险,这个工具将永久保持有限访问?PH 用户把重点放在 Flash 系列而不是另一个旗舰模型上很明智——对于智能体来说,每次调用的成本和延迟远比前沿基准测试上的几个百分点重要,因为一次运行会触发大量调用。OSWorld(电脑使用)和 long-horizon SWE 上的提升才是我日常能感受到的。好奇 "3.5 Flash Cyber" 是针对什么微调的——是专注于安全/红队测试的变体,还是别的什么?PH 用户3.6 的推理能力与之前的 3.5 Flash 模型相比,在高级编码、编辑、修复和审查等任务上表现如何?PH 用户终于让新的 Flash 在一个快速的智能体任务上试了一下,延迟的降低确实很明显,整个循环比我预期的更流畅。PH 用户在模型 API 中内置一流的可观测性仪表盘将非常有用。每次智能体运行的实时 token 用量、延迟分解和故障模式检测,将大大简化大规模调试和优化。PH 用户围绕“面向大规模智能体的效率、延迟和可靠性”的定位显得不完整。目前所有说法都是定性的——没有硬数据、没有延迟图表、没有可靠性基准、没有故障模式透明性。构建多步骤智能体的开发者不仅需要快速的模型,还需要在长链条中可预测的工具使用行为。如果没有公布的一致性指标、正常运行时间保证或真实的智能体压力测试,就无法评估3.6 Flash是否真正解决了让生产环境智能体崩溃的可靠性缺口。另外,Flash-Lite和Flash-Cyber被宣传得好像区分得很清楚,但文档迫使我们要翻遍分散的页面才能比较成本、推理质量和安全行为。一个统一的看板不是“锦上添花”,而是必不可少。目前这个发布读起来更像是营销而非工程。如果Google想让开发者投入工作负载,我们需要的是数字,而不是形容词。 热门产品Sundar Pichai2026-07-22原文 打开互动版
好奇 "3.5 Flash Cyber" 是针对什么微调的——是专注于安全/红队测试的变体,还是别的什么?
构建多步骤智能体的开发者不仅需要快速的模型,还需要在长链条中可预测的工具使用行为。如果没有公布的一致性指标、正常运行时间保证或真实的智能体压力测试,就无法评估3.6 Flash是否真正解决了让生产环境智能体崩溃的可靠性缺口。
另外,Flash-Lite和Flash-Cyber被宣传得好像区分得很清楚,但文档迫使我们要翻遍分散的页面才能比较成本、推理质量和安全行为。一个统一的看板不是“锦上添花”,而是必不可少。
目前这个发布读起来更像是营销而非工程。如果Google想让开发者投入工作负载,我们需要的是数字,而不是形容词。