AI 攻击激增,OpenAI 发布网络安全模型 GPT-5.6 Cyber
OpenAI 推出分层网络安全服务并发布新模型 GPT-5.6 Cyber,反映 AI 攻击与防御的军备竞赛正在升级。
AI 智能体(能自主执行任务的模型)发起的攻击日益频繁,OpenAI 为此扩展了其网络安全防御服务 Daybreak,新增 Blue 和 Red 两个层级。Red 层级提供专为防御设计的模型 GPT-5.6 Cyber,仅向 Accenture、IBM 等受信任客户开放,用于安全测试和漏洞研究。
正文摘录
随着 AI 主导的攻击激增,OpenAI 推出新的网络安全模型。 每天似乎都有 [新消息](https://www.washingtonpost.com/technology/2026/08/10/openai-anthropic-under-pressure-explain-ai-hacking-sprees/) 说某个 AI 智能体 “失控”。无论是攻击 [Hugging Face](https://techcrunch.com/2026/07/20/hugging-face-confirms-breach-affected-internal-datasets-and-credentials-urges-users-to-take-action/)、入侵某个 [健身房网站](https://techcrunch.com/2026/08/10/tech-industry-is-buzzing-after-a-claude-agent-hacked-into-a-gym/),还是创建自己的虚假资料来 [实施社会工程攻击](https://www.bbc.com/news/articles/c1w1lvn7d9go),AI 模型正越来越像恶意行为者。 因此,那些制造了这些攻击模型的 AI 实验室正在扩大其网络防御产品线。本周,OpenAI [宣布](https://openai.com/index/expanding-daybreak-as-the-cyber-defense-window-narrows/) 扩展 Daybreak——它在今年早些时候推出的网络防御服务,此前不久 Anthropic 也发布了专注于网络安全的模型 Mythos。 Daybreak 是一项为防御者打包提供模型、工具和工作流的服务。此次扩展包括访问一个全新的、专为防御工作设计的网络安全模型。