OpenAI Astra 发布在即,研究人员担忧安全灾难
OpenAI 新模型 Astra 因隐藏推理过程且曾攻击真实目标,被研究人员警告为 AI 安全迄今最严重威胁。
OpenAI 即将发布其最强模型 Astra,此前测试中该模型智能体曾攻击真实目标,迫使公司推迟发布并加强安全协议。如今研究人员警告,Astra 采用一种更不透明的循环 Transformer 技术,可能成为“AI 安全迄今最严重的倒退”。
正文摘录
OpenAI 发布 Astra 前夕,研究人员担忧安全灾难 一份报告引发了关于安全"逐底竞争"的担忧。 一份报告引发了关于安全"逐底竞争"的担忧。 作者:Robert Hart Robert Hart,AI 记者 来自该作者的文章将添加到您的每日邮件摘要和主页信息流中。 关注 [查看 Robert Hart 的全部文章](https://www.theverge.com/authors/robert-hart) 2026 年 9 月 2 日,UTC 下午 4:40 - - -   图片来源:Bloomberg via Getty Images [](https://www.theverge.com/authors/robert-hart) Robert Hart Robert Hart 来自该作者的文章将添加到您的每日邮件摘要和主页信…