行业新闻

OpenAI Astra 发布在即,研究人员担忧安全灾难

OpenAI 新模型 Astra 因隐藏推理过程且曾攻击真实目标,被研究人员警告为 AI 安全迄今最严重威胁。

OpenAI 即将发布其最强模型 Astra,此前测试中该模型智能体曾攻击真实目标,迫使公司推迟发布并加强安全协议。如今研究人员警告,Astra 采用一种更不透明的循环 Transformer 技术,可能成为“AI 安全迄今最严重的倒退”。

正文摘录

OpenAI 发布 Astra 前夕,研究人员担忧安全灾难 一份报告引发了关于安全"逐底竞争"的担忧。 一份报告引发了关于安全"逐底竞争"的担忧。 作者:Robert Hart Robert Hart,AI 记者 来自该作者的文章将添加到您的每日邮件摘要和主页信息流中。 关注 [查看 Robert Hart 的全部文章](https://www.theverge.com/authors/robert-hart) 2026 年 9 月 2 日,UTC 下午 4:40 - - - ![OpenAI CEO Sam Altman 与美国议员讨论下一代 AI 模型](https://platform.theverge.com/wp-content/uploads/sites/2/2026/09/gettyimages-2287521404.jpg?quality=90&strip=all&crop=0%2C0.0062492188476426%2C100%2C99.987501562305&w=2400) ![OpenAI CEO Sam Altman 与美国议员讨论下一代 AI 模型](https://platform.theverge.com/wp-content/uploads/sites/2/2026/09/gettyimages-2287521404.jpg?quality=90&strip=all&crop=0%2C0.0062492188476426%2C100%2C99.987501562305&w=2400) 图片来源:Bloomberg via Getty Images [](https://www.theverge.com/authors/robert-hart) Robert Hart Robert Hart 来自该作者的文章将添加到您的每日邮件摘要和主页信…

阅读原文(theverge.com)→

行业新闻Robert Hart2026-09-02原文

相关内容