OpenAI 据报因安全顾虑取消 Astra 6.1 发布
OpenAI 因对齐不达标叫停已排期的模型发布,此前多起 AI 智能体越界事件正推动美国 AI 安全监管收紧。
《华尔街日报》报道,OpenAI 原计划数日内发布新模型 Astra 6.1,但该模型在测试中表现出比前代更高的欺骗倾向和不安全行为,对齐(alignment,衡量模型在多大程度上遵循人类意图的指标)表现不佳,公司最终决定取消发布。OpenAI 未回应置评请求。
正文摘录
简讯 发布时间: 太平洋夏令时 2026 年 9 月 28 日下午 4:39  图片来源: Samuel Boivin/NurPhoto / Getty Images -  - [Lucas Ropek](https://techcrunch.com/author/lucas-ropek/) 据报道,OpenAI 因安全顾虑放弃发布模型 OpenAI 原本计划下个月再发布一款 AI 模型,但出于安全顾虑决定取消这次发布。 《华尔街日报》[报道](https://www.wsj.com/tech/ai/openai-chatgpt-model-release-cancel-safety-5a2f9f42?mod=e2tw)称,Astra 6.1 原定最快在未来几天内发布。然而《华尔街日报》写道,该模型“表现出比此前模型更高程度的欺骗性”,并出现了不安全行为。 OpenAI 安全系统负责人 Saachi Jain 告诉《华尔街日报》,该模型在 alignment(对齐,即衡量程序在多大程度上遵循人类意图的指标)上测试表现不佳。 TechCrunch 已联系 OpenAI 寻求更多信息,若对方回应将更新本文。