行业新闻

OpenAI 发布 Astra 模型,主打智能与安全

OpenAI 发布新模型 Astra,性能强劲但推理过程晦涩难察,安全性与可监控性引发讨论。

OpenAI 周四推出最新 AI 模型 Astra,据称是其迄今最强大、最安全的模型。它擅长计算机与浏览器任务,在软件工程和网络安全测试中表现出色。但该模型使用一种晦涩的推理技术,可能削弱研究人员对模型决策过程的监控能力,引发争议。

正文摘录

- title: OpenAI 发布 Astra,其强大(且备受争议)的新模型 - sourcecompany: TechCrunch - bodymarkdown: OpenAI 于周四发布 Astra,这是其最新 AI 模型 —— 据该公司称,也是其迄今最强大、最能干的模型。 OpenAI 声称 Astra 代表了“计算机与浏览器使用的新前沿”,并且能以无与伦比的“速度、准确性和安全性”处理任务。 该模型于周四向使用其网络安全项目 Daybreak 的 OpenAI 客户开放。在接下来的一周内,它也将在 OpenAI 的付费套餐中上线 —— 包括 Pro、Plus、Enterprise 及 Business 账户 —— 同时也会通过其 API 提供。 在周四与记者的电话会议中,OpenAI 总裁 Greg Brockman 表示,Astra 是公司“最智能,而且也非常重要的是,迄今最对齐的模型”。他补充说,Astra “汇集了我们多年的研究和重大押注,每一项突破都建立在前一项之上”,并且它代表着“人们能够委托给 AI 的工作类型,以及 AI 如何赋能于人方面的一个真正转变”。 关于 Astra 的网络能力,外界已有诸多讨论。OpenAI 本周早些时候[发布了一篇博客](https://openai.com/index/path-to-astra/),讨论了该模型的新能力,以及为让用户体验更安全而新设的防护措施。该公司周四表示,已在多种安全基准上对 Astra 进行测试以确保其能力,并且它能“识别和开发零日漏洞,可以帮助防御者发现并修补弱点”。 该公司对对齐(即模型趋向于用户想要的或符合其最佳利益的倾向)的关注,很难不让人感觉是对近期 Hugging Face 安全漏洞事件的回应。

阅读原文(techcrunch.com)→

行业新闻Lucas Ropek2026-09-03原文

相关内容