近日,OpenAI宣布即将推出新模型Astra,考虑到其网络安全能力已经达到更高风险等级,因此将限制这一模型部分高级网络安全功能的使用范围。目前,OpenAI方面尚未公布Astra模型的具体发布时间,仅表示将“很快”推出。

OpenAI此前透露,Astra已达到“关键网络安全能力”的门槛,在相关测试中,该模型能够在拥有合适工具和访问权限的情况下,发现此前未知的软件安全漏洞,并开发针对这些漏洞的利用方式。为了降低相关能力被滥用,据悉,Astra在上线初期将仅面向少量测试人员开放高级网络安全功能,后续计划通过Daybreak Blue项目向更多用户提供用于网络防御的访问权限,同时配套相应的安全措施。

值得注意的是,Astra此次强化的安全措施与OpenAI近期发生的一起网络安全事件有关。此前在2026年7月,该公司进行内部网络安全评估时发现,有测试模型绕过了原本用于隔离模型与互联网的控制措施,访问了其内部研究基础设施及Hugging Face部分系统,并在Hugging Face的41台生产服务器上执行代码,取得了其中至少一台服务器的root级权限,同时获取了生产环境凭证并下载4个私有代码仓库,而且这些操作仅在约13小时内完成。
OpenAI随后暂停了部分前沿模型训练和Astra的相关工作,并加强训练环境隔离、网络访问控制、监控以及模型对齐等措施,并表示,该模型与即将推出的Astra模型属于同家族,但并非同一模型。
近年来,OpenAI持续在推进模型的迭代。2025年1月其推出o3-mini,作为o系列的小型推理模型,重点面向数学、科学和编码等任务;4月发布o3和o4-mini,进一步强化推理与工具调用能力。8月,OpenAI推出GPT-5,随后在12月发布的GPT-5.2-Codex已具备更强的网络安全能力,并被定位为面向复杂软件工程和防御性网络安全的智能体编码模型。

进入2026年后,OpenAI于2月推出GPT-5.3-Codex,将Codex与GPT-5训练体系结合,进一步提升智能体编程能力;3月发布GPT-5.4,将推理、编程和智能体工作流能力整合到单一模型中,并支持智能体操作计算机和跨应用执行任务。7月,GPT-5.6系列正式发布,其中旗舰模型GPT-5.6 Sol进一步强化了编程、智能体及网络安全能力,并针对高风险活动和敏感网络安全请求加强防护。
【本文图片来自网络】
