OpenAI发布GPT-6 Astra,网络安全能力大幅提升

美国当地时间9月3日,OpenAI宣布推出GPT-6 Astra模型。据其透露,作为OpenAI目前能力最强、部署范围最广的大语言模型,GPT-6 Astra首次达到其“准备框架”中的“关键”(Critical)网络安全能力门槛。


同时OpenAI方面宣布推出“Daybreak for Frontline Defenders”计划,未来6个月将投入10亿美元,为资源有限的网络安全防御团队提供AI访问权限、培训及技术支持,重点覆盖供水、电力、地方政府和金融等关键服务。据悉,该计划将首先在美国展开,未来数周将扩展至其他合作国家。

OpenAI发布GPT-6 Astra,强化网络安全能力

据OpenAI方面介绍,GPT-6 Astra在网络安全能力方面实现了大幅提升。在获得适当工具和授权的情况下,该模型能够在无人指导的情况下发现部分防护严密系统中此前未知的安全漏洞,并开发新的利用方式。


针对网络安全能力提升,OpenAI进一步强化了模型部署环境隔离、加密模型检查点和运行轨迹监控,并新增阻断式对齐评估流程。与GPT-5.6 Sol相比,GPT-6 Astra在提示词注入攻击的鲁棒性有所提升,在真实浏览及专业计算机环境中,未经授权交易、数据丢失、过度访问权限和绕过控制等潜在破坏性行为也有所减少。

OpenAI发布GPT-6 Astra,强化网络安全能力

OpenAI公布的一组对齐评估结果显示,在使用超过5.4万项内部Codex任务进行部署模拟的情况下,GPT-6 Astra被标记为高严重程度失配行为的次数约为GPT-5.6 Sol的一半。不过OpenAI方面同时指出,GPT-6 Astra的可监控性较上一代有所下降。


相关测试显示,GPT-6 Astra更有能力控制自身思维链,并可能在部分对抗性评估中规避内部监控。对此OpenAI方面表示,目前尚未发现GPT-6 Astra存在通过思维链隐写推理隐藏信息的证据,并将继续研究模型可监控性及相关审计技术。

OpenAI发布GPT-6 Astra,强化网络安全能力

2026年早些时候OpenAI就已推出Daybreak Access网络安全可信访问计划,为经过验证的公共部门和私营部门网络安全防御人员提供AI网络防御能力,其中,Daybreak Blue主要支持常见防御任务,Daybreak Red则面向获批准机构提供专业网络安全模型。


目前已有超过2000家获批准机构和工作空间、数千名网络安全防御人员使用Daybreak Access,OpenAI还宣布与多个州信息共享与分析中心(MS-ISAC)开展试点,并将通过Daybreak Defense Network合作伙伴推出超过35款相关企业产品及合作运营服务。

OpenAI发布GPT-6 Astra,强化网络安全能力

今年以来,OpenAI持续推进模型的迭代,此前在今年2月推出GPT-5.3-Codex,将Codex与GPT-5训练体系结合,进一步提升智能体编程能力;3月发布GPT-5.4,将推理、编程和智能体工作流能力整合到单一模型中,并支持智能体操作计算机和跨应用执行任务。随后在7月,GPT-5.6系列正式发布,其中旗舰模型GPT-5.6 Sol进一步强化了编程、智能体及网络安全能力,并针对高风险活动和敏感网络安全请求加强防护。


值得注意的是,今年7月OpenAI进行内部网络安全评估时发现,有测试模型绕过了原本用于隔离模型与互联网的控制措施,访问了其内部研究基础设施及Hugging Face部分系统,并在Hugging Face的41台生产服务器上执行代码,取得了其中至少一台服务器的root级权限,同时获取了生产环境凭证并下载4个私有代码仓库,而且这些操作仅在约13小时内完成。


OpenAI随后暂停了部分前沿模型训练和Astra的相关工作,并加强训练环境隔离、网络访问控制、监控以及模型对齐等措施,据其透露,该模型与即将推出的Astra模型属于同家族,但并非同一模型。


【本文图片来自网络】

踩(0)

最新文章

相关文章

大家都在看