OpenAI重磅发布GPT-5.6-Cyber:蓝红分层,95%渗透提示应答率

OpenAI将Daybreak网络安全计划拆分为蓝红两级,并推出专攻攻防的GPT-5.6-Cyber模型。该模型在高级基准测试中可应答95%渗透提示,远超旧版,目前仅向IBM、CrowdStrike等16家通过审查的合作伙伴开放。

OpenAI周一将Daybreak网络防御计划拆分为蓝(Blue)和红(Red)两个层级,并发布专用于网络安全GPT-5.6-Cyber模型。该模型已提供给少数经过审查的安全公司,用于对抗AI攻击。

今年早些时候,OpenAI推出Daybreak项目,向私人组织和政府提供未公开的前沿模型,用于防御工作。如今,该项目将客户分为蓝、红两档:蓝层基于通用前沿模型GPT-5.6 Sol,移除了部分生产级防护限制,OpenAI称这是“大多数防御者的推荐起点”,适用于漏洞发现、安全代码审查、恶意软件分析、事件响应和补丁验证;红层则提供专用的网络安全模型,用于授权漏洞研究、漏洞利用验证和安全测试,GPT-5.6-Cyber仅存在于红层。

OpenAI表示,由于该模型在恶意网络任务上的能力远超Sol,红层客户将受到严格监控和监管。GPT-5.6-Cyber基于GPT-5.6 Sol训练,但专门强化了零日漏洞挖掘、漏洞利用链构建,并减少对高风险、双重用途请求的拒绝。

在内部基准“高级网络安全完成率”测试中,GPT-5.6-Cyber能应答95.0%的测试问题,而GPT-5.6 Sol仅为1.5%,通过蓝层也仅为2.0%;旧版GPT-5.5-Cyber为57.3%。OpenAI提到,此前研究人员常因请求被拒而抱怨,这一数字正是相关问题的反映。

OpenAI还启动了合作伙伴计划,共有16家网络安全服务商参与,包括IBM、CrowdStrike、Accenture、Ernst & Young、KPMG、Palo Alto Networks、Cisco、Cloudflare和Sophos。GPT-5.6-Cyber目前仅向“可信客户合作伙伴”提供,名单包括Accenture、IBM、CrowdStrike和Cloudflare。SpecterOps CTO Jared Atkinson表示,该模型“在一天内完成了此前模型数周仍未解决的工作”,减少不必要的拒绝后,授权研究员能更专注于验证发现。OpenAI表示,更完整的系统说明将于稍后公布。

OpenAI承认,“减少安全防护的模型会带来超出标准使用的风险,无论是滥用还是失调。”但该公司仍认为,“面向防御者普及前沿智能至关重要。”据英国AI安全研究所8月5日报告,在122次测试中,OpenAI和Anthropic的智能体共有19次违反规则,其中2次涉及GPT-5.6-Sol,其余多指向Anthropic的Mythos 5。Daybreak的推出发生在Anthropic发布其网络安全模型Mythos之后,OpenAI表示正放缓另一模型Astra的研发,以构建更完善的控制措施。

免责声明:本文提供的信息不是交易建议。BlockWeeks.com不对根据本文提供的信息所做的任何投资承担责任。我们强烈建议在做出任何投资决策之前进行独立研究或咨询合格的专业人士。

(0)
区块链小猫的头像区块链小猫作者
上一篇 14小时前
下一篇 14小时前

相关推荐

发表回复

登录后才能评论
分享本页
返回顶部