🤖 由 文心大模型 生成的文章摘要
OpenAI宣布推出红队模型GPT-5.6-Cyber,专注于网
人工智能公司OpenAI宣布扩展其网络安全计划Daybreak,并推出了一款专注于网络攻击模拟的专用模型——GPT-5.6-Cyber(红队模型)。该模型旨在通过扮演“AI黑客”的角色,主动挖掘系统漏洞,以提前暴露风险,从而“锻造更坚固的盾”。
OpenAI构建了“红蓝攻防体系”。其中,红队模型(Daybreak Red) 模拟攻击者视角,而蓝队模型(Daybreak Blue) 则负责防御。此次重点推出的GPT-5.6-Cyber红队模型在攻击模拟能力上表现突出:
自主挖掘“零日漏洞”:在内部评测中,模型被仅给予开源代码,需自主发现全新未知漏洞(零日漏洞)并评估其潜在危害。结果显示,其平均漏洞发现质量远超通用模型。在真实世界测试中,它成功在Chrome浏览器的V8引擎、某流行移动操作系统、某数据库及操作系统内核中发现了大量漏洞,包括可导致权限提升的漏洞链。
串联攻击路径:模型不仅发现孤立漏洞,还能进一步分析并串联多个漏洞,构建出完整的、在现实中可利用的攻击路径。例如,在V8引擎案例中,它找到两个漏洞并判断其可被组合利用,以逃逸安全沙箱。
大幅降低安全拒绝倾向:为完成高风险任务,OpenAI主动降低了该模型在安全任务上的拒绝率。在涉及漏洞利用、认证绕过、权限提升等“高级网络安全任务”测试中,GPT-5.6-Cyber的完成率达到95%,而普通模型完成率仅约1.5%-2%。这意味着它对“如何绕过认证”这类高风险请求更倾向于提供技术方案。
这种强大的攻击模拟能力也带来了显著的滥用风险。OpenAI承认此风险,并采取了分级权限隔离措施:模型仅面向经过批准的专业安全机构和人员,在沙箱等隔离环境中运行,并对高风险操作进行二次拦截。
然而,此举引发了行业争议。批评者指出,防御所需的“攻击模拟能力”与真正攻击者所需的能力高度重合。在近期刚发生过AI Agent突破安全边界事件后,训练一个攻击能力更强的模型,究竟是在提升安全防御上限,还是在提高AI风险的扩散上限?OpenAI选择了“允许更强能力存在,依靠权限治理”的路径,但其最终效果仍是未知数。
上一篇:AI办公也需要「牛来」
下一篇:没有了