OpenAI于8月10日星期一发布GPT-5.6-Cyber。这是一款面向高级且获得授权的网络安全工作的专用人工智能模型。随着外界越来越担心攻击者利用自动化手段大规模开展网络行动,该公司只通过新设立的Daybreak Red访问层向审核通过的防御人员提供该模型。Axios在世界协调时间17时独立报道了这次发布,因此这一消息处于过去二十四小时的有效时间窗口内。
该模型以GPT-5.6 Sol为基础,但经过专门训练,目的是减少对敏感双重用途任务的拒绝。OpenAI表示,Daybreak Blue将让获批用户使用通用模型,并配置适合防御工作的保护措施,可用于事件响应、恶意软件分析和补丁验证。Daybreak Red则面向获得授权的漏洞研究、漏洞利用验证、渗透测试以及其他高级安全评估。两种层级按照工作风险和所需能力区分访问范围。
在涵盖漏洞利用链开发、绕过身份验证和提升权限的内部评估中,OpenAI称GPT-5.6-Cyber完成了95.0%的请求。相比之下,标准GPT-5.6 Sol的完成率为1.5%,Daybreak Blue环境中的Sol为2.0%,上一代GPT-5.5-Cyber为57.3%。这些数字来自公司自己的测试,目前尚未得到独立机构重复验证,因此应被视为厂商报告的结果,而不是外部确认的性能结论。
OpenAI还表示,该模型协助发现了谷歌V8 JavaScript引擎中两个此前未知的漏洞。两个漏洞可以串联起来破坏内存,并逃离堆沙箱。谷歌已经修复报告的问题,并分配编号CVE-2026-15903。OpenAI称,该模型还在一个移动操作系统、一个数据库和一个操作系统内核中发现其他高严重性问题,但在修复工作和协调披露完成前,相关细节仍将保密,以免未修补系统面临额外风险。
扩大能力访问的同时也伴随着多项控制。OpenAI表示,两种层级都要求事先批准、身份验证、账户安全保护、持续监控、获准用途限制以及法律声明。从9月1日起,Daybreak个人账户必须采用硬件安全密钥。公司还建议在隔离环境中运行相关工作,明确授权系统和操作边界,保留人工监督,并使用自动审查模式;该模式能够拦截需要更高权限且可能造成破坏的操作。
按照OpenAI的准备框架,GPT-5.6-Cyber的网络能力被评为高等级,但仍低于关键等级门槛。公司承认,减少安全限制会带来滥用或模型偏离预期的风险,并表示以后将发布更完整的系统卡。此次发布突显科技行业面临的艰难平衡:必须在进攻型人工智能广泛扩散前给合法防御人员提供更强工具,同时又要把访问限制得足够严格,避免相同能力落入攻击者手中。
评论