OpenAI 推出 GPT-5.6-Cyber,拒绝率降低,... 笔记

OpenAI 推出 GPT-5.6-Cyber,拒绝率降低,在高级网络安全任务中的完成率达 95%

OpenAI 推出了 GPT-5.6-Cyber,这是一款专为高级漏洞研究与利用开发而设计的专用人工智能模型。该模型是 GPT-5.6 Sol 的微调版本,专门针对网络安全任务进行训练,例如发现零日漏洞。关键在于,其工程设计旨在降低对潜在双重用途网络安全请求的拒绝率,以协助防御方。GPT-5.6-Cyber 在高级网络安全基准测试中的完成率显著高于其前身及通用 GPT-5.6 Sol 模型。然而,GPT-5.6-Cyber 的访问权限仅限于已获准加入 OpenAI 新推出的 Daybreak Red 网络安全计划的组织。Daybreak Red 要求严格的申请流程,包括展示强大的内部安全计划以及合法、授权的防御性工作。更广泛的 Daybreak Blue 层级则为更广泛的防御方,在通用模型(如 GPT-5.6 Sol)上提供部分解除的护栏。OpenAI 已报告 GPT-5.6-Cyber 在发现多个零日漏洞方面取得成功,涉及 Google V8 JavaScript 引擎等系统。尽管具有专用性,GPT-5.6-Cyber 并非在所有网络安全任务上均普遍优于通用模型。这些更宽松模型的推出,发生在 OpenAI 与 Hugging Face 之间一次重大的 AI 驱动网络事件之后,凸显了能力与安全之间微妙的平衡。
CdXz5zHNQW_siZXfA0xMT.png