智谱AI GLM-5.3正式开源,网络安全性能引关注

备受期待的智谱AI旗舰模型GLM-5.3,最终定于北京时间8月28日上午10点向公众开放其模型权重。这一时间点比部分开发者预期的晚了约两周。根据官方解释,延迟的主要原因并非技术障碍,而是源于一个积极的发现:模型在后期训练阶段展现出的网络安全能力增长“超出预期”。

为何推迟发布?安全能力的意外飞跃

实际上,GLM-5.3的核心版本早在8月14日就已通过Coding Plan平台上线,并随后开放了API接口。然而,完整的模型权重下载却直到现在才放开。智谱AI团队表示,他们在后训练过程中观察到,模型不仅更擅长识别单一的安全漏洞,甚至开始展现出规划多步骤、完整漏洞利用链的复杂能力。

这种能力的快速进化让团队决定按下“暂停键”。在开源之前,进行彻底的安全评估和模型加固成为了一项必要且优先的工作,旨在确保技术负责任地发布。

性能评测:漏洞发现能力领先

根据官方发布的基准测试结果,GLM-5.3在网络安全领域取得了显著进步:

  • 在专注于漏洞发现的“Cyber Gym”测试中,GLM-5.3取得了84.5%的得分,表现略优于一些同期主流模型。
  • 在更偏向攻击利用的“Exploit Bench”测试中,其得分从上一代GLM-5.2的24.4%大幅提升至54.4%,实现了能力翻番,尽管与顶尖水平仍有差距。

更为实际的是,智谱AI透露,利用GLM-5.3的能力,团队已在269个开源软件项目中发现了总计2436个安全漏洞,其中超过1000个被归类为严重或高危级别。这证明了其在现实世界代码审计中的巨大潜力。

技术路径:后训练驱动的专项提升

需要指出的是,GLM-5.3沿用了与GLM-5.2相同的基座模型。这意味着它在通用语言能力上保持了一致性,而所有在网络安全方面令人印象深刻的提升,完全来源于针对性的后训练(Post-training)技术。这种方法使得模型能够在特定垂直领域快速迭代和强化,而不必从头开始训练。

对于开发者和安全研究人员而言,GLM-5.3的开源提供了一个强大的新工具,有望应用于自动化代码审计、漏洞挖掘和网络安全教育等多个场景。它的到来,或许将重新定义AI在网络安全防御与攻防研究中的角色。