(来源:千龙网)
中国开源大模型正从“会写代码”进一步迈向“守护数字基础设施”。近日,北京人工智能企业智谱正式发布新一代基座模型GLM-5.3。该模型总参数规模达7530亿,在代码生成、复杂工程执行,尤其是网络安全能力方面实现重大技术突破,在部分安全任务中追平甚至超过海外闭源前沿模型。
网络安全被视为代码能力的“高阶考场”。它要求大模型不仅要读懂代码,还要从海量系统中还原逻辑、定位漏洞、判断影响并协助推动修复。在国际漏洞推理评测CyberGym的测试中,GLM-5.3得分为84.5% ,略高于Mythos 5的83.8%和GPT-5.6 Sol的83.6%。不过,在更考验深度推理能力的ExploitBench测试,以及考察模型限定时间内能够完成多少漏洞利用任务的ExploitGym测试中,Mythos 5仍处于领先位置。
当前,网络安全能力正成为人工智能国际竞争的重要高地。国际开源社区Hugging Face上个月披露的一起AI智能体入侵事件中,中国开源模型就展现了其在安全可信方面的价值。Hugging Face透露,在尝试使用商业闭源模型分析攻击日志并遭到拒绝后,其借助智谱GLM-5.2成功还原了攻击过程,同时确保敏感数据留存在企业环境内。
“网络安全能力是守护数字世界的坚盾,只有掌握自主可控的前沿大模型技术和网络安全核心能力,才能在这场全新的攻防变革中,保护自己的数字基础设施、捍卫安全边界。”智谱相关负责人表示。
据了解,随着GLM-5.3的发布与开源,智谱将同步启动“开源的盾”计划:对重点开源项目开展持续安全审计,帮助维护者免费发现风险并修复,并向开源社区免费提供模型额度及更加便捷的防御入口,开源项目维护者可申请将其用于安全审计和防御任务。
近几个月来,北京大模型捷报频传:Kimi K3发布当前最大开源模型,综合智能水平直逼国际两大尖端闭源模型;小米MiMo-V2.5在通用图形处理器上实现推理速度大幅突破,并登顶全球多模型聚合平台公布的大模型调用量榜首;字节跳动发布新一代视频生成模型Seedance 2.5,在生成时长、多模态理解、编辑精度等维度实现全面升级。从代码生成到安全守护,从模型竞技到产业落地,北京AI创新力量正从多个维度同时发力,向世界前沿水平迈进。
上一篇:“上午要,下午交”当叫停