新京报客户端

好新闻 无止境

立即打开
智谱GLM-5.3发布,涌现网络安全能力
新京报 记者 罗亦丹 编辑 岳彩周
2026-08-14 15:47

新京报贝壳财经讯(记者罗亦丹)8月14日,智谱在公众号官宣发布GLM-5.3大模型。


智谱表示,与GLM-5.2相比,基座模型没变,但通过极致的后训练Scaling大大提高了模型的智能上界:数十倍的长程任务环境、更丰富多样的环境类型、超长的后训练时间,“我们发现充分的模型后训练涌现出超出预期的模型能力。”


相比前代,GLM-5.3的新能力包括——


更强的编程能力。GLM-5.3是编程能力最强的开源模型,在内部自建体感评测中较GLM-5.2提升50%,在包括Terminal Bench 3.0、Agents' Last Exam(CLI)在内的公开基准测试中取得开源第一。


网络安全能力。在白盒代码审查与漏洞发现等安全任务中,GLM-5.3的表现持平Mythos 5,展现出面向网络安全防御场景的强大潜力。


后训练Scaling。上述全部提升都来自后训练。基于IndexShare、SAO、以及持续演进的新一代Slime框架,我们在与GLM-5.2完全相同基座上高效推进强化学习,可能我们还远未开发出这个基座的智能上界。


以上能力中,由于编程等一直是GLM系列主打的能力范畴,所以网络安全能力的涌现就显得有些“意料之外”。


对此,智谱方面表示,“在任务环境不断扩张的过程中,我们观察到模型在网络安全领域的表现超出预期。安全能力的出现并不偶然,安全工作本质上是约束严格的编程能力。我们从2025年9月开始在这个方向投入研究,在GLM-5.2与GLM-5.3的研发过程中,与国内多家头部安全实验室一同推进更多长程任务环境,构建更专业化的评测与执行框架(harness)。”


事实上,智谱的模型显现出不俗的网络安全能力早有端倪。此前在OpenAI模型“越狱”攻击Hugging Face数据库事件发生时,Hugging Face方最终用来防御的模型就是开源的GLM模型。


智谱表示,将在发布两周后开放模型权重,此前完成安全评估与模型加固。


编辑 岳彩周

校对 柳宝庆

来阅读我的更多文章吧
罗亦丹
新京报记者
记者主页
相关推荐
北京自研大模型网络安全能力实现重大突破
新京号
北京亦庄发布“北京机域”——人机共融具身智能新社会建设构想
北京
美AI测试失控 中国模型如何“救场”
第一看点
「经济发展」朱民:谁先构建全球经营能力,谁就在下一轮出海竞争中胜出
新京号
OpenAI承认其模型测试失控 侵入抱抱脸系统
新京号
国产大模型改写全球AI调用版图
新京号
AI自主攻击已成现实,绿盟科技用大模型重新定义渗透测试
藻知科技
北京将打造一批“北京智造”智能体终端标杆产品
北京
北京将打造一批“北京智造”智能体终端标杆产品
新京号
北京缘何成为AI创新之源?
北京

新京报报料邮箱:82708677@bjnews.com.cn