三伍新闻资讯,有趣实用的生活常识!

最新更新文章排行

三伍新闻资讯

当前位置: 首页 > AI智能

GLM-5.3突然发布!唐杰的“sooooooon”这次兑现了

时间:2026-08-14人气: 作者: 佚名

三天前,一位网友在X上调侃智谱首席科学家唐杰@的很快=elon的下周,glm 5.3什么时候出?

今天上午,唐杰只回了一个词:""。

GLM-5.3突然发布!唐杰的“sooooooon”这次兑现了(图1)

评论区迅速热闹起来。有人调侃这波又是烟雾弹,有人按智谱过往的发布节奏推断至少还得等一个月,还有人翻出唐杰上一次说soon已是三个月前的事。

结果几个小时后,GLM-5.3正式发布。

GLM-5.3突然发布!唐杰的“sooooooon”这次兑现了(图2)

从唐杰发出那条推文到Z.ai官网挂出技术博客,中间只隔了几个小时,兑现速度在大模型圈里颇为罕见。

这个,可能是大模型圈历史上兑现最快的一次。

GLM-5.3的定位非常聚焦:不做全能选手,只做编程和安全两件事,然后做到极致。

在编程维度上,最亮眼的不是某一项高分,而是提升幅度。

SWE-从19.4分翻倍至42.5分,从67.5分提升至78.1 分。

GLM-5.3突然发布!唐杰的“sooooooon”这次兑现了(图3)

单独看 Bench 3.0,这个基准模拟真实Linux终端环境下的多步操作,模型需要理解命令行、处理文件状态、调试程序输出,是开发者每天面对的最普通也最繁琐的工作。

GLM-5.2 在这上面的得分是 4.6,GLM-5.3 干到了 28.3。

五倍多。

同代基座,同样的参数规模,仅靠后训练就把一项能力翻了五倍。

GLM-5.3突然发布!唐杰的“sooooooon”这次兑现了(图4)

再看网络安全,这是本次发布中更受关注的部分。

基准考察的不是编写安全代码,而是发现并利用漏洞。模型需要在给定的系统环境中识别安全隐患、构造攻击、验证效果,本质上是在扮演白帽子黑客。

在网络安全维度上,GLM-5.3的得分84.5,位列所有参评模型之首。

GLM-5.3突然发布!唐杰的“sooooooon”这次兑现了(图5)

GLM-5.3突然发布!唐杰的“sooooooon”这次兑现了(图6)

Z.ai还同步发布了一份安全披露账本。

GLM-5.3突然发布!唐杰的“sooooooon”这次兑现了(图7)

账本显示,GLM-5.3相关研究共记录 2,436条安全发现,覆盖269个开源项目,其中1,097条属于或 High级别。最老的漏洞1981年被引入,平均每条漏洞在被发现前已在代码中存活26.6年。

26.6年这个数字,直观说明了问题的规模。

许多漏洞自被写进代码起便一直存在,等待某个恰好触发它的场景,而传统安全审计受限于人力与代码量的指数膨胀,往往难以覆盖。

顺着这条线再看Agent能力。GLM-5.3 引入了 Level 机制,提供Non-到Max四档推理深度,模型可按任务复杂度调节计算投入。

官方公布的曲线图显示,GLM-5.3从Low档到Max档,准确率从约24.5%提升至 34.5%,曲线斜率明显。相比之下,GLM-5.2的曲线近乎水平,在相同区间内准确率仅从约20%爬升至23.5%。

GLM-5.3突然发布!唐杰的“sooooooon”这次兑现了(图8)

方向的完整数据也值得关注。

73.0、 48.2、' Last Exam 28.5、HLE w/ Tools 62.5、-AA v2 1769,在多个基准上都处于第一梯队。

GLM-5.3突然发布!唐杰的“sooooooon”这次兑现了(图9)

智谱同时透露,下一代大版本将更换全新架构,参数规模直接翻倍,全面对标 Fable 5。若如此,GLM-5.3更像是一次中场休息,是更大版本发布前的铺垫。

关于soon的故事,还有后半段。

今天有人在X上接着问唐杰,那GLM-6呢。唐杰的回复是:soon。

同样的词,第二次出现。但这一次,选择相信的人更多,毕竟就在几个小时前,同一句soon刚刚兑现过一次。