新闻
刚刚,GLM-5.3来了!拿下多个开源SOTA,我用它“魔改”DeepSeek Harness
1 分钟阅读
来源:zhidx.com
智东西 作者 | 陈骏达 编辑 | 心缘 智东西8月14日报道,就在刚刚,智谱发布了其 最新一代旗舰模型GLM-5.3 ,并宣布模型将 在两周内开源 。这是一个拥有7430亿个参数的模型,和此前的GLM模型一样主打编程。 在多项主流基准测试中,GLM-5.3位居所有已开源或即将开源模型中的第一;其在编程与智能体任务上的能力, 已逼近Claude Fable 5、GPT-5.6 Sol等海外顶尖模型 。 与国内模型相比,GLM-5.3与Kimi K3 在编程和智能体领域互有胜负 ,并在绝大部分基准测试中领先DeepSeek-V4-Pro-0813。而在 网络安全能力方面,GLM-5.3则展现出一定优势 ,领先于另外两款国产模型。 同时,GLM-5.3还在能力和token效率之间取得了更好的平衡。在相同的高档位思考预算下,GLM-5.3的准确率达到31.5%,超过Claude Opus 4.8的29.5%, 任务平均输出约5万个token,不到Opus 4.8平均输出量的一半。 智东西在发布前获得了GLM-5.3的内测资格,得以提前深度体验这款模型在真实开发场景中的完整能力。在我们的实测中,GLM-5.3+ZCode的组合不仅能从0到1开发一款 以真实地图数据1:1复刻上海陆家嘴至外滩区域的3D开放世界驾驶游戏 ,还能“ 裸考”DeepSeek刚开源的Harness框架 :在零先验的条件下读懂这个超7000个文件的代码仓库,再按它的规矩打造出一个“人格插件”。 除了编程能力之外,智谱称GLM-5.3在充分的预训练之后,还涌现出了不错的网络安全能力,在与国内高校、企业的合作中,GLM