News
国产大模型打出王炸
1 min read
Source: Telegram AI频道
国产大模型打出王炸!智谱GLM-5.3-Flash原生多模态颠覆行业价格战 大模型行业的“价格战”与“能力天花板”在近期迎来了一次全新突破。此前在开源社区引发广泛关注、被称作“牛来”的神秘模型Ox-Alpha终于揭开面纱,它正是智谱AI最新发布的GLM-5.3-Flash。作为GLM- 5 系列的首个原生多模态模型,它不仅在性能上硬刚全球顶级旗舰,更以极具颠覆性的价格和全国产算力底座,重新改写了行业竞争规则。 在核心性能与价格定位上,GLM-5.3-Flash展现了跨越式的性价比。其Artificial Analysis Intelligence评分达到 57 分,不仅超越上一代旗舰GLM-5.2,也高于DeepSeek V4 Pro正式版的 53 分,远超同类模型 18 分的中间值。而在价格方面,它打破了传统大模型“参数越大、价格越贵”的定律,每百万Token输入仅需0. 8 元、输出2. 8 元、缓存命中0. 23 元,成本约为Claude Opus 4. 8 的四十分之一,让前沿智能真正摆脱了“省着用”的窘境。 多模态视觉能力的全面原生集成,是该模型最大的技术亮点。传统编程大模型依赖“人类充当裁判”的单向流程,而GLM-5.3-Flash则将视觉编码能力融入Coding循环中。模型在编写代码、设计游戏或搭建3D场景时,能够主动“观察”渲染结果和交互反馈,形成“生成-观察-修正”的闭环。官方测试显示,该模型甚至能在Blender中自主运行 16 个小时,从零搭建出一个约 400 平方米的专业主厨自宅与测试厨房,展现了强大的自主视觉判断与迭代改进能力。 更为关键的是,这款前沿大模型背后的算力支撑全面转向了国产芯片。在OpenCode和OpenRouter等平台上,由集群承载的全球真实线上流量均由国产芯片提供算力支持,并借助专用的SGLang推理引擎、ReplaySSM、混合缓存量化及EPD分离式架构等一系列激进优化技术,克服了内存与带宽瓶颈。这一突破证明,国产芯片不仅能够完美承载前沿大模型,还能在大规模真实流量下保持稳定与经济。 目前,GLM-5.3-Flash的模型