会懂网AI资讯获悉,
8月26日晚,北京大模型公司智谱正式认领了此前在海外爆火的匿名模型“牛来”(Ox-Alpha),将其正式版GLM-5.3-Flash以开源形式上线。这是GLM-5系列首个原生多模态模型,总参数320B、激活参数18B,原生支持文本、图片和视频输入,并支持1M上下文。

发布前,GLM-5.3-Flash以匿名身份在OpenRouter、OpenCode两大海外平台测试,迅速登顶并刷新双平台历史纪录,词元调用量高达62T,还终结了DeepSeek在OpenCode连续56天的霸榜。这种“匿名发模型、测榜后再认领”的玩法,正成为国产模型厂商制造声量的新方式。
价格是大亮点。GLM-5.3-Flash定价为GLM-5.3的1/10,限时折扣内为1/20,仅为Claude Opus 4.8的1/40。便宜来自架构重构:它采用稀疏注意力与线性注意力混合架构,是首个采用该架构的开源前沿模型,总参数与GLM-4.5相当,但激活参数与层数几乎减半,结合30T Token多模态预训练语料,用更少算力实现更强性能。
更关键的是国产算力支撑。智谱披露,GLM-5.3-Flash全部线上流量由10万张国产芯片承载,通过自研高带宽互联网络连接;与同一硬件上的初始基线相比,端到端服务性能提升3倍,硬件效率和单Token成本已达到与主流GPU相当的水平。这证明国产芯片能在大规模场景下高效、经济地支撑前沿模型推理。
模型以MIT License开源,权重已在Hugging Face公开,并接入ZCode等编码平台、纳入GLM Coding Plan。在Artificial Analysis综合智能指数中,GLM-5.3-Flash拿到57分,进入全球前沿模型区间,与Claude Opus 4.8持平。对开发者而言,一个既能跑通多模态、又把成本压到闭源零头的开放模型,意味着可以把更多精力放在应用本身,而不是盯着账单做取舍。国产大模型用“开源+极致性价比+国产算力”的组合,正在全球开发者面前重新定价前沿智能,也让“前沿能力不必省着用”第一次成为现实。




















暂无评论内容