智谱开源GLM-5.3-Flash:62万亿Token调用全部由国产芯片承载

会懂网AI资讯获悉,智谱AI正式开源GLM-5.3-Flash大模型。8月26日晚间,智谱宣布开源这一模型,此前它以匿名”牛来”之名在OpenRouter、OpenCod两大平台登顶并刷新纪录,如今身份正式揭晓。GLM-5.3-Flash总参数320B、激活参数18B,是GLM-5系列首个原生多模态模型,AA Index评分57分,价格仅为闭源旗舰的约四十分之一。

更受关注的是其算力背景:该模型62万亿Token的调用量,全部由10万张国产芯片集群承载,这也是国产算力芯片首次大规模集体出海,服务全球真实负载。从训练到推理全程跑在国产算力底座上,并在海外主流平台登顶,被视为国产大模型与国产算力协同突破的标志性事件。

此前,智谱已确认Ox Alpha为其GLM系列新一代版本,该模型完全免费,已跃居OpenRouter排行榜首位,使用量一度达到DeepSeek的两倍以上。此次GLM-5.3-Flash的开源,进一步巩固了智谱在开源基础模型赛道的领先地位。

业内分析认为,GLM-5.3-Flash的发布,是国产大模型”后训练时代”的缩影。当参数规模的边际收益递减,通过开源+价格优势+国产算力协同,国产模型正在全球市场构建差异化的竞争力。62万亿Token调用量全部由国产芯片承载的事实,也向全球展示了中国AI软硬件协同的能力,为更多国产模型出海趟出了一条可行路径。

国产大模型此前在训练侧已有突破,但大规模推理负载下的稳定性仍待验证。此次62万亿Token调用全部由国产芯片承载,相当于一次大规模的真实负载压力测试,既为国产芯片优化积累了宝贵数据,也证明了国产算力在真实场景中的可用性,”双轮驱动”效应正在显现。

© 版权声明
THE END
喜欢就支持一下吧
点赞8 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容