智谱GLM-5.3-Flash正式认领神秘模型“牛来”(Ox-Alpha)。该模型测试期间每日100万亿token的流量,全部由超过10万张国产芯片承载,智谱称其成本效率已与英伟达GPU相当。传闻称芯片供应或来自华为、摩尔线程与海光。此外,模型定价为Claude Opus 4.8的1/40。
8月26日,智谱正式确认:此前在开发者社区引发热议的匿名模型Ox Alpha(中文社区称“牛来”),就是其最新发布的GLM-5.3-Flash。模型代号灵感来源于国内近期热映电影《牛来》。
这个模型在正式亮相前,以匿名形式在OpenRouter和OpenCode上免费开放测试,5天内流量累计超过50万亿token,刷新了两个平台的流量增长纪录,当前使用量已超过DeepSeek的两倍以上。但真正引发市场关注的,是智谱随后披露的一个细节:这些流量,全部由国产芯片承载。
智谱在官方技术文档中表示,调用超过10万张国产芯片集群用于该模型推理服务,“硬件效率及单token成本已经达到了与主流英伟达GPU相当的水平”。
半导体研究机构SemiAnalysis随即在X平台发文评论:“所有流量均由国产芯片承载,硬件效率和单token成本已可与英伟达GPU相媲美。继Jalapeño(OpenAI自研推理芯片)昨日宣布之后,CUDA护城河再度受到考验。”
0
评论 (0)