31

08

星期一

19:35

智谱Token推理成本较年初降80%:10万张国产芯片跑大模型

动察 Beating AI 快讯,智谱披露,公司目前已经实现 10 万级国产芯片的规模化低成本推理,单位 Token 推理成本较年初下降 80%。 这批国产算力此前已经经过真实流量压测。GLM-5.3-Flash 发布前以 Ox-Alpha 匿名上线 OpenRouter 和 OpenCode,Token 调用量达到 62 万亿;正式发布后,全部线上流量也继续由 10 万张国产芯片承载。

「查看原文」

本内容旨在传递行业动态,不构成投资建议或承诺。