动察 Beating AI 快讯,智谱披露,公司目前已经实现 10 万级国产芯片的规模化低成本推理,单位 Token 推理成本较年初下降 80%。
这批国产算力此前已经经过真实流量压测。GLM-5.3-Flash 发布前以 Ox-Alpha 匿名上线 OpenRouter 和 OpenCode,Token 调用量达到 62 万亿;正式发布后,全部线上流量也继续由 10 万张国产芯片承载。
动察 Beating AI 快讯,智谱披露,公司目前已经实现 10 万级国产芯片的规模化低成本推理,单位 Token 推理成本较年初下降 80%。
这批国产算力此前已经经过真实流量压测。GLM-5.3-Flash 发布前以 Ox-Alpha 匿名上线 OpenRouter 和 OpenCode,Token 调用量达到 62 万亿;正式发布后,全部线上流量也继续由 10 万张国产芯片承载。