
智谱 Token 推理成本较年初下降 80%
智谱披露,公司目前已实现 10 万级国产芯片的规模化低成本推理,单位 Token 推理成本较年初下降 80%。
这批国产算力此前已用于公开模型运行。智谱发布 GLM-5.3-Flash 时曾确认,该模型的全部线上流量由 10 万张国产芯片承载。发布前,匿名模型 Ox-Alpha 在 OpenRouter、OpenCode 上进行的大规模测试,也运行在这批国产算力上。
© 版权声明
文章版权归作者所有,未经允许请勿转载。
THE END










暂无评论内容