【智谱Token推理成本较年初降80%:10万张国产芯片跑大模型】
【智谱Token推理成本较年初降80%:10万张国产芯片跑大模型】报道,8月31日消息,智谱披露,公司目前已经实现10万级国产芯片的规模化低成本推理,单位Token推理成本较年初下降80%。这批国产算力此前已经经过真实流量压测。GLM-5.3-Flash发布前以Ox-Alpha匿名上线OpenRouter和OpenCode,Token调用量达到62万亿;正式发布后,全部线上流量也继续由10万张国产芯片承载。
免责声明:
内容来源金色财经、欧意交易所、gate.io交易平台以及Binance交易所官网
本站不对其做任何背书,也不代表赞成作者观点,如有失察或对您造成影响,可联系我们删除
内容来源金色财经、欧意交易所、gate.io交易平台以及Binance交易所官网
本站不对其做任何背书,也不代表赞成作者观点,如有失察或对您造成影响,可联系我们删除

还没有评论,来说两句吧...