ITCOW牛新网 9月18日消息,智谱AI正式上线GLM‑5.3‑FlashX推理版本API,模型峰值生成速度最高200 tokens/s,面向企业与开发者提供更快的推理体验。

该模型的前身GLM‑5.3‑Flash此前以代号“Ox Alpha”对外提供服务,海内外调用量持续走高。智谱依托10万张国产芯片的推理算力集群,加大底层推理基础设施优化,在保留原有模型智能能力的基础上,进一步提升输出速度,实现智能、成本、速度综合竞争力。
目前该API已经开放调用,模型标识为GLM‑5.3‑FlashX,开发者可以查阅官方文档接入使用。