智谱今日正式发布 GLM-5.3-FlashX。该模型此前以代号“Ox Alpha”向全球开发者提供,通过利用 100,000 枚国产芯片的计算资源,实现了最高 200 Tokens/s 的推理速度。GLM-5.3-FlashX API 现已上线,模型标识符为“GLM-5.3-FlashX”。