智谱 AI 旗下 BigModel 平台正式推出 GLM-5.3-FlashX 大模型,API 同步上线,模型标识为“GLM-5.3-FlashX”。新版本最高输出速度达200tokens/s,主打“智能、价格、速度”三位一体竞争力,面向企业与开发者提供高吞吐、低延迟的推理服务。

智谱发布 GLM-5.3-FlashX:速度飙至200tokens/s,国产算力再提速

该模型前身 GLM-5.3-Flash 曾以“Ox Alpha”匿名亮相海外,凭借同尺寸最强智能水平与极高性价比迅速积累口碑,调用量持续攀升。为支撑增长需求,智谱依托10万张国产芯片算力底座,加大推理优化投入,最终推出提速版 FlashX。

FlashX 在保持原有智能水准与亲民定价的基础上,将生成速度拉满,进一步巩固了其在高并发场景下的商用优势。开发者可通过官方 API 文档接入,非技术用户也可在体验中心直接试用。此次升级标志着国产大模型在推理效率与普惠化落地上又迈进一步。