星知

logo
logo
登录

智谱GLM-5.3-FlashX上线:最高 200 tokens/s

智谱发布GLM-5.3-FlashX,最高输出200 tokens/s,API已上线,主打智能、价格与速度平衡。
发布时间:2026/09/20 03:00|分类:人工智能
智谱今天端出了新模型 GLM-5.3-FlashX,官方标出的最高速度冲到了每秒200个 token,给企业开发者的体验按下了加速键。该提速型号基于此前以“Ox Alpha”之名在海外亮相的 GLM-5.3-Flash,凭借同尺寸中突出的智能水平积累口碑,调用量持续攀升。智谱在10万张国产芯片支撑的推理算力基础上,继续投入 Infra 基建和推理优化,使 FlashX 同时兼顾智能、价格与速度。目前 GLM-5.3-FlashX 的 API 已上线,开发者调用时使用 Model Key:GLM-5.3-FlashX。对生产场景而言,每秒200 token有助于在不牺牲聪明程度的前提下降低响应延迟。
人工智能星知