跳到正文
原文
智谱 公众号·· 12 天前精选AI 评分68

智谱上线 GLM-5.3-FlashX 模型

GLM-5.3-FlashX上线:大大方方、好好用用、嗖嗖嗖嗖

AI 导读

智谱正式上线 GLM-5.3-FlashX 模型,生成速度最高可达 200 tokens/s。该模型基于 10 万张国产芯片提供的推理算力进行了底层 Infra 与推理优化,主打智能、价格与速度竞争力,目前 API 与体验中心已同步开放调用。

推荐理由

原文给出了基于国产算力优化后的生成速率指标,读者可以据此评估高吞吐场景下的调用时延与可用性。

来源:智谱 公众号 · mp.weixin.qq.com