跳到正文
原文
智谱 公众号·· 2026-05-22精选AI 评分73

智谱推出 GLM-5.1 高速版 API,输出速度达 400 tokens/s

GLM-5.1高速版:400 tokens/s,顶尖模型跑出最快速度

AI 导读

智谱联合 TileRT 团队推出 GLM-5.1 高速版 API(GLM-5.1-highspeed),输出速度达 400 tokens/s,在完整保留旗舰模型能力的同时实现低延迟。

推荐理由

智谱通过底层推理引擎重构将旗舰模型输出速度提升至400 tokens/s,为高频交互与长程编码场景提供了极低延迟的落地路径。

来源:智谱 公众号 · mp.weixin.qq.com