智谱 公众号·· 2026-05-22精选AI 评分73
智谱推出 GLM-5.1 高速版 API,输出速度达 400 tokens/s
GLM-5.1高速版:400 tokens/s,顶尖模型跑出最快速度
AI 导读
智谱联合 TileRT 团队推出 GLM-5.1 高速版 API(GLM-5.1-highspeed),输出速度达 400 tokens/s,在完整保留旗舰模型能力的同时实现低延迟。
推荐理由
智谱通过底层推理引擎重构将旗舰模型输出速度提升至400 tokens/s,为高频交互与长程编码场景提供了极低延迟的落地路径。
来源:智谱 公众号 · mp.weixin.qq.com