智谱上线 GLM-5.3-FlashX:推理速度最高达 200 tokens/s
智谱正式推出 GLM-5.3-FlashX 模型并开放 API 接口。该模型此前以“Ox Alpha”代号测试,在10万张国产芯片构建的推理算力基础设施上,通过底层架构与推理优化,实现了最高 200 tokens/s 的生成速度。智谱表示,GLM-5.3-FlashX 旨在兼顾智能水平、性价比与推理速度,全面提升企业及开发者的调用体验。
推荐理由智谱主力小模型推出加速版GLM-5.3-FlashX,依托10万张国产芯片算力优化推理性能,具备较强的工程落地价值。
原标题:GLM-5.3-FlashX上线:大大方方、好好用用、嗖嗖嗖嗖
阅读 智谱 公众号 原文 ↗