智谱上线 GLM-5.3-FlashX:推理速度最高达 200 tokens/s
智谱正式推出 GLM-5.3-FlashX 模型并开放 API 接口。该模型此前以“Ox Alpha”代号测试,在10万张国产芯片构建的推理算力基础设施上,通过底层架构与推理优化,实现了最高 200 tokens/s 的生成速度。智谱表示,GLM-5.3-FlashX 旨在兼顾智能水平、性价比与推理速度,全面提升企业及开发者的调用体验。
智谱正式推出 GLM-5.3-FlashX 模型并开放 API 接口。该模型此前以“Ox Alpha”代号测试,在10万张国产芯片构建的推理算力基础设施上,通过底层架构与推理优化,实现了最高 200 tokens/s 的生成速度。智谱表示,GLM-5.3-FlashX 旨在兼顾智能水平、性价比与推理速度,全面提升企业及开发者的调用体验。
MaaS平台进入爆发期
智谱 2026-08-26 22:11 北京 今天,我们上线并开源GLM-5.3-Flash (320B-A18B),这是GLM-5系列的首个 原生多模态模型 。 大家好像已经习惯将前沿智能与前沿价格绑定,并认为这是技术进步必须支付的成本。今天,GLM-5.3-Flash来了:320B总参数,能力超过GLM-5.2,在全球权威的Artificial Analysis Intelligence Index(AA综合智能指数)中取得 57分 ,进入全球前沿模型能力区间,与Anthropic最受欢迎的模型Claude Opus 4.8得分持平。在自研Z.ai Code Bench体感评估中,其 编程 表现与Claude Opus 4.8相当。 与此同时, GLM-5.3-Flash定价 为GLM-5.3的 1/10 ,限时折扣内为GLM-5.3的 1/20 ,为Opus 4.8的 1/40 。同样智力,1/40价格,前沿智能,第一次不需要省着用。 为收集广大用户的广泛、专业反馈,我们在正式发布前,以匿名模型 Ox-Alpha (中文社区称作牛来)在OpenCode和OpenRouter上进行了大规模测试。Ox-Alpha迅速成为当周最受欢迎的模型,创下双平台调用量新高。 而 这些请求流量全部由国产芯片提供算力支持。 GLM-5.3-Flash在各项基准测试和实际使用中,全面超越参数量高出一倍的GLM-5.2,定价却仅为后者的1/10。这得益于其全新模型架构。GLM-5.3-Flash的
跻身开源模型SOTA
单弦不成音,独木不成林
智谱 2026-08-11 13:52 北京 ZCode是一款针对GLM深度优化的国产Coding Harness,已成为百万开发者用GLM写代码的首选入口。今天,ZCode迎来重大升级,Goal、Subagents、Remote Control与闲时任务四大功能正式上线。 作为百万用户里程碑的特别回馈, GLM Coding Plan 全体用户 额度已 于今天13:00统一重置, 届时全员额度全部回满。 Z Co de,GLM的最佳拍档 模型决定能力上限,Harness负责上下文管理、工具调用、任务调度、缓存和结果校验,决定模型能力能发挥出多少。同一个模型放在不同的Coding Agent里,实际表现可能差很多。 在ZCode里使用GLM可以获得更好的任务表现。 智谱内部自研的Z.ai Code Bench围绕真实用户需求场景,基于Full Stack、Bug Fix、Feature Implementation等细分类别构造任务,模拟复杂的本地编程环境,通过回归测试、新功能测试、前端模拟交互、代码质量评估等维度对于模型的复杂长程编程能力进行全面评估,避免公开榜单可能存在的数据污染,力求还原用户真实体感。 在Z.ai Code Bench中,我们使用GLM-5.2,分别搭配ZCode、Claude Code进行测试。结果显示,GLM+ZCode相较于GLM+Claude Code,在任务整体通过率上高2.39%;在检查项通过率上,ZCode 低1.22% 。 ZCode的优势更
智谱 2026-06-17 09:11 北京 今天,我们上线并开源GLM-5.2。 在全球百万用户参与盲测的前端开发评估系统Code Arena上, GLM-5.2取得全球可用模型第一的表现 。 从2025初开始,我们几乎投入全部力量攻关Coding,历时大半年,细扣每一个代码环境的优化,终于迎来代码基座GLM-4.5,年底的GLM-4.7已经成为效果最好的国产Coding模型。 但代码还不是AGI,在通往AGI的路上,还有更多的高山需要翻越,迎面而来的就是长程任务。当下最需要模型突破的是完成一个极长的,跨越数天、数周乃至数月的任务执行。当一个模型不知疲倦地在写软件工程代码,本质上是在学习一名顶级软件工程师的思维方式,然后以机器的耐力将其放大。这是对一个又一个职业的重新定义。 今天GLM-5.2 专为长程任务能力而生 ,全新特色包括: Solid 1M上下文 , 稳定支撑长程任务 更强体感 , 更实用的Coding能力 极致Infra优化 , Day 0运行在国产算力平台 MIT开源协议 , 无地域限制,技术平权无国界 1M上下文与长程任务 支撑长程任务的第一步是 GLM-5.2必须实现 1M无损上下文 。此前 1M 上下文 大多数 在超过数百K过后就开始劣化,主要问题在于不同时 增强Coding Agent环境及数据的情况下 单纯扩展到1M帮助有限。为此,我们花了几个月时间扩展1M Coding Agent的训练环境,覆盖自动化研究、性能优化等多个领域,使得 GLM-5.2在1
智谱 2026-06-13 14:19 北京 在一些前沿模型突然变得不可用的时刻,我们选择相信另一条路:前沿智能不应只属于少数人,也不应被少数规则随时收回。它应该 开放、可用、可构建,并服务于每一位开发者 。 GLM-5.2 是智谱迄今能力最强的开源模型,支持真正可用的 1M 上下文 ,并在 长程任务 中继续保持领先。它也依旧是我们心中最 强的国产 Coding 模 型。 今晚 5:21, GLM-5.2 将面向 GLM Coding Plan 全量用户开放,覆盖 Lite / Pro / Max / 团队版。 GLM-5.2 API 将于下周上线,模型下周正式 开源 , 遵循 MIT 协议 。 A step closer to frontier intelligence for everyone. The future of AI is open, and it is for the people. ModelKey: GLM-5.2 跳转微信打开