跳到正文

智谱 GLM

智谱的 GLM 系列模型动态:旗舰开源发布、代码与推理能力迭代、商业化与生态进展的追踪。

最新精选

第 1–20 条 · 共 20 条
今天10月6日周二
  1. AWS 机器学习69

    智谱 GLM 5.3 正式上线 Amazon Bedrock

    智谱 AI 旗下的 753B MoE 模型 GLM 5.3 正式上线 Amazon Bedrock,面向符合条件的企业客户开放全托管 API 调用。该模型针对编码与长周期智能体任务优化,并在网络安全测试中表现突出。Bedrock 支持跨区域推理、隐式及显式提示词缓存(单断点需满 1,024 tokens),并兼容 OpenAI 格式与 Bedrock 原生 API 接口。

    推荐理由:文章详细介绍了该模型在 Bedrock 上的托管调用方式与显式提示词缓存机制,读者可以据此评估长上下文智能体任务的工程接入方案。

10月3日周六
  1. Hacker News · AI67

    Anthropic 报告称智谱 GLM-5.3 存在安全防护漏洞且可被用于网络攻击

    Anthropic 发布前沿红队测试报告,称智谱 AI 的 GLM-5.3 模型具备 Mythos 级别的黑客攻击能力且安全防护薄弱,可通过多种方式绕过防护用于生成恶意内容及网络攻击。该报告发布之际正值业界呼吁放缓 AI 发展并加强监管治理,而 Anthropic 自身在发出相关风险警告数天后推出了 Claude Opus 5.5 与 Claude Sonnet 5.5。

    推荐理由:报告披露了前沿红队测试对开源权重模型安全边界的评估细节,读者可据此了解前沿模型在网络安全风险上的争议与监管动态。

9月30日周三
  1. The Decoder75

    Anthropic 称智谱开源模型 GLM-5.3 漏洞利用构建能力接近 Claude Mythos Preview

    Anthropic 评测显示,智谱开源模型 GLM-5.3 在网络漏洞利用能力上已接近 Claude Mythos Preview,在 ExploitBench 测试中 410 次尝试成功构建 50 次可用漏洞利用,Mythos Preview 为 56 次。

    推荐理由:通过具体的漏洞挖掘基准测试数据,展现了开源大模型在网络安全攻防能力上快速逼近专有模型的现状。

  2. 量子位75

    Anthropic 发文警告智谱 GLM-5.3 网络攻击能力强且开源护栏易绕过

    Anthropic 发布安全研究报告,警告智谱开源模型 GLM-5.3 具备端到端网络漏洞挖掘与利用能力,且开源权重使其安全护栏容易被绕过或修改移除。测试显示 GLM-5.3 在 ExploitBench 上的漏洞利用表现接近闭源的 Claude Mythos Preview,并能以极低 API 成本构建漏洞攻击链。

    推荐理由:文章梳理了 Anthropic 对开源模型网络安全能力的实测警告,呈现了模型能力扩散与开源安全治理之间的核心争议。

  3. IT之家 · AI 筛选76

    中国开源大模型接入 OpenAI 企业通道,Kimi K3 与 GLM 5.3 支持通过 Codex 调用

    OpenAI 与 AI 基础设施公司 Baseten 达成合作,企业用户可通过 Codex 或 Responses API 调用月之暗面 Kimi K3 和智谱 GLM 5.3 等开源模型。Baseten 承诺相关模型均部署在美国服务器并实行提示词零数据保留(ZDR)。其中 Kimi K3 具备原生视觉能力并拥有 100 万 Token 上下文窗口,适用于长时间编程与多文档分析。

    推荐理由:该合作使企业用户能在现有企业结算通道内直接调用第三方开源模型,降低了跨生态采购与合规部署的门槛。

  4. Hacker News · AI68

    CAISI 评估智谱 Z.ai GLM-5.3 网络安全与攻防能力

    CAISI 发布针对智谱(Z.ai)开源权重模型 GLM-5.3 的网络安全能力评估,指出其为迄今网络能力最强的开源权重模型,但综合表现仍落后美国前沿模型约 4 个月。

    推荐理由:原文给出了该开源模型在漏洞挖掘与利用基准上的实测数据和差距对比,读者可以据此评估开源模型在网络安全攻防领域的真实能力边界。

  5. vLLM 官方博客(网页)73

    vLLM 在 24 张 NVIDIA B300 上部署优化 GLM-5.2:TPOT 从 40ms 降至 17ms

    DaoCloud 团队在 vLLM 官方博客分享了在 24 块 NVIDIA B300 GPU 上部署 GLM-5.2-NVFP4 的生产级优化实践,采用 4P1D 的 P/D 分离拓扑将平均 TPOT 从 40ms 降至 17ms,达成 TTFT ≤ 2.5s 与 TPOT ≤ 20ms 的 SLA 目标。

    推荐理由:文章详细拆解了超大 MoE 模型在长上下文与投机解码下的端到端调优路径,给出了完整的部署配置与长周期排障经验。

  6. vLLM 官方博客(网页)72

    vLLM 引入 Hybrid HiSparse 混合稀疏卸载优化,支持 GLM 5.3 单机长上下文高并发推理

    vLLM 针对 GLM 5.3 推出 Hybrid HiSparse 混合稀疏卸载优化机制,使单个 8× H200 节点即可运行 100 万全长上下文并显著提升并发能力。

    推荐理由:文章给出了混合稀疏卸载机制在单节点上的显存管理设计,为长上下文大模型推理的高并发部署提供了实用方案。

  7. Simon Willison67

    Anthropic 红队评测显示 GLM-5.3 与 Claude Mythos 具备二进制漏洞利用能力

    Anthropic 前沿红队在内部二进制漏洞利用基准的 100 项随机任务评测中发现,Claude Mythos Preview 和 GLM-5.3 分别在 6% 和 4% 的测试中实现了完整控制流劫持。该团队指出,早期的 Claude Opus 4.6 与 GLM-5.2 在所有测试中均未成功,新一代模型已跨过具备高阶网络能力的关键门槛。

    推荐理由:材料给出了前沿模型在二进制漏洞利用评测中的量化对比,读者可以据此了解高阶网络安全能力的演进跨越。

  8. Buzzing HN · 中文精选75

    Anthropic 评测 GLM-5.3 网络漏洞利用能力与安全护栏有效性

    Anthropic 发布对智谱 GLM-5.3 的网络安全能力评估,指出该开源权重模型具备较强的端到端漏洞挖掘与利用能力,在 ExploitBench 上 410 次尝试中成功构建 50 次完整利用链。

    推荐理由:报告通过实测对比了开源权重模型在自动化漏洞利用中的攻防边界,为评估前沿模型滥用风险提供了具体基准。

9月18日周五
  1. 智谱 公众号68

    智谱上线 GLM-5.3-FlashX 模型

    智谱正式上线 GLM-5.3-FlashX 模型,生成速度最高可达 200 tokens/s。该模型基于 10 万张国产芯片提供的推理算力进行了底层 Infra 与推理优化,主打智能、价格与速度竞争力,目前 API 与体验中心已同步开放调用。

    推荐理由:原文给出了基于国产算力优化后的生成速率指标,读者可以据此评估高吞吐场景下的调用时延与可用性。

8月26日周三
  1. 智谱 公众号85

    智谱开源原生多模态模型 GLM-5.3-Flash

    智谱正式上线并开源 GLM-5 系列原生多模态模型 GLM-5.3-Flash(320B-A18B),在综合智能指数与编程评测中取得与 Claude Opus 4.8 相当的表现。

    推荐理由:该模型在综合评测中追平海外顶级旗舰,并通过混合注意力架构与国产芯片部署大幅压低了调用成本。

8月19日周三
  1. 智谱 公众号81

    智谱上线 GLM-5.3 API:综合智能指数达 60 分且权重将于下周五开源

    智谱宣布 GLM-5.3 API 正式上线,模型权重将于下周五开源,调用定价与上一代 GLM-5.2 保持一致。该模型擅长复杂编码、防御性网络安全与长程任务,在 Artificial Analysis 综合智能指数中取得 60 分,与 Kimi K3 并列开源模型第一。

    推荐理由:原文公布了评测表现、调用定价与开源时间表,开发者可以据此评估将该模型接入复杂编码或长程任务工作流的成本效益。

8月14日周五
  1. 智谱 公众号82

    智谱发布 GLM-5.3,提升编程与网络安全防御能力

    智谱正式发布新模型 GLM-5.3,在与 GLM-5.2 相同基座上通过强化学习与长程后训练扩展,显著提升了复杂编程与网络安全防御能力。该模型在 Terminal-Bench 3.0 等基准上取得开源领先,并协助安全团队挖掘出多项高危系统与底层协议漏洞;相关能力已接入 ZCode 等工具,完整模型权重计划在两周内开源。

    推荐理由:原文阐述了基于相同基座进行后训练扩展的技术路径,为开发者评估大模型在代码工程与网络安全防御中的实际可用性提供了参考。

8月11日周二
  1. 智谱 公众号70

    智谱编程工具 ZCode 升级:上线目标模式、子智能体与手机远程控制

    智谱针对 GLM 优化的编程工具 ZCode 迎来重大升级,正式上线 Goal 目标模式、Subagents 子智能体、Remote Control 远程控制与闲时任务四大功能。

    推荐理由:升级引入了目标自主交付与子智能体分工机制,展示了编程工具如何通过上下文缓存优化与远程控制提升长程任务效率。

6月17日周三
  1. 智谱 公众号83

    智谱上线并开源 GLM-5.2:支持 1M 上下文并强化长程编程能力

    智谱正式上线并开源 GLM-5.2 模型,遵循 MIT 协议,主打 1M 上下文与长程编程任务能力。在 FrontierSWE 等基准测试中其表现逼近 Claude Opus 4.8,并通过 IndexShare 架构优化将 1M 上下文下的单位 token FLOPs 降低至 2.9 倍。

    推荐理由:模型主打长程编程任务与长上下文支持,结合架构优化降低推理算力消耗,为长链路软件工程落地提供了开源参考。

6月13日周六
  1. 智谱 公众号80

    智谱宣布 GLM-5.2 全量开放并即将开源

    智谱宣布 GLM-5.2 全量开放,该模型支持 1M 上下文并主打长程任务与代码能力。GLM-5.2 将面向 GLM Coding Plan 全量用户(Lite / Pro / Max / 团队版)开放,其 API 将于下周上线,模型也将于下周遵循 MIT 协议正式开源。

    推荐理由:原文给出了上线节奏、版本开放范围和开源协议,开发者可以据此了解模型获取途径与商用支持。

5月22日周五
2月25日周三
  1. Sebastian Raschka73

    2026 年初开源大模型架构横向对比:从注意力混合机制到长上下文推理优化

    Sebastian Raschka 梳理并对比了 2026 年 1 至 2 月发布的 10 余款代表性开源大模型的网络架构与基准表现。分析指出近期开源模型普遍强化了推理计算效率设计,包括广泛采用 MLA、DeepSeek 稀疏注意力、Gated DeltaNet 等线性注意力混合机制、多 Token 预测以及滑动窗口注意力。

    推荐理由:原文横向对比了多款开源大模型的注意力机制与混合专家结构演进,读者可据此理清长上下文与推理效率优化的关键设计差异。