GLM-5.3 与 GLM-5.3-Flash(智谱 Z.ai)

智谱(Z.ai)的 GLM-5 系列最新成果包括两个核心模型:GLM-5.3(顶级旗舰,主打 Agent 与长程任务)和 GLM-5.3-Flash(320B-A18B MoE 架构,原生多模态,AA 综合智能指数 57 分追平 Claude Opus 4.8,价格仅 Opus 4.8 的 20%)。GLM-5.3-Flash 于 2026-08-26 晚由智谱正式认领——其前身就是社区热传的「Ox Alpha 牛来模型」。本报告涵盖两个模型,方便理解智谱的完整产品布局。


一、公司速览

智谱 AI

  • 公司全称:北京智谱华章科技有限公司(Zhipu AI / Z.ai)
  • 成立时间:2019 年
  • 总部:北京
  • 官网:zhipuai.cn / z.ai
  • 海外品牌:Z.ai(面向国际市场)
  • 定位:通用人工智能公司,自研 GLM 系列大模型

核心方向

  • GLM(General Language Model) 系列自研大模型
  • GLM-5.3 + GLM-5.3-Flash 是当前主力旗舰
  • 兼容 7 大国产芯片:华为昇腾、摩尔线程、海光、寒武纪、昆仑芯、沐曦、燧原 来源
  • 海外品牌 Z.ai 提供订阅服务 + 模型 API

二、产品矩阵

模型层(GLM-5 系列)

模型发布时间定位
GLM-5.3-Flash2026-08-26 晚最新开源模型,320B-A18B MoE,原生多模态,AA 57 分追平 Opus 4.8 来源
GLM-5.32026-08顶级旗舰,同基座纯后训练,主打 Agent + 长程任务 来源
GLM-5.22026 春季上代基座
GLM-52026 早期第五代基座
GLM-4 系列2024-2025上一代系列
视觉模型持续更新多模态能力,30 万亿 token 多模态语料训练 来源

产品层

产品定位
Z.ai(智谱清言)对话产品,C 端入口
GLM Coding Plan编程订阅服务
Z.ai API模型 API,企业级调用
BigModel 开放平台智谱国内主品牌

三、GLM-5.3-Flash(最新模型,重点)

3.1 真实身份:Ox Alpha 牛来模型

GLM-5.3-Flash = 之前匿名的「Ox Alpha」(社区戏称「牛来模型」)

  • 智谱为了收集真实用户反馈,把这个模型以 Ox Alpha 匿名身份在 OpenRouter、OpenCode 上做公测 来源
  • 上线期间一举登顶并刷新 OpenRouter 双平台历史纪录来源
  • 2026-08-26 晚智谱正式认领 来源

3.2 架构:320B-A18B MoE

参数值
总参数320B
激活参数18B
架构MoE(混合专家)
原生多模态✅ 图片、视频、文件、文本

来源

3.3 关键性能

评测表现
AA 综合智能指数(Artificial Analysis)57 分来源
对标对象追平 Claude Opus 4.8来源
价格仅为 Opus 4.8 的 20%(降 97.5%) 来源
对比 DeepSeek价格约为 DeepSeek 的一半 来源

意义:智能平权——用 Opus 4.8 20% 的价格获得同等的智能水平。

3.4 「同基座纯后训练」策略

GLM-5 系列(包括 GLM-5.3 和 GLM-5.3-Flash)的核心训练哲学:

  • 不换基座,只做后训练
  • 通过数十倍长程任务环境训练
  • 智能上限大幅提升
  • 训练成本低、迭代快

来源

3.5 国产芯片推理

  • 通过架构创新大幅降低推理成本
  • 部署在10 万张国产芯片上 来源
  • 算力供应商或来自华为海光、摩尔线程来源

3.6 多模态输入支持

  • 图片
  • 视频
  • 文件
  • 文本

来源

3.7 接入案例

金山办公灵犀专业版已经首发接入 GLM-5.3-Flash 来源。


四、GLM-5.3 顶级旗舰

4.1 技术路线:同基座、纯后训练

GLM-5.3 的最大特点是不换基座,只做后训练——这和主流大厂”换基座+后训练”路线不同。

  • 优势:训练成本低、迭代快
  • 效果:通过数十倍长程任务环境、超长后训练时间,让模型智能上限大幅提升 来源

4.2 开源协议

  • MIT 许可证(宽松商用)
  • 权重在 Hugging Face 开放
  • 支持 SGLang、vLLM、KTransformers 等推理框架 来源
  • 支持商用推理部署和二次训练,无需额外授权来源

4.3 多模态预训练

最新视觉模型采用 30 万亿 token 多模态预训练语料——视觉能力不是外挂,而是在在 预训练阶段就把文本和视觉信息纳入统一模型 来源。

4.4 能力评测

基准GLM-5.2GLM-5.3备注
ExploitGym(2h)29 / 39105 / 130限时漏洞利用任务,开源 SOTA
ExploitGym(6h)—130 / 247闭源 Mythos 5: 181/247
Agents’ Last Exam (CLI)23.828.5开源第一
GDPval-AA v2(44 职业)—1,769Z.ai 评测中所有模型最高分
Terminal-Bench 2.1—88.2与闭源最前缘同水平
Terminal Bench 3.0—开源第一最新一代终端执行评测 来源

4.5 评测解读

  • ExploitGym:考察模型在安全研究场景下限时找漏洞的能力——GLM-5.3 在 6 小时预算下能完成 130/247 个任务,离闭源最强只差 50 个
  • Terminal-Bench 2.1 88.2 分:超过 GPT-5.5 的 82.7%、Claude Opus 4.7 的 69.4%,目前最强来源
  • 长程任务能力:通过”数十倍长程任务环境”后训练,越往”利用链”上游走(更复杂的任务链),GLM-5.3 越强 来源

五、商业策略

5.1 GLM Coding Plan

2026 年推出,是智谱面向开发者的编程订阅服务 来源:

  • 订阅制
  • 包含 GLM-5.3 / GLM-5.3-Flash 等旗舰模型 API 配额
  • 适合高频编码任务

5.2 海外品牌 Z.ai

  • 服务海外用户
  • 同样提供 GLM-5.3 等模型 API
  • 美元结算,对标 OpenAI、Anthropic

5.3 价格策略(GLM-5.3-Flash 定价)

GLM-5.3-Flash 的「智能平权」定价 来源:

对标对象价格对比
Claude Opus 4.8Flash 仅为其 20%(降 97.5%)
DeepSeekFlash 仅为其约一半
国产旗舰Flash 极具性价比

六、国内大模型横向对标

6.1 主流模型对比(2026 年 8 月)

模型公司上下文开源智能指数价格优势Agent
GLM-5.3-Flash智谱中长✅ MIT57(追平 Opus 4.8)极致⭐⭐⭐⭐
GLM-5.3智谱中长✅ MIT顶级中等⭐⭐⭐⭐⭐
Doubao-Seed-Evolving字节1M❌75.5(SuperCLUE)低⭐⭐⭐⭐⭐
M3MiniMax1M✅顶级中等⭐⭐⭐⭐⭐
Kimi K3月之暗面4M✅顶级较高⭐⭐⭐⭐⭐
DeepSeek V4DeepSeek1M✅ MIT顶级低⭐⭐⭐⭐⭐

6.2 GLM-5.3 系列独特卖点

  1. GLM-5.3-Flash「智能平权」:Opus 4.8 同等智能、20% 价格 来源
  2. MIT 协议最宽松:商用、二次训练、修改、分发全开
  3. 海外 Z.ai 品牌接受度高
  4. 10 万张国产芯片承载:华为海光、摩尔线程等
  5. GLM-5.3 顶级旗舰:Terminal Bench 88.2 分全球领先

七、适合什么样的使用者

推荐用 GLM-5.3-Flash 的场景

  • ✅ 极致成本成本敏感:Opus 4.8 20% 价格获得同等智能
  • ✅ 需要原生多模态:图片、视频、文件、文本
  • ✅ 海外业务:Z.ai 在国际市场接受度高
  • ✅ 需要 MIT 协议:商用最自由
  • ✅ 智能平权场景:让中小团队也能用上顶级智能
  • ✅ 金山办公类生产力集成

推荐用 GLM-5.3 的场景

  • ✅ 安全研究 / 漏洞分析:ExploitGym 表现突出
  • ✅ 终端 / 命令行 Agent:Terminal Bench 88.2 分领先
  • ✅ 需要二次训练:MIT 协议最自由
  • ✅ 国产化部署:兼容 7 大国产芯片
  • ✅ 海外业务:Z.ai 在国际市场接受度高

不太推荐用 GLM-5.3 系列的场景

  • ❌ 需要 1M 超长上下文:Doubao Evolving / Kimi K3 更适合
  • ❌ 极致顶级中文写作:MiniMax、Kimi 在中文场景可能更细腻
  • ❌ 极致顶级代码生成 + 超长上下文:和 M3、K3 互有胜负

八、常见问题

Q1:GLM-5.3 和 GLM-5.3-Flash 是什么关系?

同一系列的两款模型:

模型定位关键差异
GLM-5.3顶级旗舰主打 Agent + 长程任务,能力最强
GLM-5.3-Flash开源最新320B-A18B MoE,原生多模态,价格屠夫

两者共享 GLM-5 基座(“同基座纯后训练”策略)。

Q2:Ox Alpha 和 GLM-5.3-Flash 是什么关系?

Ox Alpha = GLM-5.3-Flash 的匿名马甲

  • Ox Alpha 是智谱在 2026 年 8 月给 GLM-5.3-Flash 起的匿名代号
  • 在 OpenRouter、OpenCode 上以匿名身份做公测
  • 社区戏称「牛来模型」
  • 2026-08-26 晚智谱正式认领 来源

Q3:GLM-5.3-Flash 真的能追平 Opus 4.8 吗?

在 AA 综合智能指数上是的:

  • GLM-5.3-Flash:57 分来源
  • Claude Opus 4.8:57 分来源
  • AA(Artificial Analysis)是国际权威的智能指数评测

但要记住:AA 57 分是综合评分,单项评测可能仍有差异。

Q4:GLM-5.3-Flash 的价格具体是多少?

公开数据:

Q5:MIT 协议意味着什么?

MIT 协议允许:

  • ✅ 商用
  • ✅ 修改
  • ✅ 分发
  • ✅ 私有使用
  • 无需开源你的衍生作品

目前国产大模型里最宽松的协议之一。

Q6:智谱和 Z.ai 是什么关系?

  • 智谱 AI(zhipuai.cn):中国主品牌
  • Z.ai:面向海外市场的品牌
  • 两者使用同一套 GLM 系列模型,API 接口略有不同

Q7:GLM-5.3 的 ExploitGym 强怎么解读?

ExploitGym 评测的是限时安全研究任务:给模型一个程序和漏洞描述,让它在限定时间内找出漏洞利用方法。GLM-5.3 在这个评测上开源第一,意味着它在自主探索+长链路推理上有独到优势。


九、延伸阅读

官方资源

Ox Alpha / GLM-5.3-Flash 相关

第三方分析


十、一句话总结

智谱 GLM-5.3-Flash 是 2026 年「智能平权」维度的标杆——Ox Alpha 牛来模型的真实身份,AA 57 分追平 Claude Opus 4.8、320B-A18B MoE、原生多模态、价格仅 Opus 4.8 的 20%、10 万张国产芯片承载。MIT 协议、7 大国产芯片兼容、海外 Z.ai 品牌接受度高。如果你的项目需要顶级智能 + 极致性价比 + 原生多模态 + 国产化部署,GLM-5.3-Flash 是当前最值得认真考虑的国产开源模型。