GLM 5.3 Flash
Z.ai 面向代码与智能体的多模态模型,拥有 1M-token 上下文
可免费使用

- 上下文
- 1,000,000 tokens
- 输出
- 最高 131,072 tokens
- 输入
- 文本、图像、视频
- 架构
- MoE,320B / 18B 激活
- 提供方
- Z.ai(通过 OpenRouter)
- 使用权限
- ChatPlus PRO
GLM 5.3 Flash 是 Z.ai 推出的推理型多模态模型,针对编程、长流程智能体工作和生产级负载调校。它是 GLM-5 系列首个原生多模态模型:采用 MoE 架构,拥有 320 billion 参数(18 billion 激活),上下文最高 1M tokens,并支持文本、图像和视频输入。2026 年 8 月,它曾以 Ox Alpha 的匿名身份在 OpenRouter 首发。在代码和智能体基准测试中,它可与 Claude Opus 4.8 正面较量。在 ChatPlus 上,它随 PRO 方案提供。
GLM 5.3 Flash 的故事有点特别:这款实力很强的模型最初以 Ox Alpha 这个代号匿名发布——没有实验室名称,也没有发布公告,只是出现在 OpenRouter 上,用来在正式发布前收集真实反馈。这样的“隐身”发布,通常是作者想在不放大品牌效应的情况下,在真实环境中测试模型。
社区很快开始猜测幕后团队是谁,并从 tokenizer 和它特有的错误代码判断,答案可能来自 GLM 家族。2026 年 8 月 26 日,Z.ai 证实了这一猜测:Ox Alpha 正是 GLM 5.3 Flash,也是 GLM-5 系列首个原生多模态模型。其权重已在 Hugging Face 上以 MIT 许可发布。
从任务定位看,这是一款工程向模型:代码、长流程智能体场景、最高百万 token 上下文。在编程基准上,它足以与 Claude Opus 4.8 抗衡。服务方会在其侧保留请求,因此在 ChatPlus 上,我们只在 PRO 方案提供它,并将其从自动选择中移除——这样更注重隐私。
它擅长什么
编程
为工程任务调校:编写和修改代码,处理大型代码库。
长流程智能体任务
在带工具调用的多步骤场景中,从头到尾保持上下文。
超大上下文
最高 1M tokens——整个项目和大型文档一次放入。
多模态
不仅理解文本,也能把图像和视频作为请求的一部分来处理。

GLM 5.3 Flash 和所有其他模型——一个计划,一个窗口。
它最强的地方
GLM 5.3 Flash 对比其他模型
并排看看 GLM 5.3 Flash 与其他实验室的旗舰模型表现如何。它们都包含在一个 ChatPlus 订阅里。
| Claude | DeepSeek | GPT | Gemini | Grok | GLM | Kimi | Qwen | Muse | GLM 5.3 Flash | |
|---|---|---|---|---|---|---|---|---|---|---|
| 开发方 | Anthropic | DeepSeek | OpenAI | xAI | Z.ai | Moonshot | Alibaba | Meta | Z.ai | |
| 模型 | Sonnet 4.6 | DeepSeek V4.1 Reasoner | GPT-6 Astra | Gemini 3 Pro | Grok 4 | GLM 5 | Kimi K3 | Qwen 3.8 Max | Muse Spark 1.3 | GLM 5.3 Flash |
| 上下文 | 200K | 128K | 1M | 1M | 256K | 1M | 256K | 256K | 1M | 1M |
| 可理解图片 | — | — | ||||||||
| 实时网页数据 | — | — | — | — | — | — | — | |||
| 开源 | — | — | — | — | — | |||||
| 核心优势 | 文本与代码 | 推理 | 电脑操作 | 多模态 | 时效性 | 代码与智能体 | 长上下文 | 复杂任务 | 智能体与代码 | 代码 |
| ChatPlus 上可用 |