在线
10 个 AI lab · 30 个模型
Z.ai · 版本 by Z.aiPRO

GLM 5.3 Flash

Z.ai 面向代码与智能体的多模态模型,拥有 1M-token 上下文

代码智能体1M 上下文

可免费使用

中国
规格
上下文
1,000,000 tokens
输出
最高 131,072 tokens
输入
文本、图像、视频
架构
MoE,320B / 18B 激活
提供方
Z.ai(通过 OpenRouter)
使用权限
ChatPlus PRO
01 / 这个模型是什么

GLM 5.3 Flash 是 Z.ai 推出的推理型多模态模型,针对编程、长流程智能体工作和生产级负载调校。它是 GLM-5 系列首个原生多模态模型:采用 MoE 架构,拥有 320 billion 参数(18 billion 激活),上下文最高 1M tokens,并支持文本、图像和视频输入。2026 年 8 月,它曾以 Ox Alpha 的匿名身份在 OpenRouter 首发。在代码和智能体基准测试中,它可与 Claude Opus 4.8 正面较量。在 ChatPlus 上,它随 PRO 方案提供。

GLM 5.3 Flash 的故事有点特别:这款实力很强的模型最初以 Ox Alpha 这个代号匿名发布——没有实验室名称,也没有发布公告,只是出现在 OpenRouter 上,用来在正式发布前收集真实反馈。这样的“隐身”发布,通常是作者想在不放大品牌效应的情况下,在真实环境中测试模型。

社区很快开始猜测幕后团队是谁,并从 tokenizer 和它特有的错误代码判断,答案可能来自 GLM 家族。2026 年 8 月 26 日,Z.ai 证实了这一猜测:Ox Alpha 正是 GLM 5.3 Flash,也是 GLM-5 系列首个原生多模态模型。其权重已在 Hugging Face 上以 MIT 许可发布。

从任务定位看,这是一款工程向模型:代码、长流程智能体场景、最高百万 token 上下文。在编程基准上,它足以与 Claude Opus 4.8 抗衡。服务方会在其侧保留请求,因此在 ChatPlus 上,我们只在 PRO 方案提供它,并将其从自动选择中移除——这样更注重隐私。

02 / 优势

它擅长什么

01

编程

为工程任务调校:编写和修改代码,处理大型代码库。

02

长流程智能体任务

在带工具调用的多步骤场景中,从头到尾保持上下文。

03

超大上下文

最高 1M tokens——整个项目和大型文档一次放入。

04

多模态

不仅理解文本,也能把图像和视频作为请求的一部分来处理。

包含在 ChatPlus 订阅中

GLM 5.3 Flash 和所有其他模型——一个计划,一个窗口。

03 / 模型档案

它最强的地方

代码90
智能体91
推理87
上下文95
04 / 对比

GLM 5.3 Flash 对比其他模型

并排看看 GLM 5.3 Flash 与其他实验室的旗舰模型表现如何。它们都包含在一个 ChatPlus 订阅里。

ClaudeDeepSeekGPTGeminiGrokGLMKimiQwenMuseGLM 5.3 Flash
开发方AnthropicDeepSeekOpenAIGooglexAIZ.aiMoonshotAlibabaMetaZ.ai
模型Sonnet 4.6DeepSeek V4.1 ReasonerGPT-6 AstraGemini 3 ProGrok 4GLM 5Kimi K3Qwen 3.8 MaxMuse Spark 1.3GLM 5.3 Flash
上下文200K128K1M1M256K1M256K256K1M1M
可理解图片——
实时网页数据———————
开源—————
核心优势文本与代码推理电脑操作多模态时效性代码与智能体长上下文复杂任务智能体与代码代码
ChatPlus 上可用
在浏览器中使用 · 支持任意银行卡

GLM 5.3 Flash
实战表现