sophnet/z-ai/glm-5.3-flash

算能
文本生成编程智能体1M 上下文320B多模态模型128K输出

GLM-5.3-Flash 是 GLM-5 系列首个原生多模态模型,采用总参数 320B、激活 18B 的稀疏激活架构,支持约 1M token 上下文与文本、图片、视频等交错多模态输入,视觉能力融入代码循环,可观察界面、渲染结果并迭代。其在 AA 综合智能指数得 57 分,与 Claude Opus 4.8 持平,定价仅为 GLM-5.3 的 1/10、Opus 4.8 的 1/40,兼具前沿智能与极低成本,适合代码、Office 与专业文档等场景。

模型基本信息

输入类型:文本、图片、视频、文件
输出类型:文本
TPM:600,000
上下文长度1049K
最大输入长度:1049K
最大输出长度:128K

模型特性

工具调用
结构化输出
缓存
流式输出
深度思考

模型价格

计费项价格
输入0.4元 / M Tokens
输出1.4元 / M Tokens

调用示意

CURL
查看AppKey