GLM-5 系列首个原生多模态模型。总参 320B、激活 18B,采用稀疏注意力与线性注意力混合架构;智能强于 GLM-5.2,注意力计算与 KV 缓存较 GLM-5.3 分别降低约 3.01× 与 4.44×。支持 1M 上下文,输入文本/图像/视频/文件,思考不可关闭。
| 条件 | 计费项 | 价格 |
|---|---|---|
| 输入长度 (0, 无限] 且输出长度 (0, 无限] | 输出 | 0.0028 元 / K |
| 缓存输入 | 0.00023 元 / K | |
| 非缓存输入 | 0.0008 元 / K |
GLM-5 系列首个原生多模态模型。总参 320B、激活 18B,采用稀疏注意力与线性注意力混合架构;智能强于 GLM-5.2,注意力计算与 KV 缓存较 GLM-5.3 分别降低约 3.01× 与 4.44×。支持 1M 上下文,输入文本/图像/视频/文件,思考不可关闭。