开源多模态 MoE,Qwen4 架构先导。125B 总参、每 token 激活 6B,另含 51B N-gram Embedding。原生 262,144 上下文,YaRN 可至 1,000,000;支持文本、图像、视频输入与深度思考。
| 条件 | 计费项 | 价格 |
|---|---|---|
| 输入长度 (0, 无限] 且输出长度 (0, 无限] | 输出 | 0.003 元 / K |
| 缓存输入 | 0.0001 元 / K | |
| 显式缓存输入 | 0.0001 元 / K | |
| 缓存创建 | 0.00125 元 / K | |
| 非缓存输入 | 0.001 元 / K |
Qwen 开源的多模态 MoE,作为即将用于 Qwen4 的模型结构先导预览。带视觉编码器的因果语言模型:125B 总参、每 token 激活 6B,另含 51B N-gram Embedding 与 4B MTP。