Kimi-K3
Kimi K3 是 Kimi 迄今能力最强的旗舰模型,拥有 2.8 万亿参数,基于 KDA 混合线性注意力机制(Kimi Delta Attention)和注意力残差(Attention Residuals)技术构建,原生支持视觉理解,并拥有 100 万 token 上下文窗口。它是全球首个开源的 3 万亿级别模型,面向长程编程、知识工作和推理等前沿智能场景而设计。
DeepSeek、GLM、MiniMax、Kimi 等主流大模型兼容 Codex、Claude Code、Gemini CLI 等 AI Coding 工具
持续接入主流模型,通过统一 API 即刻调用。
Kimi K3 是 Kimi 迄今能力最强的旗舰模型,拥有 2.8 万亿参数,基于 KDA 混合线性注意力机制(Kimi Delta Attention)和注意力残差(Attention Residuals)技术构建,原生支持视觉理解,并拥有 100 万 token 上下文窗口。它是全球首个开源的 3 万亿级别模型,面向长程编程、知识工作和推理等前沿智能场景而设计。
DeepSeek-V4-Pro-0813 是DeepSeek最新一代旗舰级MoE大模型,拥有1M超长上下文和顶尖的智能体与编程能力,适合处理高复杂度任务。
在与 GLM-5.2 完全相同的基座上,依托数十倍规模的长程任务环境、更丰富多样的环境类型与超长周期的后训练,编程体感较前代提升 50%,并在 Terminal Bench 3.0 等公开基准中位列开源模型第一;同时涌现出强大的网络安全能力,在白盒代码审查、漏洞发现等任务中的表现接近 Mythos 5。
DeepSeek V4 Flash Vision Exp 是 DeepSeek 于 2026 年 8 月 21 日发布的实验性(Experimental)多模态视觉理解模型,可通过 `deepseek-v4-flash-vision-exp` 模型名在 DeepSeek API 平台调用。它在 DeepSeek V4 Flash 基础上额外接受图像输入,可用于图像描述、截图文字识别、图表分析等图文混合任务。
开源多模态 MoE,Qwen4 架构先导。125B 总参、每 token 激活 6B,另含 51B N-gram Embedding。原生 262,144 上下文,YaRN 可至 1,000,000;支持文本、图像、视频输入与深度思考。
GLM-5 系列首个原生多模态模型。总参 320B、激活 18B,采用稀疏注意力与线性注意力混合架构;智能强于 GLM-5.2,注意力计算与 KV 缓存较 GLM-5.3 分别降低约 3.01× 与 4.44×。支持 1M 上下文,输入文本/图像/视频/文件,思考不可关闭。
Hy4 Preview 是腾讯混元推出的新一代开源 MoE 旗舰生产力模型,支持 1M 超长上下文,面向智能体、代码开发、办公分析及复杂推理任务优化。
MiniMax-H3-Max:Minimax-H3极速生成版本。仅支持文生视频与图生视频(首帧 / 尾帧),不支持中间帧与多模态参考(参考图 / 参考视频 / 参考音频);分辨率 480P / 768P,不支持 2K;时长 5~15 秒。
实时接入最新国产四大模型,无速率限制生产无忧
一套接口覆盖多家模型,降低重复适配成本
无速率限制,支持从内部工具扩展到高频业务
积分周期更灵活,团队预算清晰可控
可先从轻量档位起步,业务增长后再升级
企业轻量集成 / 内部工具
企业中频业务 / SaaS 辅助功能
企业高频业务 / 多部门协同
预付资源包折扣更清晰,适合模型体验、业务验证和稳定调用。
可以抵扣开源和国内发行的主流模型,根据不同的模型,有不同的抵扣比例,详情请进入购买页面查看
可以抵扣开源和国内发行的主流模型,根据不同的模型,有不同的抵扣比例,详情请进入购买页面查看
可以抵扣开源和国内发行的主流模型,根据不同的模型,有不同的抵扣比例,详情请进入购买页面查看
聚合多类模型、兼容主流协议,并提供面向生产环境的企业级稳定服务质量。
覆盖文本、图像、语音、多模态等模型能力,业务无需为不同模型重复适配调用链路。

支持 OpenAI、Anthropic 兼容协议与原生接口调用方式,既能快速迁移已有应用,也能沉淀统一工程规范。
依托七牛云基础设施与调度能力,为企业级应用提供更可靠的调用、监控和资源保障。
聚合多厂商、多模态模型能力
一套凭证贯穿接入、鉴权与治理
从试用到生产调用保持同一链路
稳定性、可观测与资源协同支撑
基于真实业务场景,帮助你高效判断模型选型策略及接入路径,实现业务价值提升
选择分类快速找到所需文档
七牛云账号注册和基础配置指南
账号身份认证和实名验证流程
获取AI大模型推理API密钥令牌KEY的完整指南
Model Context Protocol 完整使用指南和配置说明
在控制台创建API Key的详细步骤
配置API Key的使用限额和权限控制
查看和管理AI大模型Token用量统计
AI大模型推理服务的计费预估说明
AI实时推理API的接入指南和示例代码
大批量AI推理任务的API接入说明
聊天补全接口的完整参数说明
大模型接口调用相关的常见问题解答
Model Context Protocol概念和原理介绍
快速了解七牛云 AI 推理平台的核心功能和使用方法