新用户福利
调用即送300万全模型免费额度资源包!!
支持全系列大语言模型调用按比例抵扣,免费额度有限,先到先得!
部分模型价格不含适用税费,如当地法规要求,发票可能会加收增值税/商品及服务税(VAT/GST)
NEW ARRIVALS

一站式新模型

聚合最新模型能力,统一 API 快速接入

MiniMax-H3
上新
MiniMax-H3 是一款开源的全模态生成模型,能够同时理解并融合文本、最多9张图片、3段视频和3段音频作为输入,此外,MiniMax H3 输出视频:2K 0.80 元/秒、768P 0.50 元/秒;输入视频按输出分辨率同价计费,音频免费,图片前 5 张免费、超出部分 0.20 元/张。
视频输入(2K输出)0.8 元 / 秒
视频输入(768P输出)0.5 元 / 秒
图片输入(张)0.2 元 / 张
视频输出(2K)0.8 元 / 秒
视频输出(768P)0.5 元 / 秒
Moonshotai/Kimi-K3
上新
工具调用
深度思考
Kimi K3 是 Kimi 迄今能力最强的旗舰模型,拥有 2.8 万亿参数,基于 KDA 混合线性注意力机制(Kimi Delta Attention)和注意力残差(Attention Residuals)技术构建,原生支持视觉理解,并拥有 100 万 token 上下文窗口。它是全球首个开源的 3 万亿级别模型,面向长程编程、知识工作和推理等前沿智能场景而设计。
输出0.1 元 / K
缓存输入0.002 元 / K
非缓存输入0.02 元 / K
Deepseek-V4-Flash-20260731
热门
工具调用
深度思考
大幅提升了其 Agent 功能,基准测试得分已远超 V4-Pro-Preview。性能飞跃!原生支持 Responses API 格式,并已完全适配 Codex!
输出0.002 元 / K
缓存输入0.00002 元 / K
非缓存输入0.001 元 / K
DeepSeek-V4-Pro-202606
热门
工具调用
深度思考
【原厂版】DeepSeek V4 Pro 是 DeepSeek 推出的大规模混合专家(Mixture-of-Experts)模型,总参数量达 1.6 万亿,每次前向传播激活 490 亿参数,支持长达 100 万 token 的上下文窗口。该模型专为高级推理、编程和长程智能体工作流设计,在知识、数学和软件工程基准测试中均表现出色。它基于与 DeepSeek V4 Flash 相同的架构,引入了混合注意力系统以实现高效的长上下文处理,并支持多种推理模式,可根据任务需求在速度和深度之间取得平衡。它非常适用于全代码库分析、多步骤自动化和大规模信息综合等复杂工作负载,这些场景对能力和效率都有极高要求。
输出0.006 元 / K
缓存输入0.000025 元 / K
非缓存输入0.003 元 / K
GLM-5.2
热门
工具调用
深度思考
GLM-5.2 是面向长任务时代的旗舰模型。支持真正可用的 1M 上下文,可承载项目级工程上下文,长程任务执行更稳定、工程规范遵循更可靠,一次任务即可完成从需求到多端部署的完整开发链路。
输出0.028 元 / K
缓存输入0.002 元 / K
非缓存输入0.008 元 / K
Minimax-M3
工具调用
深度思考
MiniMax-M3 是 MiniMax 推出的多模态基础模型。它支持文本、图像和视频输入,输出文本,具备 100 万 token 的上下文窗口,适用于长周期智能体工作、编程和工具使用。该模型基于 MiniMax 稀疏注意力(MSA)构建,通过 KV 块选择替代全注意力机制,从而降低长上下文场景下每 token 的计算量——在处理 100 万 token 时,其成本约为上一代模型的 1/20,同时显著提升预填充和解码速度,并在大多数任务上保持质量。作为原生多模态模型,MiniMax-M3 在交错数据上进行训练,并借助交互式用户模拟器框架进行多轮、面向生产环境的协作调优。该模型面向持续性、多步骤任务,而非单轮执行。
输出0.0084 元 / K
缓存输入0.00042 元 / K
非缓存输入0.0021 元 / K
Kimi-K2.7-Code
工具调用
结构化输出
MoonshotAI: Kimi K2.7 Code 是 Moonshot AI(月之暗面)旗下 Kimi K2 系列专为编程打造的模型,在长文本情境下高可靠性地完成端到端编程任务。 原生多模态混合专家架构 (MoE):支持文本和图片双重输入。 全时思考模式:模型始终以“思考模式(thinking mode)”运行,并在多轮对话中保留完整的推理内容。 超长上下文窗口:具备 256K tokens 的上下文窗口,专为长周期编程、智能体任务拆解(agentic task decomposition)及多轮对话而设计。 高效参数激活:在约 1万亿(1T)的总参数量中,每次仅激活 320亿(32B)参数,兼顾强悍性能与高效响应。
输出0.027 元 / K
缓存输入0.0013 元 / K
非缓存输入0.0065 元 / K
Moonshotai/Kimi-K2.6
工具调用
深度思考
Kimi K2.6 是 Kimi 最新最智能的模型,Kimi K2.6 的通用 Agent、代码、视觉理解等综合能力得到全面提升,其中在博士级难度的完整版人类最后的考试(Humanity’s Last Exam)、在考察模型真实软件工程能力的 SWE-Bench Pro、评估 Agent 深度检索能力的 DeepSearchQA 等基准测试中均取得行业领先的成绩,同时支持文本、图片与视频输入,思考与非思考模式,对话与 Agent 任务。
输入0.0065 元 / K
输出0.027 元 / K
Baidu Search API
支持多种搜索类型和过滤条件,返回结构化的搜索结果,适用于智能问答、内容聚合、信息检索等多种应用场景
次数0.036 元 / 次
Z-AI/GLM 5
工具调用
深度思考
GLM-5 是智谱新一代的旗舰基座模型,面向 Agentic Engineering 打造,能够在复杂系统工程与长程 Agent 任务中提供可靠生产力。在 Coding 与 Agent 能力上,GLM-5 取得开源 SOTA 表现,在真实编程场景的使用体感逼近 Claude Opus 4.5,擅长复杂系统工程与长程 Agent 任务,是通用 Agent 助手的理想基座。
输入0.004 元 / K
输出0.018 元 / K
Minimax/Minimax-M2.5
工具调用
深度思考
Minimax M2.5专为Agent场景原生设计,编程与智能体性能(Coding & Agentic)直接对标Claude Opus 4.6,尤其在Excel高阶处理、PPT生成和深度调研等Office生产力场景达到行业领先水平(SOTA)。
输入0.0021 元 / K
输出0.0084 元 / K
DeepSeek-V4-Flash
热门
工具调用
高 TPS
DeepSeek V4 Flash 是 DeepSeek 推出的一款经过效率优化的混合专家(Mixture-of-Experts)模型,总参数量达 2840 亿,每次前向传播激活 130 亿参数,支持长达 100 万 token 的上下文窗口。该模型专为快速推理和高吞吐量工作负载设计,同时保持了强大的推理和编程能力。模型采用混合注意力机制以实现高效的长上下文处理,并支持可配置的推理模式。它非常适用于对响应速度和成本效益要求较高的应用场景,如编程助手、聊天系统和智能体工作流。
输入0.001 元 / K
输出0.002 元 / K
DeepSeek-V4-Pro
热门
工具调用
深度思考
DeepSeek V4 Pro 是 DeepSeek 推出的大规模混合专家(Mixture-of-Experts)模型,总参数量达 1.6 万亿,每次前向传播激活 490 亿参数,支持长达 100 万 token 的上下文窗口。该模型专为高级推理、编程和长程智能体工作流设计,在知识、数学和软件工程基准测试中均表现出色。它基于与 DeepSeek V4 Flash 相同的架构,引入了混合注意力系统以实现高效的长上下文处理,并支持多种推理模式,可根据任务需求在速度和深度之间取得平衡。它非常适用于全代码库分析、多步骤自动化和大规模信息综合等复杂工作负载,这些场景对能力和效率都有极高要求。
输入0.012 元 / K
输出0.024 元 / K
DeepSeek/DeepSeek-V3.2
工具调用
深度思考
DeepSeek 发布 V3.2 正式版,显著强化了 Agent 和推理能力,在主流测试中达到 GPT-5 水平并支持思考模式下的工具调用;同时推出的 Speciale 探索版在多项国际竞赛中取得金牌级表现。模型已全面开放使用。
批量输入0.001008 元 / K
输出0.003 元 / K
批量输出0.001512 元 / K
缓存输入0.0002 元 / K
非缓存输入0.002 元 / K
Doubao Seed 2.0 Lite
工具调用
深度思考
Doubao Seed 2.0 Lite 面向高频企业场景兼顾性能与成本的均衡型模型,综合能力超越上一代Doubao-Seed-1.8。胜任非结构化信息处理、内容创作、搜索推荐、数据分析等生产型工作,支持长上下文、多源信息融合、多步指令执行与高保真结构化输出。在保障稳定效果的同时显著优化成本。
输出0.0036 元 / K
缓存输入0.00012 元 / K
非缓存输入0.0006 元 / K
Doubao Seed 2.0 Mini
工具调用
深度思考
Doubao Seed 2.0 Mini 面向低时延、高并发与成本敏感场景,强调快速响应与灵活推理部署。模型效果与Doubao-Seed-1.6相当。支持256k上下文、4档思考长度和多模态理解,适合成本和速度优先的轻量级任务。
输出0.002 元 / K
缓存输入0.00004 元 / K
非缓存输入0.0002 元 / K
Doubao-Seed 1.6
即将退役
图像理解
工具调用
Doubao Seed 1.6全新多模态深度思考模型,同时支持auto/thinking/non-thinking三种思考模式。 non-thinking模式下,模型效果对比Doubao-1.5-pro/250115大幅提升。支持 256k 上下文窗口,输出长度支持最大 16k tokens。
输入0.0008 元 / K
输出0.002 元 / K
Doubao 1.5 Pro 32k
即将退役
工具调用
全新升级的多模态大模型,视觉理解、分类、信息抽取等能力显著提升,并重点增强了解题、视频理解等场景的任务效果。支持 128k 上下文窗口,输出长度支持最大 16K。
输入0.0008 元 / K
输出0.002 元 / K
Doubao Seed 2.0 Pro
工具调用
深度思考
Doubao Seed 2.0 Pro 旗舰级全能通用模型,面向 Agent 时代的复杂推理与长链路任务执行场景。强调多模态理解、长上下文推理、结构化生成与工具增强执行。复杂指令与多约束执行能力突出,可稳定应对多步复杂规划、复杂图文推理、视频内容理解与高难度分析等场景。
输出0.016 元 / K
缓存输入0.00064 元 / K
非缓存输入0.0032 元 / K
Doubao Seed 2.0 Code
工具调用
深度思考
Doubao Seed 2.0 Code 面向真实编程环境优化的 Coding 模型,能稳定调用 Claude Code 等常见 IDE 中的工具。模型特别优化了前端能力,在使用常见的前端框架时能有良好表现。模型支持使用 Skills,可以配合多种自定义技能使用。
输出0.016 元 / K
缓存输入0.00064 元 / K
非缓存输入0.0032 元 / K
Qwen3 Next 80B A3B Thinking
即将退役
工具调用
深度思考
通义千问3 Next 80B A3B Thinking是Qwen3 Next系列中优先进行推理的对话模型,默认输出结构化的"思考"轨迹。该模型专为复杂多步骤问题设计,涵盖数学证明、代码合成/调试、逻辑推理和智能体规划等领域,在知识处理、推理能力、编程辅助、对齐性及多语言评估方面表现卓越。相较于先前Qwen3版本,该模型着重提升了长链思维下的稳定性与推理时的高效扩展性,并通过调优实现了对复杂指令的精准遵循,同时减少重复或偏离任务的行为。
输入0.001 元 / K
输出0.01 元 / K
MiniMax M1
工具调用
深度思考
MiniMax-M1,世界上第一个开源的大规模混合架构的推理模型。M1在面向生产力的复杂场景中能力是开源模型中的最好一档,超过国内的闭源模型,接近海外的最领先模型,同时又有业内最高的性价比。M1有一个显著的优势是支持目前业内最高的100万上下文的输入,跟闭源模型里面的 Google Gemini 2.5 Pro 一样,是 DeepSeek R1 的 8 倍,以及业内最长的8万Token的推理输出。
输入0.004 元 / K
输出0.016 元 / K
Moonshotai/Kimi-K2.5
工具调用
图像理解
Kimi K2.5 是 Kimi 迄今最智能的模型,在 Agent、代码、视觉理解及一系列通用智能任务上取得开源 SoTA 表现。同时 Kimi K2.5 也是 Kimi 迄今最全能的模型,原生的多模态架构设计,同时支持视觉与文本输入、思考与非思考模式、对话与 Agent 任务。
输入0.004 元 / K
输出0.021 元 / K
Viduq3-Pro
视频生成
Vidu Q3 Pro 能够根据文字提示生成高品质的视听视频,具备先进的音效和语音同步功能,支持 1 到 16 秒的时长,最高可达 1080p 分辨率。
图/首尾帧生视频(540p)0.4375 元 / 秒
图/首尾帧生视频(720p)0.9375 元 / 秒
图/首尾帧生视频(1080p)1 元 / 秒
文生视频(540p)0.4375 元 / 秒
文生视频(720p)0.9375 元 / 秒
文生视频(1080p)1 元 / 秒
Viduq2-Pro
视频生成
Vidu Q2 Pro 能够生成专业级别的视频,具有出色的动态效果、1080p 分辨率以及增强的时序稳定性。支持以下使用场景:图生视频、首尾帧。
图/首尾帧生视频(540p)0.25 元 / 秒
图/首尾帧生视频(720p)0.46875 元 / 秒
图/首尾帧生视频(1080p)1.71875 元 / 秒
Tencent/Hy3 Preview
热门
工具调用
深度思考
Hy3预览版是腾讯推出的一款高效混合专家模型,专为智能体工作流和生产环境设计。它支持禁用、低、高三种可配置的推理级别,能够根据任务需求灵活平衡推理速度与深度,同时在多步骤的实际工作流中提供强大的代码生成能力与可靠的性能表现。
输出0.004 元 / K
缓存输入0.0004 元 / K
非缓存输入0.0012 元 / K
Qwen/Qwen3.6-27B
工具调用
深度思考
Qwen3.6 27B 是阿里巴巴 Qwen 团队于 2026 年 4 月发布的一款拥有 270 亿参数的混合多模态语言模型,具有 262144 大小的上下文窗口。
输入0.002304 元 / K
输出0.02304 元 / K
Qwen/Qwen3.7-Max
工具调用
深度思考
Qwen3.7系列中规模最大、综合能力最强的Max模型,当前开放纯文本模型能力供体验。Qwen3.7是面向智能体时代的新一代旗舰模型,核心优势在于智能体能力的广度与深度:在编程、办公与生产力、长周期自主执行方面均能出色胜任各项任务。
显式缓存输入0.0012 元 / K
输出0.036 元 / K
缓存输入0.0024 元 / K
非缓存输入0.012 元 / K
缓存创建0.015 元 / K
DeepSeek-V3
即将退役
推理速度大幅提升,位居开源模型之首,媲美顶尖闭源模型。采用负载均衡辅助策略和多标记预测训练,性能显著增强。
输入0.002 元 / K
批量输入0.001 元 / K
输出0.008 元 / K
批量输出0.004 元 / K
DeepSeek-V4-Flash-202605
热门
工具调用
深度思考
【原厂版】DeepSeek V4 Flash 是 DeepSeek 推出的一款经过效率优化的混合专家(Mixture-of-Experts)模型,总参数量达 2840 亿,每次前向传播激活 130 亿参数,支持长达 100 万 token 的上下文窗口。该模型专为快速推理和高吞吐量工作负载设计,同时保持了强大的推理和编程能力。模型采用混合注意力机制以实现高效的长上下文处理,并支持可配置的推理模式。它非常适用于对响应速度和成本效益要求较高的应用场景,如编程助手、聊天系统和智能体工作流。
输出0.002 元 / K
缓存输入0.00002 元 / K
非缓存输入0.001 元 / K
Doubao Seed 2.1 pro
工具调用
深度思考
迈向生产级智能的新一代大模型,全面升级 Coding、Agent 与多模态能力,以更强的自主规划、长链路执行和动态修复能力,胜任企业真实复杂任务。
输出0.03 元 / K
缓存输入0.0012 元 / K
非缓存输入0.006 元 / K
Doubao Seed 2.1 turbo
工具调用
深度思考
效果与成本均衡,全面升级 Coding、Agent 与多模态能力,以更强的自主规划、长链路执行和动态修复能力,胜任企业真实复杂任务。
输出0.015 元 / K
缓存输入0.0006 元 / K
非缓存输入0.003 元 / K
StepFun/Step-3.7 Flash
工具调用
图像理解
Step 3.7 Flash 作为一款支持 256K 上下文、拥有原生多模态理解与高可靠 Agent 编排能力的旗舰级 MoE 架构模型
输出0.0081 元 / K
缓存输入0.00027 元 / K
非缓存输入0.00135 元 / K
Qwen/Qwen3.8-Max
工具调用
深度思考
2.4万亿参数MoE旗舰,编程与办公能力全面跃升,可自主编程十数天交付完整项目。胜任法律、金融、设计等数百种专业任务,一次对话端到端交付生产级成果。原生视觉理解贯穿规划、执行与验证全流程,支持超长文档与长视频的深度语义解析。长程任务中自主规划与闭环迭代,持续进化。
显式缓存输入0.001 元 / K
输出0.036 元 / K
缓存输入0.0015 元 / K
非缓存输入0.012 元 / K
缓存创建0.015 元 / K
Viduq1
视频生成
Vidu Q1 是一款成本效益高的视频生成模型,专为加快生成速度并保持良好质量而优化。它非常适合快速原型制作和大量视频创作。支持以下场景使用:参考图生视频、文生视频。
图/首尾帧生视频(1080p)0.5 元 / 秒
文生视频(1080p)0.5 元 / 秒
参考主体生视频(1080p)0.5 元 / 秒
Z-AI/GLM 5.1
工具调用
深度思考
GLM-5.1 在编程能力上实现了重大飞跃,尤其在处理长周期任务方面提升显著。与以往基于分钟级交互构建的模型不同,GLM-5.1 能够独立持续处理单个任务超过 8 小时,全程自主规划、执行并自我优化,最终交付完整、工程级的结果。
输入0.006 元 / K
输出0.024 元 / K
Viduq2
视频生成
Vidu Q2在速度与质量之间实现了良好的平衡,支持从 360p 到 1080p 的多种分辨率。其还具有更稳定的运动表现和更强的场景理解能力。支持以下场景使用:参考图生视频、文生视频。
文生视频(540p)0.3125 元 / 秒
文生视频(720p)0.46875 元 / 秒
文生视频(1080p)0.625 元 / 秒
参考主体生视频(540p)0.46875 元 / 秒
参考主体生视频(720p)0.78125 元 / 秒
参考主体生视频(1080p)2.34375 元 / 秒
Viduq2-Turbo
视频生成
Vidu Q2 Turbo 在优化处理的同时实现了快速的视频生成,同时还能保持高视觉质量及动作连贯性。支持以下使用场景:图生视频、首尾帧。
图/首尾帧生视频(540p)0.1875 元 / 秒
图/首尾帧生视频(720p)0.25 元 / 秒
图/首尾帧生视频(1080p)1.09375 元 / 秒
Kling-V3
热门
视频生成
Kling-V3 是快手最新的视频生成模型,支持生成长达15秒的高清视频,具备创新的多镜头连贯生成与原生音频能力。
std x 无参考视频 x 无声0.6 元 / 秒
pro x 无参考视频 x 无声0.8 元 / 秒
std x 无参考视频 x 有声 x 未指定音色0.9 元 / 秒
pro x 无参考视频 x 有声 x 未指定音色1.2 元 / 秒
动作控制视频(std)0.9 元 / 秒
动作控制视频(pro)1.2 元 / 秒
4k x 无参考视频 x 无声3 元 / 秒
4k x 无参考视频 x 有声 x 未指定音色3 元 / 秒
文生图0.2 元 / 张
图生图0.2 元 / 张
多图生图0.2 元 / 张
Qwen3.5 397B A17B
工具调用
深度思考
Qwen3.5系列397B-A17B原生视觉语言模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。在语言理解、逻辑推理、代码生成、智能体任务、图像理解、视频理解、图形用户界面(GUI)等多种任务中,均展现出与当前顶尖前沿模型相媲美的卓越性能。具备强大的代码生成与智能体能力,对于各类智能体场景具有良好的泛化性。
输入0.0012 元 / K
输出0.0072 元 / K
Kling-Video/Kling-3.0-Turbo
热门
Kling VIDEO 3.0 Turbo是Kling 3.0家族中一个速度优化的多模态视频生成模型。它专为需要更快周转时间但又不牺牲稳定运动、快速响应、多镜头一致性和视听同步的高产量生产工作流程而构建。它支持文本到视频和图像到视频的生成,特别强调改进的唇同步质量和更高效的大规模内容创作。
720p有声视频0.8 元 / 秒
1080p有声视频1 元 / 秒
Viduq3
视频生成
Vidu Q3是生数科技于2026年1月30日发布的一款AI视频生成模型,可生成长度达16秒、1080P画质并包含音频的视频内容。
参考主体生视频(540p)0.21875 元 / 秒
参考主体生视频(720p)0.375 元 / 秒
参考主体生视频(1080p)0.46875 元 / 秒
Qwen/Qwen3.6-Plus
工具调用
深度思考
Qwen 3.6 Plus 是 Qwen Plus 系列的下一代演进版本,采用了先进的混合架构,在效率与可扩展性上均有提升。与 3.5 系列相比,它具有更强的推理能力和更可靠的智能体行为表现。在基准测试中,其性能达到或超越当前领先的业界顶尖模型。作为旗舰级预览版本,它在智能体编程、前端开发及复杂问题求解方面表现尤为出色。 注:该模型会收集提示词与生成结果数据,用于模型的改进。
显式缓存输入0.0002 元 / K
输出0.012 元 / K
缓存输入0.0004 元 / K
非缓存输入0.002 元 / K
缓存创建0.0025 元 / K
Qwen/Qwen3.5-Plus
热门
工具调用
图像理解
Qwen3.5原生视觉语言系列Plus模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。在多项任务评测中,3.5系列均展现出与当前顶尖前沿模型相媲美的卓越性能,模型效果在纯文本与多模态方面相较3系列均实现飞跃式进步。
显式缓存输入0.00008 元 / K
输出0.0048 元 / K
缓存输入0.00016 元 / K
非缓存输入0.0008 元 / K
缓存创建0.001 元 / K
Kling-Image O1
使用强参照控制进行精确的图像编辑,在转换主题、风格和局部细节的同时保持视觉一致性。
Omni生图0.2 元 / 张
Kling-V2 6
视频生成
可灵视频 2.6支持「动作控制」与「音画同出」。 这是可灵首个支持音画同步生成的视频模型,不仅能一键产出匹配语音、音效(对话/唱歌/Rap)的沉浸式视频,更支持强大的动作捕捉能力,可通过参考视频精准复刻人物肢体动作与微表情,实现对视频“视、听、动”的精准掌控。
std x 无参考视频 x 无声0.5 元 / 秒
pro x 无参考视频 x 无声0.5 元 / 秒
std x 无参考视频 x 有声 x 未指定音色1 元 / 秒
std x 无参考视频 x 有声 x 指定音色1.2 元 / 秒
pro x 无参考视频 x 有声 x 未指定音色1 元 / 秒
pro x 无参考视频 x 有声 x 指定音色1.2 元 / 秒
动作控制视频(std)0.5 元 / 秒
动作控制视频(pro)0.8 元 / 秒
Kling-V2 5 Turbo
视频生成
可灵2.5 Turbo是可灵团队推出的AI视频生成模型,在多个方面实现了显著的升级和优化。性能提升是其核心亮点之一。模型能更好地理解复杂的因果关系和时间序列指令,生成的视频动作更加流畅自然,运镜更加稳定。在风格保持上也表现出色,无论是色彩、光影还是笔触质感,能在视频生成过程中保持高度一致性。成本降低也是2.5 Turbo的一大优势,使更多用户能以更低的成本体验到高质量的AI视频生成服务。在与顶级CG作品的对比中,可灵2.5 Turbo在某些场景下已经能达到接近甚至超越CG的水平,尤其是在动态预览方面,为CG制作提供了更高效、更快速的解决方案。
std x 无参考视频 x 无声0.3 元 / 秒
pro x 无参考视频 x 无声0.5 元 / 秒
Kling-Video O1
视频生成
可灵O1(可灵视频 O1 模型)是可灵AI推出的全球首个统一多模态视频生成模型。模型通过创新的多模态视觉语言(MVL)架构,实现视频生成、编辑与理解的无缝融合。模型支持多模态输入,如图片、视频和文字,能进行全能创作编辑,解决视频一致性难题,提供多种创意组合。用户可通过简单对话生成精准视频内容,探索无限创作可能。
std x 无参考视频 x 无声0.6 元 / 秒
std x 有参考视频 x 无声0.9 元 / 秒
pro x 无参考视频 x 无声0.8 元 / 秒
pro x 有参考视频 x 无声1.2 元 / 秒
Kling-v2-1
生图
视频生成
由快手大模型团队自研打造的文生图大模型,支持 1:1,16:9,4:3,3:2,2:3,3:4,9:16,21:9 比例的图片生成。
std x 无参考视频 x 无声0.4 元 / 秒
pro x 无参考视频 x 无声0.7 元 / 秒
文生图0.1 元 / 张
多图生图0.4 元 / 张
Kling-V2
生图
由快手大模型团队自研打造的一款图片生成大模型,支持文生图、图生图-多图参考、图生图-风格转绘等类型的图片生成任务。
文生图0.1 元 / 张
图生图0.1 元 / 张
多图生图0.2 元 / 张
Kling-V1-5
生图
由快手大模型团队自研打造的一款图片生成大模型,支持文生图、图生图-角色特征、图生图-人物长相等类型的图片生成任务。
文生图0.025 元 / 张
图生图0.025 元 / 张
Kling-V2-New
生图
由快手大模型团队自研打造的图生图风格转绘大模型,生成图片分辨率与入参图相同,不支持单独设置分辨率。
文生图0.1 元 / 张
图生图0.1 元 / 张
Kling-V1
生图
由快手大模型团队自研打造的一款图片生成大模型,支持文生图、图生图-通用垫图等类型的图片生成任务。
文生图0.025 元 / 张
图生图0.025 元 / 张
Minimax/Minimax-M2.7
工具调用
深度思考
MiniMax-M2.7 是一款面向自主化、真实生产力与持续进化的下一代大语言模型。该模型深度参与自身演化进程,通过多智能体协同整合先进的智能体能力,能够在动态环境中完成复杂任务的规划、执行与优化。
输入0.0021 元 / K
输出0.0084 元 / K
Minimax/Minimax-M2.5 Highspeed
工具调用
深度思考
Minimax M2.5 高 TPS 版本。
输入0.0042 元 / K
输出0.0168 元 / K
Viduq3-Turbo
视频生成
Vidu Q3 Turbo 能够以优化的处理速度从文本生成快速的音频视频内容,支持 1 到 16 秒的时长,最高可达 1080p 分辨率。
图/首尾帧生视频(540p)0.25 元 / 秒
图/首尾帧生视频(720p)0.375 元 / 秒
图/首尾帧生视频(1080p)0.5 元 / 秒
文生视频(540p)0.25 元 / 秒
文生视频(720p)0.375 元 / 秒
文生视频(1080p)0.5 元 / 秒
参考主体生视频(540p)0.125 元 / 秒
参考主体生视频(720p)0.3125 元 / 秒
参考主体生视频(1080p)0.40625 元 / 秒
Kling-V3 Omni
热门
视频生成
Kling-V3-Omni 是全能多模态版本,将文/图生视频、视频编辑以及基于多参考图的角色和风格一致性控制,完美统一在了单一模型中。
std x 无参考视频 x 无声0.6 元 / 秒
std x 有参考视频 x 无声0.9 元 / 秒
pro x 无参考视频 x 无声0.8 元 / 秒
pro x 有参考视频 x 无声1.2 元 / 秒
std x 无参考视频 x 有声 x 未指定音色0.8 元 / 秒
pro x 无参考视频 x 有声 x 未指定音色1 元 / 秒
4k x 无参考视频 x 无声3 元 / 秒
4k x 无参考视频 x 有声 x 未指定音色3 元 / 秒
智能助手



电话