Qwen-Image-Edit-Plus调用ID:ali/qwen-image-edit-plus图像生成图像与设计+1图像生成图像与设计通义千问系列首个图像编辑模型,成功将Qwen-Image的文本渲染能力拓展到编辑任务上。支持精准的中英双语文字编辑、视觉外观与语义双重编辑、具备强大的跨基准性能表现。价格多项属性定价多项属性定价每张图片公开价格¥0.2/每张图片
Qwen3-Coder-480B-A35B-Instruct调用ID:ali/qwen3-coder-480b-a35b-instruct文本编程智能代理与数据多模态理解+3文本编程智能代理与数据多模态理解基于Qwen3的代码生成模型,具有强大的Coding Agent能力,代码能力达到开源模型 SOTA。价格多项属性定价多项属性定价输入≤32k¥6/M token32k~不限¥9/M token输出≤32k¥24/M token32k~不限¥36/M token
即梦3.1-文生图调用ID:bytedance/jimeng_t2i_v31图像生成图像与设计内容创作+2图像生成图像与设计内容创作即梦3.1 - 文生图模型,支持多风格(写实、二次元、艺术风等)文生图,能精准还原文字描述的细节与氛围,生成速度快,可通过关键词精细调控光影、构图,适配创意设计、场景创作等需求,助力高效产出精美图像。价格多项属性定价多项属性定价每张图片公开价格¥0.2/每张图片
I2V-01-live调用ID:minimax/i2v-01-live视频生成视频与3D+1视频生成视频与3D图生视频模型,本模型增强了对于卡通、漫画、手绘风格的表现。价格多项属性定价多项属性定价时长6秒512p¥3/次768p¥3/次1080p¥3/次
即梦3.0-图生视频-首尾帧-720P调用ID:bytedance/jimeng_i2v_first_tail_v30视频生成视频与3D内容创作+2视频生成视频与3D内容创作专注首尾帧联动的图生视频模型,可精准衔接输入的首尾帧画面风格、元素细节(如人物造型、场景光影),生成720p高清视频。能自然补全中间动态过程,避免动作断层或场景错位,适配短视频创作、动态故事板等场景,兼顾生成效率与画面质感,满足需精准控制开头结尾的轻量级动态创作需求。价格多项属性定价多项属性定价每秒公开价格¥0.23/秒
T2V-01-Director调用ID:minimax/t2v-01-director视频生成视频与3D+1视频生成视频与3D文生视频模型(导演版),支持用户输入文本描述,进行视频生成。支持插入运镜指令,更精准控制视频镜头表现。价格多项属性定价多项属性定价时长6秒512p¥3/次768p¥3/次1080p¥3/次
I2V-01-Director调用ID:minimax/i2v-01-director视频生成视频与3D+1视频生成视频与3D图生视频模型(导演版),支持用户输入文本描述,及参考图片参考,进行视频生成。支持插入运镜指令,更精准控制视频镜头表现。价格多项属性定价多项属性定价时长6秒512p¥3/次768p¥3/次1080p¥3/次
KlingV2调用ID:kling/kling-v2视频生成视频与3D内容创作图像与设计多模态理解+4视频生成视频与3D内容创作图像与设计多模态理解kling/klingv2是快手研发的文生/图生视频双模态模型,能精准还原文本描述或首帧画面细节,生成动作连贯、场景一致的动态内容。支持720P分辨率、24fps帧率,可输出写实、国漫等多风格视频,还内置基础运镜功能。适配短视频创作、动态海报等场景,兼顾生成效率与画面质感,满足轻量级动态创意需求。价格多项属性定价多项属性定价图像生成视频720p5秒¥10.00/次720p10秒¥20.00/次1080p5秒¥10.00/次1080p10秒¥20.00/次文本生成视频720p5秒¥10.00/次720p10秒¥20.00/次1080p5秒¥10.00/次1080p10秒¥20.00/次
S2V-01调用ID:minimax/s2v-01视频生成视频与3D+1视频生成视频与3D主体参考视频生成模型,支持用户上传主体图片生成视频,生成视频,高效锁定并保持人面部特征,确保生成视频中的主体形象具有高度一致性。价格多项属性定价多项属性定价时长6秒512p¥4.5/次768p¥4.5/次1080p¥4.5/次
o3调用ID:openai/o3文本编程数学与科学多模态理解文档与办公智能代理与数据+5文本编程数学与科学多模态理解文档与办公智能代理与数据o3是一款全面且强大的跨领域模型,在数学、科学、编程和视觉推理任务中树立了新标杆。它在技术写作和遵循指令方面也表现出色。可用于处理涉及文本、代码和图像分析的多步骤问题。输入¥14/M输出¥56/M上下文200K
GLM-4.5调用ID:bigmodel/glm-4.5文本编程智能代理与数据数学与科学文档与办公+4文本编程智能代理与数据数学与科学文档与办公GLM-4.5是智谱最新旗舰模型,推理、代码、智能体综合能力达到开源模型的SOTA水平,模型上下文长度可达128k。价格多项属性定价多项属性定价输入≤32k¥2/M token≤32k¥3/M token32k~不限¥4/M token输出≤2k¥8/M token2k~不限¥14/M token全部¥16/M token缓存读全部¥0.4/M token全部¥0.6/M token全部¥0.8/M token
Kimi-thinking-preview调用ID:moonshot/kimi-thinking-preview文本多模态理解数学与科学+2文本多模态理解数学与科学Kimi-thinking-preview是月之暗面提供的具有多模态推理能力和通用推理能力的多模态思考模型,它最长支持128k上下文,擅长深度推理,帮助解决更多更难的事情。输入¥200/M输出¥200/M上下文128K
Doubao-Seedance-1.0-pro调用ID:bytedance/doubao-seedance-1.0-pro视频生成视频与3D+1视频生成视频与3DSeedance 的专业版,为 5p 和 10p 分辨率的 480 秒或 1080 秒视频提供文本到视频和图像到视频支持价格多项属性定价多项属性定价输出公开价格¥15/M token
即梦3.0-图生视频-运镜-720P调用ID:bytedance/jimeng_i2v_recamera_v30视频生成视频与3D+1视频生成视频与3D即梦3.0-图生视频-运镜-720P价格多项属性定价多项属性定价每秒公开价格¥0.23/秒
即梦3.0-文生视频-1080P调用ID:bytedance/jimeng_t2v_v30_1080p视频生成视频与3D+1视频生成视频与3D即梦3.0-文生视频-1080P价格多项属性定价多项属性定价每秒公开价格¥0.5/秒
Lipsync调用ID:kling/lipsync视频生成视频与3D+1视频生成视频与3Dkling/lipsync是专注唇形同步的AI模型,主打文本或音频驱动的唇动生成。它能精准匹配语音节奏与语调变化,还原抿嘴、开合幅度等自然唇形细节,适配写实、动漫等多风格人物。 适用于虚拟人直播、短视频配音、动画角色配音等场景,支持主流分辨率,生成流畅无卡顿,可快速实现唇形与声音的精准同步,大幅降低唇形匹配的制作成本与门槛。 调用结果:就用你那个价格多项属性定价多项属性定价lipsync720p5秒¥0.50/次1080p5秒¥0.50/次
即梦3.0Pro-视频调用ID:bytedance/jimeng_ti2v_v30_pro视频生成视频与3D+1视频生成视频与3D即梦3.0Pro-视频生成,支持文生视频和首帧图生视频价格多项属性定价多项属性定价每秒公开价格¥1/秒
GLM-4.5 Thinking调用ID:bigmodel/glm-4.5:thinking文本编程数学与科学智能代理与数据+3文本编程数学与科学智能代理与数据GLM-4.5是智谱最新旗舰模型,推理、代码、智能体综合能力达到开源模型的SOTA水平,模型上下文长度可达128k。价格多项属性定价多项属性定价输入≤32k¥2/M token≤32k¥3/M token32k~不限¥4/M token输出≤2k¥8/M token2k~不限¥14/M token全部¥16/M token缓存读全部¥0.4/M token全部¥0.6/M token全部¥0.8/M token
KlingV1.6调用ID:kling/kling-v1-6视频生成视频与3D+1视频生成视频与3Dkling/klingv1.6是快手推出的文生/图生视频双模态模型,支持720P高清输出与24fps流畅帧率。能精准捕捉文本描述或首帧画面的细节(如场景光影、人物形态),动态过渡自然无跳帧,可生成写实、国漫等多风格内容。适配短视频创作、动态海报等轻量级场景,兼顾生成效率与画面质感,有效降低动态内容制作门槛,满足日常创意表达需求。价格多项属性定价多项属性定价图像生成视频720p5秒¥2.00/次720p10秒¥4.00/次1080p5秒¥3.50/次1080p10秒¥7.00/次multi-img2video720p5秒¥2.00/次720p10秒¥4.00/次1080p5秒¥3.50/次1080p10秒¥7.00/次文本生成视频720p5秒¥2.00/次720p10秒¥4.00/次1080p5秒¥3.50/次1080p10秒¥7.00/次
Gemini 2.5 Flash Lite调用ID:google/gemini-2.5-flash-lite文本多模态理解编程数学与科学文档与办公内容创作+5文本多模态理解编程数学与科学文档与办公内容创作Gemini 2.5 Flash-Lite 是Gemini 2.5 系列中的一个轻量级推理模型,优化了超低延迟和成本效率。与早期的 Flash 模型相比,它提供了更好的吞吐量、更快的 token 生成以及在常见基准测试中更好的性能。可通过reasoning.max_tokens开启思考并控制思维链长度。价格多项属性定价多项属性定价缓存写(5m)公开价格¥0.581/M token
即梦3.0-文生视频-720P调用ID:bytedance/jimeng_t2v_v30视频生成视频与3D+1视频生成视频与3D即梦最新发布视频3.0模型,最大特点是2个:非常强的质量遵循能力和多镜头运镜、切换能力。价格多项属性定价多项属性定价每秒公开价格¥0.23/秒