通义万相2.5-文生视频-Preview调用ID:ali/wan2.5-t2v-preview视频生成视频与3D+1视频生成视频与3D文字生成视频内容,丝滑动态能力,电影美学控制,精准指令遵循价格多项属性定价多项属性定价每秒视频1080P¥1/秒480P¥0.3/秒720P¥0.6/秒
通义万相2.5-图生视频-Preview调用ID:ali/wan2.5-i2v-preview视频生成视频与3D+1视频生成视频与3D图片生成视频内容,稳定保持图像主体、风格和文字等细节信息价格多项属性定价多项属性定价每秒视频1080P¥1/秒480P¥0.3/秒720P¥0.6/秒
Grok 4 Fast调用ID:x-ai/grok-4-fast文本多模态理解文档与办公数学与科学+3文本多模态理解文档与办公数学与科学Grok 4 Fast 是 xAI 最新的多模态模型,具有 SOTA 成本效益和 2M 令牌上下文窗口。它有两种类型:非推理和推理。价格多项属性定价多项属性定价输入≤128k¥1.4/M token128k~不限¥2.8/M token输出≤128k¥3.5/M token128k~不限¥7/M token缓存读≤128k¥0.35/M token128k~不限¥0.35/M token
GLM-4.6调用ID:bigmodel/glm-4.6文本对话与客服文档与办公编程内容创作学术与教育+5文本对话与客服文档与办公编程内容创作学术与教育GLM-4.6 是智谱最新的旗舰模型,其总参数量 355B,激活参数 32B。GLM-4.6 所有核心能力上均完成了对 GLM-4.5 的超越输入¥2/M输出¥8/M上下文200K
Gemini-2.5-flash-image调用ID:google/gemini-2.5-flash-image图像生成图像与设计+1图像生成图像与设计谷歌最强图像模型,nano-banana 的正式版。价格多项属性定价多项属性定价音频·输入公开价格¥7/M token图片·输入公开价格¥2.1/M token图片·输出公开价格¥210/M token视频·输入公开价格¥2.1/M token输入公开价格¥2.1/M token输出公开价格¥17.5/M token
KAT-Coder-Exp-72B-1010调用ID:streamlake/kat-coder-exp-72b-1010文本编程智能代理与数据+2文本编程智能代理与数据KAT-Coder-Exp-72B 是 KAT-Coder 系列模型中的 RL 创新实验版本,在软件开发能力评测基准 SWE-Bench verified 上取得了 74.6% 的卓越性能,创下开源模型新纪录。专注于 Agentic Coding,目前仅支持 SWE-Agent 脚手架,也可进行简单对话。输入¥0.0001/M输出¥0/M上下文128K
通义万相2.2-文生图-Lora调用ID:ali/wan-2.2-t2i-lora图像生成图像与设计+1图像生成图像与设计该模型可在 3-4 秒内生成精美的电影级 200 万像素图像,它源自 Wan 2.2 模型,并运用了 pruna 包中的优化技术。价格多项属性定价多项属性定价每张图片公开价格¥0.14/每张图片
通义万相2.2-图生视频-Fast-Lora调用ID:ali/wan-2.2-i2v-fast-lora视频生成视频与3D+1视频生成视频与3DPrunaAI 开发的 Wan 2.2 A14B 图像转视频优化版本,速度极快且价格低廉。价格多项属性定价多项属性定价每个视频480P¥0.35/秒720P¥0.77/秒
通义万相2.2-文生视频-Fast-Lora调用ID:ali/wan-2.2-t2v-fast-lora视频生成视频与3D内容创作+2视频生成视频与3D内容创作PrunaAI 开发的 Wan 2.2 A14B 文本转视频优化版本,速度极快且价格低廉。价格多项属性定价多项属性定价每个视频480P¥0.35/秒720P¥0.7/秒
GLM-4.6 Thinking调用ID:bigmodel/glm-4.6:thinking文本编程数学与科学学术与教育文档与办公对话与客服+5文本编程数学与科学学术与教育文档与办公对话与客服GLM-4.6 是智谱最新的旗舰模型,其总参数量 355B,激活参数 32B。GLM-4.6 所有核心能力上均完成了对 GLM-4.5 的超越价格多项属性定价多项属性定价输入≤32k¥2/M token≤32k¥3/M token32k~不限¥4/M token输出≤2k¥8/M token2k~不限¥14/M token全部¥16/M token缓存读全部¥0.4/M token全部¥0.6/M token全部¥0.8/M token
通义万相2.2-数字人-S2V调用ID:ali/wan2.2-s2v视频生成视频与3D+1视频生成视频与3Dwan2.2-s2v 是一款视频生成模型,可基于人物图片和人声音频文件,生成高质量的人物说话/唱歌/表演动态视频。价格多项属性定价多项属性定价视频480P¥0.5/次720P¥0.9/次
通义万相2.2-首尾帧-Flash调用ID:ali/wan2.2-kf2v-flash视频生成视频与3D+1视频生成视频与3D全新升级的通义万相2.2-首尾帧生视频,生成速度更快。优化视频动态稳定性与成功率,更强大的指令遵循能力,两张图片生成丝滑过度视频。价格多项属性定价多项属性定价视频480P¥0.1/次720P¥0.2/次1080P¥0.48/次
通义万相2.2-数字人-Animate-图生动作调用ID:ali/wan2.2-animate-move视频生成视频与3D多模态理解图像与设计+3视频生成视频与3D多模态理解图像与设计wan2.2-animate-move图生动作是一款角色动画生成模型,用户只需上传一张角色照片和一段参考表演视频,即可将视频中的表情和动作迁移到图片角色上,生成高保真的动画视频。价格多项属性定价多项属性定价每秒视频480P¥0.4/秒720P¥0.6/秒
通义万相2.2-数字人-Animate-视频换人调用ID:ali/wan2.2-animate-mix视频生成视频与3D+1视频生成视频与3Dwan2.2-animate-mix视频换人是一款角色替换的模型产品,上传一张角色照片与一段表演视频,即可将原视频中的角色精准替换为照片中的角色,完整保留原始视频的场景、光照和色调等环境细节。价格多项属性定价多项属性定价每秒视频480P¥0.6/秒720P¥0.9/秒
通义万相2.2-图生视频-Flash调用ID:ali/wan2.2-i2v-flash视频生成视频与3D+1视频生成视频与3D全新升级的通义万相2.2图生视频,生成速度更快。优化视频生成稳定性与成功率,更强大的指令遵循能力,稳定保持图片文字、人像和商品一致性,精准运镜控制。价格多项属性定价多项属性定价视频480P¥0.1/次720P¥0.2/次
通义万相2.2-图生视频-Plus调用ID:ali/wan2.2-i2v-plus视频生成视频与3D+1视频生成视频与3D全新升级的通义万相2.2图生视频,视频品质更高。优化视频生成稳定性与成功率,更强大的指令遵循能力,稳定保持图片文字、人像和商品一致性,精准运镜控制。价格多项属性定价多项属性定价视频480P¥0.14/次1080P¥0.7/次
通义万相2.2-文生视频-Plus调用ID:ali/wan2.2-t2v-plus视频生成视频与3D+1视频生成视频与3D全新升级的通义万相2.2文生视频,视频品质更高。可稳定生成大幅度复杂运动,支持影视级画面表现与控制,更强大的指令遵循能力,实现物理世界还原。价格多项属性定价多项属性定价视频480P¥0.14/次1080P¥0.7/次
Grok 4调用ID:x-ai/grok-4文本对话与客服内容创作文档与办公编程学术与教育+5文本对话与客服内容创作文档与办公编程学术与教育Grok 4是xAI的多模态大型语言模型,目前支持文本模态,视觉、图像生成等功能即将推出。价格多项属性定价多项属性定价输入≤128k¥21/M token128k~不限¥42/M token输出≤128k¥105/M token128k~不限¥210/M token缓存读≤128k¥5.25/M token128k~不限¥5.25/M token
GPT-5-Codex调用ID:openai/gpt-5-codex文本编程+1文本编程GPT-5-Codex 是 GPT-5 的专用版本,针对软件工程和编码工作流程进行了优化。它专为交互式开发会话和复杂工程任务的长时间独立执行而设计。该模型支持从头开始构建项目、功能开发、调试、大规模重构和代码审查。与 GPT-5 相比,Codex 更具可作性,严格遵守开发人员的指令,并生成更干净、更高质量的代码输出。输入¥8.75/M输出¥70/M上下文400K
MiniMax M2调用ID:minimax/minimax-m2文本编程智能代理与数据+2文本编程智能代理与数据MiniMax M2,专为 Agent 和代码而生,仅 Claude Sonnet 8% 价格,2倍速度。价格多项属性定价多项属性定价缓存写(5m)公开价格¥2.625/M token
Flux-kontext-pro调用ID:black-forest-labs/flux-kontext-pro图像生成图像与设计+1图像生成图像与设计最先进的基于文本的图像编辑模型,可提供高质量的输出,具有出色的及时性和一致的结果,可通过自然语言转换图像价格多项属性定价多项属性定价每张图片公开价格¥0.28/每张图片
Flux-kontext-max调用ID:black-forest-labs/flux-kontext-max图像生成图像与设计+1图像生成图像与设计一种基于文本的高级图像编辑模型,可提供最佳性能和改进的排版生成,通过自然语言提示转换图像价格多项属性定价多项属性定价每张图片公开价格¥0.56/每张图片
Grok 4.6调用ID:x-ai/grok-4.6文本文档与办公编程数学与科学+3文本文档与办公编程数学与科学Grok 4.6 是 SpaceXAI 目前最先进的智能模型,在编程、知识处理以及 STEM 领域都表现出色。价格多项属性定价多项属性定价输入≤200k¥14/M token200k~不限¥28/M token输出≤200k¥42/M token200k~不限¥84/M token显式缓存命中≤200k¥3.5/M token200k~不限¥7/M token
Qwen3-VL-32B-Instruct调用ID:ali/qwen3-vl-32b-instruct文本多模态理解文档与办公数学与科学+3文本多模态理解文档与办公数学与科学Qwen3-VL系列最大尺寸Dense模型的非推理版本,综合表现仅次于Qwen3-VL-235B-Instruct,文档识别和理解能力出色,空间感知与万物识别能力强,视觉2D检测/空间推理能力达到SOTA,适合通用场景下的复杂感知任务。输入¥2/M输出¥8/M上下文128K