Bytedance / Doubao-Seedance-1.0-lite-t2v调用ID:bytedance/doubao-seedance-1.0-lite-t2v视频生成视频与3D内容创作bytedance/doubao-seedance-1.0-lite-t2v 是字节跳动轻量级文生视频模型,支持文 / 图生视频,含专业运镜、多艺术风格,输出 480P/720P、24fps。适用于电商营销、影视预演、创意内容制作
OpenAI / GPT 5.1 Codex Mini调用ID:openai/gpt-5.1-codex-mini文本编程多模态理解智能代理与数据数学与科学(当前仅支持/v1/responses接口)GPT-5.1-Codex 的小参数快速版本。
xAI / Grok 4.6调用ID:x-ai/grok-4.6文本文档与办公编程数学与科学Grok 4.6 是 SpaceXAI 目前最先进的智能模型,在编程、知识处理以及 STEM 领域都表现出色。
Ali / Qwen3-VL-32B-Instruct调用ID:ali/qwen3-vl-32b-instruct文本多模态理解文档与办公数学与科学Qwen3-VL系列最大尺寸Dense模型的非推理版本,综合表现仅次于Qwen3-VL-235B-Instruct,文档识别和理解能力出色,空间感知与万物识别能力强,视觉2D检测/空间推理能力达到SOTA,适合通用场景下的复杂感知任务。
Google / Gemini 2.5 Flash调用ID:google/gemini-2.5-flash文本多模态理解对话与客服编程内容创作数学与科学Gemini 2.5 Flash是Google在性价比方面表现最优的模型,兼具全面能力与高效性能。作为首个具备“思维能力”的 Flash 系列模型,Gemini 2.5 Flash支持可视化的思维过程,让用户直观了解模型在生成回答时的推理路径。
Google / Gemini 2.5 Pro调用ID:google/gemini-2.5-pro文本编程多模态理解编程数学与科学学术与教育文档与办公Gemini 2.5 Pro是一款强大的推理模型,专为解决复杂问题而设计。它具备卓越的理解与分析能力,能够处理来自多种信息源的海量数据,包括文本、音频、图像、视频,甚至是完整的代码库。
Streamlake / KAT-Coder-Exp-72B-1010调用ID:streamlake/kat-coder-exp-72b-1010文本编程智能代理与数据KAT-Coder-Exp-72B 是 KAT-Coder 系列模型中的 RL 创新实验版本,在软件开发能力评测基准 SWE-Bench verified 上取得了 74.6% 的卓越性能,创下开源模型新纪录。专注于 Agentic Coding,目前仅支持 SWE-Agent 脚手架,也可进行简单对话。
Ali / 通义万相2.2-文生图-Lora调用ID:ali/wan-2.2-t2i-lora图像生成图像与设计该模型可在 3-4 秒内生成精美的电影级 200 万像素图像,它源自 Wan 2.2 模型,并运用了 pruna 包中的优化技术。
Ali / 通义万相2.2-图生视频-Fast-Lora调用ID:ali/wan-2.2-i2v-fast-lora视频生成视频与3DPrunaAI 开发的 Wan 2.2 A14B 图像转视频优化版本,速度极快且价格低廉。
Ali / 通义万相2.2-文生视频-Fast-Lora调用ID:ali/wan-2.2-t2v-fast-lora视频生成视频与3D内容创作PrunaAI 开发的 Wan 2.2 A14B 文本转视频优化版本,速度极快且价格低廉。
Ali / Qwen3-Max-Preview调用ID:ali/qwen3-max-preview文本数学与科学编程翻译学术与教育对话与客服Qwen3-Max-Preview是阿里巴巴旗下通义千问团队发布的最新旗舰大语言模型,是 Qwen3 系列中参数量最大的模型,参数规模超过1万亿。模型在推理、指令跟随、多语言支持和长尾知识覆盖等方面有重大改进,支持超过100种语言,中英文理解能力出色。在数学推理、编程和科学推理等任务中表现出色,能更可靠地遵循复杂指令,减少幻觉,生成更高质量的响应。
Ali / 通义万相2.2-数字人-S2V调用ID:ali/wan2.2-s2v视频生成视频与3Dwan2.2-s2v 是一款视频生成模型,可基于人物图片和人声音频文件,生成高质量的人物说话/唱歌/表演动态视频。
Ali / 通义万相2.2-首尾帧-Flash调用ID:ali/wan2.2-kf2v-flash视频生成视频与3D全新升级的通义万相2.2-首尾帧生视频,生成速度更快。优化视频动态稳定性与成功率,更强大的指令遵循能力,两张图片生成丝滑过度视频。
Ali / 通义万相2.2-数字人-Animate-图生动作调用ID:ali/wan2.2-animate-move视频生成视频与3D多模态理解图像与设计wan2.2-animate-move图生动作是一款角色动画生成模型,用户只需上传一张角色照片和一段参考表演视频,即可将视频中的表情和动作迁移到图片角色上,生成高保真的动画视频。
Ali / 通义万相2.2-数字人-Animate-视频换人调用ID:ali/wan2.2-animate-mix视频生成视频与3Dwan2.2-animate-mix视频换人是一款角色替换的模型产品,上传一张角色照片与一段表演视频,即可将原视频中的角色精准替换为照片中的角色,完整保留原始视频的场景、光照和色调等环境细节。
Ali / 通义万相2.2-图生视频-Flash调用ID:ali/wan2.2-i2v-flash视频生成视频与3D全新升级的通义万相2.2图生视频,生成速度更快。优化视频生成稳定性与成功率,更强大的指令遵循能力,稳定保持图片文字、人像和商品一致性,精准运镜控制。
Ali / 通义万相2.2-图生视频-Plus调用ID:ali/wan2.2-i2v-plus视频生成视频与3D全新升级的通义万相2.2图生视频,视频品质更高。优化视频生成稳定性与成功率,更强大的指令遵循能力,稳定保持图片文字、人像和商品一致性,精准运镜控制。
Ali / 通义万相2.2-文生视频-Plus调用ID:ali/wan2.2-t2v-plus视频生成视频与3D全新升级的通义万相2.2文生视频,视频品质更高。可稳定生成大幅度复杂运动,支持影视级画面表现与控制,更强大的指令遵循能力,实现物理世界还原。
bigmodel / GLM-4.6 Thinking调用ID:bigmodel/glm-4.6:thinking文本编程数学与科学学术与教育文档与办公对话与客服GLM-4.6 是智谱最新的旗舰模型,其总参数量 355B,激活参数 32B。GLM-4.6 所有核心能力上均完成了对 GLM-4.5 的超越
OpenAI / GPT-Image调用ID:openai/gpt-image-1图像生成图像与设计OpenAI最强图像生成模型,新模型能够结合世界知识,生成更加符合上下文图像,质量更高,还支持多种功能自定义。
MiniMax / MiniMax M2调用ID:minimax/minimax-m2文本编程智能代理与数据MiniMax M2,专为 Agent 和代码而生,仅 Claude Sonnet 8% 价格,2倍速度。
StepFun / Step 3.7 Flash调用ID:stepfun/step-3.7-flash文本多模态理解Step 3.7 Flash 是阶跃星辰推出的旗舰多模态推理模型,基于 198B 总参数 / 11B 激活参数的稀疏 MoE 架构,原生支持图片和视频理解,具备 256K tokens 长上下文和高速低延迟的推理能力。
JiMeng / 即梦3.0-图生视频-首帧-720P调用ID:bytedance/jimeng_i2v_first_v30视频生成视频与3D内容创作jimeng/即梦3.0-图生视频-首帧-720p是专注首帧驱动的图生视频模型,以输入首帧为基础生成动态内容,支持720p高清输出。能精准延续首帧的画面风格、元素细节(如人物肌理、场景光影),生成的视频动作自然、场景元素连贯不跳帧,适配创意短视频、动态海报等场景,兼顾生成效率与画面质感,满足轻量级动态创作需求。
OpenAI / GPT-5-Codex调用ID:openai/gpt-5-codex文本编程GPT-5-Codex 是 GPT-5 的专用版本,针对软件工程和编码工作流程进行了优化。它专为交互式开发会话和复杂工程任务的长时间独立执行而设计。该模型支持从头开始构建项目、功能开发、调试、大规模重构和代码审查。与 GPT-5 相比,Codex 更具可作性,严格遵守开发人员的指令,并生成更干净、更高质量的代码输出。