Bytedance / Doubao Seedream 3.0 T2I调用ID:bytedance/doubao-seedream-3.0-t2i图像生成图像与设计Seedream 3.0 是一款支持原生高分辨率的中英双语图像生成基础模型,综合能力媲美GPT-4o,处于世界第一梯队。支持原生 2K 分辨率输出;响应速度更快;小字生成更准确,文本排版效果增强;指令遵循能力强,美感&结构提升,保真度和细节表现较好。
OpenAI / GPT-5-Mini调用ID:openai/gpt-5-mini文本多模态理解对话与客服文档与办公内容创作学术与教育GPT-5-Mini是GPT-5的轻量级版本,专为高效处理日常推理任务而设计。它继承了 GPT-5的指令跟随能力和安全优化,同时具备更低的延迟和成本优势。
DeepSeek / DeepSeek V3.1调用ID:deepseek/deepseek-v3.1文本智能代理与数据多模态理解数学与科学DeepSeek V3.1是DeepSeek的新一代模型,具备混合推理(Think & Non-Think双模式),显著提升思考速度和任务处理效率,并通过后训练强化工具调用与多步骤智能体能力。
Ali / Qwen3 Next 80B A3B Instruct调用ID:ali/qwen3-next-80b-a3b-Instruct文本编程智能代理与数据对话与客服数学与科学翻译Qwen3-Next-80B-A3B-Instruct是Qwen3-Next系列中的一款指令微调对话模型,专为提供快速、稳定的响应而优化。它能够胜任复杂推理、代码生成、知识问答和多语言应用,同时在对齐与格式控制方面保持稳健。与以往的Qwen3 指令模型相比,该版本在超长输入和多轮对话场景下具备更高吞吐与更强稳定性,非常适用于RAG、工具调用以及需要一致性最终答案的智能体工作流。
Moonshot / Kimi-thinking-preview调用ID:moonshot/kimi-thinking-preview文本多模态理解数学与科学Kimi-thinking-preview是月之暗面提供的具有多模态推理能力和通用推理能力的多模态思考模型,它最长支持128k上下文,擅长深度推理,帮助解决更多更难的事情。
Minimax / S2V-01调用ID:minimax/s2v-01视频生成视频与3D主体参考视频生成模型,支持用户上传主体图片生成视频,生成视频,高效锁定并保持人面部特征,确保生成视频中的主体形象具有高度一致性。
OpenAI / o3调用ID:openai/o3文本编程数学与科学多模态理解文档与办公智能代理与数据o3是一款全面且强大的跨领域模型,在数学、科学、编程和视觉推理任务中树立了新标杆。它在技术写作和遵循指令方面也表现出色。可用于处理涉及文本、代码和图像分析的多步骤问题。
JiMeng / 即梦3.0-图生视频-首尾帧-720P调用ID:bytedance/jimeng_i2v_first_tail_v30视频生成视频与3D内容创作专注首尾帧联动的图生视频模型,可精准衔接输入的首尾帧画面风格、元素细节(如人物造型、场景光影),生成720p高清视频。能自然补全中间动态过程,避免动作断层或场景错位,适配短视频创作、动态故事板等场景,兼顾生成效率与画面质感,满足需精准控制开头结尾的轻量级动态创作需求。
Kling / KlingV2调用ID:kling/kling-v2视频生成视频与3D内容创作图像与设计多模态理解kling/klingv2是快手研发的文生/图生视频双模态模型,能精准还原文本描述或首帧画面细节,生成动作连贯、场景一致的动态内容。支持720P分辨率、24fps帧率,可输出写实、国漫等多风格视频,还内置基础运镜功能。适配短视频创作、动态海报等场景,兼顾生成效率与画面质感,满足轻量级动态创意需求。
Minimax / T2V-01-Director调用ID:minimax/t2v-01-director视频生成视频与3D文生视频模型(导演版),支持用户输入文本描述,进行视频生成。支持插入运镜指令,更精准控制视频镜头表现。
Minimax / I2V-01-Director调用ID:minimax/i2v-01-director视频生成视频与3D图生视频模型(导演版),支持用户输入文本描述,及参考图片参考,进行视频生成。支持插入运镜指令,更精准控制视频镜头表现。
Bytedance / Doubao-Seedance-1.0-pro调用ID:bytedance/doubao-seedance-1.0-pro视频生成视频与3DSeedance 的专业版,为 5p 和 10p 分辨率的 480 秒或 1080 秒视频提供文本到视频和图像到视频支持
bigmodel / GLM-4.5调用ID:bigmodel/glm-4.5文本编程智能代理与数据数学与科学文档与办公GLM-4.5是智谱最新旗舰模型,推理、代码、智能体综合能力达到开源模型的SOTA水平,模型上下文长度可达128k。
bigmodel / GLM-4.5 Thinking调用ID:bigmodel/glm-4.5:thinking文本编程数学与科学智能代理与数据GLM-4.5是智谱最新旗舰模型,推理、代码、智能体综合能力达到开源模型的SOTA水平,模型上下文长度可达128k。
Google / Gemini 2.5 Flash Lite调用ID:google/gemini-2.5-flash-lite文本多模态理解编程数学与科学文档与办公内容创作Gemini 2.5 Flash-Lite 是Gemini 2.5 系列中的一个轻量级推理模型,优化了超低延迟和成本效率。与早期的 Flash 模型相比,它提供了更好的吞吐量、更快的 token 生成以及在常见基准测试中更好的性能。可通过reasoning.max_tokens开启思考并控制思维链长度。
Kling / Lipsync调用ID:kling/lipsync视频生成视频与3Dkling/lipsync是专注唇形同步的AI模型,主打文本或音频驱动的唇动生成。它能精准匹配语音节奏与语调变化,还原抿嘴、开合幅度等自然唇形细节,适配写实、动漫等多风格人物。 适用于虚拟人直播、短视频配音、动画角色配音等场景,支持主流分辨率,生成流畅无卡顿,可快速实现唇形与声音的精准同步,大幅降低唇形匹配的制作成本与门槛。 调用结果:就用你那个
Kling / KlingV1.6调用ID:kling/kling-v1-6视频生成视频与3Dkling/klingv1.6是快手推出的文生/图生视频双模态模型,支持720P高清输出与24fps流畅帧率。能精准捕捉文本描述或首帧画面的细节(如场景光影、人物形态),动态过渡自然无跳帧,可生成写实、国漫等多风格内容。适配短视频创作、动态海报等轻量级场景,兼顾生成效率与画面质感,有效降低动态内容制作门槛,满足日常创意表达需求。
JiMeng / 即梦3.0-文生视频-720P调用ID:bytedance/jimeng_t2v_v30视频生成视频与3D即梦最新发布视频3.0模型,最大特点是2个:非常强的质量遵循能力和多镜头运镜、切换能力。