Loading…
Skip to main content
The new Enterprise Gateway is live. Start your free trial today.View details
Modelmesh
Core products
LoomLoomSkillApp MarketEnterprise AI GatewayAI Chat
Model Marketplace
Model CenterDeveloper Models
Cloud Factory
AI Model DeploymentCloud AI Cluster
Agent accessCommunityAbout us
DocsConsoleChinese
DocsConsoleChinese
Log in / Sign upChecking…
Activate Enterprise GatewayProDedicated high-performance resources and support
Primary account:—
Account rechargeAPI keysEarnings
Personal settings

Redeem voucher

ModelmeshModelmesh navigation
DocsConsoleChinese
Log in / Sign up
Checking…

Model Center

Explore 337 models with public pricing, capabilities, and context information. Actual pricing may vary when routed to different providers; see model details for more pricing information.

337/ 337models
Sort
Price comparison
All文本图像生成视频生成音频生成音频转录3D生成向量化重排决策
  • Kling / KlingV2.1

    API ID:kling/kling-v2-1
    视频生成视频与3D

    Kling v2.1 是快手研发的文 / 图生视频模型,搭载 3D 时空注意力机制,能精准还原动态细节,支持 720P/1080P、24fps 输出。内置 10 + 运镜与多艺术风格,可自动补连贯动作、生成同步音效

    2025-09-01 Listed
    Attribute-based pricing

    Attribute-based pricing

    图像生成视频

    • 720p5秒¥2.00/次
    • 720p10秒¥4.00/次
    • 1080p5秒¥3.50/次
    • 1080p10秒¥7.00/次

    文本生成视频

    • 720p5秒¥2.00/次
    • 720p10秒¥4.00/次
    • 1080p5秒¥3.50/次
    • 1080p10秒¥7.00/次
  • Ali / 通义万相2.5-图像编辑-Preview

    API ID:ali/wan2.5-i2i-preview
    图像生成图像与设计

    指令编辑图片内容,轻松实现局部修改、风格变化、一致性保持等

    2025-09-28 Listed
    Attribute-based pricing

    Attribute-based pricing

    每张图片

    • Public price¥0.2/每张图片
  • Ali / 通义万相2.5-文生视频-Preview

    API ID:ali/wan2.5-t2v-preview
    视频生成视频与3D

    文字生成视频内容,丝滑动态能力,电影美学控制,精准指令遵循

    2025-09-28 Listed
    Attribute-based pricing

    Attribute-based pricing

    每秒视频

    • 1080P¥1/秒
    • 480P¥0.3/秒
    • 720P¥0.6/秒
  • Ali / 通义万相2.5-图生视频-Preview

    API ID:ali/wan2.5-i2v-preview
    视频生成视频与3D

    图片生成视频内容,稳定保持图像主体、风格和文字等细节信息

    2025-09-28 Listed
    Attribute-based pricing

    Attribute-based pricing

    每秒视频

    • 1080P¥1/秒
    • 480P¥0.3/秒
    • 720P¥0.6/秒
  • xAI / Grok 4 Fast

    API ID:x-ai/grok-4-fast
    文本多模态理解文档与办公数学与科学

    Grok 4 Fast 是 xAI 最新的多模态模型,具有 SOTA 成本效益和 2M 令牌上下文窗口。它有两种类型:非推理和推理。

    2025-09-29 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤128k¥1.4/M token
    • 128k~不限¥2.8/M token

    输出

    • ≤128k¥3.5/M token
    • 128k~不限¥7/M token

    缓存读

    • ≤128k¥0.35/M token
    • 128k~不限¥0.35/M token
  • Google / Veo3

    API ID:google/veo3
    视频生成视频与3D多模态理解内容创作

    谷歌 Veo 3 视频模型的更快、更便宜的版本,带有音频

    2025-09-01 Listed
    Attribute-based pricing

    Attribute-based pricing

    基础单价(无音频)

    • Public price¥1.4/秒

    含音频单价

    • Public price¥2.8/秒
  • ByteDance / Doubao-Seed-1.8

    API ID:bytedance/doubao-seed-1.8
    文本多模态理解智能代理与数据对话与客服

    全新面向多模态 Agent 场景定向优化模型。更强Agent能力、升级多模态理解、更灵活的上下文管理。

    2025-12-18 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥0.8/M token
    • 32k~128k¥1.2/M token
    • 128k~不限¥2.4/M token

    输出

    • ≤32k¥8/M token
    • 32k~128k¥16/M token
    • 128k~不限¥24/M token

    缓存读

    • ≤32k¥0.16/M token
    • 32k~128k¥0.16/M token
    • 128k~不限¥0.16/M token
  • Ali / Qwen3-VL-Plus

    API ID:ali/qwen3-vl-plus
    文本多模态理解图像与设计视频与3D智能代理与数据编程

    Qwen3系列视觉理解模型,实现思考模式和非思考模式的有效融合,视觉智能体能力在OS World等公开测试集上达到世界顶尖水平。此版本在视觉coding、空间感知、多模态思考等方向全面升级;视觉感知与识别能力大幅提升,支持超长视频理解。

    2025-09-24 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥1/M token
    • 32k~128k¥1.5/M token
    • 128k~256k¥3/M token

    输出

    • ≤32k¥10/M token
    • 32k~128k¥15/M token
    • 128k~256k¥30/M token

    缓存读

    • ≤32k¥0.2/M token
    • 32k~128k¥0.3/M token
    • 128k~256k¥0.6/M token

    显式缓存命中

    • ≤32k¥0.1/M token
    • 32k~256k¥0.15/M token
    • 256k~1000k¥0.3/M token

    缓存写(5m)

    • ≤32k¥1.25/M token
    • 32k~256k¥1.875/M token
    • 256k~1000k¥3.75/M token
  • Ali / Qwen3-Max

    API ID:ali/qwen3-max
    文本编程数学与科学智能代理与数据多模态理解翻译

    Qwen3-Max 是在 Qwen3 系列的基础上构建的更新版本,与 2025 年 1 月版本相比,在推理、指令遵循、多语言支持和长尾知识覆盖方面进行了重大改进。它在数学、编码、逻辑和科学任务中提供更高的准确性,更可靠地遵循复杂的中文和英文指令,减少幻觉,并为开放式问答、写作和对话提供更高质量的回答。该模型支持 100 多种语言,具有更强的翻译和常识推理能力,并针对检索增强生成 (RAG) 和工具调用进行了优化,尽管它不包括专用的“思考”模式。

    2025-09-24 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥2.5/M token
    • 32k~128k¥4/M token
    • 128k~256k¥7/M token

    输出

    • ≤32k¥10/M token
    • 32k~128k¥16/M token
    • 128k~256k¥28/M token

    缓存读

    • ≤32k¥0.5/M token
    • 32k~128k¥0.8/M token
    • 128k~256k¥1.4/M token

    i2i_search

    • Public price¥0.004/次调用

    t2i_search

    • Public price¥0.004/次调用

    web_search

    • Public price¥0.004/次调用

    显式缓存命中

    • ≤32k¥0.25/M token
    • 32k~256k¥4/M token
    • 256k~1000k¥0.7/M token

    缓存写(5m)

    • ≤32k¥3.125/M token
    • 32k~256k¥5/M token
    • 256k~1000k¥8.75/M token
  • JiMeng / 即梦4.0

    API ID:bytedance/jimeng_v40
    图像生成图像与设计多模态理解

    即梦4.0是即梦同源的图像生成能力,该能力在统一框架内集成了文生图、图像编辑及多图组合生成的功能:支持单次输入最多 10 张图像及进行复合编辑,并能通过对提示词的深度推理,智能适配最优的图像比例尺寸与生成数量,可一次性输出最多 15 张内容关联的图像。此外,模型显著提升了中文生成的准确率与内容多样性,且支持 4K 超高清输出,为专业图像创作提供了从生成到编辑的一站式解决方案。

    2025-09-23 Listed
    Attribute-based pricing

    Attribute-based pricing

    每张图片

    • Public price¥0.22/每张图片
  • Moonshot / Kimi K2.7 Code HighSpeed

    API ID:moonshot/kimi-k2.7-code-highspeed
    文本编程

    Kimi K2.7 Code HighSpeed 是 Kimi K2.7 Code 的高速版模型,与 Kimi K2.7 Code 是相同模型,但输出速度约 180 Tokens/s,短上下文场景可达 260 Token/s,带来更极致的编程体验。

    2026-07-29 Listed¥13/M Input¥54/M Output256K Context
  • xAI / Grok 4.5

    API ID:x-ai/grok-4.5
    文本编程文档与办公数学与科学

    Grok 4.5是XAI最智能的模型,具备在编程、知识工作和STEM领域的前沿性能。

    2026-07-29 Listed¥14/M Input¥42/M Output2M Context
  • Ali / Qwen3-Omni-Flash

    API ID:ali/qwen3-omni-flash
    文本对话与客服内容创作翻译编程文档与办公

    Qwen-Omni 模型能够接收文本、图片、音频、视频等多种模态的组合输入,并生成文本或语音形式的回复, 提供多种拟人音色,支持多语言和方言的语音输出,可应用于文本创作、视觉识别、语音助手等场景。

    2025-09-23 Listed¥1.8/M Input¥6.9/M Output65.5K Context
  • Ali / 通义万相2.5-文生图-Preview

    API ID:ali/wan2.5-t2i-preview
    图像生成图像与设计

    文字生成图片,写实质感细腻画面,文字内容生成,艺术风格表现

    2025-09-28 Listed
    Attribute-based pricing

    Attribute-based pricing

    每张图片

    • Public price¥0.2/每张图片
  • Kling / KlingV2.5 Turbo

    API ID:kling/kling-v2-5-turbo
    视频生成视频与3D

    No model description is currently available.

    2025-12-05 Listed
    Attribute-based pricing

    Attribute-based pricing

    图像生成视频

    • 720p5秒¥1.50/次
    • 720p10秒¥3.00/次
    • 1080p5秒¥2.50/次
    • 1080p10秒¥5.00/次

    文本生成视频

    • 720p5秒¥1.50/次
    • 720p10秒¥3.00/次
    • 1080p5秒¥2.50/次
    • 1080p10秒¥5.00/次
  • Vidu / Vidu2.0

    API ID:vidu/vidu2.0
    视频生成视频与3D

    vidu/vidu2.0 是清华与生数科技联合研发的文生视频模型,核心搭载全球首创 U-ViT 架构,10 秒内即可生成 4 秒视频,单秒成本仅 4 分钱。支持 16 秒 1080P 输出,能精准控制多主体动态一致性,内置物理引擎还原毫米级运动细节,还深度适配国风等文化元素

    2025-09-02 Listed
    Attribute-based pricing

    Attribute-based pricing

    图像生成视频

    • 720p4秒¥1.25/次
    • 720p8秒¥3.13/次
    • 1080p4秒¥3.13/次

    reference2video

    • 720p4秒¥2.50/次

    首尾帧生成视频

    • 720p4秒¥1.25/次
    • 720p8秒¥3.13/次
    • 1080p4秒¥3.13/次
  • OpenAI / GPT-5-Nano

    API ID:openai/gpt-5-nano
    文本编程对话与客服多模态理解

    GPT-5-Nano是GPT-5系列中最快速的版本,专为开发者工具、即时交互和超低延迟场景优化。尽管在复杂推理能力上略逊于更大的模型,但它保留了核心的指令跟随与安全特性。

    2025-08-15 Listed¥0.35/M Input¥2.8/M Output400K Context
  • StepFun / Step 5 Preview

    API ID:stepfun/step-5-preview
    文本多模态理解智能代理与数据文档与办公编程

    Step 5 Preview 是 StepFun 面向真实任务的新一代旗舰基模,重点覆盖编程与专业知识工作。模型原生支持文本、图片和视频输入,提供 1M tokens 上下文窗口,适合需要处理大量信息、调用工具,并持续推进到交付结果的任务。

    2026-09-24 Listed¥7/M Input¥20/M Output256K Context
  • bigmodel / GLM-4.6

    API ID:bigmodel/glm-4.6
    文本对话与客服文档与办公编程内容创作学术与教育

    GLM-4.6 是智谱最新的旗舰模型,其总参数量 355B,激活参数 32B。GLM-4.6 所有核心能力上均完成了对 GLM-4.5 的超越

    2025-10-09 Listed¥2/M Input¥8/M Output200K Context
  • Ali / Qwen-VL-OCR

    API ID:ali/qwen-vl-ocr
    文本多模态理解文档与办公图像与设计

    通义千问VL-OCR(qwen-vl-ocr),即基于Qwen-VL训练的OCR识别大模型。通过统一模型的方式聚合多种图文识别、解析、处理类任务,提供强大的图文识别能力。

    2025-11-28 Listed¥0.3/M Input¥0.5/M Output32K Context
  • DeepSeek / DeepSeek-OCR

    API ID:deepseek/deepseek-ocr
    文本图像与设计多模态理解文档与办公

    DeepSeek-OCR 是 DeepSeek AI 发布的视觉语言模型,旨在探索视觉-文本压缩边界,专注于文档识别及图像转文本场景的解决方案 。该模型可将长文本渲染为高压缩比图像,在 10 倍无损压缩下能实现 97% 的 OCR 准确率,即使压缩到 20 倍也能保持约 60% 的准确率。

    2025-11-28 Listed¥0.0001/M Input¥0/M Output0 Context
  • xAI / Grok 4

    API ID:x-ai/grok-4
    文本对话与客服内容创作文档与办公编程学术与教育

    Grok 4是xAI的多模态大型语言模型,目前支持文本模态,视觉、图像生成等功能即将推出。

    2025-07-10 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤128k¥21/M token
    • 128k~不限¥42/M token

    输出

    • ≤128k¥105/M token
    • 128k~不限¥210/M token

    缓存读

    • ≤128k¥5.25/M token
    • 128k~不限¥5.25/M token
  • Google / Gemini-2.5-flash-image

    API ID:google/gemini-2.5-flash-image
    图像生成图像与设计

    谷歌最强图像模型,nano-banana 的正式版。

    2025-10-09 Listed
    Attribute-based pricing

    Attribute-based pricing

    音频·输入

    • Public price¥7/M token

    图片·输入

    • Public price¥2.1/M token

    图片·输出

    • Public price¥210/M token

    视频·输入

    • Public price¥2.1/M token

    输入

    • Public price¥2.1/M token

    输出

    • Public price¥17.5/M token
  • Bytedance / Doubao-Seedance-1.0-lite-i2v

    API ID:bytedance/doubao-seedance-1.0-lite-i2v
    视频生成视频与3D

    Doubao-Seedance-1.0-lite-i2v,根据首帧图片、尾帧图片(可选)、参考图片(可选)和文本描述(可选)生成视频。是兼顾生成效果与速度的性价比之选。该模型语义理解与指令遵循能力强。运镜专业。支持多种视频风格,可以丝滑兼容各种风格的首图。分辨率支持480P、720P、1080P,时长支持3-12s,帧率24fps

    2025-09-02 Listed
    Attribute-based pricing

    Attribute-based pricing

    输出

    • Public price¥10/M token

24 / 337 models loaded

←Previous
  1. 1
  2. …
  3. 6
  4. 7
  5. 8
  6. …
  7. 15
Page 7 of 15Next→
General filters0
Use case

No matching options

Provider

No matching options

Input modality
Minimum context
General filters