Loading…
Skip to main content
The new Enterprise Gateway is live. Start your free trial today.View details
Modelmesh
Core products
LoomLoomSkillApp MarketEnterprise AI GatewayAI Chat
Model Marketplace
Model CenterDeveloper Models
Cloud Factory
AI Model DeploymentCloud AI Cluster
Agent accessCommunityAbout us
DocsConsoleChinese
DocsConsoleChinese
Log in / Sign upChecking…
Activate Enterprise GatewayProDedicated high-performance resources and support
Primary account:—
Account rechargeAPI keysEarnings
Personal settings

Redeem voucher

ModelmeshModelmesh navigation
DocsConsoleChinese
Log in / Sign up
Checking…

Model Center

Explore 336 models with public pricing, capabilities, and context information. Actual pricing may vary when routed to different providers; see model details for more pricing information.

336/ 336models
Sort
Price comparison
All文本图像生成视频生成音频生成音频转录3D生成向量化重排决策
  • DeepSeek / DeepSeek-R1-0528

    API ID:deepseek/deepseek-r1-0528
    文本编程翻译编程数学与科学

    DeepSeek R1-0528是DeepSeek R1模型的小版本升级版。通过增加计算资源和引入后训练阶段的算法优化,DeepSeek R1-0528显著提升了推理与推断的深度和能力。该模型在数学、编程及一般逻辑等多项基准测试中表现优异,整体性能已接近业内领先的 O3和Gemini 2.5 Pro模型,展现出强大的多领域应用潜力。

    2025-02-20 Listed¥4/M Input¥12/M Output128K Context
  • Tencent / Hunyuan-T1-Vision

    API ID:tencent/hunyuan-t1-vision
    文本多模态理解图像与设计文档与办公对话与客服

    采用混元MOE结构,是混元最新多模态模型,支持多语种作答,中英文能力均衡。

    2025-11-06 Listed¥3/M Input¥9/M Output32K Context
  • Anthropic / Claude-3.7-sonnet(Thinking)

    API ID:anthropic/claude-3.7-sonnet:thinking
    文本编程数学与科学多模态理解编程文档与办公学术与教育

    Claude-3.7-sonnet(Thinking)是Anthropic于 2025 年推出的新一代思维型大语言模型。该模型首次融合自回归生成与符号推理架构,具备多步骤思维展示、自我纠错能力以及长达 10 万 tokens 的上下文理解能力,标志着AI从简单生成向深度逻辑推理与透明思考的跨越。

    2025-03-28 Listed
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥26.25/M token

    缓存写(1h)

    • Public price¥42/M token
  • bigmodel / GLM-4.5-Air

    API ID:bigmodel/glm-4.5-air
    文本对话与客服编程文档与办公内容创作智能代理与数据

    GLM-4.5-Air为GLM-4.5的轻量版,兼顾性能与性价比,可灵活切换混合思考模型。

    2025-07-29 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥0.8/M token
    • ≤32k¥0.8/M token
    • 32k~不限¥1.2/M token

    输出

    • ≤2k¥2/M token
    • 2k~不限¥6/M token
    • 全部¥8/M token

    缓存读

    • 全部¥0.16/M token
    • 全部¥0.16/M token
    • 全部¥0.24/M token
  • bigmodel / GLM-4.5-AirX Thinking

    API ID:bigmodel/glm-4.5-airx:thinking
    文本对话与客服编程数学与科学

    GLM-4.5-AirX为GLM-4.5-Air的极速版,响应速度更快,专为大规模高速度需求打造。

    2025-09-29 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥4/M token
    • ≤32k¥4/M token
    • 32k~不限¥8/M token

    输出

    • ≤2k¥12/M token
    • 2k~不限¥16/M token
    • 全部¥32/M token

    缓存读

    • 全部¥0.8/M token
    • 全部¥0.8/M token
    • 全部¥1.6/M token
  • Ali / Qwen3-235B-A22B-Instruct-2507

    API ID:ali/qwen3-235b-a22b-instruct-2507
    文本编程数学与科学多模态理解文档与办公翻译

    Qwen3-235B-A22B-Instruct-2507是Qwen3-235B-A22B-FP8的增强版本,在指令遵循、逻辑推理、文本理解、数学与编程能力、多语言知识覆盖等方面表现显著提升,并在256K长上下文处理和主观任务对齐度上进一步优化,生成内容更高质量、更贴近用户意图。

    2025-07-23 Listed¥2/M Input¥8/M Output128K Context
  • bigmodel / GLM-4.5-Air Thinking

    API ID:bigmodel/glm-4.5-air:thinking
    文本数学与科学编程智能代理与数据对话与客服文档与办公

    GLM-4.5-Air为GLM-4.5的轻量版,兼顾性能与性价比,可灵活切换混合思考模型。

    2025-09-29 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥0.8/M token
    • ≤32k¥0.8/M token
    • 32k~不限¥1.2/M token

    输出

    • ≤2k¥2/M token
    • 2k~不限¥6/M token
    • 全部¥8/M token

    缓存读

    • 全部¥0.16/M token
    • 全部¥0.16/M token
    • 全部¥0.24/M token
  • bigmodel / GLM-4.5-X

    API ID:bigmodel/glm-4.5-x
    文本对话与客服编程文档与办公内容创作翻译

    GLM-4.5-X为GLM-4.5的极速版,在性能强劲的同时,生成速度可达100tokens/秒。

    2025-07-29 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥8/M token
    • ≤32k¥12/M token
    • 32k~不限¥16/M token

    输出

    • ≤2k¥16/M token
    • 2k~不限¥32/M token
    • 全部¥64/M token

    缓存读

    • 全部¥1.6/M token
    • 全部¥2.4/M token
    • 全部¥3.2/M token
  • bigmodel / GLM-4.5-X Thinking

    API ID:bigmodel/glm-4.5-x:thinking
    文本对话与客服文档与办公编程内容创作学术与教育

    GLM-4.5-X为GLM-4.5的极速版,在性能强劲的同时,生成速度可达100tokens/秒。

    2025-09-29 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥8/M token
    • ≤32k¥12/M token
    • 32k~不限¥16/M token

    输出

    • ≤2k¥16/M token
    • 2k~不限¥32/M token
    • 全部¥64/M token

    缓存读

    • 全部¥1.6/M token
    • 全部¥2.4/M token
    • 全部¥3.2/M token
  • MiniMax / MiniMax-M1

    API ID:minimax/minimax-m1
    文本数学与科学编程多模态理解

    MiniMax-M1,世界上第一个开源的大规模混合架构的推理模型,适合在复杂场景中使用。

    2025-07-15 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥0.8/M token
    • 32k~128k¥1.2/M token
    • 128k~不限¥2.4/M token

    输出

    • ≤32k¥8/M token
    • 32k~128k¥16/M token
    • 128k~不限¥24/M token
  • Anthropic / Claude 3.5 Haiku

    API ID:anthropic/claude-3.5-haiku
    文本多模态理解对话与客服内容创作文档与办公编程

    Claude 3.5 Haiku是Anthropic最快且最具成本效益的下一代模型,非常适合速度和经济性重要的应用场景。

    2025-07-24 Listed
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥7/M token

    缓存写(1h)

    • Public price¥11.2/M token
  • Moonshot / Kimi-latest

    API ID:moonshot/kimi-latest
    文本多模态理解文档与办公对话与客服内容创作学术与教育

    Kimi-latest是一个最长支持128k上下文的视觉模型,支持图片理解。同时,kimi-latest 模型总是使用Kimi智能助手产品使用最新的Kimi 大模型版本,可能包含尚未稳定的特性。

    2025-07-15 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤8k¥2/M token
    • 8k~32k¥5/M token
    • 32k~不限¥10/M token

    输出

    • ≤8k¥10/M token
    • 8k~32k¥20/M token
    • 32k~不限¥30/M token
  • Ali / Qwen3-235B-A22B-Thinking-2507

    API ID:ali/qwen3-235b-a22b-thinking-2507
    文本数学与科学多模态理解内容创作学术与教育文档与办公

    基于Qwen3的思考模式开源模型,相较通义千问3-235B-A22B逻辑能力、通用能力、知识增强及创作能力均有大幅提升,适用于高难度强推理场景。

    2025-07-28 Listed¥2/M Input¥20/M Output131.1K Context
  • Vidu / Vidu1.5

    API ID:vidu/vidu1.5
    视频生成视频与3D

    vidu/vidu1.5是生数科技推出的多模态AI视频生成模型,核心突破多主体一致性难题,上传1-3张参考图即可精准控制人物、物体及场景融合,无需LoRA微调。支持文生、图生、参考生视频,输出最高1080P分辨率,30秒内即可出片。具备上下文理解能力,适配写实、动漫风格,广泛应用于影视预制作、广告创作、动漫开发等场景。

    2025-09-02 Listed
    Attribute-based pricing

    Attribute-based pricing

    图像生成视频

    • 360p4秒¥1.25/次
    • 720p4秒¥3.13/次
    • 720p8秒¥6.25/次
    • 1080p4秒¥6.25/次

    reference2video

    • 360p4秒¥2.50/次
    • 720p4秒¥6.25/次
    • 720p8秒¥12.50/次
    • 1080p4秒¥12.50/次

    首尾帧生成视频

    • 360p4秒¥1.25/次
    • 720p4秒¥3.13/次
    • 720p8秒¥6.25/次
    • 1080p4秒¥6.25/次

    文本生成视频

    • 360p4秒¥1.25/次
    • 720p4秒¥3.13/次
    • 720p8秒¥6.25/次
    • 1080p4秒¥6.25/次
  • Ali / Qwen3-VL-Embedding-8B

    API ID:ali/qwen3-vl-embedding-8b
    向量化多模态理解智能代理与数据

    Qwen3-VL-Embedding 是 Qwen3 多模态模型体系中的新一代视觉-语言嵌入模型,专为跨模态语义理解、检索与排序任务设计。该模型基于 Qwen3 系列高性能视觉语言基础模型构建,能够将文本、图像及其组合统一映射到高质量向量空间,实现精准的跨模态语义对齐。模型支持长上下文输入与高维嵌入表示,兼顾细粒度语义表达与大规模检索效率,广泛适用于多模态搜索、RAG 知识增强、内容推荐、相似度计算与智能审核等场景。继承 Qwen3 系列卓越的多语言与视觉理解能力,Qwen3-VL-Embedding 在复杂语义推理与跨语言跨模态任务中表现出色,并支持灵活的输出维度与任务指令感知能力,帮助开发者针对不同业务场景进行高效优化。

    2026-08-04 Listed
    Attribute-based pricing

    Attribute-based pricing

    图片·输入

    • Public price¥1.8/M token
  • Ali / Qwen3-VL-Reranker-8B

    API ID:ali/qwen3-vl-reranker-8b
    重排多模态理解智能代理与数据

    Qwen3-VL-Reranker 是 Qwen3 多模态重排序模型系列的最新专有模型,专为视觉-语言相关性建模与精排决策任务设计。该模型基于 Qwen3 系列高性能视觉语言密集基础模型构建,具备强大的跨模态语义对齐与细粒度理解能力,可对文本、图像及其组合进行高精度相关性打分与排序判断。模型支持长上下文输入,能够处理复杂查询、多候选内容与多轮语义条件,在多模态检索增强生成(RAG)、跨模态搜索、内容推荐与审核等场景中显著提升最终结果质量。继承 Qwen3 系列卓越的多语言与视觉推理能力,Qwen3-VL-Reranker 在跨语言与复杂语义匹配任务中表现稳定可靠,并支持指令感知与任务自适应优化,帮助开发者针对不同业务目标实现更高相关性与转化效率。

    2026-08-04 Listed
    Attribute-based pricing

    Attribute-based pricing

    图片·输入

    • Public price¥1.8/M token
  • InternLM / Intern-S2-Preview

    API ID:intern/intern-s2-preview
    文本多模态理解智能代理与数据数学与科学学术与教育

    我们最新发布的 35B-A3B 科学多模态推理模型,支持 256K 上下文窗口;通过任务 scaling 与架构优化,重点提升科学发现和通用智能体能力。

    2026-07-02 Listed¥0/M Input¥0/M Output128K Context
  • Google / Gemini 2.5 Flash Nativa Audio

    API ID:google/gemini-2.5-flash-live
    文本语音处理对话与客服多模态理解翻译

    Gemini 2.5 Flash 的原生音频模型,支持Live API格式调用。

    2025-12-17 Listed¥3.5/M Input¥14/M Output1M Context
  • InternLM / InternVL3.5

    API ID:intern/internvl3.5
    文本多模态理解

    最新的发布的通用多模态大模型系列,拥有卓越的图文推理能力。

    2026-07-07 Listed¥0/M Input¥0/M Output128K Context
  • bigmodel / GLM-4.5-AirX

    API ID:bigmodel/glm-4.5-airx
    文本对话与客服内容创作文档与办公

    GLM-4.5-AirX为GLM-4.5-Air的极速版,响应速度更快,专为大规模高速度需求打造。

    2025-07-29 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥4/M token
    • ≤32k¥4/M token
    • 32k~不限¥8/M token

    输出

    • ≤2k¥12/M token
    • 2k~不限¥16/M token
    • 全部¥32/M token

    缓存读

    • 全部¥0.8/M token
    • 全部¥0.8/M token
    • 全部¥1.6/M token
  • InternLM / Intern-S1-Pro

    API ID:intern/intern-s1-pro
    文本多模态理解智能代理与数据数学与科学学术与教育

    先进开源多模态推理模型,综合性能优秀,支持内置联网搜索能力

    2026-07-07 Listed¥0/M Input¥0/M Output128K Context
  • Ali / Qwen3-Embedding-4B

    API ID:ali/qwen3-embedding-4b
    向量化智能代理与数据

    Qwen3-Embedding-4B是通义千问团队推出的文本嵌入模型,旨在将文本转换为高质量的向量表示,广泛用于检索、分类、聚类等任务。它拥有40亿参数,支持长达32K的上下文。 该模型具备三大优势:一是支持超过100种语言的多语言能力;二是支持灵活的向量维度自定义(32至2560),便于平衡性能与成本;三是具备指令感知能力,能通过提示词适配特定任务。在权威的MTEB多语言榜单上,其8B版本更是取得了第一名的成绩,展现了卓越的性能

    2026-08-04 Listed¥0.5/M Input¥0/M Output256K Context
  • Vidu / ViduQ2-turbo

    API ID:vidu/viduq2-turbo
    视频生成视频与3D

    No model description is currently available.

    2025-10-22 Listed
    Attribute-based pricing

    Attribute-based pricing

    图像生成视频

    • 720p2秒¥0.31/次
    • 720p3秒¥0.63/次
    • 720p4秒¥0.94/次
    • 720p5秒¥1.25/次
    • 720p6秒¥1.56/次
    • 720p7秒¥1.88/次
    • 720p8秒¥2.19/次
    • 1080p2秒¥1.56/次
    • 1080p3秒¥1.88/次
    • 1080p4秒¥2.19/次
    • 1080p5秒¥2.50/次
    • 1080p6秒¥2.81/次
    • 1080p7秒¥3.13/次
    • 1080p8秒¥3.44/次

    首尾帧生成视频

    • 720p2秒¥0.31/次
    • 720p3秒¥0.63/次
    • 720p4秒¥0.94/次
    • 720p5秒¥1.25/次
    • 720p6秒¥1.56/次
    • 720p7秒¥1.88/次
    • 720p8秒¥2.19/次
    • 1080p2秒¥1.56/次
    • 1080p3秒¥1.88/次
    • 1080p4秒¥2.19/次
    • 1080p5秒¥2.50/次
    • 1080p6秒¥2.81/次
    • 1080p7秒¥3.13/次
    • 1080p8秒¥3.44/次
  • InternLM / Intern-S1

    API ID:intern/intern-s1
    文本多模态理解数学与科学学术与教育

    融合了专业科学能力的多模态大模型

    2026-07-07 Listed¥0/M Input¥0/M Output128K Context

24 / 336 models loaded

←Previous
  1. 1
  2. …
  3. 10
  4. 11
  5. 12
  6. …
  7. 14
Page 11 of 14Next→
General filters0
Use case

No matching options

Provider

No matching options

Input modality
Minimum context
General filters