Loading…
Skip to main content
The new Enterprise Gateway is live. Start your free trial today.View details
Modelmesh
Core products
LoomLoomSkillApp MarketEnterprise AI GatewayAI Chat
Model Marketplace
Model CenterDeveloper Models
Cloud Factory
AI Model DeploymentCloud AI Cluster
Agent accessCommunityAbout us
DocsConsoleChinese
DocsConsoleChinese
Log in / Sign upChecking…
Activate Enterprise GatewayProDedicated high-performance resources and support
Primary account:—
Account rechargeAPI keysEarnings
Personal settings

Redeem voucher

ModelmeshModelmesh navigation
DocsConsoleChinese
Log in / Sign up
Checking…

Model Center

Explore 335 models with public pricing, capabilities, and context information. Actual pricing may vary when routed to different providers; see model details for more pricing information.

335/ 335models
Sort
Price comparison
All文本图像生成视频生成音频生成音频转录3D生成向量化重排决策
  • Hunyuan-T1-Vision

    API ID:tencent/hunyuan-t1-vision
    文本多模态理解图像与设计文档与办公对话与客服
    +4
    文本多模态理解图像与设计文档与办公对话与客服

    采用混元MOE结构,是混元最新多模态模型,支持多语种作答,中英文能力均衡。

    Input
    ¥3/M
    Output
    ¥9/M
    Context
    32K
    2025-11-06 Listed
  • Claude-3.7-sonnet(Thinking)

    API ID:anthropic/claude-3.7-sonnet:thinking
    文本编程数学与科学多模态理解编程文档与办公学术与教育
    +6
    文本编程数学与科学多模态理解编程文档与办公学术与教育

    Claude-3.7-sonnet(Thinking)是Anthropic于 2025 年推出的新一代思维型大语言模型。该模型首次融合自回归生成与符号推理架构,具备多步骤思维展示、自我纠错能力以及长达 10 万 tokens 的上下文理解能力,标志着AI从简单生成向深度逻辑推理与透明思考的跨越。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥26.25/M token

    缓存写(1h)

    • Public price¥42/M token
    2025-03-28 Listed
  • DeepSeek-R1-0528

    API ID:deepseek/deepseek-r1-0528
    文本编程翻译编程数学与科学
    +4
    文本编程翻译编程数学与科学

    DeepSeek R1-0528是DeepSeek R1模型的小版本升级版。通过增加计算资源和引入后训练阶段的算法优化,DeepSeek R1-0528显著提升了推理与推断的深度和能力。该模型在数学、编程及一般逻辑等多项基准测试中表现优异,整体性能已接近业内领先的 O3和Gemini 2.5 Pro模型,展现出强大的多领域应用潜力。

    Input
    ¥4/M
    Output
    ¥12/M
    Context
    128K
    2025-02-20 Listed
  • Qwen3-235B-A22B-Instruct-2507

    API ID:ali/qwen3-235b-a22b-instruct-2507
    文本编程数学与科学多模态理解文档与办公翻译
    +5
    文本编程数学与科学多模态理解文档与办公翻译

    Qwen3-235B-A22B-Instruct-2507是Qwen3-235B-A22B-FP8的增强版本,在指令遵循、逻辑推理、文本理解、数学与编程能力、多语言知识覆盖等方面表现显著提升,并在256K长上下文处理和主观任务对齐度上进一步优化,生成内容更高质量、更贴近用户意图。

    Input
    ¥2/M
    Output
    ¥8/M
    Context
    128K
    2025-07-23 Listed
  • GLM-4.5-AirX Thinking

    API ID:bigmodel/glm-4.5-airx:thinking
    文本对话与客服编程数学与科学
    +3
    文本对话与客服编程数学与科学

    GLM-4.5-AirX为GLM-4.5-Air的极速版,响应速度更快,专为大规模高速度需求打造。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥4/M token
    • ≤32k¥4/M token
    • 32k~不限¥8/M token

    输出

    • ≤2k¥12/M token
    • 2k~不限¥16/M token
    • 全部¥32/M token

    缓存读

    • 全部¥0.8/M token
    • 全部¥0.8/M token
    • 全部¥1.6/M token
    2025-09-29 Listed
  • GLM-4.5-X

    API ID:bigmodel/glm-4.5-x
    文本对话与客服编程文档与办公内容创作翻译
    +5
    文本对话与客服编程文档与办公内容创作翻译

    GLM-4.5-X为GLM-4.5的极速版,在性能强劲的同时,生成速度可达100tokens/秒。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥8/M token
    • ≤32k¥12/M token
    • 32k~不限¥16/M token

    输出

    • ≤2k¥16/M token
    • 2k~不限¥32/M token
    • 全部¥64/M token

    缓存读

    • 全部¥1.6/M token
    • 全部¥2.4/M token
    • 全部¥3.2/M token
    2025-07-29 Listed
  • GLM-4.5-Air Thinking

    API ID:bigmodel/glm-4.5-air:thinking
    文本数学与科学编程智能代理与数据对话与客服文档与办公
    +5
    文本数学与科学编程智能代理与数据对话与客服文档与办公

    GLM-4.5-Air为GLM-4.5的轻量版,兼顾性能与性价比,可灵活切换混合思考模型。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥0.8/M token
    • ≤32k¥0.8/M token
    • 32k~不限¥1.2/M token

    输出

    • ≤2k¥2/M token
    • 2k~不限¥6/M token
    • 全部¥8/M token

    缓存读

    • 全部¥0.16/M token
    • 全部¥0.16/M token
    • 全部¥0.24/M token
    2025-09-29 Listed
  • MiniMax-M1

    API ID:minimax/minimax-m1
    文本数学与科学编程多模态理解
    +3
    文本数学与科学编程多模态理解

    MiniMax-M1,世界上第一个开源的大规模混合架构的推理模型,适合在复杂场景中使用。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥0.8/M token
    • 32k~128k¥1.2/M token
    • 128k~不限¥2.4/M token

    输出

    • ≤32k¥8/M token
    • 32k~128k¥16/M token
    • 128k~不限¥24/M token
    2025-07-15 Listed
  • GLM-4.5-Air

    API ID:bigmodel/glm-4.5-air
    文本对话与客服编程文档与办公内容创作智能代理与数据
    +5
    文本对话与客服编程文档与办公内容创作智能代理与数据

    GLM-4.5-Air为GLM-4.5的轻量版,兼顾性能与性价比,可灵活切换混合思考模型。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥0.8/M token
    • ≤32k¥0.8/M token
    • 32k~不限¥1.2/M token

    输出

    • ≤2k¥2/M token
    • 2k~不限¥6/M token
    • 全部¥8/M token

    缓存读

    • 全部¥0.16/M token
    • 全部¥0.16/M token
    • 全部¥0.24/M token
    2025-07-29 Listed
  • GLM-4.5-X Thinking

    API ID:bigmodel/glm-4.5-x:thinking
    文本对话与客服文档与办公编程内容创作学术与教育
    +5
    文本对话与客服文档与办公编程内容创作学术与教育

    GLM-4.5-X为GLM-4.5的极速版,在性能强劲的同时,生成速度可达100tokens/秒。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥8/M token
    • ≤32k¥12/M token
    • 32k~不限¥16/M token

    输出

    • ≤2k¥16/M token
    • 2k~不限¥32/M token
    • 全部¥64/M token

    缓存读

    • 全部¥1.6/M token
    • 全部¥2.4/M token
    • 全部¥3.2/M token
    2025-09-29 Listed
  • Qwen3-235B-A22B-Thinking-2507

    API ID:ali/qwen3-235b-a22b-thinking-2507
    文本数学与科学多模态理解内容创作学术与教育文档与办公
    +5
    文本数学与科学多模态理解内容创作学术与教育文档与办公

    基于Qwen3的思考模式开源模型,相较通义千问3-235B-A22B逻辑能力、通用能力、知识增强及创作能力均有大幅提升,适用于高难度强推理场景。

    Input
    ¥2/M
    Output
    ¥20/M
    Context
    131.1K
    2025-07-28 Listed
  • Claude 3.5 Haiku

    API ID:anthropic/claude-3.5-haiku
    文本多模态理解对话与客服内容创作文档与办公编程
    +5
    文本多模态理解对话与客服内容创作文档与办公编程

    Claude 3.5 Haiku是Anthropic最快且最具成本效益的下一代模型,非常适合速度和经济性重要的应用场景。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥7/M token

    缓存写(1h)

    • Public price¥11.2/M token
    2025-07-24 Listed
  • Kimi-latest

    API ID:moonshot/kimi-latest
    文本多模态理解文档与办公对话与客服内容创作学术与教育
    +5
    文本多模态理解文档与办公对话与客服内容创作学术与教育

    Kimi-latest是一个最长支持128k上下文的视觉模型,支持图片理解。同时,kimi-latest 模型总是使用Kimi智能助手产品使用最新的Kimi 大模型版本,可能包含尚未稳定的特性。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤8k¥2/M token
    • 8k~32k¥5/M token
    • 32k~不限¥10/M token

    输出

    • ≤8k¥10/M token
    • 8k~32k¥20/M token
    • 32k~不限¥30/M token
    2025-07-15 Listed
  • Vidu1.5

    API ID:vidu/vidu1.5
    视频生成视频与3D
    +1
    视频生成视频与3D

    vidu/vidu1.5是生数科技推出的多模态AI视频生成模型,核心突破多主体一致性难题,上传1-3张参考图即可精准控制人物、物体及场景融合,无需LoRA微调。支持文生、图生、参考生视频,输出最高1080P分辨率,30秒内即可出片。具备上下文理解能力,适配写实、动漫风格,广泛应用于影视预制作、广告创作、动漫开发等场景。

    Price
    Attribute-based pricing

    Attribute-based pricing

    图像生成视频

    • 360p4秒¥1.25/次
    • 720p4秒¥3.13/次
    • 720p8秒¥6.25/次
    • 1080p4秒¥6.25/次

    reference2video

    • 360p4秒¥2.50/次
    • 720p4秒¥6.25/次
    • 720p8秒¥12.50/次
    • 1080p4秒¥12.50/次

    首尾帧生成视频

    • 360p4秒¥1.25/次
    • 720p4秒¥3.13/次
    • 720p8秒¥6.25/次
    • 1080p4秒¥6.25/次

    文本生成视频

    • 360p4秒¥1.25/次
    • 720p4秒¥3.13/次
    • 720p8秒¥6.25/次
    • 1080p4秒¥6.25/次
    2025-09-02 Listed
  • Qwen3-Reranker-8B

    API ID:ali/qwen3-reranker-8b
    重排智能代理与数据
    +1
    重排智能代理与数据

    创建于 2026-06-10 19:20:02 Qwen3-Reranker-8B是阿里巴巴通义实验室于2025年6月开源的80亿参数重排序模型,支持119种语言和32K超长文本处理。在中文检索(CMTEB-R 77.45分)、多语言检索(MTEB-R 69.02分)和代码检索(MTEB-Code 81.22分)任务中均刷新行业纪录,性能超越BGE等主流模型30%以上‌。 其创新单塔交叉编码器架构和指令感知能力,可显著提升检索增强生成(RAG)系统的精度与效率‌。

    Input
    ¥0.5/M
    Output
    ¥0/M
    Context
    256K
    2026-08-04 Listed
  • Qwen3-Embedding-0.6B

    API ID:ali/qwen3-embedding-0.6b
    向量化智能代理与数据
    +1
    向量化智能代理与数据

    Qwen3-Embedding-0.6B 是 Qwen3 嵌入模型系列的最新专有模型,专为文本嵌入和排序任务设计。该模型基于 Qwen3 系列的密集基础模型,具有 6 亿参数规模,支持长达 32K 的上下文长度,可生成最高 1024 维的嵌入向量。模型继承了基础模型卓越的多语言能力,支持超过 100 种语言,具备长文本理解和推理能力。在 MTEB 多语言排行榜上表现优异(得分 64.33),在文本检索、代码检索、文本分类、文本聚类和双语挖掘等多项任务中表现出色。模型支持用户自定义输出维度(32 到 1024)和指令感知功能,可根据特定任务、语言或场景进行优化,为需要平衡效率和效果的应用场景提供理想选择

    Input
    ¥0.07/M
    Output
    ¥0/M
    Context
    256K
    2026-08-04 Listed
  • Qwen-Plus

    API ID:ali/qwen-plus-latest
    文本对话与客服内容创作文档与办公编程学术与教育
    +5
    文本对话与客服内容创作文档与办公编程学术与教育

    通义千问系列能力均衡的模型,推理效果、成本和速度介于通义千问-Max和通义千问-Turbo之间,适合中等复杂任务。

    Input
    ¥0.8/M
    Output
    ¥2/M
    Context
    131.1K
    2025-02-20 Listed
  • Gemini 2.5 Flash Nativa Audio

    API ID:google/gemini-2.5-flash-live
    文本语音处理对话与客服多模态理解翻译
    +4
    文本语音处理对话与客服多模态理解翻译

    Gemini 2.5 Flash 的原生音频模型,支持Live API格式调用。

    Input
    ¥3.5/M
    Output
    ¥14/M
    Context
    1M
    2025-12-17 Listed
  • ViduQ1

    API ID:vidu/viduq1
    视频生成视频与3D
    +1
    视频生成视频与3D

    主打高可控性与电影级画质。支持文生、图生、参考生三重模式,可输入7张参考图精准控制多主体一致性,生成1080P分辨率视频,动态过渡自然且符合物理规律。其首尾帧功能仅需两张图即可实现电影级运镜,音频生成支持48KHz高保真采样,同步精度达±0.1秒。在VBench测评中,该模型以绝对优势超越Sora、Runway等国际竞品,稳居文生/图生视频双榜首。凭借每秒0.3元的低成本与10秒极速生成能力,ViduQ1广泛应用于电商广告、影视预制作、动漫开发等场景,推动AI视频从创意工具向生产力引擎升级。

    Price
    Attribute-based pricing

    Attribute-based pricing

    图像生成视频

    • 1080p5秒¥2.50/次

    首尾帧生成视频

    • 1080p5秒¥2.50/次

    文本生成视频

    • 1080p5秒¥2.50/次
    2025-09-02 Listed
  • ViduQ1-image

    API ID:vidu/viduq1-image
    图像生成视频与3D图像与设计内容创作
    +3
    图像生成视频与3D图像与设计内容创作

    主打高可控性与电影级画质。支持文生、图生、参考生三重模式,可输入7张参考图精准控制多主体一致性,生成1080P分辨率视频,动态过渡自然且符合物理规律。其首尾帧功能仅需两张图即可实现电影级运镜,音频生成支持48KHz高保真采样,同步精度达±0.1秒。在VBench测评中,该模型以绝对优势超越Sora、Runway等国际竞品,稳居文生/图生视频双榜首。凭借每秒0.3元的低成本与10秒极速生成能力,ViduQ1广泛应用于电商广告、影视预制作、动漫开发等场景,推动AI视频从创意工具向生产力引擎升级。

    Price
    Attribute-based pricing

    Attribute-based pricing

    每张图片

    • Public price¥0.625/每张图片
    2025-10-22 Listed
  • ViduQ2-turbo

    API ID:vidu/viduq2-turbo
    视频生成视频与3D
    +1
    视频生成视频与3D

    No model description is currently available.

    Price
    Attribute-based pricing

    Attribute-based pricing

    图像生成视频

    • 720p2秒¥0.31/次
    • 720p3秒¥0.63/次
    • 720p4秒¥0.94/次
    • 720p5秒¥1.25/次
    • 720p6秒¥1.56/次
    • 720p7秒¥1.88/次
    • 720p8秒¥2.19/次
    • 1080p2秒¥1.56/次
    • 1080p3秒¥1.88/次
    • 1080p4秒¥2.19/次
    • 1080p5秒¥2.50/次
    • 1080p6秒¥2.81/次
    • 1080p7秒¥3.13/次
    • 1080p8秒¥3.44/次

    首尾帧生成视频

    • 720p2秒¥0.31/次
    • 720p3秒¥0.63/次
    • 720p4秒¥0.94/次
    • 720p5秒¥1.25/次
    • 720p6秒¥1.56/次
    • 720p7秒¥1.88/次
    • 720p8秒¥2.19/次
    • 1080p2秒¥1.56/次
    • 1080p3秒¥1.88/次
    • 1080p4秒¥2.19/次
    • 1080p5秒¥2.50/次
    • 1080p6秒¥2.81/次
    • 1080p7秒¥3.13/次
    • 1080p8秒¥3.44/次
    2025-10-22 Listed
  • Agnes 3.0 Flash

    API ID:agnes/agnes-3.0-flash
    文本智能代理与数据编程
    +2
    文本智能代理与数据编程

    Agnes 3.0 Flash 是 Agnes AI 推出的全新一代升级文本模型,面向 Agent 编程与工具驱动任务,重点提升复杂任务的端到端执行质量。

    Input
    ¥0/M
    Output
    ¥0/M
    Context
    512K
    2026-09-18 Listed
  • Agnes 2.5 Flash

    API ID:agnes/agnes-2.5-flash
    文本多模态理解智能代理与数据编程对话与客服
    +4
    文本多模态理解智能代理与数据编程对话与客服

    Agnes 2.5 Flash 是基于 Agnes 2.0 Flash 升级的全量可用语言模型。它沿用 OpenAI 兼容的 Chat Completions 接入方式,同时在编码任务、智能体工作流、工具调用、多轮对话、推理和图像理解体验上进行了优化。

    Input
    ¥0/M
    Output
    ¥0/M
    Context
    512K
    2026-08-28 Listed
  • Qwen3-VL-Embedding-8B

    API ID:ali/qwen3-vl-embedding-8b
    向量化多模态理解智能代理与数据
    +2
    向量化多模态理解智能代理与数据

    Qwen3-VL-Embedding 是 Qwen3 多模态模型体系中的新一代视觉-语言嵌入模型,专为跨模态语义理解、检索与排序任务设计。该模型基于 Qwen3 系列高性能视觉语言基础模型构建,能够将文本、图像及其组合统一映射到高质量向量空间,实现精准的跨模态语义对齐。模型支持长上下文输入与高维嵌入表示,兼顾细粒度语义表达与大规模检索效率,广泛适用于多模态搜索、RAG 知识增强、内容推荐、相似度计算与智能审核等场景。继承 Qwen3 系列卓越的多语言与视觉理解能力,Qwen3-VL-Embedding 在复杂语义推理与跨语言跨模态任务中表现出色,并支持灵活的输出维度与任务指令感知能力,帮助开发者针对不同业务场景进行高效优化。

    Price
    Attribute-based pricing

    Attribute-based pricing

    图片·输入

    • Public price¥1.8/M token
    2026-08-04 Listed

24 / 335 models loaded

←Previous
  1. 1
  2. …
  3. 10
  4. 11
  5. 12
  6. …
  7. 14
Page 11 of 14Next→
General filters0
Use case

No matching options

Provider

No matching options

Input modality
Minimum context
General filters