Loading…
Skip to main content
The new Enterprise Gateway is live. Start your free trial today.View details
Modelmesh
Core products
LoomLoomSkillApp MarketEnterprise AI GatewayAI Chat
Model Marketplace
Model CenterDeveloper Models
Cloud Factory
AI Model DeploymentCloud AI Cluster
Agent accessCommunityAbout us
DocsConsoleChinese
DocsConsoleChinese
Log in / Sign upChecking…
Activate Enterprise GatewayProDedicated high-performance resources and support
Primary account:—
Account rechargeAPI keysEarnings
Personal settings

Redeem voucher

ModelmeshModelmesh navigation
DocsConsoleChinese
Log in / Sign up
Checking…

Model Center

Explore 336 models with public pricing, capabilities, and context information. Actual pricing may vary when routed to different providers; see model details for more pricing information.

214/ 336models
Sort
Price comparison
All文本图像生成视频生成音频生成音频转录3D生成向量化重排决策
  • Gemini 2.5 Pro

    API ID:google/gemini-2.5-pro
    文本编程多模态理解编程数学与科学学术与教育文档与办公
    +6
    文本编程多模态理解编程数学与科学学术与教育文档与办公

    Gemini 2.5 Pro是一款强大的推理模型,专为解决复杂问题而设计。它具备卓越的理解与分析能力,能够处理来自多种信息源的海量数据,包括文本、音频、图像、视频,甚至是完整的代码库。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤200k¥8.75/M token
    • 200k~不限¥17.5/M token

    输出

    • ≤200k¥70/M token
    • 200k~不限¥105/M token

    缓存读

    • ≤200k¥0.875/M token
    • 200k~不限¥1.75/M token
    2025-06-18 Listed
  • GPT 5.1 Codex Mini

    API ID:openai/gpt-5.1-codex-mini
    文本编程多模态理解智能代理与数据数学与科学
    +4
    文本编程多模态理解智能代理与数据数学与科学

    (当前仅支持/v1/responses接口)GPT-5.1-Codex 的小参数快速版本。

    Input
    ¥1.75/M
    Output
    ¥14/M
    Context
    400K
    2025-11-19 Listed
  • Gemini 2.5 Flash

    API ID:google/gemini-2.5-flash
    文本多模态理解对话与客服编程内容创作数学与科学
    +5
    文本多模态理解对话与客服编程内容创作数学与科学

    Gemini 2.5 Flash是Google在性价比方面表现最优的模型,兼具全面能力与高效性能。作为首个具备“思维能力”的 Flash 系列模型,Gemini 2.5 Flash支持可视化的思维过程,让用户直观了解模型在生成回答时的推理路径。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥0.581/M token
    2025-06-18 Listed
  • GPT-5

    API ID:openai/gpt-5
    文本编程数学与科学多模态理解智能代理与数据
    +4
    文本编程数学与科学多模态理解智能代理与数据

    GPT-5是OpenAI推出的最新一代先进模型,在推理能力、代码生成质量和用户体验方面实现显著提升。该模型针对复杂任务进行了专项优化,尤其擅长需要逐步推理、精准遵循指令以及对准确性要求严格的高风险场景。

    Input
    ¥8.75/M
    Output
    ¥70/M
    Context
    400K
    2025-08-15 Listed
  • Kimi K2.7 Code HighSpeed

    API ID:moonshot/kimi-k2.7-code-highspeed
    文本编程
    +1
    文本编程

    Kimi K2.7 Code HighSpeed 是 Kimi K2.7 Code 的高速版模型,与 Kimi K2.7 Code 是相同模型,但输出速度约 180 Tokens/s,短上下文场景可达 260 Token/s,带来更极致的编程体验。

    Input
    ¥13/M
    Output
    ¥54/M
    Context
    256K
    2026-07-29 Listed
  • Grok 4.5

    API ID:x-ai/grok-4.5
    文本编程文档与办公数学与科学
    +3
    文本编程文档与办公数学与科学

    Grok 4.5是XAI最智能的模型,具备在编程、知识工作和STEM领域的前沿性能。

    Input
    ¥14/M
    Output
    ¥42/M
    Context
    2M
    2026-07-29 Listed
  • GLM-5

    API ID:bigmodel/glm-5
    文本智能代理与数据编程
    +2
    文本智能代理与数据编程

    GLM-5 是智谱新一代的旗舰基座模型,面向 Agentic Engineering 打造,能够在复杂系统工程与长程 Agent 任务中提供可靠生产力。在 Coding 与 Agent 能力上,GLM-5 取得开源 SOTA 表现,在真实编程场景的使用体感逼近 Claude Opus 4.5,擅长复杂系统工程与长程 Agent 任务,是通用 Agent 助手的理想基座。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥4/M token
    • 32k~不限¥6/M token

    输出

    • ≤32k¥18/M token
    • 32k~不限¥22/M token

    缓存读

    • ≤32k¥1/M token
    • 32k~不限¥1.5/M token
    2026-02-12 Listed
  • Grok 4

    API ID:x-ai/grok-4
    文本对话与客服内容创作文档与办公编程学术与教育
    +5
    文本对话与客服内容创作文档与办公编程学术与教育

    Grok 4是xAI的多模态大型语言模型,目前支持文本模态,视觉、图像生成等功能即将推出。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤128k¥21/M token
    • 128k~不限¥42/M token

    输出

    • ≤128k¥105/M token
    • 128k~不限¥210/M token

    缓存读

    • ≤128k¥5.25/M token
    • 128k~不限¥5.25/M token
    2025-07-10 Listed
  • GPT-5-Nano

    API ID:openai/gpt-5-nano
    文本编程对话与客服多模态理解
    +3
    文本编程对话与客服多模态理解

    GPT-5-Nano是GPT-5系列中最快速的版本,专为开发者工具、即时交互和超低延迟场景优化。尽管在复杂推理能力上略逊于更大的模型,但它保留了核心的指令跟随与安全特性。

    Input
    ¥0.35/M
    Output
    ¥2.8/M
    Context
    400K
    2025-08-15 Listed
  • MiniMax M2

    API ID:minimax/minimax-m2
    文本编程智能代理与数据
    +2
    文本编程智能代理与数据

    MiniMax M2,专为 Agent 和代码而生,仅 Claude Sonnet 8% 价格,2倍速度。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥2.625/M token
    2025-10-28 Listed
  • Qwen3-VL-32B-Instruct

    API ID:ali/qwen3-vl-32b-instruct
    文本多模态理解文档与办公数学与科学
    +3
    文本多模态理解文档与办公数学与科学

    Qwen3-VL系列最大尺寸Dense模型的非推理版本,综合表现仅次于Qwen3-VL-235B-Instruct,文档识别和理解能力出色,空间感知与万物识别能力强,视觉2D检测/空间推理能力达到SOTA,适合通用场景下的复杂感知任务。

    Input
    ¥2/M
    Output
    ¥8/M
    Context
    128K
    2026-08-14 Listed
  • Step 3.7 Flash

    API ID:stepfun/step-3.7-flash
    文本多模态理解
    +1
    文本多模态理解

    Step 3.7 Flash 是阶跃星辰推出的旗舰多模态推理模型,基于 198B 总参数 / 11B 激活参数的稀疏 MoE 架构,原生支持图片和视频理解,具备 256K tokens 长上下文和高速低延迟的推理能力。

    Input
    ¥1.35/M
    Output
    ¥8.1/M
    Context
    256K
    2026-09-24 Listed
  • GPT-5-Codex

    API ID:openai/gpt-5-codex
    文本编程
    +1
    文本编程

    GPT-5-Codex 是 GPT-5 的专用版本,针对软件工程和编码工作流程进行了优化。它专为交互式开发会话和复杂工程任务的长时间独立执行而设计。该模型支持从头开始构建项目、功能开发、调试、大规模重构和代码审查。与 GPT-5 相比,Codex 更具可作性,严格遵守开发人员的指令,并生成更干净、更高质量的代码输出。

    Input
    ¥8.75/M
    Output
    ¥70/M
    Context
    400K
    2025-10-10 Listed
  • GLM-4.6 Thinking

    API ID:bigmodel/glm-4.6:thinking
    文本编程数学与科学学术与教育文档与办公对话与客服
    +5
    文本编程数学与科学学术与教育文档与办公对话与客服

    GLM-4.6 是智谱最新的旗舰模型,其总参数量 355B,激活参数 32B。GLM-4.6 所有核心能力上均完成了对 GLM-4.5 的超越

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥2/M token
    • ≤32k¥3/M token
    • 32k~不限¥4/M token

    输出

    • ≤2k¥8/M token
    • 2k~不限¥14/M token
    • 全部¥16/M token

    缓存读

    • 全部¥0.4/M token
    • 全部¥0.6/M token
    • 全部¥0.8/M token
    2025-10-09 Listed
  • GLM-4.6

    API ID:bigmodel/glm-4.6
    文本对话与客服文档与办公编程内容创作学术与教育
    +5
    文本对话与客服文档与办公编程内容创作学术与教育

    GLM-4.6 是智谱最新的旗舰模型,其总参数量 355B,激活参数 32B。GLM-4.6 所有核心能力上均完成了对 GLM-4.5 的超越

    Input
    ¥2/M
    Output
    ¥8/M
    Context
    200K
    2025-10-09 Listed
  • GPT-5.4-Pro

    API ID:openai/gpt-5.4-pro
    文本编程内容创作多模态理解学术与教育数学与科学
    +5
    文本编程内容创作多模态理解学术与教育数学与科学

    GPT-5 Pro 是 OpenAI 最先进的模型,在推理、代码质量和用户体验方面进行了重大改进。它针对需要分步推理、遵循指令和高风险用例准确性的复杂任务进行了优化。它支持测试时路由功能和高级提示理解,包括用户指定的意图,例如“认真考虑这个问题”。改进包括减少幻觉、阿谀奉承,以及在编码、写作和健康相关任务中表现更好。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤272k¥210/M token
    • 272k~不限¥420/M token

    输出

    • ≤272k¥1260.001/M token
    • 272k~不限¥1890.002/M token
    2026-03-10 Listed
  • Step 5 Preview

    API ID:stepfun/step-5-preview
    文本多模态理解智能代理与数据文档与办公编程
    +4
    文本多模态理解智能代理与数据文档与办公编程

    Step 5 Preview 是 StepFun 面向真实任务的新一代旗舰基模,重点覆盖编程与专业知识工作。模型原生支持文本、图片和视频输入,提供 1M tokens 上下文窗口,适合需要处理大量信息、调用工具,并持续推进到交付结果的任务。

    Input
    ¥7/M
    Output
    ¥20/M
    Context
    256K
    2026-09-24 Listed
  • Qwen3 Next 80B A3B Instruct

    API ID:ali/qwen3-next-80b-a3b-Instruct
    文本编程智能代理与数据对话与客服数学与科学翻译
    +5
    文本编程智能代理与数据对话与客服数学与科学翻译

    Qwen3-Next-80B-A3B-Instruct是Qwen3-Next系列中的一款指令微调对话模型,专为提供快速、稳定的响应而优化。它能够胜任复杂推理、代码生成、知识问答和多语言应用,同时在对齐与格式控制方面保持稳健。与以往的Qwen3 指令模型相比,该版本在超长输入和多轮对话场景下具备更高吞吐与更强稳定性,非常适用于RAG、工具调用以及需要一致性最终答案的智能体工作流。

    Input
    ¥1/M
    Output
    ¥4/M
    Context
    131.1K
    2025-09-12 Listed
  • Qwen3-Coder-480B-A35B-Instruct

    API ID:ali/qwen3-coder-480b-a35b-instruct
    文本编程智能代理与数据多模态理解
    +3
    文本编程智能代理与数据多模态理解

    基于Qwen3的代码生成模型,具有强大的Coding Agent能力,代码能力达到开源模型 SOTA。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥6/M token
    • 32k~不限¥9/M token

    输出

    • ≤32k¥24/M token
    • 32k~不限¥36/M token
    2025-08-26 Listed
  • Claude Sonnet 4 ( Thinking )

    API ID:anthropic/claude-sonnet-4:thinking
    文本编程数学与科学
    +2
    文本编程数学与科学

    Claude Sonnet 4 ( Thinking ),在编程与推理任务中展现出更高的精度与可控性。该模型兼顾能力与计算效率,适用于从日常编码到复杂软件开发等多种场景。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥26.25/M token

    缓存写(1h)

    • Public price¥42/M token
    2025-06-19 Listed
  • Doubao-Seed-1.6-flash

    API ID:bytedance/doubao-seed-1.6-flash
    文本对话与客服多模态理解文档与办公
    +3
    文本对话与客服多模态理解文档与办公

    Doubao-Seed-1.6-flash为豆包大模型1.6系列的极速版本,具有低延迟的显著优势,非常适用于对延迟要求极高的实时交互场景,如客服场景等。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥0.15/M token
    • 32k~128k¥0.3/M token
    • 128k~不限¥0.6/M token

    输出

    • ≤32k¥1.5/M token
    • 32k~128k¥3/M token
    • 128k~不限¥6/M token

    缓存读

    • ≤32k¥0.03/M token
    • 32k~128k¥0.03/M token
    • 128k~不限¥0.03/M token
    2025-06-12 Listed
  • Claude Opus 4.1

    API ID:anthropic/claude-opus-4.1
    文本编程智能代理与数据数学与科学
    +3
    文本编程智能代理与数据数学与科学

    Claude Opus 4.1是Anthropic旗舰模型的更新版本,在编码、推理和代理任务方面均有提升。它在SWE-bench Verified测试中达到了74.5%的准确率,并在多文件代码重构、调试精度和面向细节的推理方面展现出显著提升。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥131.25/M token

    缓存写(1h)

    • Public price¥210/M token
    2025-08-06 Listed
  • Qwen3 Next 80B A3B Thinking

    API ID:ali/qwen3-next-80b-a3b-thinking
    文本数学与科学编程智能代理与数据学术与教育
    +4
    文本数学与科学编程智能代理与数据学术与教育

    Qwen3-Next-80B-A3B-Thinking 是Qwen3-Next系列中以推理为核心的对话模型,默认输出结构化的“思维链”内容。它专为复杂多步问题而设计,能够处理数学证明、代码生成与调试、逻辑推演以及智能体规划等任务,并在知识、推理、编程、对齐和多语言评测上表现出色。与以往的Qwen3模型相比,该版本在长链式思维下的稳定性与推理阶段的高效扩展上更具优势,且在复杂指令跟随时显著降低了重复或偏离任务的情况。

    Input
    ¥1/M
    Output
    ¥10/M
    Context
    131.1K
    2025-09-12 Listed

23 / 214 models loaded

←Previous
  1. 1
  2. …
  3. 5
  4. 6
  5. 7
  6. …
  7. 9
Page 6 of 9Next→
General filters0
Use case

No matching options

Provider

No matching options

Input modality
Minimum context
General filters