Loading…
Skip to main content
The new Enterprise Gateway is live. Start your free trial today.View details
Modelmesh
Core products
LoomLoomSkillApp MarketEnterprise AI GatewayAI Chat
Model Marketplace
Model CenterDeveloper Models
Cloud Factory
AI Model DeploymentCloud AI Cluster
Agent accessCommunityAbout us
DocsConsoleChinese
DocsConsoleChinese
Log in / Sign upChecking…
Activate Enterprise GatewayProDedicated high-performance resources and support
Primary account:—
Account rechargeAPI keysEarnings
Personal settings

Redeem voucher

ModelmeshModelmesh navigation
DocsConsoleChinese
Log in / Sign up
Checking…

Model Center

Explore 335 models with public pricing, capabilities, and context information. Actual pricing may vary when routed to different providers; see model details for more pricing information.

213/ 335models
Sort
Price comparison
All文本图像生成视频生成音频生成音频转录3D生成向量化重排决策
  • GLM-4.7

    API ID:bigmodel/glm-4.7
    文本智能代理与数据编程对话与客服多模态理解内容创作
    +5
    文本智能代理与数据编程对话与客服多模态理解内容创作

    最新旗舰模型:通用对话、推理与智能体能力上实现全面升级。回复更简洁自然,写作更具沉浸感,且在工具调用时指令遵循更强,Artifacts 与 Agentic Coding 的前端美感和长程任务完成效率进一步提升

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥2/M token
    • ≤32k¥3/M token
    • 32k~不限¥4/M token

    输出

    • ≤2k¥8/M token
    • 2k~不限¥14/M token
    • 全部¥16/M token

    缓存读

    • 全部¥0.4/M token
    • 全部¥0.6/M token
    • 全部¥0.8/M token
    2025-12-23 Listed
  • Kimi K2 0905

    API ID:moonshot/kimi-k2
    文本编程智能代理与数据
    +2
    文本编程智能代理与数据

    ( 最新版本 0905) Kimi K2是一款上下文长度256k的模型,具备更强的Agentic Coding能力、更突出的前端代码的美观度和实用性、以及更好的上下文理解能力。

    Input
    ¥4/M
    Output
    ¥16/M
    Context
    256K
    2025-07-15 Listed
  • Qwen3-Coder-Plus

    API ID:ali/qwen3-coder-plus
    文本编程智能代理与数据
    +2
    文本编程智能代理与数据

    Qwen3-Coder-Plus,这是通义千问系列迄今为止最具代理能力的代码模型。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥4/M token
    • ≤128k¥6/M token
    • 128k~256k¥10/M token
    • 256k~1000k¥20/M token

    输出

    • ≤32k¥16/M token
    • ≤128k¥24/M token
    • 128k~256k¥40/M token
    • 256k~1000k¥200/M token

    缓存读

    • ≤32k¥0.8/M token
    • ≤128k¥1.2/M token
    • 128k~256k¥2/M token
    • 256k~1000k¥25/M token

    显式缓存命中

    • ≤32k¥0.4/M token
    • 32k~128k¥0.6/M token
    • 128k~256k¥1/M token
    • 256k~1000k¥2/M token

    缓存写(5m)

    • ≤32k¥5/M token
    • 32k~128k¥7.5/M token
    • 128k~256k¥12.5/M token
    • 256k~1000k¥25/M token
    2025-07-23 Listed
  • LongCat-2.0(限时4折)

    API ID:longcat/longcat-2.0
    文本智能代理与数据编程
    +2
    文本智能代理与数据编程

    LongCat-2.0 是美团 全量开源的1.6 万亿参数 MoE 国产大模型,也是全球首个依托五万张国产算力芯片完成完整训推流程的万亿级大模型美团技术团。

    Input
    ¥2/M
    Output
    ¥8/M
    Context
    1M
    2026-07-07 Listed
  • Hunyuan-3

    API ID:tencent/hy3
    文本智能代理与数据文档与办公编程
    +3
    文本智能代理与数据文档与办公编程

    Hy3 正式版面向真实业务场景打磨,采用 295B 总参数、21B 激活 MoE 架构,原生支持 256K 上下文,并提供no_think(极速响应)、think_low(快速思考)与 think_high(深度推理) 多档思考模式,兼顾极速响应、复杂推理与调用成本。相比 Preview 版本,Hy3 基于腾讯元宝、WorkBuddy、ima 、Marvis等真实业务反馈,重点提升了 Coding Agent、长文理解、多轮上下文承接、搜索问答与复杂任务执行能力,在减少幻觉、提升任务完成度和工程可用性方面表现更稳。更加适合前端任务、跨文件代码开发、长文档分析、办公自动化和多步骤 Agent 工作流等实用场景。

    Input
    ¥1/M
    Output
    ¥4/M
    Context
    256K
    2026-07-07 Listed
  • DeepSeek V3.2 Thinking

    API ID:deepseek/deepseek-v3.2-think
    文本数学与科学编程智能代理与数据
    +3
    文本数学与科学编程智能代理与数据

    DeepSeek-V3.2 是一款大型语言模型,旨在兼顾高计算效率、强大的推理能力以及智能体工具使用性能。它引入了 DeepSeek 稀疏注意力机制 (DSA),这是一种细粒度的稀疏注意力机制,能够在长上下文场景下降低训练和推理成本,同时保持模型质量。可扩展的强化学习后训练框架进一步提升了推理能力,其性能已达到 GPT-5 的水平,并在 2025 年国际数学奥林匹克竞赛 (IMO) 和国际信息学奥林匹克竞赛 (IOI) 中荣获金奖。V3.2 还采用了大规模智能体任务合成流程,将推理更好地融入工具使用场景,从而提升模型在交互式环境中的适应性和泛化能力。

    Input
    ¥2/M
    Output
    ¥3/M
    Context
    128K
    2025-12-02 Listed
  • Claude Sonnet 5

    API ID:anthropic/claude-sonnet-5
    文本多模态理解智能代理与数据编程
    +3
    文本多模态理解智能代理与数据编程

    Sonnet 5 是 Anthropic 公司最强大的 Sonnet 类模型之一,其在各种编程、代理以及专业场景中的性能表现都非常出色。该模型支持自适应思维机制,用户可以选择不同的推理强度级别(低、中、高、最高以及超高强度)。它还具备 1 百万标记数的上下文存储能力,并且能够接受文本、图像和文件输入。Sonnet 5 采用了升级后的分词器,并配备了实时网络安全保护功能,能够阻止某些高风险的两用活动

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥17.5/M token

    缓存写(1h)

    • Public price¥28/M token
    2026-07-01 Listed
  • GPT 5.1 Codex Max

    API ID:openai/gpt-5.1-codex-max
    文本编程数学与科学智能代理与数据
    +3
    文本编程数学与科学智能代理与数据

    (当前仅支持/v1/responses接口)GPT-5.1-Codex-Max 是 OpenAI 最新的代理编码模型,专为长期运行的高上下文软件开发任务设计。它基于更新版的 5.1 推理堆栈,并基于跨软件工程、数学和研究的代理工作流进行训练。 GPT-5.1-Codex-Max 在整个开发生命周期中实现了更快的性能、更优的推理和更高的代币效率。

    Input
    ¥8.75/M
    Output
    ¥70/M
    Context
    400K
    2025-12-11 Listed
  • Doubao-Seed-Character

    API ID:bytedance/doubao-seed-character
    文本多模态理解内容创作对话与客服
    +3
    文本多模态理解内容创作对话与客服

    Doubao-Seed-Character 是面向新一代虚拟陪伴场景打造的 Seed 分支模型,擅长虚拟演绎与“真人”风格的角色扮演,支持剧情创作、剧情演绎与推动、多人聊天等多类对话互动场景。 模型在角色理解、人设保持、多轮对话、剧情推进与互动表达上持续增强,能够稳定理解用户意图、延续角色设定,并以更具画面感的语言带来自然、生动、连贯的互动体验。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥0.8/M token
    • 32k~不限¥1.2/M token

    输出

    • ≤32k¥2/M token
    • 32k~不限¥6/M token

    缓存读

    • ≤32k¥0.16/M token
    • 32k~不限¥0.16/M token
    2026-06-23 Listed
  • Doubao-Seed-Evolving

    API ID:bytedance/doubao-seed-evolving
    文本智能代理与数据编程
    +2
    文本智能代理与数据编程

    Doubao-Seed-Evolving 面向 Coding 与 Agent 场景,持续周级升级,以统一模型 ID 提供最新能力,助力复杂任务高效落地。

    Input
    ¥6/M
    Output
    ¥30/M
    Context
    256K
    2026-06-23 Listed
  • Doubao-Seed-2.1-turbo

    API ID:bytedance/doubao-seed-2-1-turbo
    文本多模态理解智能代理与数据编程
    +3
    文本多模态理解智能代理与数据编程

    效果与成本均衡,全面升级 Coding、Agent 与多模态能力,以更强的自主规划、长链路执行和动态修复能力,胜任企业真实复杂任务。

    Input
    ¥3/M
    Output
    ¥15/M
    Context
    256K
    2026-06-23 Listed
  • Doubao-Seed-2.1-pro

    API ID:bytedance/doubao-seed-2-1-pro
    文本多模态理解智能代理与数据编程
    +3
    文本多模态理解智能代理与数据编程

    Doubao-Seed-2.1 是面向 Coding 和 Agent 时代打造的新一代大模型,提供 Pro 和 Turbo 两个版本,分别面向高复杂度任务探索和规模化生产场景。相较上一代版本,Seed 2.1 在 Coding 工程交付、Agent 长链路任务执行和多模态理解三大方向上实现全面升级,以更强的自主规划与动态修复能力,胜任真实研发与高价值生产任务。

    Input
    ¥6/M
    Output
    ¥30/M
    Context
    256K
    2026-06-23 Listed
  • GLM-5.2

    API ID:bigmodel/glm-5.2
    文本智能代理与数据编程
    +2
    文本智能代理与数据编程

    GLM-5.2 是面向长任务时代的旗舰模型。支持真正可用的 1M 上下文,实测可承载项目级工程上下文,长程任务执行更稳定、工程规范遵循更可靠,开发场景成功率进一步提升。一次任务即可完成“从需求到多端可部署产物”的完整开发链路。

    Price
    Attribute-based pricing

    Attribute-based pricing

    web_search

    • Public price¥0.004/次调用
    2026-06-17 Listed
  • Kimi K2.7 Code

    API ID:moonshot/kimi-k2.7-code
    文本多模态理解智能代理与数据编程对话与客服
    +4
    文本多模态理解智能代理与数据编程对话与客服

    Kimi K2.7 Code 是 Kimi 迄今最智能的 Coding 模型,在长上下文中更可靠地遵循指令,能以更高的成功率完成编程任务。同时支持文本、图片与视频输入,仅支持思考模式,对话与 Agent 任务。模型上下文长度 256k,支持长思考擅长深度推理,支持自动上下文缓存功能,ToolCalls、JSON Mode、Partial Mode 等能力

    Input
    ¥6.5/M
    Output
    ¥27/M
    Context
    256K
    2026-06-15 Listed
  • Claude Fable 5

    API ID:anthropic/claude-fable-5
    文本智能代理与数据编程文档与办公
    +3
    文本智能代理与数据编程文档与办公

    Claude Fable 5 是 Anthropic 下一代智能,专注于最难的知识工作和编程问题。它比以往任何普遍可用的 Claude 模型都能独立运行时间更长:通过代理框架运行,它可以连续工作数天,跨阶段规划,委派给子代理,并检查自身工作。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥87.5/M token

    缓存写(1h)

    • Public price¥140/M token
    2026-06-10 Listed
  • Qwen3.7-Plus(限时8折)

    API ID:ali/qwen3.7-plus
    文本多模态理解文档与办公编程智能代理与数据
    +4
    文本多模态理解文档与办公编程智能代理与数据

    Qwen3.7系列中高性价比Plus模型,在强大文本能力的基础上全面升级了视觉-语言能力,同时保持了在编码、工具使用和生产力工作流方面的完整智能体能力。其核心特色为多模态交互混合智能体能力,能够感知真实世界场景、读取屏幕并操作 GUI、基于视觉参考生成代码、端到端导航移动应用。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤256k¥1.6/M token
    • 256k~不限¥4.8/M token

    输出

    • ≤256k¥6.4/M token
    • 256k~不限¥19.2/M token

    缓存读

    • ≤256k¥0.32/M token
    • 256k~不限¥0.96/M token

    缓存写(5m)

    • Public price¥7.5/M token

    缓存写(1h)

    • Public price¥7.5/M token
    2026-06-03 Listed
  • MiniMax M3(5折)

    API ID:minimax/minimax-m3
    文本智能代理与数据编程
    +2
    文本智能代理与数据编程

    MiniMax M3永久五折,MiniMax M3 在编程和智能体等专业任务上达到了前沿的能力。它使用了我们提出的全新注意力架构 MSA (MiniMax Sparse Attention ),最高支持 1M 超长上下文。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤512k¥2.1/M token
    • 512k~不限¥4.2/M token

    输出

    • ≤512k¥8.4/M token
    • 512k~不限¥16.8/M token

    显式缓存命中

    • ≤512k¥0.42/M token
    • 512k~不限¥0.84/M token
    2026-06-01 Listed
  • Claude Opus 4.8

    API ID:anthropic/claude-opus-4.8
    文本多模态理解智能代理与数据文档与办公编程
    +4
    文本多模态理解智能代理与数据文档与办公编程

    Claude Opus 4.8 是 Anthropic 在 Opus 家族中最强大的通用型号。它支持文本、图片和文件输入,并输出文本,支持推理和 1M 令牌上下文窗口。它适合高度自主的代理、长视野代理工作、知识驱动工作以及在长时间会话中保持一致性的记忆驱动任务。 它在多步推理、复杂编码和端到端项目编排方面尤为强大——大型代码库、多阶段调试和长期运行的异步代理流水线。除了编码,它还处理知识工作,如起草文档、构建演示文稿和分析数据,保持长时间输出的质量。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥43.75/M token

    缓存写(1h)

    • Public price¥70/M token
    2026-05-29 Listed
  • Gemini 3.5 Flash

    API ID:google/gemini-3.5-flash
    文本智能代理与数据编程多模态理解
    +3
    文本智能代理与数据编程多模态理解

    Gemini 3.5 Flash 以 Flash 级别的成本和速度提供接近专业级的智能:专业级的编码能力、并行代理执行,所有这些都以更低的价格实现。

    Input
    ¥10.5/M
    Output
    ¥63/M
    Context
    1M
    2026-05-25 Listed
  • Qwen3.7-Max

    API ID:ali/qwen3.7-max
    文本智能代理与数据文档与办公编程
    +3
    文本智能代理与数据文档与办公编程

    Qwen3.7系列中规模最大、综合能力最强的Max模型,当前开放纯文本模型能力供体验。Qwen3.7是面向智能体时代的新一代旗舰模型,核心优势在于智能体能力的广度与深度:在编程、办公与生产力、长周期自主执行方面均能出色胜任各项任务。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥15/M token
    2026-05-25 Listed
  • Gemini 3.1 Flash Lite

    API ID:google/gemini-3.1-flash-lite
    文本多模态理解智能代理与数据编程
    +3
    文本多模态理解智能代理与数据编程

    Gemini 3.1 Flash-Lite 是谷歌最具成本效益的 Gemini 型号,针对低延迟、高成本的大型语言模型流量进行了优化。它相比 Gemini 2.0/2.5 Flash-Lite 型号实现了显著的质量提升,在关键能力领域的性能与 Gemini 2.5 闪存相当。

    Price
    Attribute-based pricing

    Attribute-based pricing

    音频·输入

    • Public price¥3.5/M token

    图片·输入

    • Public price¥1.75/M token

    视频·输入

    • Public price¥1.75/M token
    2026-05-18 Listed
  • MiMo-V2.5

    API ID:xiaomi/mimo-v2.5
    文本多模态理解智能代理与数据文档与办公
    +3
    文本多模态理解智能代理与数据文档与办公

    MiMo-V2.5 是小米原生的全模态模型。它以约一半的推理成本实现专业级代理性能,同时在图像和视频理解任务中的多模态感知上超越 MiMo-V2-Omni。其 100 万上下文窗口支持完整文档、扩展对话和复杂任务上下文,非常适合与代理框架集成,在需要强大推理、丰富感知和成本效益的环境中。

    Input
    ¥1/M
    Output
    ¥2/M
    Context
    1M
    2026-04-27 Listed
  • GPT-5.2

    API ID:openai/gpt-5.2
    文本智能代理与数据编程数学与科学多模态理解文档与办公
    +5
    文本智能代理与数据编程数学与科学多模态理解文档与办公

    GPT-5.2 是 GPT-5 系列中最新的前沿级模型,相比 GPT-5.1 提供了更强的代理和长上下文性能。它利用自适应推理动态分配计算,快速响应简单查询,同时在复杂任务上投入更多深度。 GPT-5.2 专为广泛任务覆盖而设计,在数学、编程、科学和工具调用工作负载中持续带来进步,提供更连贯的长篇答案和提升的工具使用可靠性。

    Input
    ¥12.25/M
    Output
    ¥98/M
    Context
    400K
    2025-12-12 Listed
  • GPT-5.5

    API ID:openai/gpt-5.5
    文本编程多模态理解数学与科学文档与办公智能代理与数据
    +5
    文本编程多模态理解数学与科学文档与办公智能代理与数据

    GPT-5.5 是 OpenAI 为复杂专业工作负载设计的前沿模型,基于 GPT-5.4,具备更强的推理能力、更高的可靠性,处理困难任务。它配备了 1M上下文窗口(922K 输入,128K 输出),支持文本和图像输入,支持在单一系统内实现大规模推理、编码和多模态工作流。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤272k¥35/M token
    • 272k~不限¥70/M token

    输出

    • ≤272k¥210/M token
    • 272k~不限¥315/M token

    缓存读

    • ≤272k¥3.5/M token
    • 272k~不限¥7/M token
    2026-04-27 Listed

24 / 213 models loaded

←Previous
  1. 1
  2. 2
  3. 3
  4. 4
  5. …
  6. 9
Page 3 of 9Next→
General filters0
Use case

No matching options

Provider

No matching options

Input modality
Minimum context
General filters