Loading…
Skip to main content
The new Enterprise Gateway is live. Start your free trial today.View details
Modelmesh
Core products
LoomLoomSkillApp MarketEnterprise AI GatewayAI Chat
Model Marketplace
Model CenterDeveloper Models
Cloud Factory
AI Model DeploymentCloud AI Cluster
Agent accessCommunityAbout us
DocsConsoleChinese
DocsConsoleChinese
Log in / Sign upChecking…
Activate Enterprise GatewayProDedicated high-performance resources and support
Primary account:—
Account rechargeAPI keysEarnings
Personal settings

Redeem voucher

ModelmeshModelmesh navigation
DocsConsoleChinese
Log in / Sign up
Checking…

Model Center

Explore 336 models with public pricing, capabilities, and context information. Actual pricing may vary when routed to different providers; see model details for more pricing information.

336/ 336models
Sort
Price comparison
All文本图像生成视频生成音频生成音频转录3D生成向量化重排决策
  • Anthropic / Claude Sonnet 4.6

    API ID:anthropic/claude-sonnet-4.6
    文本编程智能代理与数据文档与办公

    Sonnet 4.6 是 Anthropic 迄今为止最强大的 Sonnet 级模型,在编码、代理和专业工作领域表现出色。它擅长迭代开发、复杂的代码库导航、带内存的端到端项目管理、精致的文档创建,以及自信的网页质量保证和工作流程自动化的计算机使用。

    2026-02-18 Listed
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥26.25/M token

    缓存写(1h)

    • Public price¥42/M token
  • Google / Gemini 3.1 Pro Preview

    API ID:google/gemini-3.1-pro-preview
    文本编程智能代理与数据多模态理解文档与办公数学与科学

    Gemini 3.1 Pro Preview 专为高级开发和智能体系统而设计,在提升令牌效率的同时,增强了长期稳定性、工具编排能力。它引入了一种新的中间思维模式,以更好地平衡成本、速度和性能。该模型在智能体编码、结构化规划、多模态分析和工作流自动化方面表现出色,因此非常适合自主智能体、金融建模、电子表格自动化和高上下文企业任务。

    2026-02-21 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤200k¥14/M token
    • 200k~不限¥28/M token

    输出

    • ≤200k¥84/M token
    • 200k~不限¥126/M token

    缓存读

    • ≤200k¥1.4/M token
    • 200k~不限¥2.8/M token
  • Ali / Qwen3.5-Plus

    API ID:ali/qwen3.5-plus
    文本多模态理解编程文档与办公内容创作对话与客服

    Qwen3.5原生视觉语言系列Plus模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。在多项任务评测中,3.5系列均展现出与当前顶尖前沿模型相媲美的卓越性能,模型效果在纯文本与多模态方面相较3系列均实现飞跃式进步。

    2026-02-24 Listed¥2/M Input¥3/M Output128K Context
  • OpenAI / GPT-5.4

    API ID:openai/gpt-5.4
    文本编程智能代理与数据文档与办公多模态理解

    GPT-5.4 是 OpenAI 最新的前沿模型,将 Codex 和 GPT 系列整合为一个系统。它配备了 1M+令牌上下文窗口(922K 输入,128K 输出),支持文本和图像输入,支持同一工作流程中的高上下文推理、编码和多模态分析。该模型在编码、文档理解、工具使用和指令执行方面提供了更好的性能。它被设计为通用任务和软件工程的强默认选项,能够生成生产质量的代码,综合多个来源的信息,并以更少的迭代和更高的令牌效率执行复杂的多步工作流程。

    2026-03-06 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤272k¥17.5/M token
    • 272k~不限¥35/M token

    输出

    • ≤272k¥105/M token
    • 272k~不限¥157.5/M token

    缓存读

    • ≤272k¥1.75/M token
    • 272k~不限¥3.5/M token
  • OpenAI / GPT-5.3 Chat

    API ID:openai/gpt-5.3-chat
    文本对话与客服

    GPT-5.3 Chat 是对 ChatGPT 最常用模型的升级,使日常对话更加流畅、实用且直接实用。它能提供更准确的答案,更好地提供上下文,显著减少不必要的拒绝、附加条件和过于谨慎的措辞,避免打断对话流畅。

    2026-03-06 Listed¥12.25/M Input¥98/M Output400K Context
  • OpenAI / GPT 5.3 Codex

    API ID:openai/gpt-5.3-codex
    文本编程智能代理与数据多模态理解数学与科学

    GPT-5.3-Codex 将先进的编码能力、更广泛的推理和专业问题解决整合在一个专为真实工程工作打造的单一模型中。它将 GPT-5.2-Codex 的前沿编码性能与 GPT5.2 的推理和专业知识能力整合到一个系统中。这使得体验从优化孤立输出转向支持更长时间的开发工作;当仓库庞大、变更跨越多个步骤,且需求不总是在一开始就完全明确时。

    2026-03-04 Listed¥12.25/M Input¥98/M Output400K Context
  • Google / Gemini 3.1 Flash Lite Preview

    API ID:google/gemini-3.1-flash-lite-preview
    文本对话与客服内容创作文档与办公编程数学与科学

    Gemini 3.1 Flash-Lite 是谷歌最具成本效益的 Gemini 型号,针对低延迟、高成本的大型语言模型流量进行了优化。它相比 Gemini 2.0/2.5 Flash-Lite 型号实现了显著的质量提升,在关键能力领域的性能与 Gemini 2.5 闪存相当。

    2026-03-04 Listed
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥0.581/M token
  • Google / Gemini 3.1 Flash Image

    API ID:google/gemini-3.1-flash-image
    图像生成图像与设计多模态理解

    谷歌最强图像模型,nano banana 2 。Gemini 3.1 Flash Image 将最强大的图像生成功能推向主流市场。它提升了图像质量、视觉理解能力,更好地渲染了多种语言的长文本段落,并提高了图像的真实性。该模型还能够生成分辨率从 512 (0.25MP) 到 4K (16MP) 的图像。

    2026-02-28 Listed
    Attribute-based pricing

    Attribute-based pricing

    图片·输入

    • Public price¥3.5/M token

    图片·输出

    • Public price¥420/M token
  • Ali / Qwen3.5-397B-A17B

    API ID:ali/qwen3.5-397b-a17b
    文本编程多模态理解智能代理与数据数学与科学

    Qwen3.5系列397B-A17B原生视觉语言模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。在语言理解、逻辑推理、代码生成、智能体任务、图像理解、视频理解、图形用户界面(GUI)等多种任务中,均展现出与当前顶尖前沿模型相媲美的卓越性能。具备强大的代码生成与智能体能力,对于各类智能体场景具有良好的泛化性。

    2026-02-24 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤128k¥1.2/M token
    • 128k~256k¥3/M token

    输出

    • ≤128k¥7.2/M token
    • 128k~256k¥18/M token
  • OpenAI / GPT 5.1 Codex Mini

    API ID:openai/gpt-5.1-codex-mini
    文本编程多模态理解智能代理与数据数学与科学

    (当前仅支持/v1/responses接口)GPT-5.1-Codex 的小参数快速版本。

    2025-11-19 Listed¥1.75/M Input¥14/M Output400K Context
  • Ali / Qwen3-Max-Preview

    API ID:ali/qwen3-max-preview
    文本数学与科学编程翻译学术与教育对话与客服

    Qwen3-Max-Preview是阿里巴巴旗下通义千问团队发布的最新旗舰大语言模型,是 Qwen3 系列中参数量最大的模型,参数规模超过1万亿。模型在推理、指令跟随、多语言支持和长尾知识覆盖等方面有重大改进,支持超过100种语言,中英文理解能力出色。在数学推理、编程和科学推理等任务中表现出色,能更可靠地遵循复杂指令,减少幻觉,生成更高质量的响应。

    2025-09-08 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥6/M token
    • 32k~128k¥10/M token
    • 128k~不限¥15/M token

    输出

    • ≤32k¥24/M token
    • 32k~128k¥40/M token
    • 128k~不限¥60/M token

    缓存读

    • ≤32k¥1.2/M token
    • 32k~128k¥2/M token
    • 128k~不限¥3/M token
  • OpenAI / GPT-5.4-Pro

    API ID:openai/gpt-5.4-pro
    文本编程内容创作多模态理解学术与教育数学与科学

    GPT-5 Pro 是 OpenAI 最先进的模型,在推理、代码质量和用户体验方面进行了重大改进。它针对需要分步推理、遵循指令和高风险用例准确性的复杂任务进行了优化。它支持测试时路由功能和高级提示理解,包括用户指定的意图,例如“认真考虑这个问题”。改进包括减少幻觉、阿谀奉承,以及在编码、写作和健康相关任务中表现更好。

    2026-03-10 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤272k¥210/M token
    • 272k~不限¥420/M token

    输出

    • ≤272k¥1260.001/M token
    • 272k~不限¥1890.002/M token
  • ByteDance / Doubao-Seed-2.0-pro

    API ID:bytedance/doubao-seed-2-0-pro
    文本多模态理解智能代理与数据数学与科学文档与办公对话与客服

    旗舰级全能通用模型,面向 Agent 时代的复杂推理与长链路任务执行场景。强调多模态理解、长上下文推理、结构化生成与工具增强执行。复杂指令与多约束执行能力突出,可稳定应对多步复杂规划、复杂图文推理、视频内容理解与高难度分析等场景。

    2026-03-14 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥3.2/M token
    • 32k~128k¥4.8/M token
    • 128k~256k¥9.6/M token

    输出

    • ≤32k¥16/M token
    • 32k~128k¥24/M token
    • 128k~256k¥48/M token

    缓存读

    • ≤32k¥0.64/M token
    • 32k~128k¥0.96/M token
    • 128k~256k¥1.92/M token
  • ByteDance / Doubao-Seed-2.0-mini

    API ID:bytedance/doubao-seed-2-0-mini
    文本多模态理解对话与客服文档与办公内容创作翻译

    面向低时延、高并发与成本敏感场景,提供极致的模型推理速度。模型效果与Doubao-Seed-1.6相当。支持256k上下文、4档思考长度和多模态理解,适合成本和速度优先的轻量级任务。

    2026-03-14 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥0.2/M token
    • 32k~128k¥0.4/M token
    • 128k~256k¥0.8/M token

    输出

    • ≤32k¥2/M token
    • 32k~128k¥4/M token
    • 128k~256k¥8/M token

    缓存读

    • ≤32k¥0.04/M token
    • 32k~128k¥0.08/M token
    • 128k~256k¥0.16/M token
  • ByteDance / Doubao-Seed-2.0-lite

    API ID:bytedance/doubao-seed-2-0-lite
    文本文档与办公内容创作智能代理与数据多模态理解

    面向高频企业场景兼顾性能与成本的均衡型模型,综合能力超越上一代Doubao-Seed-1.8。胜任非结构化信息处理、内容创作、搜索推荐、数据分析等生产型工作,支持长上下文、多源信息融合、多步指令执行与高保真结构化输出。在保障稳定效果的同时显著优化成本。

    2026-03-14 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥0.6/M token
    • 32k~128k¥0.9/M token
    • 128k~256k¥1.8/M token

    输出

    • ≤32k¥3.6/M token
    • 32k~128k¥5.4/M token
    • 128k~256k¥10.8/M token

    缓存读

    • ≤32k¥0.12/M token
    • 32k~128k¥0.18/M token
    • 128k~256k¥0.36/M token
  • bigmodel / GLM-5

    API ID:bigmodel/glm-5
    文本智能代理与数据编程

    GLM-5 是智谱新一代的旗舰基座模型,面向 Agentic Engineering 打造,能够在复杂系统工程与长程 Agent 任务中提供可靠生产力。在 Coding 与 Agent 能力上,GLM-5 取得开源 SOTA 表现,在真实编程场景的使用体感逼近 Claude Opus 4.5,擅长复杂系统工程与长程 Agent 任务,是通用 Agent 助手的理想基座。

    2026-02-12 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥4/M token
    • 32k~不限¥6/M token

    输出

    • ≤32k¥18/M token
    • 32k~不限¥22/M token

    缓存读

    • ≤32k¥1/M token
    • 32k~不限¥1.5/M token
  • ByteDance / Doubao-Seed-2.0-Code

    API ID:bytedance/doubao-seed-2-0-code
    文本编程智能代理与数据多模态理解

    面向真实编程环境优化的 Coding 模型,能稳定调用 Claude Code 等常见 IDE 中的工具。模型特别优化了前端能力,在使用常见的前端框架时能有良好表现。模型支持使用 Skills,可以配合多种自定义技能使用。

    2026-03-14 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥3.2/M token
    • 32k~128k¥4.8/M token
    • 128k~256k¥9.6/M token

    输出

    • ≤32k¥16/M token
    • 32k~128k¥24/M token
    • 128k~256k¥48/M token

    缓存读

    • ≤32k¥0.64/M token
    • 32k~128k¥0.96/M token
    • 128k~256k¥1.92/M token
  • MiniMax / MiniMax M2.7-highspeed

    API ID:minimax/minimax-m2.7-highspeed
    文本编程文档与办公智能代理与数据多模态理解对话与客服

    M2.7 在真实的软件工程中有优异的表现,包括端到端的完整项目交付,分析日志排查 Bug、代码安全,机器学习等。 在专业办公领域,我们提升了模型在各领域的专业知识和任务交付能力,在 GDPval-AA 的ELO得分是1495,为开源最高。M2.7 对 Office 三件套 Excel/PPT/Word 的复杂编辑能力显著提升,能更好地完成多轮修改和高保真的编辑。 M2.7具备与复杂环境交互的能力,M2.7 在 40 个复杂 skills (> 2000 Token) 的 case 上,仍能保持 97% 的 skills 遵循率。在OpenClaw的使用中,M2.7相比于M2.5也有了显著的提升,在MMClaw的评测中接近最新的Sonnet 4.6。 M2.7具备优秀的身份保持能力和情商,除了生产力使用外,给互动娱乐场景的创新也准备了空间。

    2026-03-18 Listed
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥2.625/M token
  • xAI / Grok 4.1 Fast

    API ID:x-ai/grok-4.1-fast
    文本智能代理与数据对话与客服

    Grok 4.1 Fast 是 xAI 最好的代理工具调用模型,在客户支持和深入研究等实际应用场景中表现出色。200 万上下文窗口。

    2026-03-23 Listed¥1.4/M Input¥3.5/M Output2M Context
  • Bytedance / Doubao-Seedance-1.5-pro

    API ID:bytedance/doubao-seedance-1.5-pro
    视频生成视频与3D

    豆包视频生成模型Seedance 1.5 pro 作为全球领先的视频生成模型,可生成音画高精同步的视频内容。支持多人多语言对白,全面覆盖环境音、动作音、合成音、乐器音、背景音及人声,支持首尾帧,实现影视级叙事效果,满足影视、漫剧、电商及广告领域的高阶创作需求

    2026-03-25 Listed
    Attribute-based pricing

    Attribute-based pricing

    default audio

    • Public price¥16/M token

    default silent

    • Public price¥8/M token

    flex audio

    • Public price¥8/M token

    flex silent

    • Public price¥4/M token
  • Ali / 通义万相2.6-参考生视频

    API ID:ali/wan2.6-r2v
    视频生成视频与3D

    支持指定人物或任意物品进行参考,精准保持形象和声音的一致性,支持多角色参考合拍。

    2026-03-25 Listed
    Attribute-based pricing

    Attribute-based pricing

    视频

    • 720P¥0.6/次
    • 1080P¥1/次
  • Kling / KlingV2.6

    API ID:kling/kling-v2-6
    视频生成视频与3D

    No model description is currently available.

    2026-03-25 Listed
    Attribute-based pricing

    Attribute-based pricing

    图像生成视频

    • 720p5秒¥1.50/次
    • 720p10秒¥3.00/次
    • 1080p5秒¥2.50/次
    • 1080p10秒¥5.00/次

    文本生成视频

    • 720p5秒¥1.50/次
    • 720p10秒¥3.00/次
    • 1080p5秒¥2.50/次
    • 1080p10秒¥5.00/次
  • bigmodel / GLM-5V-Turbo

    API ID:bigmodel/glm-5v-turbo
    文本编程智能代理与数据多模态理解

    GLM-5V-Turbo 是智谱首个多模态 Coding 基座模型,面向视觉编程任务打造。能够原生处理图片、视频、文本等多模态输入,同时擅长长程规划、复杂编程和动作执行;深度适配 Agent 工作流,能够与 Claude Code、OpenClaw 等 Agent 深度协同,完成”看懂环境→规划动作→执行任务”的完整闭环。

    2026-04-03 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥5/M token
    • 32k~不限¥7/M token

    输出

    • ≤32k¥22/M token
    • 32k~不限¥26/M token

    缓存读

    • ≤32k¥1.2/M token
    • 32k~不限¥1.8/M token
  • OpenAI / GPT-5-Nano

    API ID:openai/gpt-5-nano
    文本编程对话与客服多模态理解

    GPT-5-Nano是GPT-5系列中最快速的版本,专为开发者工具、即时交互和超低延迟场景优化。尽管在复杂推理能力上略逊于更大的模型,但它保留了核心的指令跟随与安全特性。

    2025-08-15 Listed¥0.35/M Input¥2.8/M Output400K Context

24 / 336 models loaded

←Previous
  1. 1
  2. …
  3. 5
  4. 6
  5. 7
  6. …
  7. 14
Page 6 of 14Next→
General filters0
Use case

No matching options

Provider

No matching options

Input modality
Minimum context
General filters