Loading…
Skip to main content
The new Enterprise Gateway is live. Start your free trial today.View details
Modelmesh
Core products
LoomLoomSkillApp MarketEnterprise AI GatewayAI Chat
Model Marketplace
Model CenterDeveloper Models
Cloud Factory
AI Model DeploymentCloud AI Cluster
Agent accessCommunityAbout us
DocsConsoleChinese
DocsConsoleChinese
Log in / Sign upChecking…
Activate Enterprise GatewayProDedicated high-performance resources and support
Primary account:—
Account rechargeAPI keysEarnings
Personal settings

Redeem voucher

ModelmeshModelmesh navigation
DocsConsoleChinese
Log in / Sign up
Checking…

Model Center

Explore 335 models with public pricing, capabilities, and context information. Actual pricing may vary when routed to different providers; see model details for more pricing information.

213/ 335models
Sort
Price comparison
All文本图像生成视频生成音频生成音频转录3D生成向量化重排决策
  • DeepSeek-V4-Flash-0731

    API ID:deepseek/deepseek-v4-flash
    文本数学与科学智能代理与数据文档与办公编程对话与客服
    +5
    文本数学与科学智能代理与数据文档与办公编程对话与客服

    DeepSeek-V4-Flash是深度求索公司于2026年4月24日发布的高效经济版大语言模型。它采用混合专家(MoE)架构,总参数量约2840亿,每次推理仅激活约130亿参数,并原生支持高达100万Token的超长上下文。该版本在推理能力和简单Agent任务上接近性能强大的Pro版本,但凭借更小的参数和激活规模,能提供更快捷、低成本的API服务。适合需要快速响应和追求极致性价比的各类轻量级应用场景。

    Input
    ¥1/M
    Output
    ¥4/M
    Context
    1M
    2026-04-24 Listed
  • Step 3.5 Flash-2603

    API ID:stepfun/step-3.5-flash-2603
    文本智能代理与数据编程
    +2
    文本智能代理与数据编程

    基于 Step 3.5 Flash 针对高频 Agent 场景优化,在保留旗舰推理与工具调用能力的同时,进一步提升 Token 效率与推理速度,并支持切换低推理模式以降低消耗。对 Coding 与 Agent 框架兼容性也做了专项优化。

    Input
    ¥0.7/M
    Output
    ¥2.1/M
    Context
    256K
    2026-04-21 Listed
  • Step 3.5 Flash

    API ID:stepfun/step-3.5-flash
    文本编程数学与科学智能代理与数据学术与教育
    +4
    文本编程数学与科学智能代理与数据学术与教育

    阶跃星辰的旗舰语言推理模型。该模型具备顶尖推理能力与快速可靠的执行能力。能够完成对复杂任务的分解、计划,可快速可靠地调用工具执行任务,胜任逻辑推理、数学、软件工程、深度研究等各种复杂任务。上下文长度为256K。

    Input
    ¥0.7/M
    Output
    ¥2.1/M
    Context
    256K
    2026-04-21 Listed
  • Kimi K2.6

    API ID:moonshot/kimi-k2.6
    文本编程智能代理与数据多模态理解对话与客服学术与教育
    +5
    文本编程智能代理与数据多模态理解对话与客服学术与教育

    Kimi K2.6 是 Kimi 最新最智能的模型,Kimi K2.6 的通用 Agent、代码、视觉理解等综合能力得到全面提升,其中在博士级难度的完整版人类最后的考试(Humanity’s Last Exam)、在考察模型真实软件工程能力的 SWE-Bench Pro、评估 Agent 深度检索能力的 DeepSearchQA 等基准测试中均取得行业领先的成绩,同时支持文本、图片与视频输入,思考与非思考模式,对话与 Agent 任务。

    Input
    ¥6.5/M
    Output
    ¥27/M
    Context
    256K
    2026-04-21 Listed
  • Qwen3.6-Max-Preview

    API ID:ali/qwen3.6-max-preview
    文本编程智能代理与数据学术与教育
    +3
    文本编程智能代理与数据学术与教育

    Qwen3.6系列中规模最大、综合能力最强的Max模型Preview版本,当前开放纯文本模型能力供体验。相较于此前发布的Qwen3-Max和Qwen3.6-Plus,本模型在vibe coding能力上进一步提升、coding agent执行更加高效、前端编程开发能力显著提升;长尾知识能力进一步升级。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤128k¥9/M token
    • 128k~256k¥15/M token

    输出

    • ≤128k¥54/M token
    • 128k~256k¥90/M token

    缓存读

    • ≤128k¥0.9/M token
    • 128k~256k¥1.5/M token

    缓存写(5m)

    • Public price¥18.75/M token

    缓存写(1h)

    • Public price¥18.75/M token
    2026-04-21 Listed
  • Claude Opus 4.7

    API ID:anthropic/claude-opus-4.7
    文本智能代理与数据编程多模态理解
    +3
    文本智能代理与数据编程多模态理解

    Opus 4.7 是 Anthropic Opus 系列的下一代产品,专为长时间运行的异步代理而设计。它在 Opus 4.6 的编码和代理功能优势基础上,显著提升了复杂多步骤任务的性能,并在扩展工作流中实现了更可靠的代理执行。对于任务随时间展开的异步代理管道(例如大型代码库、多阶段调试和端到端项目编排),Opus 4.7 尤为有效。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥43.75/M token

    缓存写(1h)

    • Public price¥70/M token
    2026-04-17 Listed
  • GLM-5.1

    API ID:bigmodel/glm-5.1
    文本编程智能代理与数据多模态理解
    +3
    文本编程智能代理与数据多模态理解

    GLM-5.1 是智谱最新旗舰模型,代码能力大大增强,长程任务显著提升,能够在单次任务中持续、自主地工作长达 8 小时,完成从规划、执行到迭代优化的完整闭环,交付工程级成果。 在综合能力与 Coding 能力上,GLM-5.1 整体表现对齐 Claude Opus 4.6,并在长程自主执行、复杂工程优化与真实开发场景中展现出更强的持续工作能力,是构建 Autonomous Agent 与长程 Coding Agent 的理想基座。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥6/M token
    • 32k~200k¥8/M token

    输出

    • ≤32k¥24/M token
    • 32k~200k¥28/M token

    缓存读

    • ≤32k¥1.2/M token
    • 32k~200k¥1.6/M token

    显式缓存命中

    • ≤32k¥0.6/M token
    • 32k~200k¥0.8/M token

    缓存写(5m)

    • ≤32k¥7.5/M token
    • 32k~200k¥10/M token
    2026-04-08 Listed
  • Gemini 3 Flash Preview

    API ID:google/gemini-3-flash
    文本智能代理与数据编程对话与客服多模态理解数学与科学
    +5
    文本智能代理与数据编程对话与客服多模态理解数学与科学

    Gemini 3 Flash Preview 旨在以极高的速度和性价比提供强大的代理功能(接近专业级)。它非常适合进行多轮对话,并能与您的编码代理进行流畅的双向协作。与 2.5 Flash 版本相比,它在各方面都实现了显著提升。 Gemini 3 型号是具有思考能力的模型,能够在做出反应之前进行推理,从而提高性能和准确性。

    Price
    Attribute-based pricing

    Attribute-based pricing

    音频·输入

    • Public price¥7/M token
    2025-12-18 Listed
  • Qwen3.6-Plus

    API ID:ali/qwen3.6-plus
    文本编程多模态理解图像与设计
    +3
    文本编程多模态理解图像与设计

    Qwen3.6原生视觉语言系列Plus模型,展现出与当前顶尖前沿模型相媲美的卓越性能,模型效果相较3.5系列显著提升。模型在Agentic coding、前端编程、Vibe coding等代码能力、多模态万物识别、OCR、物体定位等能力上显著增强。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤256k¥2/M token
    • 256k~1000k¥8/M token

    输出

    • ≤256k¥12/M token
    • 256k~1000k¥48/M token

    缓存读

    • ≤256k¥0.2/M token
    • 256k~1000k¥0.8/M token

    缓存写(5m)

    • Public price¥10/M token

    缓存写(1h)

    • Public price¥10/M token
    2026-04-02 Listed
  • Deepseek V3.2

    API ID:deepseek/deepseek-v3.2
    文本数学与科学编程智能代理与数据
    +3
    文本数学与科学编程智能代理与数据

    DeepSeek-V3.2 是一款大型语言模型,旨在兼顾高计算效率、强大的推理能力以及智能体工具使用性能。它引入了 DeepSeek 稀疏注意力机制 (DSA),这是一种细粒度的稀疏注意力机制,能够在长上下文场景下降低训练和推理成本,同时保持模型质量。可扩展的强化学习后训练框架进一步提升了推理能力,其性能已达到 GPT-5 的水平,并在 2025 年国际数学奥林匹克竞赛 (IMO) 和国际信息学奥林匹克竞赛 (IOI) 中荣获金奖。V3.2 还采用了大规模智能体任务合成流程,将推理更好地融入工具使用场景,从而提升模型在交互式环境中的适应性和泛化能力。

    Input
    ¥2/M
    Output
    ¥3/M
    Context
    128K
    2025-12-02 Listed
  • GPT-5.4-Nano

    API ID:openai/gpt-5.4-nano
    文本文档与办公编程智能代理与数据
    +3
    文本文档与办公编程智能代理与数据

    GPT-5.4-nano 是一款轻量化、超高效模型,专为大规模低延迟、低成本任务设计。GPT-5.4-nano 专为专业知识工作设计,包括文档和电子表格的创建、编码、数据分析、代理式工作流以及软件自动化。

    Input
    ¥1.4/M
    Output
    ¥8.75/M
    Context
    400K
    2026-03-19 Listed
  • GPT-5.4-Mini

    API ID:openai/gpt-5.4-mini
    文本编程文档与办公智能代理与数据多模态理解
    +4
    文本编程文档与办公智能代理与数据多模态理解

    GPT-5.4-mini 是一款紧凑、成本效益高的模型,旨在满足高流量日常 AI 工作负载的可靠性能。GPT-5.4-mini 专为专业知识工作设计,包括文档和电子表格的创建、编码、数据分析、代理式工作流程以及软件自动化。

    Input
    ¥5.25/M
    Output
    ¥31.5/M
    Context
    400K
    2026-03-19 Listed
  • MiniMax M2.1 lightning

    API ID:minimax/minimax-m2.1-lightning
    文本编程
    +1
    文本编程

    MiniMax-M2.1-lightning,强大多语言编程实力,全面升级编程体验,更快的速度。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥2.625/M token
    2025-12-23 Listed
  • MiniMax M2.7

    API ID:minimax/minimax-m2.7
    文本编程文档与办公智能代理与数据对话与客服
    +4
    文本编程文档与办公智能代理与数据对话与客服

    M2.7 在真实的软件工程中有优异的表现,包括端到端的完整项目交付,分析日志排查 Bug、代码安全,机器学习等。 在专业办公领域,我们提升了模型在各领域的专业知识和任务交付能力,在 GDPval-AA 的ELO得分是1495,为开源最高。M2.7 对 Office 三件套 Excel/PPT/Word 的复杂编辑能力显著提升,能更好地完成多轮修改和高保真的编辑。 M2.7具备与复杂环境交互的能力,M2.7 在 40 个复杂 skills (> 2000 Token) 的 case 上,仍能保持 97% 的 skills 遵循率。在OpenClaw的使用中,M2.7相比于M2.5也有了显著的提升,在MMClaw的评测中接近最新的Sonnet 4.6。 M2.7具备优秀的身份保持能力和情商,除了生产力使用外,给互动娱乐场景的创新也准备了空间。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥2.625/M token
    2026-03-18 Listed
  • GLM-5-Turbo

    API ID:bigmodel/glm-5-turbo
    文本智能代理与数据
    +1
    文本智能代理与数据

    GLM-5-Turbo 是面向 OpenClaw 龙虾场景深度优化的基座模型。 其从训练阶段就针对龙虾任务的核心需求进行专项优化,增强如工具调用、指令遵循、定时与持续性任务、长链路执行等核心能力,使其在复杂、动态、长链路的任务中也真正具备可执行性。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥5/M token
    • 32k~不限¥7/M token

    输出

    • ≤32k¥22/M token
    • 32k~不限¥26/M token

    缓存读

    • ≤32k¥1.2/M token
    • 32k~不限¥1.8/M token
    2026-03-16 Listed
  • Qwen3.5-Flash

    API ID:ali/qwen3.5-flash
    文本对话与客服内容创作文档与办公学术与教育编程
    +5
    文本对话与客服内容创作文档与办公学术与教育编程

    Qwen3.5原生视觉语言系列Flash模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。模型效果在纯文本与多模态方面相较3系列均实现飞跃式进步;响应速度快,兼具推理速度和性能。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤128k¥0.2/M token
    • 128k~256k¥0.8/M token
    • 256k~1000k¥1.2/M token

    输出

    • ≤128k¥2/M token
    • 128k~256k¥8/M token
    • 256k~1000k¥12/M token

    缓存读

    • ≤128k¥0.02/M token
    • 128k~256k¥0.08/M token
    • 256k~1000k¥0.12/M token
    2026-03-15 Listed
  • Claude Opus 5.5

    API ID:anthropic/claude-opus-5.5
    文本多模态理解智能代理与数据编程数学与科学
    +4
    文本多模态理解智能代理与数据编程数学与科学

    Claude Opus 5.5 是 Anthropic 推出的旗舰模型,用于高难度推理、代码开发以及长周期智能体任务,为 Claude Opus 5 的迭代版本。该模型在大型代码库的多步修改、代码审查与漏洞查找、金融和科学分析,以及读取信息密集的图表、示意图和截图方面表现尤为突出。相比前代产品,它更加严谨,仅陈述可佐证的数据并标注对应的信息来源。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥35/M token

    缓存写(1h)

    • Public price¥56/M token
    2026-09-23 Listed
  • Claude Sonnet 5.5

    API ID:anthropic/claude-sonnet-5.5
    文本编程智能代理与数据文档与办公多模态理解图像与设计
    +5
    文本编程智能代理与数据文档与办公多模态理解图像与设计

    Claude Sonnet 5.5是Anthropic旗下Sonnet系列模型,适用于范围明确的日常工作,作为Claude Sonnet 5的直接升级版。该模型在功能开发、漏洞修复以及生成精美的文档、幻灯片和电子表格方面表现尤为突出,相比前代模型,其文字撰写与表达沟通能力更强。思考功能默认开启,因此可通过调整算力投入,在推理深度、响应延迟与使用成本之间做权衡;调低算力投入设置,能够保证模型在日常智能代理任务循环中保持较快响应速度。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥17.5/M token

    缓存写(1h)

    • Public price¥28/M token
    2026-09-29 Listed
  • Qwen3-Max-2026-01-23

    API ID:ali/qwen3-max-2026-01-23
    文本对话与客服编程智能代理与数据内容创作学术与教育
    +5
    文本对话与客服编程智能代理与数据内容创作学术与教育

    通义千问3系列Max模型,相较2025年9月23日快照,此版本实现思考模式和非思考模式的有效融合,模型整体效果得到全方位的大幅度提升。在思考模式下,同时发布Web搜索、Web信息提取和代码解释器工具能力,使得模型在慢思考的同时,能够通过引入外部工具,以更高的准确性解决更有难度的问题。此版本为2026年1月23日快照。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥2.5/M token
    • ≤128k¥4/M token
    • 128k~256k¥7/M token

    输出

    • ≤32k¥1/M token
    • ≤128k¥16/M token
    • 128k~256k¥28/M token

    search_strategy:agent

    • Public price¥0.004/次调用

    search_strategy:agent_max

    • Public price¥0.004/次调用

    web_search

    • Public price¥0.004/次调用
    2026-01-27 Listed
  • Kimi K2.5

    API ID:moonshot/kimi-k2.5
    文本编程多模态理解智能代理与数据
    +3
    文本编程多模态理解智能代理与数据

    Kimi K2.5 是 Kimi 迄今最智能的模型,在 Agent、代码、视觉理解及一系列通用智能任务上取得开源 SoTA 表现。同时 Kimi K2.5 也是 Kimi 迄今最全能的模型,原生的多模态架构设计,同时支持视觉与文本输入、思考与非思考模式、对话与 Agent 任务。 Kimi K2.5 在原有全栈开发与工具生态优势基础上,进一步强化前端代码质量与设计表现力前端能力,实现了跨越式突破,支持从自然语言直接生成功能完整、视觉精美的交互界面,并能精准处理动态布局、滚动动画等复杂效果。

    Input
    ¥4/M
    Output
    ¥21/M
    Context
    256K
    2026-01-27 Listed
  • Claude Opus 4.6

    API ID:anthropic/claude-opus-4.6
    文本编程智能代理与数据
    +2
    文本编程智能代理与数据

    Opus 4.6 是 Anthropic 最强的代码生成和长期专业任务模型。它专为跨整个工作流运行的代理而构建,而不是单个提示,这使得它在大型代码库、复杂的重构和随着时间推移展开的多步骤调试方面特别有效。该模型比之前的模型表现出更深入的上下文理解、更强的问题分解能力,以及在工程任务难度较高的情况下更可靠的可靠性。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥43.75/M token

    缓存写(1h)

    • Public price¥70/M token
    2026-02-06 Listed
  • GPT-5.4

    API ID:openai/gpt-5.4
    文本编程智能代理与数据文档与办公多模态理解
    +4
    文本编程智能代理与数据文档与办公多模态理解

    GPT-5.4 是 OpenAI 最新的前沿模型,将 Codex 和 GPT 系列整合为一个系统。它配备了 1M+令牌上下文窗口(922K 输入,128K 输出),支持文本和图像输入,支持同一工作流程中的高上下文推理、编码和多模态分析。该模型在编码、文档理解、工具使用和指令执行方面提供了更好的性能。它被设计为通用任务和软件工程的强默认选项,能够生成生产质量的代码,综合多个来源的信息,并以更少的迭代和更高的令牌效率执行复杂的多步工作流程。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤272k¥17.5/M token
    • 272k~不限¥35/M token

    输出

    • ≤272k¥105/M token
    • 272k~不限¥157.5/M token

    缓存读

    • ≤272k¥1.75/M token
    • 272k~不限¥3.5/M token
    2026-03-06 Listed
  • GPT-5.3 Chat

    API ID:openai/gpt-5.3-chat
    文本对话与客服
    +1
    文本对话与客服

    GPT-5.3 Chat 是对 ChatGPT 最常用模型的升级,使日常对话更加流畅、实用且直接实用。它能提供更准确的答案,更好地提供上下文,显著减少不必要的拒绝、附加条件和过于谨慎的措辞,避免打断对话流畅。

    Input
    ¥12.25/M
    Output
    ¥98/M
    Context
    400K
    2026-03-06 Listed
  • GPT 5.3 Codex

    API ID:openai/gpt-5.3-codex
    文本编程智能代理与数据多模态理解数学与科学
    +4
    文本编程智能代理与数据多模态理解数学与科学

    GPT-5.3-Codex 将先进的编码能力、更广泛的推理和专业问题解决整合在一个专为真实工程工作打造的单一模型中。它将 GPT-5.2-Codex 的前沿编码性能与 GPT5.2 的推理和专业知识能力整合到一个系统中。这使得体验从优化孤立输出转向支持更长时间的开发工作;当仓库庞大、变更跨越多个步骤,且需求不总是在一开始就完全明确时。

    Input
    ¥12.25/M
    Output
    ¥98/M
    Context
    400K
    2026-03-04 Listed

24 / 213 models loaded

←Previous
  1. 1
  2. …
  3. 3
  4. 4
  5. 5
  6. …
  7. 9
Page 4 of 9Next→
General filters0
Use case

No matching options

Provider

No matching options

Input modality
Minimum context
General filters