Loading…
Skip to main content
The new Enterprise Gateway is live. Start your free trial today.View details
Modelmesh
Core products
LoomLoomSkillApp MarketEnterprise AI GatewayAI Chat
Model Marketplace
Model CenterDeveloper Models
Cloud Factory
AI Model DeploymentCloud AI Cluster
Agent accessCommunityAbout us
DocsConsoleChinese
DocsConsoleChinese
Log in / Sign upChecking…
Activate Enterprise GatewayProDedicated high-performance resources and support
Primary account:—
Account rechargeAPI keysEarnings
Personal settings

Redeem voucher

ModelmeshModelmesh navigation
DocsConsoleChinese
Log in / Sign up
Checking…

Model Center

Explore 336 models with public pricing, capabilities, and context information. Actual pricing may vary when routed to different providers; see model details for more pricing information.

214/ 336models
Sort
Price comparison
All文本图像生成视频生成音频生成音频转录3D生成向量化重排决策
  • GPT 5.3 Codex

    API ID:openai/gpt-5.3-codex
    文本编程智能代理与数据多模态理解数学与科学
    +4
    文本编程智能代理与数据多模态理解数学与科学

    GPT-5.3-Codex 将先进的编码能力、更广泛的推理和专业问题解决整合在一个专为真实工程工作打造的单一模型中。它将 GPT-5.2-Codex 的前沿编码性能与 GPT5.2 的推理和专业知识能力整合到一个系统中。这使得体验从优化孤立输出转向支持更长时间的开发工作;当仓库庞大、变更跨越多个步骤,且需求不总是在一开始就完全明确时。

    Input
    ¥12.25/M
    Output
    ¥98/M
    Context
    400K
    2026-03-04 Listed
  • Gemini 3.1 Flash Lite Preview

    API ID:google/gemini-3.1-flash-lite-preview
    文本对话与客服内容创作文档与办公编程数学与科学
    +5
    文本对话与客服内容创作文档与办公编程数学与科学

    Gemini 3.1 Flash-Lite 是谷歌最具成本效益的 Gemini 型号,针对低延迟、高成本的大型语言模型流量进行了优化。它相比 Gemini 2.0/2.5 Flash-Lite 型号实现了显著的质量提升,在关键能力领域的性能与 Gemini 2.5 闪存相当。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥0.581/M token
    2026-03-04 Listed
  • Qwen3.5-397B-A17B

    API ID:ali/qwen3.5-397b-a17b
    文本编程多模态理解智能代理与数据数学与科学
    +4
    文本编程多模态理解智能代理与数据数学与科学

    Qwen3.5系列397B-A17B原生视觉语言模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。在语言理解、逻辑推理、代码生成、智能体任务、图像理解、视频理解、图形用户界面(GUI)等多种任务中,均展现出与当前顶尖前沿模型相媲美的卓越性能。具备强大的代码生成与智能体能力,对于各类智能体场景具有良好的泛化性。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤128k¥1.2/M token
    • 128k~256k¥3/M token

    输出

    • ≤128k¥7.2/M token
    • 128k~256k¥18/M token
    2026-02-24 Listed
  • Qwen3.5-Plus

    API ID:ali/qwen3.5-plus
    文本多模态理解编程文档与办公内容创作对话与客服
    +5
    文本多模态理解编程文档与办公内容创作对话与客服

    Qwen3.5原生视觉语言系列Plus模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。在多项任务评测中,3.5系列均展现出与当前顶尖前沿模型相媲美的卓越性能,模型效果在纯文本与多模态方面相较3系列均实现飞跃式进步。

    Input
    ¥2/M
    Output
    ¥3/M
    Context
    128K
    2026-02-24 Listed
  • Gemini 3.1 Pro Preview

    API ID:google/gemini-3.1-pro-preview
    文本编程智能代理与数据多模态理解文档与办公数学与科学
    +5
    文本编程智能代理与数据多模态理解文档与办公数学与科学

    Gemini 3.1 Pro Preview 专为高级开发和智能体系统而设计,在提升令牌效率的同时,增强了长期稳定性、工具编排能力。它引入了一种新的中间思维模式,以更好地平衡成本、速度和性能。该模型在智能体编码、结构化规划、多模态分析和工作流自动化方面表现出色,因此非常适合自主智能体、金融建模、电子表格自动化和高上下文企业任务。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤200k¥14/M token
    • 200k~不限¥28/M token

    输出

    • ≤200k¥84/M token
    • 200k~不限¥126/M token

    缓存读

    • ≤200k¥1.4/M token
    • 200k~不限¥2.8/M token
    2026-02-21 Listed
  • Claude Sonnet 4.6

    API ID:anthropic/claude-sonnet-4.6
    文本编程智能代理与数据文档与办公
    +3
    文本编程智能代理与数据文档与办公

    Sonnet 4.6 是 Anthropic 迄今为止最强大的 Sonnet 级模型,在编码、代理和专业工作领域表现出色。它擅长迭代开发、复杂的代码库导航、带内存的端到端项目管理、精致的文档创建,以及自信的网页质量保证和工作流程自动化的计算机使用。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥26.25/M token

    缓存写(1h)

    • Public price¥42/M token
    2026-02-18 Listed
  • KAT-Coder-Exp-72B-1010

    API ID:streamlake/kat-coder-exp-72b-1010
    文本编程智能代理与数据
    +2
    文本编程智能代理与数据

    KAT-Coder-Exp-72B 是 KAT-Coder 系列模型中的 RL 创新实验版本,在软件开发能力评测基准 SWE-Bench verified 上取得了 74.6% 的卓越性能,创下开源模型新纪录。专注于 Agentic Coding,目前仅支持 SWE-Agent 脚手架,也可进行简单对话。

    Input
    ¥0.0001/M
    Output
    ¥0/M
    Context
    128K
    2025-11-13 Listed
  • Qwen3-Max

    API ID:ali/qwen3-max
    文本编程数学与科学智能代理与数据多模态理解翻译
    +5
    文本编程数学与科学智能代理与数据多模态理解翻译

    Qwen3-Max 是在 Qwen3 系列的基础上构建的更新版本,与 2025 年 1 月版本相比,在推理、指令遵循、多语言支持和长尾知识覆盖方面进行了重大改进。它在数学、编码、逻辑和科学任务中提供更高的准确性,更可靠地遵循复杂的中文和英文指令,减少幻觉,并为开放式问答、写作和对话提供更高质量的回答。该模型支持 100 多种语言,具有更强的翻译和常识推理能力,并针对检索增强生成 (RAG) 和工具调用进行了优化,尽管它不包括专用的“思考”模式。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥2.5/M token
    • 32k~128k¥4/M token
    • 128k~256k¥7/M token

    输出

    • ≤32k¥10/M token
    • 32k~128k¥16/M token
    • 128k~256k¥28/M token

    缓存读

    • ≤32k¥0.5/M token
    • 32k~128k¥0.8/M token
    • 128k~256k¥1.4/M token

    i2i_search

    • Public price¥0.004/次调用

    t2i_search

    • Public price¥0.004/次调用

    web_search

    • Public price¥0.004/次调用

    显式缓存命中

    • ≤32k¥0.25/M token
    • 32k~256k¥4/M token
    • 256k~1000k¥0.7/M token

    缓存写(5m)

    • ≤32k¥3.125/M token
    • 32k~256k¥5/M token
    • 256k~1000k¥8.75/M token
    2025-09-24 Listed
  • Doubao-Seed-2.0-pro

    API ID:bytedance/doubao-seed-2-0-pro
    文本多模态理解智能代理与数据数学与科学文档与办公对话与客服
    +5
    文本多模态理解智能代理与数据数学与科学文档与办公对话与客服

    旗舰级全能通用模型,面向 Agent 时代的复杂推理与长链路任务执行场景。强调多模态理解、长上下文推理、结构化生成与工具增强执行。复杂指令与多约束执行能力突出,可稳定应对多步复杂规划、复杂图文推理、视频内容理解与高难度分析等场景。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥3.2/M token
    • 32k~128k¥4.8/M token
    • 128k~256k¥9.6/M token

    输出

    • ≤32k¥16/M token
    • 32k~128k¥24/M token
    • 128k~256k¥48/M token

    缓存读

    • ≤32k¥0.64/M token
    • 32k~128k¥0.96/M token
    • 128k~256k¥1.92/M token
    2026-03-14 Listed
  • Doubao-Seed-2.0-mini

    API ID:bytedance/doubao-seed-2-0-mini
    文本多模态理解对话与客服文档与办公内容创作翻译
    +5
    文本多模态理解对话与客服文档与办公内容创作翻译

    面向低时延、高并发与成本敏感场景,提供极致的模型推理速度。模型效果与Doubao-Seed-1.6相当。支持256k上下文、4档思考长度和多模态理解,适合成本和速度优先的轻量级任务。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥0.2/M token
    • 32k~128k¥0.4/M token
    • 128k~256k¥0.8/M token

    输出

    • ≤32k¥2/M token
    • 32k~128k¥4/M token
    • 128k~256k¥8/M token

    缓存读

    • ≤32k¥0.04/M token
    • 32k~128k¥0.08/M token
    • 128k~256k¥0.16/M token
    2026-03-14 Listed
  • Qwen3-Max-Preview

    API ID:ali/qwen3-max-preview
    文本数学与科学编程翻译学术与教育对话与客服
    +5
    文本数学与科学编程翻译学术与教育对话与客服

    Qwen3-Max-Preview是阿里巴巴旗下通义千问团队发布的最新旗舰大语言模型,是 Qwen3 系列中参数量最大的模型,参数规模超过1万亿。模型在推理、指令跟随、多语言支持和长尾知识覆盖等方面有重大改进,支持超过100种语言,中英文理解能力出色。在数学推理、编程和科学推理等任务中表现出色,能更可靠地遵循复杂指令,减少幻觉,生成更高质量的响应。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥6/M token
    • 32k~128k¥10/M token
    • 128k~不限¥15/M token

    输出

    • ≤32k¥24/M token
    • 32k~128k¥40/M token
    • 128k~不限¥60/M token

    缓存读

    • ≤32k¥1.2/M token
    • 32k~128k¥2/M token
    • 128k~不限¥3/M token
    2025-09-08 Listed
  • Doubao-Seed-2.0-lite

    API ID:bytedance/doubao-seed-2-0-lite
    文本文档与办公内容创作智能代理与数据多模态理解
    +4
    文本文档与办公内容创作智能代理与数据多模态理解

    面向高频企业场景兼顾性能与成本的均衡型模型,综合能力超越上一代Doubao-Seed-1.8。胜任非结构化信息处理、内容创作、搜索推荐、数据分析等生产型工作,支持长上下文、多源信息融合、多步指令执行与高保真结构化输出。在保障稳定效果的同时显著优化成本。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥0.6/M token
    • 32k~128k¥0.9/M token
    • 128k~256k¥1.8/M token

    输出

    • ≤32k¥3.6/M token
    • 32k~128k¥5.4/M token
    • 128k~256k¥10.8/M token

    缓存读

    • ≤32k¥0.12/M token
    • 32k~128k¥0.18/M token
    • 128k~256k¥0.36/M token
    2026-03-14 Listed
  • Qwen3-Omni-Flash

    API ID:ali/qwen3-omni-flash
    文本对话与客服内容创作翻译编程文档与办公
    +5
    文本对话与客服内容创作翻译编程文档与办公

    Qwen-Omni 模型能够接收文本、图片、音频、视频等多种模态的组合输入,并生成文本或语音形式的回复, 提供多种拟人音色,支持多语言和方言的语音输出,可应用于文本创作、视觉识别、语音助手等场景。

    Input
    ¥1.8/M
    Output
    ¥6.9/M
    Context
    65.5K
    2025-09-23 Listed
  • Grok 4.7

    API ID:x-ai/grok-4.7
    文本智能代理与数据文档与办公编程
    +3
    文本智能代理与数据文档与办公编程

    Grok 4.7是SpaceXAI面向代码编写、智能代理任务以及知识类工作推出的旗舰模型,为Grok 4.6的迭代版本。该模型在长时间软件工程任务、自我工作校验以及长上下文处理方面表现突出,相较于前代产品,在文档撰写、演示文稿制作等专业知识工作上的能力有所提升。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤200k¥11.2/M token
    • 200k~不限¥22.4/M token

    输出

    • ≤200k¥33.6/M token
    • 200k~不限¥67.2/M token

    显式缓存命中

    • ≤200k¥2.8/M token
    • 200k~不限¥5.6/M token
    2026-09-23 Listed
  • Doubao-Seed-2.0-Code

    API ID:bytedance/doubao-seed-2-0-code
    文本编程智能代理与数据多模态理解
    +3
    文本编程智能代理与数据多模态理解

    面向真实编程环境优化的 Coding 模型,能稳定调用 Claude Code 等常见 IDE 中的工具。模型特别优化了前端能力,在使用常见的前端框架时能有良好表现。模型支持使用 Skills,可以配合多种自定义技能使用。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥3.2/M token
    • 32k~128k¥4.8/M token
    • 128k~256k¥9.6/M token

    输出

    • ≤32k¥16/M token
    • 32k~128k¥24/M token
    • 128k~256k¥48/M token

    缓存读

    • ≤32k¥0.64/M token
    • 32k~128k¥0.96/M token
    • 128k~256k¥1.92/M token
    2026-03-14 Listed
  • Doubao-Seed-1.8

    API ID:bytedance/doubao-seed-1.8
    文本多模态理解智能代理与数据对话与客服
    +3
    文本多模态理解智能代理与数据对话与客服

    全新面向多模态 Agent 场景定向优化模型。更强Agent能力、升级多模态理解、更灵活的上下文管理。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥0.8/M token
    • 32k~128k¥1.2/M token
    • 128k~不限¥2.4/M token

    输出

    • ≤32k¥8/M token
    • 32k~128k¥16/M token
    • 128k~不限¥24/M token

    缓存读

    • ≤32k¥0.16/M token
    • 32k~128k¥0.16/M token
    • 128k~不限¥0.16/M token
    2025-12-18 Listed
  • MiniMax M2.7-highspeed

    API ID:minimax/minimax-m2.7-highspeed
    文本编程文档与办公智能代理与数据多模态理解对话与客服
    +5
    文本编程文档与办公智能代理与数据多模态理解对话与客服

    M2.7 在真实的软件工程中有优异的表现,包括端到端的完整项目交付,分析日志排查 Bug、代码安全,机器学习等。 在专业办公领域,我们提升了模型在各领域的专业知识和任务交付能力,在 GDPval-AA 的ELO得分是1495,为开源最高。M2.7 对 Office 三件套 Excel/PPT/Word 的复杂编辑能力显著提升,能更好地完成多轮修改和高保真的编辑。 M2.7具备与复杂环境交互的能力,M2.7 在 40 个复杂 skills (> 2000 Token) 的 case 上,仍能保持 97% 的 skills 遵循率。在OpenClaw的使用中,M2.7相比于M2.5也有了显著的提升,在MMClaw的评测中接近最新的Sonnet 4.6。 M2.7具备优秀的身份保持能力和情商,除了生产力使用外,给互动娱乐场景的创新也准备了空间。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥2.625/M token
    2026-03-18 Listed
  • Grok 4.6

    API ID:x-ai/grok-4.6
    文本文档与办公编程数学与科学
    +3
    文本文档与办公编程数学与科学

    Grok 4.6 是 SpaceXAI 目前最先进的智能模型,在编程、知识处理以及 STEM 领域都表现出色。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤200k¥14/M token
    • 200k~不限¥28/M token

    输出

    • ≤200k¥42/M token
    • 200k~不限¥84/M token

    显式缓存命中

    • ≤200k¥3.5/M token
    • 200k~不限¥7/M token
    2026-08-14 Listed
  • Grok 4.1 Fast

    API ID:x-ai/grok-4.1-fast
    文本智能代理与数据对话与客服
    +2
    文本智能代理与数据对话与客服

    Grok 4.1 Fast 是 xAI 最好的代理工具调用模型,在客户支持和深入研究等实际应用场景中表现出色。200 万上下文窗口。

    Input
    ¥1.4/M
    Output
    ¥3.5/M
    Context
    2M
    2026-03-23 Listed
  • GLM-5V-Turbo

    API ID:bigmodel/glm-5v-turbo
    文本编程智能代理与数据多模态理解
    +3
    文本编程智能代理与数据多模态理解

    GLM-5V-Turbo 是智谱首个多模态 Coding 基座模型,面向视觉编程任务打造。能够原生处理图片、视频、文本等多模态输入,同时擅长长程规划、复杂编程和动作执行;深度适配 Agent 工作流,能够与 Claude Code、OpenClaw 等 Agent 深度协同,完成”看懂环境→规划动作→执行任务”的完整闭环。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥5/M token
    • 32k~不限¥7/M token

    输出

    • ≤32k¥22/M token
    • 32k~不限¥26/M token

    缓存读

    • ≤32k¥1.2/M token
    • 32k~不限¥1.8/M token
    2026-04-03 Listed
  • Qwen3-VL-Plus

    API ID:ali/qwen3-vl-plus
    文本多模态理解图像与设计视频与3D智能代理与数据编程
    +5
    文本多模态理解图像与设计视频与3D智能代理与数据编程

    Qwen3系列视觉理解模型,实现思考模式和非思考模式的有效融合,视觉智能体能力在OS World等公开测试集上达到世界顶尖水平。此版本在视觉coding、空间感知、多模态思考等方向全面升级;视觉感知与识别能力大幅提升,支持超长视频理解。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥1/M token
    • 32k~128k¥1.5/M token
    • 128k~256k¥3/M token

    输出

    • ≤32k¥10/M token
    • 32k~128k¥15/M token
    • 128k~256k¥30/M token

    缓存读

    • ≤32k¥0.2/M token
    • 32k~128k¥0.3/M token
    • 128k~256k¥0.6/M token

    显式缓存命中

    • ≤32k¥0.1/M token
    • 32k~256k¥0.15/M token
    • 256k~1000k¥0.3/M token

    缓存写(5m)

    • ≤32k¥1.25/M token
    • 32k~256k¥1.875/M token
    • 256k~1000k¥3.75/M token
    2025-09-24 Listed
  • Grok 4 Fast

    API ID:x-ai/grok-4-fast
    文本多模态理解文档与办公数学与科学
    +3
    文本多模态理解文档与办公数学与科学

    Grok 4 Fast 是 xAI 最新的多模态模型,具有 SOTA 成本效益和 2M 令牌上下文窗口。它有两种类型:非推理和推理。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤128k¥1.4/M token
    • 128k~不限¥2.8/M token

    输出

    • ≤128k¥3.5/M token
    • 128k~不限¥7/M token

    缓存读

    • ≤128k¥0.35/M token
    • 128k~不限¥0.35/M token
    2025-09-29 Listed
  • Qwen-VL-OCR

    API ID:ali/qwen-vl-ocr
    文本多模态理解文档与办公图像与设计
    +3
    文本多模态理解文档与办公图像与设计

    通义千问VL-OCR(qwen-vl-ocr),即基于Qwen-VL训练的OCR识别大模型。通过统一模型的方式聚合多种图文识别、解析、处理类任务,提供强大的图文识别能力。

    Input
    ¥0.3/M
    Output
    ¥0.5/M
    Context
    32K
    2025-11-28 Listed
  • DeepSeek-OCR

    API ID:deepseek/deepseek-ocr
    文本图像与设计多模态理解文档与办公
    +3
    文本图像与设计多模态理解文档与办公

    DeepSeek-OCR 是 DeepSeek AI 发布的视觉语言模型,旨在探索视觉-文本压缩边界,专注于文档识别及图像转文本场景的解决方案 。该模型可将长文本渲染为高压缩比图像,在 10 倍无损压缩下能实现 97% 的 OCR 准确率,即使压缩到 20 倍也能保持约 60% 的准确率。

    Input
    ¥0.0001/M
    Output
    ¥0/M
    Context
    0
    2025-11-28 Listed

24 / 214 models loaded

←Previous
  1. 1
  2. …
  3. 4
  4. 5
  5. 6
  6. …
  7. 9
Page 5 of 9Next→
General filters0
Use case

No matching options

Provider

No matching options

Input modality
Minimum context
General filters