Loading…
Skip to main content
The new Enterprise Gateway is live. Start your free trial today.View details
Modelmesh
Core products
LoomLoomSkillApp MarketEnterprise AI GatewayAI Chat
Model Marketplace
Model CenterDeveloper Models
Cloud Factory
AI Model DeploymentCloud AI Cluster
Agent accessCommunityAbout us
DocsConsoleChinese
DocsConsoleChinese
Log in / Sign upChecking…
Activate Enterprise GatewayProDedicated high-performance resources and support
Primary account:—
Account rechargeAPI keysEarnings
Personal settings

Redeem voucher

ModelmeshModelmesh navigation
DocsConsoleChinese
Log in / Sign up
Checking…

Model Center

Explore 335 models with public pricing, capabilities, and context information. Actual pricing may vary when routed to different providers; see model details for more pricing information.

213/ 335models
Sort
Price comparison
All文本图像生成视频生成音频生成音频转录3D生成向量化重排决策
  • DeepSeek-V4-Flash-Vision-Exp

    API ID:deepseek/deepseek-v4-flash-vision-exp
    文本多模态理解智能代理与数据文档与办公
    +3
    文本多模态理解智能代理与数据文档与办公

    DeepSeek V4 Flash Vision Exp是DeepSeek推出的DeepSeek V4 Flash 0731实验版视觉能力版本,新增图像理解能力,同时在智能代理、推理以及世界知识等文本能力方面与基础模型保持同等水平。该模型为稀疏混合专家模型,总参数量2840亿,激活参数量130亿。适用于文档与图表理解、视觉问答,以及文本与图像交替处理的多模态智能代理工作流。

    Input
    ¥1/M
    Output
    ¥4/M
    Context
    1M
    2026-08-24 Listed
  • GLM-5.3

    API ID:bigmodel/glm-5.3
    文本智能代理与数据编程
    +2
    文本智能代理与数据编程

    GLM-5.3 是智谱最新旗舰模型,复杂软件工程与 Agent 任务能力全面进阶。它使用与 GLM-5.2 相同的基础模型——所有提升均来自后训练。与 GLM-5.2 相比,它在复杂编程和长程任务方面表现更加出色。

    Input
    ¥8/M
    Output
    ¥28/M
    Context
    1M
    2026-08-19 Listed
  • Qwen3.8 27B

    API ID:ali/qwen3.8-27b
    文本多模态理解智能代理与数据文档与办公编程数学与科学
    +5
    文本多模态理解智能代理与数据文档与办公编程数学与科学

    Qwen3.8 27B是通义千问推出的一款开放权重稠密多模态视觉语言模型。该模型适用于代码编写、专业工作流程、科研、多模态交互以及长时间运行的智能体任务,可开启或关闭灵活思考能力。

    Input
    ¥3/M
    Output
    ¥12/M
    Context
    1M
    2026-08-17 Listed
  • KAT-Coder-Pro-V1

    API ID:streamlake/kat-coder-pro-v1
    文本编程智能代理与数据
    +2
    文本编程智能代理与数据

    专为 Agentic Coding 设计,全面覆盖编程任务与场景,通过大规模智能体强化学习,实现智能行为涌现,在代码编写性能上显著超越同类模型。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥4/M token
    • 32k~128k¥6/M token
    • 128k~不限¥10/M token

    输出

    • ≤32k¥16/M token
    • 32k~128k¥24/M token
    • 128k~不限¥40/M token

    缓存读

    • ≤32k¥0.8/M token
    • 32k~128k¥1.2/M token
    • 128k~不限¥2/M token
    2025-11-13 Listed
  • GPT-5.1

    API ID:openai/gpt-5.1
    文本编程数学与科学智能代理与数据对话与客服多模态理解
    +5
    文本编程数学与科学智能代理与数据对话与客服多模态理解

    GPT-5.1 是 GPT-5 系列的最新前沿模型,与 GPT-5 相比,它拥有更强大的通用推理能力、更高的指令遵循度以及更自然的对话风格。它采用自适应推理技术动态分配计算资源,能够快速响应简单查询,同时在处理复杂任务时投入更多精力。该模型能够生成更清晰、更贴近实际的解释,减少专业术语的使用,即使是技术性或多步骤问题也更容易理解。 GPT-5.1 旨在覆盖广泛的任务,在数学、编程和结构化分析等工作负载方面均取得了持续的提升,能够提供更连贯的长篇答案,并提高工具使用的可靠性。它还改进了对话对齐方式,能够在不牺牲准确性的前提下,提供更亲切、更直观的回答。GPT-5.1 是 GPT-5 的主要全功能继任者。

    Input
    ¥8.75/M
    Output
    ¥70/M
    Context
    400K
    2025-11-19 Listed
  • DeepSeek-V4-Pro-0813

    API ID:deepseek/deepseek-v4-pro
    文本智能代理与数据编程数学与科学
    +3
    文本智能代理与数据编程数学与科学

    DeepSeek V4 Pro 是 DeepSeek 推出的大型专家混合模型,它专为高级推理、编码和长远视野代理工作流设计,在知识、数学和软件工程基准测试中表现出色。它基于与 DeepSeek V4 Flash 相同的架构,引入了混合注意力系统,实现高效的长上下文处理,并支持多种推理模式,根据任务平衡速度和深度。它非常适合复杂工作负载,如全代码库分析、多步自动化和大规模信息综合,这些工作在能力和效率上都至关重要。

    Input
    ¥4.5/M
    Output
    ¥13.5/M
    Context
    1M
    2026-08-14 Listed
  • Qwen3.7-Flash

    API ID:ali/qwen3.7-flash
    文本多模态理解智能代理与数据编程
    +3
    文本多模态理解智能代理与数据编程

    Qwen3.7原生视觉语言系列Flash模型,相较3.6-Flash全面提升多模态理解与Agent执行能力。重点强化多模态基础能力、万物识别能力更强,真实世界感知与空间智能进一步提升,Search Agent、CI Agent等多模态Agent场景能力显著升级、端到端任务执行更稳定,多模态Coding能力优化、vibe coding 体验更加流畅。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥0.2/M token
    • 32k~256k¥0.8/M token
    • 256k~1000k¥1.2/M token

    输出

    • ≤32k¥2/M token
    • 32k~256k¥8/M token
    • 256k~1000k¥12/M token

    缓存读

    • ≤32k¥0.02/M token
    • 32k~256k¥0.08/M token
    • 256k~1000k¥0.12/M token

    i2i_search

    • Public price¥0.048/次调用

    t2i_search

    • Public price¥0.024/次调用

    web_search

    • Public price¥0.004/次调用

    显式缓存命中

    • ≤32k¥0.02/M token
    • 32k~256k¥0.06/M token
    • 256k~1000k¥0.12/M token

    缓存写(5m)

    • ≤32k¥0.25/M token
    • 32k~256k¥0.75/M token
    • 256k~1000k¥1.5/M token
    2026-08-12 Listed
  • Qwen3.5-4B

    API ID:ali/qwen3.5-4b
    文本多模态理解智能代理与数据
    +2
    文本多模态理解智能代理与数据

    Qwen3.5-4B 是通义千问团队推出的原生多模态大语言模型,拥有 4B 参数,是 Qwen3.5 系列中最轻量的 Dense 模型。该模型采用门控 Delta 网络与门控注意力相结合的高效混合架构,原生支持 256K 上下文长度,并可扩展至约 100 万 tokens。模型通过早期融合训练实现了统一的视觉语言基础能力,支持文本、图像和视频理解,在同规模模型中表现优异,多项指标超越 GPT-5-Nano 和 Gemini-2.5-Flash-Lite。模型默认启用思考模式(Thinking Mode),支持工具调用,并覆盖 201 种语言和方言

    Input
    ¥0/M
    Output
    ¥0/M
    Context
    256K
    2026-08-05 Listed
  • Qwen3.5-9B

    API ID:ali/qwen3.5-9b
    文本多模态理解智能代理与数据
    +2
    文本多模态理解智能代理与数据

    Qwen3.5-9B 是通义千问团队推出的原生多模态大语言模型,拥有 9B 参数。作为 Qwen3.5 系列的轻量级 Dense 模型,它采用门控 Delta 网络与门控注意力相结合的高效混合架构,原生支持 256K 上下文长度,并可扩展至约 100 万 tokens。模型通过早期融合训练实现了统一的视觉语言基础能力,支持文本、图像和视频理解。模型默认启用思考模式(Thinking Mode),支持工具调用,并覆盖 201 种语言和方言

    Input
    ¥0.5/M
    Output
    ¥1.5/M
    Context
    256K
    2026-08-05 Listed
  • Qwen3.5-27B

    API ID:ali/qwen3.5-27b
    文本多模态理解
    +1
    文本多模态理解

    Qwen3.5系列27B原生视觉语言Dense模型,融合了线性注意力机制;响应速度快,兼具推理速度和性能。该模型的综合能力接近于Qwen3.5-122B-A10B。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤128k¥0.6/M token
    • 128k~256k¥1.8/M token

    输出

    • ≤128k¥4.8/M token
    • 128k~256k¥14.4/M token

    i2i_search

    • Public price¥0.048/次调用

    t2i_search

    • Public price¥0.024/次调用

    web_search

    • Public price¥0.004/次调用
    2026-08-05 Listed
  • Qwen3.5-35B-A3B

    API ID:ali/qwen3.5-35b-a3b
    文本多模态理解
    +1
    文本多模态理解

    Qwen3.5系列35B-A3B原生视觉语言模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。该模型的综合表现接近于Qwen3.5-27B。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤128k¥0.4/M token
    • 128k~256k¥1.6/M token

    输出

    • ≤128k¥3.2/M token
    • 128k~256k¥12.8/M token

    i2i_search

    • Public price¥0.048/次调用

    t2i_search

    • Public price¥0.024/次调用

    web_search

    • Public price¥0.004/次调用
    2026-08-05 Listed
  • Qwen3.5-122B-A10B

    API ID:ali/qwen3.5-122b-a10b
    文本多模态理解
    +1
    文本多模态理解

    Qwen3.5系列122B-A10B原生视觉语言模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。该模型的综合表现仅次于Qwen3.5-397B-A17B,文本能力显著优于Qwen3-235B-2507,视觉能力优于Qwen3-VL-235B。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤128k¥0.8/M token
    • 128k~256k¥2/M token

    输出

    • ≤128k¥6.4/M token
    • 128k~256k¥16/M token

    i2i_search

    • Public price¥0.048/次调用

    t2i_search

    • Public price¥0.024/次调用

    web_search

    • Public price¥0.004/次调用
    2026-08-05 Listed
  • Qwen3.6-27B

    API ID:ali/qwen3.6-27b
    文本多模态理解智能代理与数据文档与办公编程数学与科学
    +5
    文本多模态理解智能代理与数据文档与办公编程数学与科学

    Qwen3.6系列27B原生视觉语言Dense模型,模型效果相较3.5-27B重点提升了Agentic coding能力、模型STEM与推理能力进一步增强;视觉模态方面在空间智能、物体定位与检测能力上显著增强,视频理解、文档OCR及视觉Agent能力稳步提升。

    Input
    ¥3/M
    Output
    ¥18/M
    Context
    256K
    2026-08-05 Listed
  • Qwen3.8-Max

    API ID:ali/qwen3.8-max
    文本多模态理解智能代理与数据文档与办公编程
    +4
    文本多模态理解智能代理与数据文档与办公编程

    2.4万亿参数MoE旗舰,编程与办公能力全面跃升,可自主编程十数天交付完整项目。胜任法律、金融、设计等数百种专业任务,一次对话端到端交付生产级成果。原生视觉理解贯穿规划、执行与验证全流程,支持超长文档与长视频的深度语义解析。长程任务中自主规划与闭环迭代,持续进化。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥15/M token

    缓存写(1h)

    • Public price¥15/M token
    2026-08-04 Listed
  • Qwen3.6-35B-A3B

    API ID:ali/qwen3.6-35b-a3b
    文本多模态理解数学与科学智能代理与数据编程
    +4
    文本多模态理解数学与科学智能代理与数据编程

    Qwen3.6系列35B-A3B原生视觉语言模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。模型效果相较3.5-35B-A3B显著提升了agentic coding能力、数学推理和代码推理能力、空间智能能力、物体定位与目标检测能力。

    Price
    Attribute-based pricing

    Attribute-based pricing

    i2i_search

    • Public price¥0.048/次调用

    t2i_search

    • Public price¥0.024/次调用

    web_search

    • Public price¥0.004/次调用
    2026-08-03 Listed
  • GPT 5.1 Codex

    API ID:openai/gpt-5.1-codex
    文本编程
    +1
    文本编程

    (当前仅支持/v1/responses接口)GPT-5.1-Codex 是 GPT-5.1 的一个特殊版本,专为软件工程和编码工作流程而优化。它既适用于交互式开发,也适用于长时间独立执行复杂的工程任务。该模型支持从零开始构建项目、功能开发、调试、大规模重构和代码审查。与 GPT-5.1 相比,Codex 更易于控制,能够更严格地遵循开发者指令,并生成更简洁、更高质量的代码输出。可以通过 `reasoning.effort` 参数调整推理难度。

    Input
    ¥8.75/M
    Output
    ¥70/M
    Context
    400K
    2025-11-19 Listed
  • Claude Opus 4.5

    API ID:anthropic/claude-opus-4.5
    文本编程智能代理与数据文档与办公多模态理解
    +4
    文本编程智能代理与数据文档与办公多模态理解

    Anthropic 最智能模型的下一代产品 ——Claude Opus 4.5,在编码、代理、计算机使用以及企业工作流方面处于行业领先地位。应用场景如下: 编码:Opus 4.5 能够自信地在几小时内完成原本需要数天的软件开发项目,它可以独立工作,凭借深厚的技术功底和出色的品味,打造高效且简洁的解决方案。它在各种编程语言上的性能都有所提升,在规划和架构选择方面表现更优,是企业开发者的理想模型。 代理:Claude Opus 4.5 结合我们先进的工具使用能力,能打造出功能更强大、具备新行为模式的代理。 计算机使用:作为我们目前最出色的计算机使用模型,Claude Opus 4.5 能以自信、一致的方式应对新场景,实现更接近人类的浏览体验,从而优化网络问答、工作流自动化以及高级用户体验。 企业工作流:Opus 4.5 可以为代理提供支持,助力其从头到尾管理庞大的专业项目。它能更好地利用内存来保持文件间的上下文连贯性和一致性,同时在创建电子表格、幻灯片和文档方面实现了显著的飞跃式改进。 财务分析:Opus 4.5 能够整合复杂信息系统中的各类数据,包括监管文件、市场报告和内部数据,从而实现复杂的预测建模和主动合规。 cybersecurity(网络安全):Opus 4.5 为安全工作流带来专业级别的分析能力,它能关联日志、漏洞数据库和威胁情报,实现主动威胁检测和自动化事件响应。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥43.75/M token

    缓存写(1h)

    • Public price¥70/M token
    2025-11-25 Listed
  • Gemini 3.5 Flash Lite

    API ID:google/gemini-3.5-flash-lite
    文本智能代理与数据多模态理解文档与办公
    +3
    文本智能代理与数据多模态理解文档与办公

    Gemini 3.5 Flash-Lite 是我们最具成本效益的型号,旨在满足高吞吐量和自动化处理的需求。

    Input
    ¥2.1/M
    Output
    ¥17.5/M
    Context
    1M
    2026-07-29 Listed
  • Gemini 3.6 Flash

    API ID:google/gemini-3.6-flash
    文本编程多模态理解智能代理与数据
    +3
    文本编程多模态理解智能代理与数据

    Gemini 3.6 Flash 是 Google 推出的一款高效模型,适用于编程、智能体工作流以及网页和应用开发。

    Input
    ¥5.25/M
    Output
    ¥26.25/M
    Context
    1M
    2026-07-29 Listed
  • Claude Opus 5

    API ID:anthropic/claude-opus-5
    文本多模态理解编程智能代理与数据文档与办公
    +4
    文本多模态理解编程智能代理与数据文档与办公

    Claude Opus 5 是 Anthropic 公司推出的旗舰模型,适用于需要复杂推理、编码以及长期规划的代理任务。它在以下方面表现出强大的能力:端到端的软件任务处理、代码审查与缺陷检测、图表与文档的视觉分析、复杂的办公任务执行,以及平行子代理的协调工作。 这个模型在执行长时间任务时仍能保持出色的指令遵循能力和工具使用能力,同时在处理那些更注重延迟和效率的工作负载时,其性能依然十分出色。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥43.75/M token

    缓存写(1h)

    • Public price¥70/M token
    2026-07-26 Listed
  • Kimi K3

    API ID:moonshot/kimi-k3
    文本多模态理解文档与办公智能代理与数据数学与科学
    +4
    文本多模态理解文档与办公智能代理与数据数学与科学

    Kimi K3 是 Kimi 迄今能力最强的旗舰模型,拥有 2.8 万亿参数,基于 KDA 混合线性注意力机制(Kimi Delta Attention)和注意力残差(Attention Residuals)技术构建,原生支持视觉理解,并拥有 100 万 token 上下文窗口。它是全球首个开源的 3 万亿级别模型,面向长程编程、知识工作和推理等前沿智能场景而设计。

    Input
    ¥20/M
    Output
    ¥100/M
    Context
    1M
    2026-07-17 Listed
  • GPT-5.6-Terra

    API ID:openai/gpt-5.6-terra
    文本智能代理与数据编程数学与科学
    +3
    文本智能代理与数据编程数学与科学

    GPT-5.6 Terra是OpenAl旗下GPT-5.6系列中的一款均衡模型,介于旗舰级Sol层级与高性价比Luna层级之间。它适用于日常编码、推理及代理任务场景,在这些场景中需要兼顾性能与成本,且能够以大致相当于Sol成本一半的价格提供强大的性能表现。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤272k¥14/M token
    • 272k~不限¥28/M token

    输出

    • ≤272k¥84/M token
    • 272k~不限¥126/M token

    缓存读

    • ≤272k¥1.4/M token
    • 272k~不限¥2.8/M token

    缓存写(5m)

    • ≤272k¥17.5/M token
    • 272k~不限¥35/M token
    2026-07-11 Listed
  • GPT-5.6-Luna

    API ID:openai/gpt-5.6-luna
    文本智能代理与数据对话与客服
    +2
    文本智能代理与数据对话与客服

    GPT-5.6 Luna是OpenAl公司GPT-5.6系列中的一款快速且成本效益高的模型。它适用于高容量、对时延敏感的任务,如聊天、分类以及轻量级代理式工作流程,并以其在价格定位范围内的出色推理能力而著称。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤272k¥1.4/M token
    • 272k~不限¥2.8/M token

    输出

    • ≤272k¥8.4/M token
    • 272k~不限¥12.6/M token

    缓存读

    • ≤272k¥0.14/M token
    • 272k~不限¥0.28/M token

    缓存写(5m)

    • ≤272k¥1.75/M token
    • 272k~不限¥3.5/M token
    2026-07-11 Listed
  • GPT-5.6-Sol

    API ID:openai/gpt-5.6-sol
    文本智能代理与数据编程数学与科学
    +3
    文本智能代理与数据编程数学与科学

    GPT-5.6 Sol是OpenAl公司GPT-5.6系列中的旗舰模型。它适用于复杂的推理、编码及代理式工作流程, 尤其在命令行和多步骤编码任务以及长期目标问题解决方面表现尤为出色。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤272k¥35/M token
    • 272k~不限¥70/M token

    输出

    • ≤272k¥210/M token
    • 272k~不限¥315/M token

    缓存读

    • ≤272k¥3.5/M token
    • 272k~不限¥7/M token

    缓存写(5m)

    • ≤272k¥43.75/M token
    • 272k~不限¥87.5/M token
    2026-07-11 Listed

24 / 213 models loaded

←Previous
  1. 1
  2. 2
  3. 3
  4. …
  5. 9
Page 2 of 9Next→
General filters0
Use case

No matching options

Provider

No matching options

Input modality
Minimum context
General filters