Loading…
Skip to main content
The new Enterprise Gateway is live. Start your free trial today.View details
Modelmesh
Core products
LoomLoomSkillApp MarketEnterprise AI GatewayAI Chat
Model Marketplace
Model CenterDeveloper Models
Cloud Factory
AI Model DeploymentCloud AI Cluster
Agent accessCommunityAbout us
DocsConsoleChinese
DocsConsoleChinese
Log in / Sign upChecking…
Activate Enterprise GatewayProDedicated high-performance resources and support
Primary account:—
Account rechargeAPI keysEarnings
Personal settings

Redeem voucher

ModelmeshModelmesh navigation
DocsConsoleChinese
Log in / Sign up
Checking…

Model Center

Explore 335 models with public pricing, capabilities, and context information. Actual pricing may vary when routed to different providers; see model details for more pricing information.

335/ 335models
Sort
Price comparison
All文本图像生成视频生成音频生成音频转录3D生成向量化重排决策
  • Ali / Qwen3.5-Omni-Flash

    API ID:ali/qwen3.5-omni-flash
    文本多模态理解内容创作对话与客服语音处理

    Qwen3.5-Omni是Qwen最新一代全模态大模型,支持文本,图片,音频,音视频理解与交互。作为 Qwen3-Omni 的全面进化版本, 支持超过 10 小时的音频理解及超过 400 秒的 720P(1 FPS)音视频理解与对话,并进一步拓展语言范围,支持60+种语言音频输入,30+语言语音输出,并且具备强大的结构化音视频理解能力,广泛应用于文本创作、语音助手、多媒体分析等场景,提供自然流畅的多模态理解与交互体验。

    2026-08-27 Listed
    Attribute-based pricing

    Attribute-based pricing

    音频·输入

    • Public price¥18/M token

    音频·输出

    • Public price¥72/M token

    图片·输入

    • Public price¥2.2/M token

    视频·输入

    • Public price¥2.2/M token

    search_strategy:agent

    • Public price¥0.004/次调用
  • Ali / Qwen3.5-Omni-Plus

    API ID:ali/qwen3.5-omni-plus
    文本多模态理解内容创作对话与客服语音处理

    Qwen3.5-Omni是Qwen最新一代全模态大模型,支持文本,图片,音频,音视频理解与交互。作为 Qwen3-Omni 的全面进化版本, 支持超过 10 小时的音频理解及超过 400 秒的 720P(1 FPS)音视频理解与对话,并进一步拓展语言范围,支持60+种语言音频输入,30+语言语音输出,并且具备强大的结构化音视频理解能力,广泛应用于文本创作、语音助手、多媒体分析等场景,提供自然流畅的多模态理解与交互体验。

    2026-08-27 Listed
    Attribute-based pricing

    Attribute-based pricing

    音频·输入

    • Public price¥53/M token

    音频·输出

    • Public price¥213/M token

    图片·输入

    • Public price¥7/M token

    视频·输入

    • Public price¥7/M token

    search_strategy:agent

    • Public price¥0.004/次调用
  • Ali / Qwen3.8-Flash

    API ID:ali/qwen3.8-flash
    文本多模态理解智能代理与数据文档与办公编程

    Qwen3.8-Flash 是千问最新推出的多模态大模型,兼具强大的理解与生成能力和出色的响应速度。模型原生支持百万级上下文窗口,能够一次性处理超长文档、代码仓库和复杂对话。在编程辅助、智能体协作、图文理解等场景中表现尤为出色——无论是自动修复代码、操作桌面应用,还是分析图表与长视频,都能给出准确、高质量的结果。同时兼容 OpenAI 与 Anthropic 主流接口协议,可无缝接入 Claude Code、Codex 等开发者工具,轻松构建高并发应用与智能工作流。凭借优异的性能与极具竞争力的推理成本,Qwen3.8-Flash 是开发者和企业在 AI 应用中兼顾效果与效率的理想选择。

    2026-08-27 Listed¥1/M Input¥3/M Output1M Context
  • Anthropic / Claude Haiku 4.5

    API ID:anthropic/claude-haiku-4.5
    文本编程智能代理与数据对话与客服

    Claude Haiku 4.5 为各种用例提供​​近乎前沿的性能,并脱颖而出,成为最佳编码和代理模型之一——其速度和成本恰到好处,能够为免费产品和海量用户体验提供支持。用例:为免费层级用户体验提供支持:Claude Haiku 4.5 以合理的成本和速度提供近乎前沿的性能,使为免费代理产品和代理用例提供支持在经济上可行。

    2025-10-16 Listed
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥8.75/M token

    缓存写(1h)

    • Public price¥14/M token
  • Anthropic / Claude Haiku 4.5 Thinking

    API ID:anthropic/claude-haiku-4.5:thinking
    文本编程智能代理与数据多模态理解

    Claude Haiku 4.5 为各种用例提供​​近乎前沿的性能,并脱颖而出,成为最佳编码和代理模型之一——其速度和成本恰到好处,能够为免费产品和海量用户体验提供支持。用例:为免费层级用户体验提供支持:Claude Haiku 4.5 以合理的成本和速度提供近乎前沿的性能,使为免费代理产品和代理用例提供支持在经济上可行。

    2025-10-16 Listed
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥8.75/M token

    缓存写(1h)

    • Public price¥14/M token
  • Google / Veo3.1-fast

    API ID:google/veo3.1-fast-preview
    视频生成文本图像

    Veo 3.1 是 Google 最先进的模型,可生成高保真度的 8 秒 720p 或 1080p 视频,这些视频具有惊人的逼真效果和原生生成的音频。

    2025-10-16 Listed
    Attribute-based pricing

    Attribute-based pricing

    基础单价(无音频)

    • Public price¥0.7/秒

    含音频单价

    • Public price¥1.05/秒
  • OpenAI / Sora2

    API ID:openai/sora2
    视频生成视频与3D

    Sora2 是OpenAI 于2025 年9 月30 日发布的AI 视频生成模型升级版。 它在物理模拟、真实感和可控性方面大幅提升,能够生成高度逼真的视频,包括复杂动作如奥运体操或滑水后空翻等场景,并首次支持与画面匹配的AI 音频生成。

    2025-10-16 Listed
    Attribute-based pricing

    Attribute-based pricing

    每秒

    • Public price¥0.7/秒
  • DeepSeek / DeepSeek-V4-Flash-Vision-Exp

    API ID:deepseek/deepseek-v4-flash-vision-exp
    文本多模态理解智能代理与数据文档与办公

    DeepSeek V4 Flash Vision Exp是DeepSeek推出的DeepSeek V4 Flash 0731实验版视觉能力版本,新增图像理解能力,同时在智能代理、推理以及世界知识等文本能力方面与基础模型保持同等水平。该模型为稀疏混合专家模型,总参数量2840亿,激活参数量130亿。适用于文档与图表理解、视觉问答,以及文本与图像交替处理的多模态智能代理工作流。

    2026-08-24 Listed¥1/M Input¥4/M Output1M Context
  • bigmodel / GLM-5.3

    API ID:bigmodel/glm-5.3
    文本智能代理与数据编程

    GLM-5.3 是智谱最新旗舰模型,复杂软件工程与 Agent 任务能力全面进阶。它使用与 GLM-5.2 相同的基础模型——所有提升均来自后训练。与 GLM-5.2 相比,它在复杂编程和长程任务方面表现更加出色。

    2026-08-19 Listed¥8/M Input¥28/M Output1M Context
  • Ali / Qwen3.8 27B

    API ID:ali/qwen3.8-27b
    文本多模态理解智能代理与数据文档与办公编程数学与科学

    Qwen3.8 27B是通义千问推出的一款开放权重稠密多模态视觉语言模型。该模型适用于代码编写、专业工作流程、科研、多模态交互以及长时间运行的智能体任务,可开启或关闭灵活思考能力。

    2026-08-17 Listed¥3/M Input¥12/M Output1M Context
  • MiniMax / MiniMax M2.7

    API ID:minimax/minimax-m2.7
    文本编程文档与办公智能代理与数据对话与客服

    M2.7 在真实的软件工程中有优异的表现,包括端到端的完整项目交付,分析日志排查 Bug、代码安全,机器学习等。 在专业办公领域,我们提升了模型在各领域的专业知识和任务交付能力,在 GDPval-AA 的ELO得分是1495,为开源最高。M2.7 对 Office 三件套 Excel/PPT/Word 的复杂编辑能力显著提升,能更好地完成多轮修改和高保真的编辑。 M2.7具备与复杂环境交互的能力,M2.7 在 40 个复杂 skills (> 2000 Token) 的 case 上,仍能保持 97% 的 skills 遵循率。在OpenClaw的使用中,M2.7相比于M2.5也有了显著的提升,在MMClaw的评测中接近最新的Sonnet 4.6。 M2.7具备优秀的身份保持能力和情商,除了生产力使用外,给互动娱乐场景的创新也准备了空间。

    2026-03-18 Listed
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥2.625/M token
  • Streamlake / KAT-Coder-Air-V1

    API ID:streamlake/kat-coder-air-v1
    文本编程智能代理与数据

    KAT-Coder 系列模型中的轻量化版本。专为 Agentic Coding 设计,全面覆盖编程任务与场景,通过大规模智能体强化学习,实现智能行为涌现,在代码编写性能上显著超越同类模型。

    2025-11-13 Listed¥0.0001/M Input¥0/M Output128K Context
  • DeepSeek / DeepSeek-V4-Pro-0813

    API ID:deepseek/deepseek-v4-pro
    文本智能代理与数据编程数学与科学

    DeepSeek V4 Pro 是 DeepSeek 推出的大型专家混合模型,它专为高级推理、编码和长远视野代理工作流设计,在知识、数学和软件工程基准测试中表现出色。它基于与 DeepSeek V4 Flash 相同的架构,引入了混合注意力系统,实现高效的长上下文处理,并支持多种推理模式,根据任务平衡速度和深度。它非常适合复杂工作负载,如全代码库分析、多步自动化和大规模信息综合,这些工作在能力和效率上都至关重要。

    2026-08-14 Listed¥4.5/M Input¥13.5/M Output1M Context
  • Ali / HappyHorse-1.1-T2V

    API ID:ali/happyhorse-1.1-t2v
    视频生成视频与3D内容创作

    HappyHorse-1.1-T2V支持文生视频,进一步提升文本语义理解、镜头调度与动态生成表现。模型能够更精准地还原创作意图,在人物动作、场景氛围、视觉美感和物理运动上生成更流畅自然、细节丰富且一致性更高的高质量视频。

    2026-08-12 Listed
    Attribute-based pricing

    Attribute-based pricing

    视频

    • 480P¥0.45/次
    • 720P¥0.9/次
    • 1080P¥1.2/次
  • Ali / Qwen3.7-Flash

    API ID:ali/qwen3.7-flash
    文本多模态理解智能代理与数据编程

    Qwen3.7原生视觉语言系列Flash模型,相较3.6-Flash全面提升多模态理解与Agent执行能力。重点强化多模态基础能力、万物识别能力更强,真实世界感知与空间智能进一步提升,Search Agent、CI Agent等多模态Agent场景能力显著升级、端到端任务执行更稳定,多模态Coding能力优化、vibe coding 体验更加流畅。

    2026-08-12 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥0.2/M token
    • 32k~256k¥0.8/M token
    • 256k~1000k¥1.2/M token

    输出

    • ≤32k¥2/M token
    • 32k~256k¥8/M token
    • 256k~1000k¥12/M token

    缓存读

    • ≤32k¥0.02/M token
    • 32k~256k¥0.08/M token
    • 256k~1000k¥0.12/M token

    i2i_search

    • Public price¥0.048/次调用

    t2i_search

    • Public price¥0.024/次调用

    web_search

    • Public price¥0.004/次调用

    显式缓存命中

    • ≤32k¥0.02/M token
    • 32k~256k¥0.06/M token
    • 256k~1000k¥0.12/M token

    缓存写(5m)

    • ≤32k¥0.25/M token
    • 32k~256k¥0.75/M token
    • 256k~1000k¥1.5/M token
  • MiniMax / MiniMax H3

    API ID:minimax/minimax-h3
    视频生成多模态理解视频与3D内容创作

    MiniMax H3 是开放通用的多模态视频模型,可以统一理解文本、图片、视频和音频输入,完成视频生成、参考创作与视频编辑。

    2026-08-12 Listed
    Attribute-based pricing

    Attribute-based pricing

    参考图片(前 5 张免费)

    • Public price¥0.2/张

    每秒输出

    • 2K¥0.8/秒
    • 768P¥0.5/秒

    每秒输入

    • 2K¥0.8/秒
    • 768P¥0.5/秒
  • Streamlake / KAT-Coder-Pro-V1

    API ID:streamlake/kat-coder-pro-v1
    文本编程智能代理与数据

    专为 Agentic Coding 设计,全面覆盖编程任务与场景,通过大规模智能体强化学习,实现智能行为涌现,在代码编写性能上显著超越同类模型。

    2025-11-13 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥4/M token
    • 32k~128k¥6/M token
    • 128k~不限¥10/M token

    输出

    • ≤32k¥16/M token
    • 32k~128k¥24/M token
    • 128k~不限¥40/M token

    缓存读

    • ≤32k¥0.8/M token
    • 32k~128k¥1.2/M token
    • 128k~不限¥2/M token
  • Ali / Qwen3.5-4B

    API ID:ali/qwen3.5-4b
    文本多模态理解智能代理与数据

    Qwen3.5-4B 是通义千问团队推出的原生多模态大语言模型,拥有 4B 参数,是 Qwen3.5 系列中最轻量的 Dense 模型。该模型采用门控 Delta 网络与门控注意力相结合的高效混合架构,原生支持 256K 上下文长度,并可扩展至约 100 万 tokens。模型通过早期融合训练实现了统一的视觉语言基础能力,支持文本、图像和视频理解,在同规模模型中表现优异,多项指标超越 GPT-5-Nano 和 Gemini-2.5-Flash-Lite。模型默认启用思考模式(Thinking Mode),支持工具调用,并覆盖 201 种语言和方言

    2026-08-05 Listed¥0/M Input¥0/M Output256K Context
  • Ali / Qwen3.5-9B

    API ID:ali/qwen3.5-9b
    文本多模态理解智能代理与数据

    Qwen3.5-9B 是通义千问团队推出的原生多模态大语言模型,拥有 9B 参数。作为 Qwen3.5 系列的轻量级 Dense 模型,它采用门控 Delta 网络与门控注意力相结合的高效混合架构,原生支持 256K 上下文长度,并可扩展至约 100 万 tokens。模型通过早期融合训练实现了统一的视觉语言基础能力,支持文本、图像和视频理解。模型默认启用思考模式(Thinking Mode),支持工具调用,并覆盖 201 种语言和方言

    2026-08-05 Listed¥0.5/M Input¥1.5/M Output256K Context
  • Ali / Qwen3.5-27B

    API ID:ali/qwen3.5-27b
    文本多模态理解

    Qwen3.5系列27B原生视觉语言Dense模型,融合了线性注意力机制;响应速度快,兼具推理速度和性能。该模型的综合能力接近于Qwen3.5-122B-A10B。

    2026-08-05 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤128k¥0.6/M token
    • 128k~256k¥1.8/M token

    输出

    • ≤128k¥4.8/M token
    • 128k~256k¥14.4/M token

    i2i_search

    • Public price¥0.048/次调用

    t2i_search

    • Public price¥0.024/次调用

    web_search

    • Public price¥0.004/次调用
  • Ali / Qwen3.5-35B-A3B

    API ID:ali/qwen3.5-35b-a3b
    文本多模态理解

    Qwen3.5系列35B-A3B原生视觉语言模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。该模型的综合表现接近于Qwen3.5-27B。

    2026-08-05 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤128k¥0.4/M token
    • 128k~256k¥1.6/M token

    输出

    • ≤128k¥3.2/M token
    • 128k~256k¥12.8/M token

    i2i_search

    • Public price¥0.048/次调用

    t2i_search

    • Public price¥0.024/次调用

    web_search

    • Public price¥0.004/次调用
  • Ali / Qwen3.5-122B-A10B

    API ID:ali/qwen3.5-122b-a10b
    文本多模态理解

    Qwen3.5系列122B-A10B原生视觉语言模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。该模型的综合表现仅次于Qwen3.5-397B-A17B,文本能力显著优于Qwen3-235B-2507,视觉能力优于Qwen3-VL-235B。

    2026-08-05 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤128k¥0.8/M token
    • 128k~256k¥2/M token

    输出

    • ≤128k¥6.4/M token
    • 128k~256k¥16/M token

    i2i_search

    • Public price¥0.048/次调用

    t2i_search

    • Public price¥0.024/次调用

    web_search

    • Public price¥0.004/次调用
  • Ali / Qwen3.6-27B

    API ID:ali/qwen3.6-27b
    文本多模态理解智能代理与数据文档与办公编程数学与科学

    Qwen3.6系列27B原生视觉语言Dense模型,模型效果相较3.5-27B重点提升了Agentic coding能力、模型STEM与推理能力进一步增强;视觉模态方面在空间智能、物体定位与检测能力上显著增强,视频理解、文档OCR及视觉Agent能力稳步提升。

    2026-08-05 Listed¥3/M Input¥18/M Output256K Context
  • OpenAI / GPT-5.1

    API ID:openai/gpt-5.1
    文本编程数学与科学智能代理与数据对话与客服多模态理解

    GPT-5.1 是 GPT-5 系列的最新前沿模型,与 GPT-5 相比,它拥有更强大的通用推理能力、更高的指令遵循度以及更自然的对话风格。它采用自适应推理技术动态分配计算资源,能够快速响应简单查询,同时在处理复杂任务时投入更多精力。该模型能够生成更清晰、更贴近实际的解释,减少专业术语的使用,即使是技术性或多步骤问题也更容易理解。 GPT-5.1 旨在覆盖广泛的任务,在数学、编程和结构化分析等工作负载方面均取得了持续的提升,能够提供更连贯的长篇答案,并提高工具使用的可靠性。它还改进了对话对齐方式,能够在不牺牲准确性的前提下,提供更亲切、更直观的回答。GPT-5.1 是 GPT-5 的主要全功能继任者。

    2025-11-19 Listed¥8.75/M Input¥70/M Output400K Context

24 / 335 models loaded

←Previous
  1. 1
  2. 2
  3. 3
  4. …
  5. 14
Page 2 of 14Next→
General filters0
Use case

No matching options

Provider

No matching options

Input modality
Minimum context
General filters