Loading…
Skip to main content
The new Enterprise Gateway is live. Start your free trial today.View details
Modelmesh
Core products
LoomLoomSkillApp MarketEnterprise AI GatewayAI Chat
Model Marketplace
Model CenterDeveloper Models
Cloud Factory
AI Model DeploymentCloud AI Cluster
Agent accessCommunityAbout us
DocsConsoleChinese
DocsConsoleChinese
Log in / Sign upChecking…
Activate Enterprise GatewayProDedicated high-performance resources and support
Primary account:—
Account rechargeAPI keysEarnings
Personal settings

Redeem voucher

ModelmeshModelmesh navigation
DocsConsoleChinese
Log in / Sign up
Checking…

Model Center

Explore 335 models with public pricing, capabilities, and context information. Actual pricing may vary when routed to different providers; see model details for more pricing information.

213/ 335models
Sort
Price comparison
All文本图像生成视频生成音频生成音频转录3D生成向量化重排决策
  • GLM-5.3-Flash

    API ID:bigmodel/glm-5.3-flash
    文本多模态理解智能代理与数据文档与办公编程
    +4
    文本多模态理解智能代理与数据文档与办公编程

    GLM‑5.3‑Flash为GLM‑5系列首款原生多模态模型,以低成本架构实现优于GLM‑5.2的能力,采用总参320B、激活参18B的稀疏与线性注意力混合架构,在保障长上下文精度的同时大幅降低算力与KV缓存开销;它将视觉原生融入代码流程,可识别界面渲染反馈完成前端、游戏、Blender及真实环境操控类任务,同时拓展至办公、金融研究、专业文档场景,能够拆解任务、调用工具、自检优化,一站式输出PPTX、PDF、DOCX、XLSX等成品文档。

    Input
    ¥0.8/M
    Output
    ¥2.8/M
    Context
    1M
    2026-08-27 Listed
  • DeepSeek-V4.1-Flash

    API ID:deepseek/deepseek-v4.1-flash
    文本多模态理解智能代理与数据编程
    +3
    文本多模态理解智能代理与数据编程

    DeepSeek V4.1Flash 的中间版本内测。采用了新的模型结构,原生多模态支持、能力 更强、速度更快、且成本更低。

    Input
    ¥1/M
    Output
    ¥4/M
    Context
    1M
    2026-09-09 Listed
  • Claude Fable 5.1

    API ID:anthropic/claude-fable-5.1
    文本智能代理与数据文档与办公编程数学与科学
    +4
    文本智能代理与数据文档与办公编程数学与科学

    Claude Fable 5.1 在各方面均对 Claude Fable 5 进行了优化提升,在智能体编码、长时间运行的智能体工作流以及知识工作场景下提升最为显著:具体体现在大规模代码重构、前端与可视化代码生成,以及金融和分析类任务方面。相比 Fable 5,它输出的方案与摘要也往往更加简洁。建议你在当前使用 Fable 5 的所有场景直接升级试用该版本,同时在高推理强度任务中搭配 Opus 5 一同使用。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥87.5/M token

    缓存写(1h)

    • Public price¥140/M token
    2026-09-02 Listed
  • GPT 5.2 Codex

    API ID:openai/gpt-5.2-codex
    文本编程多模态理解智能代理与数据
    +3
    文本编程多模态理解智能代理与数据

    GPT-5.2-Codex 旨在实现可导向性、前端开发和交互性。 开发者可以利用 gpt-5.2-codex 进行各种智能、多模态的开发任务。对于寻求更智能、更安全、更集成 AI 协助的开发者来说,该模型为你的 AI 工具包提供了强大的新工具。

    Input
    ¥12.25/M
    Output
    ¥98/M
    Context
    400K
    2026-01-16 Listed
  • MiMo-V2.5-Pro

    API ID:xiaomi/mimo-v2.5-pro
    文本智能代理与数据编程
    +2
    文本智能代理与数据编程

    Xiaomi MiMo-V2-Pro 专为现实世界中高强度的 Agent 工作场景而打造。它拥有超过 1T 的总参数量(42B 激活参数),采用创新的混合注意力架构,并支持 1M 超长上下文长度。在强大的模型基座上,我们在更为广泛的 Agent 场景中持续 Scaling 算力,进一步拓展了智能的动作空间,实现了从 Coding 到 Claw 的重要泛化。

    Input
    ¥3/M
    Output
    ¥6/M
    Context
    1M
    2026-04-27 Listed
  • GPT-6-Luna

    API ID:openai/gpt-6-luna
    文本智能代理与数据编程对话与客服
    +3
    文本智能代理与数据编程对话与客服

    GPT-6 Luna是OpenAI GPT-6系列中速度快、性价比高的模型,定位低于GPT-6 Sol。它适用于高并发、对延迟敏感的工作负载,例如对话、分类以及轻量智能体任务;在调高推理算力投入时,它能够处理原本需要Sol级别模型才能完成的复杂软件工程与计算机操作任务。该模型继承了GPT-6系列在事实可靠性方面的提升,以及更清晰、简洁的表达风格。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤272k¥0.7/M token
    • 272k~不限¥1.4/M token

    输出

    • ≤272k¥3.5/M token
    • 272k~不限¥5.25/M token

    缓存读

    • ≤272k¥0.07/M token
    • 272k~不限¥0.14/M token

    缓存写(5m)

    • ≤272k¥0.875/M token
    • 272k~不限¥1.75/M token
    2026-09-23 Listed
  • GPT-6-Sol

    API ID:openai/gpt-6-sol
    文本智能代理与数据编程
    +2
    文本智能代理与数据编程

    GPT-6 Sol是OpenAI GPT-6系列中性价比出色的高端模型,定位低于旗舰款GPT-6 Astra,高于轻量高速版本GPT-6 Luna。该模型适用于高要求的专业工作、智能体代码开发、业务流程自动化以及计算机操作场景,尤其擅长基于真实代码库开展长周期软件工程任务。它能以低得多的成本达到接近Astra水平的事实可靠性,并且在技术与代码对话中,拥有和Astra一样清晰简洁的表达风格。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤272k¥14/M token
    • 272k~不限¥28/M token

    输出

    • ≤272k¥70/M token
    • 272k~不限¥105/M token

    缓存读

    • ≤272k¥1.4/M token
    • 272k~不限¥2.8/M token

    缓存写(5m)

    • ≤272k¥17.5/M token
    • 272k~不限¥35/M token
    2026-09-23 Listed
  • MiMo-V2.6-Pro-UltraSpeed

    API ID:xiaomi/mimo-v2.6-pro-ultraspeed
    文本多模态理解智能代理与数据文档与办公视频与3D内容创作编程数学与科学图像与设计
    +8
    文本多模态理解智能代理与数据文档与办公视频与3D内容创作编程数学与科学图像与设计

    兼顾 V2.6-Pro 旗舰性能,提供最高 20 倍输出速度,服务强实时交互与对响应速度敏感的生产场景。旗舰级性能无折扣完全保留,复杂任务体验相同,不因速度牺牲智能,输出速度最高为 V2.6-Pro 的 20 倍,满足强实时交互与对响应速度敏感的场景

    Input
    ¥30/M
    Output
    ¥60/M
    Context
    1M
    2026-09-22 Listed
  • MiMo-V2.6-Pro

    API ID:xiaomi/mimo-v2.6-pro
    文本多模态理解智能代理与数据文档与办公视频与3D内容创作编程数学与科学图像与设计
    +8
    文本多模态理解智能代理与数据文档与办公视频与3D内容创作编程数学与科学图像与设计

    MiMo-V2.6-Pro 是小米 MiMo-V2.6 系列旗舰原生全模态模型,支持 1M 超长上下文,适配多模态、多 Agent 、多 Harness 协同复杂任务。重点优化代码、办公、设计、科研、创作、网络安全、电脑操控能力。

    Input
    ¥3/M
    Output
    ¥6/M
    Context
    1M
    2026-09-22 Listed
  • MiMo-V2.6-Flash

    API ID:xiaomi/mimo-v2.6-flash
    文本多模态理解
    +1
    文本多模态理解

    MiMo-V2.6-Flash 是小米推出的原生全模态 MoE 开源模型,支持图文音视频输入与百万级长上下文,经强化学习优化,兼顾推理能力与推理成本,适合高并发大规模业务调用。

    Input
    ¥1/M
    Output
    ¥2/M
    Context
    1M
    2026-09-22 Listed
  • MiniMax M2.1

    API ID:minimax/minimax-m2.1
    文本编程
    +1
    文本编程

    MiniMax M2.1,强大多语言编程实力,全面升级编程体验

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥2.625/M token
    2025-12-23 Listed
  • Claude Sonnet 4.5

    API ID:anthropic/claude-sonnet-4.5
    文本编程智能代理与数据多模态理解
    +3
    文本编程智能代理与数据多模态理解

    Claude Sonnet 4.5 是 Anthropic 迄今为止最先进的 Sonnet 模型,针对真实代理和编码工作流程进行了优化。它在 SWE-bench Verified 等编码基准测试中展现出顶尖性能,并在系统设计、代码安全性和规范遵循性方面均有所改进。该模型旨在实现扩展自主操作,保持跨会话的任务连续性,并提供基于事实的进度跟踪。 Sonnet 4.5 还引入了更强大的代理功能,包括改进的工具编排、推测并行执行以及更高效的上下文和内存管理。凭借增强的上下文跟踪和跨工具调用的令牌使用感知功能,它尤其适用于多上下文和长时间运行的工作流。用例涵盖软件工程、网络安全、财务分析、研究代理以及其他需要持续推理和工具使用的领域。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥26.25/M token

    缓存写(1h)

    • Public price¥42/M token
    2025-09-30 Listed
  • GPT-6-Astra

    API ID:openai/gpt-6-astra
    文本多模态理解智能代理与数据文档与办公编程数学与科学
    +5
    文本多模态理解智能代理与数据文档与办公编程数学与科学

    GPT‑6 Astra是OpenAI面向高要求端到端工作的旗舰模型。它适用于高级分析、软件工程、深度研究、科研工作以及文档创作,在涉及计算机与浏览器操作的长周期智能代理任务方面具备突出优势。

    Price
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤272k¥70/M token
    • 272k~不限¥140/M token

    输出

    • ≤272k¥350/M token
    • 272k~不限¥525.001/M token

    缓存读

    • ≤272k¥7/M token
    • 272k~不限¥14/M token

    缓存写(5m)

    • ≤272k¥87.5/M token
    • 272k~不限¥175/M token
    2026-09-07 Listed
  • Qwen3.8-Max-0902(快照版)

    API ID:ali/qwen3.8-max-0902
    文本多模态理解智能代理与数据文档与办公编程数学与科学
    +5
    文本多模态理解智能代理与数据文档与办公编程数学与科学

    Qwen3.8-Max-0902(别名qwen3.8-max-2026-09-02)是qwen3.8-max的快照版本。编码深度再突破,可驾驭更复杂的工程级项目与长程自主开发;协作智能体能力显著增强,在多工具调度与端到端交付中表现更从容;视觉理解全面精进,图表推理、文档解析与多模态感知更敏锐准确。延续 100 万上下文、思考模式与完整工具生态,在更高智能水平上持续进化。

    Input
    ¥12/M
    Output
    ¥36/M
    Context
    1M
    2026-09-03 Listed
  • Gemini 3.8 Flash

    API ID:google/gemini-3.8-flash
    文本智能代理与数据编程
    +2
    文本智能代理与数据编程

    Gemini 3.8 Flash 是谷歌旗下能力最强的 Flash 模型,相较于 3.7 Flash 版本,它在软件工程、智能代理任务以及多步推理方面实现了大幅提升。

    Input
    ¥5.25/M
    Output
    ¥26.25/M
    Context
    1M
    2026-09-03 Listed
  • Claude Sonnet 4.5 Thinking

    API ID:anthropic/claude-sonnet-4.5:thinking
    文本智能代理与数据编程多模态理解
    +3
    文本智能代理与数据编程多模态理解

    Claude Sonnet 4.5 是 Anthropic 迄今为止最先进的 Sonnet 模型,针对真实代理和编码工作流程进行了优化。它在 SWE-bench Verified 等编码基准测试中展现出顶尖性能,并在系统设计、代码安全性和规范遵循性方面均有所改进。该模型旨在实现扩展自主操作,保持跨会话的任务连续性,并提供基于事实的进度跟踪。 Sonnet 4.5 还引入了更强大的代理功能,包括改进的工具编排、推测并行执行以及更高效的上下文和内存管理。凭借增强的上下文跟踪和跨工具调用的令牌使用感知功能,它尤其适用于多上下文和长时间运行的工作流。用例涵盖软件工程、网络安全、财务分析、研究代理以及其他需要持续推理和工具使用的领域。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥26.25/M token

    缓存写(1h)

    • Public price¥42/M token
    2025-09-30 Listed
  • Gemini 3.7 Flash

    API ID:google/gemini-3.7-flash
    文本多模态理解智能代理与数据编程
    +3
    文本多模态理解智能代理与数据编程

    Gemini 3.7 Flash 是谷歌推出的多模态模型,适用于智能代理工作流、代码编写以及复杂多步推理场景。该模型专为需要响应迅速、可稳定完成多步问题求解的任务打造。

    Input
    ¥5.25/M
    Output
    ¥26.25/M
    Context
    1M
    2026-08-31 Listed
  • Claude Haiku 4.5

    API ID:anthropic/claude-haiku-4.5
    文本编程智能代理与数据对话与客服
    +3
    文本编程智能代理与数据对话与客服

    Claude Haiku 4.5 为各种用例提供​​近乎前沿的性能,并脱颖而出,成为最佳编码和代理模型之一——其速度和成本恰到好处,能够为免费产品和海量用户体验提供支持。用例:为免费层级用户体验提供支持:Claude Haiku 4.5 以合理的成本和速度提供近乎前沿的性能,使为免费代理产品和代理用例提供支持在经济上可行。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥8.75/M token

    缓存写(1h)

    • Public price¥14/M token
    2025-10-16 Listed
  • Claude Haiku 4.5 Thinking

    API ID:anthropic/claude-haiku-4.5:thinking
    文本编程智能代理与数据多模态理解
    +3
    文本编程智能代理与数据多模态理解

    Claude Haiku 4.5 为各种用例提供​​近乎前沿的性能,并脱颖而出,成为最佳编码和代理模型之一——其速度和成本恰到好处,能够为免费产品和海量用户体验提供支持。用例:为免费层级用户体验提供支持:Claude Haiku 4.5 以合理的成本和速度提供近乎前沿的性能,使为免费代理产品和代理用例提供支持在经济上可行。

    Price
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥8.75/M token

    缓存写(1h)

    • Public price¥14/M token
    2025-10-16 Listed
  • Hunyuan-4-preview

    API ID:tencent/hy4-preview
    文本智能代理与数据文档与办公编程
    +3
    文本智能代理与数据文档与办公编程

    混元Hy4 preview总参数770B、激活参数49B,重点面向Agent、Coding与生产力场景优化,强化复杂任务中的理解、规划、工具调用与持续执行能力。相比上一代模型,Hy4 preview在多步骤Agent、代码开发和生产力任务上进一步提升,具备更好的任务拆解、上下文承接、指令遵循和长链路执行能力。在Coding场景中,进一步增强代码理解、生成、修改和复杂工程任务处理能力;在生产力场景中,重点提升文档处理、信息分析、办公自动化、游戏开发、网页生成及跨工具协作等能力。Hy4 preview适用于Coding Agent、复杂工具调用以及各类需要多步骤规划和持续执行的Agent工作流,为真实业务场景中的复杂任务提供更可靠的任务完成能力。

    Input
    ¥6/M
    Output
    ¥18/M
    Context
    1M
    2026-08-28 Listed
  • Qwen3.5-Omni-Flash

    API ID:ali/qwen3.5-omni-flash
    文本多模态理解内容创作对话与客服语音处理
    +4
    文本多模态理解内容创作对话与客服语音处理

    Qwen3.5-Omni是Qwen最新一代全模态大模型,支持文本,图片,音频,音视频理解与交互。作为 Qwen3-Omni 的全面进化版本, 支持超过 10 小时的音频理解及超过 400 秒的 720P(1 FPS)音视频理解与对话,并进一步拓展语言范围,支持60+种语言音频输入,30+语言语音输出,并且具备强大的结构化音视频理解能力,广泛应用于文本创作、语音助手、多媒体分析等场景,提供自然流畅的多模态理解与交互体验。

    Price
    Attribute-based pricing

    Attribute-based pricing

    音频·输入

    • Public price¥18/M token

    音频·输出

    • Public price¥72/M token

    图片·输入

    • Public price¥2.2/M token

    视频·输入

    • Public price¥2.2/M token

    search_strategy:agent

    • Public price¥0.004/次调用
    2026-08-27 Listed
  • Qwen3.5-Omni-Plus

    API ID:ali/qwen3.5-omni-plus
    文本多模态理解内容创作对话与客服语音处理
    +4
    文本多模态理解内容创作对话与客服语音处理

    Qwen3.5-Omni是Qwen最新一代全模态大模型,支持文本,图片,音频,音视频理解与交互。作为 Qwen3-Omni 的全面进化版本, 支持超过 10 小时的音频理解及超过 400 秒的 720P(1 FPS)音视频理解与对话,并进一步拓展语言范围,支持60+种语言音频输入,30+语言语音输出,并且具备强大的结构化音视频理解能力,广泛应用于文本创作、语音助手、多媒体分析等场景,提供自然流畅的多模态理解与交互体验。

    Price
    Attribute-based pricing

    Attribute-based pricing

    音频·输入

    • Public price¥53/M token

    音频·输出

    • Public price¥213/M token

    图片·输入

    • Public price¥7/M token

    视频·输入

    • Public price¥7/M token

    search_strategy:agent

    • Public price¥0.004/次调用
    2026-08-27 Listed
  • Qwen3.8-Flash

    API ID:ali/qwen3.8-flash
    文本多模态理解智能代理与数据文档与办公编程
    +4
    文本多模态理解智能代理与数据文档与办公编程

    Qwen3.8-Flash 是千问最新推出的多模态大模型,兼具强大的理解与生成能力和出色的响应速度。模型原生支持百万级上下文窗口,能够一次性处理超长文档、代码仓库和复杂对话。在编程辅助、智能体协作、图文理解等场景中表现尤为出色——无论是自动修复代码、操作桌面应用,还是分析图表与长视频,都能给出准确、高质量的结果。同时兼容 OpenAI 与 Anthropic 主流接口协议,可无缝接入 Claude Code、Codex 等开发者工具,轻松构建高并发应用与智能工作流。凭借优异的性能与极具竞争力的推理成本,Qwen3.8-Flash 是开发者和企业在 AI 应用中兼顾效果与效率的理想选择。

    Input
    ¥1/M
    Output
    ¥3/M
    Context
    1M
    2026-08-27 Listed
  • KAT-Coder-Air-V1

    API ID:streamlake/kat-coder-air-v1
    文本编程智能代理与数据
    +2
    文本编程智能代理与数据

    KAT-Coder 系列模型中的轻量化版本。专为 Agentic Coding 设计,全面覆盖编程任务与场景,通过大规模智能体强化学习,实现智能行为涌现,在代码编写性能上显著超越同类模型。

    Input
    ¥0.0001/M
    Output
    ¥0/M
    Context
    128K
    2025-11-13 Listed

24 / 213 models loaded

←Previous
  1. 1
  2. 2
  3. …
  4. 9
Page 1 of 9Next→
General filters0
Use case

No matching options

Provider

No matching options

Input modality
Minimum context
General filters