Loading…
Skip to main content
The new Enterprise Gateway is live. Start your free trial today.View details
Modelmesh
Core products
LoomLoomSkillApp MarketEnterprise AI GatewayAI Chat
Model Marketplace
Model CenterDeveloper Models
Cloud Factory
AI Model DeploymentCloud AI Cluster
Agent accessCommunityAbout us
DocsConsoleChinese
DocsConsoleChinese
Log in / Sign upChecking…
Activate Enterprise GatewayProDedicated high-performance resources and support
Primary account:—
Account rechargeAPI keysEarnings
Personal settings

Redeem voucher

ModelmeshModelmesh navigation
DocsConsoleChinese
Log in / Sign up
Checking…

Model Center

Explore 335 models with public pricing, capabilities, and context information. Actual pricing may vary when routed to different providers; see model details for more pricing information.

335/ 335models
Sort
Price comparison
All文本图像生成视频生成音频生成音频转录3D生成向量化重排决策
  • OpenAI / GPT 5.1 Codex

    API ID:openai/gpt-5.1-codex
    文本编程

    (当前仅支持/v1/responses接口)GPT-5.1-Codex 是 GPT-5.1 的一个特殊版本,专为软件工程和编码工作流程而优化。它既适用于交互式开发,也适用于长时间独立执行复杂的工程任务。该模型支持从零开始构建项目、功能开发、调试、大规模重构和代码审查。与 GPT-5.1 相比,Codex 更易于控制,能够更严格地遵循开发者指令,并生成更简洁、更高质量的代码输出。可以通过 `reasoning.effort` 参数调整推理难度。

    2025-11-19 Listed¥8.75/M Input¥70/M Output400K Context
  • Google / Gemini 3 Pro Image

    API ID:google/gemini-3-pro-image
    图像生成图像与设计

    谷歌最强图像模型,nano banana pro

    2025-11-21 Listed
    Attribute-based pricing

    Attribute-based pricing

    音频·输入

    • Public price¥14/M token

    图片·输入

    • Public price¥14/M token

    图片·输出

    • Public price¥840.001/M token

    视频·输入

    • Public price¥14/M token

    输入

    • Public price¥14/M token

    输出

    • Public price¥84/M token
  • Moonshot / Kimi K2 0905

    API ID:moonshot/kimi-k2
    文本编程智能代理与数据

    ( 最新版本 0905) Kimi K2是一款上下文长度256k的模型,具备更强的Agentic Coding能力、更突出的前端代码的美观度和实用性、以及更好的上下文理解能力。

    2025-07-15 Listed¥4/M Input¥16/M Output256K Context
  • Ali / Qwen3-Coder-Plus

    API ID:ali/qwen3-coder-plus
    文本编程智能代理与数据

    Qwen3-Coder-Plus,这是通义千问系列迄今为止最具代理能力的代码模型。

    2025-07-23 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤32k¥4/M token
    • ≤128k¥6/M token
    • 128k~256k¥10/M token
    • 256k~1000k¥20/M token

    输出

    • ≤32k¥16/M token
    • ≤128k¥24/M token
    • 128k~256k¥40/M token
    • 256k~1000k¥200/M token

    缓存读

    • ≤32k¥0.8/M token
    • ≤128k¥1.2/M token
    • 128k~256k¥2/M token
    • 256k~1000k¥25/M token

    显式缓存命中

    • ≤32k¥0.4/M token
    • 32k~128k¥0.6/M token
    • 128k~256k¥1/M token
    • 256k~1000k¥2/M token

    缓存写(5m)

    • ≤32k¥5/M token
    • 32k~128k¥7.5/M token
    • 128k~256k¥12.5/M token
    • 256k~1000k¥25/M token
  • Anthropic / Claude Opus 4.5

    API ID:anthropic/claude-opus-4.5
    文本编程智能代理与数据文档与办公多模态理解

    Anthropic 最智能模型的下一代产品 ——Claude Opus 4.5,在编码、代理、计算机使用以及企业工作流方面处于行业领先地位。应用场景如下: 编码:Opus 4.5 能够自信地在几小时内完成原本需要数天的软件开发项目,它可以独立工作,凭借深厚的技术功底和出色的品味,打造高效且简洁的解决方案。它在各种编程语言上的性能都有所提升,在规划和架构选择方面表现更优,是企业开发者的理想模型。 代理:Claude Opus 4.5 结合我们先进的工具使用能力,能打造出功能更强大、具备新行为模式的代理。 计算机使用:作为我们目前最出色的计算机使用模型,Claude Opus 4.5 能以自信、一致的方式应对新场景,实现更接近人类的浏览体验,从而优化网络问答、工作流自动化以及高级用户体验。 企业工作流:Opus 4.5 可以为代理提供支持,助力其从头到尾管理庞大的专业项目。它能更好地利用内存来保持文件间的上下文连贯性和一致性,同时在创建电子表格、幻灯片和文档方面实现了显著的飞跃式改进。 财务分析:Opus 4.5 能够整合复杂信息系统中的各类数据,包括监管文件、市场报告和内部数据,从而实现复杂的预测建模和主动合规。 cybersecurity(网络安全):Opus 4.5 为安全工作流带来专业级别的分析能力,它能关联日志、漏洞数据库和威胁情报,实现主动威胁检测和自动化事件响应。

    2025-11-25 Listed
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥43.75/M token

    缓存写(1h)

    • Public price¥70/M token
  • DeepSeek / Deepseek V3.2

    API ID:deepseek/deepseek-v3.2
    文本数学与科学编程智能代理与数据

    DeepSeek-V3.2 是一款大型语言模型,旨在兼顾高计算效率、强大的推理能力以及智能体工具使用性能。它引入了 DeepSeek 稀疏注意力机制 (DSA),这是一种细粒度的稀疏注意力机制,能够在长上下文场景下降低训练和推理成本,同时保持模型质量。可扩展的强化学习后训练框架进一步提升了推理能力,其性能已达到 GPT-5 的水平,并在 2025 年国际数学奥林匹克竞赛 (IMO) 和国际信息学奥林匹克竞赛 (IOI) 中荣获金奖。V3.2 还采用了大规模智能体任务合成流程,将推理更好地融入工具使用场景,从而提升模型在交互式环境中的适应性和泛化能力。

    2025-12-02 Listed¥2/M Input¥3/M Output128K Context
  • DeepSeek / DeepSeek V3.2 Thinking

    API ID:deepseek/deepseek-v3.2-think
    文本数学与科学编程智能代理与数据

    DeepSeek-V3.2 是一款大型语言模型,旨在兼顾高计算效率、强大的推理能力以及智能体工具使用性能。它引入了 DeepSeek 稀疏注意力机制 (DSA),这是一种细粒度的稀疏注意力机制,能够在长上下文场景下降低训练和推理成本,同时保持模型质量。可扩展的强化学习后训练框架进一步提升了推理能力,其性能已达到 GPT-5 的水平,并在 2025 年国际数学奥林匹克竞赛 (IMO) 和国际信息学奥林匹克竞赛 (IOI) 中荣获金奖。V3.2 还采用了大规模智能体任务合成流程,将推理更好地融入工具使用场景,从而提升模型在交互式环境中的适应性和泛化能力。

    2025-12-02 Listed¥2/M Input¥3/M Output128K Context
  • Ali / Qwen3.8-Max

    API ID:ali/qwen3.8-max
    文本多模态理解智能代理与数据文档与办公编程

    2.4万亿参数MoE旗舰,编程与办公能力全面跃升,可自主编程十数天交付完整项目。胜任法律、金融、设计等数百种专业任务,一次对话端到端交付生产级成果。原生视觉理解贯穿规划、执行与验证全流程,支持超长文档与长视频的深度语义解析。长程任务中自主规划与闭环迭代,持续进化。

    2026-08-04 Listed
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥15/M token

    缓存写(1h)

    • Public price¥15/M token
  • Ali / Qwen3.6-35B-A3B

    API ID:ali/qwen3.6-35b-a3b
    文本多模态理解数学与科学智能代理与数据编程

    Qwen3.6系列35B-A3B原生视觉语言模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。模型效果相较3.5-35B-A3B显著提升了agentic coding能力、数学推理和代码推理能力、空间智能能力、物体定位与目标检测能力。

    2026-08-03 Listed
    Attribute-based pricing

    Attribute-based pricing

    i2i_search

    • Public price¥0.048/次调用

    t2i_search

    • Public price¥0.024/次调用

    web_search

    • Public price¥0.004/次调用
  • Bytedance / Doubao-Seedream-4.5

    API ID:bytedance/doubao-seedream-4.5
    图像生成图像与设计

    Seedream 4.5 是字节跳动最新推出的图像多模态模型,整合了文生图、图生图、组图输出等能力,融合常识和推理能力。相比前代4.0模型生成效果大幅提升,具备更好的编辑一致性和多图融合效果,能更精准的控制画面细节,小字、小人脸生成更自然

    2025-12-03 Listed
    Attribute-based pricing

    Attribute-based pricing

    每张图片

    • Public price¥0.25/每张图片
  • OpenAI / GPT 5.1 Codex Max

    API ID:openai/gpt-5.1-codex-max
    文本编程数学与科学智能代理与数据

    (当前仅支持/v1/responses接口)GPT-5.1-Codex-Max 是 OpenAI 最新的代理编码模型,专为长期运行的高上下文软件开发任务设计。它基于更新版的 5.1 推理堆栈,并基于跨软件工程、数学和研究的代理工作流进行训练。 GPT-5.1-Codex-Max 在整个开发生命周期中实现了更快的性能、更优的推理和更高的代币效率。

    2025-12-11 Listed¥8.75/M Input¥70/M Output400K Context
  • Google / Gemini 3.5 Flash Lite

    API ID:google/gemini-3.5-flash-lite
    文本智能代理与数据多模态理解文档与办公

    Gemini 3.5 Flash-Lite 是我们最具成本效益的型号,旨在满足高吞吐量和自动化处理的需求。

    2026-07-29 Listed¥2.1/M Input¥17.5/M Output1M Context
  • Google / Gemini 3.6 Flash

    API ID:google/gemini-3.6-flash
    文本编程多模态理解智能代理与数据

    Gemini 3.6 Flash 是 Google 推出的一款高效模型,适用于编程、智能体工作流以及网页和应用开发。

    2026-07-29 Listed¥5.25/M Input¥26.25/M Output1M Context
  • Anthropic / Claude Opus 5

    API ID:anthropic/claude-opus-5
    文本多模态理解编程智能代理与数据文档与办公

    Claude Opus 5 是 Anthropic 公司推出的旗舰模型,适用于需要复杂推理、编码以及长期规划的代理任务。它在以下方面表现出强大的能力:端到端的软件任务处理、代码审查与缺陷检测、图表与文档的视觉分析、复杂的办公任务执行,以及平行子代理的协调工作。 这个模型在执行长时间任务时仍能保持出色的指令遵循能力和工具使用能力,同时在处理那些更注重延迟和效率的工作负载时,其性能依然十分出色。

    2026-07-26 Listed
    Attribute-based pricing

    Attribute-based pricing

    缓存写(5m)

    • Public price¥43.75/M token

    缓存写(1h)

    • Public price¥70/M token
  • Moonshot / Kimi K3

    API ID:moonshot/kimi-k3
    文本多模态理解文档与办公智能代理与数据数学与科学

    Kimi K3 是 Kimi 迄今能力最强的旗舰模型,拥有 2.8 万亿参数,基于 KDA 混合线性注意力机制(Kimi Delta Attention)和注意力残差(Attention Residuals)技术构建,原生支持视觉理解,并拥有 100 万 token 上下文窗口。它是全球首个开源的 3 万亿级别模型,面向长程编程、知识工作和推理等前沿智能场景而设计。

    2026-07-17 Listed¥20/M Input¥100/M Output1M Context
  • OpenAI / GPT-5.6-Terra

    API ID:openai/gpt-5.6-terra
    文本智能代理与数据编程数学与科学

    GPT-5.6 Terra是OpenAl旗下GPT-5.6系列中的一款均衡模型,介于旗舰级Sol层级与高性价比Luna层级之间。它适用于日常编码、推理及代理任务场景,在这些场景中需要兼顾性能与成本,且能够以大致相当于Sol成本一半的价格提供强大的性能表现。

    2026-07-11 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤272k¥14/M token
    • 272k~不限¥28/M token

    输出

    • ≤272k¥84/M token
    • 272k~不限¥126/M token

    缓存读

    • ≤272k¥1.4/M token
    • 272k~不限¥2.8/M token

    缓存写(5m)

    • ≤272k¥17.5/M token
    • 272k~不限¥35/M token
  • OpenAI / GPT-5.6-Luna

    API ID:openai/gpt-5.6-luna
    文本智能代理与数据对话与客服

    GPT-5.6 Luna是OpenAl公司GPT-5.6系列中的一款快速且成本效益高的模型。它适用于高容量、对时延敏感的任务,如聊天、分类以及轻量级代理式工作流程,并以其在价格定位范围内的出色推理能力而著称。

    2026-07-11 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤272k¥1.4/M token
    • 272k~不限¥2.8/M token

    输出

    • ≤272k¥8.4/M token
    • 272k~不限¥12.6/M token

    缓存读

    • ≤272k¥0.14/M token
    • 272k~不限¥0.28/M token

    缓存写(5m)

    • ≤272k¥1.75/M token
    • 272k~不限¥3.5/M token
  • OpenAI / GPT-5.6-Sol

    API ID:openai/gpt-5.6-sol
    文本智能代理与数据编程数学与科学

    GPT-5.6 Sol是OpenAl公司GPT-5.6系列中的旗舰模型。它适用于复杂的推理、编码及代理式工作流程, 尤其在命令行和多步骤编码任务以及长期目标问题解决方面表现尤为出色。

    2026-07-11 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入

    • ≤272k¥35/M token
    • 272k~不限¥70/M token

    输出

    • ≤272k¥210/M token
    • 272k~不限¥315/M token

    缓存读

    • ≤272k¥3.5/M token
    • 272k~不限¥7/M token

    缓存写(5m)

    • ≤272k¥43.75/M token
    • 272k~不限¥87.5/M token
  • Bytedance / Doubao-Seedream-5.0-pro

    API ID:bytedance/doubao-seedream-5-0-pro
    图像生成内容创作图像与设计

    seedream-5.0-pro是字节跳动发布的最新图像创作模型。该模型在更复杂、更真实的图像生成与编辑需求维度全面升级,将图像创作推进到可控生产的新阶段。本次模型更新的主要亮点是编辑更可控、生产更落地、效果更自然。

    2026-07-09 Listed
    Attribute-based pricing

    Attribute-based pricing

    输入图片(首张免费起)

    • Public price¥0.02/张

    输出图(≥2360000px)

    • Public price¥0.3/张

    输出图(兜底档)

    • Public price¥0.6/张
  • OpenAI / GPT-5.2

    API ID:openai/gpt-5.2
    文本智能代理与数据编程数学与科学多模态理解文档与办公

    GPT-5.2 是 GPT-5 系列中最新的前沿级模型,相比 GPT-5.1 提供了更强的代理和长上下文性能。它利用自适应推理动态分配计算,快速响应简单查询,同时在复杂任务上投入更多深度。 GPT-5.2 专为广泛任务覆盖而设计,在数学、编程、科学和工具调用工作负载中持续带来进步,提供更连贯的长篇答案和提升的工具使用可靠性。

    2025-12-12 Listed¥12.25/M Input¥98/M Output400K Context
  • OpenAI / GPT Image 1.5

    API ID:openai/gpt-image-1.5
    图像生成图像与设计

    OpenAI最强图像生成模型,新模型能够结合世界知识,生成更加符合上下文图像,质量更高,还支持多种功能自定义。

    2025-12-17 Listed
    Attribute-based pricing

    Attribute-based pricing

    图片·输入

    • Public price¥56/M token

    图片·输出

    • Public price¥224/M token
  • Ali / 通义万相2.6-图生视频

    API ID:ali/wan2.6-i2v
    视频生成视频与3D

    图片生成视频内容,稳定保持图像主体、风格和文字等细节信息

    2025-12-17 Listed
    Attribute-based pricing

    Attribute-based pricing

    视频

    • 720P¥0.6/次
    • 1080P¥1/次
  • LongCat / LongCat-2.0(限时4折)

    API ID:longcat/longcat-2.0
    文本智能代理与数据编程

    LongCat-2.0 是美团 全量开源的1.6 万亿参数 MoE 国产大模型,也是全球首个依托五万张国产算力芯片完成完整训推流程的万亿级大模型美团技术团。

    2026-07-07 Listed¥2/M Input¥8/M Output1M Context
  • Tencent / Hunyuan-3

    API ID:tencent/hy3
    文本智能代理与数据文档与办公编程

    Hy3 正式版面向真实业务场景打磨,采用 295B 总参数、21B 激活 MoE 架构,原生支持 256K 上下文,并提供no_think(极速响应)、think_low(快速思考)与 think_high(深度推理) 多档思考模式,兼顾极速响应、复杂推理与调用成本。相比 Preview 版本,Hy3 基于腾讯元宝、WorkBuddy、ima 、Marvis等真实业务反馈,重点提升了 Coding Agent、长文理解、多轮上下文承接、搜索问答与复杂任务执行能力,在减少幻觉、提升任务完成度和工程可用性方面表现更稳。更加适合前端任务、跨文件代码开发、长文档分析、办公自动化和多步骤 Agent 工作流等实用场景。

    2026-07-07 Listed¥1/M Input¥4/M Output256K Context

24 / 335 models loaded

←Previous
  1. 1
  2. 2
  3. 3
  4. 4
  5. …
  6. 14
Page 3 of 14Next→
General filters0
Use case

No matching options

Provider

No matching options

Input modality
Minimum context
General filters