正在加载…
跳到主要内容
企业网关全新版本重磅上线!现可免费开通体验~查看详情
Modelmesh
核心产品
LoomLoomSkillApp 市场企业级 AI 网关AI群聊
大模型超市
模型中心开发者模型
云端工厂
AI 模型部署服务云端智能集群
Agent 接入精益社区关于我们
文档控制台切换英文
文档控制台切换英文
登录/注册正在验证
开通企业网关Pro独享高性能资源与专属服务
主账号:—
账户充值API密钥收益管理
个人设置

兑换代金券

ModelmeshModelmesh 主导航
文档控制台切换英文
登录/注册
正在验证

模型中心

汇聚 335 个模型,公开价格、能力与上下文信息;路由至不同供应商时,实际价格可能有所差异。更多价格信息请查看模型详情页

213/ 335个模型
排序
价格对比
全部文本图像生成视频生成音频生成音频转录3D生成向量化重排决策
  • bigmodel / GLM-5.3-Flash

    调用ID:bigmodel/glm-5.3-flash
    文本多模态理解智能代理与数据文档与办公编程

    GLM‑5.3‑Flash为GLM‑5系列首款原生多模态模型,以低成本架构实现优于GLM‑5.2的能力,采用总参320B、激活参18B的稀疏与线性注意力混合架构,在保障长上下文精度的同时大幅降低算力与KV缓存开销;它将视觉原生融入代码流程,可识别界面渲染反馈完成前端、游戏、Blender及真实环境操控类任务,同时拓展至办公、金融研究、专业文档场景,能够拆解任务、调用工具、自检优化,一站式输出PPTX、PDF、DOCX、XLSX等成品文档。

    2026-08-27 上架¥0.8/M 输入¥2.8/M 输出1M 上下文
  • DeepSeek / DeepSeek-V4.1-Flash

    调用ID:deepseek/deepseek-v4.1-flash
    文本多模态理解智能代理与数据编程

    DeepSeek V4.1Flash 的中间版本内测。采用了新的模型结构,原生多模态支持、能力 更强、速度更快、且成本更低。

    2026-09-09 上架¥1/M 输入¥4/M 输出1M 上下文
  • Anthropic / Claude Fable 5.1

    调用ID:anthropic/claude-fable-5.1
    文本智能代理与数据文档与办公编程数学与科学

    Claude Fable 5.1 在各方面均对 Claude Fable 5 进行了优化提升,在智能体编码、长时间运行的智能体工作流以及知识工作场景下提升最为显著:具体体现在大规模代码重构、前端与可视化代码生成,以及金融和分析类任务方面。相比 Fable 5,它输出的方案与摘要也往往更加简洁。建议你在当前使用 Fable 5 的所有场景直接升级试用该版本,同时在高推理强度任务中搭配 Opus 5 一同使用。

    2026-09-02 上架
    多项属性定价

    多项属性定价

    缓存写(5m)

    • 公开价格¥87.5/M token

    缓存写(1h)

    • 公开价格¥140/M token
  • OpenAI / GPT 5.2 Codex

    调用ID:openai/gpt-5.2-codex
    文本编程多模态理解智能代理与数据

    GPT-5.2-Codex 旨在实现可导向性、前端开发和交互性。 开发者可以利用 gpt-5.2-codex 进行各种智能、多模态的开发任务。对于寻求更智能、更安全、更集成 AI 协助的开发者来说,该模型为你的 AI 工具包提供了强大的新工具。

    2026-01-16 上架¥12.25/M 输入¥98/M 输出400K 上下文
  • Xiaomi / MiMo-V2.5-Pro

    调用ID:xiaomi/mimo-v2.5-pro
    文本智能代理与数据编程

    Xiaomi MiMo-V2-Pro 专为现实世界中高强度的 Agent 工作场景而打造。它拥有超过 1T 的总参数量(42B 激活参数),采用创新的混合注意力架构,并支持 1M 超长上下文长度。在强大的模型基座上,我们在更为广泛的 Agent 场景中持续 Scaling 算力,进一步拓展了智能的动作空间,实现了从 Coding 到 Claw 的重要泛化。

    2026-04-27 上架¥3/M 输入¥6/M 输出1M 上下文
  • OpenAI / GPT-6-Luna

    调用ID:openai/gpt-6-luna
    文本智能代理与数据编程对话与客服

    GPT-6 Luna是OpenAI GPT-6系列中速度快、性价比高的模型,定位低于GPT-6 Sol。它适用于高并发、对延迟敏感的工作负载,例如对话、分类以及轻量智能体任务;在调高推理算力投入时,它能够处理原本需要Sol级别模型才能完成的复杂软件工程与计算机操作任务。该模型继承了GPT-6系列在事实可靠性方面的提升,以及更清晰、简洁的表达风格。

    2026-09-23 上架
    多项属性定价

    多项属性定价

    输入

    • ≤272k¥0.7/M token
    • 272k~不限¥1.4/M token

    输出

    • ≤272k¥3.5/M token
    • 272k~不限¥5.25/M token

    缓存读

    • ≤272k¥0.07/M token
    • 272k~不限¥0.14/M token

    缓存写(5m)

    • ≤272k¥0.875/M token
    • 272k~不限¥1.75/M token
  • OpenAI / GPT-6-Sol

    调用ID:openai/gpt-6-sol
    文本智能代理与数据编程

    GPT-6 Sol是OpenAI GPT-6系列中性价比出色的高端模型,定位低于旗舰款GPT-6 Astra,高于轻量高速版本GPT-6 Luna。该模型适用于高要求的专业工作、智能体代码开发、业务流程自动化以及计算机操作场景,尤其擅长基于真实代码库开展长周期软件工程任务。它能以低得多的成本达到接近Astra水平的事实可靠性,并且在技术与代码对话中,拥有和Astra一样清晰简洁的表达风格。

    2026-09-23 上架
    多项属性定价

    多项属性定价

    输入

    • ≤272k¥14/M token
    • 272k~不限¥28/M token

    输出

    • ≤272k¥70/M token
    • 272k~不限¥105/M token

    缓存读

    • ≤272k¥1.4/M token
    • 272k~不限¥2.8/M token

    缓存写(5m)

    • ≤272k¥17.5/M token
    • 272k~不限¥35/M token
  • Xiaomi / MiMo-V2.6-Pro-UltraSpeed

    调用ID:xiaomi/mimo-v2.6-pro-ultraspeed
    文本多模态理解智能代理与数据文档与办公视频与3D内容创作编程数学与科学图像与设计

    兼顾 V2.6-Pro 旗舰性能,提供最高 20 倍输出速度,服务强实时交互与对响应速度敏感的生产场景。旗舰级性能无折扣完全保留,复杂任务体验相同,不因速度牺牲智能,输出速度最高为 V2.6-Pro 的 20 倍,满足强实时交互与对响应速度敏感的场景

    2026-09-22 上架¥30/M 输入¥60/M 输出1M 上下文
  • Xiaomi / MiMo-V2.6-Pro

    调用ID:xiaomi/mimo-v2.6-pro
    文本多模态理解智能代理与数据文档与办公视频与3D内容创作编程数学与科学图像与设计

    MiMo-V2.6-Pro 是小米 MiMo-V2.6 系列旗舰原生全模态模型,支持 1M 超长上下文,适配多模态、多 Agent 、多 Harness 协同复杂任务。重点优化代码、办公、设计、科研、创作、网络安全、电脑操控能力。

    2026-09-22 上架¥3/M 输入¥6/M 输出1M 上下文
  • Xiaomi / MiMo-V2.6-Flash

    调用ID:xiaomi/mimo-v2.6-flash
    文本多模态理解

    MiMo-V2.6-Flash 是小米推出的原生全模态 MoE 开源模型,支持图文音视频输入与百万级长上下文,经强化学习优化,兼顾推理能力与推理成本,适合高并发大规模业务调用。

    2026-09-22 上架¥1/M 输入¥2/M 输出1M 上下文
  • MiniMax / MiniMax M2.1

    调用ID:minimax/minimax-m2.1
    文本编程

    MiniMax M2.1,强大多语言编程实力,全面升级编程体验

    2025-12-23 上架
    多项属性定价

    多项属性定价

    缓存写(5m)

    • 公开价格¥2.625/M token
  • Anthropic / Claude Sonnet 4.5

    调用ID:anthropic/claude-sonnet-4.5
    文本编程智能代理与数据多模态理解

    Claude Sonnet 4.5 是 Anthropic 迄今为止最先进的 Sonnet 模型,针对真实代理和编码工作流程进行了优化。它在 SWE-bench Verified 等编码基准测试中展现出顶尖性能,并在系统设计、代码安全性和规范遵循性方面均有所改进。该模型旨在实现扩展自主操作,保持跨会话的任务连续性,并提供基于事实的进度跟踪。 Sonnet 4.5 还引入了更强大的代理功能,包括改进的工具编排、推测并行执行以及更高效的上下文和内存管理。凭借增强的上下文跟踪和跨工具调用的令牌使用感知功能,它尤其适用于多上下文和长时间运行的工作流。用例涵盖软件工程、网络安全、财务分析、研究代理以及其他需要持续推理和工具使用的领域。

    2025-09-30 上架
    多项属性定价

    多项属性定价

    缓存写(5m)

    • 公开价格¥26.25/M token

    缓存写(1h)

    • 公开价格¥42/M token
  • OpenAI / GPT-6-Astra

    调用ID:openai/gpt-6-astra
    文本多模态理解智能代理与数据文档与办公编程数学与科学

    GPT‑6 Astra是OpenAI面向高要求端到端工作的旗舰模型。它适用于高级分析、软件工程、深度研究、科研工作以及文档创作,在涉及计算机与浏览器操作的长周期智能代理任务方面具备突出优势。

    2026-09-07 上架
    多项属性定价

    多项属性定价

    输入

    • ≤272k¥70/M token
    • 272k~不限¥140/M token

    输出

    • ≤272k¥350/M token
    • 272k~不限¥525.001/M token

    缓存读

    • ≤272k¥7/M token
    • 272k~不限¥14/M token

    缓存写(5m)

    • ≤272k¥87.5/M token
    • 272k~不限¥175/M token
  • Ali / Qwen3.8-Max-0902(快照版)

    调用ID:ali/qwen3.8-max-0902
    文本多模态理解智能代理与数据文档与办公编程数学与科学

    Qwen3.8-Max-0902(别名qwen3.8-max-2026-09-02)是qwen3.8-max的快照版本。编码深度再突破,可驾驭更复杂的工程级项目与长程自主开发;协作智能体能力显著增强,在多工具调度与端到端交付中表现更从容;视觉理解全面精进,图表推理、文档解析与多模态感知更敏锐准确。延续 100 万上下文、思考模式与完整工具生态,在更高智能水平上持续进化。

    2026-09-03 上架¥12/M 输入¥36/M 输出1M 上下文
  • Google / Gemini 3.8 Flash

    调用ID:google/gemini-3.8-flash
    文本智能代理与数据编程

    Gemini 3.8 Flash 是谷歌旗下能力最强的 Flash 模型,相较于 3.7 Flash 版本,它在软件工程、智能代理任务以及多步推理方面实现了大幅提升。

    2026-09-03 上架¥5.25/M 输入¥26.25/M 输出1M 上下文
  • Anthropic / Claude Sonnet 4.5 Thinking

    调用ID:anthropic/claude-sonnet-4.5:thinking
    文本智能代理与数据编程多模态理解

    Claude Sonnet 4.5 是 Anthropic 迄今为止最先进的 Sonnet 模型,针对真实代理和编码工作流程进行了优化。它在 SWE-bench Verified 等编码基准测试中展现出顶尖性能,并在系统设计、代码安全性和规范遵循性方面均有所改进。该模型旨在实现扩展自主操作,保持跨会话的任务连续性,并提供基于事实的进度跟踪。 Sonnet 4.5 还引入了更强大的代理功能,包括改进的工具编排、推测并行执行以及更高效的上下文和内存管理。凭借增强的上下文跟踪和跨工具调用的令牌使用感知功能,它尤其适用于多上下文和长时间运行的工作流。用例涵盖软件工程、网络安全、财务分析、研究代理以及其他需要持续推理和工具使用的领域。

    2025-09-30 上架
    多项属性定价

    多项属性定价

    缓存写(5m)

    • 公开价格¥26.25/M token

    缓存写(1h)

    • 公开价格¥42/M token
  • Google / Gemini 3.7 Flash

    调用ID:google/gemini-3.7-flash
    文本多模态理解智能代理与数据编程

    Gemini 3.7 Flash 是谷歌推出的多模态模型,适用于智能代理工作流、代码编写以及复杂多步推理场景。该模型专为需要响应迅速、可稳定完成多步问题求解的任务打造。

    2026-08-31 上架¥5.25/M 输入¥26.25/M 输出1M 上下文
  • Anthropic / Claude Haiku 4.5

    调用ID:anthropic/claude-haiku-4.5
    文本编程智能代理与数据对话与客服

    Claude Haiku 4.5 为各种用例提供​​近乎前沿的性能,并脱颖而出,成为最佳编码和代理模型之一——其速度和成本恰到好处,能够为免费产品和海量用户体验提供支持。用例:为免费层级用户体验提供支持:Claude Haiku 4.5 以合理的成本和速度提供近乎前沿的性能,使为免费代理产品和代理用例提供支持在经济上可行。

    2025-10-16 上架
    多项属性定价

    多项属性定价

    缓存写(5m)

    • 公开价格¥8.75/M token

    缓存写(1h)

    • 公开价格¥14/M token
  • Anthropic / Claude Haiku 4.5 Thinking

    调用ID:anthropic/claude-haiku-4.5:thinking
    文本编程智能代理与数据多模态理解

    Claude Haiku 4.5 为各种用例提供​​近乎前沿的性能,并脱颖而出,成为最佳编码和代理模型之一——其速度和成本恰到好处,能够为免费产品和海量用户体验提供支持。用例:为免费层级用户体验提供支持:Claude Haiku 4.5 以合理的成本和速度提供近乎前沿的性能,使为免费代理产品和代理用例提供支持在经济上可行。

    2025-10-16 上架
    多项属性定价

    多项属性定价

    缓存写(5m)

    • 公开价格¥8.75/M token

    缓存写(1h)

    • 公开价格¥14/M token
  • Tencent / Hunyuan-4-preview

    调用ID:tencent/hy4-preview
    文本智能代理与数据文档与办公编程

    混元Hy4 preview总参数770B、激活参数49B,重点面向Agent、Coding与生产力场景优化,强化复杂任务中的理解、规划、工具调用与持续执行能力。相比上一代模型,Hy4 preview在多步骤Agent、代码开发和生产力任务上进一步提升,具备更好的任务拆解、上下文承接、指令遵循和长链路执行能力。在Coding场景中,进一步增强代码理解、生成、修改和复杂工程任务处理能力;在生产力场景中,重点提升文档处理、信息分析、办公自动化、游戏开发、网页生成及跨工具协作等能力。Hy4 preview适用于Coding Agent、复杂工具调用以及各类需要多步骤规划和持续执行的Agent工作流,为真实业务场景中的复杂任务提供更可靠的任务完成能力。

    2026-08-28 上架¥6/M 输入¥18/M 输出1M 上下文
  • Ali / Qwen3.5-Omni-Flash

    调用ID:ali/qwen3.5-omni-flash
    文本多模态理解内容创作对话与客服语音处理

    Qwen3.5-Omni是Qwen最新一代全模态大模型,支持文本,图片,音频,音视频理解与交互。作为 Qwen3-Omni 的全面进化版本, 支持超过 10 小时的音频理解及超过 400 秒的 720P(1 FPS)音视频理解与对话,并进一步拓展语言范围,支持60+种语言音频输入,30+语言语音输出,并且具备强大的结构化音视频理解能力,广泛应用于文本创作、语音助手、多媒体分析等场景,提供自然流畅的多模态理解与交互体验。

    2026-08-27 上架
    多项属性定价

    多项属性定价

    音频·输入

    • 公开价格¥18/M token

    音频·输出

    • 公开价格¥72/M token

    图片·输入

    • 公开价格¥2.2/M token

    视频·输入

    • 公开价格¥2.2/M token

    search_strategy:agent

    • 公开价格¥0.004/次调用
  • Ali / Qwen3.5-Omni-Plus

    调用ID:ali/qwen3.5-omni-plus
    文本多模态理解内容创作对话与客服语音处理

    Qwen3.5-Omni是Qwen最新一代全模态大模型,支持文本,图片,音频,音视频理解与交互。作为 Qwen3-Omni 的全面进化版本, 支持超过 10 小时的音频理解及超过 400 秒的 720P(1 FPS)音视频理解与对话,并进一步拓展语言范围,支持60+种语言音频输入,30+语言语音输出,并且具备强大的结构化音视频理解能力,广泛应用于文本创作、语音助手、多媒体分析等场景,提供自然流畅的多模态理解与交互体验。

    2026-08-27 上架
    多项属性定价

    多项属性定价

    音频·输入

    • 公开价格¥53/M token

    音频·输出

    • 公开价格¥213/M token

    图片·输入

    • 公开价格¥7/M token

    视频·输入

    • 公开价格¥7/M token

    search_strategy:agent

    • 公开价格¥0.004/次调用
  • Ali / Qwen3.8-Flash

    调用ID:ali/qwen3.8-flash
    文本多模态理解智能代理与数据文档与办公编程

    Qwen3.8-Flash 是千问最新推出的多模态大模型,兼具强大的理解与生成能力和出色的响应速度。模型原生支持百万级上下文窗口,能够一次性处理超长文档、代码仓库和复杂对话。在编程辅助、智能体协作、图文理解等场景中表现尤为出色——无论是自动修复代码、操作桌面应用,还是分析图表与长视频,都能给出准确、高质量的结果。同时兼容 OpenAI 与 Anthropic 主流接口协议,可无缝接入 Claude Code、Codex 等开发者工具,轻松构建高并发应用与智能工作流。凭借优异的性能与极具竞争力的推理成本,Qwen3.8-Flash 是开发者和企业在 AI 应用中兼顾效果与效率的理想选择。

    2026-08-27 上架¥1/M 输入¥3/M 输出1M 上下文
  • Streamlake / KAT-Coder-Air-V1

    调用ID:streamlake/kat-coder-air-v1
    文本编程智能代理与数据

    KAT-Coder 系列模型中的轻量化版本。专为 Agentic Coding 设计,全面覆盖编程任务与场景,通过大规模智能体强化学习,实现智能行为涌现,在代码编写性能上显著超越同类模型。

    2025-11-13 上架¥0.0001/M 输入¥0/M 输出128K 上下文

24 / 213 个模型已加载

←上一页
  1. 1
  2. 2
  3. …
  4. 9
第 1 页,共 9 页下一页→
通用筛选0
适用场景

没有匹配的选项

厂商

没有匹配的选项

输入模态
最低上下文
通用筛选