正在加载…
跳到主要内容
企业网关全新版本重磅上线!现可免费开通体验~查看详情
Modelmesh
核心产品
LoomLoomSkillApp 市场企业级 AI 网关AI群聊
大模型超市
模型中心开发者模型
云端工厂
AI 模型部署服务云端智能集群
Agent 接入精益社区关于我们
文档控制台切换英文
文档控制台切换英文
登录/注册正在验证
开通企业网关Pro独享高性能资源与专属服务
主账号:—
账户充值API密钥收益管理
个人设置

兑换代金券

ModelmeshModelmesh 主导航
文档控制台切换英文
登录/注册
正在验证

模型中心

汇聚 335 个模型,公开价格、能力与上下文信息;路由至不同供应商时,实际价格可能有所差异。更多价格信息请查看模型详情页

335/ 335个模型
排序
价格对比
全部文本图像生成视频生成音频生成音频转录3D生成向量化重排决策
  • Ali / Qwen3.5-Omni-Flash

    调用ID:ali/qwen3.5-omni-flash
    文本多模态理解内容创作对话与客服语音处理

    Qwen3.5-Omni是Qwen最新一代全模态大模型,支持文本,图片,音频,音视频理解与交互。作为 Qwen3-Omni 的全面进化版本, 支持超过 10 小时的音频理解及超过 400 秒的 720P(1 FPS)音视频理解与对话,并进一步拓展语言范围,支持60+种语言音频输入,30+语言语音输出,并且具备强大的结构化音视频理解能力,广泛应用于文本创作、语音助手、多媒体分析等场景,提供自然流畅的多模态理解与交互体验。

    2026-08-27 上架
    多项属性定价

    多项属性定价

    音频·输入

    • 公开价格¥18/M token

    音频·输出

    • 公开价格¥72/M token

    图片·输入

    • 公开价格¥2.2/M token

    视频·输入

    • 公开价格¥2.2/M token

    search_strategy:agent

    • 公开价格¥0.004/次调用
  • Ali / Qwen3.5-Omni-Plus

    调用ID:ali/qwen3.5-omni-plus
    文本多模态理解内容创作对话与客服语音处理

    Qwen3.5-Omni是Qwen最新一代全模态大模型,支持文本,图片,音频,音视频理解与交互。作为 Qwen3-Omni 的全面进化版本, 支持超过 10 小时的音频理解及超过 400 秒的 720P(1 FPS)音视频理解与对话,并进一步拓展语言范围,支持60+种语言音频输入,30+语言语音输出,并且具备强大的结构化音视频理解能力,广泛应用于文本创作、语音助手、多媒体分析等场景,提供自然流畅的多模态理解与交互体验。

    2026-08-27 上架
    多项属性定价

    多项属性定价

    音频·输入

    • 公开价格¥53/M token

    音频·输出

    • 公开价格¥213/M token

    图片·输入

    • 公开价格¥7/M token

    视频·输入

    • 公开价格¥7/M token

    search_strategy:agent

    • 公开价格¥0.004/次调用
  • Ali / Qwen3.8-Flash

    调用ID:ali/qwen3.8-flash
    文本多模态理解智能代理与数据文档与办公编程

    Qwen3.8-Flash 是千问最新推出的多模态大模型,兼具强大的理解与生成能力和出色的响应速度。模型原生支持百万级上下文窗口,能够一次性处理超长文档、代码仓库和复杂对话。在编程辅助、智能体协作、图文理解等场景中表现尤为出色——无论是自动修复代码、操作桌面应用,还是分析图表与长视频,都能给出准确、高质量的结果。同时兼容 OpenAI 与 Anthropic 主流接口协议,可无缝接入 Claude Code、Codex 等开发者工具,轻松构建高并发应用与智能工作流。凭借优异的性能与极具竞争力的推理成本,Qwen3.8-Flash 是开发者和企业在 AI 应用中兼顾效果与效率的理想选择。

    2026-08-27 上架¥1/M 输入¥3/M 输出1M 上下文
  • Anthropic / Claude Haiku 4.5

    调用ID:anthropic/claude-haiku-4.5
    文本编程智能代理与数据对话与客服

    Claude Haiku 4.5 为各种用例提供​​近乎前沿的性能,并脱颖而出,成为最佳编码和代理模型之一——其速度和成本恰到好处,能够为免费产品和海量用户体验提供支持。用例:为免费层级用户体验提供支持:Claude Haiku 4.5 以合理的成本和速度提供近乎前沿的性能,使为免费代理产品和代理用例提供支持在经济上可行。

    2025-10-16 上架
    多项属性定价

    多项属性定价

    缓存写(5m)

    • 公开价格¥8.75/M token

    缓存写(1h)

    • 公开价格¥14/M token
  • Anthropic / Claude Haiku 4.5 Thinking

    调用ID:anthropic/claude-haiku-4.5:thinking
    文本编程智能代理与数据多模态理解

    Claude Haiku 4.5 为各种用例提供​​近乎前沿的性能,并脱颖而出,成为最佳编码和代理模型之一——其速度和成本恰到好处,能够为免费产品和海量用户体验提供支持。用例:为免费层级用户体验提供支持:Claude Haiku 4.5 以合理的成本和速度提供近乎前沿的性能,使为免费代理产品和代理用例提供支持在经济上可行。

    2025-10-16 上架
    多项属性定价

    多项属性定价

    缓存写(5m)

    • 公开价格¥8.75/M token

    缓存写(1h)

    • 公开价格¥14/M token
  • Google / Veo3.1-fast

    调用ID:google/veo3.1-fast-preview
    视频生成文本图像

    Veo 3.1 是 Google 最先进的模型,可生成高保真度的 8 秒 720p 或 1080p 视频,这些视频具有惊人的逼真效果和原生生成的音频。

    2025-10-16 上架
    多项属性定价

    多项属性定价

    基础单价(无音频)

    • 公开价格¥0.7/秒

    含音频单价

    • 公开价格¥1.05/秒
  • OpenAI / Sora2

    调用ID:openai/sora2
    视频生成视频与3D

    Sora2 是OpenAI 于2025 年9 月30 日发布的AI 视频生成模型升级版。 它在物理模拟、真实感和可控性方面大幅提升,能够生成高度逼真的视频,包括复杂动作如奥运体操或滑水后空翻等场景,并首次支持与画面匹配的AI 音频生成。

    2025-10-16 上架
    多项属性定价

    多项属性定价

    每秒

    • 公开价格¥0.7/秒
  • DeepSeek / DeepSeek-V4-Flash-Vision-Exp

    调用ID:deepseek/deepseek-v4-flash-vision-exp
    文本多模态理解智能代理与数据文档与办公

    DeepSeek V4 Flash Vision Exp是DeepSeek推出的DeepSeek V4 Flash 0731实验版视觉能力版本,新增图像理解能力,同时在智能代理、推理以及世界知识等文本能力方面与基础模型保持同等水平。该模型为稀疏混合专家模型,总参数量2840亿,激活参数量130亿。适用于文档与图表理解、视觉问答,以及文本与图像交替处理的多模态智能代理工作流。

    2026-08-24 上架¥1/M 输入¥4/M 输出1M 上下文
  • bigmodel / GLM-5.3

    调用ID:bigmodel/glm-5.3
    文本智能代理与数据编程

    GLM-5.3 是智谱最新旗舰模型,复杂软件工程与 Agent 任务能力全面进阶。它使用与 GLM-5.2 相同的基础模型——所有提升均来自后训练。与 GLM-5.2 相比,它在复杂编程和长程任务方面表现更加出色。

    2026-08-19 上架¥8/M 输入¥28/M 输出1M 上下文
  • Ali / Qwen3.8 27B

    调用ID:ali/qwen3.8-27b
    文本多模态理解智能代理与数据文档与办公编程数学与科学

    Qwen3.8 27B是通义千问推出的一款开放权重稠密多模态视觉语言模型。该模型适用于代码编写、专业工作流程、科研、多模态交互以及长时间运行的智能体任务,可开启或关闭灵活思考能力。

    2026-08-17 上架¥3/M 输入¥12/M 输出1M 上下文
  • MiniMax / MiniMax M2.7

    调用ID:minimax/minimax-m2.7
    文本编程文档与办公智能代理与数据对话与客服

    M2.7 在真实的软件工程中有优异的表现,包括端到端的完整项目交付,分析日志排查 Bug、代码安全,机器学习等。 在专业办公领域,我们提升了模型在各领域的专业知识和任务交付能力,在 GDPval-AA 的ELO得分是1495,为开源最高。M2.7 对 Office 三件套 Excel/PPT/Word 的复杂编辑能力显著提升,能更好地完成多轮修改和高保真的编辑。 M2.7具备与复杂环境交互的能力,M2.7 在 40 个复杂 skills (> 2000 Token) 的 case 上,仍能保持 97% 的 skills 遵循率。在OpenClaw的使用中,M2.7相比于M2.5也有了显著的提升,在MMClaw的评测中接近最新的Sonnet 4.6。 M2.7具备优秀的身份保持能力和情商,除了生产力使用外,给互动娱乐场景的创新也准备了空间。

    2026-03-18 上架
    多项属性定价

    多项属性定价

    缓存写(5m)

    • 公开价格¥2.625/M token
  • Streamlake / KAT-Coder-Air-V1

    调用ID:streamlake/kat-coder-air-v1
    文本编程智能代理与数据

    KAT-Coder 系列模型中的轻量化版本。专为 Agentic Coding 设计,全面覆盖编程任务与场景,通过大规模智能体强化学习,实现智能行为涌现,在代码编写性能上显著超越同类模型。

    2025-11-13 上架¥0.0001/M 输入¥0/M 输出128K 上下文
  • DeepSeek / DeepSeek-V4-Pro-0813

    调用ID:deepseek/deepseek-v4-pro
    文本智能代理与数据编程数学与科学

    DeepSeek V4 Pro 是 DeepSeek 推出的大型专家混合模型,它专为高级推理、编码和长远视野代理工作流设计,在知识、数学和软件工程基准测试中表现出色。它基于与 DeepSeek V4 Flash 相同的架构,引入了混合注意力系统,实现高效的长上下文处理,并支持多种推理模式,根据任务平衡速度和深度。它非常适合复杂工作负载,如全代码库分析、多步自动化和大规模信息综合,这些工作在能力和效率上都至关重要。

    2026-08-14 上架¥4.5/M 输入¥13.5/M 输出1M 上下文
  • Ali / HappyHorse-1.1-T2V

    调用ID:ali/happyhorse-1.1-t2v
    视频生成视频与3D内容创作

    HappyHorse-1.1-T2V支持文生视频,进一步提升文本语义理解、镜头调度与动态生成表现。模型能够更精准地还原创作意图,在人物动作、场景氛围、视觉美感和物理运动上生成更流畅自然、细节丰富且一致性更高的高质量视频。

    2026-08-12 上架
    多项属性定价

    多项属性定价

    视频

    • 480P¥0.45/次
    • 720P¥0.9/次
    • 1080P¥1.2/次
  • Ali / Qwen3.7-Flash

    调用ID:ali/qwen3.7-flash
    文本多模态理解智能代理与数据编程

    Qwen3.7原生视觉语言系列Flash模型,相较3.6-Flash全面提升多模态理解与Agent执行能力。重点强化多模态基础能力、万物识别能力更强,真实世界感知与空间智能进一步提升,Search Agent、CI Agent等多模态Agent场景能力显著升级、端到端任务执行更稳定,多模态Coding能力优化、vibe coding 体验更加流畅。

    2026-08-12 上架
    多项属性定价

    多项属性定价

    输入

    • ≤32k¥0.2/M token
    • 32k~256k¥0.8/M token
    • 256k~1000k¥1.2/M token

    输出

    • ≤32k¥2/M token
    • 32k~256k¥8/M token
    • 256k~1000k¥12/M token

    缓存读

    • ≤32k¥0.02/M token
    • 32k~256k¥0.08/M token
    • 256k~1000k¥0.12/M token

    i2i_search

    • 公开价格¥0.048/次调用

    t2i_search

    • 公开价格¥0.024/次调用

    web_search

    • 公开价格¥0.004/次调用

    显式缓存命中

    • ≤32k¥0.02/M token
    • 32k~256k¥0.06/M token
    • 256k~1000k¥0.12/M token

    缓存写(5m)

    • ≤32k¥0.25/M token
    • 32k~256k¥0.75/M token
    • 256k~1000k¥1.5/M token
  • MiniMax / MiniMax H3

    调用ID:minimax/minimax-h3
    视频生成多模态理解视频与3D内容创作

    MiniMax H3 是开放通用的多模态视频模型,可以统一理解文本、图片、视频和音频输入,完成视频生成、参考创作与视频编辑。

    2026-08-12 上架
    多项属性定价

    多项属性定价

    参考图片(前 5 张免费)

    • 公开价格¥0.2/张

    每秒输出

    • 2K¥0.8/秒
    • 768P¥0.5/秒

    每秒输入

    • 2K¥0.8/秒
    • 768P¥0.5/秒
  • Streamlake / KAT-Coder-Pro-V1

    调用ID:streamlake/kat-coder-pro-v1
    文本编程智能代理与数据

    专为 Agentic Coding 设计,全面覆盖编程任务与场景,通过大规模智能体强化学习,实现智能行为涌现,在代码编写性能上显著超越同类模型。

    2025-11-13 上架
    多项属性定价

    多项属性定价

    输入

    • ≤32k¥4/M token
    • 32k~128k¥6/M token
    • 128k~不限¥10/M token

    输出

    • ≤32k¥16/M token
    • 32k~128k¥24/M token
    • 128k~不限¥40/M token

    缓存读

    • ≤32k¥0.8/M token
    • 32k~128k¥1.2/M token
    • 128k~不限¥2/M token
  • Ali / Qwen3.5-4B

    调用ID:ali/qwen3.5-4b
    文本多模态理解智能代理与数据

    Qwen3.5-4B 是通义千问团队推出的原生多模态大语言模型,拥有 4B 参数,是 Qwen3.5 系列中最轻量的 Dense 模型。该模型采用门控 Delta 网络与门控注意力相结合的高效混合架构,原生支持 256K 上下文长度,并可扩展至约 100 万 tokens。模型通过早期融合训练实现了统一的视觉语言基础能力,支持文本、图像和视频理解,在同规模模型中表现优异,多项指标超越 GPT-5-Nano 和 Gemini-2.5-Flash-Lite。模型默认启用思考模式(Thinking Mode),支持工具调用,并覆盖 201 种语言和方言

    2026-08-05 上架¥0/M 输入¥0/M 输出256K 上下文
  • Ali / Qwen3.5-9B

    调用ID:ali/qwen3.5-9b
    文本多模态理解智能代理与数据

    Qwen3.5-9B 是通义千问团队推出的原生多模态大语言模型,拥有 9B 参数。作为 Qwen3.5 系列的轻量级 Dense 模型,它采用门控 Delta 网络与门控注意力相结合的高效混合架构,原生支持 256K 上下文长度,并可扩展至约 100 万 tokens。模型通过早期融合训练实现了统一的视觉语言基础能力,支持文本、图像和视频理解。模型默认启用思考模式(Thinking Mode),支持工具调用,并覆盖 201 种语言和方言

    2026-08-05 上架¥0.5/M 输入¥1.5/M 输出256K 上下文
  • Ali / Qwen3.5-27B

    调用ID:ali/qwen3.5-27b
    文本多模态理解

    Qwen3.5系列27B原生视觉语言Dense模型,融合了线性注意力机制;响应速度快,兼具推理速度和性能。该模型的综合能力接近于Qwen3.5-122B-A10B。

    2026-08-05 上架
    多项属性定价

    多项属性定价

    输入

    • ≤128k¥0.6/M token
    • 128k~256k¥1.8/M token

    输出

    • ≤128k¥4.8/M token
    • 128k~256k¥14.4/M token

    i2i_search

    • 公开价格¥0.048/次调用

    t2i_search

    • 公开价格¥0.024/次调用

    web_search

    • 公开价格¥0.004/次调用
  • Ali / Qwen3.5-35B-A3B

    调用ID:ali/qwen3.5-35b-a3b
    文本多模态理解

    Qwen3.5系列35B-A3B原生视觉语言模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。该模型的综合表现接近于Qwen3.5-27B。

    2026-08-05 上架
    多项属性定价

    多项属性定价

    输入

    • ≤128k¥0.4/M token
    • 128k~256k¥1.6/M token

    输出

    • ≤128k¥3.2/M token
    • 128k~256k¥12.8/M token

    i2i_search

    • 公开价格¥0.048/次调用

    t2i_search

    • 公开价格¥0.024/次调用

    web_search

    • 公开价格¥0.004/次调用
  • Ali / Qwen3.5-122B-A10B

    调用ID:ali/qwen3.5-122b-a10b
    文本多模态理解

    Qwen3.5系列122B-A10B原生视觉语言模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。该模型的综合表现仅次于Qwen3.5-397B-A17B,文本能力显著优于Qwen3-235B-2507,视觉能力优于Qwen3-VL-235B。

    2026-08-05 上架
    多项属性定价

    多项属性定价

    输入

    • ≤128k¥0.8/M token
    • 128k~256k¥2/M token

    输出

    • ≤128k¥6.4/M token
    • 128k~256k¥16/M token

    i2i_search

    • 公开价格¥0.048/次调用

    t2i_search

    • 公开价格¥0.024/次调用

    web_search

    • 公开价格¥0.004/次调用
  • Ali / Qwen3.6-27B

    调用ID:ali/qwen3.6-27b
    文本多模态理解智能代理与数据文档与办公编程数学与科学

    Qwen3.6系列27B原生视觉语言Dense模型,模型效果相较3.5-27B重点提升了Agentic coding能力、模型STEM与推理能力进一步增强;视觉模态方面在空间智能、物体定位与检测能力上显著增强,视频理解、文档OCR及视觉Agent能力稳步提升。

    2026-08-05 上架¥3/M 输入¥18/M 输出256K 上下文
  • OpenAI / GPT-5.1

    调用ID:openai/gpt-5.1
    文本编程数学与科学智能代理与数据对话与客服多模态理解

    GPT-5.1 是 GPT-5 系列的最新前沿模型,与 GPT-5 相比,它拥有更强大的通用推理能力、更高的指令遵循度以及更自然的对话风格。它采用自适应推理技术动态分配计算资源,能够快速响应简单查询,同时在处理复杂任务时投入更多精力。该模型能够生成更清晰、更贴近实际的解释,减少专业术语的使用,即使是技术性或多步骤问题也更容易理解。 GPT-5.1 旨在覆盖广泛的任务,在数学、编程和结构化分析等工作负载方面均取得了持续的提升,能够提供更连贯的长篇答案,并提高工具使用的可靠性。它还改进了对话对齐方式,能够在不牺牲准确性的前提下,提供更亲切、更直观的回答。GPT-5.1 是 GPT-5 的主要全功能继任者。

    2025-11-19 上架¥8.75/M 输入¥70/M 输出400K 上下文

24 / 335 个模型已加载

←上一页
  1. 1
  2. 2
  3. 3
  4. …
  5. 14
第 2 页,共 14 页下一页→
通用筛选0
适用场景

没有匹配的选项

厂商

没有匹配的选项

输入模态
最低上下文
通用筛选