正在加载…
跳到主要内容
企业网关全新版本重磅上线!现可免费开通体验~查看详情
Modelmesh
核心产品
LoomLoomSkillApp 市场企业级 AI 网关AI群聊
大模型超市
模型中心开发者模型
云端工厂
AI 模型部署服务云端智能集群
Agent 接入精益社区关于我们
文档控制台切换英文
文档控制台切换英文
登录/注册正在验证
开通企业网关Pro独享高性能资源与专属服务
主账号:—
账户充值API密钥收益管理
个人设置

兑换代金券

ModelmeshModelmesh 主导航
文档控制台切换英文
登录/注册
正在验证

模型中心

汇聚 335 个模型,公开价格、能力与上下文信息;路由至不同供应商时,实际价格可能有所差异。更多价格信息请查看模型详情页

213/ 335个模型
排序
价格对比
全部文本图像生成视频生成音频生成音频转录3D生成向量化重排决策
  • Claude 3.5 Haiku

    调用ID:anthropic/claude-3.5-haiku
    文本多模态理解对话与客服内容创作文档与办公编程
    +5
    文本多模态理解对话与客服内容创作文档与办公编程

    Claude 3.5 Haiku是Anthropic最快且最具成本效益的下一代模型,非常适合速度和经济性重要的应用场景。

    价格
    多项属性定价

    多项属性定价

    缓存写(5m)

    • 公开价格¥7/M token

    缓存写(1h)

    • 公开价格¥11.2/M token
    2025-07-24 上架
  • Agnes 3.0 Flash

    调用ID:agnes/agnes-3.0-flash
    文本智能代理与数据编程
    +2
    文本智能代理与数据编程

    Agnes 3.0 Flash 是 Agnes AI 推出的全新一代升级文本模型,面向 Agent 编程与工具驱动任务,重点提升复杂任务的端到端执行质量。

    输入
    ¥0/M
    输出
    ¥0/M
    上下文
    512K
    2026-09-18 上架
  • Gemini 2.5 Flash Nativa Audio

    调用ID:google/gemini-2.5-flash-live
    文本语音处理对话与客服多模态理解翻译
    +4
    文本语音处理对话与客服多模态理解翻译

    Gemini 2.5 Flash 的原生音频模型,支持Live API格式调用。

    输入
    ¥3.5/M
    输出
    ¥14/M
    上下文
    1M
    2025-12-17 上架
  • Qwen-Plus

    调用ID:ali/qwen-plus-latest
    文本对话与客服内容创作文档与办公编程学术与教育
    +5
    文本对话与客服内容创作文档与办公编程学术与教育

    通义千问系列能力均衡的模型,推理效果、成本和速度介于通义千问-Max和通义千问-Turbo之间,适合中等复杂任务。

    输入
    ¥0.8/M
    输出
    ¥2/M
    上下文
    131.1K
    2025-02-20 上架
  • ERNIE-4.0-Turbo-128K

    调用ID:baidu/ernie-4.0-turbo-128k
    文本文档与办公多模态理解内容创作编程学术与教育
    +5
    文本文档与办公多模态理解内容创作编程学术与教育

    百度自研的旗舰级超大规模⼤语⾔模型,综合效果表现出色,广泛适用于各领域复杂任务场景;支持自动对接百度搜索插件,保障问答信息时效。相较于ERNIE 4.0在性能表现上更优秀

    输入
    ¥3/M
    输出
    ¥9/M
    上下文
    124K
    2025-08-13 上架
  • InternVL3.5

    调用ID:intern/internvl3.5
    文本多模态理解
    +1
    文本多模态理解

    最新的发布的通用多模态大模型系列,拥有卓越的图文推理能力。

    输入
    ¥0/M
    输出
    ¥0/M
    上下文
    128K
    2026-07-07 上架
  • Agnes 2.5 Flash

    调用ID:agnes/agnes-2.5-flash
    文本多模态理解智能代理与数据编程对话与客服
    +4
    文本多模态理解智能代理与数据编程对话与客服

    Agnes 2.5 Flash 是基于 Agnes 2.0 Flash 升级的全量可用语言模型。它沿用 OpenAI 兼容的 Chat Completions 接入方式,同时在编码任务、智能体工作流、工具调用、多轮对话、推理和图像理解体验上进行了优化。

    输入
    ¥0/M
    输出
    ¥0/M
    上下文
    512K
    2026-08-28 上架
  • Intern-S1-Pro

    调用ID:intern/intern-s1-pro
    文本多模态理解智能代理与数据数学与科学学术与教育
    +4
    文本多模态理解智能代理与数据数学与科学学术与教育

    先进开源多模态推理模型,综合性能优秀,支持内置联网搜索能力

    输入
    ¥0/M
    输出
    ¥0/M
    上下文
    128K
    2026-07-07 上架
  • Intern-S1

    调用ID:intern/intern-s1
    文本多模态理解数学与科学学术与教育
    +3
    文本多模态理解数学与科学学术与教育

    融合了专业科学能力的多模态大模型

    输入
    ¥0/M
    输出
    ¥0/M
    上下文
    128K
    2026-07-07 上架
  • GLM-4.5-AirX

    调用ID:bigmodel/glm-4.5-airx
    文本对话与客服内容创作文档与办公
    +3
    文本对话与客服内容创作文档与办公

    GLM-4.5-AirX为GLM-4.5-Air的极速版,响应速度更快,专为大规模高速度需求打造。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤32k¥4/M token
    • ≤32k¥4/M token
    • 32k~不限¥8/M token

    输出

    • ≤2k¥12/M token
    • 2k~不限¥16/M token
    • 全部¥32/M token

    缓存读

    • 全部¥0.8/M token
    • 全部¥0.8/M token
    • 全部¥1.6/M token
    2025-07-29 上架
  • Intern-S2-Preview

    调用ID:intern/intern-s2-preview
    文本多模态理解智能代理与数据数学与科学学术与教育
    +4
    文本多模态理解智能代理与数据数学与科学学术与教育

    我们最新发布的 35B-A3B 科学多模态推理模型,支持 256K 上下文窗口;通过任务 scaling 与架构优化,重点提升科学发现和通用智能体能力。

    输入
    ¥0/M
    输出
    ¥0/M
    上下文
    128K
    2026-07-02 上架
  • Agnes 2.0 Flash

    调用ID:agnes/agnes-2.0-flash
    文本智能代理与数据多模态理解编程对话与客服
    +4
    文本智能代理与数据多模态理解编程对话与客服

    Agnes 2.0 Flash 是 Agnes AI 的快速高效语言模型,适合智能体工作流、工具调用、编码、多轮对话、推理和图像理解等高频生产场景。

    输入
    ¥0/M
    输出
    ¥0/M
    上下文
    512K
    2026-08-28 上架
  • Qwen-Turbo (Thinking)

    调用ID:ali/qwen-turbo-latest:thinking
    文本对话与客服内容创作文档与办公编程翻译
    +5
    文本对话与客服内容创作文档与办公编程翻译

    Qwen-Turbo基于Qwen2.5开发,具有速度快、成本低的特点,适用于处理简单任务。

    输入
    ¥0.3/M
    输出
    ¥3/M
    上下文
    131.1K
    2025-05-27 上架
  • Qwen-Turbo

    调用ID:ali/qwen-turbo-latest
    文本对话与客服文档与办公内容创作翻译智能代理与数据
    +5
    文本对话与客服文档与办公内容创作翻译智能代理与数据

    Qwen-Turbo基于Qwen2.5开发,是一款支持100万token上下文长度的大模型,具有速度快、成本低的特点,适用于处理简单任务。

    输入
    ¥0.3/M
    输出
    ¥0.6/M
    上下文
    1M
    2025-05-27 上架
  • Qwen-Plus (Thinking)

    调用ID:ali/qwen-plus-latest:thinking
    文本对话与客服文档与办公编程数学与科学智能代理与数据
    +5
    文本对话与客服文档与办公编程数学与科学智能代理与数据

    Qwen-Plus 基于 Qwen2.5 基础模型构建,是一款支持 131K 上下文长度的大模型,在性能、速度与成本之间实现了良好平衡。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤128k¥0.8/M token
    • 128k~256k¥2.4/M token
    • 256k~1000k¥4.8/M token

    输出

    • ≤128k¥8/M token
    • 128k~256k¥24/M token
    • 256k~1000k¥48/M token

    缓存读

    • ≤128k¥0.16/M token
    • 128k~256k¥0.48/M token
    • 256k~1000k¥0.96/M token

    显式缓存命中

    • ≤128k¥0.08/M token
    • 128k~256k¥0.24/M token
    • 256k~1000k¥0.48/M token

    缓存写(5m)

    • ≤128k¥1/M token
    • 128k~256k¥3/M token
    • 256k~1000k¥6/M token
    2025-05-27 上架
  • DeepSeek-V3

    调用ID:deepseek/deepseek-v3
    文本翻译编程数学与科学学术与教育文档与办公翻译
    +6
    文本翻译编程数学与科学学术与教育文档与办公翻译

    DeepSeek-V3是DeepSeek公司发布的一款大型语言模型,以其在数学、编码和中文等任务上的卓越性能而闻名。该模型采用了MoE架构,拥有6710亿参数,每个token激活的参数量为370亿,并且支持128K token的超长上下文窗口。DeepSeek-V3不仅在性能上对标GPT-4o等主流模型,还在推理速度和效率上取得了显著提升。

    输入
    ¥2/M
    输出
    ¥8/M
    上下文
    65.5K
    2025-02-20 上架
  • ERNIE-4.5-Turbo-128K

    调用ID:baidu/ernie-4.5-turbo-128k
    文本多模态理解文档与办公对话与客服
    +3
    文本多模态理解文档与办公对话与客服

    模型能力全面提升,更好满足多轮长历史对话处理、长文档理解问答任务。

    输入
    ¥0.8/M
    输出
    ¥3.2/M
    上下文
    128K
    2025-08-12 上架
  • Grok 3

    调用ID:x-ai/grok-3
    文本编程智能代理与数据文档与办公多模态理解
    +4
    文本编程智能代理与数据文档与办公多模态理解

    Grok 3是Grok的第三代版本,在数据提取、编码和文本摘要等企业用例中表现出色。

    输入
    ¥21/M
    输出
    ¥105/M
    上下文
    131.1K
    2025-07-22 上架
  • ERNIE-4.5-Turbo-128K-Preview

    调用ID:baidu/ernie-4.5-turbo-preview
    文本文档与办公对话与客服多模态理解
    +3
    文本文档与办公对话与客服多模态理解

    模型能力全面提升,更好满足多轮长历史对话处理、长文档理解问答任务。

    输入
    ¥0.8/M
    输出
    ¥3.2/M
    上下文
    128K
    2025-08-13 上架
  • GPT OSS 120B

    调用ID:openai/gpt-oss-120b
    文本智能代理与数据多模态理解编程数学与科学文档与办公
    +5
    文本智能代理与数据多模态理解编程数学与科学文档与办公

    GPT OSS 120B是OpenAI推出的开放权重、包含1170亿个参数的MoE语言模型,专为高推理、代理和通用生产用例而设计。它每次前向传递可激活51亿个参数,并经过优化,可在具有原生MXFP4量化的单个H100 GPU上运行。

    输入
    ¥0.7/M
    输出
    ¥3.5/M
    上下文
    131.1K
    2025-08-06 上架
  • GPT OSS 20B

    调用ID:openai/gpt-oss-20b
    文本智能代理与数据多模态理解对话与客服
    +3
    文本智能代理与数据多模态理解对话与客服

    GPT OSS 20B是OpenAI发布的开放权重210亿参数模型,它采用MoE架构,每次前向传递有36亿个有效参数,并针对低延迟推理和在消费级或单GPU硬件上的部署进行了优化。该模型采用OpenAI的Harmony响应格式进行训练,并支持推理级别配置、微调和代理功能,包括函数调用、工具使用和结构化输出。

    输入
    ¥0.35/M
    输出
    ¥1.4/M
    上下文
    131.1K
    2025-08-06 上架
  • ERNIE-4.5-Turbo-32K

    调用ID:baidu/ernie-4.5-turbo-32k
    文本内容创作多模态理解学术与教育对话与客服
    +4
    文本内容创作多模态理解学术与教育对话与客服

    文本创作、知识问答等能力提升显著。输出长度及整句时延相较ERNIE 4.5有所增加。

    输入
    ¥0.8/M
    输出
    ¥3.2/M
    上下文
    32K
    2025-08-13 上架
  • ERNIE-4.5-Turbo-VL-Preview

    调用ID:baidu/ernie-4.5-turbo-vl-preview
    文本多模态理解内容创作翻译编程
    +4
    文本多模态理解内容创作翻译编程

    文心一言大模型全新版本,图片理解、创作、翻译、代码等能力显著提升,首次支持32K上下文长度,首Token时延显著降低。

    输入
    ¥3/M
    输出
    ¥9/M
    上下文
    128K
    2025-08-13 上架
  • Llama 3.3 70B Instruct

    调用ID:meta/llama-3.3-70b-instruct
    文本对话与客服翻译内容创作文档与办公学术与教育
    +5
    文本对话与客服翻译内容创作文档与办公学术与教育

    Meta Llama 3.3 是一款多语言大语言模型,在 70B 参数规模下进行了预训练与指令微调,支持文本输入与输出。该模型专为多语言对话场景优化,具备强大的生成与理解能力。

    输入
    ¥0.84/M
    输出
    ¥2.1/M
    上下文
    128K
    2025-04-02 上架

24 / 213 个模型已加载

←上一页
  1. 1
  2. …
  3. 7
  4. 8
  5. 9
第 8 页,共 9 页下一页→
通用筛选0
适用场景

没有匹配的选项

厂商

没有匹配的选项

输入模态
最低上下文
通用筛选