正在加载…
跳到主要内容
企业网关全新版本重磅上线!现可免费开通体验~查看详情
Modelmesh
核心产品
LoomLoomSkillApp 市场企业级 AI 网关AI群聊
大模型超市
模型中心开发者模型
云端工厂
AI 模型部署服务云端智能集群
Agent 接入精益社区关于我们
文档控制台切换英文
文档控制台切换英文
登录/注册正在验证
开通企业网关Pro独享高性能资源与专属服务
主账号:—
账户充值API密钥收益管理
个人设置

兑换代金券

ModelmeshModelmesh 主导航
文档控制台切换英文
登录/注册
正在验证

模型中心

汇聚 335 个模型,公开价格、能力与上下文信息;路由至不同供应商时,实际价格可能有所差异。更多价格信息请查看模型详情页

335/ 335个模型
排序
价格对比
全部文本图像生成视频生成音频生成音频转录3D生成向量化重排决策
  • Hunyuan-T1-Vision

    调用ID:tencent/hunyuan-t1-vision
    文本多模态理解图像与设计文档与办公对话与客服
    +4
    文本多模态理解图像与设计文档与办公对话与客服

    采用混元MOE结构,是混元最新多模态模型,支持多语种作答,中英文能力均衡。

    输入
    ¥3/M
    输出
    ¥9/M
    上下文
    32K
    2025-11-06 上架
  • Claude-3.7-sonnet(Thinking)

    调用ID:anthropic/claude-3.7-sonnet:thinking
    文本编程数学与科学多模态理解编程文档与办公学术与教育
    +6
    文本编程数学与科学多模态理解编程文档与办公学术与教育

    Claude-3.7-sonnet(Thinking)是Anthropic于 2025 年推出的新一代思维型大语言模型。该模型首次融合自回归生成与符号推理架构,具备多步骤思维展示、自我纠错能力以及长达 10 万 tokens 的上下文理解能力,标志着AI从简单生成向深度逻辑推理与透明思考的跨越。

    价格
    多项属性定价

    多项属性定价

    缓存写(5m)

    • 公开价格¥26.25/M token

    缓存写(1h)

    • 公开价格¥42/M token
    2025-03-28 上架
  • DeepSeek-R1-0528

    调用ID:deepseek/deepseek-r1-0528
    文本编程翻译编程数学与科学
    +4
    文本编程翻译编程数学与科学

    DeepSeek R1-0528是DeepSeek R1模型的小版本升级版。通过增加计算资源和引入后训练阶段的算法优化,DeepSeek R1-0528显著提升了推理与推断的深度和能力。该模型在数学、编程及一般逻辑等多项基准测试中表现优异,整体性能已接近业内领先的 O3和Gemini 2.5 Pro模型,展现出强大的多领域应用潜力。

    输入
    ¥4/M
    输出
    ¥12/M
    上下文
    128K
    2025-02-20 上架
  • Qwen3-235B-A22B-Instruct-2507

    调用ID:ali/qwen3-235b-a22b-instruct-2507
    文本编程数学与科学多模态理解文档与办公翻译
    +5
    文本编程数学与科学多模态理解文档与办公翻译

    Qwen3-235B-A22B-Instruct-2507是Qwen3-235B-A22B-FP8的增强版本,在指令遵循、逻辑推理、文本理解、数学与编程能力、多语言知识覆盖等方面表现显著提升,并在256K长上下文处理和主观任务对齐度上进一步优化,生成内容更高质量、更贴近用户意图。

    输入
    ¥2/M
    输出
    ¥8/M
    上下文
    128K
    2025-07-23 上架
  • GLM-4.5-AirX Thinking

    调用ID:bigmodel/glm-4.5-airx:thinking
    文本对话与客服编程数学与科学
    +3
    文本对话与客服编程数学与科学

    GLM-4.5-AirX为GLM-4.5-Air的极速版,响应速度更快,专为大规模高速度需求打造。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤32k¥4/M token
    • ≤32k¥4/M token
    • 32k~不限¥8/M token

    输出

    • ≤2k¥12/M token
    • 2k~不限¥16/M token
    • 全部¥32/M token

    缓存读

    • 全部¥0.8/M token
    • 全部¥0.8/M token
    • 全部¥1.6/M token
    2025-09-29 上架
  • GLM-4.5-X

    调用ID:bigmodel/glm-4.5-x
    文本对话与客服编程文档与办公内容创作翻译
    +5
    文本对话与客服编程文档与办公内容创作翻译

    GLM-4.5-X为GLM-4.5的极速版,在性能强劲的同时,生成速度可达100tokens/秒。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤32k¥8/M token
    • ≤32k¥12/M token
    • 32k~不限¥16/M token

    输出

    • ≤2k¥16/M token
    • 2k~不限¥32/M token
    • 全部¥64/M token

    缓存读

    • 全部¥1.6/M token
    • 全部¥2.4/M token
    • 全部¥3.2/M token
    2025-07-29 上架
  • GLM-4.5-Air Thinking

    调用ID:bigmodel/glm-4.5-air:thinking
    文本数学与科学编程智能代理与数据对话与客服文档与办公
    +5
    文本数学与科学编程智能代理与数据对话与客服文档与办公

    GLM-4.5-Air为GLM-4.5的轻量版,兼顾性能与性价比,可灵活切换混合思考模型。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤32k¥0.8/M token
    • ≤32k¥0.8/M token
    • 32k~不限¥1.2/M token

    输出

    • ≤2k¥2/M token
    • 2k~不限¥6/M token
    • 全部¥8/M token

    缓存读

    • 全部¥0.16/M token
    • 全部¥0.16/M token
    • 全部¥0.24/M token
    2025-09-29 上架
  • MiniMax-M1

    调用ID:minimax/minimax-m1
    文本数学与科学编程多模态理解
    +3
    文本数学与科学编程多模态理解

    MiniMax-M1,世界上第一个开源的大规模混合架构的推理模型,适合在复杂场景中使用。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤32k¥0.8/M token
    • 32k~128k¥1.2/M token
    • 128k~不限¥2.4/M token

    输出

    • ≤32k¥8/M token
    • 32k~128k¥16/M token
    • 128k~不限¥24/M token
    2025-07-15 上架
  • GLM-4.5-Air

    调用ID:bigmodel/glm-4.5-air
    文本对话与客服编程文档与办公内容创作智能代理与数据
    +5
    文本对话与客服编程文档与办公内容创作智能代理与数据

    GLM-4.5-Air为GLM-4.5的轻量版,兼顾性能与性价比,可灵活切换混合思考模型。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤32k¥0.8/M token
    • ≤32k¥0.8/M token
    • 32k~不限¥1.2/M token

    输出

    • ≤2k¥2/M token
    • 2k~不限¥6/M token
    • 全部¥8/M token

    缓存读

    • 全部¥0.16/M token
    • 全部¥0.16/M token
    • 全部¥0.24/M token
    2025-07-29 上架
  • GLM-4.5-X Thinking

    调用ID:bigmodel/glm-4.5-x:thinking
    文本对话与客服文档与办公编程内容创作学术与教育
    +5
    文本对话与客服文档与办公编程内容创作学术与教育

    GLM-4.5-X为GLM-4.5的极速版,在性能强劲的同时,生成速度可达100tokens/秒。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤32k¥8/M token
    • ≤32k¥12/M token
    • 32k~不限¥16/M token

    输出

    • ≤2k¥16/M token
    • 2k~不限¥32/M token
    • 全部¥64/M token

    缓存读

    • 全部¥1.6/M token
    • 全部¥2.4/M token
    • 全部¥3.2/M token
    2025-09-29 上架
  • Qwen3-235B-A22B-Thinking-2507

    调用ID:ali/qwen3-235b-a22b-thinking-2507
    文本数学与科学多模态理解内容创作学术与教育文档与办公
    +5
    文本数学与科学多模态理解内容创作学术与教育文档与办公

    基于Qwen3的思考模式开源模型,相较通义千问3-235B-A22B逻辑能力、通用能力、知识增强及创作能力均有大幅提升,适用于高难度强推理场景。

    输入
    ¥2/M
    输出
    ¥20/M
    上下文
    131.1K
    2025-07-28 上架
  • Claude 3.5 Haiku

    调用ID:anthropic/claude-3.5-haiku
    文本多模态理解对话与客服内容创作文档与办公编程
    +5
    文本多模态理解对话与客服内容创作文档与办公编程

    Claude 3.5 Haiku是Anthropic最快且最具成本效益的下一代模型,非常适合速度和经济性重要的应用场景。

    价格
    多项属性定价

    多项属性定价

    缓存写(5m)

    • 公开价格¥7/M token

    缓存写(1h)

    • 公开价格¥11.2/M token
    2025-07-24 上架
  • Kimi-latest

    调用ID:moonshot/kimi-latest
    文本多模态理解文档与办公对话与客服内容创作学术与教育
    +5
    文本多模态理解文档与办公对话与客服内容创作学术与教育

    Kimi-latest是一个最长支持128k上下文的视觉模型,支持图片理解。同时,kimi-latest 模型总是使用Kimi智能助手产品使用最新的Kimi 大模型版本,可能包含尚未稳定的特性。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤8k¥2/M token
    • 8k~32k¥5/M token
    • 32k~不限¥10/M token

    输出

    • ≤8k¥10/M token
    • 8k~32k¥20/M token
    • 32k~不限¥30/M token
    2025-07-15 上架
  • Vidu1.5

    调用ID:vidu/vidu1.5
    视频生成视频与3D
    +1
    视频生成视频与3D

    vidu/vidu1.5是生数科技推出的多模态AI视频生成模型,核心突破多主体一致性难题,上传1-3张参考图即可精准控制人物、物体及场景融合,无需LoRA微调。支持文生、图生、参考生视频,输出最高1080P分辨率,30秒内即可出片。具备上下文理解能力,适配写实、动漫风格,广泛应用于影视预制作、广告创作、动漫开发等场景。

    价格
    多项属性定价

    多项属性定价

    图像生成视频

    • 360p4秒¥1.25/次
    • 720p4秒¥3.13/次
    • 720p8秒¥6.25/次
    • 1080p4秒¥6.25/次

    reference2video

    • 360p4秒¥2.50/次
    • 720p4秒¥6.25/次
    • 720p8秒¥12.50/次
    • 1080p4秒¥12.50/次

    首尾帧生成视频

    • 360p4秒¥1.25/次
    • 720p4秒¥3.13/次
    • 720p8秒¥6.25/次
    • 1080p4秒¥6.25/次

    文本生成视频

    • 360p4秒¥1.25/次
    • 720p4秒¥3.13/次
    • 720p8秒¥6.25/次
    • 1080p4秒¥6.25/次
    2025-09-02 上架
  • Qwen3-Reranker-8B

    调用ID:ali/qwen3-reranker-8b
    重排智能代理与数据
    +1
    重排智能代理与数据

    创建于 2026-06-10 19:20:02 Qwen3-Reranker-8B是阿里巴巴通义实验室于2025年6月开源的80亿参数重排序模型,支持119种语言和32K超长文本处理。在中文检索(CMTEB-R 77.45分)、多语言检索(MTEB-R 69.02分)和代码检索(MTEB-Code 81.22分)任务中均刷新行业纪录,性能超越BGE等主流模型30%以上‌。 其创新单塔交叉编码器架构和指令感知能力,可显著提升检索增强生成(RAG)系统的精度与效率‌。

    输入
    ¥0.5/M
    输出
    ¥0/M
    上下文
    256K
    2026-08-04 上架
  • Qwen3-Embedding-0.6B

    调用ID:ali/qwen3-embedding-0.6b
    向量化智能代理与数据
    +1
    向量化智能代理与数据

    Qwen3-Embedding-0.6B 是 Qwen3 嵌入模型系列的最新专有模型,专为文本嵌入和排序任务设计。该模型基于 Qwen3 系列的密集基础模型,具有 6 亿参数规模,支持长达 32K 的上下文长度,可生成最高 1024 维的嵌入向量。模型继承了基础模型卓越的多语言能力,支持超过 100 种语言,具备长文本理解和推理能力。在 MTEB 多语言排行榜上表现优异(得分 64.33),在文本检索、代码检索、文本分类、文本聚类和双语挖掘等多项任务中表现出色。模型支持用户自定义输出维度(32 到 1024)和指令感知功能,可根据特定任务、语言或场景进行优化,为需要平衡效率和效果的应用场景提供理想选择

    输入
    ¥0.07/M
    输出
    ¥0/M
    上下文
    256K
    2026-08-04 上架
  • Qwen-Plus

    调用ID:ali/qwen-plus-latest
    文本对话与客服内容创作文档与办公编程学术与教育
    +5
    文本对话与客服内容创作文档与办公编程学术与教育

    通义千问系列能力均衡的模型,推理效果、成本和速度介于通义千问-Max和通义千问-Turbo之间,适合中等复杂任务。

    输入
    ¥0.8/M
    输出
    ¥2/M
    上下文
    131.1K
    2025-02-20 上架
  • Gemini 2.5 Flash Nativa Audio

    调用ID:google/gemini-2.5-flash-live
    文本语音处理对话与客服多模态理解翻译
    +4
    文本语音处理对话与客服多模态理解翻译

    Gemini 2.5 Flash 的原生音频模型,支持Live API格式调用。

    输入
    ¥3.5/M
    输出
    ¥14/M
    上下文
    1M
    2025-12-17 上架
  • ViduQ1

    调用ID:vidu/viduq1
    视频生成视频与3D
    +1
    视频生成视频与3D

    主打高可控性与电影级画质。支持文生、图生、参考生三重模式,可输入7张参考图精准控制多主体一致性,生成1080P分辨率视频,动态过渡自然且符合物理规律。其首尾帧功能仅需两张图即可实现电影级运镜,音频生成支持48KHz高保真采样,同步精度达±0.1秒。在VBench测评中,该模型以绝对优势超越Sora、Runway等国际竞品,稳居文生/图生视频双榜首。凭借每秒0.3元的低成本与10秒极速生成能力,ViduQ1广泛应用于电商广告、影视预制作、动漫开发等场景,推动AI视频从创意工具向生产力引擎升级。

    价格
    多项属性定价

    多项属性定价

    图像生成视频

    • 1080p5秒¥2.50/次

    首尾帧生成视频

    • 1080p5秒¥2.50/次

    文本生成视频

    • 1080p5秒¥2.50/次
    2025-09-02 上架
  • ViduQ1-image

    调用ID:vidu/viduq1-image
    图像生成视频与3D图像与设计内容创作
    +3
    图像生成视频与3D图像与设计内容创作

    主打高可控性与电影级画质。支持文生、图生、参考生三重模式,可输入7张参考图精准控制多主体一致性,生成1080P分辨率视频,动态过渡自然且符合物理规律。其首尾帧功能仅需两张图即可实现电影级运镜,音频生成支持48KHz高保真采样,同步精度达±0.1秒。在VBench测评中,该模型以绝对优势超越Sora、Runway等国际竞品,稳居文生/图生视频双榜首。凭借每秒0.3元的低成本与10秒极速生成能力,ViduQ1广泛应用于电商广告、影视预制作、动漫开发等场景,推动AI视频从创意工具向生产力引擎升级。

    价格
    多项属性定价

    多项属性定价

    每张图片

    • 公开价格¥0.625/每张图片
    2025-10-22 上架
  • ViduQ2-turbo

    调用ID:vidu/viduq2-turbo
    视频生成视频与3D
    +1
    视频生成视频与3D

    暂未提供模型说明。

    价格
    多项属性定价

    多项属性定价

    图像生成视频

    • 720p2秒¥0.31/次
    • 720p3秒¥0.63/次
    • 720p4秒¥0.94/次
    • 720p5秒¥1.25/次
    • 720p6秒¥1.56/次
    • 720p7秒¥1.88/次
    • 720p8秒¥2.19/次
    • 1080p2秒¥1.56/次
    • 1080p3秒¥1.88/次
    • 1080p4秒¥2.19/次
    • 1080p5秒¥2.50/次
    • 1080p6秒¥2.81/次
    • 1080p7秒¥3.13/次
    • 1080p8秒¥3.44/次

    首尾帧生成视频

    • 720p2秒¥0.31/次
    • 720p3秒¥0.63/次
    • 720p4秒¥0.94/次
    • 720p5秒¥1.25/次
    • 720p6秒¥1.56/次
    • 720p7秒¥1.88/次
    • 720p8秒¥2.19/次
    • 1080p2秒¥1.56/次
    • 1080p3秒¥1.88/次
    • 1080p4秒¥2.19/次
    • 1080p5秒¥2.50/次
    • 1080p6秒¥2.81/次
    • 1080p7秒¥3.13/次
    • 1080p8秒¥3.44/次
    2025-10-22 上架
  • Agnes 3.0 Flash

    调用ID:agnes/agnes-3.0-flash
    文本智能代理与数据编程
    +2
    文本智能代理与数据编程

    Agnes 3.0 Flash 是 Agnes AI 推出的全新一代升级文本模型,面向 Agent 编程与工具驱动任务,重点提升复杂任务的端到端执行质量。

    输入
    ¥0/M
    输出
    ¥0/M
    上下文
    512K
    2026-09-18 上架
  • Agnes 2.5 Flash

    调用ID:agnes/agnes-2.5-flash
    文本多模态理解智能代理与数据编程对话与客服
    +4
    文本多模态理解智能代理与数据编程对话与客服

    Agnes 2.5 Flash 是基于 Agnes 2.0 Flash 升级的全量可用语言模型。它沿用 OpenAI 兼容的 Chat Completions 接入方式,同时在编码任务、智能体工作流、工具调用、多轮对话、推理和图像理解体验上进行了优化。

    输入
    ¥0/M
    输出
    ¥0/M
    上下文
    512K
    2026-08-28 上架
  • Qwen3-VL-Embedding-8B

    调用ID:ali/qwen3-vl-embedding-8b
    向量化多模态理解智能代理与数据
    +2
    向量化多模态理解智能代理与数据

    Qwen3-VL-Embedding 是 Qwen3 多模态模型体系中的新一代视觉-语言嵌入模型,专为跨模态语义理解、检索与排序任务设计。该模型基于 Qwen3 系列高性能视觉语言基础模型构建,能够将文本、图像及其组合统一映射到高质量向量空间,实现精准的跨模态语义对齐。模型支持长上下文输入与高维嵌入表示,兼顾细粒度语义表达与大规模检索效率,广泛适用于多模态搜索、RAG 知识增强、内容推荐、相似度计算与智能审核等场景。继承 Qwen3 系列卓越的多语言与视觉理解能力,Qwen3-VL-Embedding 在复杂语义推理与跨语言跨模态任务中表现出色,并支持灵活的输出维度与任务指令感知能力,帮助开发者针对不同业务场景进行高效优化。

    价格
    多项属性定价

    多项属性定价

    图片·输入

    • 公开价格¥1.8/M token
    2026-08-04 上架

24 / 335 个模型已加载

←上一页
  1. 1
  2. …
  3. 10
  4. 11
  5. 12
  6. …
  7. 14
第 11 页,共 14 页下一页→
通用筛选0
适用场景

没有匹配的选项

厂商

没有匹配的选项

输入模态
最低上下文
通用筛选