正在加载…
跳到主要内容
企业网关全新版本重磅上线!现可免费开通体验~查看详情
Modelmesh
核心产品
LoomLoomSkillApp 市场企业级 AI 网关AI群聊
大模型超市
模型中心开发者模型
云端工厂
AI 模型部署服务云端智能集群
Agent 接入精益社区关于我们
文档控制台切换英文
文档控制台切换英文
登录/注册正在验证
开通企业网关Pro独享高性能资源与专属服务
主账号:—
账户充值API密钥收益管理
个人设置

兑换代金券

ModelmeshModelmesh 主导航
文档控制台切换英文
登录/注册
正在验证

模型中心

汇聚 335 个模型,公开价格、能力与上下文信息;路由至不同供应商时,实际价格可能有所差异。更多价格信息请查看模型详情页

335/ 335个模型
排序
价格对比
全部文本图像生成视频生成音频生成音频转录3D生成向量化重排决策
  • Qwen3-Max

    调用ID:ali/qwen3-max
    文本编程数学与科学智能代理与数据多模态理解翻译
    +5
    文本编程数学与科学智能代理与数据多模态理解翻译

    Qwen3-Max 是在 Qwen3 系列的基础上构建的更新版本,与 2025 年 1 月版本相比,在推理、指令遵循、多语言支持和长尾知识覆盖方面进行了重大改进。它在数学、编码、逻辑和科学任务中提供更高的准确性,更可靠地遵循复杂的中文和英文指令,减少幻觉,并为开放式问答、写作和对话提供更高质量的回答。该模型支持 100 多种语言,具有更强的翻译和常识推理能力,并针对检索增强生成 (RAG) 和工具调用进行了优化,尽管它不包括专用的“思考”模式。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤32k¥2.5/M token
    • 32k~128k¥4/M token
    • 128k~256k¥7/M token

    输出

    • ≤32k¥10/M token
    • 32k~128k¥16/M token
    • 128k~256k¥28/M token

    缓存读

    • ≤32k¥0.5/M token
    • 32k~128k¥0.8/M token
    • 128k~256k¥1.4/M token

    i2i_search

    • 公开价格¥0.004/次调用

    t2i_search

    • 公开价格¥0.004/次调用

    web_search

    • 公开价格¥0.004/次调用

    显式缓存命中

    • ≤32k¥0.25/M token
    • 32k~256k¥4/M token
    • 256k~1000k¥0.7/M token

    缓存写(5m)

    • ≤32k¥3.125/M token
    • 32k~256k¥5/M token
    • 256k~1000k¥8.75/M token
    2025-09-24 上架
  • 通义万相2.5-文生图-Preview

    调用ID:ali/wan2.5-t2i-preview
    图像生成图像与设计
    +1
    图像生成图像与设计

    文字生成图片,写实质感细腻画面,文字内容生成,艺术风格表现

    价格
    多项属性定价

    多项属性定价

    每张图片

    • 公开价格¥0.2/每张图片
    2025-09-28 上架
  • 通义万相2.5-图像编辑-Preview

    调用ID:ali/wan2.5-i2i-preview
    图像生成图像与设计
    +1
    图像生成图像与设计

    指令编辑图片内容,轻松实现局部修改、风格变化、一致性保持等

    价格
    多项属性定价

    多项属性定价

    每张图片

    • 公开价格¥0.2/每张图片
    2025-09-28 上架
  • KlingV2.1

    调用ID:kling/kling-v2-1
    视频生成视频与3D
    +1
    视频生成视频与3D

    Kling v2.1 是快手研发的文 / 图生视频模型,搭载 3D 时空注意力机制,能精准还原动态细节,支持 720P/1080P、24fps 输出。内置 10 + 运镜与多艺术风格,可自动补连贯动作、生成同步音效

    价格
    多项属性定价

    多项属性定价

    图像生成视频

    • 720p5秒¥2.00/次
    • 720p10秒¥4.00/次
    • 1080p5秒¥3.50/次
    • 1080p10秒¥7.00/次

    文本生成视频

    • 720p5秒¥2.00/次
    • 720p10秒¥4.00/次
    • 1080p5秒¥3.50/次
    • 1080p10秒¥7.00/次
    2025-09-01 上架
  • Doubao-Seed-1.8

    调用ID:bytedance/doubao-seed-1.8
    文本多模态理解智能代理与数据对话与客服
    +3
    文本多模态理解智能代理与数据对话与客服

    全新面向多模态 Agent 场景定向优化模型。更强Agent能力、升级多模态理解、更灵活的上下文管理。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤32k¥0.8/M token
    • 32k~128k¥1.2/M token
    • 128k~不限¥2.4/M token

    输出

    • ≤32k¥8/M token
    • 32k~128k¥16/M token
    • 128k~不限¥24/M token

    缓存读

    • ≤32k¥0.16/M token
    • 32k~128k¥0.16/M token
    • 128k~不限¥0.16/M token
    2025-12-18 上架
  • 通义万相2.5-文生视频-Preview

    调用ID:ali/wan2.5-t2v-preview
    视频生成视频与3D
    +1
    视频生成视频与3D

    文字生成视频内容,丝滑动态能力,电影美学控制,精准指令遵循

    价格
    多项属性定价

    多项属性定价

    每秒视频

    • 1080P¥1/秒
    • 480P¥0.3/秒
    • 720P¥0.6/秒
    2025-09-28 上架
  • Doubao-Seedance-1.0-lite-i2v

    调用ID:bytedance/doubao-seedance-1.0-lite-i2v
    视频生成视频与3D
    +1
    视频生成视频与3D

    Doubao-Seedance-1.0-lite-i2v,根据首帧图片、尾帧图片(可选)、参考图片(可选)和文本描述(可选)生成视频。是兼顾生成效果与速度的性价比之选。该模型语义理解与指令遵循能力强。运镜专业。支持多种视频风格,可以丝滑兼容各种风格的首图。分辨率支持480P、720P、1080P,时长支持3-12s,帧率24fps

    价格
    多项属性定价

    多项属性定价

    输出

    • 公开价格¥10/M token
    2025-09-02 上架
  • 通义万相2.5-图生视频-Preview

    调用ID:ali/wan2.5-i2v-preview
    视频生成视频与3D
    +1
    视频生成视频与3D

    图片生成视频内容,稳定保持图像主体、风格和文字等细节信息

    价格
    多项属性定价

    多项属性定价

    每秒视频

    • 1080P¥1/秒
    • 480P¥0.3/秒
    • 720P¥0.6/秒
    2025-09-28 上架
  • Veo3

    调用ID:google/veo3
    视频生成视频与3D多模态理解内容创作
    +3
    视频生成视频与3D多模态理解内容创作

    谷歌 Veo 3 视频模型的更快、更便宜的版本,带有音频

    价格
    多项属性定价

    多项属性定价

    基础单价(无音频)

    • 公开价格¥1.4/秒

    含音频单价

    • 公开价格¥2.8/秒
    2025-09-01 上架
  • GPT-5

    调用ID:openai/gpt-5
    文本编程数学与科学多模态理解智能代理与数据
    +4
    文本编程数学与科学多模态理解智能代理与数据

    GPT-5是OpenAI推出的最新一代先进模型,在推理能力、代码生成质量和用户体验方面实现显著提升。该模型针对复杂任务进行了专项优化,尤其擅长需要逐步推理、精准遵循指令以及对准确性要求严格的高风险场景。

    输入
    ¥8.75/M
    输出
    ¥70/M
    上下文
    400K
    2025-08-15 上架
  • Grok 4 Fast

    调用ID:x-ai/grok-4-fast
    文本多模态理解文档与办公数学与科学
    +3
    文本多模态理解文档与办公数学与科学

    Grok 4 Fast 是 xAI 最新的多模态模型,具有 SOTA 成本效益和 2M 令牌上下文窗口。它有两种类型:非推理和推理。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤128k¥1.4/M token
    • 128k~不限¥2.8/M token

    输出

    • ≤128k¥3.5/M token
    • 128k~不限¥7/M token

    缓存读

    • ≤128k¥0.35/M token
    • 128k~不限¥0.35/M token
    2025-09-29 上架
  • Kimi K2.7 Code HighSpeed

    调用ID:moonshot/kimi-k2.7-code-highspeed
    文本编程
    +1
    文本编程

    Kimi K2.7 Code HighSpeed 是 Kimi K2.7 Code 的高速版模型,与 Kimi K2.7 Code 是相同模型,但输出速度约 180 Tokens/s,短上下文场景可达 260 Token/s,带来更极致的编程体验。

    输入
    ¥13/M
    输出
    ¥54/M
    上下文
    256K
    2026-07-29 上架
  • KlingV2.5 Turbo

    调用ID:kling/kling-v2-5-turbo
    视频生成视频与3D
    +1
    视频生成视频与3D

    暂未提供模型说明。

    价格
    多项属性定价

    多项属性定价

    图像生成视频

    • 720p5秒¥1.50/次
    • 720p10秒¥3.00/次
    • 1080p5秒¥2.50/次
    • 1080p10秒¥5.00/次

    文本生成视频

    • 720p5秒¥1.50/次
    • 720p10秒¥3.00/次
    • 1080p5秒¥2.50/次
    • 1080p10秒¥5.00/次
    2025-12-05 上架
  • 即梦4.0

    调用ID:bytedance/jimeng_v40
    图像生成图像与设计多模态理解
    +2
    图像生成图像与设计多模态理解

    即梦4.0是即梦同源的图像生成能力,该能力在统一框架内集成了文生图、图像编辑及多图组合生成的功能:支持单次输入最多 10 张图像及进行复合编辑,并能通过对提示词的深度推理,智能适配最优的图像比例尺寸与生成数量,可一次性输出最多 15 张内容关联的图像。此外,模型显著提升了中文生成的准确率与内容多样性,且支持 4K 超高清输出,为专业图像创作提供了从生成到编辑的一站式解决方案。

    价格
    多项属性定价

    多项属性定价

    每张图片

    • 公开价格¥0.22/每张图片
    2025-09-23 上架
  • 通义万相2.2-图生视频-Fast-Lora

    调用ID:ali/wan-2.2-i2v-fast-lora
    视频生成视频与3D
    +1
    视频生成视频与3D

    PrunaAI 开发的 Wan 2.2 A14B 图像转视频优化版本,速度极快且价格低廉。

    价格
    多项属性定价

    多项属性定价

    每个视频

    • 480P¥0.35/秒
    • 720P¥0.77/秒
    2025-11-13 上架
  • GPT-5-Nano

    调用ID:openai/gpt-5-nano
    文本编程对话与客服多模态理解
    +3
    文本编程对话与客服多模态理解

    GPT-5-Nano是GPT-5系列中最快速的版本,专为开发者工具、即时交互和超低延迟场景优化。尽管在复杂推理能力上略逊于更大的模型,但它保留了核心的指令跟随与安全特性。

    输入
    ¥0.35/M
    输出
    ¥2.8/M
    上下文
    400K
    2025-08-15 上架
  • Qwen3-Omni-Flash

    调用ID:ali/qwen3-omni-flash
    文本对话与客服内容创作翻译编程文档与办公
    +5
    文本对话与客服内容创作翻译编程文档与办公

    Qwen-Omni 模型能够接收文本、图片、音频、视频等多种模态的组合输入,并生成文本或语音形式的回复, 提供多种拟人音色,支持多语言和方言的语音输出,可应用于文本创作、视觉识别、语音助手等场景。

    输入
    ¥1.8/M
    输出
    ¥6.9/M
    上下文
    65.5K
    2025-09-23 上架
  • Qwen-VL-OCR

    调用ID:ali/qwen-vl-ocr
    文本多模态理解文档与办公图像与设计
    +3
    文本多模态理解文档与办公图像与设计

    通义千问VL-OCR(qwen-vl-ocr),即基于Qwen-VL训练的OCR识别大模型。通过统一模型的方式聚合多种图文识别、解析、处理类任务,提供强大的图文识别能力。

    输入
    ¥0.3/M
    输出
    ¥0.5/M
    上下文
    32K
    2025-11-28 上架
  • DeepSeek-OCR

    调用ID:deepseek/deepseek-ocr
    文本图像与设计多模态理解文档与办公
    +3
    文本图像与设计多模态理解文档与办公

    DeepSeek-OCR 是 DeepSeek AI 发布的视觉语言模型,旨在探索视觉-文本压缩边界,专注于文档识别及图像转文本场景的解决方案 。该模型可将长文本渲染为高压缩比图像,在 10 倍无损压缩下能实现 97% 的 OCR 准确率,即使压缩到 20 倍也能保持约 60% 的准确率。

    输入
    ¥0.0001/M
    输出
    ¥0/M
    上下文
    0
    2025-11-28 上架
  • MiniMax M2.7-highspeed

    调用ID:minimax/minimax-m2.7-highspeed
    文本编程文档与办公智能代理与数据多模态理解对话与客服
    +5
    文本编程文档与办公智能代理与数据多模态理解对话与客服

    M2.7 在真实的软件工程中有优异的表现,包括端到端的完整项目交付,分析日志排查 Bug、代码安全,机器学习等。 在专业办公领域,我们提升了模型在各领域的专业知识和任务交付能力,在 GDPval-AA 的ELO得分是1495,为开源最高。M2.7 对 Office 三件套 Excel/PPT/Word 的复杂编辑能力显著提升,能更好地完成多轮修改和高保真的编辑。 M2.7具备与复杂环境交互的能力,M2.7 在 40 个复杂 skills (> 2000 Token) 的 case 上,仍能保持 97% 的 skills 遵循率。在OpenClaw的使用中,M2.7相比于M2.5也有了显著的提升,在MMClaw的评测中接近最新的Sonnet 4.6。 M2.7具备优秀的身份保持能力和情商,除了生产力使用外,给互动娱乐场景的创新也准备了空间。

    价格
    多项属性定价

    多项属性定价

    缓存写(5m)

    • 公开价格¥2.625/M token
    2026-03-18 上架
  • Grok 4

    调用ID:x-ai/grok-4
    文本对话与客服内容创作文档与办公编程学术与教育
    +5
    文本对话与客服内容创作文档与办公编程学术与教育

    Grok 4是xAI的多模态大型语言模型,目前支持文本模态,视觉、图像生成等功能即将推出。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤128k¥21/M token
    • 128k~不限¥42/M token

    输出

    • ≤128k¥105/M token
    • 128k~不限¥210/M token

    缓存读

    • ≤128k¥5.25/M token
    • 128k~不限¥5.25/M token
    2025-07-10 上架
  • Vidu2.0

    调用ID:vidu/vidu2.0
    视频生成视频与3D
    +1
    视频生成视频与3D

    vidu/vidu2.0 是清华与生数科技联合研发的文生视频模型,核心搭载全球首创 U-ViT 架构,10 秒内即可生成 4 秒视频,单秒成本仅 4 分钱。支持 16 秒 1080P 输出,能精准控制多主体动态一致性,内置物理引擎还原毫米级运动细节,还深度适配国风等文化元素

    价格
    多项属性定价

    多项属性定价

    图像生成视频

    • 720p4秒¥1.25/次
    • 720p8秒¥3.13/次
    • 1080p4秒¥3.13/次

    reference2video

    • 720p4秒¥2.50/次

    首尾帧生成视频

    • 720p4秒¥1.25/次
    • 720p8秒¥3.13/次
    • 1080p4秒¥3.13/次
    2025-09-02 上架
  • Qwen3-VL-Plus

    调用ID:ali/qwen3-vl-plus
    文本多模态理解图像与设计视频与3D智能代理与数据编程
    +5
    文本多模态理解图像与设计视频与3D智能代理与数据编程

    Qwen3系列视觉理解模型,实现思考模式和非思考模式的有效融合,视觉智能体能力在OS World等公开测试集上达到世界顶尖水平。此版本在视觉coding、空间感知、多模态思考等方向全面升级;视觉感知与识别能力大幅提升,支持超长视频理解。

    价格
    多项属性定价

    多项属性定价

    输入

    • ≤32k¥1/M token
    • 32k~128k¥1.5/M token
    • 128k~256k¥3/M token

    输出

    • ≤32k¥10/M token
    • 32k~128k¥15/M token
    • 128k~256k¥30/M token

    缓存读

    • ≤32k¥0.2/M token
    • 32k~128k¥0.3/M token
    • 128k~256k¥0.6/M token

    显式缓存命中

    • ≤32k¥0.1/M token
    • 32k~256k¥0.15/M token
    • 256k~1000k¥0.3/M token

    缓存写(5m)

    • ≤32k¥1.25/M token
    • 32k~256k¥1.875/M token
    • 256k~1000k¥3.75/M token
    2025-09-24 上架
  • GPT 5.1 Codex Mini

    调用ID:openai/gpt-5.1-codex-mini
    文本编程多模态理解智能代理与数据数学与科学
    +4
    文本编程多模态理解智能代理与数据数学与科学

    (当前仅支持/v1/responses接口)GPT-5.1-Codex 的小参数快速版本。

    输入
    ¥1.75/M
    输出
    ¥14/M
    上下文
    400K
    2025-11-19 上架

24 / 335 个模型已加载

←上一页
  1. 1
  2. …
  3. 6
  4. 7
  5. 8
  6. …
  7. 14
第 7 页,共 14 页下一页→
通用筛选0
适用场景

没有匹配的选项

厂商

没有匹配的选项

输入模态
最低上下文
通用筛选