GPT 5.1 Codex Mini调用ID:openai/gpt-5.1-codex-mini文本编程多模态理解智能代理与数据数学与科学+4文本编程多模态理解智能代理与数据数学与科学(当前仅支持/v1/responses接口)GPT-5.1-Codex 的小参数快速版本。输入¥1.75/M输出¥14/M上下文400K
Grok 4.5调用ID:x-ai/grok-4.5文本编程文档与办公数学与科学+3文本编程文档与办公数学与科学Grok 4.5是XAI最智能的模型,具备在编程、知识工作和STEM领域的前沿性能。输入¥14/M输出¥42/M上下文2M
Grok 4.6调用ID:x-ai/grok-4.6文本文档与办公编程数学与科学+3文本文档与办公编程数学与科学Grok 4.6 是 SpaceXAI 目前最先进的智能模型,在编程、知识处理以及 STEM 领域都表现出色。价格多项属性定价多项属性定价输入≤200k¥14/M token200k~不限¥28/M token输出≤200k¥42/M token200k~不限¥84/M token显式缓存命中≤200k¥3.5/M token200k~不限¥7/M token
Qwen3-VL-32B-Instruct调用ID:ali/qwen3-vl-32b-instruct文本多模态理解文档与办公数学与科学+3文本多模态理解文档与办公数学与科学Qwen3-VL系列最大尺寸Dense模型的非推理版本,综合表现仅次于Qwen3-VL-235B-Instruct,文档识别和理解能力出色,空间感知与万物识别能力强,视觉2D检测/空间推理能力达到SOTA,适合通用场景下的复杂感知任务。输入¥2/M输出¥8/M上下文128K
Step 5 Preview调用ID:stepfun/step-5-preview文本多模态理解智能代理与数据文档与办公编程+4文本多模态理解智能代理与数据文档与办公编程Step 5 Preview 是 StepFun 面向真实任务的新一代旗舰基模,重点覆盖编程与专业知识工作。模型原生支持文本、图片和视频输入,提供 1M tokens 上下文窗口,适合需要处理大量信息、调用工具,并持续推进到交付结果的任务。输入¥7/M输出¥20/M上下文256K
KAT-Coder-Exp-72B-1010调用ID:streamlake/kat-coder-exp-72b-1010文本编程智能代理与数据+2文本编程智能代理与数据KAT-Coder-Exp-72B 是 KAT-Coder 系列模型中的 RL 创新实验版本,在软件开发能力评测基准 SWE-Bench verified 上取得了 74.6% 的卓越性能,创下开源模型新纪录。专注于 Agentic Coding,目前仅支持 SWE-Agent 脚手架,也可进行简单对话。输入¥0.0001/M输出¥0/M上下文128K
Qwen3-Omni-Flash调用ID:ali/qwen3-omni-flash文本对话与客服内容创作翻译编程文档与办公+5文本对话与客服内容创作翻译编程文档与办公Qwen-Omni 模型能够接收文本、图片、音频、视频等多种模态的组合输入,并生成文本或语音形式的回复, 提供多种拟人音色,支持多语言和方言的语音输出,可应用于文本创作、视觉识别、语音助手等场景。输入¥1.8/M输出¥6.9/M上下文65.5K
Qwen3-Max调用ID:ali/qwen3-max文本编程数学与科学智能代理与数据多模态理解翻译+5文本编程数学与科学智能代理与数据多模态理解翻译Qwen3-Max 是在 Qwen3 系列的基础上构建的更新版本,与 2025 年 1 月版本相比,在推理、指令遵循、多语言支持和长尾知识覆盖方面进行了重大改进。它在数学、编码、逻辑和科学任务中提供更高的准确性,更可靠地遵循复杂的中文和英文指令,减少幻觉,并为开放式问答、写作和对话提供更高质量的回答。该模型支持 100 多种语言,具有更强的翻译和常识推理能力,并针对检索增强生成 (RAG) 和工具调用进行了优化,尽管它不包括专用的“思考”模式。价格多项属性定价多项属性定价输入≤32k¥2.5/M token32k~128k¥4/M token128k~256k¥7/M token输出≤32k¥10/M token32k~128k¥16/M token128k~256k¥28/M token缓存读≤32k¥0.5/M token32k~128k¥0.8/M token128k~256k¥1.4/M tokeni2i_search公开价格¥0.004/次调用t2i_search公开价格¥0.004/次调用web_search公开价格¥0.004/次调用显式缓存命中≤32k¥0.25/M token32k~256k¥4/M token256k~1000k¥0.7/M token缓存写(5m)≤32k¥3.125/M token32k~256k¥5/M token256k~1000k¥8.75/M token
MiniMax M2调用ID:minimax/minimax-m2文本编程智能代理与数据+2文本编程智能代理与数据MiniMax M2,专为 Agent 和代码而生,仅 Claude Sonnet 8% 价格,2倍速度。价格多项属性定价多项属性定价缓存写(5m)公开价格¥2.625/M token
Gemini 2.5 Flash调用ID:google/gemini-2.5-flash文本多模态理解对话与客服编程内容创作数学与科学+5文本多模态理解对话与客服编程内容创作数学与科学Gemini 2.5 Flash是Google在性价比方面表现最优的模型,兼具全面能力与高效性能。作为首个具备“思维能力”的 Flash 系列模型,Gemini 2.5 Flash支持可视化的思维过程,让用户直观了解模型在生成回答时的推理路径。价格多项属性定价多项属性定价缓存写(5m)公开价格¥0.581/M token
Gemini 2.5 Pro调用ID:google/gemini-2.5-pro文本编程多模态理解编程数学与科学学术与教育文档与办公+6文本编程多模态理解编程数学与科学学术与教育文档与办公Gemini 2.5 Pro是一款强大的推理模型,专为解决复杂问题而设计。它具备卓越的理解与分析能力,能够处理来自多种信息源的海量数据,包括文本、音频、图像、视频,甚至是完整的代码库。价格多项属性定价多项属性定价输入≤200k¥8.75/M token200k~不限¥17.5/M token输出≤200k¥70/M token200k~不限¥105/M token缓存读≤200k¥0.875/M token200k~不限¥1.75/M token
GPT-5-Codex调用ID:openai/gpt-5-codex文本编程+1文本编程GPT-5-Codex 是 GPT-5 的专用版本,针对软件工程和编码工作流程进行了优化。它专为交互式开发会话和复杂工程任务的长时间独立执行而设计。该模型支持从头开始构建项目、功能开发、调试、大规模重构和代码审查。与 GPT-5 相比,Codex 更具可作性,严格遵守开发人员的指令,并生成更干净、更高质量的代码输出。输入¥8.75/M输出¥70/M上下文400K
GLM-4.6 Thinking调用ID:bigmodel/glm-4.6:thinking文本编程数学与科学学术与教育文档与办公对话与客服+5文本编程数学与科学学术与教育文档与办公对话与客服GLM-4.6 是智谱最新的旗舰模型,其总参数量 355B,激活参数 32B。GLM-4.6 所有核心能力上均完成了对 GLM-4.5 的超越价格多项属性定价多项属性定价输入≤32k¥2/M token≤32k¥3/M token32k~不限¥4/M token输出≤2k¥8/M token2k~不限¥14/M token全部¥16/M token缓存读全部¥0.4/M token全部¥0.6/M token全部¥0.8/M token
GLM-4.6调用ID:bigmodel/glm-4.6文本对话与客服文档与办公编程内容创作学术与教育+5文本对话与客服文档与办公编程内容创作学术与教育GLM-4.6 是智谱最新的旗舰模型,其总参数量 355B,激活参数 32B。GLM-4.6 所有核心能力上均完成了对 GLM-4.5 的超越输入¥2/M输出¥8/M上下文200K
Step 3.7 Flash调用ID:stepfun/step-3.7-flash文本多模态理解+1文本多模态理解Step 3.7 Flash 是阶跃星辰推出的旗舰多模态推理模型,基于 198B 总参数 / 11B 激活参数的稀疏 MoE 架构,原生支持图片和视频理解,具备 256K tokens 长上下文和高速低延迟的推理能力。输入¥1.35/M输出¥8.1/M上下文256K
Grok 4.7调用ID:x-ai/grok-4.7文本智能代理与数据文档与办公编程+3文本智能代理与数据文档与办公编程Grok 4.7是SpaceXAI面向代码编写、智能代理任务以及知识类工作推出的旗舰模型,为Grok 4.6的迭代版本。该模型在长时间软件工程任务、自我工作校验以及长上下文处理方面表现突出,相较于前代产品,在文档撰写、演示文稿制作等专业知识工作上的能力有所提升。价格多项属性定价多项属性定价输入≤200k¥11.2/M token200k~不限¥22.4/M token输出≤200k¥33.6/M token200k~不限¥67.2/M token显式缓存命中≤200k¥2.8/M token200k~不限¥5.6/M token
Qwen3-VL-Plus调用ID:ali/qwen3-vl-plus文本多模态理解图像与设计视频与3D智能代理与数据编程+5文本多模态理解图像与设计视频与3D智能代理与数据编程Qwen3系列视觉理解模型,实现思考模式和非思考模式的有效融合,视觉智能体能力在OS World等公开测试集上达到世界顶尖水平。此版本在视觉coding、空间感知、多模态思考等方向全面升级;视觉感知与识别能力大幅提升,支持超长视频理解。价格多项属性定价多项属性定价输入≤32k¥1/M token32k~128k¥1.5/M token128k~256k¥3/M token输出≤32k¥10/M token32k~128k¥15/M token128k~256k¥30/M token缓存读≤32k¥0.2/M token32k~128k¥0.3/M token128k~256k¥0.6/M token显式缓存命中≤32k¥0.1/M token32k~256k¥0.15/M token256k~1000k¥0.3/M token缓存写(5m)≤32k¥1.25/M token32k~256k¥1.875/M token256k~1000k¥3.75/M token
Qwen3-Coder-480B-A35B-Instruct调用ID:ali/qwen3-coder-480b-a35b-instruct文本编程智能代理与数据多模态理解+3文本编程智能代理与数据多模态理解基于Qwen3的代码生成模型,具有强大的Coding Agent能力,代码能力达到开源模型 SOTA。价格多项属性定价多项属性定价输入≤32k¥6/M token32k~不限¥9/M token输出≤32k¥24/M token32k~不限¥36/M token
Claude Sonnet 4调用ID:anthropic/claude-sonnet-4文本编程编程数学与科学多模态理解+4文本编程编程数学与科学多模态理解Claude Sonnet 4是对Sonnet 3.7的全面升级,在编程与推理任务中展现出更高的精度与可控性。该模型兼顾能力与计算效率,适用于从日常编码到复杂软件开发等多种场景。价格多项属性定价多项属性定价缓存写(5m)公开价格¥26.25/M token缓存写(1h)公开价格¥42/M token
GPT-5-Mini调用ID:openai/gpt-5-mini文本多模态理解对话与客服文档与办公内容创作学术与教育+5文本多模态理解对话与客服文档与办公内容创作学术与教育GPT-5-Mini是GPT-5的轻量级版本,专为高效处理日常推理任务而设计。它继承了 GPT-5的指令跟随能力和安全优化,同时具备更低的延迟和成本优势。输入¥1.75/M输出¥14/M上下文400K
Claude Opus 4调用ID:anthropic/claude-opus-4文本编程智能代理与数据编程多模态理解数学与科学+5文本编程智能代理与数据编程多模态理解数学与科学Claude Opus 4是Anthropic专为构建复杂的人工智能代理而设计的模型,能够在最少的监督下自主推理、规划和执行复杂的任务。该模型在需要扩展上下文、深度推理和自适应执行的软件开发场景中表现卓越。价格多项属性定价多项属性定价缓存写(5m)公开价格¥131.25/M token缓存写(1h)公开价格¥210/M token
Doubao-Seed-1.6-thinking调用ID:bytedance/doubao-seed-1.6:thinking文本数学与科学编程多模态理解+3文本数学与科学编程多模态理解Doubao-Seed-1.6-thinking,是豆包大模型1.6系列在深度思考方面的强化版本。在代码编写、数学运算、逻辑推理等基础能力上有了进一步的显著提升。价格多项属性定价多项属性定价输入≤32k¥0.8/M token32k~128k¥1.2/M token128k~不限¥2.4/M token输出≤32k¥8/M token32k~128k¥16/M token128k~不限¥24/M token缓存读≤32k¥0.17/M token32k~128k¥0.17/M token128k~不限¥0.17/M token
Claude Sonnet 4 ( Thinking )调用ID:anthropic/claude-sonnet-4:thinking文本编程数学与科学+2文本编程数学与科学Claude Sonnet 4 ( Thinking ),在编程与推理任务中展现出更高的精度与可控性。该模型兼顾能力与计算效率,适用于从日常编码到复杂软件开发等多种场景。价格多项属性定价多项属性定价缓存写(5m)公开价格¥26.25/M token缓存写(1h)公开价格¥42/M token
Doubao-Seed-1.6调用ID:bytedance/doubao-seed-1.6文本多模态理解对话与客服文档与办公编程数学与科学+5文本多模态理解对话与客服文档与办公编程数学与科学Doubao-Seed-1.6,这是一个 “All-in-One” 的综合模型,也是国内首个支持256K上下文的思考模型,它能够同时支持thinking、non-thinking、auto三种思考模式。这是一个 “All-in-One” 的综合模型,也是国内首个支持256K上下文的思考模型,它能够同时支持thinking、non-thinking、auto三种思考模式。价格多项属性定价多项属性定价输入≤32k¥0.8/M token32k~128k¥1.2/M token128k~不限¥2.4/M token输出≤32k¥8/M token32k~128k¥16/M token128k~不限¥24/M token缓存读≤32k¥0.16/M token32k~128k¥0.16/M token128k~不限¥0.16/M token