Gemini 2.5 ProAPI ID:google/gemini-2.5-pro文本编程多模态理解编程数学与科学学术与教育文档与办公+6文本编程多模态理解编程数学与科学学术与教育文档与办公Gemini 2.5 Pro是一款强大的推理模型,专为解决复杂问题而设计。它具备卓越的理解与分析能力,能够处理来自多种信息源的海量数据,包括文本、音频、图像、视频,甚至是完整的代码库。PriceAttribute-based pricingAttribute-based pricing输入≤200k¥8.75/M token200k~不限¥17.5/M token输出≤200k¥70/M token200k~不限¥105/M token缓存读≤200k¥0.875/M token200k~不限¥1.75/M token
GPT 5.1 Codex MiniAPI ID:openai/gpt-5.1-codex-mini文本编程多模态理解智能代理与数据数学与科学+4文本编程多模态理解智能代理与数据数学与科学(当前仅支持/v1/responses接口)GPT-5.1-Codex 的小参数快速版本。Input¥1.75/MOutput¥14/MContext400K
Gemini 2.5 FlashAPI ID:google/gemini-2.5-flash文本多模态理解对话与客服编程内容创作数学与科学+5文本多模态理解对话与客服编程内容创作数学与科学Gemini 2.5 Flash是Google在性价比方面表现最优的模型,兼具全面能力与高效性能。作为首个具备“思维能力”的 Flash 系列模型,Gemini 2.5 Flash支持可视化的思维过程,让用户直观了解模型在生成回答时的推理路径。PriceAttribute-based pricingAttribute-based pricing缓存写(5m)Public price¥0.581/M token
GPT-5API ID:openai/gpt-5文本编程数学与科学多模态理解智能代理与数据+4文本编程数学与科学多模态理解智能代理与数据GPT-5是OpenAI推出的最新一代先进模型,在推理能力、代码生成质量和用户体验方面实现显著提升。该模型针对复杂任务进行了专项优化,尤其擅长需要逐步推理、精准遵循指令以及对准确性要求严格的高风险场景。Input¥8.75/MOutput¥70/MContext400K
Kimi K2.7 Code HighSpeedAPI ID:moonshot/kimi-k2.7-code-highspeed文本编程+1文本编程Kimi K2.7 Code HighSpeed 是 Kimi K2.7 Code 的高速版模型,与 Kimi K2.7 Code 是相同模型,但输出速度约 180 Tokens/s,短上下文场景可达 260 Token/s,带来更极致的编程体验。Input¥13/MOutput¥54/MContext256K
Grok 4.5API ID:x-ai/grok-4.5文本编程文档与办公数学与科学+3文本编程文档与办公数学与科学Grok 4.5是XAI最智能的模型,具备在编程、知识工作和STEM领域的前沿性能。Input¥14/MOutput¥42/MContext2M
GLM-5API ID:bigmodel/glm-5文本智能代理与数据编程+2文本智能代理与数据编程GLM-5 是智谱新一代的旗舰基座模型,面向 Agentic Engineering 打造,能够在复杂系统工程与长程 Agent 任务中提供可靠生产力。在 Coding 与 Agent 能力上,GLM-5 取得开源 SOTA 表现,在真实编程场景的使用体感逼近 Claude Opus 4.5,擅长复杂系统工程与长程 Agent 任务,是通用 Agent 助手的理想基座。PriceAttribute-based pricingAttribute-based pricing输入≤32k¥4/M token32k~不限¥6/M token输出≤32k¥18/M token32k~不限¥22/M token缓存读≤32k¥1/M token32k~不限¥1.5/M token
Grok 4API ID:x-ai/grok-4文本对话与客服内容创作文档与办公编程学术与教育+5文本对话与客服内容创作文档与办公编程学术与教育Grok 4是xAI的多模态大型语言模型,目前支持文本模态,视觉、图像生成等功能即将推出。PriceAttribute-based pricingAttribute-based pricing输入≤128k¥21/M token128k~不限¥42/M token输出≤128k¥105/M token128k~不限¥210/M token缓存读≤128k¥5.25/M token128k~不限¥5.25/M token
GPT-5-NanoAPI ID:openai/gpt-5-nano文本编程对话与客服多模态理解+3文本编程对话与客服多模态理解GPT-5-Nano是GPT-5系列中最快速的版本,专为开发者工具、即时交互和超低延迟场景优化。尽管在复杂推理能力上略逊于更大的模型,但它保留了核心的指令跟随与安全特性。Input¥0.35/MOutput¥2.8/MContext400K
MiniMax M2API ID:minimax/minimax-m2文本编程智能代理与数据+2文本编程智能代理与数据MiniMax M2,专为 Agent 和代码而生,仅 Claude Sonnet 8% 价格,2倍速度。PriceAttribute-based pricingAttribute-based pricing缓存写(5m)Public price¥2.625/M token
Qwen3-VL-32B-InstructAPI ID:ali/qwen3-vl-32b-instruct文本多模态理解文档与办公数学与科学+3文本多模态理解文档与办公数学与科学Qwen3-VL系列最大尺寸Dense模型的非推理版本,综合表现仅次于Qwen3-VL-235B-Instruct,文档识别和理解能力出色,空间感知与万物识别能力强,视觉2D检测/空间推理能力达到SOTA,适合通用场景下的复杂感知任务。Input¥2/MOutput¥8/MContext128K
Step 3.7 FlashAPI ID:stepfun/step-3.7-flash文本多模态理解+1文本多模态理解Step 3.7 Flash 是阶跃星辰推出的旗舰多模态推理模型,基于 198B 总参数 / 11B 激活参数的稀疏 MoE 架构,原生支持图片和视频理解,具备 256K tokens 长上下文和高速低延迟的推理能力。Input¥1.35/MOutput¥8.1/MContext256K
GPT-5-CodexAPI ID:openai/gpt-5-codex文本编程+1文本编程GPT-5-Codex 是 GPT-5 的专用版本,针对软件工程和编码工作流程进行了优化。它专为交互式开发会话和复杂工程任务的长时间独立执行而设计。该模型支持从头开始构建项目、功能开发、调试、大规模重构和代码审查。与 GPT-5 相比,Codex 更具可作性,严格遵守开发人员的指令,并生成更干净、更高质量的代码输出。Input¥8.75/MOutput¥70/MContext400K
GLM-4.6 ThinkingAPI ID:bigmodel/glm-4.6:thinking文本编程数学与科学学术与教育文档与办公对话与客服+5文本编程数学与科学学术与教育文档与办公对话与客服GLM-4.6 是智谱最新的旗舰模型,其总参数量 355B,激活参数 32B。GLM-4.6 所有核心能力上均完成了对 GLM-4.5 的超越PriceAttribute-based pricingAttribute-based pricing输入≤32k¥2/M token≤32k¥3/M token32k~不限¥4/M token输出≤2k¥8/M token2k~不限¥14/M token全部¥16/M token缓存读全部¥0.4/M token全部¥0.6/M token全部¥0.8/M token
GLM-4.6API ID:bigmodel/glm-4.6文本对话与客服文档与办公编程内容创作学术与教育+5文本对话与客服文档与办公编程内容创作学术与教育GLM-4.6 是智谱最新的旗舰模型,其总参数量 355B,激活参数 32B。GLM-4.6 所有核心能力上均完成了对 GLM-4.5 的超越Input¥2/MOutput¥8/MContext200K
GPT-5.4-ProAPI ID:openai/gpt-5.4-pro文本编程内容创作多模态理解学术与教育数学与科学+5文本编程内容创作多模态理解学术与教育数学与科学GPT-5 Pro 是 OpenAI 最先进的模型,在推理、代码质量和用户体验方面进行了重大改进。它针对需要分步推理、遵循指令和高风险用例准确性的复杂任务进行了优化。它支持测试时路由功能和高级提示理解,包括用户指定的意图,例如“认真考虑这个问题”。改进包括减少幻觉、阿谀奉承,以及在编码、写作和健康相关任务中表现更好。PriceAttribute-based pricingAttribute-based pricing输入≤272k¥210/M token272k~不限¥420/M token输出≤272k¥1260.001/M token272k~不限¥1890.002/M token
Step 5 PreviewAPI ID:stepfun/step-5-preview文本多模态理解智能代理与数据文档与办公编程+4文本多模态理解智能代理与数据文档与办公编程Step 5 Preview 是 StepFun 面向真实任务的新一代旗舰基模,重点覆盖编程与专业知识工作。模型原生支持文本、图片和视频输入,提供 1M tokens 上下文窗口,适合需要处理大量信息、调用工具,并持续推进到交付结果的任务。Input¥7/MOutput¥20/MContext256K
Qwen3 Next 80B A3B InstructAPI ID:ali/qwen3-next-80b-a3b-Instruct文本编程智能代理与数据对话与客服数学与科学翻译+5文本编程智能代理与数据对话与客服数学与科学翻译Qwen3-Next-80B-A3B-Instruct是Qwen3-Next系列中的一款指令微调对话模型,专为提供快速、稳定的响应而优化。它能够胜任复杂推理、代码生成、知识问答和多语言应用,同时在对齐与格式控制方面保持稳健。与以往的Qwen3 指令模型相比,该版本在超长输入和多轮对话场景下具备更高吞吐与更强稳定性,非常适用于RAG、工具调用以及需要一致性最终答案的智能体工作流。Input¥1/MOutput¥4/MContext131.1K
Qwen3-Coder-480B-A35B-InstructAPI ID:ali/qwen3-coder-480b-a35b-instruct文本编程智能代理与数据多模态理解+3文本编程智能代理与数据多模态理解基于Qwen3的代码生成模型,具有强大的Coding Agent能力,代码能力达到开源模型 SOTA。PriceAttribute-based pricingAttribute-based pricing输入≤32k¥6/M token32k~不限¥9/M token输出≤32k¥24/M token32k~不限¥36/M token
Claude Sonnet 4 ( Thinking )API ID:anthropic/claude-sonnet-4:thinking文本编程数学与科学+2文本编程数学与科学Claude Sonnet 4 ( Thinking ),在编程与推理任务中展现出更高的精度与可控性。该模型兼顾能力与计算效率,适用于从日常编码到复杂软件开发等多种场景。PriceAttribute-based pricingAttribute-based pricing缓存写(5m)Public price¥26.25/M token缓存写(1h)Public price¥42/M token
Doubao-Seed-1.6-flashAPI ID:bytedance/doubao-seed-1.6-flash文本对话与客服多模态理解文档与办公+3文本对话与客服多模态理解文档与办公Doubao-Seed-1.6-flash为豆包大模型1.6系列的极速版本,具有低延迟的显著优势,非常适用于对延迟要求极高的实时交互场景,如客服场景等。PriceAttribute-based pricingAttribute-based pricing输入≤32k¥0.15/M token32k~128k¥0.3/M token128k~不限¥0.6/M token输出≤32k¥1.5/M token32k~128k¥3/M token128k~不限¥6/M token缓存读≤32k¥0.03/M token32k~128k¥0.03/M token128k~不限¥0.03/M token
Claude Opus 4.1API ID:anthropic/claude-opus-4.1文本编程智能代理与数据数学与科学+3文本编程智能代理与数据数学与科学Claude Opus 4.1是Anthropic旗舰模型的更新版本,在编码、推理和代理任务方面均有提升。它在SWE-bench Verified测试中达到了74.5%的准确率,并在多文件代码重构、调试精度和面向细节的推理方面展现出显著提升。PriceAttribute-based pricingAttribute-based pricing缓存写(5m)Public price¥131.25/M token缓存写(1h)Public price¥210/M token
Qwen3 Next 80B A3B ThinkingAPI ID:ali/qwen3-next-80b-a3b-thinking文本数学与科学编程智能代理与数据学术与教育+4文本数学与科学编程智能代理与数据学术与教育Qwen3-Next-80B-A3B-Thinking 是Qwen3-Next系列中以推理为核心的对话模型,默认输出结构化的“思维链”内容。它专为复杂多步问题而设计,能够处理数学证明、代码生成与调试、逻辑推演以及智能体规划等任务,并在知识、推理、编程、对齐和多语言评测上表现出色。与以往的Qwen3模型相比,该版本在长链式思维下的稳定性与推理阶段的高效扩展上更具优势,且在复杂指令跟随时显著降低了重复或偏离任务的情况。Input¥1/MOutput¥10/MContext131.1K