Qwen3 Next 80B A3B ThinkingAPI ID:ali/qwen3-next-80b-a3b-thinking文本数学与科学编程智能代理与数据学术与教育+4文本数学与科学编程智能代理与数据学术与教育Qwen3-Next-80B-A3B-Thinking 是Qwen3-Next系列中以推理为核心的对话模型,默认输出结构化的“思维链”内容。它专为复杂多步问题而设计,能够处理数学证明、代码生成与调试、逻辑推演以及智能体规划等任务,并在知识、推理、编程、对齐和多语言评测上表现出色。与以往的Qwen3模型相比,该版本在长链式思维下的稳定性与推理阶段的高效扩展上更具优势,且在复杂指令跟随时显著降低了重复或偏离任务的情况。Input¥1/MOutput¥10/MContext131.1K
Qwen3 Next 80B A3B InstructAPI ID:ali/qwen3-next-80b-a3b-Instruct文本编程智能代理与数据对话与客服数学与科学翻译+5文本编程智能代理与数据对话与客服数学与科学翻译Qwen3-Next-80B-A3B-Instruct是Qwen3-Next系列中的一款指令微调对话模型,专为提供快速、稳定的响应而优化。它能够胜任复杂推理、代码生成、知识问答和多语言应用,同时在对齐与格式控制方面保持稳健。与以往的Qwen3 指令模型相比,该版本在超长输入和多轮对话场景下具备更高吞吐与更强稳定性,非常适用于RAG、工具调用以及需要一致性最终答案的智能体工作流。Input¥1/MOutput¥4/MContext131.1K
Grok Code Fast 1API ID:xai/grok-code-fast-1文本编程数学与科学+2文本编程数学与科学Grok Code Fast 1是xAI的首款编程模型,是一款兼具速度、高性价比的推理模型。Input¥1.4/MOutput¥10.5/MContext256K
Doubao-Seed-1.6-flashAPI ID:bytedance/doubao-seed-1.6-flash文本对话与客服多模态理解文档与办公+3文本对话与客服多模态理解文档与办公Doubao-Seed-1.6-flash为豆包大模型1.6系列的极速版本,具有低延迟的显著优势,非常适用于对延迟要求极高的实时交互场景,如客服场景等。PriceAttribute-based pricingAttribute-based pricing输入≤32k¥0.15/M token32k~128k¥0.3/M token128k~不限¥0.6/M token输出≤32k¥1.5/M token32k~128k¥3/M token128k~不限¥6/M token缓存读≤32k¥0.03/M token32k~128k¥0.03/M token128k~不限¥0.03/M token
Claude Opus 4.1API ID:anthropic/claude-opus-4.1文本编程智能代理与数据数学与科学+3文本编程智能代理与数据数学与科学Claude Opus 4.1是Anthropic旗舰模型的更新版本,在编码、推理和代理任务方面均有提升。它在SWE-bench Verified测试中达到了74.5%的准确率,并在多文件代码重构、调试精度和面向细节的推理方面展现出显著提升。PriceAttribute-based pricingAttribute-based pricing缓存写(5m)Public price¥131.25/M token缓存写(1h)Public price¥210/M token
DeepSeek V3.1API ID:deepseek/deepseek-v3.1文本智能代理与数据多模态理解数学与科学+3文本智能代理与数据多模态理解数学与科学DeepSeek V3.1是DeepSeek的新一代模型,具备混合推理(Think & Non-Think双模式),显著提升思考速度和任务处理效率,并通过后训练强化工具调用与多步骤智能体能力。Input¥4/MOutput¥12/MContext128K
o3API ID:openai/o3文本编程数学与科学多模态理解文档与办公智能代理与数据+5文本编程数学与科学多模态理解文档与办公智能代理与数据o3是一款全面且强大的跨领域模型,在数学、科学、编程和视觉推理任务中树立了新标杆。它在技术写作和遵循指令方面也表现出色。可用于处理涉及文本、代码和图像分析的多步骤问题。Input¥14/MOutput¥56/MContext200K
Kimi-thinking-previewAPI ID:moonshot/kimi-thinking-preview文本多模态理解数学与科学+2文本多模态理解数学与科学Kimi-thinking-preview是月之暗面提供的具有多模态推理能力和通用推理能力的多模态思考模型,它最长支持128k上下文,擅长深度推理,帮助解决更多更难的事情。Input¥200/MOutput¥200/MContext128K
GLM-4.5API ID:bigmodel/glm-4.5文本编程智能代理与数据数学与科学文档与办公+4文本编程智能代理与数据数学与科学文档与办公GLM-4.5是智谱最新旗舰模型,推理、代码、智能体综合能力达到开源模型的SOTA水平,模型上下文长度可达128k。PriceAttribute-based pricingAttribute-based pricing输入≤32k¥2/M token≤32k¥3/M token32k~不限¥4/M token输出≤2k¥8/M token2k~不限¥14/M token全部¥16/M token缓存读全部¥0.4/M token全部¥0.6/M token全部¥0.8/M token
Gemini 2.5 Flash LiteAPI ID:google/gemini-2.5-flash-lite文本多模态理解编程数学与科学文档与办公内容创作+5文本多模态理解编程数学与科学文档与办公内容创作Gemini 2.5 Flash-Lite 是Gemini 2.5 系列中的一个轻量级推理模型,优化了超低延迟和成本效率。与早期的 Flash 模型相比,它提供了更好的吞吐量、更快的 token 生成以及在常见基准测试中更好的性能。可通过reasoning.max_tokens开启思考并控制思维链长度。PriceAttribute-based pricingAttribute-based pricing缓存写(5m)Public price¥0.581/M token
GLM-4.5 ThinkingAPI ID:bigmodel/glm-4.5:thinking文本编程数学与科学智能代理与数据+3文本编程数学与科学智能代理与数据GLM-4.5是智谱最新旗舰模型,推理、代码、智能体综合能力达到开源模型的SOTA水平,模型上下文长度可达128k。PriceAttribute-based pricingAttribute-based pricing输入≤32k¥2/M token≤32k¥3/M token32k~不限¥4/M token输出≤2k¥8/M token2k~不限¥14/M token全部¥16/M token缓存读全部¥0.4/M token全部¥0.6/M token全部¥0.8/M token
Hunyuan-T1-VisionAPI ID:tencent/hunyuan-t1-vision文本多模态理解图像与设计文档与办公对话与客服+4文本多模态理解图像与设计文档与办公对话与客服采用混元MOE结构,是混元最新多模态模型,支持多语种作答,中英文能力均衡。Input¥3/MOutput¥9/MContext32K
DeepSeek-R1-0528API ID:deepseek/deepseek-r1-0528文本编程翻译编程数学与科学+4文本编程翻译编程数学与科学DeepSeek R1-0528是DeepSeek R1模型的小版本升级版。通过增加计算资源和引入后训练阶段的算法优化,DeepSeek R1-0528显著提升了推理与推断的深度和能力。该模型在数学、编程及一般逻辑等多项基准测试中表现优异,整体性能已接近业内领先的 O3和Gemini 2.5 Pro模型,展现出强大的多领域应用潜力。Input¥4/MOutput¥12/MContext128K
Claude-3.7-sonnet(Thinking)API ID:anthropic/claude-3.7-sonnet:thinking文本编程数学与科学多模态理解编程文档与办公学术与教育+6文本编程数学与科学多模态理解编程文档与办公学术与教育Claude-3.7-sonnet(Thinking)是Anthropic于 2025 年推出的新一代思维型大语言模型。该模型首次融合自回归生成与符号推理架构,具备多步骤思维展示、自我纠错能力以及长达 10 万 tokens 的上下文理解能力,标志着AI从简单生成向深度逻辑推理与透明思考的跨越。PriceAttribute-based pricingAttribute-based pricing缓存写(5m)Public price¥26.25/M token缓存写(1h)Public price¥42/M token
MiniMax-M1API ID:minimax/minimax-m1文本数学与科学编程多模态理解+3文本数学与科学编程多模态理解MiniMax-M1,世界上第一个开源的大规模混合架构的推理模型,适合在复杂场景中使用。PriceAttribute-based pricingAttribute-based pricing输入≤32k¥0.8/M token32k~128k¥1.2/M token128k~不限¥2.4/M token输出≤32k¥8/M token32k~128k¥16/M token128k~不限¥24/M token
Qwen3-235B-A22B-Instruct-2507API ID:ali/qwen3-235b-a22b-instruct-2507文本编程数学与科学多模态理解文档与办公翻译+5文本编程数学与科学多模态理解文档与办公翻译Qwen3-235B-A22B-Instruct-2507是Qwen3-235B-A22B-FP8的增强版本,在指令遵循、逻辑推理、文本理解、数学与编程能力、多语言知识覆盖等方面表现显著提升,并在256K长上下文处理和主观任务对齐度上进一步优化,生成内容更高质量、更贴近用户意图。Input¥2/MOutput¥8/MContext128K
GLM-4.5-X ThinkingAPI ID:bigmodel/glm-4.5-x:thinking文本对话与客服文档与办公编程内容创作学术与教育+5文本对话与客服文档与办公编程内容创作学术与教育GLM-4.5-X为GLM-4.5的极速版,在性能强劲的同时,生成速度可达100tokens/秒。PriceAttribute-based pricingAttribute-based pricing输入≤32k¥8/M token≤32k¥12/M token32k~不限¥16/M token输出≤2k¥16/M token2k~不限¥32/M token全部¥64/M token缓存读全部¥1.6/M token全部¥2.4/M token全部¥3.2/M token
GLM-4.5-AirX ThinkingAPI ID:bigmodel/glm-4.5-airx:thinking文本对话与客服编程数学与科学+3文本对话与客服编程数学与科学GLM-4.5-AirX为GLM-4.5-Air的极速版,响应速度更快,专为大规模高速度需求打造。PriceAttribute-based pricingAttribute-based pricing输入≤32k¥4/M token≤32k¥4/M token32k~不限¥8/M token输出≤2k¥12/M token2k~不限¥16/M token全部¥32/M token缓存读全部¥0.8/M token全部¥0.8/M token全部¥1.6/M token
GLM-4.5-Air ThinkingAPI ID:bigmodel/glm-4.5-air:thinking文本数学与科学编程智能代理与数据对话与客服文档与办公+5文本数学与科学编程智能代理与数据对话与客服文档与办公GLM-4.5-Air为GLM-4.5的轻量版,兼顾性能与性价比,可灵活切换混合思考模型。PriceAttribute-based pricingAttribute-based pricing输入≤32k¥0.8/M token≤32k¥0.8/M token32k~不限¥1.2/M token输出≤2k¥2/M token2k~不限¥6/M token全部¥8/M token缓存读全部¥0.16/M token全部¥0.16/M token全部¥0.24/M token
GLM-4.5-XAPI ID:bigmodel/glm-4.5-x文本对话与客服编程文档与办公内容创作翻译+5文本对话与客服编程文档与办公内容创作翻译GLM-4.5-X为GLM-4.5的极速版,在性能强劲的同时,生成速度可达100tokens/秒。PriceAttribute-based pricingAttribute-based pricing输入≤32k¥8/M token≤32k¥12/M token32k~不限¥16/M token输出≤2k¥16/M token2k~不限¥32/M token全部¥64/M token缓存读全部¥1.6/M token全部¥2.4/M token全部¥3.2/M token
GLM-4.5-AirAPI ID:bigmodel/glm-4.5-air文本对话与客服编程文档与办公内容创作智能代理与数据+5文本对话与客服编程文档与办公内容创作智能代理与数据GLM-4.5-Air为GLM-4.5的轻量版,兼顾性能与性价比,可灵活切换混合思考模型。PriceAttribute-based pricingAttribute-based pricing输入≤32k¥0.8/M token≤32k¥0.8/M token32k~不限¥1.2/M token输出≤2k¥2/M token2k~不限¥6/M token全部¥8/M token缓存读全部¥0.16/M token全部¥0.16/M token全部¥0.24/M token
Kimi-latestAPI ID:moonshot/kimi-latest文本多模态理解文档与办公对话与客服内容创作学术与教育+5文本多模态理解文档与办公对话与客服内容创作学术与教育Kimi-latest是一个最长支持128k上下文的视觉模型,支持图片理解。同时,kimi-latest 模型总是使用Kimi智能助手产品使用最新的Kimi 大模型版本,可能包含尚未稳定的特性。PriceAttribute-based pricingAttribute-based pricing输入≤8k¥2/M token8k~32k¥5/M token32k~不限¥10/M token输出≤8k¥10/M token8k~32k¥20/M token32k~不限¥30/M token
Qwen3-235B-A22B-Thinking-2507API ID:ali/qwen3-235b-a22b-thinking-2507文本数学与科学多模态理解内容创作学术与教育文档与办公+5文本数学与科学多模态理解内容创作学术与教育文档与办公基于Qwen3的思考模式开源模型,相较通义千问3-235B-A22B逻辑能力、通用能力、知识增强及创作能力均有大幅提升,适用于高难度强推理场景。Input¥2/MOutput¥20/MContext131.1K