Google / Gemini 3 Flash PreviewAPI ID:google/gemini-3-flash文本智能代理与数据编程对话与客服多模态理解数学与科学Gemini 3 Flash Preview 旨在以极高的速度和性价比提供强大的代理功能(接近专业级)。它非常适合进行多轮对话,并能与您的编码代理进行流畅的双向协作。与 2.5 Flash 版本相比,它在各方面都实现了显著提升。 Gemini 3 型号是具有思考能力的模型,能够在做出反应之前进行推理,从而提高性能和准确性。
Anthropic / Claude Sonnet 5API ID:anthropic/claude-sonnet-5文本多模态理解智能代理与数据编程Sonnet 5 是 Anthropic 公司最强大的 Sonnet 类模型之一,其在各种编程、代理以及专业场景中的性能表现都非常出色。该模型支持自适应思维机制,用户可以选择不同的推理强度级别(低、中、高、最高以及超高强度)。它还具备 1 百万标记数的上下文存储能力,并且能够接受文本、图像和文件输入。Sonnet 5 采用了升级后的分词器,并配备了实时网络安全保护功能,能够阻止某些高风险的两用活动
Ali / Qwen-Image-PlusAPI ID:ali/qwen-image-plus图像生成图像与设计通义千问系列图像生成模型,参数规模200亿。具备卓越的文本渲染能力,在复杂文本渲染、各类生成与编辑任务重表现出色,在多个公开基准测试中获得SOTA。
ByteDance / Doubao-Seed-CharacterAPI ID:bytedance/doubao-seed-character文本多模态理解内容创作对话与客服Doubao-Seed-Character 是面向新一代虚拟陪伴场景打造的 Seed 分支模型,擅长虚拟演绎与“真人”风格的角色扮演,支持剧情创作、剧情演绎与推动、多人聊天等多类对话互动场景。 模型在角色理解、人设保持、多轮对话、剧情推进与互动表达上持续增强,能够稳定理解用户意图、延续角色设定,并以更具画面感的语言带来自然、生动、连贯的互动体验。
ByteDance / Doubao-Seed-EvolvingAPI ID:bytedance/doubao-seed-evolving文本智能代理与数据编程Doubao-Seed-Evolving 面向 Coding 与 Agent 场景,持续周级升级,以统一模型 ID 提供最新能力,助力复杂任务高效落地。
ByteDance / Doubao-Seed-2.1-turboAPI ID:bytedance/doubao-seed-2-1-turbo文本多模态理解智能代理与数据编程效果与成本均衡,全面升级 Coding、Agent 与多模态能力,以更强的自主规划、长链路执行和动态修复能力,胜任企业真实复杂任务。
ByteDance / Doubao-Seed-2.1-proAPI ID:bytedance/doubao-seed-2-1-pro文本多模态理解智能代理与数据编程Doubao-Seed-2.1 是面向 Coding 和 Agent 时代打造的新一代大模型,提供 Pro 和 Turbo 两个版本,分别面向高复杂度任务探索和规模化生产场景。相较上一代版本,Seed 2.1 在 Coding 工程交付、Agent 长链路任务执行和多模态理解三大方向上实现全面升级,以更强的自主规划与动态修复能力,胜任真实研发与高价值生产任务。
bigmodel / GLM-5.2API ID:bigmodel/glm-5.2文本智能代理与数据编程GLM-5.2 是面向长任务时代的旗舰模型。支持真正可用的 1M 上下文,实测可承载项目级工程上下文,长程任务执行更稳定、工程规范遵循更可靠,开发场景成功率进一步提升。一次任务即可完成“从需求到多端可部署产物”的完整开发链路。
Moonshot / Kimi K2.7 CodeAPI ID:moonshot/kimi-k2.7-code文本多模态理解智能代理与数据编程对话与客服Kimi K2.7 Code 是 Kimi 迄今最智能的 Coding 模型,在长上下文中更可靠地遵循指令,能以更高的成功率完成编程任务。同时支持文本、图片与视频输入,仅支持思考模式,对话与 Agent 任务。模型上下文长度 256k,支持长思考擅长深度推理,支持自动上下文缓存功能,ToolCalls、JSON Mode、Partial Mode 等能力
Anthropic / Claude Fable 5API ID:anthropic/claude-fable-5文本智能代理与数据编程文档与办公Claude Fable 5 是 Anthropic 下一代智能,专注于最难的知识工作和编程问题。它比以往任何普遍可用的 Claude 模型都能独立运行时间更长:通过代理框架运行,它可以连续工作数天,跨阶段规划,委派给子代理,并检查自身工作。
Ali / Qwen3.7-Plus(限时8折)API ID:ali/qwen3.7-plus文本多模态理解文档与办公编程智能代理与数据Qwen3.7系列中高性价比Plus模型,在强大文本能力的基础上全面升级了视觉-语言能力,同时保持了在编码、工具使用和生产力工作流方面的完整智能体能力。其核心特色为多模态交互混合智能体能力,能够感知真实世界场景、读取屏幕并操作 GUI、基于视觉参考生成代码、端到端导航移动应用。
MiniMax / MiniMax M3(5折)API ID:minimax/minimax-m3文本智能代理与数据编程MiniMax M3永久五折,MiniMax M3 在编程和智能体等专业任务上达到了前沿的能力。它使用了我们提出的全新注意力架构 MSA (MiniMax Sparse Attention ),最高支持 1M 超长上下文。
Anthropic / Claude Opus 4.8API ID:anthropic/claude-opus-4.8文本多模态理解智能代理与数据文档与办公编程Claude Opus 4.8 是 Anthropic 在 Opus 家族中最强大的通用型号。它支持文本、图片和文件输入,并输出文本,支持推理和 1M 令牌上下文窗口。它适合高度自主的代理、长视野代理工作、知识驱动工作以及在长时间会话中保持一致性的记忆驱动任务。 它在多步推理、复杂编码和端到端项目编排方面尤为强大——大型代码库、多阶段调试和长期运行的异步代理流水线。除了编码,它还处理知识工作,如起草文档、构建演示文稿和分析数据,保持长时间输出的质量。
Google / Gemini 3.5 FlashAPI ID:google/gemini-3.5-flash文本智能代理与数据编程多模态理解Gemini 3.5 Flash 以 Flash 级别的成本和速度提供接近专业级的智能:专业级的编码能力、并行代理执行,所有这些都以更低的价格实现。
Ali / Qwen3.7-MaxAPI ID:ali/qwen3.7-max文本智能代理与数据文档与办公编程Qwen3.7系列中规模最大、综合能力最强的Max模型,当前开放纯文本模型能力供体验。Qwen3.7是面向智能体时代的新一代旗舰模型,核心优势在于智能体能力的广度与深度:在编程、办公与生产力、长周期自主执行方面均能出色胜任各项任务。
Google / Gemini 3.1 Flash LiteAPI ID:google/gemini-3.1-flash-lite文本多模态理解智能代理与数据编程Gemini 3.1 Flash-Lite 是谷歌最具成本效益的 Gemini 型号,针对低延迟、高成本的大型语言模型流量进行了优化。它相比 Gemini 2.0/2.5 Flash-Lite 型号实现了显著的质量提升,在关键能力领域的性能与 Gemini 2.5 闪存相当。
Ali / HappyHorse-1.0-Video-EditAPI ID:ali/happyhorse-1.0-video-edit视频生成视频与3D多模态理解HappyHorse-1.0-Video-Edit支持视频编辑,自然语言指令编辑视频,可参考最多5张图片局部或全局编辑视频元素,能够精准复刻视频动态过程,实现更强表现能力。
Ali / HappyHorse-1.0-R2VAPI ID:ali/happyhorse-1.0-r2v视频生成视频与3DHappyHorse-1.0-R2V支持参考生视频,更加稳定的主体与场景参考,支持最多9张图片参考,能够精准保持创作意图,实现更强表现能力。
Ali / HappyHorse-1.0-I2VAPI ID:ali/happyhorse-1.0-i2v视频生成视频与3D内容创作HappyHorse-1.0-I2V支持图生视频,具备高度还原的动态画面生成能力,能够精准理解文本语义,输出流畅自然、细节丰富的高质量视频。
Ali / HappyHorse-1.0-T2VAPI ID:ali/happyhorse-1.0-t2v视频生成视频与3DHappyHorse-1.0-T2V支持文生视频,具备高度还原的动态画面生成能力,能够精准理解文本语义,输出流畅自然、细节丰富的高质量视频。
Xiaomi / MiMo-V2.5API ID:xiaomi/mimo-v2.5文本多模态理解智能代理与数据文档与办公MiMo-V2.5 是小米原生的全模态模型。它以约一半的推理成本实现专业级代理性能,同时在图像和视频理解任务中的多模态感知上超越 MiMo-V2-Omni。其 100 万上下文窗口支持完整文档、扩展对话和复杂任务上下文,非常适合与代理框架集成,在需要强大推理、丰富感知和成本效益的环境中。
Xiaomi / MiMo-V2.5-ProAPI ID:xiaomi/mimo-v2.5-pro文本智能代理与数据编程Xiaomi MiMo-V2-Pro 专为现实世界中高强度的 Agent 工作场景而打造。它拥有超过 1T 的总参数量(42B 激活参数),采用创新的混合注意力架构,并支持 1M 超长上下文长度。在强大的模型基座上,我们在更为广泛的 Agent 场景中持续 Scaling 算力,进一步拓展了智能的动作空间,实现了从 Coding 到 Claw 的重要泛化。
OpenAI / GPT-5.5API ID:openai/gpt-5.5文本编程多模态理解数学与科学文档与办公智能代理与数据GPT-5.5 是 OpenAI 为复杂专业工作负载设计的前沿模型,基于 GPT-5.4,具备更强的推理能力、更高的可靠性,处理困难任务。它配备了 1M上下文窗口(922K 输入,128K 输出),支持文本和图像输入,支持在单一系统内实现大规模推理、编码和多模态工作流。
DeepSeek / DeepSeek-V4-Flash-0731API ID:deepseek/deepseek-v4-flash文本数学与科学智能代理与数据文档与办公编程对话与客服DeepSeek-V4-Flash是深度求索公司于2026年4月24日发布的高效经济版大语言模型。它采用混合专家(MoE)架构,总参数量约2840亿,每次推理仅激活约130亿参数,并原生支持高达100万Token的超长上下文。该版本在推理能力和简单Agent任务上接近性能强大的Pro版本,但凭借更小的参数和激活规模,能提供更快捷、低成本的API服务。适合需要快速响应和追求极致性价比的各类轻量级应用场景。