OpenAI / GPT Image 2.5 FlareAPI ID:openai/gpt-image-2.5-flare图像生成内容创作图像与设计GPT Image 2.5 Flare 是 OpenAI 推出的图像生成与编辑模型,定位为 GPT Image 2.5 系列中主打速度的版本。该模型适用于大批量日常图像生成、创作者内容制作,以及通过专用图像 API 快速制作原型。
OpenAI / GPT Image 2.5 SunburstAPI ID:openai/gpt-image-2.5-sunburst图像生成内容创作图像与设计GPT Image 2.5 Sunburst 是 OpenAI 推出的图像生成与编辑模型,定位为 GPT Image 2.5 系列中主打高精度的版本。该模型可通过专用图像 API,适用于编辑精度比生成速度更重要的精细化创意工作。
Bytedance / Doubao-Seedream-5.0-proAPI ID:bytedance/doubao-seedream-5-0-pro图像生成内容创作图像与设计seedream-5.0-pro是字节跳动发布的最新图像创作模型。该模型在更复杂、更真实的图像生成与编辑需求维度全面升级,将图像创作推进到可控生产的新阶段。本次模型更新的主要亮点是编辑更可控、生产更落地、效果更自然。
OpenAI / GPT Image 2API ID:openai/gpt-image-2图像生成图像与设计GPT-image-2 是 OpenAI 最新的尖端图像生成模型。主要附加价值包括性能提升、质量提升、编辑控制和面部保护。该模型支持高强度 input_fidelity,并且可以添加或移除图像的某一方面,同时保留其他部分。该模型在宽高比、分辨率和编辑能力方面都有改进。
Google / Gemini 3.1 Flash ImageAPI ID:google/gemini-3.1-flash-image图像生成图像与设计多模态理解谷歌最强图像模型,nano banana 2 。Gemini 3.1 Flash Image 将最强大的图像生成功能推向主流市场。它提升了图像质量、视觉理解能力,更好地渲染了多种语言的长文本段落,并提高了图像的真实性。该模型还能够生成分辨率从 512 (0.25MP) 到 4K (16MP) 的图像。
Bytedance / Doubao-Seedream-5.0-liteAPI ID:bytedance/doubao-seedream-5-0-lite图像生成图像与设计Doubao-Seedream-5.0-lite是字节跳动发布的最新图像创作模型。该模型首次搭载联网检索功能,能融合实时网络信息,提升生图时效性。同时,模型的聪明度进一步升级,能够精准解析复杂指令和视觉内容。此外,模型在世界知识广度、参考一致性及专业场景生成质量上均有增强,可更好地满足企业级视觉创作需求。
Ali / Z-Image-TurboAPI ID:ali/z-image-turbo图像生成图像与设计Z-Image-Turbo是在Artificial Analysis评测中荣登文生图开源模型世界第一的高效图像生成模型,仅用60亿参数和8步推理就能生成媲美大规模商业模型的照片级真实感图像,并在中英双语文本渲染、复杂语义理解和多样化主题生成上表现卓越。
OpenAI / GPT Image 1.5API ID:openai/gpt-image-1.5图像生成图像与设计OpenAI最强图像生成模型,新模型能够结合世界知识,生成更加符合上下文图像,质量更高,还支持多种功能自定义。
Bytedance / Doubao-Seedream-4.5API ID:bytedance/doubao-seedream-4.5图像生成图像与设计Seedream 4.5 是字节跳动最新推出的图像多模态模型,整合了文生图、图生图、组图输出等能力,融合常识和推理能力。相比前代4.0模型生成效果大幅提升,具备更好的编辑一致性和多图融合效果,能更精准的控制画面细节,小字、小人脸生成更自然
Ali / Qwen-Image-PlusAPI ID:ali/qwen-image-plus图像生成图像与设计通义千问系列图像生成模型,参数规模200亿。具备卓越的文本渲染能力,在复杂文本渲染、各类生成与编辑任务重表现出色,在多个公开基准测试中获得SOTA。
Bytedance / Doubao-Seedream-4.0API ID:bytedance/doubao-seedream-4.0图像生成图像与设计Seedream 4.0 是基于领先架构的SOTA级多模态图像创作模型,其生成美感、指令遵循、结构完整度、主体保持一致性处于世界头部水平。模型采用同一套架构实现文生图与编辑能力的统一,原生支持文本 、单图和多图输入,并能通过对提示词的深度推理,自动适配最优的图像比例尺寸与生成数量,可一次性连续输出最多 15 张内容关联的图像,支持 4K 超高清输出
BlackForestLabs / Flux-1.1-proAPI ID:black-forest-labs/flux-1.1-pro图像生成图像与设计更快、更好的 FLUX Pro。文本转图像模型,具有出色的图像质量、快速的一致性和输出多样性。
BlackForestLabs / Flux-1.1-pro-ultra-finetunedAPI ID:black-forest-labs/flux-1.1-pro-ultra-finetuned图像生成图像与设计使用自定义 finetune_id 的 FLUX 1.1 [pro] Ultra 模型。支持 4MP 图像和 raw 模式,以实现逼真效果
BlackForestLabs / Flux-1.1-pro-ultraAPI ID:black-forest-labs/flux-1.1-pro-ultra图像生成图像与设计FLUX1.1 [pro] 拥有 ultra 和 raw 两种模式。图像分辨率最高可达 400 万像素。使用 raw 模式可获得更逼真的效果。
BlackForestLabs / Flux-dev-loraAPI ID:black-forest-labs/flux-dev-lora图像生成图像与设计flux-dev 的一个版本,文本到图像模型,支持快速微调 lora 推理
BlackForestLabs / Flux-kontext-devAPI ID:black-forest-labs/flux-kontext-dev图像生成图像与设计FLUX.1 Kontext 的开源版本
BlackForestLabs / Flux-kontext-maxAPI ID:black-forest-labs/flux-kontext-max图像生成图像与设计一种基于文本的高级图像编辑模型,可提供最佳性能和改进的排版生成,通过自然语言提示转换图像
BlackForestLabs / Flux-kontext-proAPI ID:black-forest-labs/flux-kontext-pro图像生成图像与设计最先进的基于文本的图像编辑模型,可提供高质量的输出,具有出色的及时性和一致的结果,可通过自然语言转换图像
Google / Gemini-2.5-flash-imageAPI ID:google/gemini-2.5-flash-image图像生成图像与设计谷歌最强图像模型,nano-banana 的正式版。
Ali / 通义万相2.2-文生图-LoraAPI ID:ali/wan-2.2-t2i-lora图像生成图像与设计该模型可在 3-4 秒内生成精美的电影级 200 万像素图像,它源自 Wan 2.2 模型,并运用了 pruna 包中的优化技术。
BlackForestLabs / Flux-kontext-dev-loraAPI ID:black-forest-labs/flux-kontext-dev-lora图像生成图像与设计FLUX.1 Kontext[dev] 用于运行 lora finetunes 的图像编辑模型