
OpenAI
GPT Image 2
OpenAI 图像模型,适合忠于提示词的视觉、清晰图内文字、参考图编辑和一致角色。

Alibaba Qwen
Qwen Image 2.0
Alibaba Qwen 图像模型,适合双语文字渲染、锐利细节和精准参考图编辑。

Google Gemini
Nano Banana 2
高保真图像模型,适合 4K 级创意工作、角色一致性和可控图像编辑。

xAI
Grok Imagine Video 1.5
xAI 视频模型,可将文本提示词或一张参考图转成流畅的短视频片段。

ByteDance
Seedream 5
ByteDance 图像模型,适合提示词生成、清晰图中文字,以及最多 14 张参考图融合。

Topaz Labs
Topaz Image
无需提示词的 AI 放大器,可将照片放大到 8x,并恢复人脸、细节和清晰度。

Google Gemini
Gemini Omni
Google 任意输入转视频模型,可把提示词或最多七张参考图变成连贯短片。
目录
全部 AI 模型
文本生成图像、参考图编辑、产品视觉、海报和创作者素材。

GPT Image 2
OpenAI 图像模型,适合忠于提示词的视觉、清晰图内文字、参考图编辑和一致角色。

Qwen Image 2.0
Alibaba Qwen 图像模型,适合双语文字渲染、锐利细节和精准参考图编辑。

Nano Banana 2
高保真图像模型,适合 4K 级创意工作、角色一致性和可控图像编辑。

Seedream 5
ByteDance 图像模型,适合提示词生成、清晰图中文字,以及最多 14 张参考图融合。

Topaz Image
无需提示词的 AI 放大器,可将照片放大到 8x,并恢复人脸、细节和清晰度。
更快选择合适模型
从匹配任务的模型开始,再进入对应内页使用控件、示例和设置。
需要图中文字?
当结果依赖清晰标签、海报或版式时,打开 GPT Image 2 或 Qwen Image 2.0。
需要主体一致?
角色、产品和参考图驱动的创意工作,优先使用 Nano Banana 2。
需要动态画面?
当需求是把提示词或参考图变成视频片段时,打开 Grok Imagine Video 1.5 或 Gemini Omni。
AI 模型常见问题
关于在 Nano Banana Pro 上选择模型页面的快速回答。