Z-Image AI 图像生成器

Z-Image 是阿里巴巴推出的 60 亿参数高速开源文本生成图像模型,专注于高质量、照片级真实感图像,并实现高效、低延迟的生成体验。

RiverFlow 2.0 Pro 30

RiverFlow 2.0 Pro 模型,支持高分辨率输出(最高4K)、宽高比控制和高级图像编辑功能

promptPlaceholder
高级设置
多模型对比
同时对比多个模型的生成结果
文生图
1K

本次生成将消耗 20 积分

核心功能

强大的 AI 技术与卓越性能的完美结合

极速推理

仅需 1–8 个扩散步骤即可在数秒内生成高质量图像,支持多兆像素分辨率的批量生成

照片级真实感

基于 60 亿参数的 S³-DiT 架构,呈现卓越的细节、光影、纹理和整体美感

双语文字渲染

原生支持中英文清晰、可读的文字渲染,适用于海报、标识、标签和图形设计

消费级硬件即可运行

可在显存低于 16GB 的消费级 GPU 上稳定运行,包括 RTX 3060 / 4060,适合本地部署

多种模型版本

包含用于超高速生成的 Z-Image Turbo,以及用于局部重绘、图像编辑和风格修改的专用版本

灵活且多用途

支持摄影、插画、概念艺术等多种创作场景,分辨率和画幅比例灵活,指令理解能力强

常见问题

关于 Z-Image Turbo 的所有你需要了解的内容

问:Z-Image 是开源的吗?

答: 是的。Z-Image 由阿里巴巴 / 通义开源发布,代码和模型权重已在 GitHub 等平台公开,可自由使用和部署。

问:目前有哪些版本?

答: Z-Image 系列包括通用生成的基础模型、主打速度的 Z-Image Turbo,以及针对局部重绘和图像修改任务优化的专用版本。

问:本地运行需要什么硬件?

答: 模型针对消费级硬件设计,显存低于 16GB 即可运行,例如 RTX 3060 / 4060,非常适合个人开发者和创作者。

问:支持哪些文字语言?

答: Z-Image 针对图像中的英文和中文文字渲染进行了专门优化。其他语言可能部分可用,但中英文是主要设计目标。

问:生成速度有多快?需要多少步?

答: 通常只需 1–8 个扩散步骤即可完成生成,速度取决于硬件和模式。Turbo 版本在部分平台上可实现接近实时的生成效果。

问:支持哪些分辨率?

答: 支持最高约 400 万像素(4MP)的灵活分辨率,并支持多种画幅比例和批量生成。