Z-Image - 阿里通义实验室开源的图像生成模型
Z-Image是阿里通义实验室开源的图像生成模型,具有高效、快速和强大的图像生成能力。采用单流扩散Transformer架构(S3-DiT),将文本、视觉语义和图像VAE token整合为统一输入流,最大化参数效率。其核心技术创新包括解耦分布匹配蒸馏(Decoupled-DMD)和强化学习与分布匹配蒸馏融合(DMDR),显著提升少步生成性能和图像质量。Z-Image-Turbo版本仅需8次函数评估就能生成高质量图像,支持亚秒级推理延迟,适配低显存设备,擅长照片级真实感图像生成和双语文本渲染。Z-Image-Edit版本专注于图像编辑任务,可依据自然语言提示进行精确编辑。Z-Image-Base是未经蒸馏的基础模型,为社区提供更广泛的微调和定制开发空间

