描述
Z-Image 是通过 Fooocus.one 提供的 AI 图像生成和编辑模型,旨在实现逼真的输出、准确的双语文本渲染和本地编辑。它在仅需 8 个步骤的情况下,达到与领先竞争对手相当或更高的性能,并且可以在消费者 GPU 上大约 2 到 5 秒内生成图像。
该模型拥有 60 亿个参数,采用可扩展单流 DiT (S3-DiT) 架构,将文本、视觉语义标记和图像潜变量统一为一个输入序列,以最大化参数效率,相较于双流方法更具优势。它适用于消费者设备的 16GB VRAM 内存,并在企业 H800 GPU 上提供亚秒延迟。
Z-Image 在摄影级真实感方面表现出色,能够精细控制细节、光照和纹理,并准确渲染中英文文本,包括小字体,具备强大的构图和排版能力,适合海报设计。内置的提示增强器使用结构化推理链注入逻辑和常识,使模型能够处理复杂任务并从模糊指令中推断意图。Z-Image-Edit 增加了创意编辑功能,能够理解双语指令,实现灵活的转换,无需外部工具。
根据阿里巴巴 AI Arena 上基于 Elo 的人类偏好评估,Z-Image 在与领先模型的竞争中表现出色,并在开源选项中取得了最先进的结果。访问通过 Fooocus.one 的分层计划,提供月度和年度选项以及包含的工具积分。
Z-Image的核心功能
具有精细细节和光照控制的逼真图像生成
准确的中英文双语文本渲染
仅需 8 个步骤即可快速生成,消费者 GPU 上仅需几秒钟
高效的 S3-DiT 单流架构
内置提示增强器,具备结构化推理
与 Z-Image-Edit 的本地创意图像编辑
在消费者设备上运行于 16GB VRAM 内存
在开源模型中取得最先进的结果
如何使用 Z-Image?
撰写提示:详细描述您的图像,包括任何双语文本要求。
利用提示增强:使用提示增强器处理复杂任务,并从模糊指令中推断意图。
生成和编辑:在大约 2 到 5 秒内生成图像,并使用 Z-Image-Edit 进行精细调整。
下载结果:保存您的专业质量图像。
Z-Image的使用案例
- 逼真图像
- 双语海报设计
- 产品摄影
- 创意图像编辑
- 快速迭代





