¿Quiere una experiencia sin anuncios? Actualice su plan.
Generador de imágenes AI más rápido e ilimitado de Z-Image. 6 mil millones de parámetros, inferencia de 8 pasos, renderizado de texto bilingüe. Crea imágenes impresionantes en segundos.
Latencia ultra baja—perfecto para pruebas masivas de prompts.
Z-Image es un modelo base avanzado de generación de imágenes de próxima generación. Está diseñado para ofrecer síntesis de imágenes excepcionalmente rápida, de alta calidad y altamente controlable utilizando una arquitectura novedosa de Single-Stream Diffusion Transformer (S3-DiT). Z-Image integra todas las modalidades—texto, tokens semánticos y tokens de imagen VAE—en una secuencia unificada, mejorando enormemente la eficiencia de parámetros y la velocidad de generación.
Con 6 mil millones de parámetros, Z-Image pretende establecer un nuevo estándar en el ecosistema de código abierto, ofreciendo un rendimiento comparable o superior a modelos propietarios más grandes mientras mantiene una inferencia mucho más rápida.
Innovaciones técnicas que hacen de Z-Image un líder en IA generativa eficiente
Z-Image-Turbo requiere solo 8 NFEs para generar una imagen—una mejora masiva sobre los modelos de difusión tradicionales. Generación en menos de un segundo en GPUs empresariales, rendimiento en tiempo real en hardware de consumo.
Excepcional renderizado de texto en chino e inglés. Genera carteles, anuncios, empaques de productos y gráficos de redes sociales con tipografía precisa en ambos idiomas.
Prompt Enhancer permite interpretación semántica y contextual. Mejor comprensión de las relaciones entre objetos, adherencia precisa a instrucciones complejas de múltiples pasos y composiciones coherentes.
Transformaciones imagen a imagen impulsadas por lenguaje natural. Añade o elimina objetos, cambia estilo o iluminación, modifica fondos—todo con control flexible y creativo.
El punto óptimo del modelado AI. Lo suficientemente grande para comprensión profunda, lo suficientemente pequeño para GPUs de consumo de 16GB. Single-Stream DiT procesa tokens de texto e imagen juntos.
Totalmente abierto para uso comercial, investigación y modificación comunitaria. Sin regalías. Ajusta fino en tus propios conjuntos de datos para estilos personalizados.
Ecosistema flexible para generación de alta velocidad y edición creativa avanzada
Solo 8 NFEs para resultados fotorrealistas. Menos de un segundo en GPUs empresariales, tiempo real en hardware de consumo de 16GB. Ideal para apps interactivas y prototipado rápido.
Modelo completo no destilado para investigadores y usuarios avanzados. Flexibilidad total para adaptación de dominio personalizado y ajuste fino en conjuntos de datos específicos.
Edición de imágenes impulsada por lenguaje natural. Añadir/eliminar objetos, cambiar estilo, ajustar iluminación—mantiene la integridad estructural mientras aplica transformaciones creativas.
Flujo de trabajo simple para desarrolladores y artistas
Elige Z-Image-Turbo para velocidad, Z-Image-Base para personalización o Z-Image-Edit para posprocesado. Todas las variantes son de código abierto y listas para desplegar.
Descarga pesos preentrenados y ejecuta localmente. Z-Image funciona sin problemas en GPUs de 16GB VRAM. ComfyUI proporciona una interfaz modular basada en nodos para personalización ilimitada.
Z-Image entiende y renderiza nativamente inglés y chino. Introduce descripciones detalladas o frases poéticas—Z-Image interpreta tu intención semántica con alta precisión.
Con la latencia de menos de un segundo de Z-Image-Turbo, itera rápidamente por docenas de conceptos. Usa Z-Image-Edit para perfeccionar detalles con comandos de lenguaje natural.
Siguientes pasos recomendados según lo que estás haciendo.

Sube una foto fija y la IA le da movimiento natural.
Convierte imágenes en video cinematográfico
Abrir
Define dos fotogramas clave — la IA rellena la transición.
Convierte imágenes en video cinematográfico
Abrir
Edita imágenes con IA
Abrir
Elimina desenfoque y ruido con un clic — fotos como nuevas.
Mejora la calidad antes de publicar
Abrir