
Última actualización 07-15-2026
Categoría:
Reviews:
Join thousands of AI enthusiasts in the World of AI!
Z-Image
Z-Image es un modelo de inteligencia artificial de código abierto para imágenes que puedes usar a través de Fooocus.one para generación de texto a imagen y edición nativa de imágenes. Está diseñado para diseñadores, marketers y creadores que necesitan imágenes fotorrealistas con texto en chino e inglés con precisión en la misma escena. Las generaciones suelen completarse en ocho pasos, con un tiempo de espera de aproximadamente dos a cinco segundos en GPU de consumo.
El modelo utiliza una arquitectura Scalable Single-Stream DiT (S3-DiT). Las incrustaciones de texto, tokens semánticos visuales y tokens VAE de la imagen se concatenan en una secuencia antes de llegar a la columna vertebral del Transformador, lo que mantiene un impacto de seis mil millones de parámetros eficiente en comparación con diseños de doble flujo. Un Mejorador de Prompts incorporado aplica razonamiento estructurado para instrucciones complejas, desde diseños de carteles bilingües hasta ediciones donde la intención del usuario solo está parcialmente expresada.
Los diseñadores de carteles, equipos de comercio electrónico y editores bilingües obtienen una ventaja práctica cuando la tipografía debe mantenerse nítida en tamaños pequeños. Z-Image-Edit maneja instrucciones de edición bilingües en la misma interfaz, por lo que puedes iterar sobre un concepto sin necesidad de exportar a otra herramienta. Los benchmarks de preferencia humana en Alibaba AI Arena lo colocan en competencia con los principales modelos cerrados, liderando además el campo de código abierto.
Representa texto en chino e inglés de manera nítida, incluso en tamaños de fuente pequeños
Generación en ocho pasos con un tiempo de salida de aproximadamente dos a cinco segundos en GPUs para consumidores
Z-Image-Edit aplica ediciones bilingües de lenguaje natural sin herramientas externas
Prompt Enhancer razona a través de instrucciones complejas como acertijos o poesía
S3-DiT agrupa tokens de texto e imagen en un solo flujo de seis mil millones de parámetros
Iluminación fotorrealista, texturas y composición ajustadas para diseño de carteles
El acceso de invitado en Fooocus.one incluye 30 puntos sin necesidad de crear una cuenta.
La generación en ocho pasos ofrece una calidad competitiva frente a los modelos líderes mencionados en el sitio.
Z-Image-Edit maneja ediciones bilingües en la misma interfaz que la generación de texto a imagen.
Tipografía fuerte en fuentes pequeñas para pósters, portadas de revistas y diseños de marketing.
Z-Image se ejecuta en Fooocus.one en lugar de un sitio de producto independiente dedicado.
Cada generación de imagen cuesta cinco puntos, limitando la salida gratuita a un puñado de imágenes.
La licencia comercial en el plan Básico requiere facturación anual según la página de precios.
La sincronización del historial de generación requiere iniciar sesión en una cuenta de Fooocus.one.
¿Es Z-Image gratis para usar en Fooocus.one?
Sí. Z-Image en Fooocus.one ofrece acceso como invitado con 30 puntos y sin necesidad de iniciar sesión. Cada generación cuesta cinco puntos, por lo que los invitados pueden crear varias imágenes antes de necesitar un plan pago o puntos adicionales.
¿Cuál es la arquitectura S3-DiT de Z-Image?
Z-Image utiliza un diseño Scalable Single-Stream DiT (S3-DiT) que alimenta texto, tokens semánticos visuales y tokens VAE de imagen en una única secuencia unificada del Transformer. Fooocus.one indica que este enfoque de flujo único es más eficiente en parámetros que las alternativas de flujo dual para su modelo de seis mil millones de parámetros.
¿Qué tan rápido es la generación de imágenes con Z-Image?
Z-Image apunta a una generación en ocho pasos. Fooocus.one reporta latencia inferior a un segundo en GPUs empresariales H800, unos dos segundos en hardware NVIDIA A10, y aproximadamente de dos a cinco segundos en tarjetas de consumo como RTX 3090 o 4090.
¿Puede Z-Image renderizar texto bilingüe en chino e inglés?
Sí. Z-Image está diseñado para renderizar texto preciso en chino e inglés mientras mantiene rostros y composición general realistas. Fooocus.one destaca los diseños de pósteres, portadas de revistas y tipografía de fuentes pequeñas como casos de uso fuertes.
¿Qué es el Prompt Enhancer en Z-Image?
El Prompt Enhancer (PE) en Z-Image usa una cadena de razonamiento estructurada para interpretar instrucciones complejas o ambiguas. Fooocus.one da ejemplos como visualizar poesía clásica china o resolver acertijos lógicos a partir de un prompt de texto.
¿Soporta Z-Image la edición de imágenes?
Sí. Z-Image-Edit acepta instrucciones de edición bilingües para cambios en la imagen en el lugar en Fooocus.one. La página lista modos de Texto a Imagen y Editor de Imágenes, con edición integrada para que no necesites un editor externo para revisiones básicas.
¿Cuáles son los planes pagos de Fooocus.one para Z-Image?
Fooocus.one ofrece Basic a $9 al mes, Plus a $18 al mes y Enterprise a $36 al mes, con facturación anual de $108, $216 y $432 respectivamente. Los niveles pagos añaden más puntos para herramientas auxiliares, generación más rápida y licencia comercial en los niveles superiores.
