Z-Image

Z-Image

Z-Image est un modèle d'IA open-source pour l'image que vous pouvez utiliser via Fooocus.one pour la génération d'images à partir de texte et l'édition d'images native. Il est conçu pour les designers, marketeurs et créateurs qui ont besoin de visuels photoréalistes avec du texte précis en chinois et en anglais dans le même cadre. Les générations s'effectuent généralement en huit étapes, avec un délai d'environ deux à cinq secondes sur des GPU grand public.

Le modèle utilise une architecture Scalable Single-Stream DiT (S3-DiT). Les embeddings de texte, les jetons sémantiques visuels et les jetons VAE d’image sont concaténés en une seule séquence avant d’atteindre la backbone Transformer, ce qui permet de maintenir une empreinte de six milliards de paramètres tout en restant efficace par rapport aux designs à double flux. Un amplificateur de prompts intégré applique un raisonnement structuré pour des instructions complexes, allant de mises en page bilingues à des modifications où l’intention de l’utilisateur n’est que partiellement exprimée.

Les designers d’affiches, les équipes e-commerce et les éditeurs bilingues ont un avantage pratique lorsque la typographie doit rester nette à petite taille. Z-Image-Edit gère les instructions d’édition bilingues dans la même interface, vous permettant de faire évoluer un concept sans exporter vers un autre outil. Les benchmarks de préférences humaines sur Alibaba AI Arena le classent de manière compétitive face à des modèles fermés de premier plan tout en étant à la tête du domaine open-source.

Fonctionnalités principales:
  1. Rend le texte chinois et anglais de manière nette, même à de petites tailles de police

  2. Génération en huit étapes avec une sortie d'environ deux à cinq secondes sur GPU grand public

  3. Z-Image-Edit applique des modifications bilingues en langage naturel sans outils externes

  4. Prompt Enhancer raisonne à travers des instructions complexes comme des énigmes ou de la poésie

  5. S3-DiT regroupe les tokens de texte et d’image en un flux unique de six milliards de paramètres

  6. Éclairage, textures et composition photoréalistes optimisés pour la conception d’affiches

Pros:
  1. L'accès invité sur Fooocus.one inclut 30 points sans créer de compte.

  2. La génération en huit étapes offre une qualité compétitive par rapport aux modèles de pointe mentionnés sur le site.

  3. Z-Image-Edit gère les modifications bilingues dans la même interface que la génération texte-image.

  4. Typographie solide en petits caractères pour affiches, couvertures de magazines et mises en page marketing.

Cons:
  1. Z-Image fonctionne sur Fooocus.one plutôt que sur un site produit autonome dédié.

  2. Chaque génération d'images pour les invités coûte cinq points, limitant la production gratuite à une poignée d'images.

  3. La licence commerciale du plan Basic nécessite une facturation annuelle selon la page de tarifs.

  4. La synchronisation de l'historique des générations nécessite de se connecter à un compte Fooocus.one.

FAQ:

Z-Image est-il gratuit à utiliser sur Fooocus.one ?

Oui. Z-Image sur Fooocus.one offre un accès invité avec 30 points sans besoin de connexion. Chaque génération coûte cinq points, permettant ainsi aux invités de créer plusieurs images avant de devoir souscrire un plan payant ou d'acheter des points supplémentaires.

Quelle est l'architecture S3-DiT de Z-Image ?

Z-Image utilise une conception Scalable Single-Stream DiT (S3-DiT) qui intègre des tokens textuels, des tokens sémantiques visuels et des tokens VAE d'image dans une séquence Transformer unifiée. Fooocus.one indique que cette approche à flux unique est plus efficace en termes de paramètres que les alternatives à double flux pour son modèle de six milliards de paramètres.

Quelle est la rapidité de génération d'image de Z-Image ?

Z-Image vise une génération en huit étapes. Fooocus.one rapporte une latence inférieure à la seconde sur des GPU d'entreprise H800, environ deux secondes sur du matériel NVIDIA A10, et approximativement deux à cinq secondes sur des cartes grand public comme la RTX 3090 ou 4090.

Z-Image peut-il rendre du texte bilingue chinois et anglais ?

Oui. Z-Image est conçu pour un rendu précis du texte chinois et anglais tout en conservant des visages et une composition globale réalistes. Fooocus.one souligne comme cas d’usage fort les mises en page d'affiches, les couvertures de magazines et la typographie en petits caractères.

Qu'est-ce que le Prompt Enhancer dans Z-Image ?

Le Prompt Enhancer (PE) dans Z-Image utilise une chaîne de raisonnement structurée pour interpréter des instructions complexes ou ambiguës. Fooocus.one cite des exemples tels que la visualisation de poésie classique chinoise ou la résolution d’énigmes logiques à partir d’un texte prompt.

Z-Image supporte-t-il l’édition d’image ?

Oui. Z-Image-Edit accepte des instructions d’édition bilingues pour des modifications d’image sur place sur Fooocus.one. La page liste les modes Text to Image et Image Editor, avec une édition intégrée, vous n'avez donc pas besoin d'un éditeur externe séparé pour des révisions basiques.

Quels sont les plans payants Fooocus.one pour Z-Image ?

Fooocus.one propose le plan Basic à 9 $ par mois, Plus à 18 $ par mois, et Enterprise à 36 $ par mois, avec une facturation annuelle à 108 $, 216 $ et 432 $ respectivement. Les niveaux payants ajoutent plus de points pour les outils auxiliaires, une génération plus rapide, et une licence commerciale sur les niveaux supérieurs.

Catégorie:

Tarification:

Freemium

Tags:

AI Image Generation
Text-to-Image
Bilingual Text Rendering
Image Editing
Open Source AI Model
Photorealistic Images

Technologie utilisée:

Next.js
Cloudflare
Ruby
Emotion
Tailwind CSS

Commentaires:

Give your opinion on Z-Image :-

Overall rating

Join thousands of AI enthusiasts in the World of AI!

Meilleur Gratuit Z-Image Alternatives (et Payées)

By Rishit