Les 5 meilleurs générateurs d'images AI en open source

Les 5 meilleurs générateurs d’images AI en open source

Les modèles de génération de texte en image basés sur l’IA sont partout et deviennent de plus en plus faciles d’accès chaque jour. S’il est facile de visiter un site Web et de générer l’image que vous recherchez, les générateurs de texte en image open source sont votre meilleure option si vous souhaitez davantage de contrôle sur le processus de génération.

Il existe des dizaines de générateurs de texte en image IA gratuits et open source disponibles sur Internet, spécialisés dans des types d’images spécifiques. Nous avons donc passé au crible la pile et trouvé les meilleurs générateurs de texte en image IA open source que vous pouvez essayer dès maintenant.

1Craiyon

Craiyon est l’un des générateurs d’images IA open source les plus facilement accessibles. Il est basé sur DALL-E Mini, et bien que vous puissiez cloner le référentiel Github et installer le modèle localement sur votre ordinateur, Craiyon semble avoir abandonné cette approche au profit de son site Web.

Le dépôt Github officiel n’a pas été mis à jour depuis juin 2022, mais le dernier modèle est toujours disponible gratuitement sur le site officiel de Craiyon. Il n’existe pas non plus d’applications Android ou iOS.

En termes de fonctionnalités, vous verrez toutes les options habituelles que vous attendez d’un générateur d’images IA. Une fois que vous avez saisi votre invite et obtenu une image, vous pouvez utiliser la fonction de mise à l’échelle pour obtenir une copie en haute résolution. Vous avez le choix entre trois styles : Art, Photo et Dessin. Vous pouvez également sélectionner l’option « Aucun » si vous souhaitez que le modèle décide.

image générée par craiyon

De plus, le « mode expert » vous permet d’inclure des mots négatifs, ce qui indique au modèle d’éviter certains éléments. Il existe également une fonction de prédiction des invites, qui utilise ChatGPT pour aider les utilisateurs à rédiger les invites les plus précises et les plus détaillées possibles. Enfin, les fonctions de suppression d’arrière-plan alimentées par l’IA peuvent vous aider à gagner du temps et à économiser des efforts en recadrant les arrière-plans des images.

Et c’est à peu près tout ce que fait Craiyon. Ce n’est pas le modèle de génération d’images d’IA le plus sophistiqué, mais il fonctionne bien comme modèle de base si vous ne voulez pas quelque chose de détaillé ou de réaliste.

Le modèle est gratuit, mais les utilisateurs gratuits sont limités à neuf images gratuites à la fois par minute. Vous pouvez vous abonner à leurs niveaux Supporter ou Professional (au prix de 5 $ et 20 $ par mois, respectivement, et facturés annuellement) pour ne pas avoir de publicités ni de filigranes, une génération plus rapide et la possibilité de garder vos images générées privées. Un niveau d’abonnement personnalisé permet également des modèles personnalisés, l’intégration, une assistance dédiée et des serveurs privés.

2Diffusion stable 1,5

Stable Diffusion est peut-être l’un des modèles de génération de texte en image open source les plus populaires. Il alimente également d’autres modèles, notamment les trois générateurs d’images mentionnés ci-dessous. Il est sorti en 2022 et a connu de nombreuses implémentations depuis.

interface utilisateur web à diffusion stable

Je vous épargnerai les détails trop techniques du fonctionnement du modèle (pour lesquels vous pouvez consulter leur dépôt Github officiel), mais le modèle est facile à installer même pour les débutants complets et fonctionne bien tant que vous disposez d’un GPU dédié avec au moins 4 Go de mémoire. Vous pouvez également accéder à Stable Diffusion en ligne, et nous avons ce qu’il vous faut si vous souhaitez exécuter Stable Diffusion sur un Mac.

Il existe plusieurs points de contrôle (considérez-les comme des versions) disponibles pour Stable Diffusion. Bien que nous ayons testé la version 1.5, la version 2.1 est également en cours de développement et est plus précise.

image générée par dreamshaper-ai

L’exécution du modèle est également assez simple. Nous l’avons testé avec l’interface utilisateur Web AUTOMATIC1111 Stable Diffusion, et tous les contrôles et paramètres fonctionnent bien. Il est également assez résistant aux NSFW grâce à la base de données LAION-5B sur laquelle le modèle s’est entraîné (même si elle n’est pas parfaite, attention). Bien que le temps de génération lui-même varie en fonction de votre matériel, vous pouvez vous attendre à ce que vos images soient détaillées et réalistes même avec des invites de base.

3Façonneur de rêves

DreamShaper est un modèle de génération d’images basé sur la diffusion stable. Il a été conçu comme une alternative open source à MidJourney et se concentre sur le photoréalisme dans les images générées, bien qu’il puisse tout aussi bien gérer les styles d’anime et de peinture avec quelques ajustements.

Le modèle est plus performant que Stable Diffusion, ce qui permet aux utilisateurs plus de liberté sur le résultat final, allant des améliorations rapides aux restrictions NSFW plus souples. L’exécution du modèle est également facile, avec une version téléchargeable et pré-entraînée disponible en ligne pour un accès local et une multitude de sites Web, notamment Sinkin.ai, RandomSeed et Mage.space (nécessite un abonnement de base) qui vous permettent d’exécuter le modèle avec l’accélération GPU.

comparaison de dreamshaper-stablediffusion

Comme vous pouvez probablement le deviner, les images générées par DreamShaper ont tendance à paraître plus réalistes que celles générées par Stable Diffusion. Même si vous exécutez la même invite sur les deux modèles, le modèle DreamShaper sera probablement plus réaliste, détaillé et mieux éclairé.

C’est particulièrement vrai pour les portraits ou les personnages, ce qui me semble manquer à Stable Diffusion par rapport au même message. Si vos images deviennent trop réalistes, voici quatre façons d’identifier une image générée par l’IA.

Vous n’avez pas non plus besoin d’un PC géant pour exécuter le modèle. Ma GTX 1650Ti avec 4 Go de VRAM a parfaitement exécuté le modèle. Le temps de génération a été un peu plus long, mais cela ne semble pas affecter le résultat réel. Cela dit, vous aurez peut-être besoin de GPU avec plus de VRAM pour exécuter DreamShaper XL, qui est basé sur le modèle Stable Diffusion XL.

4Invoquer l’IA

Invoke AI est un autre modèle de génération d’images basé sur l’IA et basé sur Stable Diffusion, avec une version XL basée sur Stable Diffusion XL. Il dispose également de sa propre interface utilisateur Web et de ligne de commande, ce qui signifie que vous n’aurez pas à vous soucier de choses comme l’interface utilisateur Web de Stable Diffusion.

invokeai-interface-utilisateur-avec-image

Le modèle permet aux utilisateurs de créer des visuels basés sur leur propriété intellectuelle avec des flux de travail personnalisés. InvokeAI est l’un des meilleurs modèles de génération d’images IA open source pour la formation de modèles personnalisés et le travail avec la propriété intellectuelle.

Son référentiel Github officiel répertorie deux méthodes d’installation : l’installation via le programme d’installation d’InvokeAI ou l’utilisation de PyPI si vous êtes à l’aise avec un terminal et Python et avez besoin de plus de contrôle sur les packages installés avec le modèle.

Cependant, ce contrôle supplémentaire entraîne quelques limitations, notamment des exigences matérielles plus strictes. InvokeAI recommande un GPU dédié avec au moins 4 Go de mémoire, avec six à huit Go recommandés pour exécuter la variante XL. Les exigences en matière de VRAM s’appliquent aux GPU AMD et Nvidia. Vous aurez également besoin d’au moins 12 Go de RAM et de 12 Go d’espace disque libre pour le modèle, ses dépendances et Python.

invoquer-l'image-générée-par-l'IA

Bien que la documentation ne recommande pas les GPU Nvidia GTX 10 et 16 en raison de leur manque de mémoire vidéo, le programme d’installation fourni a fonctionné parfaitement. Bien que votre kilométrage puisse varier, si vous utilisez un GPU bas de gamme, attendez-vous à attendre plus longtemps pour voir vos invites se transformer en images. Enfin, si vous utilisez Windows, vous ne pouvez utiliser qu’un GPU Nvidia, car il n’existe actuellement aucune prise en charge des GPU AMD.

Pour la partie génération d’images, le modèle a tendance à pencher davantage vers les styles artistiques que vers le photoréalisme. Bien sûr, vous pouvez entraîner le modèle sur votre ensemble de données et lui faire générer des images plus proches de ce que vous voulez, même si cela implique des images photoréalistes, surtout si vous travaillez dans la conception de produits, l’architecture ou les espaces de vente au détail. Cependant, il est important de garder à l’esprit qu’InvokeAI est avant tout un moteur de génération d’images, ce qui signifie que vous devrez probablement utiliser vos propres modèles pour obtenir les meilleurs résultats (facilement trouvés via le gestionnaire de modèles fourni dans l’interface Web) car le modèle par défaut est assez similaire à Stable Diffusion lui-même.

5Voyage ouvert

Openjourney est un modèle de génération d’images d’IA gratuit et open source basé une fois de plus sur la diffusion stable. Si vous vous demandez pourquoi le modèle s’appelle Openjourney, c’est parce qu’il a été formé sur des images Midjourney et peut imiter son style dans les images qu’il génère.

PromptHero, la société à l’origine d’Openjourney, vous permet de tester le modèle aux côtés d’autres modèles, notamment Stable Diffusion (versions 1.5 et 2), DreamShaper et Realistic Vision. Lors de votre inscription, vous obtenez 25 crédits gratuits (un crédit pour chaque image générée), après quoi vous devez vous abonner à leur abonnement Pro, qui coûte 9 $ par mois et vous donne accès à 300 crédits chaque mois avec d’autres fonctionnalités exclusives.

comparaison openjourney-stablediffusion

Cependant, si vous souhaitez l’exécuter localement et gratuitement, vous pouvez télécharger le fichier modèle depuis HuggingFace et l’exécuter à l’aide de l’interface utilisateur Web de Stable Diffusion. Openjourney est également le deuxième modèle de génération d’images IA le plus téléchargé sur HuggingFace, juste derrière Stable Diffusion.

Openjourney ne répertorie aucune configuration matérielle spécifique pour exécuter le modèle localement sur son site Web, mais vous pouvez vous attendre à des exigences matérielles similaires à celles de Stable Diffusion. Cela signifie un GPU dédié avec 4 Go de VRAM, 16 Go de RAM et environ 12 à 15 Go d’espace libre sur votre ordinateur pour enregistrer le modèle et ses dépendances.

image générée par openjourney-ai

Les images générées par Openjourney ont tendance à être équilibrées entre le photoréalisme et l’art, sauf indication contraire. Si vous recherchez un modèle polyvalent et préférez l’apparence et la convivialité de Midjourney sans payer d’abonnement, Openjourney est l’une des meilleures options.

Soutenez notre effort ❤️

Si vous avez apprécié cet article, pensez à laisser un pourboire pour nous aider à continuer à publier du contenu de qualité.

Paiement sécurisé sur PayPal
Voir aussi:  Comment l'IA ruine l'observation des oiseaux : risques pour la faune et les amateurs
Moyens I/O Staff est une équipe de rédacteurs spécialisés, passionnés par la technologie, l’innovation et les usages numériques. Forts d’une expertise pointue en IA, applications mobiles, gaming et tendances digitales, nous produisons un contenu rigoureux, vérifié et utile. Notre mission : vous offrir une information fiable et claire pour mieux naviguer dans le monde numérique en constante évolution. Découvrez les avis de nos lecteurs sur Trustpilot.