La possibilité de conserver des personnages cohérents ou un style cohérent d'images en images est l'une des problématiques principales des utilisateurs d'IA génératives d'images. Les créateurs de ces IA travaillent d'arrache-pied à développer des solutions.
Depuis la sortie du manuel, des nouveautés importantes ont vu le jour.
1) Style Tuner (Midjourney)
Les Style Tuner permettent de construire une « graine de style » à partir de quelques images générées. Cette graine peut ensuite être utilisée dans les prompts grâce au paramètre « –style » pour guider la génération et obtenir un style proche.
Pour en savoir plus sur les Style Tuner, découvrez la documentation officielle de Midjourney.
2) Style Reference (Midjourney et Leonardo)
La Style Reference permet d'intégrer au prompt une ou plusieurs images de référence dont le style sera extrait et répliqué dans l'image générée. Contrairement aux techniques classiques d'image-to-image consistant à intégrer directement une image au prompt pour servir d'inspiration globale (style, posture, composition…), la Style Reference permet d'intégrer une image au prompt pour servir d'inspiration de style uniquement. Le résultat est beaucoup plus précis qu'avec l'image-to-image classique.
Sur Midjourney la Style Reference fonctionne via deux nouveaux paramètres : –sref et –sw
Sur Leonardo, elle peut être activée depuis l'onglet « Image Guidance », en version premium uniquement.
3) Character Reference (Midjourney)
La Character Reference permet d'intégrer au prompt une image de référence contenant un personnage qui sera réutilisé dans l'image générée. Cela permet de conserver un même personnage sur plusieurs images !
La Character Reference fonctionne via deux nouveaux paramètres : –cref et –cw
La Character Reference et la Style Reference peuvent être combinées.