Résumé rapide : SoulGen ne divulgue pas publiquement l'architecture spécifique du modèle d'IA qui sous-tend sa plateforme de génération d'images et de vidéos. L'outil semble utiliser des modèles propriétaires basés sur la diffusion, optimisés pour la création de personnages, avec des capacités allant de la conversion de texte en image à celle d'image en vidéo, en passant par l'animation avec synchronisation labiale. SoulGen détient actuellement environ 5% du marché de la génération d’images par IA, se positionnant ainsi comme un acteur spécialisé aux côtés de leaders du secteur tels que DALL-E, Midjourney et Stable Diffusion.
Le secteur de la génération d'images par IA a connu une croissance fulgurante ces dernières années. SoulGen s'est taillé une place de choix en tant qu'outil spécialisé dans la création de personnages et la génération de vidéos. Mais comment cela fonctionne-t-il réellement en coulisses ?
Contrairement à des acteurs majeurs tels qu’OpenAI ou Stability AI, SoulGen n’a pas publié d’articles techniques détaillés sur l’architecture de son modèle. Beaucoup se demandent donc quelle technologie se cache exactement derrière cette plateforme.
(suite...)








