Shengshu Technologies a annoncé aujourd'hui que la fonction de génération d'images à partir de références de Vidu, son modèle vidéo, est désormais accessible aux utilisateurs du grand public. Cette mise en service vise à surmonter les contraintes techniques de la cohérence entre plusieurs sujets, à fermer la chaîne de production commerciale de la génération d'images et de vidéos par l'IA, et à faire entrer la création multimodale par l'IA dans une nouvelle phase.

QQ20250909-142106.png

Le lancement de la fonction de génération d'images à partir de références de Vidu Q1 repose sur « cinq atouts majeurs ». Tout d'abord, il permet d'entrer jusqu'à 7 images de référence en même temps, ce qui améliore significativement le contrôle pendant le processus de création. Ensuite, Vidu Q1 démontre une meilleure cohérence dans la génération de scènes multiples et de sujets multiples. Quel que soit le nombre de générations, les visages et les caractéristiques des personnages et des sujets restent constants, assurant ainsi un haut niveau de fidélité et de réalisme. De plus, l'utilisateur n'a besoin que d'une seule image et d'un seul mot-clé pour changer librement les vêtements et le fond, permettant ainsi une création à haute liberté.

Shengshu Technologies affirme que l'ère des multiples images de référence avec Vidu Q1 marque une grande avancée technique en matière de cohérence, permettant aux utilisateurs de créer de manière flexible dans des scénarios complexes et renforçant le réalisme et l'applicabilité de la génération d'images. Les outils de création par IA d'avant étaient principalement orientés vers l'inspiration, tandis que Vidu Q1 étend le rôle de l'IA à celui de principal acteur de la production de contenu. L'utilisateur n'a qu'à superviser, ce qui réduit considérablement le seuil de production de contenu.

QQ20250909-142136.png

Dans les applications concrètes, Vidu Q1 propose trois modes de génération : la synthèse, le remplacement et la transformation. Par exemple, les utilisateurs peuvent synthétiser différents personnages dans une même scène ou remplacer le fond d'une photo existante par une nouvelle scène, afin de générer facilement du contenu personnalisé. De plus, cet outil a un grand potentiel d'application dans les domaines de la conception de vêtements, de la publicité et du marketing créatif, pouvant aider les designers et les e-commerçants à produire rapidement des matériaux de haute qualité.

La dernière innovation de Shengshu Technologies marque un nouveau jalon dans l'application commerciale des outils de génération d'images par l'IA. L'entreprise espère que cette technologie avancée encouragera davantage d'entreprises et d'utilisateurs individuels à entrer dans une nouvelle ère de création multimodale, et réaliser véritablement l'objectif de l'IA de stimuler la productivité.