Passer au playerPasser au contenu principal
  • il y a 5 semaines
Meta sort son générateur d'Image et Vidéo IA, et il est performant.

Catégorie

🤖
Technologie
Transcription
00:00Une surprise de taille, Meta lance son nouveau modèle image et vidéo, Muse.
00:05Et je dois dire, je ne m'attendais à rien, mais il est plutôt impressionnant.
00:08Un modèle image qui se classe parmi les premiers dans différents benchmarks.
00:12Alors comme d'hab, les benchmarks, on s'en fout un peu,
00:15mais ici on peut voir qu'ils se classent deuxième,
00:17que ce soit dans le mode image to video,
00:19ou dans le mode édition simple ou multi-édition.
00:23Donc j'ai commencé à faire mes tests et je comprends la petite hype qu'il y a dessus,
00:27d'autant qu'il a un accès 100% gratuit,
00:30et on va voir tout ça ensemble.
00:32Pour pouvoir utiliser ce nouveau modèle image,
00:35il faudra se rendre sur Meta.ai en se connectant avec un compte Facebook.
00:39C'est simple, si tu as déjà un compte Facebook,
00:42tu as l'accès à Meta.ai sur ta page d'accueil tout de suite sur la gauche.
00:46Puis une fois connecté, ici, tu vas pouvoir rentrer les instructions,
00:50que ce soit des prompts, mais aussi des entrées références en termes d'images.
00:54Deux configurations seront possibles.
00:56Une réponse instantanée et une réponse en réflexion,
01:00puisque ce modèle image IA, c'est un modèle agentique,
01:04et donc qui va réfléchir.
01:05Que ce soit pour te proposer plusieurs générations,
01:08les modifier, mais aussi faire appel aux recherches web,
01:11pour pouvoir compléter ton image.
01:13Un exemple vaut mieux que 1000 mots.
01:15Donc là, on a le mode réflexion,
01:16et on va demander, génère une image d'un homme dans un stade de foot,
01:21supporter de l'équipe de France,
01:23pour la finale de la Coupe du Monde contre l'Angleterre.
01:27Et on peut préciser le format.
01:29Ici, on va mettre 16 neuvième style réaliste.
01:33Et ce qu'on va voir, c'est que ici,
01:34l'agent va travailler en réflexion,
01:36en te disant exactement ce qu'il va faire étape par étape,
01:40avant de te générer l'image.
01:41La finalisation se fait,
01:43et nous avons notre image.
01:44Comme on peut voir, c'est assez correct.
01:47Ce qui est impressionnant, c'est qu'au niveau du texte,
01:49avant Meta était un petit peu à la ramasse.
01:51Maintenant, on a une intention particulière à ceci.
01:54Et nous allons pouvoir, dans notre fil de conversation,
01:58changer notre image,
01:59que ce soit avec les suggestions,
02:01en dessinant des annotations.
02:02Par exemple ici, hop,
02:04on va demander de supprimer l'écusson
02:06pour pouvoir éditer notre image
02:09au fil de la conversation avec l'agent de Meta.
02:13Comme on peut voir ici,
02:14l'écusson a été supprimé.
02:16Donc rapidement, tu vois,
02:17la génération texte ou image est assez cool,
02:20d'un bon niveau avec beaucoup de précision.
02:22Ça fera toujours un petit peu IA.
02:24Mais on va voir à travers les tests que j'ai fait,
02:26les surprises que nous réserve Muse
02:27et les performances qui n'ont rien à envier
02:30aux autres modèles images IA.
02:32D'abord, bien sûr, ici,
02:33le Créer une image est mis en avant.
02:35Mais nous pouvons aussi utiliser
02:37les autres modèles de Meta IA
02:40pour pouvoir générer du texte
02:41ou alors analyser un document.
02:43Ici, on restera bien sûr sur Créer une image.
02:46Et on voit qu'on a des suggestions,
02:48un petit peu comme on a sur Nano, Banana
02:49et ChatGPT,
02:51pour pouvoir, par exemple,
02:52créer son personnage en Claymation.
02:53Ici, il suffira d'importer une image
02:55ou de sélectionner parmi notre bibliothèque d'images
02:58pour, en un clic,
03:00transformer une photo dans le style qu'on souhaite.
03:02Ici, ça sera sur le style Claymation.
03:04Et comme on peut voir,
03:05l'IA fonctionne en plusieurs étapes
03:07avant de nous proposer l'image la plus parfaite
03:09et la plus proche de ce qu'on avait demandé.
03:12Maintenant, on va aller en profondeur dans les tests.
03:14Tout d'abord, je lui ai fait passer
03:15l'épreuve classique du verre de vin
03:18rempli à ras-bord
03:19et de l'horloge qui indique la bonne heure.
03:21Et ici, si le verre de vin est quasiment rempli,
03:24l'horloge indique bien 13h15,
03:26mais au niveau des aiguilles,
03:28il y a un petit souci.
03:29Pas grave, dans la conversation,
03:30je lui dis qu'il y a une aiguille de trop sur l'horloge,
03:34mais malgré le fait que l'agent confirme son erreur,
03:38il n'arrive pas à supprimer l'aiguille sur le 10.
03:41Au bout d'un moment,
03:42il n'arrive pas à créer ce que je veux,
03:44mais il me propose une solution.
03:45Et là, il me dit,
03:46on n'a qu'à passer en digital 13h15.
03:49Et comme ceci,
03:50il arrive parfaitement à indiquer l'heure.
03:52On continue le test en lui demandant
03:54que le verre de vin n'est pas rempli à ras-bord
03:57et du coup, s'il pouvait le re-remplir.
03:59Alors, on voit que là,
04:01ça a légèrement augmenté.
04:02Je lui demande encore plus,
04:03mais il n'y arrive pas.
04:04Par contre, après,
04:05quand je lui dis,
04:06fais en sorte que ça déborde,
04:07il a réussi à me le remplir à ras-bord
04:10avec l'effet du vin qui déborde du verre.
04:12Maintenant, ce test passé,
04:14on va tester la multi-entrée
04:16et voir comment l'agent se comporte.
04:19Sachant qu'à travers les différents exemples mis en avant,
04:22un particulièrement attire mon attention,
04:24c'est le fait de tester sa compréhension
04:26avec une multi-entrée et des promptes simples.
04:30Je vais donc ici lui demander de créer dans un style.
04:33Et je vais rentrer l'image de mon style.
04:36Donc, je n'aurai qu'à la déposer juste ici
04:38pour qu'elle s'enregistre dans mes médias méta IA.
04:40Je vais dire de mettre en scène le personnage suivant.
04:45Et pareil, je vais dans mon petit plus.
04:47Pour pouvoir ici importer le personnage
04:49ou le sélectionner dans mes médias,
04:50je continue en disant dans l'action suivante
04:53pour reproduire la pose.
04:56Et je vais rentrer ici une image de danseuse.
05:00Je lance ma requête.
05:01L'agent réfléchit et me propose ainsi,
05:04dans le bon style avec le bon personnage
05:06et la bonne pose,
05:07le visuel suivant.
05:09Je vais pouvoir continuer mes modifications.
05:11Par exemple, en lui demandant,
05:13mais lui, plutôt des baskets.
05:15Et ma modification a été faite.
05:17Ce que je trouve pas mal
05:19par rapport au modèle de chat GPT image,
05:22c'est qu'on n'a pas trop de pertes,
05:24même si on peut voir que sur la droite,
05:26eh bien, on a quand même
05:27le panneau de la boutique qui change.
05:29Mais en termes de qualité,
05:30on n'a pas une image qui s'assombrit.
05:32On va essayer maintenant
05:33de challenger sa créativité
05:35et son mode texte.
05:36Ici, je lui ai uploadé une photo du Ciao
05:39pour demander une affiche publicitaire
05:41avec le prix.
05:42Alors, la première fois,
05:43il me l'a fait en anglais.
05:45Donc, je lui ai demandé
05:45de traduire en français.
05:47Et le problème,
05:48c'est qu'il ne voulait pas
05:49me reprendre le Ciao.
05:51Et il avait donc marqué Ono.
05:52Pas de souci.
05:53Je lui ai demandé de changer
05:54le Ono en Ciao.
05:56Je me suis trompé.
05:57J'ai oublié un A.
05:58Mais ce qui est assez fort,
06:00c'est que non seulement
06:00il m'a bien mis le CEO
06:02ici et ici,
06:04mais il m'a aussi changé le packaging.
06:05Par contre,
06:06en ce qui est de la créativité,
06:08ça fait peut-être moins IA
06:09que ChatGPT,
06:09mais on est plus sur un slide présentation
06:12qu'une publicité.
06:13On va essayer pour voir,
06:14pour challenger encore sa créativité,
06:16de nous proposer une affiche A4
06:18pour la fête de la musique à Marseille.
06:20C'est intéressant de voir
06:21ce qu'il va nous pondre
06:22par rapport aux affiches
06:24qu'on est en train de voir partout
06:25faites avec ChatGPT
06:26pour voir si on a aussi
06:28cette touche IA flagrante.
06:30Et ce qu'on voit,
06:31c'est que l'agent
06:32recherche les images de Marseille.
06:33Par exemple,
06:34ici, il est en train
06:34de parcourir les images
06:36du vieux port
06:36pour pouvoir constituer son affiche.
06:38Donc ça, c'est intéressant.
06:40Et proposer peut-être
06:41quelque chose
06:41qui fait un petit peu moins
06:43de ChatGPT.
06:43En tout cas,
06:44il a pris le pari
06:45de proposer un style unique.
06:47Bon, même si je n'aime pas trop
06:49la typographie,
06:50je pourrais demander,
06:50pourquoi pas,
06:51de changer le style
06:53plus illustration.
06:56Et donc là,
06:56bon, il ne m'a pas changé
06:57le visuel,
06:57mais il m'a fait un style
06:58un petit peu plus illustration
07:00en rajoutant les notes de musique,
07:01en mettant un coup de crayon.
07:03Mais je n'aime toujours pas
07:04la typo,
07:05mais ce que je peux faire,
07:06c'est utiliser un autre outil
07:07qui est très utile
07:08pour pouvoir faire
07:09les modifications.
07:10C'est Canva
07:11avec l'outil sur l'accueil
07:12du calque magique
07:13qui permet,
07:14en important une image,
07:16de l'ouvrir dans un éditeur
07:18et de lancer automatiquement
07:20dans le menu modifié
07:21l'outil calque magique.
07:22Pour pouvoir séparer
07:24l'ensemble des éléments
07:25et ainsi replacer le tout
07:27ou même changer la police
07:29si on le souhaite.
07:32Autre test,
07:33j'ai essayé à partir
07:34de la photo
07:35de Mark Zuckerberg
07:36de créer la miniature
07:37pour cette vidéo
07:38en donnant la consigne
07:40à partir de cette vidéo,
07:41à partir de cette photo,
07:42créez-moi une miniature YouTube
07:43pour dire que le modèle
07:45Muse image vidéo
07:46de Meta est arrivé.
07:47Donc la première génération
07:49n'était pas top,
07:50je lui ai demandé
07:50des modifications,
07:51mais il m'a censuré
07:53le fait que je voulais
07:53lui faire manger une banane
07:55pour dire qu'il était supérieur
07:56à Nano Banana.
07:58Donc j'ai quand même réussi
07:59à lui faire des petites lunettes
08:01de soleil
08:02et puis ensuite après
08:03lui faire écraser une banane.
08:05Donc si les résultats
08:06sont pas mal,
08:07je trouve quand même
08:07qu'on a plus de possibilités
08:09sur ChatGPT Images
08:10sur la modification
08:12et le côté créatif
08:14par rapport aux éléments
08:15qu'on va donner.
08:15Donc ça,
08:16c'était pour le côté créativité,
08:17mais qu'en est-il
08:18du côté technique ?
08:20Pour cela,
08:20deux tests avec
08:21une photo originale
08:22de Paris.
08:23Je voulais que Muse
08:24transforme cette image
08:25en Paris des années 1970
08:26et le résultat
08:28est plutôt pas mal.
08:29Même si en zoom,
08:30on voit que la qualité,
08:32on a du mal
08:33d'être au rendez-vous,
08:33mais en tout cas,
08:34tous les éléments,
08:35que ce soit la voiture,
08:36le look des personnages
08:37ou le nom des brasseries,
08:40ça rend plutôt pas mal.
08:41Et après,
08:41j'ai continué dans mon prompt
08:42en demandant que l'image
08:44soit de nuit.
08:45Et là,
08:46même si le prompt
08:47est très bien respecté,
08:48on voit que déjà,
08:50les personnages
08:50commencent à faire
08:51plus illustration
08:53que photo réelle.
08:54Ensuite,
08:55j'ai demandé
08:56de changer le temps
08:56comme s'il pleuvait.
08:57Pareil,
08:58les consignes sont
08:59super bien respectées
09:00avec l'ajout des parapluies,
09:02l'ajout du K-Way
09:03du cycliste
09:04qui est juste ici.
09:05Et après,
09:06j'ai essayé de demander
09:07quand même si
09:08Meta pouvait
09:09m'upscaler la photo.
09:10Alors,
09:11j'ai un très léger
09:12changement sur la qualité,
09:13mais ça reste quand même
09:14très IA.
09:15Et en termes de qualité,
09:16eh bien,
09:16on a beaucoup perdu
09:17par rapport
09:18à la photo originale.
09:20En tout cas,
09:20sur une première génération,
09:22ça faisait le travail.
09:23Côté performance,
09:24j'ai voulu aussi voir
09:25comment justement
09:26il pouvait améliorer
09:27une image floue.
09:28Donc,
09:29je suis parti du même
09:29du chat ici,
09:31très très flou,
09:31en demandant
09:32de l'upscaler.
09:33Et l'upscaler
09:34est assez sympa.
09:35On peut voir
09:36la différence
09:36entre l'image 1
09:37et l'image 2
09:38en termes de netteté,
09:39tout en me préservant
09:41l'aspect original
09:42du même.
09:43Assez sympa.
09:44J'ai demandé
09:44s'il pouvait
09:45m'upscaler
09:45un petit peu
09:46plus supplémentaire,
09:47mais on voit
09:47qu'il n'y a pas
09:48trop de modifications.
09:49Une fois qu'il a l'upscaler,
09:50on arrive au max.
09:51Mais je suis quand même
09:52agréablement surprise
09:53de la performance
09:54de Muse.
09:55Dernier test
09:56pour savoir
09:56si le caractère référence
09:58fonctionne bien.
09:59Ici,
10:00je lui ai donné
10:01une fiche détail
10:02et personnage
10:03pour pouvoir créer
10:04une image
10:04avec celui-ci.
10:05Le marchand ici,
10:07dans un style 2D
10:08qui se balade
10:09avec sa carriole
10:10d'objet
10:11et la consigne
10:12a été respectée
10:13avec le marchand
10:15qui a été repris.
10:16Par contre,
10:16au niveau des détails
10:17de la veste,
10:18ça pêche un petit peu,
10:20mais sinon,
10:20la qualité de l'image
10:21est quand même
10:22assez sympa.
10:23Donc,
10:23bon point ici
10:24pour le modèle
10:25de Meta Muse.
10:27Un modèle donc
10:27déjà disponible
10:28sur Meta.ai
10:30pour nous
10:30et même
10:31en accès direct
10:32sur Instagram
10:33ou WhatsApp
10:34pour d'autres pays
10:35comme par exemple
10:35les Etats-Unis.
10:36Donc,
10:37ça devrait bientôt
10:37arriver chez nous.
10:39L'intégration
10:39sur Instagram,
10:41ça a l'air de se trouver
10:41dans l'ensemble
10:42des filtres,
10:43ce qui permettra
10:44de réaliser
10:45des effets
10:46IA à partir
10:47de ces stories
10:48Instagram.
10:49Et pour WhatsApp,
10:50la même chose,
10:50la possibilité
10:51de transformer directement
10:52les photos
10:53qu'on enverra
10:54sur WhatsApp
10:54avec Muse de Meta
10:56pour pouvoir
10:57les réimaginer
10:59avec l'IA.
11:00Et ce n'est pas tout
11:00car en parallèle
11:02du lancement
11:02de Muse Image,
11:04Meta annonce
11:05Muse Video.
11:06On sera sur la génération
11:07de vidéos
11:08avec du son
11:09mais à mon avis,
11:10c'est un modèle
11:11qui sera très proche
11:11de VO3
11:13en termes de qualité
11:14que ce soit au niveau
11:14de la vidéo
11:15ou au niveau sonore
11:17avec quand même
11:18des exemples
11:18assez sympas.
11:19Donc,
11:19hâte de découvrir ça
11:21et on en fera bien sûr
11:22une vidéo
11:22sur le Labo des Réseaux
11:23dès qu'il sortira.
11:25En attendant,
11:25tu peux toujours
11:26tester Vibe
11:27disponible seulement
11:28sur mobile
11:29sur ton application
11:29Meta AI
11:30qui te permet
11:31de créer
11:32des formats
11:33verticaux
11:34avec l'IA
11:34de Meta
11:35et de publier
11:36dans un feed dédié
11:37un petit peu
11:37comme ce que Sora
11:39proposait avant.
11:40J'ai fait une vidéo
11:41sur le sujet,
11:41n'hésite pas à aller la voir.
11:42Et si tu es intéressé
11:43par l'IA,
11:44par les réseaux sociaux
11:45et par la création
11:46de contenu,
11:46n'hésite pas aussi
11:47à parcourir
11:48l'ensemble des vidéos
11:48de la chaîne.
11:49C'était Marco
11:50et je te dis
11:51à très bientôt
11:51sur le Labo des Réseaux
11:52pour d'autres vidéos.
11:53Sous-titrage Société Radio-Canada
Commentaires
Labo Des Réseaux
Créateur
Muse Meta AI en gratuit

Recommandations