Jour 6 : analyse des outils nécessaires

 Je continue à recenser les IA pour ne pas rester dans Midjourney/StableDiffusion ainsi que RunwayML/Pika et notamment j'ai trouvé plusieurs agrégateur de modèles génératifs assez intéressant. Par exemple un qui est capable de proposer du Seedream4 ainsi que du Seedance1 donc le modèle génératif chinois que je trouve vraiment bon et qui est super bien classé dans les LLMArena. Mais qui propose en plus du NanoBanana avec Veo3, ainsi que ceux qui m'intéressent : Kling pour la vidéo qui est pas mal mon best, ainsi que Flux pour les images. Tout ça pour un prix d'ami. Par exemple, j'ai calculé pour la phase d'exploration/initiation, ça me coûterait 91cad/m disons sur 2 mois alors que si je prends un agrégateur en faisant joujou avec le meilleur de tous les modèles… 83cad/m. 10% de moins certes. Mais en phase de formation, c'est tout de suite plus intéressant : 139$ pour travailler comme il faut contre 115$, 24$ de mieux. Encore plus flagrant si on rajoute les options en phase de formation : 198$ contre 275$ ! Bref, ça a l'air intéressant de se frotter aux meilleurs modèles images et vidéos à partir d'un agrégateur, mais j'ai un peu peur de me disperser et de tester comme un fou le même prompt sur plusieurs modèles au lieu d'améliorer le mien sur un seul modèle.

C'est drôle, il y a un article qui vient de paraître sur BDM. Ca touche directement mon métier et ce que je fais en ce moment. C'est un réalisateur IA français, que je découvre et qui explique le pipeline que j'explore depuis un mois (à peu près), non seulement pour bâtir un prompt à partir de ChatGPT mais aussi de générer des images Midjourney pour le faire tourner dans RunwayML, et d'utiliser les voix de ElevenLabs avec de la musique Suno pour terminer sur de l'upscaling TopazAI. J'ai quand même découvert Producer (je suis inscrit sur la liste d'attente) ainsi que pléthore d'agrégateur, justement !

Commentaires

Posts les plus consultés de ce blog

Jour 1 !

Jour 2...

Jour 3