Salut les projectionnistes du futur, bienvenue dans cette 164e édition de GENERATIVE, la newsletter qui surfe sur le raz de marée de l’actualité image, vidéo et son. Cette semaine, Reve génère en 4K, Bytedance sort Seedream 5.0 Pro, Kling se connecte via MCP et Runway ouvre son accès aux dev . Sans oublier ElevenLabs qui promet de transférer l’émotion des acteurs dans le doublage.
Si vous ne deviez retenir que 3 infos cette semaine :
Midjourney sort la preview de la version 8.2 avec des améliorations mineures
Reve 2.1 génère en 4K
Runway Dev donne accès à tous ses modèles en API via une plateforme unique de niveau entreprise
Let’s go !
Si tu es nouveau par ici, je suis Gilles Guerraz, réalisateur publicitaire devenu expert en outils créatifs GEN AI. J’ai fondé NEXTREND, organisme de formation spécialisé en outils créa IA et BANGGER, société de production audiovisuelle IA et hybride.
Avec Caroline Thireau (AI Creative Technologist), nous te proposons une plongée hebdomadaire dans la marmite bouillonnante de l’actualité de l’IA générative !
Si on t’a transféré cette lettre, abonne-toi en un clic ici.
Ma prochaine session de formation CPF aura lieu à Paris les 10 et 11 septembre prochains ! Je vous remets la video du mois d’avril, mais les dates seront bien les 10 et 11 septembre 2026 !
Si ce n’est pas déjà fait, tu peux aussi :
Découvrir mes formations IA pour les créateurs, 100% finançables par le CPF. Les inscriptions se font ici.
Former tes équipes à l’IA générative grâce à nos formations entreprise finançables par ton OPCO
Nous contacter directement pour discuter de ton projet IA générative
Me suivre sur LinkedIn, YouTube ou TikTok pour ne rien rater.
🔹 ElevenLabs lance Dubbing v2 avec “transfert d’émotion”
ElevenLabs lance Dubbing v2, une nouvelle version de son moteur de doublage automatique. La promesse cette fois : transférer non seulement la voix, mais aussi l’émotion et le jeu de l’acteur original dans chaque langue cible. Sur le papier, c’est intrigant. “Une émotion peut-elle être synthétique ?” Vous avez deux heures…
🔹 Midjourney preview V8.2 et améliore la cohérence stylistique
Midjourney annonce deux petites mises à jour côté image. D’abord, l’option `--preview` permet désormais d’avoir un aperçu des esthétiques de la future V8.2 ainsi que de ses fonctions de personnalisation. Ensuite, le mode Draft en batch est maintenant compatible avec `--sref random`, ce qui permettrait d’explorer l’espace des styles “24 fois plus vite qu’avant” selon leurs équipes. Disponible dès maintenant, à tester par ici.
Nore avis : le combo `--sref random` + Draft batch est potentiellement très utile pour le moodboarding rapide, à voir si la cohérence des styles générés suit. Pour `--preview`, c’est surtout une façon d’alimenter l’impatience autour de la V8.2 avant sa sortie officielle.
🔹 Seedream 5.0 Pro
Bytedance sort Seedream 5.0 Pro, modèle de génération d’image qui progresse sur les infographies, le texte multilingue et la composition spatiale. Les zones à modifier se sélectionnent par point, lasso, cadre ou croquis. Ce nouveau modèle peut aussi décomposer une affiche en plus de dix calques transparents.
Avec sa fonctionnalité Edit, on est content de savoir qu’il est déjà intégré dans la plupart des aggrégateurs et disponible sous Capcut et Dreamina bien sûr.
Avis de Caro : encore quelques faiblesses sur les petits textes et les retouches très précises pour ce nouveau modèle de Bytedance, qui reste assez bluffant de réalisme comme vous pouvez le voir ci-dessus.
Avis de Gilles : encore un peu trop saturé et contrasté à mon goût sur les rendus photoréalistes.
🔹 Reve 2.1 en 4K
Reve 2.1 progresse sur la compréhension des intentions, les visuels marketing, les personnages et le texte multilingue. L’image est organisée en zones hiérarchisées qui peuvent être retravaillées séparément avec une sortie possible en 4K natif, 16 mégapixels. Reve affirme aussi avoir entraîné le modèle avec moins d’un dixième des ressources utilisées par certains laboratoires concurrents.
Avis de Caro : Un agent qui a une bonne adhérence au prompt, l’avantage du layout control, d’une maîtrise sur le texte et de sortie en 4K, mais qui reste moins performant sur l’edit qu’un GPT selon moi.
Avis de Gilles : pour ma part très fan du rendu éditorial de Reve. Son interface agentique simplifie toutes les interactions, très agréable à l’usage.
🔹 Meta Muse Image
Considéré comme le concurrent du modèle juste au dessus, Muse Image recherche du contexte, exécute du code et révise ses brouillons avant le rendu final. Meta met en avant la lisibilité du texte, la précision des graphiques et la génération de QR codes fonctionnels. L’utilisation de visages provenant de comptes Instagram publics pose toutefois la question du consentement. Muse Video reste en preview, avec des limites sur la synchronisation et les mouvements rapides.
🔹 Kling MCP, CLI et Agent
Kling publie un serveur MCP et un outil en ligne de commande pour lancer des générations image et vidéo depuis Claude, Cursor, ComfyUI ou des scripts. Seuls les crédits payants du workspace personnel peuvent être utilisés. La limite est fixée à cinq requêtes par seconde et les fichiers restent disponibles pendant 24 heures.
🔹 Runway renforce son écosystème de production
Runway Dev centralise ses modèles d’image, vidéo, audio et personnages dans une même API, avec des Recipes prêtes à l’emploi et des Workflows privés pour construire ses propres chaînes. Runway annonce 99,9 % de disponibilité, aucune conservation des données et aucun entraînement sur les contenus clients sous contrat.
En parallèle, Slide Maker génère une diapositive mise en page à partir d’un prompt, puis permet de l’exporter ou de l’envoyer vers d’autres Apps Runway pour l’animer.
Runway toujours, ajoute de son côté Seedance 4K, Seedance Mini et Kling 3.0 Turbo. Une façon de réunir davantage de modèles dans une seule interface, avec un workflow et une facturation centralisés. Un code 30RUNWAY promet 30 % de réduction pendant trois mois.
🔹 Pika Voxel-It
Voxel-It convertit une photo en univers de blocs tout en gardant les personnes en rendu réaliste. La transformation peut cibler uniquement le décor, un objet ou plusieurs éléments. La Skill est accessible dans Pika ou depuis un assistant relié à son connecteur MCP. La définition de sortie n’est pas encore précisée.
🔹 BRIA Product Dimensions dans Wavespeed
Product Dimensions détoure une photo produit et y ajoute la hauteur, la largeur ou d’autres informations, sans modifier l’objet. Les unités métriques et impériales sont disponibles. BRIA vise les catalogues de 100 à plus de 10 000 références. Le tarif affiché sur WaveSpeedAI est de 0,04 dollar par image.
🔹 Morphic fluidifie le passage de l’audio au storyboard
Audio to Transcript convertit podcasts, voix off et narrations en texte directement dans Morphic. La transcription peut ensuite servir à identifier les personnages, découper les scènes et préparer la timeline Compose.
Morphic ajoute aussi des tags personnalisés pour classer images, personnages, décors et autres assets, puis les filtrer avant de les renvoyer vers le Canvas. Deux mises à jour qui renforcent surtout la continuité et l’organisation du workflow, de l’audio jusqu’au storyboard et au montage.
🔹 Jitter Superagents
Les Superagents de Jitter prennent en charge des tâches comme le redimensionnement, la traduction, le renommage des calques, le nettoyage de la timeline ou la création d’une animation complète. Tout reste ensuite modifiable dans l’éditeur. Une même scène peut être déclinée dans plusieurs formats et langues, puis exportée en lot.
Note de Caro : utilisatrice depuis un moment, une fonctionnalité pas mal pour remixer, animer et traduire rapidement des scènes via IA tout en gardant la main sur l’édition… manuelle !
🔹 Vector Editor de Recraft Studio
Le Vector Editor donne accès aux points d’ancrage, aux poignées de Bézier, aux contours et aux remplissages directement dans Recraft. Il fonctionne sur les illustrations générées ou vectorisées avant leur export en SVG. Une vraie avancée pour corriger logos, icônes et systèmes graphiques sans repasser systématiquement par Illustrator ou Figma.
Avis de Caro : pour moi, l’un des meilleurs outils IA actuels pour générer et éditer rapidement des SVG propres, scalables et sans trop de complexité.
🔹 FLORA Timeline Editor
Timeline Editor sert à séquencer, couper et raccorder les plans générés dans FLORA, sans passer par un logiciel externe. La timeline devient un node connecté au reste du workflow. La chaîne peut ainsi couvrir la génération, l’upscale, l’extension, le montage et le rendu final, notamment pour les publicités, les sizzle reels et les formats sociaux.
🔹 ImagineArt Fashion Studio
Fashion Studio couvre les lookbooks, campagnes, flatlays, photos produit, essayages virtuels et vidéos de défilé. Les paramètres de marque (silhouette, lumière, décor ou palette) peuvent être réutilisés d’un contenu à l’autre. Ce module Imaginart donne accès à plus de cinquante modèles et à des workflows par nodes, du brief jusqu’au rendu final.
🔶 CÔTÉ OPEN SOURCE
🔸 LTX-2.3 Cinemagraph
Ce LoRA transforme une image fixe en boucle vidéo en n’animant qu’un seul élément. Elle a été entraînée sur des plans sans mouvement de caméra pour éviter les glissements et les effets de parallaxe. Elle fonctionne dans ComfyUI avec LTX-2.3-22B et le trigger cinemagraph_motion. Dispo ici sur Hugging face.
Note de Caro : À réserver surtout aux scènes fixes : elle est moins adaptée aux personnages, aux mouvements multiples et aux travellings.
🔸 Wan Music-to-Dance
Cette fonctionnalité de Wan génère une vidéo dansée à partir d’une image de personnage et d’une piste audio. Cinq styles sont proposés : street dance, claquettes, danse latine, K-Pop et danse classique chinoise. Les mouvements suivent les temps forts du morceau. Wan lance également une Skill qui transforme des photos en pages de journal illustré.
🔹 L’ÉVÉNEMENT
🔹 CapCut lance un festival de films entièrement créés en IA
CapCut lance le CRE[AI]TE AI Festival, un concours ouvert aux créateurs qui souhaitent produire un court ou moyen métrage entièrement réalisé avec CapCut Video Studio. Films IA, séries épisodiques, expériences social-first ou spots publicitaires fictifs : toutes les catégories sont acceptées. À la clé, un grand prix de 70 000 dollars. Les soumissions sont ouvertes jusqu’au 10 août.
🔹 LA RECO DU JOUR. : briefia.fr
Vous me suivez pour la créa générative. Pour tout le reste de l’actu IA, il y a briefia.fr.
Chaque soir, l’essentiel de ce qui bouge décrypté en 5 minutes : nouveaux modèles, outils, annonces qui comptent. De quoi garder une longueur d’avance sans y passer vos journées, pendant que vous, vous créez. C’est gratuit et quotidien.
Abonnez-vous ici : briefia.fr !
🔹La pépite de la semaine
La pépite de la semaine est “Claire + Louis”, un court métrage très réussi de Vincent vallon, qui narre la rencontre poétique et onirique de deux solitudes, avec un réel talent dans la mise en scène.
Cette édition est terminée, merci de l’avoir lue jusqu’ici ! Si elle vous a plu, vous pouvez la partager en cliquant juste ici :
Vous pouvez également me suivre sur LinkedIn (Caroline est par ici) et activer la cloche 🔔, je poste régulièrement sur l’intelligence artificielle générative. Vous pouvez également me contacter pour toute proposition de création, intervention, conférence, projet, formation liée à l’intelligence artificielle générative.
Et n’oubliez pas de vous abonner pour ne rien rater des prochaines éditions 👇















Sur le doublage émotionnel d'ElevenLabs, la vraie question c'est le Japon : ici l'industrie du seiyū est un pilier culturel et syndical bien plus verrouillé qu'en Occident, et je vois mal les comités de production accepter de transférer le jeu d'un acteur sans passer par les ayants droit. Curieux de savoir si la 4K de Seedance tient la route sur des plans d'animation stylisée ou seulement sur du photoréaliste ?
Côté japonais, le vrai test de ces modèles 4K ce sera l'anime : la cohérence temporelle des traits reste le mur, et les studios de Tokyo restent frileux tant que le line art « tremble » d'une image à l'autre. Question sur ElevenLabs d'ailleurs — transférer l'émotion des acteurs, c'est frontal avec les syndicats de seiyū ici, tu as vu passer des données sur leur position ?