Kling Kling Boum
Salut les excités de l’innovation, bienvenue dans cette 125e édition de GENERATIVE, la newsletter qui échoue chaque semaine à faire un régime, tellement l’infobésité règne dans le petit monde de l’IA générative.
Séquence micro-drama automnal : Suite à une mauvaise manip de ma part, Caro n’a pas co-signé l’édition précédente. Son nom n’apparaissait pas à l’envoi. Certains lecteurs inquiets l’ont même contactée en MP pour savoir ce qu’il en était. Rassurez-vous, Caro est toujours là, et je peux même avancer que sans elle, cette newsletter serait très probablement en pause indéfinie, faut de bande passante suffisante de mon côté.
Au fait :
Ma prochaine session de formation CPF aura lieu les 16 et 17 octobre prochains !
Si tu es salarié.e ou indépendant.e, et que tu souhaites monter en compétence sur la génération d’images et de vidéo, tu es le/la bienvenue.e !
La session est 100% finançable par le CPF. Les inscriptions se font ici.Former tes équipes à l'IA générative grâce à nos formations entreprise finançables par ton OPCO
Nous contacter directement pour discuter de ton projet IA générative
Me suivre sur LinkedIn, YouTube ou TikTok pour ne rien rater.
Et c'est parti ! 🚀
🟦 KLING et son nouveau modèle vidéo 2.5 Turbo
L’info avant fuité la semaine dernière Kling lance son modèle 2.5 Turbo !
Il coûte moins cher que le 2.1, est plus rapide, améliore l’adhésion au prompt, réduit les artefacts et conserve mieux la cohérence des textures et personnages sur toute la durée du clip généré (toujours 5 ou 10 secondes). Les mouvements rapides et scènes multi-personnages sont mieux gérés. Sur des plans complexes certains artefacts/warpings persistent parfois mais globalement c’est très très bon. Gilles est déjà accro ! Il a réalisé ce bout à bout avec ses images Midjourney et une musique générée avec Suno V5. Regardez, la qualité est assez excellente :
Avant on parlait de latence de génération, certaines plateformes & suites ont inventé la latence d’intégration ! 2.5 Turbo est désormais proposé sur Krea AI…
… mais aussi en accès illimité jusqu’à la fin du mois sur Higgsfield (comprendre mardi!)
et également sur ImagineArt !
🟦 News côté Plateformes & Saas
🔹 Higgsfield AI : WAN Unlimited
Higgsfield déploie WAN 2.5 Unlimited, capable de produire des vidéos IA jusqu’à 10 s en Full HD 1080p. A l’instar de Veo 3, ce nouveau modèles génère à la fois de la vidéo et du son. On l’a testé, c’est mieux que Wan 2.2 mais on trouve les rendus un peu moins naturels que ceux proposés par Kling. Les sorties se font en plusieurs formats : 16:9 pour YouTube, 9:16 pour TikTok/Reels/Shorts, et 1:1 pour Instagram.
Des générations gratuites quotidiennes sont incluses, mais la régularité des rendus sur des clips longs ou complexes reste à valider.
🔹 … et WAN 2.2 Animate & Replace
Higgsfield a également introduit WAN2.2-Animate & Replace, qui transforme une photo fixe en clip animé. La fonction Replace permet de substituer un personnage ou “Soul ID” dans une vidéo existante tout en conservant pose et rythme. Les sorties vont de 480p à 720p, adaptées aux formats courts (TikTok, Reels, Shorts). Chaque abonnement inclut un essai gratuit, mais la précision du rendu dépend -encore- de la complexité des scènes.
🔹 et puis Photodump Studio & Lipsync Studio
Higgsfield lance Photodump Studio, qui produit en un clic 26 photos éditoriales ultra-réalistes d’un personnage Soul ID, sans besoin de shooting réel. Chaque cliché peut ensuite être animé via Lipsync Studio, transformé en vidéo parlante grâce à la synchronisation labiale avec texte ou audio. Le premier personnage est gratuit à l’entraînement, et un essai est inclus avec d’autres outils (Veo 3, InfiniteTalk, Kling Speak).
Caro a testé pour vous avec son avatar : ça fait beaucoup de costards tout ça !
🔹 ImagineArt & SeeDream 4.0
ImagineArt ouvre également gratuitement SeeDream 4.0 pendant une semaine sur ses plans Ultimate et Creator. Le moteur génère des images en 4K natif, avec une forte cohérence visuelle entre les rendus et un temps de sortie moyen autour de 2 secondes pour du 2K. Il accepte jusqu’à 6 images de référence pour guider style et continuité. L’offre est valable jusqu’à demain ! Go !
🔹 Freepik & le retour de son offre MiniMax Hailuo 02 en illimité
Freepik active à nouveau Hailuo 02 en mode illimité pour ses abonnés Premium+ et Pro. Souvenez-vous, le modèle produit des vidéos en 1080p jusqu’à 10 secondes. Faites-vous plaisir !
🔹 Wonder, la plateforme pour créatifs IA
Wonder se présente comme un réseau professionnel dédié aux créateurs IA, à la manière d’un “LinkedIn spécialisé”. La plateforme permet de publier son portfolio, trouver des missions, recruter des talents et collaborer sur des projets liés à la vidéo, l’image, le design ou la 3D. L’accès se fait par abonnement via une page d’inscription dédiée, encore en cours de déploiement.
On y retrouve notamment Floriane Bont, Stéphane Tranquillin, Alexandre Tissier et Melody Bossan du Prompt Club ! Ainsi que nos camarades Marseillais Ludovic Carli et Jean-Michel Falciasecca (Note de Caro : mais où est Gilles ?).
Lien d’inscription moyennant un abonnement à 4$ par ICI.
🔹 Suno sort sa V5
On vous en parlait dans l’édition de la semaine dernière, Suno déploie V5 depuis le début de la semaine. Accessible aussi aux abonnés des plans Pro et Premier. Le modèle améliore la qualité sonore avec un rendu plus immersif et des voix proches du réel. Les retours signalent un mixage plus propre que la V4.5, mais aussi des limites persistantes : répétitions dans les paroles, coupures abruptes et cohésion parfois inégale. Attention, il vous faudra préciser la durée maximale des morceaux.
🔹 LTX
LTX a offert un accès gratuit et illimité à Flux Premium pendant 24 heures via LTX Studio. Un peu court, mais tout le monde ne peut pas faire de l’illimité… indéfiniment ! On vous offre cette petite démo de Eric Solorio, spécialiste des VFX, avec un peu de post prod, pour compenser !
🔹 MiniMax & Free AI Agent
MiniMax lance Free AI Agent, une interface vocale capable d’orchestrer automatiquement des créations en image, vidéo et audio. L’utilisateur parle, l’agent sélectionne les modèles, planifie les étapes, puis génère le contenu dans un même espace. L’offre est gratuite cette semaine. La promesse est un flux créatif centralisé. A voir si le contrôle sur les rendus sera au rendez-vous !
🔹 Google Nano Banana depuis son mobile
Nano Banana, intégré à Gemini app, est maintenant disponible sur Google Pixel et à tester aussi sur d’autres smartphones comme le Samsung S25 Ultra. Dans les options possibles : éditer des photos par langage naturel, modifier styles, fonds, objets ou restaurer des images, génération d’images à partir de texte. Compatible avec stylet pour annoter directement l’image., l’outil fonctionne localement et rend l’édition photo mobile et interactive, accessible partout.
En parlant de Nano Banana (et oui, on a encore du mal à dire Gemini 2.5 Flash Image), on vous partage cette démo de AI Studios par le creative technologist Rikard Lindström. Avec un zoom infini sur une image fixe, l’IA recrée invente dynamiquement les détails via une “mise à l’échelle créative”. À chaque étape, des pixels plausibles sont générés pour prolonger l’image sans rupture. Le système utilise ensuite une logique proche de Nano Banana pour maintenir la cohérence visuelle. Assez subliminal, non ?
🔹 Google Flow : Prompt Expanders via Gemini
Côté Flow, les Prompt Expanders ont été ajoutés. Cette fonctionnalité transforme un seul prompt en plusieurs styles vidéo (figurine articulée, film noir, cinématographique, etc.). Un fonctionnalité dont on vous a déjà parlé chez Runway, Kling, Luma, Mago…
🔹 Google Labs : Mixboard (beta US)
Mixboard est un outil de mindmapping visuel piloté par IA, lancé par Google Labs et donc aux US uniquement (une fois n’est pas coutume!). Il permet de démarrer des projets via texte ou modèles prêts à l’emploi, de générer ou importer des images, et de les modifier en langage naturel via Nano Banana. L’interface propose aussi des fonctions comme régénération visuelle en un clic et génération de texte contextuel à partir d’images. L’outil vise à faciliter l’exploration d’idées visuelles dans un cadre fluide.
🔹 Photoshop : Generative Fill avec plusieurs modèles IA
Le remplissage génératif de Photoshop permet désormais de choisir entre 3 modèles : Gemini 2.5 Flash Image (Nano Banana), FLUX.1 Kontext et Firefly. L’utilisateur sélectionne celui qui correspond le mieux à son besoin directement dans le logiciel, sans changer d’outil.
Note de Caro : cette release était très attendue, on en parlait la semaine dernière. Adobe accélère son changement de stratégie avec l’intégration des différents modèles. Bientôt dans la course avec les autres plateformes ?
🔹 Gambo.ai : le jeu vidéo généré en un prompt !
Gambo.ai transforme un prompt textuel en un jeu vidéo complet : personnages, cartes, musiques, SFX, animations et assets sont générés automatiquement et organisés. Un éditeur de niveau intégré est prévu, ainsi que des outils pour monétiser (annonces, skins, etc.). L’objectif est d’éliminer des mois de codage pour concevoir des prototypes ou jeux simples, en laissant l’IA gérer l’architecture et les interactions. La qualité sera-t-elle au rendez-vous pour les gamers ?
Voici une démo pour vous faire une idée de ce que ça donne :
🔹 Huxe : l’assistant audio personnalisé sans écran
Huxe est une app mobile (iOS/Android) qui génère des podcasts personnalisés, des briefings quotidiens et des flux audio thématiques à partir de votre mail, agenda ou centres d’intérêt. Fonctionne sans interface visuelle : on écoute, on interagit vocalement avec l’outil. L’idée : remplacer les écrans par un fil audio génératif, mis à jour en continu.
Le système, encore jeune, présente des limites (contenus parfois flous, voix perfectibles, accents québécois impromptus), mais le concept de veille “mains libres” est solide. Merci à Rémi Rostan, éditeur en chef du magazine LHC, dont on vous parle souvent ici, pour le partage de cette belle trouvaille cette semaine.
🔹 Tether & le contrôle IA dans After Effects (bêta)
Tether est un plugin pour Adobe After Effects dont la bêta est en préparation. Conçu pour intégrer l’IA dans un workflow d’animation sans abandonner les outils traditionnels, cela permettra de définir précisément ce qui doit bouger via des nulls, avec un respect des animations d’images clés et qui fonctionnera dans tous les formats (16:9, 1:1, 9:16…). Lien pour la bêta ICI.
Note de Caro : selon les infos partagées, des itérations pourront être générer sans quitter After, avec une logique de directabilité pensée davantage pour les aficionados d’AE que les simples prompteurs. Il va falloir réviser !
🔹 Kinetix Vidéo & Animation 3D à partir de vidéos réelles
Kinetix transforme une vidéo source et une image fixe en animation 3D. Le mouvement est extrait de la vidéo et appliqué à l’image. Le modèle intègre un rigging 3D de base, permettant une reconstitution crédible des gestes. Il propose aussi un contrôle caméra 3D, utile pour varier les points de vue.
Avis de Caro : l’outil reste expérimental mais prometteur pour explorer des scènes avec des mouvements plus dynamiques. Actuellement, le suivi d’objets est encore fragile comme avec le bâton de l’arrêt sur image ci-dessus.
🔹 Démo Luma Ray 3
La mise à jour Ray3 dans Dream Machine continue à faire parler d’elle. En renforçant la fidélité anatomique, les visages, mains et corps en mouvement conservent leur structure et leurs détails, même dans des séquences cinématiques complexes. Les personnages humains ou créatures gardent une cohérence visuelle à travers l’action, évitant les déformations souvent rencontrées dans les modèles vidéo IA.
Les équipes de Jon Finger vous montre aussi comment réinterpréter des videos réelles pour un “perfect happy end” :
Enfin, voici une dernière démo sur Ray 3 de Luma AI de Ross Symons. Pour rappel, l’un des avantages du modèle est son export HDR natif, encore rare en génération vidéo IA.
Dans un autre genre, voici des tests se font sur des scènes dynamiques à fort contraste menés par Yigit Kirka, Creative Director de Wonder Studios. Il nous rappelle aussi qu’il s’agit du premier (?) modèle basé sur le raisonnement, ce qui permet de mieux interpréter les requêtes ambiguës ou visuelles atypiques.
🔹 Dzine AI : le LipSync
Ca faisait un moment, voici le retour de Dzine AI dont on vous avait déjà parlé. Sa fonction Lipsync permet désormais de synchroniser jusqu’à 4 personnages parlant simultanément. Le nouveau mode Pro améliore la fluidité des mouvements et la qualité d’image pour des rendus plus crédibles.
Il ont également récemment intégré Seedream 4.0.
… et son Video Editor
Cet éditeur vidéopermet d’ajuster couleur, style et lumière d’un clip. Il intègre le remplacement d’arrière-plan via texte ou image et l’ajout d’éléments visuels. L’outil accepte aussi des références visuelles pour améliorer la précision des rendus.
🔹 Le workflow Weavy de la semaine
Sergio Alvadez nous partage son flux de travail Weavy, système nodal central pour structurer les étapes de création avec Nano Banana, Seedream V4 et Luma AI. Il y génère des scènes d’action en style kung-fu. Cette approche continue de séduire les profils habitués aux interfaces type compositing (comme Nuke ou Blender). Le rendu est cohérent, et la personnalisation poussée selon les outils utilisés parmi la boîte à outils disponible dans l’interface.
🔹 Runway : Gaming & modèle A2D
Runway lance une série de cours sur l’usage de l’IA dans la création de jeux vidéo, de l’art conceptuel aux trailers. Le programme est accessible sur leur site. En parallèle, l’équipe présente A2D (Autoregressive-to-Diffusion), un modèle de langage visuel combinant les forces des architectures autorégressives et diffusion, sans entraînement depuis zéro. Objectif : accélérer et améliorer la génération multimodale (image, texte, vidéo).
Le projet Lionsgate x Runway ralenti
D’ailleurs on vous parlait il y a quelques mois du partenariat de Runway avec Lionsgate, le projet sur la génération de contenus et trailers est ralenti. Parmi les problèmes principaux : un catalogue trop limité pour un entraînement efficace et un flou juridique autour des droits des acteurs. Les résultats actuels ne suffisent donc pas à produire des contenus cohérents. Lionsgate continue les tests mais explore désormais d’autres outils en parallèle.
🔹 Meshy 6 : Text-to-3D et Image-to-3D
On n’en avait pas parlé depuis un moment, voici un update pour nos camarades de la 3D ! Meshy 6 améliore nettement la qualité de ses maillages générés. Les formes sont plus précises et détaillées, proches de la sculpture manuelle. Les modèles issus de texte ou d’image gagnent en fidélité et netteté et le temps de génération est réduit. L’outil ambitionne de devenir un support rapide pour prototyper ou prévisualiser des assets 3D avec plus de rigueur. On vous en partage la démo ici.
🔹 Meshcapade : Extraction de tracking 3D
Meshcapade sépare désormais les données de tracking caméra 3D et d’estimation de pose humaine à partir de vidéo, comme chez Wonder Dynamics et Autodesk Flow Studio à ce stade. L’outil devient pertinent pour les artistes 3D et les pipelines IA vidéo-à-vidéo, en apportant des données exploitables pour de l’animation ou une intégration.
🔹 TaTa de Timbaland x Stage Zero
Timbaland, dont on vous avait partagé une video où il découvrait le potentiel de l’IA en musique, dévoile TaTa, artiste Pop-IA conçue avec Stage Zero, décrite comme « vivante, autonome, apprenante ».
🔹 Luna de Kling AI et son premier single
Kling présente Luna, dont le clip “New Born”, produit avec Outliers, illustre une scène banale transformée par l’émotion musicale. Ce lancement marque l’entrée de Kling dans le secteur des artistes virtuels.
Note de Caro : il n’y aurait pas un air de famille avec Kion de Higgsfield ?
🔹 Candicce, l’artiste IA grunge européenne
Candicce est une chanteuse IA franco-belge mêlant grunge, indie et rock brut. Son clip « Clash of Violins » explore l’épuisement émotionnel dans le quotidien professionnel. Créée avec Beyönd BV, il s’agit d’une série musicale autour de la cybersécurité, combinant poésie, son design et narration émotionnelle. L’IA devient ici une voix pour des causes humaines. Merci au camarade Laurent Rozenfeld pour le partage.
🟧 côté Open source
🔸 Qwen3-Omni
Qwen3-Omni est un modèle unifié capable de traiter texte, image, audio et vidéo. Il offre une latence de 211 ms, analyse 30 min d’audio en quelques secondes, et inclut un sous-titreur open source à faible hallucination. L’entrée et la sortie vocales sont prises en charge. Personnalisable par invites système, il est disponible en test open source. Lien Huggingface ICI.
Pour rappel, Qwen c’est ça :
🔸 OmnInsert (ByteDance)
Développé par ByteDance, OmnInsert permet d’insérer des sujets dans des vidéos sans recourir aux masques. Il utilise un pipeline (InsertPipe), une injection progressive de caractéristiques et un Subject-Focus-Loss pour harmoniser sujet et scène. Un benchmark interne (InsertBench) montre de meilleurs résultats que les solutions propriétaires. L’outil vise un équilibre insertion/naturel plus poussé.
🔸 Lynx (ByteDance)
Lynx est un cadre de génération vidéo basé sur diffusion, avec deux modules clés : un adaptateur d’identité pour encoder les visages, et un Ref-adapter pour assurer le réalisme visuel. Il surpasse les modèles récents sur la ressemblance faciale, la synchronisation et la qualité globale, d’après un benchmark sur 800 cas.
🔸 Glif & Seedream v4 : Remix d’images web dans Chrome
Glif intègre Seedream v4 dans une extension Chrome. En un clic droit, il devient possible de modifier n’importe quelle image web (style, contenu). Cela ouvre un usage rapide pour les designers ou créateurs visuels, sans quitter le navigateur. L’outil transforme l’édition en ligne en interface directe de création.
🔹 L’épopée Kung-Fu de Dave Clark
Caro avait eu l’occasion de faire un stream croisé avec lui cet été pour nos amis de Machine Cinema. Voici l’une des dernières vidéos partagées par Dave Clark, co-fondateur de Promise : l’histoire d’un moine Shaolin qui se transforme en guerrier, entre kung-fu et conspiration. Pour ce film, Dave s’appuie sur un pipeline IA complet : storyboard avec Adobe Firefly, écriture sous Gemini, images générées dans Midjourney puis retravaillées via Freepik, Seedream et Nano Banana. La vidéo est produite avec Luma Ray 3 et Veo 3, la musique signée Suno, et les finitions réalisées sur Premiere, Resolve et FilmConvert.
Cette édition est terminée, merci de l’avoir lue jusqu’ici ! Si elle vous a plu, vous pouvez la partager en cliquant juste ici :
Vous pouvez également me suivre sur LinkedIn (Caroline est par ici) et activer la cloche 🔔, je poste régulièrement sur l’intelligence artificielle générative. Vous pouvez également me contacter pour toute proposition de création, intervention, conférence, projet, formation liée à l’intelligence artificielle générative.
Et n’oubliez pas de vous abonner pour ne rien rater des prochaines éditions










Merci pour ces énormes news.
J'ai testé à peine 1/l4 de ces nouveautés 😅