Anti-Prompt protège une image IA contre son animation non autorisée
Les auteurs d’Anti-Prompt injectent dans une image des perturbations imperceptibles qui provoquent des défauts visibles lors de sa conversion en vidéo guidée par texte. La méthode affaiblit les interactions entre l’image et le prompt sans dégrader la source affichée. Testée sur 2 architectures image-vers-vidéo, elle améliore aussi le transfert de la protection entre modèles. L’approche déplace ainsi la protection technique vers le fichier source. Source : publication Anti-Prompt sur arXiv
WorldDirector conserve les objets hors champ dans les mondes vidéo
Les auteurs de WorldDirector présentent un modèle vidéo qui mémorise l’identité et le mouvement d’un objet après sa sortie du cadre. Un world model est un système qui simule un environnement et son évolution. Ici, un modèle de langage coordonne trajectoires 3D et caméra avant la génération des images. Le hors-champ devient une mémoire de mise en scène, utile pour explorer un décor sans voir disparaître ses personnages. Source : publication WorldDirector sur arXiv
GMO-E2DIT décompose la retouche e-commerce en opérations vérifiables
Les chercheurs de GMO-E2DIT décrivent un agent qui transforme une demande de retouche e-commerce en une suite d’actions localisées, exécutées puis contrôlées. Un modèle vision-langage prépare les zones et les opérations, tandis qu’un éditeur masqué préserve les parties déjà validées et reprend les erreurs. Pour les équipes qui formalisent leurs workflows créatifs IA, la retouche devient un programme auditable, pas une transformation globale difficile à corriger. Source : publication GMO-E2DIT sur arXiv
KathaTrace mesure la perte de sens entre les plans d’un storyboard
Les chercheurs de KathaTrace montrent qu’une séquence visuellement cohérente peut perdre le lien narratif qui relie deux scènes. Leur protocole compare ce que le lecteur comprend depuis le texte, les images, puis les deux réunis. Les générateurs évalués affichent un écart moyen de 23,5 points entre récit textuel et récit visuel. Pour la prévisualisation, la continuité ne se limite donc plus au personnage ou au décor : elle inclut la causalité. Source : publication KathaTrace sur arXiv
AbsoluteDegradation recrée les défauts physiques des films d’archive
Les auteurs d’AbsoluteDegradation publient un pipeline modulaire qui simule grain, rayures et mouvements de caméra avant d’entraîner des modèles de restauration. Leur benchmark réunit 81 576 images haute résolution issues de films d’archive réels. En reproduisant la chaîne analogique puis sa numérisation, le système évite de réduire l’usure à un filtre aléatoire et révèle les échecs que les jeux synthétiques classiques masquent. Source : publication AbsoluteDegradation sur arXiv
Les signaux IA qui changent la création et la production
-
Recraft refond la reprise d’images, Kohler industrialise ses variantes créatives, PALATE personnalise la…
-
LTX relie audio et caméra, Sidekick fiabilise InDesign, CCS Media documente un spot…
-
Wan 3.0 transforme des documents en références vidéo, OpenGradient structure les recettes et…
Guides Pratiques

ChatGPT Work : transformer un brief en mission agentique
ChatGPT Work est conçu pour les tâches longues qui demandent de rassembler du contexte, d’utiliser des applications ou des fichiers, de produire un livrable et de revenir vers l’utilisateur lorsque son arbitrage compte.

Piloter la lumière IA comme un chef opérateur
La lumière en IA ne se contrôle pas avec des adjectifs comme « cinematic », « moody » ou « dramatic lighting ». Elle se dirige comme un plan lumière : une source, une direction, une intensité, une température, un contraste et une intention narrative.

Brand Brain : transformer une stratégie de marque en système utilisable par l’IA
Un Brand Brain IA est un référentiel de marque structuré pour être consulté, interprété et vérifié par des assistants d’intelligence artificielle. Il ne s’agit pas de copier un brand book dans une conversation ni d’empiler des prompts.