IA Créative • 29 juin 2026



Gap relie données, création et diffusion dans un même système marketing IA

Gap Inc. a annoncé une infrastructure marketing qui connecte ses données clients, la création de contenus et l’activation de campagnes avec Google Cloud, Zeta Global et Publicis Sapient.

Le groupe utilisera Agent Studio, Agent Engine, Gemini, Nano Banana et Veo. Athena de Zeta doit coordonner audience, développement créatif, diffusion et optimisation. Le changement dépasse la génération d’images : la création devient une étape d’un système qui apprend après chaque campagne. Pour les équipes qui structurent leurs workflows créatifs IA, le signal est précis : le modèle opérationnel compte désormais autant que le modèle génératif. Source : annonce de Gap Inc.

PaperTok transforme un article scientifique en vidéo verticale de 45 secondes

L’Université de Washington a présenté PaperTok, un outil qui convertit un article de recherche en vidéo de 45 secondes tout en laissant son auteur corriger le script et le storyboard.

Gemini propose quatre accroches, découpe le texte en scènes puis génère les séquences. Le dispositif a été comparé à deux générateurs PDF-vers-vidéo auprès de 100 participants en ligne et 18 universitaires. Les vidéos ont été jugées plus engageantes, mais leur aspect trop artificiel reste un risque de crédibilité. PaperTok montre ainsi une voie plus utile que l’automatisation totale : garder l’expert dans la boucle éditoriale. Source : Université de Washington

SceneCraft remplace le prompt de retouche par un graphe de scène

Les chercheurs de SceneCraft ont conçu une interface qui traduit les relations entre objets d’une image en instructions de retouche précises.

Un graphe de scène est une représentation structurée des objets, de leurs attributs et de leurs relations spatiales. L’utilisateur modifie directement ce graphe, puis le système envoie les consignes produites à plusieurs modèles génératifs. Cette approche réduit l’ambiguïté des formulations comme « déplacer cet objet derrière celui-ci ». Elle déplace aussi le contrôle créatif du prompt vers une structure visuelle inspectable. Source : publication SceneCraft sur arXiv

Neural4D génère un objet 3D étanche en moins de 90 secondes

Neural4D a ajouté à son studio un agent qui dirige une demande vers la génération d’image, de vidéo ou de modèle 3D depuis une même interface.

L’utilisateur peut rappeler une création antérieure avec une balise @asset, puis obtenir un maillage triangulaire fermé, texturé en PBR et exportable en STL, GLB ou FBX. L’entreprise annonce un résultat 3D en moins de 90 secondes. L’agent automatise surtout le choix du moteur et des paramètres, sans permettre encore l’affinage du modèle par dialogue. C’est une limite claire, mais aussi une définition honnête de son rôle. Source : documentation Neural4D

MoVerse transforme une image en environnement vidéo navigable

Les chercheurs de MoVerse ont présenté un modèle de monde qui construit un espace vidéo interactif à partir d’une seule image au champ de vision étroit.

Le système étend d’abord l’image en panorama à 360°, le convertit en structure 3D persistante puis génère les vues correspondant au mouvement de caméra demandé. Il atteint 8 images par seconde sur une seule NVIDIA RTX 4090. Cette combinaison de géométrie explicite et de rendu génératif prépare des décors explorables pour la prévisualisation, le jeu et les expériences immersives, sans modéliser manuellement chaque angle. Source : publication MoVerse

Résumer cet article :

Les signaux IA qui changent la création et la production

  • Recraft refond la reprise d’images, Kohler industrialise ses variantes créatives, PALATE personnalise la…

    Lire la suite

  • LTX relie audio et caméra, Sidekick fiabilise InDesign, CCS Media documente un spot…

    Lire la suite

  • Wan 3.0 transforme des documents en références vidéo, OpenGradient structure les recettes et…

    Lire la suite

Guides Pratiques

ChatGPT Work

ChatGPT Work : transformer un brief en mission agentique

ChatGPT Work est conçu pour les tâches longues qui demandent de rassembler du contexte, d’utiliser des applications ou des fichiers, de produire un livrable et de revenir vers l’utilisateur lorsque son arbitrage compte.

Accéder au guide

prompt lumière IA

Piloter la lumière IA comme un chef opérateur

La lumière en IA ne se contrôle pas avec des adjectifs comme « cinematic », « moody » ou « dramatic lighting ». Elle se dirige comme un plan lumière : une source, une direction, une intensité, une température, un contraste et une intention narrative.

Accéder au guide

brand brain IA

Brand Brain : transformer une stratégie de marque en système utilisable par l’IA

Un Brand Brain IA est un référentiel de marque structuré pour être consulté, interprété et vérifié par des assistants d’intelligence artificielle. Il ne s’agit pas de copier un brand book dans une conversation ni d’empiler des prompts.

Lire l’article