IA Bulletin — 11 septembre 2026

Le vocabulaire commun de la CCAI /
Les microdramas sous vidéo générative /
La déclaration de Saint-Paul-de-Vence /
ComfyUI 0.35 et l'espace pixel

Le vocabulaire commun de la CCAI

La Creators Coalition on AI, fondée il y a neuf mois par Joseph Gordon-Levitt, Daniel Kwan et le producteur Ted Tremper, a ouvert le 9 septembre son Standards and Definitions Project, un portail public destiné à l'ensemble des métiers de l'écran. Le site démarre avec un glossaire d'environ 180 termes — « contenu d'auteur humain », « performance numérique par IA » — dont les définitions ont été négociées lors de deux conventions estivales réunissant des délégués des onze branches représentées. Il propose surtout un « AI Impact Visualizer » qui note, sur une échelle de 0 à 5, la probabilité qu'un modèle remplace le poste, pour quelque 150 métiers répartis en onze domaines, de la réalisation au mixage son en passant par l'animation et l'illustration de concept. Un peu plus de 250 réponses ont été collectées pour l'instant et la plupart des rôles restent affichés en « connaissance recommandée », faute de données suffisantes, l'objectif étant d'atteindre plusieurs milliers de répondants vérifiés et de publier une mise à jour majeure chaque trimestre. Les fondateurs assument une visée politique : un vocabulaire partagé, disent-ils, facilite autant la rédaction d'un projet de loi que la négociation d'un contrat individuel.

Note éditoriale

Le geste le plus utile ici n'est pas la note sur cinq, c'est le glossaire. Depuis deux ans, chaque négociation achoppe sur des mots que personne ne définit de la même façon — « assisté », « généré », « performance » — et le flou profite toujours à celui qui rédige le contrat. Fixer une définition de « contenu d'auteur humain » qui tolère l'appareil photo, le synthétiseur et le logiciel de montage, mais pas la contribution expressive d'un modèle, trace une ligne discutable mais au moins lisible.

Le visualiseur, lui, mesurera ce que les répondants craignent plus que ce que les outils font ; les fondateurs l'admettent en citant le coiffeur noté zéro dont le plateau disparaît quand même. Un baromètre de la peur reste un instrument, à condition de ne pas le lire comme une prévision.

Sources : The Hollywood Reporter — A Hollywood Creators Group Is Trying to Assess What AI Is Doing to the Industry

Les microdramas sous vidéo générative

Une enquête du Hollywood Reporter décrit le retournement d'un format qui avait servi de filet de sécurité aux techniciens et comédiens de Los Angeles après les grèves de 2023 : les plateformes de microdramas verticaux basculent vers la production entièrement synthétique. Des applications comme My Muse ou Inkitt Ironblood ne diffusent plus que des séries générées, et des acteurs majeurs — DramaBox, DramaWave, FlareFlow — multiplient les épisodes sans comédien, une bascule que plusieurs producteurs datent de la sortie de Seedance 2.0 en février. L'arithmétique est brutale : un tournage réel coûte de 100 000 à 300 000 dollars, mobilise une cinquantaine de personnes et douze semaines, quand un épisode généré revient à 60 000 ou 100 000 dollars pour cinq personnes et deux semaines, certains studios revendiquant même des projets à 1 000 dollars. Une agente qui suit quinze comédiens du secteur dit être passée de quinze à vingt castings quotidiens à quatre depuis juin, et un contrat de production mensuelle a été rompu en juillet du jour au lendemain quand la plateforme cliente est devenue « entièrement IA ». Le récit se double d'un contentieux sur le consentement — performances et visages réutilisés dans des projets synthétiques, publicités sexualisées fabriquées sans accord, personnages qui empruntent ostensiblement les traits d'Henry Cavill — tandis qu'en Chine, plus de 95 % des titres du premier trimestre auraient déjà été produits avec des modèles.

Note éditoriale

Le microdrama est le premier format audiovisuel entièrement né dans l'économie de l'attention, sans patrimoine, sans syndicat solide, sans public qui le défende par attachement. C'est donc là que la vidéo générative frappe d'abord, non parce qu'elle y est meilleure mais parce que rien n'y résiste — et ce qui s'y joue en six mois annonce ce qui se jouera ailleurs en six ans.

L'argument du patron de Shortical mérite qu'on l'écoute sans le croire : cinq personnes par série, mais dix fois plus de séries, donc davantage d'emplois. La productivité a rarement rendu aux travailleurs ce qu'elle leur prenait, et les comédiens qui comptent les annonces de casting semaine après semaine tiennent une comptabilité plus fiable que les communiqués.

Sources : The Hollywood Reporter — AI Is Deflating Hollywood's Microdramas Scene

La déclaration de Saint-Paul-de-Vence

Le Sommet Lumière, réuni à la Fondation Maeght sous la coprésidence des présidents français et coréen, a adopté le 7 septembre cinq déclarations thématiques, dont une consacrée à l'intelligence artificielle, signée notamment par la France, la République de Corée, la SACEM et l'Adami, et rejointe depuis par la Motion Picture Association. Le texte ne demande pas si les industries de l'écran doivent utiliser ces outils — ils sont déjà dans l'écriture, la prévisualisation, les effets, le doublage — mais à quelles conditions et sous quelle autorité. Ses six principes placent les systèmes qui produisent, diffusent ou transforment des œuvres culturelles, ou qui s'entraînent sur elles, dans le champ de la Convention UNESCO de 2005 sur la diversité culturelle, posent que tout usage d'œuvres protégées à des fins d'entraînement doit respecter la propriété intellectuelle et donner lieu à rémunération, et font de la préservation de l'emploi artistique humain un objectif durable de politique publique. Le volet transparence réclame la publication du contenu et de la provenance des jeux de données, l'identification claire de ce qui a été généré ou modifié, et des mécanismes permettant aux ayants droit de retrouver l'usage de leurs œuvres, y compris pour l'image et la voix des interprètes. La déclaration générale du sommet, en quinze principes, ajoute un avertissement inédit dans un texte multilatéral : l'avènement possible d'un monde où l'accès aux œuvres serait de plus en plus médié par des agents automatisés.

Note éditoriale

Une déclaration n'oblige personne, et celle-ci reste ouverte à la signature de ceux qui voudront bien la lire. Mais deux choses la distinguent des chartes habituelles : elle s'adosse à un instrument existant, la Convention de 2005, plutôt que d'en inventer un, et elle nomme les agents — ces intermédiaires logiciels qui, demain, choisiront quel film, quel disque, quelle image arrive jusqu'à nous, avant même l'algorithme de recommandation.

Que la SACEM et l'Adami figurent parmi les premiers signataires dit aussi où se situe le rapport de force : du côté des sociétés de gestion, pas des artistes individuels. La transparence des jeux de données, si elle advenait, servirait d'abord ceux qui ont les moyens d'aller vérifier.

Sources : Variety — Screen Industries Adopt Five Thematic Declarations at Lumière Summit — Variety — Lumière Declaration Sets 15 Principles for Global Film Governance

ComfyUI 0.35 et l'espace pixel

ComfyUI 0.35, publié le 9 septembre, ajoute le support natif de SenseNova U1.5, un modèle qui génère directement en espace pixel, sans passer par un encodeur latent, et accepte jusqu'à dix images de référence pour l'édition. La 3D progresse avec Pixal3D Multi-View, qui reconstruit un maillage texturé à partir de quatre vues — face, dos, gauche, droite — et un nœud File3DToMesh qui fait entrer les fichiers GLB, GLTF, OBJ et STL dans le pipeline sans conversion externe. Côté vidéo, LTXV gagne des images-clés générées que l'on peut ajouter, séparer ou ré-épingler, un guide latent pré-encodé sans aller-retour par le VAE, et des nœuds de rognage et de découpe directement dans l'interface. Deux ajouts intéressent la chaîne de finition : une conversion entre sRGB, HDR HLG et HDR PQ, et une sortie AVIF dans l'enregistrement avancé, à quoi s'ajoutent un compilateur mémoire avec graphes CUDA pour réduire les allocations et une baisse de la VRAM consommée par TRELLIS. Pour un atelier qui itère sur la déclinaison graphique d'une pochette d'album, la combinaison d'un modèle à dix références et d'un export HDR change la nature des allers-retours entre esquisse et fichier final.

Note éditoriale

La génération en espace pixel n'est pas une coquetterie d'ingénieur : le VAE des modèles latents est l'endroit où se perdent les textures fines, les lettrages, les grains, tout ce qu'un graphiste passe ensuite des heures à réparer. Qu'un modèle ouvert s'en passe, et qu'il accepte dix références plutôt qu'une, déplace le travail de la retouche vers la direction.

La conversion HDR est plus discrète et sans doute plus lourde de conséquences : elle signifie qu'un graphe de nœuds gratuit livre désormais des fichiers conformes aux chaînes de diffusion broadcast et streaming, là où seuls les logiciels de finition sous licence le faisaient. Le point d'entrée dans les pipelines professionnels ne se négocie plus, il s'installe.

Sources : ComfyUI — Changelog v0.35.0
Happy Housewives — Studio Takuya
Happy Housewives — Studio Takuya