IA Bulletin — 12 septembre 2026

Le remix sous licence chez Universal /
L'édition chirurgicale de ChatGPT Images 2.5 /
Les lèvres resynchronisées de Prime Video

Le remix sous licence chez Universal

Universal Music Group et ElevenLabs ont annoncé le 10 septembre un accord stratégique pluriannuel, le premier de la société de synthèse vocale avec une major, dont le premier chantier est une plateforme grand public où les fans pourront créer des remixes, des mashups et de nouvelles interprétations à partir de titres sous licence. La participation des artistes et des auteurs se fait par consentement explicite, titre par titre, et le communiqué promet une rémunération « équitable » sans en décrire le mécanisme, sans nom de produit, sans date de lancement ni tarif. L'expression « expériences vocales personnalisées » désigne, chez une entreprise dont le cœur technique est le clonage de voix à partir de quelques secondes d'audio, la possibilité d'entendre un artiste consentant chanter une mélodie composée par le fan — précisément l'usage qu'Universal faisait retirer des plateformes il y a deux ans. La plateforme sera distincte de Music API et d'ElevenMusic, dont le modèle Music v2 revendique un entraînement sur des données licenciées via Merlin et Kobalt, et elle arrive vingt-quatre heures après les modèles v6 de Suno développés avec Warner, BMG et Believe. Contrairement aux accords Udio–Universal ou Suno–Warner, nés de procès, celui-ci n'a été précédé d'aucune plainte, et il ne couvre ni les indépendants distribués via DistroKid ou TuneCore ni les musiciens de session dont le syndicat américain poursuit justement Warner et Universal depuis juin.

Note éditoriale

Un accord signé sans procès préalable dit surtout une chose : la licence est devenue un produit d'appel, plus une réparation. ElevenLabs achète une légitimité qu'une introduction en bourse exige, Universal achète un guichet de plus pour son catalogue, et le fan achète le droit de faire chanter une voix qui n'est pas la sienne dans un enclos surveillé.

Reste le mot « équitable », qui n'a pas de chiffre. Tant que la clé de répartition entre la major, l'artiste consentant et les musiciens de session restera hors communiqué, la seule certitude est que l'enclos rapporte d'abord à celui qui en tient la porte.

Sources : PR Newswire — Universal Music Group and ElevenLabs Announce Multi-Year Strategic Agreement — Génération NT — Universal Music aura sa plateforme de musique par IA — Tech Times — ElevenLabs Signs First Lawsuit-Free AI Music Deal with UMG

L'édition chirurgicale de ChatGPT Images 2.5

OpenAI a publié le 8 septembre ChatGPT Images 2.5, un modèle qui, selon l'éditeur, réduit la latence de génération jusqu'à 50 % par rapport à Images 2.0, rend des textures et un éclairage plus naturels et conserve mieux les sujets des photos de référence à travers les changements de décor et de style. Le point le plus travaillé est l'édition ciblée : le modèle ne modifie que l'élément demandé — un produit, un fond, une ligne de texte — et garde le reste intact, y compris au fil d'une longue conversation où chaque retouche s'ajoute à la précédente sans dégrader l'image. L'interface gagne un mode Sketch, invoqué par « @Sketch », qui permet de dessiner une composition à main levée directement dans ChatGPT et de la faire compléter, des gabarits pour les formats courants (affiche, produit, merchandising), des commentaires posés directement sur l'image et le partage d'un prompt avec la création. Côté API, deux modèles arrivent : GPT-Image-2.5 Flare, par défaut et deux à quatre fois plus rapide que GPT-Image-2 d'après les mesures de Manus, et GPT-Image-2.5 Sunburst, plus lent, réservé aux retouches de précision, tous deux déjà intégrés chez Adobe Firefly, Runway et Higgsfield. Pour un atelier qui produit les variantes d'une pochette d'album à partir d'un même visuel maître, la promesse d'une édition qui ne touche que ce qu'on lui désigne compte davantage que la vitesse, et OpenAI maintient métadonnées C2PA et filigrane invisible sur chaque sortie.

Note éditoriale

Trois milliards d'images par semaine, dit OpenAI, et l'argument commercial de cette version n'est plus la beauté du résultat mais la discipline de l'outil : ne pas toucher à ce qu'on ne lui a pas demandé. C'est l'aveu que le problème des modèles d'image n'a jamais été de générer, mais d'obéir.

Le mode Sketch mérite un regard prudent : un trait maladroit interprété par un modèle n'est pas un dessin, c'est une consigne floue. Ce que le crayon apporte réellement, c'est la mise en page — où va le sujet, où respire le vide — et cela, aucune description écrite ne l'exprime aussi vite qu'un rectangle mal tracé.

Sources : OpenAI — Introducing ChatGPT Images 2.5 — 9to5Mac — OpenAI releases ChatGPT Images 2.5

Les lèvres resynchronisées de Prime Video

Prime Video a activé le 9 septembre une technologie de synchronisation labiale qui modifie, par IA et effets visuels, le mouvement des lèvres des comédiens pour le faire coïncider avec un doublage anglais enregistré par des voix humaines. Le service l'applique d'abord aux saisons 1 et 2 de Maxton Hall, série allemande devenue sa production internationale la plus regardée, et l'intégrera à la troisième et dernière saison prévue le 9 décembre. Amazon insiste sur le fait que les voix restent celles de doubleurs et que la retouche est purement visuelle, appliquée sous « supervision créative » pour préserver l'intention des auteurs, avant une extension à d'autres titres du catalogue. Le procédé recouvre un usage déjà proposé par des sociétés de post-production spécialisées, mais son déploiement par une plateforme sur des saisons entières, à l'échelle mondiale et sans surcoût pour l'abonné, change l'ordre de grandeur. Le doublage, longtemps considéré comme une convention acceptée par le public, devient ainsi un chantier de retouche d'image où le visage du comédien est réécrit après tournage, sans que le communiqué précise si les acteurs concernés ont été consultés ni comment l'opération est signalée au spectateur.

Note éditoriale

Le doublage a toujours été un mensonge consenti, et la désynchronisation en était la trace visible, l'aveu discret que la voix venait d'ailleurs. Effacer cette trace rend l'artifice invisible, ce qui est exactement le but, et exactement le problème.

Pour les comédiens de doublage, la nouvelle est paradoxale : leur voix est conservée, mais c'est le visage de l'autre qui s'adapte à eux. Pour les acteurs à l'image, une question que le communiqué laisse ouverte : qui a signé pour que leur bouche prononce des mots qu'ils n'ont jamais dits ?

Sources : Amazon — Prime Video introduces new lip-sync technology on Maxton Hall — Variety — Prime Video Is Using AI to Lip-Sync Actors' Mouths in Dubbed Titles
Another Summer With Kate — Studio Takuya
Another Summer With Kate — Studio Takuya