IA Bulletin — 28 septembre 2026

La voix volée de Kenjiro Tsuda /
Le fond disparu des vidéos Firefly /
Le renfort visuel d'ElevenLabs

La voix volée de Kenjiro Tsuda

Le comédien de doublage japonais Kenjiro Tsuda, voix de personnages de Jujutsu Kaisen et de Yu-Gi-Oh !, poursuit TikTok devant le tribunal de district de Tokyo pour ce qui serait la première action individuelle japonaise défendant une identité vocale contre un clone généré par IA. Un compte anonyme, dont la photo de profil reprenait un personnage qu'il a doublé, publiait des vidéos sur les légendes urbaines et les théories du complot narrées par ce que Tsuda identifie comme une copie de son timbre grave et reconnaissable. Le compte avait rassemblé plus de 200 000 abonnés et générait, selon l'estimation avancée devant le tribunal, environ 500 000 yens — près de 3 200 dollars — de revenus mensuels. Tsuda invoque ses droits de publicité, la capacité à contrôler et à monétiser les usages de son identité, et réclame le retrait des vidéos ainsi qu'une reconnaissance de la responsabilité de la plateforme ; TikTok rétorque qu'il s'agit d'une « voix masculine générique » relevant de la liberté de création. L'affaire s'inscrit dans la campagne « No More » lancée par le syndicat japonais des acteurs contre le clonage vocal non autorisé, quelques semaines après des lignes directrices non contraignantes du ministère de la Justice précisant que la voix relève déjà du droit de publicité existant.

Note éditoriale

Un compte qui vit uniquement de légendes urbaines racontées d'une voix empruntée n'a rien produit : il a prélevé un supplément de crédibilité sur un timbre que d'autres ont mis vingt ans à construire. C'est l'exact inverse d'un geste artistique dirigé — aucune culture, aucun choix, seulement l'exploitation d'une reconnaissance vocale acquise ailleurs, ce qui est la définition même de la statistique esthétique plutôt que de l'art.

Les lignes directrices non contraignantes d'un ministère ne valent que ce qu'un tribunal en fait, et c'est précisément ce qui se joue à Tokyo : la défense de TikTok — une « voix générique » subjectivement similaire — est le genre d'argument qui ne survit pas longtemps face à un juge qui écoute l'enregistrement. Le dossier Universal et Sony contre Suno posait la question à l'échelle d'un catalogue ; celui-ci la pose à l'échelle d'un seul homme, ce qui rend l'enjeu plus lisible pour quiconque doute encore que sa voix lui appartienne.

Sources : The Japan Times — Japanese anime actor fights TikTok over AI voice cloning — France 24 (AFP) — Japanese anime actor fights TikTok over AI voice cloning

Le fond disparu des vidéos Firefly

Adobe a mis à jour le 18 septembre son studio créatif Firefly avec une fonction de retrait d'arrière-plan appliquée à des clips vidéo entiers, qui détecte le sujet et supprime le fond sans passer par un masquage image par image. La génération d'images gagne aussi en format : GPT Image 2, le modèle d'OpenAI intégré à Firefly, passe de trois à dix formats d'image disponibles sur le web et dans les Boards, et la longueur des invites acceptées augmente sur les modèles d'image comme de vidéo. Les Boards, l'espace de moodboard collaboratif de Firefly, peuvent désormais s'appuyer sur des images de référence pour piloter Kling 3.0 Omni, le modèle vidéo du chinois Kuaishou, directement depuis l'interface d'Adobe. L'assistant IA intégré à Firefly voit par ailleurs son ton ajusté, décrit comme recentré sur le travail et les idées de la personne qui l'utilise plutôt que sur ses propres suggestions. Le retrait de fond automatisé, jusqu'ici réservé à la photo fixe, s'impose ainsi comme une étape de post-production à part entière, aussi utile pour détourer un sujet de tournage que pour préparer, en amont, le nettoyage du fond d'une pochette d'album avant l'impression.

Note éditoriale

Adobe ne cherche plus à gagner la course au meilleur modèle propriétaire : Firefly devient une couche d'orchestration qui héberge le modèle d'image d'OpenAI et le modèle vidéo d'un concurrent chinois sous un même toit d'interface. Le produit n'est plus l'algorithme, c'est le poste de travail qui choisit lequel appeler selon la tâche — une logique de chef d'orchestre plutôt que de soliste.

Le rotoscopage automatisé d'un clip entier retire une corvée réellement pénible, longtemps facturée à des spécialistes du détourage frame par frame ; c'est un vrai gain de temps, pas un raccourci créatif. Reste que choisir quel plan mérite d'être découpé, et pourquoi, continue de dépendre entièrement de la main qui monte le film — l'outil ne prend aucune de ces décisions à sa place.

Sources : Adobe Community — What's new in Adobe Firefly, septembre 2026

Le renfort visuel d'ElevenLabs

ElevenLabs a mis à jour le 21 septembre sa plateforme d'agents vocaux ElevenAgents pour permettre l'exécution parallèle de plusieurs outils en un seul tour de conversation, réduisant la latence perçue par l'utilisateur final. La liste des modèles de langage disponibles pour piloter ces agents s'enrichit de gpt-6-astra, aux côtés des options existantes. Plus notable pour la création visuelle : ElevenLabs intègre à son offre les modèles GPT Image 2.5 « Flare » et « Sunburst » d'OpenAI, capables d'accepter jusqu'à dix images de référence et de produire des sorties en 1K, 2K ou 4K selon cinq niveaux de qualité. Une entreprise connue pour la voix synthétique devient ainsi, sans avoir développé son propre modèle d'image, un point d'entrée supplémentaire vers la génération visuelle — une logique déjà à l'œuvre chez Adobe le même mois avec Kling. Les kits de développement JavaScript et Python suivent avec une nouvelle version, signe que l'orchestration d'agents capables de manier voix, texte et image à la fois devient la priorité produit, davantage que la course au modèle maison.

Note éditoriale

Le même mois, deux entreprises nées chacune sur un seul médium — la voix pour ElevenLabs, l'édition d'image pour Adobe — choisissent d'héberger le modèle d'un tiers plutôt que d'en construire un concurrent. La bataille se déplace de la fabrication du modèle vers l'assemblage : qui décide quel modèle traite quelle tâche devient une question aussi créative que technique.

Empiler des appels API ne fabrique pourtant aucune vision à soi. L'outil ne vaut que par la main qui le tient, et une plateforme d'orchestration reste un choix de plomberie, pas un choix esthétique — il serait prématuré d'y voir la promesse d'une direction artistique, même quand l'interface donne l'illusion d'en tenir une.

Sources : ElevenLabs — Changelog du 21 septembre 2026
Magic Bernard, Divine Machine — Studio Takuya
Magic Bernard, Divine Machine — Studio Takuya