Archive 28 septembre – 4 octobre 2026
Takuya Studio — IA Bulletin

FLUX 3 Image et la mise en page par coordonnées /
Suno, de la v6 à la parole /
ComfyUI, du workflow au service et à la conversation

Semaine des promesses de poids ouverts et des outils pilotés par la conversation. FLUX 3 Image place chaque élément par coordonnées, Ideogram 4.5 corrige sans dériver, Midjourney limite ses retouches aux pixels choisis et annonce un Thinking Mode, pendant que ComfyUI fait du workflow un service avec Comfy API puis un dialogue avec Comfy Agent. Côté son, Suno v6 reste au centre d'une seconde plainte d'Universal et Sony visant 60 202 enregistrements, Suno Speech ajoute la parole à la musique, ElevenLabs étend ses voix à plus de 90 langues et Stability AI mise sur la permission avant le catalogue. Entre-temps, un comédien japonais attaque TikTok pour un clonage vocal et Qobuz étiquette le morceau synthétique : le droit court encore après les modèles. Sept éditions, du 28 septembre au 4 octobre 2026.

28 septembre 2026
La voix volée de Kenjiro Tsuda / Le fond disparu des vidéos Firefly / Le renfort visuel d'ElevenLabs
Kenjiro Tsuda · procès inédit contre TikTok pour clonage vocal, plus de 200 000 abonnés sur le compte visé — Adobe Firefly · retrait d'arrière-plan sur clip vidéo entier, références Kling 3.0 Omni dans les Boards — ElevenLabs · modèles GPT Image 2.5 intégrés à la plateforme d'agents ElevenAgents
Le comédien japonais Kenjiro Tsuda poursuit TikTok devant le tribunal de Tokyo pour un clonage vocal par IA, ce qui serait la première action individuelle du genre au Japon. Adobe met à jour Firefly avec un retrait d'arrière-plan appliqué à des clips vidéo entiers et des références Kling 3.0 Omni dans les Boards. ElevenLabs intègre les modèles GPT Image 2.5 d'OpenAI à sa plateforme d'agents vocaux ElevenAgents.
29 septembre 2026
Dix secondes pour une voix / Kling 4.0 Flash et le plan de trente secondes / Suno v6 et l'arbre empoisonné
ElevenLabs · Eleven v4 et v4 Turbo, plus de 90 langues et clonage vocal en dix secondes — Kling · 4.0 Flash, 15 références et 10 images clés, accès Ultra annuel d'abord — Suno · v6 visé par Universal et Sony, 60 202 enregistrements cités
ElevenLabs lance Eleven v4 et v4 Turbo, des modèles de voix en plus de 90 langues avec clonage à partir de dix secondes d'audio. Kling dévoile Kling 4.0 Flash, réservé d'abord aux abonnés Ultra annuels, avant la version standard d'octobre. Universal et Sony déposent une seconde plainte contre Suno v6, dont l'entraînement sur les créations des utilisateurs a été confirmé.
30 septembre 2026
Qobuz et l'étiquette du morceau synthétique / AnyAngle, LanPaint et Vlo dans l'atelier ComfyUI / Unit1 et les avatars de scène
Qobuz · étiquette IA au niveau de l'album, 0,38 % des écoutes et 60 % de flux frauduleux — ComfyUI · AnyAngle, LanPaint 2.2.0 et Vlo 0.3 autour de Qwen-Image 2.1 — Unit1 · avatars de scène sur écrans LED, artistes disparus en ligne de mire
Qobuz étiquette les albums identifiés comme générés par IA et chiffre à 60 % la part de fraude sur leurs écoutes. Trois outils ComfyUI autour de Qwen-Image 2.1, AnyAngle, LanPaint et Vlo, arrivent le même jour. Unit1 lève 20 millions de dollars pour des concerts d'avatars.
1er octobre 2026
Ideogram 4.5 et la retouche sans dérive / HeyGen Video, la scène livrée avec son son / Comfy API et le workflow devenu service
Ideogram · modèle 4.5, retouche sur place jusqu'à 24 mégapixels — HeyGen · modèle vidéo avec son, 0,01 dollar la seconde en lancement — Comfy API · workflow ComfyUI en service qui s'adapte à la charge
Ideogram 4.5 vise la retouche d'image sans dérive de pixels, jusqu'à 24 mégapixels. HeyGen lance un modèle vidéo qui livre la scène avec son son en un seul appel. Comfy API transforme un workflow ComfyUI en service qui s'adapte à la charge.
2 octobre 2026
FLUX 3 Image et la mise en page par coordonnées / Comfy Agent, le workflow écrit en conversation / Recast et le casting remplacé dans le plan
FLUX 3 Image · placement par coordonnées, 16,8 mégapixels — Comfy Agent · workflows ComfyUI par conversation, sur le cloud — Recast · personnages remplacés dans une vidéo, 0,30 dollar la seconde
FLUX 3 Image place chaque élément d'une scène par coordonnées, avec dix références et 16,8 mégapixels. Comfy Agent construit les workflows ComfyUI par conversation, pour l'instant sur le cloud. Recast remplace les personnages d'une vidéo en conservant le mouvement et le son.
3 octobre 2026
Midjourney et la retouche sur les seuls pixels choisis / Suno Speech, la parole posée sur sa propre musique / Eleven v4 et la voix dirigée par balises
Midjourney · édits limités aux pixels sélectionnés, format de base conservé — Suno · Speech en bêta, parole et musique en une génération, plainte à 60 202 enregistrements — ElevenLabs · Eleven v4, plus de 90 langues, voix dirigée par balises
Midjourney retouche les seuls pixels sélectionnés et conserve le format de l'image de base. Suno lance Speech en bêta, parole et musique en une seule génération, au milieu d'un contentieux sur ses données d'entraînement. ElevenLabs publie Eleven v4 : voix dirigée par balises, plus de 90 langues.
4 octobre 2026
Midjourney et le Thinking Mode en approche / Stability AI et la permission avant le catalogue / Les poids ouverts promis aux modèles de retouche
Midjourney · Thinking Mode annoncé, V9 expérimental, sessions de plusieurs heures — Stability AI · Stable Audio 3.0, poids ouverts, plug-in et studio web en bêta — FLUX 3 Image et Ideogram 4.5 · poids ouverts promis, tarif de lancement jusqu'au 8 octobre
Midjourney annonce un Thinking Mode qui relance l'image quand le prompt échoue. Stability AI présente sa stratégie musicale, la permission avant le produit, avec des outils en bêta. FLUX 3 Image et Ideogram 4.5 promettent des poids ouverts, sans date ni licence publiées.