IA Bulletin — 2 octobre 2026

FLUX 3 Image et la mise en page par coordonnées /
Comfy Agent, le workflow écrit en conversation /
Recast et le casting remplacé dans le plan

FLUX 3 Image et la mise en page par coordonnées

Black Forest Labs met en ligne FLUX 3 Image, un modèle d'image et d'édition qui place chaque élément d'une scène selon des coordonnées sur une grille de 0 à 1000. Chaque élément reçoit un identifiant, une description et une boîte au format [y_min, x_min, y_max, x_max], et le modèle accepte jusqu'à dix images de référence citées directement dans le prompt. La sortie atteint environ 16,8 mégapixels, soit près de 5 456 × 3 072 pixels, générés en natif et sans agrandissement séparé qui risquerait d'abîmer le texte ou les détails fins. Les retouches par région laissent, selon l'éditeur, les pixels extérieurs à la boîte strictement identiques, un point qui compte pour la mise en page d'une pochette de disque, où le titre doit rester à sa place d'un essai à l'autre. L'accès se fait par un terrain de jeu et une API avec une remise de 50 % jusqu'au 8 octobre, une licence commerciale de poids existe pour l'auto-hébergement, et une version à poids ouverts est annoncée sous quelques semaines, sans date précise.

Note éditoriale

Désigner un objet par une boîte et un identifiant, plutôt que par une phrase, ramène la génération d'image vers la composition : on dit où, avant de dire quoi. Pour un graphiste habitué à la grille, la logique est familière, et c'est peut-être la première fois qu'un modèle parle sa langue de repères et de marges.

La promesse d'un reste de l'image inchangé au bit près est celle du fichier livrable, pas de la démonstration. Elle reste une affirmation de l'éditeur, et la version à poids ouverts, si elle arrive, permettra de la vérifier sur sa propre machine.

Sources : AlphaSignal — FLUX 3 Image place les objets par coordonnées exactes — Black Forest Labs — Release notes — The Neuron — Everything That Happened in AI Today (1er octobre 2026)

Comfy Agent, le workflow écrit en conversation

Comfy lance Comfy Agent, un assistant intégré à ComfyUI qui planifie, construit, exécute et débogue des workflows à partir d'une description en langage courant. L'agent modifie le canevas en temps réel avec l'utilisateur, comprend visuellement les images du projet et gère jusqu'à cinq conversations en parallèle, chacune avec son historique complet. Il est disponible dès maintenant sur Comfy Cloud, consomme des crédits Comfy pour les jetons de langage, et des jetons gratuits sont offerts aux nouveaux comptes. Par défaut, il demande une confirmation avant de lancer une génération, et il se limite pour l'instant aux nœuds pris en charge par le cloud. Le support local, pour un GPU personnel et des nœuds personnalisés, est seulement annoncé comme « bientôt » sans date, ce qui laisse hors champ la partie la plus ouverte de l'écosystème.

Note éditoriale

Un workflow ComfyUI est un objet étrange : à la fois un graphe de nœuds et une manière de penser l'image. Confier son montage à un agent qui dialogue déplace l'effort de la connexion des câbles vers la formulation de l'intention, ce qui peut débloquer les débutants et agacer ceux pour qui le câblage fait partie du geste.

L'absence de version locale pèse dans la balance : c'est la machine personnelle, avec ses modèles ouverts et ses nœuds maison, qui faisait l'intérêt de ComfyUI pour les praticiens soucieux de leurs données. Tant que l'agent vit sur le cloud, il relève du service plus que de l'outil.

Sources : Comfy — Comfy Agent — The Neuron — Everything That Happened in AI Today (1er octobre 2026)

Recast et le casting remplacé dans le plan

fal propose Recast, une variante du modèle MiniMax H3 Max qui remplace les personnes principales d'une vidéo par celles de photos de référence, en les suivant d'un plan à l'autre. Le modèle conserve, selon la page du service, le mouvement, les gestes, la caméra, le rythme des plans et la bande-son d'origine. Les limites sont de quatre photos de référence, trente secondes de vidéo au total et quinze secondes par plan, en 768p ou en 1080p. Le tarif est de 0,30 dollar la seconde en 768p et de 0,45 dollar en 1080p, sans surcoût pour les images de référence, et l'usage commercial est autorisé. La page ne dit rien du consentement des personnes dont le visage est substitué ni d'un marquage des vidéos produites, deux points que les sources consultées ne précisent pas.

Note éditoriale

Remplacer un interprète en gardant son jeu, sa lumière et son montage ressemble à de la postproduction rêvée : refaire un plan sans le retourner. Pour un clip ou une publicité, l'intérêt est réel, à condition que la personne choisie ait donné son accord et sache ce que son image devient.

Le même outil sert à l'hommage comme à l'usurpation, et rien dans la page de présentation ne distingue les deux. Cette absence de garde-fous visibles est moins un défaut technique qu'une question de pratique professionnelle : contrat, mention, traçabilité.

Sources : fal — MiniMax H3 Max Recast — The Neuron — Everything That Happened in AI Today (1er octobre 2026)
1807-it-time — Studio Takuya
1807-it-time — Studio Takuya