IA Bulletin — 4 octobre 2026

Midjourney et le Thinking Mode en approche /
Stability AI et la permission avant le catalogue /
Les poids ouverts promis aux modèles de retouche

Midjourney et le Thinking Mode en approche

Lors de ses « office hours » du 30 septembre, Midjourney a annoncé pour les jours suivants un Thinking Mode qui relance la génération quand le prompt donne un résultat en deçà de la demande, selon la synthèse de la lettre Creativity AI. Les résultats varient fortement selon la complexité du prompt, et l'équipe envisage ensuite des niveaux de réflexion réglables, voire un mode automatique. Le modèle V9 existe en version expérimentale mais apporte des gains moindres que ce mode, ce qui laisse entier le problème de tenir ensemble fidélité au prompt et qualité esthétique sans sacrifier l'une à l'autre. Sont aussi annoncés un transfert de style renforcé pour le modèle d'édition, des contrôles de caméra mieux articulés avec les références multiples, utiles pour constituer les références visuelles d'une pochette d'album, et un upsampler amélioré dont les défauts de cohérence persistent. Midjourney expérimente enfin des sessions de création longues, de l'instantané à des tâches de fond d'environ douze heures, avec un tarif évoqué autour de 100 dollars pour une vidéo complexe, une hypothèse et non une grille officielle.

Note éditoriale

Relancer une image tant que le prompt ne tient pas revient à confier à la machine une itération que le graphiste faisait à l'œil. Le gain est réel pour qui produit des séries, à condition que la relance corrige l'intention plutôt que de ramener le résultat vers la moyenne.

Les sessions de douze heures à cent dollars relèvent pour l'instant de la conversation d'atelier. Reste à savoir qui juge qu'une image est enfin juste : le modèle, ou la main qui le dirige.

Sources : Creativity AI #95 — Midjourney plans Thinking Mode (1er octobre 2026)

Stability AI et la permission avant le catalogue

Sean Parker, président exécutif de Stability AI, a exposé le 2 octobre à The Information la stratégie musicale de la société, en reconnaissant que Napster avait fonctionné en demandant pardon plutôt que permission, là où Stability affirme désormais obtenir l'autorisation avant de construire le produit. La société a levé 76 millions de dollars en août, avec Sony, Universal et Warner parmi les investisseurs, et sa famille Stable Audio 3.0 compte trois variantes aux poids ouverts, le modèle Medium produisant jusqu'à 6 minutes 20 tandis que la version Large reste réservée à l'API. Un plug-in AU et VST3 pour macOS et un studio web, tous deux en bêta, génèrent des pistes instrumentales à partir de texte avec des réglages de mixage, et Parker annonce une fonction pour fredonner une mélodie ou battre un rythme qui guiderait la génération, sans date. Le récit d'un catalogue licencié par les trois majors reste à nuancer, puisque seuls des partenariats avec Universal et Warner sont documentés d'après le recoupement de Progressive Robot, Sony apparaissant comme investisseur sans accord annoncé. Les variantes Small et Medium se téléchargent sur Hugging Face, avec réglage fin par LoRA et intégration à ComfyUI, alors que le prix des outils n'est pas publié.

Note éditoriale

Obtenir la permission avant de construire est une position plus défendable que celle de Napster, mais une licence de catalogue ne dit rien de l'oreille de celui qui dirige l'outil. Les poids ouverts et le réglage fin par LoRA offrent en revanche une prise concrète : entraîner un modèle sur sa propre matière sonore.

Entre le récit de trois majors alignées et les partenariats que la presse parvient à documenter, l'écart mérite d'être gardé en tête tant que les tarifs et les conditions d'usage ne sont pas publiés.

Sources : Gokhshtein — Sean Parker’s AI Music Pivot (2 octobre 2026) — Progressive Robot — Stability AI Music, Sean Parker’s rebuild (3 octobre 2026) — Decrypt — ElevenLabs, Stability AI drop new AI music models (27 mai 2026)

Les poids ouverts promis aux modèles de retouche

Black Forest Labs et Ideogram promettent chacun des poids ouverts pour leurs modèles de retouche à préservation de pixels, sans calendrier précis. Pour FLUX 3 Image, lancé le 1er octobre, les entreprises peuvent déjà acheter les poids pour un déploiement interne et un réglage fin, tandis qu'une version publique est annoncée « dans les prochaines semaines ». En attendant, l'accès passe par l'API de BFL avec un tarif de lancement de 0,0205 dollar par image de 768 pixels jusqu'au 8 octobre, environ doublé ensuite, la grille publiée allant de 0,041 à 0,607 dollar du 768 pixels à la 4K. Ideogram 4.5 s'échelonne de 0,008 à 0,22 dollar la retouche selon le niveau de qualité, un écart de 27 fois qui illustre la même logique d'appel à l'API avant toute exécution en local. Les annonces consultées n'indiquent ni la licence ni la taille de ces versions ouvertes, deux informations qui décideront de leur exécution sur une carte graphique ordinaire.

Note éditoriale

Une promesse de poids ouverts n'est pas un téléchargement : tant que la licence, la taille du modèle et la date manquent, elle reste un argument commercial. Pour qui travaille en local, le critère n'est pas la préservation de 67,8 à 89,7 % des pixels annoncée par l'éditeur, mais la possibilité de faire tourner l'outil sur sa propre carte graphique.

Les tarifs d'appel valables jusqu'au 8 octobre montrent aussi que l'accès par l'API précède l'ouverture, et que celle-ci reste à vérifier le jour où les fichiers seront en ligne.

Sources : TechTimes — Black Forest Labs launches Flux 3 Image (2 octobre 2026) — Black Forest Labs — Release notes (FLUX 3 Image, 1er octobre 2026) — AlphaSignal — Ideogram 4.5 fights edit drift
2007-post-004 — Studio Takuya
2007-post-004 — Studio Takuya