Midjourney et le Thinking Mode en approche
Lors de ses « office hours » du 30 septembre, Midjourney a annoncé pour les jours suivants un Thinking Mode qui relance la génération quand le prompt donne un résultat en deçà de la demande, selon la synthèse de la lettre Creativity AI. Les résultats varient fortement selon la complexité du prompt, et l'équipe envisage ensuite des niveaux de réflexion réglables, voire un mode automatique. Le modèle V9 existe en version expérimentale mais apporte des gains moindres que ce mode, ce qui laisse entier le problème de tenir ensemble fidélité au prompt et qualité esthétique sans sacrifier l'une à l'autre. Sont aussi annoncés un transfert de style renforcé pour le modèle d'édition, des contrôles de caméra mieux articulés avec les références multiples, utiles pour constituer les références visuelles d'une pochette d'album, et un upsampler amélioré dont les défauts de cohérence persistent. Midjourney expérimente enfin des sessions de création longues, de l'instantané à des tâches de fond d'environ douze heures, avec un tarif évoqué autour de 100 dollars pour une vidéo complexe, une hypothèse et non une grille officielle.
Relancer une image tant que le prompt ne tient pas revient à confier à la machine une itération que le graphiste faisait à l'œil. Le gain est réel pour qui produit des séries, à condition que la relance corrige l'intention plutôt que de ramener le résultat vers la moyenne.
Les sessions de douze heures à cent dollars relèvent pour l'instant de la conversation d'atelier. Reste à savoir qui juge qu'une image est enfin juste : le modèle, ou la main qui le dirige.