Microsoft hisse MAI-Image-2.5 au sommet de l'édition d'image
Microsoft a confirmé le 17 juin la disponibilité de MAI-Image-2.5, sommet actuel de sa famille maison de sept modèles MAI dévoilée à la conférence Build 2026, qui réunit la génération texte-vers-image et l'édition image-vers-image dans un seul système de diffusion. Le modèle se classe deuxième sur le banc « édition » de l'Arena, devant Nano Banana 2.1, et troisième en texte-vers-image avec un score d'environ 1 254 points, en hausse de soixante-douze points sur la version précédente. Microsoft livre deux variantes : une version haute fidélité et une version Flash trois fois moins chère en sortie, pensée pour les pipelines à fort volume. L'accent est mis sur les retouches chirurgicales — suppression d'objet, remplacement de texte, cohérence d'identité et de composition d'une itération à l'autre —, un terrain qui rejoint le travail réel sur l'identité visuelle d'un album. Le modèle est déjà déployé dans PowerPoint, OneDrive et Bing, signe que Microsoft le traite comme une infrastructure de production et non comme une démonstration.
Le signal n'est pas le classement mais le glissement de terrain : la bataille de l'image quitte la génération pure pour l'édition fine, là où se joue le travail quotidien d'un studio. Un modèle qui tient l'identité d'un visage ou d'une typographie sur dix retouches successives vaut davantage qu'un modèle qui éblouit sur une seule invite. Que Microsoft cesse de tout router vers OpenAI pour pousser sa propre fonderie dans ses logiciels grand public dit aussi combien l'image générée est devenue un actif stratégique.