IA Bulletin — 1er octobre 2026

Ideogram 4.5 et la retouche sans dérive /
HeyGen Video, la scène livrée avec son son /
Comfy API et le workflow devenu service

Ideogram 4.5 et la retouche sans dérive

Ideogram propose son modèle 4.5, présenté comme le modèle d'édition le plus précis de la maison, conçu pour limiter la dérive des pixels, des couleurs et des textures d'une retouche à l'autre. La page du modèle met en avant l'édition en plusieurs tours, la retouche guidée par une image de référence et la modification sur place en haute résolution, sans réduire l'image au préalable. La démonstration porte sur un fichier de 4 016 × 6 016 pixels, soit environ 24 mégapixels, dont la zone modifiée se réintègre à l'original en conservant les bornes du recadrage. Les usages cités vont de la traduction du texte inscrit dans l'image à la restauration de photographies anciennes, du croquis vers l'image à la profondeur vers l'image, avec une version web et une API facturée à part. Aucun tarif n'est détaillé sur cette page et la tenue de la précision ne repose que sur les exemples du fabricant, ce qui reste à éprouver lors de la retouche d'une pochette d'album, où une lettre déformée saute aux yeux.

Note éditoriale

Retoucher sans abîmer le reste est une promesse ancienne, que chaque outil génératif a rompue à sa manière : on corrige une main, et le grain du ciel change. Un modèle qui revendique la fidélité des pixels intacts déplace la question, de l'invention vers la discipline, ce qui intéresse davantage ceux qui livrent des fichiers que ceux qui collectionnent des démonstrations.

La mention d'un fichier de 24 mégapixels travaillé sans réduction compte pour l'impression et l'édition, où le format de sortie décide de tout. Reste que l'exemple choisi par l'éditeur est, par construction, celui qui lui réussit ; la retouche qui échoue n'a pas de page de présentation.

Sources : Ideogram — Ideogram 4.5, le modèle d'édition le plus précis — The Neuron — Everything That Happened in AI Today (30 septembre 2026)

HeyGen Video et la scène livrée avec son son

HeyGen présente son premier modèle vidéo généraliste, qui produit une scène entière, image et son synchronisé, en un seul appel d'API à partir d'un prompt, d'une première image ou de références. Selon la synthèse quotidienne de The Neuron, un clip de dix secondes en image vers vidéo se génère en 3,7 secondes. Le tarif de lancement relevé par cette même source est de 0,01 dollar la seconde jusqu'à la fin octobre, contre 0,03 dollar au tarif public. La page développeurs signale un film de lancement, des benchmarks et des clips d'exemple, mais ces mesures émanent du fabricant et aucune évaluation indépendante n'est citée. Pour un vidéaste, l'intérêt tient à la bande-son produite avec l'image, qui évite l'assemblage séparé du dialogue et des bruitages, sans que la qualité de ce son ait pu être vérifiée dans les sources consultées.

Note éditoriale

Une scène qui arrive avec son son change la nature du brouillon : ce qui était un plan muet à sonoriser devient un tout déjà orienté, avec ses choix d'ambiance et de voix que personne n'a décidés. La vitesse annoncée, quelques secondes pour dix de film, favorise la multiplication des essais plus que la maturation d'une intention.

Le tarif à 0,01 dollar la seconde jusqu'en octobre est un prix d'appel, et il dit surtout la bataille pour s'installer dans les outils des équipes. La question reste celle du regard : un générateur généraliste fournit une moyenne vraisemblable, qu'il appartient à une direction artistique de contredire.

Sources : HeyGen — Developers, HeyGen Video — The Neuron — Everything That Happened in AI Today (30 septembre 2026)

Comfy API et le workflow devenu service

Comfy API transforme un workflow ComfyUI en point d'accès de production qui s'adapte automatiquement à la charge, sans ingénierie dédiée selon le fabricant. Le service empaquette dans une même construction reproductible les nœuds personnalisés, les modèles, les LoRA, les dépendances Python et la version épinglée de ComfyUI. La facturation se fait à la seconde, avec des GPU allant de la RTX PRO 6000 à 4,54 dollars l'heure jusqu'au B200 à 11,23 dollars, et 0,20 dollar par gigaoctet et par mois de stockage. Quatre formules, Standard, Creator, Pro et Team, plafonnent le nombre de déploiements, de deux à vingt, et les charges inactives retombent à zéro d'après The Neuron. La page ne précise ni date de lancement ni disponibilité, et la commodité a pour revers un workflow qui quitte la machine de l'artiste pour des GPU loués, même si la même source indique qu'il peut revenir sur du matériel possédé.

Note éditoriale

Un workflow ComfyUI est souvent le résultat de semaines de réglages, un geste d'atelier plus qu'un simple fichier. Le figer en service reproductible lui donne une existence industrielle, utile à une équipe qui doit retrouver le même rendu d'une semaine sur l'autre, au risque de verrouiller ce qui devait rester un terrain d'essais.

Pour les modèles ouverts et locaux, la souveraineté tenait à la machine sous le bureau ; la location de GPU à la seconde en déplace le centre de gravité vers le fournisseur. L'option de retour sur matériel possédé tempère le constat, sans le supprimer : la dépendance se mesure à la facilité de sortie, que seul l'usage prouvera.

Sources : Comfy — Comfy API — The Neuron — Everything That Happened in AI Today (30 septembre 2026)
Growth — Studio Takuya
Growth — Studio Takuya