Un monde généré par diffusion tourne à 31 images par seconde
Une équipe de recherche publie AlayaRenderer-Flash, une déclinaison temps réel du Generative World Renderer qui fait bondir un moteur de rendu par diffusion de 0,56 à 31,54 images par seconde sur une seule carte H200. Le modèle est reformulé en rendu autorégressif en flux continu de quatre étapes, épaulé par un encodeur de G-buffer distillé et un décodeur VAE allégés. Les contrôles par G-buffer et par prompt textuel sont conservés, tandis que la mémoire vidéo de pointe redescend à 16,2 Go, à portée d'une station de travail sérieuse. La démonstration fait tourner le jeu SuperTuxKart à 30 images par seconde soutenues, avec des styles visuels commutables par prompt en pleine partie. Après les world models cantonnés aux laboratoires, c'est le rendu neuronal jouable qui sort de la vidéo précalculée pour entrer dans l'interaction directe.
Trente images par seconde sur une carte, c'est la frontière où l'image générée cesse d'être un plan pour devenir un espace. Pour les installations interactives et la performance visuelle en direct, un rendu par diffusion pilotable au prompt en pleine séquence ouvre une voie qui contournait jusqu'ici les moteurs 3D classiques. Le détail qui compte est ailleurs : les contrôles G-buffer sont conservés, donc la géométrie reste dirigeable — le hasard génératif sous contrainte, exactement là où se joue l'écriture visuelle.