IA Bulletin — 17 juillet 2026

Le plan de 30 secondes en une passe /
Une génération en rejet du slop /
Le mouvement humain généré à la souris

Seedance 2.5 entame son déploiement public, trente secondes d'un seul tenant

Annoncé le 23 juin à la conférence FORCE de Volcano Engine, Seedance 2.5 est entré dans sa fenêtre de lancement public : les applications maison Dreamina et Jimeng ouvrent la voie, avant l'intégration CapCut prévue à la mi-juillet et l'API développeurs en fin de mois. ByteDance a sauté les versions 2.1 à 2.4 pour marquer un saut générationnel : le modèle génère un plan continu de 30 secondes en une seule passe, sans assemblage de segments, là où la plupart des outils plafonnent entre 8 et 15 secondes. Il accepte jusqu'à 50 références multimodales — images, vidéos, audio, modèles 3D — pour verrouiller un personnage, un produit ou une palette sur toute la durée du clip. L'édition par région permet de retoucher un arrière-plan ou un détail sans regénérer le plan entier, un réflexe de production plus que de démonstration. Les filtres de contenu hérités du contentieux avec les studios hollywoodiens devraient être reconduits, et la tarification n'est toujours pas publiée.

Note éditoriale

Le plan-séquence de trente secondes déplace la difficulté : elle n'est plus dans le raccord des segments mais dans l'écriture du prompt, qui devient un vrai découpage. Un clip qui tient sans couture exige de penser la scène en amont — sujet, action, caméra, lumière — exactement comme un tournage. Les outils qui allègent la post-production alourdissent d'autant la préparation, et c'est plutôt une bonne nouvelle pour ceux qui savent préparer.

Sources : TechTimes — ByteDance Seedance 2.5 Launches This Week — TNW — ByteDance unveils Seedance 2.5 — XMK — How to Access Seedance 2.5

Christopher Nolan salue une génération qui rejette le slop

En pleine promotion de The Odyssey, Christopher Nolan a livré une charge remarquée contre le « slop » généré : il dit n'avoir « jamais vu un rejet aussi rapide et massif d'une technologie supposée fondatrice ». Le cinéaste s'appuie sur la réaction de la jeune génération, dont « le jugement a été immédiat et sévère », d'autant plus affûté qu'elle a grandi dans le monde en ligne qui a produit ces images. Il cite les succès de jeunes cinéastes derrière Obsession et Backrooms comme preuve d'un regain d'intérêt pour des formes de récit plus tactiles, plus réelles, après des années d'environnements virtuels lourds. Sans juger la technologie inutile, il estime qu'elle arrive « exactement au mauvais moment » pour la fabrication des films, et récuse le fatalisme de Matt Damon pour qui The Odyssey serait le dernier film de son espèce. Ce fossé entre l'adhésion des marchés et le rejet du public traverse toutes les disciplines visuelles, de l'affiche de film à la direction artistique d'un album, où la trace humaine redevient un argument.

Note éditoriale

Une technologie plébiscitée par les investisseurs et rejetée par son public : la configuration est rare, et Nolan a raison d'y voir un signal plutôt qu'une anecdote. La génération qui a vu naître le slop en ligne le reconnaît à l'œil nu — l'esthétique générique devient un repoussoir commercial. Reste une nuance : ce qui est rejeté est le slop, pas l'outil ; la différence se joue dans la main qui le tient.

Sources : Deadline — Christopher Nolan Praises Gen Z For Utterly Rejecting AI Slop — Variety — Nolan Slams AI Slop — Futurism — Christopher Nolan Unloads on AI Slop

ARDY génère le mouvement humain en temps réel, à la souris

Les chercheurs de NVIDIA publient ARDY, un modèle de diffusion autorégressive accepté à SIGGRAPH 2026 qui génère du mouvement humain en continu avec une latence moyenne de 33 millisecondes. Le système accepte des consignes texte modifiables en cours de génération et des contraintes cinématiques souples : trajectoires, keyframes corps entier, positions d'articulations éparses sur de longues durées. Sa représentation hybride combine des caractéristiques explicites de racine et un embedding latent du corps, conciliant contrôle précis de trajectoire et efficacité générative en quatre étapes de diffusion seulement. La démonstration interactive montre un personnage piloté à la souris et au clavier, changement de consigne à la volée compris, et le mouvement généré a été transposé sur le robot humanoïde Unitree G1 via des politiques de suivi physique. Code et modèles sont publiés, ouvrant la voie à la prévisualisation, à l'animation de personnages et à la performance en direct.

Note éditoriale

À 33 millisecondes, l'animation générée change de nature : ce n'est plus un rendu qu'on attend, c'est un instrument qu'on joue. Les musiciens connaissent ces seuils — en dessous d'une certaine latence on improvise, au-delà on programme. Faire entrer le mouvement de personnage dans cette zone ouvre la porte à des performances scéniques dirigées en direct, où l'avatar répond au geste comme un synthé répond au clavier.

Sources : NVIDIA Research — ARDY project page — arXiv — ARDY: Autoregressive Diffusion with Hybrid Representation — GitHub — nv-tlabs/ardy
Vegetarian Statement — Studio Takuya
Vegetarian Statement — Studio Takuya