IA Bulletin — 26 juin 2026

La barre des trente secondes franchie /
L'image qui raisonne avant de dessiner /
La bande-son générée d'un seul tenant

Seedance 2.5 franchit la barre des trente secondes

ByteDance a présenté Seedance 2.5 le 23 juin à la conférence FORCE de Volcano Engine, sa branche cloud destinée aux entreprises. Le modèle génère un plan unique de trente secondes sans recollage, avec changements de scène et variations de tempo intégrés à la même séquence. Il accepte jusqu'à cinquante références simultanées — images, audio, autres entrées — pour composer des scènes à plusieurs personnages. Une retouche après coup reste possible sur la vidéo produite, en conservant le style et le rendu d'origine. La bascule est annoncée en bêta entreprise, ouverture publique visée début juillet, pendant que Seedance 2.0 passe au 4K natif 10 bits.

Note éditoriale

Trente secondes d'un seul tenant, c'est moins une prouesse de durée qu'un changement d'échelle narrative : le plan cesse d'être une vignette pour devenir une séquence. Reste que la durée ne fabrique pas le sens — un plan long mal pensé n'est qu'un plan court répété. La vraie question est ailleurs : cinquante références injectées d'un coup, c'est aussi cinquante manières de diluer une intention dans la moyenne des entrées.

Sources : The Decoder — Seedance 2.5 franchit la barre des 30 secondes — ByteDance Seed — Seedance

Seedream 5.0 Pro mise sur l'image qui raisonne

Au même événement, ByteDance a dévoilé Seedream 5.0 Pro, son nouveau moteur d'image. Le studio revendique un glissement : passer d'un générateur qui exécute une consigne à un modèle qui observe, comprend et raisonne avant de produire. La déclinaison Seedream 5.0 Lite met en avant une étape de « réflexion » — lire l'intention, mobiliser des connaissances du monde — avant de dessiner ou d'écrire. Elle est déjà accessible sur Dreamina et le centre d'expérience Volcano Ark, tandis que la version Pro vise les usages professionnels. Pour qui travaille la direction artistique d'une pochette d'album, l'enjeu déclaré n'est plus la résolution brute mais la capacité du modèle à lire correctement une intention.

Note éditoriale

Vendre un modèle qui « raisonne » avant de dessiner, c'est déplacer la promesse du pixel vers l'interprétation — et c'est précisément là que se joue la valeur d'un directeur artistique. Un outil qui lit mieux un brief soulage l'exécution, il ne décide pas de ce qu'il faut montrer. Le risque est de confondre la docilité du modèle avec une justesse de regard.

Sources : ByteDance Seed — Seedream 5.0 Lite — The Decoder — Volcano Engine FORCE

Seed-Audio 1.0 génère la bande-son d'un seul tenant

Le troisième volet de la keynote est Seed-Audio 1.0, un modèle audio génératif complet. Il produit en une seule passe des dialogues multi-personnages aux voix et émotions distinctes, une musique d'ambiance accordée à l'humeur, des bruitages et des fonds sonores. Une génération couvre jusqu'à deux minutes, extensibles tout en préservant la cohérence des voix. Le modèle est exposé via API sur la plateforme Volcano Ark, pour la production de podcasts, de bandes vidéo courtes ou de prévisualisations sonores de film. Réunis, Seedance, Seedream et Seed-Audio dessinent une chaîne créative entière — vidéo, image, son — tenue par un seul fournisseur.

Note éditoriale

Trois modèles, une seule keynote, un seul fournisseur : l'événement raconte moins une avancée technique qu'un mouvement de consolidation. Quand la vidéo, l'image et le son sortent du même robinet, la dépendance se loge dans le confort. Pour un studio indépendant, l'intérêt d'une chaîne intégrée se paie d'une question simple : à qui appartient, demain, le tuyau par lequel passe toute la création ?

Sources : The Decoder — cinq modèles annoncés à FORCE — ByteDance Seed
Paris 15e — Studio Takuya
Paris 15e — Studio Takuya