Le studio audio complet de Firefly
Adobe a fait sortir de bêta le 20 août ses trois outils audio Firefly — Generate Music, Generate Speech et Generate Sound Effects — désormais ouverts à tous sur web et sur mobile. Generate Music s'appuie sur le Firefly Music Model : l'outil lit une vidéo, rédige un prompt éditable puis renvoie quatre pistes dont le tempo, l'énergie et la durée se calent sur la longueur du montage. Generate Speech tourne sur le Firefly Speech Model, avec les modèles ElevenLabs Multilingual v2 disponibles en option dans un menu déroulant, un contrôle du rythme et de l'émotion, des balises de prononciation et un export en .wav sur plus de vingt langues. Generate Sound Effects accepte une description écrite ou une performance vocale comme référence, et analyse le minutage de la scène pour caler le bruitage sur l'image. L'argument central n'est pas la qualité sonore mais la licence : Adobe vend une sortie commercialement exploitable sans risque de retrait pour violation de droits, et n'a toujours pas publié le coût en crédits d'une génération audio.
Le produit ici n'est pas le son, c'est le document juridique qui l'accompagne. Un monteur qui pose une nappe sous un plan ne cherche pas la plus belle nappe du marché, il cherche celle qui ne fera pas tomber sa vidéo trois semaines après la mise en ligne — et Adobe a compris avant les autres que cette angoisse-là se facture à l'abonnement.
Reste que la qualité musicale d'un modèle entraîné sur du catalogue autorisé a un plafond, et que ce plafond s'entend. Ces outils excellent sur la musique fonctionnelle, celle qui doit remplir un fond sans jamais attirer l'attention ; ils sont sans intérêt dès qu'un morceau doit porter quelque chose. La séparation entre musique-décor et musique-propos, longtemps floue par commodité, est en train de devenir une frontière industrielle nette.