Suno Speech et la voix portée par sa musique
Le 1er octobre, Suno a lancé en bêta Speech, son premier modèle audio qui génère une voix parlée et une musique de fond originale en une seule prise. L'utilisateur saisit un texte, poème, idée ou note, puis choisit la voix et le style musical souhaités, directement dans la plateforme de Suno. Le modèle a d'abord été testé auprès d'un groupe restreint avant d'être ouvert à la communauté, et l'entreprise cite parmi ses usages les lectures dramatisées, les notes vocales enrichies, les méditations, les poèmes, les discours d'encouragement et les histoires du soir. L'annonce reconnaît des défauts de jeunesse : les accents britanniques peuvent « dériver vers l'Australie avant de revenir », et les pauses dramatiques peuvent l'être très dramatiquement. Suno présente ce modèle comme un pas hors de la chanson, vers un « divertissement créatif » où la voix et son habillage sonore naissent ensemble.
Une voix et son décor sonore livrés d'un seul bloc déplacent la frontière entre lecture, chanson et bande-son : le poème dit sur un lit musical devient un format à part entière.
Pour un musicien, la question est celle du mixage. Une voix et une musique nées ensemble ne se séparent pas, et le geste de studio qui pose l'une sur l'autre disparaît. Les accents qui errent rappellent que la bêta est une bêta.