Suno lance Speech et génère voix et musique ensemble

D'après The Verge (2 octobre 2026 à 11h42)

Résumé

Suno lance Speech, une fonction en bêta publique qui génère des voix parlées avec ou sans musique d’accompagnement sur web et mobile.

Les faits

Suno élargit son offre au-delà de la génération musicale avec Speech, une fonctionnalité capable de produire des voix parlées à partir d’un script ou d’une description. Disponible en bêta publique sur les plateformes web et mobiles de Suno, elle permet de générer simultanément une voix off et une musique d’accompagnement. « La musique sera toujours au cœur de Suno et de ce que nous construisons. En même temps, notre vision s’est toujours étendue à d’autres formes d’expression humaine », a déclaré Jack Brody, directeur produit de Suno. Il présente Speech comme « le premier modèle audio qui génère la voix et la musique ensemble dans une piste cohérente ». La musique d’accompagnement reste facultative et peut être désactivée à l’aide d’un bouton. Suno cite notamment les poèmes accompagnés d’une bande sonore apaisante, les voix off dramatiques et les discours d’encouragement parmi les usages possibles. La durée maximale d’une génération est d’environ huit minutes. La fonction se trouve dans l’onglet « Create », puis dans l’option Speech. Le mode Simple permet de décrire le résultat souhaité dans une zone de texte, tandis que le mode Advanced accepte un script personnalisé. Les réglages avancés permettent aussi d’ajuster le genre de la voix, le style de diction et le niveau de variété entre les générations.

Pourquoi c’est important

Avec Speech, Suno applique son savoir-faire en génération musicale à la parole synthétique, en réunissant voix et musique dans une même piste. Cette approche distingue la fonction des outils de synthèse vocale centrés sur la production d’une voix seule. Le lancement élargit les usages potentiels de la plateforme aux poèmes, aux voix off et aux discours. Suno reconnaît toutefois que la fonction reste perfectible : « La bêta signifie vraiment bêta ». Selon Jack Brody, les accents britanniques peuvent parfois dériver vers l’Australie et les pauses dramatiques devenir très marquées.

Questions fréquentes

Qu’est-ce que Speech de Suno ?

Speech est une fonction qui génère des voix parlées à partir d’un script ou d’une description, avec la possibilité d’ajouter une musique d’accompagnement.

Où Speech est-il disponible ?

Speech est disponible en bêta publique sur les plateformes web et mobiles de Suno.

Quelle est la durée maximale d’une génération ?

Speech permet de générer des contenus d’une durée maximale d’environ huit minutes.

Peut-on désactiver la musique ?

Oui. La musique d’accompagnement est facultative et peut être désactivée à l’aide d’un bouton.

Quels réglages sont proposés ?

Le mode Advanced permet d’utiliser un script personnalisé et d’ajuster le genre de la voix, son style de diction et la variété des générations.

Source

The Verge

Auteur

Rédaction IA-Medias

Rédaction spécialisée dans la veille et l’analyse de l’actualité de l’intelligence artificielle, des puces IA, des robots, des agents IA et de la recherche.