Créer l'extrait audio d'un livre avec l'IA

Le chapitre en PDF glissé sur le canvas : un node Texte en recopie l'ouverture mot pour mot, une voix de narrateur ElevenLabs la lit, une nappe instrumentale tourne dessous, et la couverture reste à l'écran dans un Montage 16:9 : la vidéo à mettre en ligne pour faire écouter le premier chapitre. Le workflow entier se voit sans compte.

Le premier chapitre du roman original, un PDF glissé dans le node MédiaDémo interactive

Vrai workflow, résultats réels. Déplacez-vous et zoomez librement.

Utiliser ce workflow

Le vrai workflow : le premier chapitre d'un roman en PDF dans un node Média, Claude Sonnet 5 qui recopie l'ouverture, ElevenLabs v3 pour la narration, ElevenLabs Music pour la nappe, GPT Image 2.5 Flare pour la couverture, un node Montage. Les textes affichés sont les réponses des modèles, sans retouche.

En bref

Vous fournissez
1 PDF · un texte ou un brief
Ce que le workflow produit
1 image en 3:4 · 1 piste audio de 60 s au total · 1 voix off
Structure du canvas
8 nodes reliés par 6 liaisons
Modèles câblés
Claude Sonnet 5, ElevenLabs v3, ElevenLabs Music, GPT Image 2.5 Flare
Coût d'un passage complet
environ 97 crédits, soit 0,97 €
Compte
La démo se voit sans compte ; générer demande un compte gratuit, crédits d'essai compris

Faire écouter le premier chapitre est la meilleure publicité d'un livre. Le PDF entre dans un node Média, et un node Texte le lit par son port « Image ou PDF à analyser » pour recopier l'ouverture mot pour mot, sans rien réécrire, jusqu'à la fin d'un paragraphe avant 1 400 caractères : la longueur d'une lecture d'une minute et demie.

Le node Voix off lit ce texte câblé avec ElevenLabs v3, une voix de narrateur choisie dans la liste. Le node Musique compose soixante secondes de nappe instrumentale sur un brief câblé, bouclées dans le Montage à volume bas. Le node Image dessine la couverture avec le titre sur GPT Image 2.5 Flare, et le Montage la garde entière, sur fond noir, le temps de la narration.

La démo lit l'ouverture de « North of Silence », un roman original écrit pour l'exemple. Remplacez le PDF par votre chapitre, la voix dans le node, le titre dans le prompt de couverture. Un chapitre entier se lit en plusieurs nodes Voix off de 3 000 caractères, mis bout à bout dans le Montage. La couverture et la bande-annonce complètent la série.

Rendus réels de la démo

Ce sont les fichiers du workflow ci-dessus, tels que les modèles les ont produits, sans retouche. Le point de départ est indiqué quand il y en a un.

Rendu

La narration de l'ouverture du chapitre, lue par ElevenLabs v3 avec la voix GeorgeGénéré avec ElevenLabs v3
La nappe instrumentale de soixante secondes composée par ElevenLabs Music, bouclée sous la voixGénéré avec ElevenLabs Music
La couverture avec le titre, dessinée par GPT Image 2.5 Flare, posée entière dans le MontageGénéré avec GPT Image 2.5 Flare
L'extrait monté : la couverture à l'écran, la narration et la nappe, prêt à mettre en ligne

Pour qui

Auteurs et éditeurs qui veulent faire écouter un premier chapitre sans studio ni comédien, ou tester une voix avant un livre audio complet.

Quels fichiers fournir

Un chapitre en PDF texte, pas un scan : le node Texte recopie la prose telle quelle et la voix la lit phrase pour phrase.

Comment faire

  1. 1

    Glissez le chapitre en PDF

    Un node Média le reçoit. Le node Texte recopie l'ouverture, pas un résumé : c'est votre prose qui est lue, phrase pour phrase, jusqu'à la fin d'un paragraphe.

  2. 2

    Choisissez la voix et lisez

    Le node Voix off reçoit le texte par câble. Une vingtaine de timbres ElevenLabs v3, ou une voix clonée : la démo utilise George, un narrateur posé. Une balise [pause] ou [whispers] dans le texte guide le jeu.

  3. 3

    Composez la nappe et dessinez la couverture

    Le node Musique compose soixante secondes sur le brief câblé, instrumental. Le node Image écrit le titre dans la couverture en 3:4, deux crédits. Les deux se refont sans toucher à la narration.

  4. 4

    Montez et mettez en ligne

    Le Montage pose la couverture entière sur fond noir en 16:9, la narration sur une piste, la nappe bouclée à volume bas sur l'autre, avec un fondu final. Rendu dans le navigateur, sans crédit, export en mp4.

Variantes et cas d'usage

Le même canvas, réglé pour des besoins différents : chaque variante tient en deux ou trois lignes de prompt à changer.

L'extrait du premier chapitre

C'est la démo : l'ouverture recopiée mot pour mot, une voix de narrateur, une nappe, la couverture à l'écran. Remplacez le PDF et le titre, gardez le reste, et la vidéo se refait pour votre livre.

Le chapitre complet en plusieurs prises

Un node Texte par tranche de 3 000 caractères, un node Voix off chacun, tous dans le même Montage : un chapitre de quinze minutes se lit en une dizaine de nodes, la nappe bouclée dessous.

L'extrait lu par l'auteur

Clonez votre voix dans un node Voix off depuis une minute d'enregistrement, puis choisissez-la pour la narration : le premier chapitre est lu par vous, sans studio.

La version podcast, sans image

Retirez le node Image et le Montage : la narration et la nappe s'exportent en mp3 depuis les nodes, pour une plateforme de podcast ou la page du livre.

L'extrait en plusieurs langues

Demandez au node Texte de traduire la tranche, réglez la langue du node Voix off, gardez la couverture : la même vidéo existe en anglais, en espagnol, en allemand, avec la même voix.

Erreurs fréquentes

Un résumé à la place du texte

La consigne dit de recopier la prose exactement. Si le modèle résume, il a lu un PDF scanné sans texte : passez le manuscrit en PDF texte, pas en images de pages.

Une nappe qui couvre la voix

La musique est à 0,25 dans le Montage pour rester sous la narration. Une nappe avec une mélodie marquée attire l'oreille : demandez au brief un fond sans thème, sans percussions.

La couverture recadrée

Le Montage est réglé pour contenir l'image entière sur fond noir. En mode couvrir, une couverture 3:4 perd son titre en haut et en bas : gardez contenir pour un extrait.

Modèles recommandés

Questions fréquentes

Peut-on lire un chapitre entier ?

Oui, par tranches : un node Voix off lit jusqu'à 3 000 caractères. Demandez au node Texte la tranche suivante, dupliquez le node Voix off, et posez les tranches bout à bout dans le Montage. Le prix suit les caractères lus.

Combien coûte l'extrait ?

Une soixantaine de crédits pour la démo : la narration de 1 400 caractères (une douzaine de crédits), la nappe de soixante secondes (une cinquantaine), la couverture (deux) et la lecture du PDF (deux à trois). Le prix s'affiche sur chaque node avant de cliquer.

La voix respecte-t-elle la ponctuation ?

Oui : ElevenLabs v3 marque les virgules, les points et les paragraphes séparés par une ligne vide. Pour une pause plus longue, la balise [pause] ; pour un murmure, [whispers]. Les balises ne sont pas lues.

Quelle longueur pour un extrait ?

Une minute et demie à deux minutes, soit 1 400 à 1 800 caractères : assez pour installer une voix et une scène, court pour être écouté en entier sur un téléphone.

Peut-on changer la voix après coup ?

Oui, sur le node Voix off, sans regénérer le texte : choisissez un autre timbre et relancez la lecture, le Montage se met à jour.

Faut-il une couverture ?

Non, un clip image quelconque suffit au Montage : une photo de l'auteur, une illustration du lieu. La couverture avec le titre reste ce qui se partage le mieux.

Où mettre la vidéo ?

Sur la page du livre, sur les réseaux, en épisode zéro d'un podcast : le mp4 sort en 16:9, 1080p, avec le son mixé. Un Montage en 9:16 fait la version verticale.

Créer l'extrait audio d'un livre avec l'IA

Utiliser ce workflow

Compte gratuit, sans carte bancaire. Le workflow s'ouvre pré-rempli dans votre canvas.