Создать аудиофрагмент книги с помощью ИИ

Глава в PDF, перетащенная на холст: узел «Текст» копирует её начало слово в слово, голос рассказчика ElevenLabs его озвучивает, под ним звучит инструментальная подложка, а обложка остаётся на экране в Монтаже 16:9: видео, готовое к публикации, чтобы дать людям послушать первую главу. Весь рабочий процесс виден без учётной записи.

Первая глава оригинального романа, PDF, перетащенный в узел «Медиа»Интерактивное демо

Настоящий воркфлоу, реальные результаты. Двигайте холст и приближайте как угодно.

Использовать этот воркфлоу

Реальный рабочий процесс: первая глава романа в PDF в узле «Медиа», Claude Sonnet 5 копирует начало, ElevenLabs v3 для озвучки, ElevenLabs Music для подложки, GPT Image 2.5 Flare для обложки, узел «Монтаж». Показанные тексты: ответы моделей без правок.

Коротко

Вы предоставляете
1 PDF · текст или бриф
Что выдаёт воркфлоу
1 изображение в 3:4 · 1 звуковая дорожка, всего 60 с · 1 закадровый голос
Структура холста
8 нод, связанных 6 соединениями
Подключённые модели
Claude Sonnet 5, ElevenLabs v3, ElevenLabs Music, GPT Image 2.5 Flare
Стоимость полного прогона
около 97 кредитов, то есть 1,16 $
Учётная запись
Демо доступно для просмотра без учётной записи; для генерации нужна бесплатная учётная запись, пробные кредиты включены

Дать людям услышать первую главу: лучшая реклама книги. PDF попадает в узел «Медиа», а узел «Текст» считывает его через порт «Изображение или PDF для анализа», чтобы скопировать начало слово в слово, ничего не переписывая, до конца абзаца, не превышая 1400 символов: это длина полутораминутного чтения.

Узел «Озвучка» читает этот подключённый текст с помощью ElevenLabs v3, голосом рассказчика, выбранным из списка. Узел «Музыка» сочиняет шестьдесят секунд инструментальной подложки по подключённому брифу, зацикленной в Монтаже на низкой громкости. Узел «Изображение» рисует обложку с названием на GPT Image 2.5 Flare, а Монтаж сохраняет её целиком, на чёрном фоне, на всё время озвучки.

В демо звучит начало «North of Silence», оригинального романа, написанного специально для примера. Замените PDF своей главой, голос в узле, название в промпте обложки. Целая глава читается несколькими узлами «Озвучка» по 3000 символов, выстроенными подряд в Монтаже. Обложка и трейлер дополняют серию.

Реальные результаты из демо

Это файлы workflow'а, показанного выше, в том виде, в котором их выдали модели, без ретуши. Исходная точка указана, если она есть.

Результат

Озвучка начала главы, прочитанная ElevenLabs v3 голосом GeorgeСоздано с помощью ElevenLabs v3
Шестидесятисекундная инструментальная подложка, сочинённая ElevenLabs Music, зацикленная под голосомСоздано с помощью ElevenLabs Music
Обложка с названием, нарисованная GPT Image 2.5 Flare, показанная целиком в МонтажеСоздано с помощью GPT Image 2.5 Flare
Смонтированный фрагмент: обложка на экране, озвучка и подложка, готовый к публикации

Для кого

Авторы и издатели, которые хотят дать людям услышать первую главу без студии и актёра или протестировать голос перед созданием полной аудиокниги.

Какие файлы предоставить

Глава в текстовом PDF, а не скан: узел «Текст» копирует прозу как есть, а голос читает её фраза за фразой.

Как это сделать

  1. 1

    Перетащите главу в PDF

    Узел «Медиа» её принимает. Узел «Текст» копирует начало, а не пересказывает: читается именно ваша проза, фраза за фразой, до конца абзаца.

  2. 2

    Выберите голос и озвучьте

    Узел «Озвучка» получает текст по кабелю. Около двадцати тембров ElevenLabs v3 или клонированный голос: в демо используется George, спокойный рассказчик. Тег [pause] или [whispers] в тексте задаёт манеру исполнения.

  3. 3

    Сочините подложку и нарисуйте обложку

    Узел «Музыка» сочиняет шестьдесят секунд по подключённому брифу, инструментал. Узел «Изображение» вписывает название в обложку формата 3:4, две подписи. Оба элемента можно переделать, не трогая озвучку.

  4. 4

    Смонтируйте и опубликуйте

    Монтаж размещает обложку целиком на чёрном фоне в формате 16:9, озвучку на одной дорожке, зацикленную подложку на низкой громкости на другой, с финальным затуханием. Рендер в браузере, без титров, экспорт в mp4.

Варианты и сценарии использования

Тот же холст, настроенный под разные задачи: в каждом варианте меняются две-три строки промпта.

Фрагмент первой главы

Это демо: начало скопировано слово в слово, голос рассказчика, подложка, обложка на экране. Замените PDF и название, оставьте остальное, и видео пересоберётся для вашей книги.

Полная глава в несколько дублей

Один узел «Текст» на каждые 3000 символов, по одному узлу «Озвучка» на каждый, все в одном Монтаже: пятнадцатиминутная глава читается примерно десятком узлов, под ней зациклена подложка.

Фрагмент, прочитанный автором

Клонируйте свой голос в узле «Озвучка» по минутной записи, затем выберите его для озвучки: первая глава прозвучит вашим голосом, без студии.

Подкаст-версия без изображения

Уберите узел «Изображение» и Монтаж: озвучка и подложка экспортируются в mp3 прямо из узлов, для подкаст-платформы или страницы книги.

Фрагмент на нескольких языках

Попросите узел «Текст» перевести отрывок, задайте язык узла «Озвучка», оставьте обложку: то же видео появится на английском, испанском, немецком, с тем же голосом.

Частые ошибки

Пересказ вместо текста

Инструкция требует копировать прозу дословно. Если модель пересказывает, значит она прочитала отсканированный PDF без текстового слоя: переведите рукопись в текстовый PDF, а не в изображения страниц.

Подложка, заглушающая голос

Музыка стоит на уровне 0,25 в Монтаже, чтобы оставаться тише озвучки. Подложка с выраженной мелодией отвлекает внимание: попросите в брифе фон без темы, без ударных.

Обрезанная обложка

Монтаж настроен вписывать изображение целиком на чёрном фоне. В режиме заполнения обложка формата 3:4 теряет название сверху и снизу: для фрагмента оставьте режим вписывания.

Рекомендуемые модели

Частые вопросы

Можно ли прочитать целую главу?

Да, по частям: один узел «Озвучка» читает до 3000 символов. Попросите узел «Текст» дать следующую часть, продублируйте узел «Озвучка» и выстройте части подряд в Монтаже. Цена зависит от количества прочитанных символов.

Сколько стоит фрагмент?

Около шестидесяти кредитов за демо: озвучка на 1400 символов (около двенадцати кредитов), подложка на шестьдесят секунд (около пятидесяти), обложка (два) и чтение PDF (от двух до трёх). Цена отображается на каждом узле до нажатия.

Учитывает ли голос пунктуацию?

Да: ElevenLabs v3 отмечает запятые, точки и абзацы, разделённые пустой строкой. Для более долгой паузы: тег [pause]; для шёпота: [whispers]. Теги вслух не читаются.

Какой длины должен быть фрагмент?

От полутора до двух минут, то есть от 1400 до 1800 символов: достаточно, чтобы задать голос и сцену, но достаточно коротко, чтобы дослушать до конца на телефоне.

Можно ли поменять голос потом?

Да, в узле «Озвучка», без повторной генерации текста: выберите другой тембр и запустите чтение заново, Монтаж обновится.

Нужна ли обложка?

Нет, для Монтажа подойдёт любой изображённый клип: фотография автора, иллюстрация места действия. Но обложка с названием лучше всего расходится при публикации.

Куда публиковать видео?

На странице книги, в социальных сетях, как нулевой эпизод подкаста: mp4 выходит в формате 16:9, 1080p, со сведённым звуком. Монтаж в формате 9:16 создаёт вертикальную версию.

Создать аудиофрагмент книги с помощью ИИ

Использовать этот воркфлоу

Бесплатный аккаунт, без банковской карты. Воркфлоу откроется уже заполненным на вашем холсте.