Фрагмент первой главы
Это демо: начало скопировано слово в слово, голос рассказчика, подложка, обложка на экране. Замените PDF и название, оставьте остальное, и видео пересоберётся для вашей книги.
Глава в PDF, перетащенная на холст: узел «Текст» копирует её начало слово в слово, голос рассказчика ElevenLabs его озвучивает, под ним звучит инструментальная подложка, а обложка остаётся на экране в Монтаже 16:9: видео, готовое к публикации, чтобы дать людям послушать первую главу. Весь рабочий процесс виден без учётной записи.
Интерактивное демоНастоящий воркфлоу, реальные результаты. Двигайте холст и приближайте как угодно.
Использовать этот воркфлоуРеальный рабочий процесс: первая глава романа в PDF в узле «Медиа», Claude Sonnet 5 копирует начало, ElevenLabs v3 для озвучки, ElevenLabs Music для подложки, GPT Image 2.5 Flare для обложки, узел «Монтаж». Показанные тексты: ответы моделей без правок.
Коротко
Дать людям услышать первую главу: лучшая реклама книги. PDF попадает в узел «Медиа», а узел «Текст» считывает его через порт «Изображение или PDF для анализа», чтобы скопировать начало слово в слово, ничего не переписывая, до конца абзаца, не превышая 1400 символов: это длина полутораминутного чтения.
Узел «Озвучка» читает этот подключённый текст с помощью ElevenLabs v3, голосом рассказчика, выбранным из списка. Узел «Музыка» сочиняет шестьдесят секунд инструментальной подложки по подключённому брифу, зацикленной в Монтаже на низкой громкости. Узел «Изображение» рисует обложку с названием на GPT Image 2.5 Flare, а Монтаж сохраняет её целиком, на чёрном фоне, на всё время озвучки.
В демо звучит начало «North of Silence», оригинального романа, написанного специально для примера. Замените PDF своей главой, голос в узле, название в промпте обложки. Целая глава читается несколькими узлами «Озвучка» по 3000 символов, выстроенными подряд в Монтаже. Обложка и трейлер дополняют серию.
Это файлы workflow'а, показанного выше, в том виде, в котором их выдали модели, без ретуши. Исходная точка указана, если она есть.
Результат
Авторы и издатели, которые хотят дать людям услышать первую главу без студии и актёра или протестировать голос перед созданием полной аудиокниги.
Глава в текстовом PDF, а не скан: узел «Текст» копирует прозу как есть, а голос читает её фраза за фразой.
Перетащите главу в PDF
Узел «Медиа» её принимает. Узел «Текст» копирует начало, а не пересказывает: читается именно ваша проза, фраза за фразой, до конца абзаца.
Выберите голос и озвучьте
Узел «Озвучка» получает текст по кабелю. Около двадцати тембров ElevenLabs v3 или клонированный голос: в демо используется George, спокойный рассказчик. Тег [pause] или [whispers] в тексте задаёт манеру исполнения.
Сочините подложку и нарисуйте обложку
Узел «Музыка» сочиняет шестьдесят секунд по подключённому брифу, инструментал. Узел «Изображение» вписывает название в обложку формата 3:4, две подписи. Оба элемента можно переделать, не трогая озвучку.
Смонтируйте и опубликуйте
Монтаж размещает обложку целиком на чёрном фоне в формате 16:9, озвучку на одной дорожке, зацикленную подложку на низкой громкости на другой, с финальным затуханием. Рендер в браузере, без титров, экспорт в mp4.
Тот же холст, настроенный под разные задачи: в каждом варианте меняются две-три строки промпта.
Это демо: начало скопировано слово в слово, голос рассказчика, подложка, обложка на экране. Замените PDF и название, оставьте остальное, и видео пересоберётся для вашей книги.
Один узел «Текст» на каждые 3000 символов, по одному узлу «Озвучка» на каждый, все в одном Монтаже: пятнадцатиминутная глава читается примерно десятком узлов, под ней зациклена подложка.
Клонируйте свой голос в узле «Озвучка» по минутной записи, затем выберите его для озвучки: первая глава прозвучит вашим голосом, без студии.
Уберите узел «Изображение» и Монтаж: озвучка и подложка экспортируются в mp3 прямо из узлов, для подкаст-платформы или страницы книги.
Попросите узел «Текст» перевести отрывок, задайте язык узла «Озвучка», оставьте обложку: то же видео появится на английском, испанском, немецком, с тем же голосом.
Инструкция требует копировать прозу дословно. Если модель пересказывает, значит она прочитала отсканированный PDF без текстового слоя: переведите рукопись в текстовый PDF, а не в изображения страниц.
Музыка стоит на уровне 0,25 в Монтаже, чтобы оставаться тише озвучки. Подложка с выраженной мелодией отвлекает внимание: попросите в брифе фон без темы, без ударных.
Монтаж настроен вписывать изображение целиком на чёрном фоне. В режиме заполнения обложка формата 3:4 теряет название сверху и снизу: для фрагмента оставьте режим вписывания.
Да, по частям: один узел «Озвучка» читает до 3000 символов. Попросите узел «Текст» дать следующую часть, продублируйте узел «Озвучка» и выстройте части подряд в Монтаже. Цена зависит от количества прочитанных символов.
Около шестидесяти кредитов за демо: озвучка на 1400 символов (около двенадцати кредитов), подложка на шестьдесят секунд (около пятидесяти), обложка (два) и чтение PDF (от двух до трёх). Цена отображается на каждом узле до нажатия.
Да: ElevenLabs v3 отмечает запятые, точки и абзацы, разделённые пустой строкой. Для более долгой паузы: тег [pause]; для шёпота: [whispers]. Теги вслух не читаются.
От полутора до двух минут, то есть от 1400 до 1800 символов: достаточно, чтобы задать голос и сцену, но достаточно коротко, чтобы дослушать до конца на телефоне.
Да, в узле «Озвучка», без повторной генерации текста: выберите другой тембр и запустите чтение заново, Монтаж обновится.
Нет, для Монтажа подойдёт любой изображённый клип: фотография автора, иллюстрация места действия. Но обложка с названием лучше всего расходится при публикации.
На странице книги, в социальных сетях, как нулевой эпизод подкаста: mp4 выходит в формате 16:9, 1080p, со сведённым звуком. Монтаж в формате 9:16 создаёт вертикальную версию.
Создать аудиофрагмент книги с помощью ИИ
Использовать этот воркфлоуБесплатный аккаунт, без банковской карты. Воркфлоу откроется уже заполненным на вашем холсте.