כל הכלים

להפוך תמונה לדוברת בעזרת AI

תמונת פנים וטקסט שנקרא בקול מהקטלוג: InfiniTalk גורם לאדם לדבר, כולל שפתיים, מצמוצים ותנועות ראש. הווידאו נמשך בדיוק כמו הקול. כל תהליך העבודה נראה בלי חשבון.

דמו אינטראקטיבי

workflow אמיתי, תוצאות אמיתיות. הזיזו והתקרבו כרצונכם.

שימוש ב-workflow הזה

תהליך העבודה האמיתי: תמונה בנוד Media, שני טקסטים שכל אחד נקרא על ידי נוד Voice-over, ושני נודים Video מוגדרים ל-InfiniTalk שמקבלים את התמונה בפורט image ואת הקול בפורט voice.

בקצרה

מה ה-workflow מפיק
2 סרטונים של 18 שניות ב-480p, יחס 1:1 · 2 קריינויות
מבנה הקנבס
8 נודים המחוברים ב-6 קשרים
מודלים מחווטים
ElevenLabs v3, InfiniTalk
עלות של מעבר מלא
בערך 446 קרדיטים, כלומר ‏5.35 ‏$

תמונה אחת מספיקה. אין צילום וידאו, אין הגדרת אווטאר: הפנים שבתמונה מתחילות לדבר, עם שפתיים מתוזמנות לכל הגה, מצמוצים, ותנועות ראש קטנות שמלוות משפט. התוצאה נראית כמו צילום ישיר למצלמה, והיא באה מפורטרט שצולם בטלפון.

הטקסט נקרא בנוד Voice-over, עם אחד מהקולות מהקטלוג (בראשם ElevenLabs v3) או קול משוכפל. נוד Video המוגדר ל-InfiniTalk מקבל את התמונה ואת הקול, ומפיק וידאו שנמשך בדיוק כמו האודיו, עד עשרים ושמונה שניות. המחיר עוקב אחרי משך הזמן הזה, נמדד על הקובץ, ומוצג לפני שלוחצים.

זו התנועה של האווטאר המדבר, אבל מהפנים שלך, או מהפנים של דמות שנוצרה, קמע מצויר, פורטרט ישן. הודעת יום הולדת, הצגת מוצר, הכרזה ברשתות: ההדמו מציג שתי הודעות על אותה תמונה.

איך עושים את זה

  1. 1

    בחרו תמונה מזווית קדמית

    פנים חדות, פה סגור וגלוי, תאורה מלפנים, רקע פשוט. פורטרט שצולם בטלפון מתאים היטב. משקפיים וזקנים עוברים, יד לפני הפה או פרופיל לא.

  2. 2

    כתבו את הטקסט ובחרו את הקול

    נוד Voice-over קורא את מה שכתבתם עם הקול שנבחר, בשפה שלכם. משפט של עשרים מילים אורך שבע עד שמונה שניות. צרו את הקול קודם: הוא זה שקובע את משך הזמן ואת המחיר של הווידאו.

  3. 3

    צרו את הווידאו

    נוד InfiniTalk מציג את משך הזמן הנמדד של הקול ואת המחיר המדויק. לחצו: הפנים מדברות, ב-480p לרשתות חברתיות או ב-720p לתצוגה מוקרנת.

  4. 4

    המשיכו שרשור אם הטקסט ארוך

    מעבר לעשרים ושמונה שניות של קול, חלקו את הטקסט לשני צילומים ועשו מהם עריכה ברצף בנוד Montage, בחינם, כמו בתהליכי עבודה וידאו אחרים.

וריאציות ותרחישי שימוש

אותו קנבס, מכוון לצרכים שונים: כל וריאציה מסתכמת בשתיים-שלוש שורות פרומפט להחלפה.

הודעת יום ההולדת

התמונה של האדם הנחוג, טקסט של עשרים מילים שנקרא בקול חם: זו הדוגמה השנייה בהדמו. הווידאו נשלח כמו שהוא בהודעה, ואף אחד לא נאלץ לצלם את עצמו.

הצגת המוצר בלי צילום

פורטרט שנוצר הופך למציג: טקסט ההשקה בנוד Voice-over, התמונה בנוד Media, והווידאו יוצא ב-720p, מוכן לעמוד מוצר או לפרסומת UGC.

פורטרט ישן שמספר

תמונת משפחה שסקנוה, טקסט שנכתב בגוף ראשון: הפנים מתעוררות לחיים ומדברות. העבירו את התמונה קודם בנוד Enhance אם היא קטנה או פגומה, ואז ב-InfiniTalk.

הקמע שמכריז

דמות מצוירת עם פה קריא עובדת: המודל מנפיש את שפתיי הציור בדיוק כמו של תמונה. אידאלי להכרזת מותג ברשתות חברתיות, עם קול שמח מהקטלוג.

אותה הודעה בשלוש שפות

תמונה אחת, שלושה נודי Voice-over בשלוש שפות, שלושה נודי InfiniTalk: אותו אדם מדבר אנגלית, ספרדית וצרפתית, עם שפתיים מדויקות בכל פעם. כדי להתחיל מווידאו שכבר צולם, ראו דיבוב.

התמונה שמדברת, ואז זזה

לקחו את הווידאו שנוצר והעבירו אותו בלגרום לתמונה לרקוד או לנוד Video כרפרנס: הדיבור קודם, הגוף אחר כך.

טעויות נפוצות

פנים בפרופיל או בזווית שלושת רבעי צמודה

המודל צריך לראות את כל הפה. בזווית קדמית או בשלושת רבעי קלה, הסנכרון נקי; בפרופיל, השפתיים מתעוותות.

פה פתוח או מוסתר בתמונה

חיוך עם שיניים גלויות, יד על הסנטר, מיקרופון לפני: כל אלה מכשולים. פה סגור, פנים חשופות, והתוצאה חדה.

כתיבת הטקסט בנוד Video

הפרומפט של נוד InfiniTalk מתאר את ההתנהגות, לא את הטקסט. מה שהאדם אומר זה הקול המחובר: הטקסט הולך לנוד Voice-over.

קול ארוך מדי למעבר אחד

מעבר לעשרים ושמונה שניות, הנוד מסרב לפני היצירה, בלי חיוב. חלקו לשני צילומים ושרשרו אותם בנוד Montage.

מודלים מומלצים

שאלות נפוצות

כמה זמן התמונה יכולה לדבר?

משתי שניות עד עשרים ושמונה שניות לכל יצירה, בערך שבעים מילים בקצב רגיל. הווידאו נמשך בדיוק כמו הקול המחובר: אין מה להגדיר.

האם אפשר להשתמש בקול שלי?

כן. העלו הקלטה לנוד Media וחברו אותה לפורט voice, או שכפלו את הקול שלכם בנוד Voice-over וגרמו לו לקרוא כל טקסט.

האם צריך תמונה שלי, או שדמות שנוצרה מתאימה?

שניהם. פורטרט שנוצר על ידי נוד Image, קמע מצויר או תמונה ישנה מדברים היטב בדיוק כמו סלפי, כל עוד הפנים בזווית קדמית והפה גלוי.

האם מחייבים אותי אם היצירה נכשלת?

לא. המחיר משוריין בעת ההפעלה ומוחזר אוטומטית במקרה של כשל טכני. הסכום המדויק מוצג על הכפתור לפני שלוחצים.

מה ההבדל מהאווטאר המדבר?

האווטאר המדבר יוצר מציג מדומה עם קול שלו, בבת אחת, על Veo. כאן, התמונה שלך מדברת, עם הקול שבחרתם, והטקסט משתנה בלי ליצור מחדש את הדמות.

האם אפשר לבחור את השפה?

כן, בנוד Voice-over: קולות ElevenLabs קוראים ארבע עשרה שפות. סנכרון השפתיים עוקב אחרי הצלילים, בכל שפה.

האם הווידאו הוא 16:9 או אנכי?

InfiniTalk מפיק מסגרת קרובה לתמונה, ב-480p או ב-720p. לפורמט מדויק, חתכו מחדש אחר כך בנוד Montage, שמקבל 9:16, 1:1 ו-16:9.

האם אפשר לגרום לכמה אנשים לדבר?

אדם אחד לכל נוד. לדיאלוג, גרמו לשתי תמונות לדבר כל אחת על הקול שלה, ואז החליפו בין הצילומים בנוד Montage.

להפוך תמונה לדוברת בעזרת AI

שימוש ב-workflow הזה

חשבון חינמי, בלי כרטיס אשראי. ה-workflow נפתח מוכן מראש בקנבס שלכם.