10% הנחה על המנוי החודשי עם הקוד NODE10, עד 31 באוגוסט

Imaginode
בלוג

12 באוגוסט 2026

דמות עקבית ב-AI: לשמור על אותן פנים מתמונה לתמונה ומווידאו לווידאו

למה הדמות שלכם מחליפה פרצוף בכל ג'נרציה, למה פרומפט של 400 מילה לא ישנה את זה, ואיך נוד הרפרנס של Imaginode פותר את הבעיה עם שלוש תמונות ו-@mention אחד.

הבעיה שכולם פוגשים אחרי עשר דקות

אותו פרומפט מילה במילה מייצר דמות אחרת בכל ג'נרציה: זו התנהגות רגילה של המודלים, והפתרון עובר דרך תמונות רפרנס, לא דרך טקסט טוב יותר.

אתם מייצרים גיבורה לפרויקט שלכם. היא מושלמת: בת שלושים, שיער ג'ינג'י קצר, ג'קט ג'ינס דהוי. אתם מריצים ג'נרציה נוספת כדי לראות אותה בפרופיל. והנה ההפתעה. השיער הפך לחום, הג'קט נעלם, הפנים כבר לא דומות בכלל. אותו פרומפט, מילה במילה. דמות אחרת.

זה לא באג של Imaginode ולא של שום כלי אחר. זו ההתנהגות הרגילה של כל מודלי התמונה הקיימים היום. וכל עוד לא הבנתם למה, אתם מבזבזים שעות ועשרות קרדיטים על הרצות חוזרות בתקווה לנס. המאמר הזה מסביר את הסיבה, ואז את הפתרון האמיתי, זה שעובד בייצור של קומיקס, סדרת פוסטים או סרט.

ספוילר כן: הפתרון הוא לא פרומפט טוב יותר. הוא להראות למודל את הדמות שלכם במקום לתאר אותה, עם תמונות רפרנס. ב-Imaginode זה עובר דרך נוד הרפרנס, ואנחנו נרכיב אותו צעד אחר צעד, מפורטרט האב ועד ה-@mention הירוק, עם המחירים המדויקים בקרדיטים לכל שלב.

למה הפנים משתנות: הרעש האקראי

כל ג'נרציה יוצאת מרעש אקראי אחר ולמודל אין שום זיכרון מהתמונות הקודמות: הפרומפט שלכם מתאר קטגוריה של אנשים, והוא שולף אחד חדש בכל פעם.

מודל תמונה לא מצייר כמו מאייר ששומר את הדמות בראש. כל ג'נרציה מתחילה מתמונת רעש אקראי, מחית פיקסלים שהוגרלה, שהמודל מנקה בהדרגה בהתבסס על הפרומפט שלכם. שתי הגרלות רעש שונות נותנות שתי נקודות פתיחה שונות, ולכן שתי פנים שונות בסוף.

הפרומפט שלכם מתאר רק קטגוריה של אנשים: “אישה ג'ינג'ית בת שלושים בג'קט ג'ינס” מתאים למיליוני פנים אפשריות. המודל שולף אחת, שתואמת לתיאור, בכל פעם מחדש. הוא לעולם לא בוחר פעמיים את אותה אחת, כי שום דבר לא מחייב אותו.

צריך להוסיף בשורה רעה שנייה: למודל אין שום זיכרון. ג'נרציה מספר 12 לא יודעת דבר על 11 שקדמו לה. הוא לא “זוכר” את הגיבורה שלכם, הוא מעולם לא הכיר אותה. כל לחיצה על ייצור מתחילה מאפס, עם רעש חדש ובלי היסטוריה משותפת.

למה פרומפט מפורט במיוחד לעולם לא מספיק

השפה ענייה מכדי ללכוד אלפי מיקרו פרופורציות של פנים: 400 מילה מייצבות את השיער ואת הג'קט, אף פעם לא את התווים, וכל מילה נוספת עולה בקשב במקום אחר.

הרפלקס הראשון, כולנו עברנו אותו: לתאר יותר. ארבע מאות מילה על צורת האף, המרחק בין העיניים, התלתל שנופל שמאלה. זה משפר קצת את היציבות של האלמנטים הקלים, צבע השיער או הבגד. אבל הפנים עצמן ממשיכות להשתנות.

הסיבה מתסכלת אבל הגיונית: השפה ענייה מכדי לתאר פנים. נסו לתאר בכתב את החבר הכי טוב שלכם, ואז תנו את הטקסט לצייר שמעולם לא ראה אותו. הפורטרט יהיה סביר, לעולם לא דומה. פנים אנושיות הן אלפי מיקרו פרופורציות שאף אוצר מילים לא לוכד.

וככל שהפרומפט מתארך, כך המודל מגשר בין הוראות שדורכות זו על זו. מעבר לנקודה מסוימת, כל מילה שנוספת על הפנים משולמת בקשב שאובד על הסצנה, התאורה או הפעולה. אתם מקבלים פורטרט קפוא במקום התמונה החיה שרציתם.

הפתרון האמיתי: להראות במקום לתאר

צרפו תמונות רפרנס לג'נרציה: שלוש תמונות טובות נותנות דמות מזוהה כמעט בכל פעם, שם שפרומפט ארוך נותן כפיל אחת מכל חמש.

מה שצייר היה עושה בחיים האמיתיים זה לבקש תמונה. המודלים העדכניים יודעים לעשות בדיוק את זה: אתם מצרפים תמונת רפרנס אחת או כמה לג'נרציה, והמודל משתמש בהן כמקור חזותי ישיר במקום לפרש טקסט.

ההבדל מרהיב. במקום שבו פרומפט של 400 מילה נותן כפיל מקורב אחת מכל חמש פעמים, שלוש תמונות רפרנס טובות נותנות דמות מזוהה כמעט בכל פעם. זה לא קסם: המודל מעתיק פרופורציות אמיתיות במקום להמציא אותן.

אבל שימו לב, לא כל המודלים יודעים. ב-Imaginode, פורט הרפרנסים פשוט לא מופיע על נוד כשהמודל שנבחר לא תומך בהם. אם אתם לא רואים את הפורט, החליפו מודל לפני שאתם מחפשים הגדרה נסתרת: אין כזו.

נוד הרפרנס, צעד אחר צעד

נוד הרפרנס מרכז שם, תיאור ותמונות, נוצר פעם אחת וניתן לשימוש חוזר בכל נוד תמונה או וידאו בפרויקט, עם שמירה אוטומטית.

בקנבס של Imaginode, הוסיפו נוד רפרנס. יש בו שלושה שדות. קודם כל שם: “לאה”, “קפטן ערפל”, מה שתרצו, רצוי קצר. אחר כך תיאור: זה הטקסט שיוזרק לפרומפטים שלכם, נחזור לזה בהמשך. ולבסוף התמונות: גררו לשם את התמונות הכי טובות של הדמות.

הנוד הזה ניתן לשימוש חוזר בכל מקום בפרויקט. אתם יוצרים אותו פעם אחת, ואז כל נוד תמונה או וידאו בקנבס יכול להתחבר אליו. זה כל ההיגיון של קנבס הנודים: הדמות הופכת ללבנה שמונחת איפשהו, לא לפסקה שצריך להעתיק לתוך עשרים פרומפטים.

פרט מעשי שמשנה הכל ביומיום: השמירה אוטומטית וכל נוד שומר את היסטוריית 12 הג'נרציות האחרונות שלו. אם גרסה 7 של הדמות שלכם הייתה הנכונה, היא עדיין שם, מוכנה להצטרף לנוד הרפרנס.

ה-@mention הירוק, או איך מזמנים את הדמות שלכם

הקלידו @ ואחריו את השם בכל פרומפט: התיאור מוזרק והתמונות יוצאות אוטומטית כרפרנס, ושרביט הקסמים שומר על האזכור גם בשכתובים.

אחרי שנוד הרפרנס נוצר, אתם מזמנים את הדמות בכל פרומפט על ידי הקלדת @ ואחריו השם שלה. האזכור מוצג בירוק בתוך הטקסט, סימן שהוא באמת מקושר לנוד. אז אתם כותבים פרומפטים קצרים וטבעיים: “@לאה חוצה שוק לילי בגשם, פריים רחב”.

בזמן הג'נרציה, Imaginode עושה שני דברים אוטומטית: הוא מזריק את תיאור הנוד לתוך הפרומפט, והוא מצרף את התמונות כתמונות רפרנס, בתנאי שאתם משתמשים במודל שתומך בעריכה. אין לכם מה להעתיק, אין מה להעלות מחדש. האזכור מספיק.

בונוס נחמד: שרביט הקסמים, שמשכתב את פרומפטי התמונה והווידאו שלכם לאנגלית עשירה דרך Kimi בקרדיט אחד, שומר על ה-@mentions. אתם יכולים לכן להעשיר פרומפט בלי לשבור את הקישור לדמות שלכם. זה סוג הפרט שמונע הפתעות לא נעימות ב-6 קרדיטים לג'נרציה.

אילו מודלי תמונה יודעים להחזיק דמות

Seedream 5 Lite ב-5 קרדיטים הוא אלוף הרפרנסים, GPT Image Mini ב-2 קרדיטים משמש לאיטרציות, ו-Flux Kontext ב-6 קרדיטים עורך את התפאורה בלי לגעת בדמות.

בצד התמונה, אלוף הרפרנסים ב-Imaginode נקרא Seedream 5 Lite, ב-5 קרדיטים לג'נרציה, כלומר בערך 0.05 €. זה המודל שכדאי לבחור כברירת מחדל לכל דמות חוזרת: הוא מקבל את התמונות שלכם ומשחזר פנים בנאמנות שאחרים לא מגיעים אליה במחיר הזה.

שתי חלופות לפי הצורך. GPT Image Mini, ב-2 קרדיטים, מקבל גם הוא רפרנסים: מושלם לאיטרציות על תנוחות ומסגורים בלי לרוקן את המונה. ו-Flux Kontext, ב-6 קרדיטים, ממלא תפקיד אחר: הוא עורך תמונה קיימת. “החלף את הרקע בחוף ים”, והדמות שלכם נשארת שלמה בזמן שהתפאורה משתנה.

מנגד, Flux Schnell בקרדיט אחד או Imagen 4 Fast ב-3 קרדיטים הם כללניים מצוינים, אבל אל תסמכו עליהם לעקביות הפנים של גיבור סדרה. הרפלקס הנכון: לסקצץ את הקומפוזיציה עם מודל זול, ואז לעבור ל-Seedream 5 Lite עם ה-@mention לתמונות הסופיות.

שיטת פורטרט האב

ייצרו קודם פורטרט של הדמות לבדה, על רקע ניטרלי ובתאורה ישירה: תכננו 4 או 5 ניסיונות, כלומר 24 עד 30 קרדיטים, לאבן הפינה של כל התמונות הבאות.

טעות קלאסית: לקחת כרפרנס תמונות שבהן הדמות כבר בסיטואציה, קטנה בפריים, באור נגדי, מהגב. אז המודל לומד את התפאורה בדיוק כמו את הפנים. השיטה הנכונה היא לייצר קודם פורטרט אב: הדמות לבדה, על רקע ניטרלי, בתאורה ישירה.

בפועל, פתחו נוד תמונה, בחרו מודל פוטוריאליסטי כמו Imagen 4 ב-6 קרדיטים, ותארו רק את הדמות: “פורטרט חצי גוף, אישה בת 30, שיער ג'ינג'י קצר, ג'קט ג'ינס דהוי, רקע אפור אחיד, אור רך מלפנים”. הריצו שוב עד שתקבלו את הפנים. תכננו 4 או 5 ניסיונות, כלומר 24 עד 30 קרדיטים, פחות מ-0.30 €.

הפורטרט הזה הופך לאבן הפינה של נוד הרפרנס. כל התמונות הבאות יורדות ממנו. זו השקעה של עשר דקות שחוסכת לכם שעות של לוטו אחר כך, וזה השלב היחיד שבו להריץ הרבה באמת מוצדק.

גוונו את הזוויות של תמונות הרפרנס

ארבע תמונות מספיקות לרוב: חזית, שלושה רבעים, פרופיל ופריים מלא; עדיף 4 תמונות ללא רבב מ-8 בינוניות, כי רפרנס כושל מזהם את כל הג'נרציות הבאות.

פורטרט חזיתי אחד זו התחלה טובה, אבל אז המודל מכיר את הדמות שלכם רק מזווית אחת. בקשו ממנו פרופיל והוא יאלתר אף, לסת, אוזניים. כדי לנעול את הדמות בשלושה ממדים, צריך להראות לו כמה נקודות מבט.

השילוב שעובד טוב: פורטרט חזיתי, שלושה רבעים, פרופיל, ופריים מלא לצללית וללבוש. ארבע תמונות מספיקות לרוב. כדי לייצר אותן, צאו מפורטרט האב עם מודל שמקבל רפרנסים, ובקשו “אותה אדם, מבט מהפרופיל, אותו רקע אפור”. בדקו כל תוצאה לפני שאתם מוסיפים אותה לנוד.

היו קפדנים בשלב הזה, יותר מבכל מקום אחר. תמונת רפרנס כושלת קלות, עם סנטר קצת אחר או אוזן מקורבת, תזהם בשקט את כל הג'נרציות הבאות, ואתם תחפשו את הסיבה במקום הלא נכון, בפרומפטים שלכם. עדיף 4 תמונות ללא רבב מ-8 בינוניות. ב-5 קרדיטים למבט עם Seedream 5 Lite, לחזור על תמונה מפוקפקת עולה 0.05 €. אל תתמקחו.

כתבו את התיאור כחוזה של רציפות

כתבו בתיאור רק את מה שחייב לשרוד את כל הפריימים, צלקת, ג'קט, שעון: הזהות חיה בנוד, הסצנה חיה בפרומפט.

שדה התיאור של נוד הרפרנס הוא לא קישוט: הוא מוזרק לכל פרומפט שבו מופיע ה-@mention. לכן צריך לכתוב בו את מה שחייב לשרוד את כל הפריימים, ושום דבר אחר. הסימנים המזהים הקבועים: הצלקת בגבה השמאלית, ג'קט הג'ינס הדהוי, השעון על פרק יד ימין, ההליכה השחוחה.

אל תכניסו לשם את מה שמשתנה מסצנה לסצנה. אם תכתבו “מחייכת, בבית קפה” בתיאור, הדמות שלכם תחייך בבית קפה גם באמצע סצנת סערה. התיאור מתאר את הזהות, הפרומפט מתאר את הסצנה. הפרדת התפקידים הזו היא מה שהופך את המערכת לחסינה.

בהפקות יש לעבודה הזו שם: סקריפט הרציפות. אף אחד לא חושב שזה זוהר, כולם מודים שזה מה שמונע מהשחקן להחליף חולצה בין שני שוטים. נוד הרפרנס שלכם ממלא בדיוק את התפקיד הזה.

ובצד הווידאו: המודלים והמקסימום המדויק שלהם

Seedance 2.0 ו-MiniMax H3 מקבלים 9 רפרנסים, Grok 5, Kling V3 ו-Veo 3.1 Fast שלושה כל אחד; הטכניקה האמינה ביותר נשארת תמונה מושלמת שמחוברת כפתיחת הווידאו.

הווידאו מציב את אותה בעיה כמו התמונה, רק גרוע יותר: פנים שנסחפות לאורך השניות נראות מיד. למזלנו, כמה ממודלי הווידאו של Imaginode מקבלים תמונות רפרנס, עם מקסימומים שונים. Seedance 2.0 ו-2.0 Fast לוקחים 9, Seedance 2.5 אפילו יותר. MiniMax H3 מקבל גם הוא 9, Grok Imagine Video 5, Kling V3 ו-Veo 3.1 Fast שלושה כל אחד.

נוד הווידאו חושף גם כניסות נפרדות לפי המודל: תמונת פתיחה, ותמונת סיום כשהמודל תומך בזה. הטכניקה האמינה ביותר היא דווקא הזו: לייצר קודם תמונה מושלמת של הדמות עם Seedream 5 Lite, ואז לחבר אותה כתמונת הפתיחה של הווידאו. התנועה יוצאת מפנים שכבר נכונות.

בואו נהיה כנים לגבי שיעורי ההצלחה: וידאו AI נכשל בערך בג'נרציה אחת מכל שלוש או ארבע, עם רפרנסים או בלי. איבר שחוצה חפץ, מבט שהולך לכיוון אחר. תכננו את הבזבוז הזה בתקציב. ב-26 קרדיטים ל-5 שניות ב-Kling 2.5 Turbo או 48 קרדיטים ב-720p ב-Seedance 2.0 Fast, סצנה מוגמרת עולה בפועל כפול מהמחיר המוצג. הכשלים הטכניים, לעומת זאת, מוחזרים אוטומטית.

מקרה מעשי: קומיקס קצר של שש משבצות

פורטרט אב, מבטים משלימים ושש משבצות כולל הרצות חוזרות: הקומיקס המלא עם דמות יציבה עולה בערך 105 קרדיטים, כלומר 1.05 €.

ניקח דוגמה ריאלית: קומיקס קצר של שש משבצות לאינסטגרם, עם לונה, כוורנית, כגיבורה. שלב 1, פורטרט האב על רקע ניטרלי: 5 ניסיונות עם Imagen 4, 30 קרדיטים. שלב 2, המבטים המשלימים, שלושה רבעים, פרופיל, פריים מלא: בערך 6 ג'נרציות עם Seedream 5 Lite, 30 קרדיטים. נוד הרפרנס “@לונה” מוכן.

שלב 3, שש המשבצות. כל פרומפט נשאר קצר: “@לונה פותחת כוורת בזריחה, מבט מלמעלה”. עם Seedream 5 Lite ב-5 קרדיטים ובהנחה של הרצה חוזרת אחת מכל שתיים, שש המשבצות עולות בערך 45 קרדיטים. סך הפרויקט: בערך 105 קרדיטים, כלומר 1.05 €. לסדרה של שישה ויזואלים עם דמות יציבה, קשה לעשות טוב יותר.

אותו נוד ישרת אתכם בשבוע הבא לפרק 2, ואז לווידאו של 5 שניות שבו לונה מנופפת למצלמה. דמות אחת, מוגדרת פעם אחת, נפרסת בכל מקום. זה אותו עיקרון שמחזיק יוצרת UGC וירטואלית לאורך חמש עשרה שניות של וידאו מול המצלמה. כאן ההיגיון של הנודים מקבל את מלוא המשמעות מול כלים שבהם כל תמונה מתחילה מדף לבן.

מלכודת מספר 1: רפרנסים סותרים

תמונות מגרסאות שונות של הדמות מייצרות ממוצע רפוי: אם הג'נרציות כולן כמעט טובות אבל אף פעם לא זהות, נקו את הנוד, לא את הפרומפט.

המלכודת הנפוצה ביותר: לערבב בנוד הרפרנס תמונות מגרסאות שונות של הדמות. שתי תמונות שבהן תספורת השיער שונה קלות, שלישית שבה הג'קט כהה יותר. המודל, שנדרש להיות נאמן למקורות שסותרים זה את זה, מייצר ממוצע רפוי שלא דומה לאף אחת מהשלוש.

התסמין מזוהה בקלות: הג'נרציות כולן “כמעט טובות” אבל אף פעם לא זהות זו לזו. אם זה קורה לכם, אל תיגעו בפרומפט. פתחו את נוד הרפרנס, הציגו את התמונות זו לצד זו וסלקו בלי רחמים את אלה שסוטות. חזרו לפורטרט האב כמקור האמת היחיד.

כלל פשוט: כל תמונה שנוספת צריכה להיות ניתנת לתיאור באותו משפט בדיוק כמו האחרות. אם אתם צריכים להגיד “זו, זה לפני שהייתה לה הצלקת”, אין לה מה לחפש בנוד. צרו במקום זה נוד רפרנס שני לגרסה ההיא של הדמות.

מלכודת מספר 2: שמונה תמונות כמעט זהות

יותר מדי דוגמאות זהות נועלות את התנוחה במקום את הפנים: ארבע תמונות מגוונות מנצחות באופן שיטתי שמונה שכפולים של אותו פורטרט חזיתי.

המלכודת ההפוכה קיימת גם היא. שמונה פורטרטים חזיתיים, אותה הבעה, אותה תאורה, אותו רקע. המודל מסיק שהכל הוא חתימה של הדמות: הזווית, החיוך הקפוא, התאורה. התוצאה, הוא מתנגד כשאתם מבקשים משהו אחר. הדמות שלכם מסתכלת ישר למצלמה בכל הסצנות, גם באמצע ריצה מהירה.

זה יתר התאמה בגרסת רפרנס: יותר מדי דוגמאות זהות נועלות את התנוחה במקום את הפנים. הפתרון מתחבר לעצה על הזוויות: מעט תמונות, אבל מגוונות. ארבע תמונות שמכסות חזית, שלושה רבעים, פרופיל וצללית מנצחות שמונה שכפולים של אותו פורטרט, באופן שיטתי.

במודלי הווידאו שמקבלים עד 9 רפרנסים כמו Seedance 2.0 או MiniMax H3, הפיתוי למלא את כל המשבצות חזק. התנגדו. מלאו אותן רק אם כל תמונה מוסיפה מידע חדש: זווית, לבוש, הבעה. אחרת, שלוש תמונות טובות עדיפות על תשע חופפות.

איפה מתחילים היום

סשן של שלושים דקות מספיק: פורטרט אב, נוד רפרנס, סצנה ראשונה עם @mention, והכל בפחות מ-15% מ-900 הקרדיטים של תוכנית Starter ב-13 € לפני מע״מ.

תוכנית הפעולה מסתכמת בסשן של שלושים דקות. צרו נוד תמונה, ייצרו את פורטרט האב שלכם על רקע ניטרלי, תכננו כשלושים קרדיטים של ניסיונות. צרו את נוד הרפרנס, תנו שם לדמות, כתבו שלושה משפטים של תיאור קבוע, הוסיפו את הפורטרט ואז את המבטים המשלימים. אחר כך בדקו סצנה ראשונה עם ה-@mention ועם Seedream 5 Lite.

אם אתם מעדיפים לא לחבר את כל זה בעצמכם, העוזר של Imaginode בונה את זרימת העבודה המלאה בלחיצה אחת בקרדיט אחד להודעה: תארו “סדרת פוסטים עם דמות חוזרת” והוא יניח את נודי התמונה, הרפרנס והווידאו כשהם כבר מחוברים. נשאר לכם רק למלא את התמונות ולכוונן את הפרומפטים.

עם תוכנית Starter ב-13 € לפני מע״מ ל-900 קרדיטים חודשיים, הסשן המלא הזה צורך פחות מ-15% מהחבילה. והכל קורה בדפדפן, הייצור רץ בצד השרת: אין מה להתקין, אין צורך בכרטיס מסך, סשן הצהריים שלכם על הלפטופ בסלון מספיק בהחלט.

אחרי שהדמות שלכם התייצבה, הפרויקט הבא הוא להעמיד אותה כמו שצריך: מסגור, עדשה, תנועת מצלמה. זה בדיוק הנושא של נוד המצלמה, והקדשנו לו מאמר שלם, “לנהל את המצלמה ב-AI”. לגיבורה שלכם יש עכשיו פנים שמחזיקות. נשאר להציע לה פריימים אמיתיים.

רוצים לנסות על קנבס אמיתי?

כל מה שמתואר בכתבה הזו נעשה ב-Imaginode, ישירות בדפדפן.

התחלה