6 באוקטובר 2026
המרת וידאו מ-24 fps ל-25, 30 או 60 fps: שלוש שיטות, כולל AI
להאיץ ב-4%, לשכפל תמונה אחת מכל ארבע, או להמציא את התמונות החסרות באמצעות אינטרפולציה: מה עושה כל שיטה כדי להעביר וידאו מ-24 ל-25, 30 או 60 fps, מה היא פוגעת בו, פקודות ffmpeg, ומה עולה ההמרה באמצעות AI, כפי שנמדד על הצילומים שלנו עצמנו.

Frank Houbreמייסד Imaginode
שלוש דרכים לשנות את קצב התמונות
כדי לעבור מ-24 ל-25, 30 או 60 תמונות לשנייה, אפשר להפעיל את הווידאו מהר יותר, לחזור על תמונות מסוימות, או ליצור תמונות חדשות בין אלו שקיימות; רק השיטה השלישית שומרת גם על משך הזמן וגם על תנועה חלקה.
וידאו בקצב 24 תמונות לשנייה מכיל 24 תמונות רגע עבור כל שנייה. וידאו ב-30 מכיל 30. לעבור מאחד לשני פירושו למצוא שש תמונות שלא קיימות. יש רק שלוש דרכים לעשות זאת, וכל תוכנה, מהפשוטה ביותר ועד היקרה ביותר, משתמשת באחת מהן.
הראשונה היא לא להמציא כלום ולהפעיל את הווידאו מהר יותר: 24 התמונות של שנייה אחת מוצגות בפרק זמן קצר משנייה אחת. השנייה שומרת על המהירות וחוזרת על תמונות קיימות כדי למלא את הפערים. השלישית מתבוננת בשתי תמונות שכנות ומחשבת את זו שצריכה להיות ביניהן: זו האינטרפולציה, שה-AI כיום עושה טוב בהרבה מהאלגוריתמים הישנים.
הבחירה תלויה בקצב המבוקש. מ-24 ל-25, השיטה הראשונה היא קלאסיקה של הטלוויזיה האירופית. מ-24 ל-30, השנייה היא מה שרוב הפלטפורמות עושות בלי לציין זאת. וכשרוצים תנועה חלקה ב-30, 50 או 60, צריך את השלישית. הסיבות לבחירת קצב כזה או אחר מוסברות ב24, 25, 30 או 60 fps: איזה קצב לבחור.
מ-24 ל-25: להאיץ ב-4%
הפעלת וידאו ב-24 תמונות לשנייה בקצב 25 מקצרת אותו ב-4% ומעלה את הסאונד בכ-0.7 חצי-טון; זו ההמרה ההיסטורית של סרטים שמוצגים בטלוויזיה האירופית, והיא לא יוצרת ולא משכפלת אף תמונה.
בין 24 ל-25, הפער קטן כך שהטלוויזיות האירופיות בחרו זמן רב שלא לחשב שום דבר מחדש: הסרט פשוט מוצג מהר יותר ב-4.17%. כל תמונה מקורית מוצגת פעם אחת, התנועה נשארת חלקה לגמרי, וסרט של 100 דקות נמשך 96 דקות. קוראים לזה לרוב האצת PAL.
המחיר משתלם בסאונד: כשהוא מופעל מהר יותר ב-4.17%, הוא עולה בכ-0.7 חצי-טון. קול עמוק נשמע קצת יותר חד, מוזיקה משתנה קלות בטונליות. הכלים הנוכחיים מאיצים את הסאונד בלי לשנות את הגובה שלו. עם ffmpeg, זה נכנס בשורה אחת: ffmpeg -i entree.mp4 -filter:v "setpts=PTS*24/25" -r 25 -filter:a "atempo=25/24" sortie.mp4. על קליפ בדיקה של 10 שניות, כל 240 התמונות נשמרות והקובץ נמשך 9.6 שניות, כולל הסאונד, באותו גובה.
השיטה הזו אינה מתאימה כשמשך הזמן חשוב: מוזיקה שמתואמת לתמונה, שוט מסונכרן לקריינות, פרסומת באורך קבוע. היא גם לא עובדת מעבר ל-25: לעבור מ-24 ל-30 באמצעות האצה ייתן סרט קצר ב-25% וקולות של סרט מצויר. במקרים כאלה, שומרים על משך הזמן ומייצרים תמונות חדשות.
מ-24 ל-30: לחזור על תמונה אחת מכל ארבע
בלי אינטרפולציה, 24 תמונות הופכות ל-30 על ידי חזרה על תמונה אחת מכל ארבע: משך הזמן נשמר, אבל התנועה מתקדמת בקפיצות קבועות, סטטר שבולט מאוד בפנורמות ובצילומי טרקינג.
שלושים חלקי עשרים וארבע נותן 1.25: לכל ארבע תמונות מקוריות, צריך חמש. הפתרון הפשוט ביותר הוא להציג אחת מהארבע פעמיים. זה מה שעושה הפקודה ffmpeg -i entree.mp4 -vf fps=30 sortie.mp4, זה מה שעושות רוב תוכנות העריכה כשמכניסים שוט ב-24 fps לטיימליין ב-30 fps, וזה מה שעושה פלטפורמה שמקבלת 24 ומציגה 30.
התוצאה שומרת על משך הזמן והסאונד, אבל התנועה אינה חלקה יותר: שלושה צעדים נורמליים, צעד אחד במקום, שלושה צעדים נורמליים. על פנים שמדברות, לא רואים כלום. על פנורמה של רחפן, צילום טרקינג צידי או טקסט שמתגלגל, התמונה מתקדמת בקפיצות קטנות, כמה פעמים בשנייה. הטלוויזיה האמריקאית חיה עם וריאציה של הפגם הזה במשך עשרות שנים, 3:2 pulldown, שמפזר את החזרה על פני חצאי תמונות.
התמונות למטה מציגות את ההבדל על אותו שוט. בחלק העליון, ארבע תמונות רצופות מהמקור ב-24 תמונות לשנייה. באמצע, חמש התמונות המתאימות לאחר שכפול: שתיים מהן זהות לחלוטין. בתחתית, חמש התמונות לאחר אינטרפולציה באמצעות AI: כל אחת שונה, והכפר מתקדם בקצב אחיד.
מ-24 ל-30 או 60: להמציא את התמונות החסרות
אינטרפולציה באמצעות AI מערכת את התנועה של כל אזור בתמונה בין שתי תמונות רצופות, ואז מחשבת את התמונות שבאמצע: משך הזמן והסאונד לא משתנים, והתנועה נשארת חלקה ב-25, 30, 50 או 60 תמונות לשנייה.
מודל אינטרפולציה מקבל שתי תמונות שכנות ומחפש, לכל אזור קטן, לאן הוא נסע: הגג ירד שלושה פיקסלים, הגל נע שמאלה, היד הסתובבה. מכך הוא נגזר וקטורי תנועה, ואז מצייר תמונת ביניים שבה כל אזור עבר חלק מהמסלול. אלגוריתמים ישנים עשו את אותו הדבר עם בלוקים מרובעים והשאירו קצוות קרועים; הרשתות הנוירונים הנוכחיות מטפלות הרבה יותר טוב בקווי המתאר, וגם במה שמתגלה מאחורי אובייקט שנע.
כדי לעבור מ-24 ל-30, המודל מציב חמש תמונות במקום שבו היו ארבע, ברגעים שכמעט אף פעם לא חופפים לתמונה מקורית. ל-60, הוא מציב שתיים וחצי לכל תמונה מקורית. ל-25, רק תמונה אחת מכל עשרים וחמש היא באמת מומצאת, וההמרה כמעט בלתי מורגשת. בכל מקרה, הווידאו נמשך בדיוק אותו זמן, ואת פס הסאונד אפשר להעתיק כמו שהוא.
מדדנו זאת על שני צילומים משלנו שנוצרו ב-24 תמונות לשנייה, ברזולוציה 1280 × 720, בתאריך 6 באוקטובר 2026. מעוף רחפן של 10.04 שניות, 241 תמונות, הפך ל-251 תמונות ב-25 (10.04 שניות), 300 ב-30 ו-600 ב-60 (10.00 שניות). פרסומת בשמים של 8 שניות עם המוזיקה שלה הפכה ל-240 תמונות ב-30, הסאונד שלם ומסונכרן. מה שיכול להשתבש באינטרפולציה, ומתי, מפורט באינטרפולציית תמונות באמצעות AI.
השיטה שלב אחר שלב ב-Imaginode
בקנבס, node ה-שיפור במצב Video משנה את קצב התמונות: Topaz ב-×1 שומר על הרזולוציה ועולה 6 קרדיטים לחמש שניות ב-720p עד 30 תמונות לשנייה, 12 ב-50 או 60; משך הזמן והסאונד של המקור נשמרים.
חברו את הצילום שלכם, node מסוג Video שסיים ליצור או mp4 שיובא ל-node מסוג Media, ל-node שיפור במצב Video. בחרו ב-Topaz Proteus ובמקדם ×1: הרזולוציה לא זזה, רק קצב התמונות משתנה. בחרו את הקצב, 24, 25, 30, 50 או 60, והריצו. המחיר מוצג על הכפתור, מחושב לפי משך הצילום בפועל, בין שנייה אחת לשישים שניות להרצה.
התמחור עוקב אחרי המחיר של הספק: עד 30 תמונות לשנייה, זה מחיר של הגדלה, 6 קרדיטים לחמש שניות עבור פלט ב-720p, 12 ב-1080p. ב-50 או 60, המחיר מוכפל, כי החישוב מתבצע על פי שנתיים ברק אחד. אם הצילום שלכם צריך גם להגדיל ברזולוציה, ByteDance Upscaler עושה את שניהם בבת אחת: 720p שעולה ל-1080p וב-30 תמונות לשנייה עולה 5 קרדיטים לחמש שניות, 9 ב-60.
התבנית "שינוי קצב התמונות של וידאו" מכילה את זרימת העבודה הזו כבר מחוברת, עם מעוף מעל כפר ב-24 תמונות שהומר ל-30 ול-60, בעלות 18 קרדיטים עבור שתי ההרצות. החליפו את המקור בצילום שלכם והריצו מחדש. להגדלה בלי לגעת בקצב התמונות, אותו היגיון חל בלהשיג וידאו חד.
בתוכנת עריכה או באמצעות ffmpeg
DaVinci Resolve ו-Premiere Pro יודעים לבצע אינטרפולציה בייצוא או בשינוי מהירות עם מצב flux optique, ו-ffmpeg מציע את הפילטר minterpolate; הכלים המקומיים האלה חינמיים או שכבר שולם עליהם, אך הם איטיים יותר ונוטים יותר לקרעים מהמודלים החדישים.
ב-DaVinci Resolve, שוט שקצב התמונות שלו שונה מזה של הפרויקט מומר כברירת מחדל במצב Nearest, כלומר בשכפול. הגדרת ה-retiming של השוט מציעה גם Frame Blend, מעבר מתמוסס בין תמונות שכנות, ו-Optical Flow, אינטרפולציה; מצב Speed Warp, המתקדם יותר, שמור לגרסת Studio, במחיר 295 דולר. Premiere Pro, במחיר 22.99 דולר בחודש, מציע את אותה הבחירה באינטרפולציה הזמנית של השוט: Frame Sampling, Frame Blending או Optical Flow. בשני המקרים, החישוב מתבצע על המחשב שלכם, בשלב הרינדור.
עם ffmpeg, הפילטר minterpolate מבצע אינטרפולציה מבוססת תנועה, בלי רשת נוירונים: ffmpeg -i entree.mp4 -vf "minterpolate=fps=60:mi_mode=mci:mc_mode=aobmc:me_mode=bidir:vsbmc=1" sortie.mp4. זה חינמי, אבל איטי, החישוב מתבצע על המעבד, ואובייקטים מהירים משאירים קצוות קרועים או הילות. התיעוד עצמו מזהיר שמעבר בין סצנות הופך את וקטורי התנועה לאקראיים.
הכלים האלה נשארים שימושיים לשוט פשוט, תנועה איטית, המרה מ-24 ל-25. לשוט עם הרבה תנועה, רחפן, ריקוד, קהל, מודלי האינטרפולציה החדישים נותנים קווי מתאר נקיים בהרבה. ההשוואה בין הכלים, חינמיים ובתשלום, נמצאת באינטרפולציית תמונות באמצעות AI.
שלושת המלכודות שיש להימנע מהן
המרת עריכה שכבר נחתכה יוצרת תמונת רפאים בכל חיתוך, כוונה ל-60 תמונות לשנייה מסירה את האופי הקולנועי, וערבוב בין קצב תמונות ותנועה איטית גורם לציפייה לאפקט שלא מגיע.
מלכודת ראשונה: להמיר את הווידאו הסופי במקום כל שוט בנפרד. בכל חיתוך חד, המודל מחפש תנועה בין שתי תמונות שאין להן קשר אחת לשנייה ובונה תמונה שבה שני השוטים מתערבבים, גלויה לרגע בכל חיתוך. ממירים שוט אחר שוט, ואז עורכים. אם יש רק את הקובץ הסופי, כלים מסוימים מזהים מעברי סצנה ומדלגים על החיתוכים; יש לבדוק תמונה אחר תמונה.
מלכודת שנייה: להעביר הכול ל-60. וידאו ב-60 תמונות לשנייה נראה חלק כמו משחק כדורגל או משחק וידאו. זה מתאים בול לספורט, מדריך מסך, גלילת מוצר. זה מתקבל לרוב בצורה לא טובה בשוט עלילתי, שם הטשטוש הקל של התנועה ב-24 הוא חלק מהאסתטיקה, מכאן הביקורת על החלקת התנועה של מכשירי טלוויזיה.
מלכודת שלישית: לחכות לתנועה איטית. המעבר מ-24 ל-60 שומר על משך הזמן: הסצנה מתקדמת באותה מהירות, עם יותר תמונות. תנועה איטית פירושה להפעיל את 60 התמונות האלה ב-24 לשנייה, מה שמאריך את השוט פי שתיים וחצי. לתנועה איטית אמיתית ומרשימה, טיפות תלויות ושיער שמתנפנף, כדאי ליצור אותה ישירות: ראו וידאו בתנועה איטית עם AI.
הסיכום
מ-24 ל-25: להאיץ ב-4% אם משך הזמן והסאונד יכולים להשתנות, אחרת לבצע אינטרפולציה. מ-24 ל-30, 50 או 60: לבצע אינטרפולציה, שוט אחר שוט, לפני העריכה. שכפול תמונות מתאים רק כשהתנועה איטית.
השכפול חינמי ומהיר, אבל הוא גורם לכל מה שנע בקביעות לזנק בקפיצות. ההאצה מתאימה בול לסרט ב-25 תמונות, במחיר של 4% ממשך הזמן ועלייה קלה בסאונד. האינטרפולציה היא השיטה היחידה ששומרת גם על משך הזמן, גם על הסאונד וגם על תנועה חלקה, בכל קצב שתבחרו.
ב-Imaginode, היא עולה 6 קרדיטים לחמש שניות ב-720p עד 30 תמונות לשנייה עם Topaz ב-×1, או 5 קרדיטים עם ByteDance Upscaler אם אתם גם מגדילים ל-1080p במקביל. מעבר ל-30, המחיר מוכפל. הסאונד נשמר בשני המקרים.
כמעט כל וידאו שנוצר באמצעות AI מגיע ב-24 תמונות לשנייה: אם העריכה שלכם, הערוץ שלכם או המסך שלכם מצפים למשהו אחר, ההמרה היא חלק מהעבודה, בדיוק כמו קורקציית צבע או הגדלה. לעניין האחרון, ראו יצירה ב-4K או הגדלה בשלב מאוחר יותר.