שיטת השוטליסט: איך לתכנן סרטון AI לפני שכותבים פרומפט
מדריך מעשי ליוצרים: איך להפוך רעיון לסרטון AI מתוכנן, עם שוטים, תנועה, רפרנסים ופרומפטים שמייצרים תוצאה הרבה יותר נשלטת.
למה אני מתחיל בשוטליסט, לא בפרומפט
הרבה יוצרים שאני פוגש ניגשים לוידאו AI הפוך: קודם כותבים פרומפט ארוך, אחר כך מקווים שהמודל יבין את הסרט שהיה להם בראש. לפעמים זה עובד, אבל ברוב המקרים זה מייצר תוצאה יפה ולא מדויקת: תנועה לא ברורה, מצלמה שמחליטה לבד, דמות שמשתנה בין שוטים, או סרטון שנראה כמו הדגמה של מודל במקום כמו קטע שבאמת ביימו אותו.
אני מעדיף להתחיל כמו במיני-הפקה: לפני הפרומפט אני בונה שוטליסט. לא מסמך כבד של חברת הפקה, אלא רשימת שוטים קצרה וברורה שמגדירה מה הצופה רואה, מה זז, איך המצלמה זזה, מה הרגש, ומה חייב להישאר עקבי. ברגע שיש לי את זה, הפרומפטים נכתבים הרבה יותר מהר, והכי חשוב - יש לי דרך לבדוק אם התוצאה טובה או רק יפה.
זה נהיה חשוב במיוחד כשעובדים עם כלים כמו Veo, Runway, Kling או כל מודל וידאו מתקדם אחר. לפי ההנחיות הרשמיות של Google ו-Runway, פרומפט טוב לא מסתפק ב"אישה הולכת ברחוב בסגנון קולנועי". הוא מפרק את הסצנה לרכיבים: נושא, מקום, פעולה, סגנון, קומפוזיציה, תנועת מצלמה, תנועת סביבה, תאורה וטון. ב-Runway, במיוחד ב-Image to Video, ההמלצה היא לא לתאר שוב את כל מה שכבר קיים בתמונה, אלא להתמקד כמעט לגמרי בתנועה. זה בדיוק המקום שבו שוטליסט עושה סדר.
למה זה משנה ליוצר ולא רק לבמאי
אם אתה יוצר תוכן, מעצב, בעל עסק או מרצה שרוצה להשתמש בוידאו AI, אתה לא צריך להפוך לצלם קולנוע. אבל אתה כן צריך לדעת לבקש מהמודל משהו שאפשר לבצע. סרטון AI טוב הוא לא רק "איכות תמונה". הוא שילוב של בחירות קטנות: איפה מתחילים, כמה זמן השוט נמשך, האם הדמות מתקרבת או המצלמה מתקרבת, האם הרקע חי או סטטי, האם יש רגע אחד ברור שהצופה אמור לזכור.
בלי שוטליסט, כל השאלות האלה מתערבבות בתוך פרומפט אחד. עם שוטליסט, כל שוט מקבל תפקיד. שוט פתיחה יוצר הקשר. שוט שני מקרב אותנו לרגש. שוט שלישי מראה פעולה. שוט אחרון נותן פאנץ' או קריאה לפעולה. גם אם בסוף מייצרים רק שלושה קליפים של חמש עד עשר שניות, יש להם כיוון.
עוד יתרון: השוטליסט חוסך כסף וזמן. במקום לשרוף ניסיונות על פרומפטים כלליים, אני יודע מראש מה לבדוק בכל רינדור. אם שוט נכשל, אני לא זורק הכול. אני שואל: האם הבעיה בתנועה של הדמות? בתנועת המצלמה? ברפרנס? במשך השוט? בבחירת המודל? זאת עבודה הרבה יותר מקצועית.
השיטה שלי: רעיון אחד, חמישה שוטים
כשאני מתחיל סרטון AI קצר, אני לא פותח עם עשרים שוטים. אני מתחיל עם חמישה. זה מספיק כדי לספר משהו, אבל לא מספיק כדי להתפזר.
שלב 1: משפט הסרטון
אני כותב משפט אחד שמסביר מה הסרטון עושה. לא מה רואים, אלא מה הוא אמור לגרום לצופה להבין או להרגיש.
דוגמה: "להראות איך עסק קטן יכול להפוך רעיון לא ברור לקמפיין וידאו שנראה מקצועי בתוך יום עבודה אחד."
המשפט הזה שומר עליי. אם שוט נראה מגניב אבל לא משרת את המשפט, הוא יוצא.
שלב 2: בחירת פורמט
לפני הפרומפט אני מחליט איפה הסרטון יחיה. סטורי? ריל? דף נחיתה? פתיח להרצאה? סרטון אופקי ליוטיוב? הבחירה הזאת משנה את היחס, הקצב, גודל הדמות בפריים ואפילו כמות הטקסט שאפשר לשלב אחר כך בעריכה.
לריל או סטורי אני בדרך כלל חושב ב-9:16, קרוב יותר לדמות, עם תנועה ברורה ומהירה. לדף נחיתה אני יכול לבחור 16:9 או 21:9, לתת יותר מקום לסביבה, ולהשאיר אזור נקי לטקסט.
שלב 3: בניית חמשת השוטים
אני משתמש בתבנית קבועה:
- שוט 1: הקשר. איפה אנחנו ומה העולם של הסרטון?
- שוט 2: דמות או אובייקט מרכזי. מי מוביל את הסיפור?
- שוט 3: פעולה. מה משתנה מול העיניים?
- שוט 4: פירוט או רגע רגשי. מה גורם לזה להרגיש אמיתי?
- שוט 5: תוצאה. מה נשאר לצופה בראש?
לא כל סרטון צריך דמות. לפעמים האובייקט המרכזי הוא מוצר, מסך מחשב, שולחן עבודה, רובוט, מחברת, סטודיו, או אפילו רעיון מופשט שמקבל ייצוג חזותי.
שלב 4: הגדרת תנועה לכל שוט
זה השלב שהכי הרבה אנשים מדלגים עליו. הם מתארים תמונה, ואז מצפים לקבל וידאו. אבל וידאו הוא תנועה. לכל שוט אני כותב שתי תנועות: תנועת הנושא ותנועת המצלמה.
לדוגמה:
שוט 2 - תנועת נושא: היוצרת מרימה מבט מהמסך, מחייכת קלות, ומסובבת את המחברת לכיוון המצלמה.
שוט 2 - תנועת מצלמה: דולי-אין איטי מפריים בינוני לקלוז-אפ רך, בלי סיבוב חד.
אם אין לי תנועה ברורה, כנראה שהשוט לא צריך להיות וידאו. אולי הוא צריך להיות תמונת מעבר, טקסט, או בכלל להימחק.
שלב 5: החלטת עקביות
בוידאו AI, עקביות לא קורה לבד. אני מסמן מראש מה חייב להישאר אותו דבר:
- אותה דמות: פנים, גיל, לבוש, שיער, פרופורציות.
- אותו עולם: צבעים, תאורה, תקופה, סוג לוקיישן.
- אותו אובייקט: מוצר, לוגו, מסך, כלי עבודה.
- אותו טון: רציני, מצחיק, יוקרתי, ביתי, טכנולוגי.
אם העקביות קריטית, אני מתחיל מרפרנסים חזקים: תמונת דמות, תמונת מוצר, לוח השראה, או פריים פתיחה. בכלים של Image to Video, אני מתייחס לתמונה כמו לעוגן, ואז בפרומפט מתאר בעיקר את התנועה שרוצה להתרחש בתוכה.
תבנית השוטליסט שאני משתמש בה
אפשר להעתיק את המבנה הזה למסמך, Notion, Google Docs או אפילו הודעה לעצמך:
שם הסרטון: מה אנחנו יוצרים?
מטרה: מה הצופה אמור להבין או לעשות בסוף?
פורמט: 9:16, 16:9, 1:1 או אחר.
שפת צילום: ריאליסטי, פרסומי נקי, דוקומנטרי, קולנועי, אנימטיבי, עתידני, מינימליסטי.
כללי עקביות: מה אסור שישתנה בין שוטים?
שוט 1:
מטרה: פתיחה והקשר.
מה בפריים: תיאור קצר.
תנועת נושא: מה זז.
תנועת מצלמה: איך המצלמה זזה.
תאורה ואווירה: תחושה.
פרומפט בסיס: משפט אחד ברור.
שוט 2:
מטרה: קירוב לדמות או לרעיון.
מה בפריים: תיאור קצר.
תנועת נושא: מה זז.
תנועת מצלמה: איך המצלמה זזה.
תאורה ואווירה: תחושה.
פרומפט בסיס: משפט אחד ברור.
ממשיכים ככה עד שוט 5.
הטריק הוא לא למלא את זה במילים יפות. התפקיד של השוטליסט הוא להכריח אותי לבחור. אם אני כותב "מצלמה קולנועית דינמית" זה לא מספיק. אני רוצה "המצלמה עוקבת מצד ימין לשמאל במהירות איטית" או "המצלמה נשארת יציבה בזמן שהדמות מתקרבת". מודלים מבינים טוב יותר הוראות פעולה ישירות מאשר אווירה כללית.
דוגמה מלאה: סרטון ליוצרת שמוכרת סדנת AI
נניח שאני רוצה ליצור סרטון קצר לסדנת AI ליוצרים. המטרה היא להראות מעבר מכאוס לסדר: רעיונות מפוזרים הופכים לתהליך עבודה ברור.
משפט הסרטון: "יוצרת עצמאית הופכת בלגן של רעיונות למערכת תוכן מסודרת בעזרת AI."
פורמט: 9:16 לריל.
שפה: ריאליסטי, סטודיו ביתי חם, תאורת בוקר, מצלמה טבעית ולא מוגזמת.
כללי עקביות: אותה יוצרת, אותו שולחן עץ, לפטופ כסוף, מחברת צהובה, צבעים חמים.
שוט 1 - הקשר:
יוצרת יושבת מול שולחן עמוס פתקים, לפטופ פתוח, כוס קפה, אור בוקר מהחלון. היא נראית מרוכזת אבל קצת מוצפת. המצלמה בפריים רחב אנכי, תנועה איטית פנימה.
פרומפט בסיס: יוצרת עצמאית בסטודיו ביתי חם יושבת מול שולחן עמוס פתקים ולפטופ, אור בוקר רך מהחלון, היא מסתכלת על הבלגן במבט מרוכז, המצלמה מבצעת דולי-אין איטי מפריים רחב לפריים בינוני, תנועה טבעית וריאליסטית.
שוט 2 - רגע ההחלטה:
קלוז-אפ על היד שלה מסדרת שלושה פתקים לשורות: רעיון, תסריט, פרסום. המצלמה מעל השולחן בזווית קלה, בלי תנועה חדה.
פרומפט בסיס: צילום קרוב של ידיים מסדרות פתקים צבעוניים על שולחן עץ לשלוש קבוצות מסודרות, לפטופ מטושטש ברקע, המצלמה בזווית עליונה קלה ונעה לאט מצד שמאל לימין, תאורה חמימה ורכה.
שוט 3 - העבודה עם AI:
היוצרת מקלידה בלפטופ, ועל המסך רואים ממשק מופשט של עוזר AI, בלי טקסט קריא או לוגואים מזויפים. היא עוצרת, קוראת, ומחייכת.
פרומפט בסיס: יוצרת מקלידה בלפטופ בסטודיו ביתי, על המסך מופיע ממשק AI נקי ומופשט ללא טקסט קריא וללא לוגואים, היא קוראת את התוצאה ומחייכת קלות, המצלמה נשארת יציבה בפריים בינוני עם תנועת נשימה עדינה.
שוט 4 - התוצאה:
הפתקים כבר מסודרים, המחברת פתוחה, ועל השולחן מופיע מבנה ברור של שבוע תוכן. המצלמה עוברת מעל השולחן בתנועה איטית.
פרומפט בסיס: שולחן עבודה מסודר עם מחברת פתוחה, פתקים מסודרים ולפטופ בצד, תחושה של מערכת תוכן ברורה ומאורגנת, המצלמה מבצעת תנועת top-down איטית לאורך השולחן, תאורה נקייה וחמימה.
שוט 5 - סיום:
היוצרת מרימה את המחברת לכיוון המצלמה, מחייכת בביטחון, הרקע נשאר רך. זה השוט שמחזיק את הקריאה לפעולה בעריכה.
פרומפט בסיס: יוצרת בסטודיו ביתי מרימה מחברת צהובה לכיוון המצלמה ומחייכת בביטחון, הרקע מטושטש בעדינות, תאורת בוקר חמה, המצלמה מתקרבת מעט ונעצרת בפריים קרוב, מקום נקי בחלק העליון לטקסט בעריכה.
איך להפוך שוטליסט לפרומפט טוב יותר
אחרי שיש שוטליסט, אני לא מדביק את כולו למודל. אני עובד שוט-שוט. לכל שוט אני כותב פרומפט קצר יחסית, עם סדר ברור:
1. סוג הוידאו והסגנון: ריאליסטי, קולנועי, פרסומי, אנימטיבי.
2. נושא מרכזי: מי או מה בפריים.
3. סביבה: איפה זה קורה.
4. פעולה: מה הנושא עושה.
5. תנועת מצלמה: דולי, פאן, טרקינג, קלוז-אפ, פריים יציב.
6. תאורה ואווירה: בוקר, ניאון, דרמטי, נקי, טבעי.
7. מגבלות חיוביות: מה כן לשמור, במקום רשימת "אל תעשה" ארוכה.
אני משתדל לנסח חיובי. במקום "בלי עיוותים, בלי טקסט שבור, בלי ידיים מוזרות", אני כותב "תנועה טבעית, ידיים יציבות, מסך ללא טקסט קריא, קומפוזיציה נקייה". זה לא מבטיח שלמות, אבל זה בדרך כלל עובד טוב יותר מפרומפט שמנסה לריב עם המודל.
טעויות נפוצות שאני רואה שוב ושוב
הטעות הראשונה היא לבקש יותר מדי משוט אחד. אם בפרומפט אחד הדמות נכנסת לחדר, מתיישבת, פותחת לפטופ, מקלידה, מקבלת רעיון, קמה ורוקדת - המודל כנראה ידחוס, ידלג או יבלבל. עדיף לחלק את זה לשניים או שלושה שוטים.
הטעות השנייה היא תיאור סטטי מדי. "משרד יפה עם אישה ליד מחשב" יכול להיות תמונה טובה, אבל לא בהכרח וידאו טוב. צריך פעולה ותנועה.
הטעות השלישית היא תנועת מצלמה שלא מתאימה לרגש. שוט רגוע עם קריין אישי לא צריך מצלמה שמסתובבת סביב הדמות כאילו זה טריילר אקשן. שוט מכירתי יכול להיות נקי ויציב. שוט חלומי יכול לקבל תנועה איטית ורכה. התנועה צריכה לשרת את המסר.
הטעות הרביעית היא חוסר מחשבה על עריכה. אם אני יודע שארצה להוסיף כותרת, אני משאיר אזור נקי בפריים. אם אני יודע שהוידאו ייכנס לדף נחיתה, אני לא ממלא כל פינה בפרטים. AI יכול לייצר עומס ויזואלי מאוד מהר; התפקיד שלי הוא להשאיר מקום לנשימה.
הטעות החמישית היא להתאהב ברינדור הראשון. לפעמים קליפ נראה מדהים, אבל הוא לא מתאים לסרטון. אני בודק מול השוטליסט: האם הוא עושה את התפקיד שלו? אם לא, הוא לא נכנס.
צ'קליסט מהיר לפני Generate
לפני שאני לוחץ Generate, אני עובר על זה:
- האם ברור מה מטרת השוט?
- האם יש פעולה אחת מרכזית ולא חמש?
- האם תנועת המצלמה מוגדרת במילים פשוטות?
- האם הפורמט מתאים למקום שבו הסרטון יתפרסם?
- האם יש רפרנס אם אני צריך עקביות?
- האם השוט משאיר מקום לעריכה, טקסט או לוגו?
- האם הפרומפט מתאר מה כן צריך לקרות, ולא רק מה לא?
- האם השוט הזה באמת מקדם את הסיפור?
אם התשובה לאחת השאלות לא ברורה, אני מתקן לפני הרינדור. זה חוסך הרבה תסכול.
פעולה לסיום
בפעם הבאה שיש לך רעיון לסרטון AI, אל תתחיל מפרומפט. תכתוב קודם חמישה שוטים. גם אם הם פשוטים. תן לכל שוט תפקיד, תנועה, רגש וסיבה להיות שם. אחר כך תכתוב פרומפט אחד לכל שוט, תייצר, תבדוק מול המטרה, ותתקן בצורה נקודתית.
זאת הדרך שבה וידאו AI מפסיק להרגיש כמו מזל ומתחיל להרגיש כמו בימוי.
אם אתם רוצים ללמוד יצירת וידאו AI ברמה גבוהה, צעד אחר צעד ועם ליווי אישי, אפשר לבדוק את תוכנית ההכשרה שלי כאן: https://onemanaistudio.com/
מקורות למחקר
- Google DeepMind - מדריך פרומפטים ל-Veo: https://deepmind.google/models/veo/prompt-guide/
- Google Cloud - מבנה פרומפט ליצירת וידאו: https://docs.cloud.google.com/gemini-enterprise-agent-platform/models/video/video-gen-prompt-guide
- Runway - Gen-4 Video Prompting Guide: https://help.runwayml.com/hc/en-us/articles/39789879462419-Gen-4-Video-Prompting-Guide
- Runway - Image to Video Prompting Guide: https://help.runwayml.com/hc/en-us/articles/48324313115155-Image-to-Video-Prompting-Guide




