דלג לתוכן הראשי
AI ליצירת תוכן11 דקות קריאהעומר

Seedance 2.5: המדריך המלא ליצירת סרטונים שנראים אמיתיים

כל ההגדרות בהיגספילד, מבנה הפרומפט שהמודל באמת מקשיב לו, ואיך עובדים עם רפרנסים. כולל סקיל של Claude שכותב לכם את הפרומפט לבד.

  • Seedance
  • וידאו AI
  • פרומפטים
  • כלים
עומר יושב מאחורי ההגה של פרארי אדומה ברחוב עירוני בשעת בין ערביים

כולנו ידענו שמתישהו זה יקרה. עכשיו זה קרה רשמית.

Seedance 2.5, המודל החדש של ByteDance, יוצר סרטונים שאי אפשר יותר לזהות מה אמיתי ומה נוצר במחשב. 30 שניות ברצף, קול מובנה, ועד 50 רפרנסים בבקשה אחת.

והנה הבעיה: רוב האנשים ייכנסו אליו, יכתבו שורה אחת, ויקבלו משהו שנראה... זול. פלסטיקי. גנרי.

לא בגלל שהמודל חלש.

בגלל שהוא מקשיב בדיוק למה שאמרתם לו, ורוב האנשים לא אומרים לו כלום.

המדריך הזה הוא השיטה המלאה. איפה לוחצים, מה לבחור, ואיך כותבים פרומפט שהמודל באמת מבצע.

איפה עובדים עם זה

אנחנו עובדים דרך Higgsfield. נכנסים, ובוחרים את Seedance 2.5 מרשימת המודלים.

למה שם ולא ישירות אצל ByteDance? כי בהיגספילד אתם מקבלים את כל ההגדרות במסך אחד, את ההעלאה של הרפרנסים באותו מקום, ואת ה-Upscale בלחיצה אחת אחרי. זה אותו מודל, בלי קוד.

ההגדרות, לפני שכותבים מילה

חמש בחירות. כל אחת מהן משפיעה על התוצאה יותר ממה שנדמה.

יחס התמונה. אנכי לסטורי, לריל ולטיקטוק. לרוחב ליוטיוב ולמודעות. 2.5 תומך בכל יחס בין 0.4 ל-2.5, אז אתם לא נעולים על שישה יחסים כמו בגרסה הקודמת.

רזולוציה: 720p. זו ההמלצה שלי וזו לא התפשרות. אתם עוד לא יודעים אם הסרטון יצא טוב, ואין שום סיבה לשלם על 4K של ניסיון. את האיכות משחזרים בסוף עם Upscale, ועל זה בהמשך.

אורך: עד 30 שניות. תבחרו את האורך שבאמת כתבתם לו תוכן. אורך שאין בו מספיק פעולות זה בדיוק המקום שבו המודל מתחיל להמציא.

High bitrate: דלוק. זה ההבדל בין גרדיאנט חלק לבין ריבועים בשמיים. זה עולה רק בגודל הקובץ.

סאונד: דלוק, אם בפרומפט יש דיבור, אפקטים או מוזיקה. כבוי אם אתם מתכוונים להלביש סאונד משלכם בעריכה.

וכאן מגיע החלק שרוב האנשים מפספסים

הפרומפט והרפרנסים.

זה לא "עוד שלב". זה כל ההבדל בין תוצאה שנכנסת ישר לעריכה לבין עוד סרטון AI שנראה כמו כולם.

Seedance 2.5 הוא לא מנוע חיפוש. הוא צוות הפקה. לצוות הפקה לא נותנים משפט, נותנים תדריך.

מבנה הפרומפט: ארבעה בלוקים, תמיד באותו סדר

הסדר הזה הוא לא סגנון. זה הסדר שבו המודל קורא.

בלוק 1: מיפוי הרפרנסים

זה הבלוק הכי חשוב במדריך הזה, וזה הבלוק שכולם מדלגים עליו.

הרפרנסים ממוספרים לפי סדר ההעלאה: Image 1, Video 1, Audio 1. כל אחד מהם צריך להיות קשור בטקסט, ולכל אחד צריך להגיד בשביל מה הוא רפרנס.

Image 1: subject appearance reference, the man.
Image 2: vehicle reference, the red Ferrari.
Image 3: environment, lighting and color reference.
Audio 1: the man's voice timbre.

שלושה כללים שנלמדו בדרך הקשה:

אל תשימו את המיפוי בתוך התמונה. אם כתבתם "עומר" על התמונה ואז כתבתם בפרומפט "עומר נכנס לרכב", תקבלו בלבול דמויות או שני עומרים בפריים. המיפוי חי בטקסט, לא בתמונה.

עם כמה דמויות, תפרטו אחת אחת. "Images 1-2 are Character 1 and correspond to Audio 1; Images 3-4 are Character 2 and correspond to Audio 2."

כשהרפרנס כבר מדויק, תפסיקו לתאר אותו. "Strictly follow the camera movement in Video 1" עובד הרבה יותר טוב מפסקה שמתארת מחדש כל תנועה. הפסקה הזו מתחרה ברפרנס במקום לעזור לו.

בלוק 2: משפט אחד שמסכם הכול

הנוסחה:

Subject + Location + Event + Genre/Style + Camera movement

בפועל:

Omer drives a red Ferrari through a rain-slicked Tel Aviv street at night, cinematic realistic short-film style, tracking side shot.

המשפט הזה מעגן את כל מה שבא אחריו. אם רשימת השוטים בהמשך תסתור אותו, תקבלו סרטון שמרגיש כמו שני סרטונים שהודבקו.

בלוק 3: העלילה, ביט אחרי ביט

מחלקים את האורך לקטעים. אפשר בחותמות זמן ואפשר ב-Shot 1 / Shot 2. שתי השיטות עובדות. חותמות הזמן חדשות ב-2.5 ונותנות שליטה הדוקה יותר.

לכל ביט: גודל שוט, תנועת מצלמה, מה קורה, ואם יש דיבור או סאונד.

0-4s: [Wide tracking shot, low angle, camera moving alongside the car]
Omer's red Ferrari from Image 2 pulls out of a side street onto the wet
main road. Neon signs reflect off the asphalt. The engine growl rises.

4-9s: [Medium shot through the open driver's window, slight handheld feel]
Omer from Image 1 keeps both hands on the wheel, glances once at the side
mirror, and looks back at the road.
Dialogue (Omer, in Hebrew): "לא הלילה."

9-15s: [Close-up on the gear shift, rack focus to his face, then slow push in]
He shifts up. The engine note climbs and the streetlights streak past
behind him. The frame settles on his face and holds.

החוקים של הזמן:

  • שניות שלמות, ברצף, בלי חורים. 0-3s ... 3-7s ... 7-15s תקין. 0-3s ... 5-6s משאיר חור שהמודל ימלא איך שבא לו.
  • פעולה אחת ברורה לכל 3 עד 5 שניות. ביט עם דיבור צריך לפחות שלוש.
  • ביט ריק מדי, המודל ממציא. ביט עמוס מדי, תקבלו קאטים מיותרים או שהוא פשוט ידלג על חלק.
  • אל תתזמנו פעולות מהירות. "מנענע בראש שלוש פעמים בשנייה" לא יעבוד.
  • אפשר גם נקודת זמן: "at the 5-second mark, a quick left wipe transition". ואפשר זמן יחסי: "after 3 seconds, the light turns green".

ב-30 שניות נכנסים בנוחות שישה עד תשעה ביטים. תשעה זה כבר גבול, מעבר לזה זה מרגיש כמו טריילר.

בלוק 4: דרישות כלליות

כל מה שצריך להחזיק לאורך כל הסרטון.

Overall requirements: Cinematic realistic style, 35mm cinema lens, shallow
depth of field, practical neon lighting against deep night blue, fine film
grain, authentic skin texture with no over-smoothing. Omer's face must
strictly follow Image 1 and stay consistent throughout with no identity
drift. Camera movement smooth and continuous, no stuttering or flickering.
Engine, tyre and rain sound only, no background music. No subtitles.
9:16 vertical frame.

שימו לב לשורה על עקביות הפנים. זו השורה שאף אחד לא כותב וכולם צריכים. בלעדיה הפנים נודדות באמצע הסרטון, ואתם לא תבינו למה.

תיאורים חיוביים, עם שלושה חריגים

תתארו מה אתם רוצים. המודל מטפל בחיובי הרבה יותר טוב מאשר באיסורים.

שלושת החריגים שכן עובדים רשמית:

  • כתוביות: No subtitles.
  • מוזיקה: No BGM; environmental and action sounds only.
  • אודיו בכלל: No audio.

כל דבר אחר, תנסחו חיובי. במקום "לא מצויר", תכתבו "realistic photographic texture, real skin pores, natural lighting".

שפת מצלמה: כתבו את זה ישר

המודל מכיר את המונחים האלה. אין צורך להסביר אותם.

קטגוריהמה כותבים
גודל שוטextreme wide / wide / medium / medium close-up / close-up
תנועת מצלמהpush in / pull out / pan / track / follow / orbit / dive / tilt up / handheld shake
זוויתlow angle / overhead / eye level / over-the-shoulder / first-person
טכניקהone-shot long take / dolly zoom / rack focus / speed ramp / bullet time / FPV / slow motion

למונח נישתי, כתבו מונח + הסבר:

Rack focus: the focus shifts smoothly, the foreground goes soft while Omer's face behind it comes sharp.

למעבר, תנו גם את הטריגר וגם את השיטה:

At the 5-second mark, a quick leftward wipe combined with a natural dissolve.

פעולות: תארו בגדול. "הוא עושה כמה תמרוני עקיפה" עדיף על תיאור של כל סיבוב הגה. פירוט יתר של כל תנועה מקפיא את התנועה. תפרטו רק את הרגע האחד או השניים שחייבים לנחות.

כמה רפרנסים אפשר, וכמה כדאי

סוגהתקרהעובד הכי טוב
תמונות301 עד 8 נושאים. 9 עד 12 אפשרי אבל פחות יציב
סרטונים10, סה"כ 30 שניותרפרנס תנועה של 5 עד 10 שניות
אודיו10, סה"כ 30 שניות1 עד 5 דמויות עם רפרנס קול
פאנלים בסטוריבורדלא מוגבל טכנית15 ומטה, קווי, בלי טקסט על התמונה
סרטון לעריכהלא מוגבל טכניתמתחת ל-20 שניות

עד חמישה נושאים, תמונות מכמה זוויות עובדות מצוין. מעל חמישה, עדיף תמונה אחת לכל זווית בנפרד ולא קולאז' אחד עם הכול.

הסקיל של Claude שכותב לכם את זה

עכשיו החלק שחוסך לכם את כל מה שקראתם עד עכשיו.

בניתי סקיל ל-Claude שמכיר את כל המבנה הזה. אתם מספרים לו בעברית מה אתם רוצים בסרטון, והוא מחזיר פרומפט מלא באנגלית, את רשימת הרפרנסים לפי סדר ההעלאה, ואת ההגדרות שצריך לבחור.

seedance-prompt.zip · 28KB

הסקיל המלא, כולל שתי חוברות רפרנס ודוגמאות מוכנות. מדריך ההתקנה בעברית נמצא בפנים.

הורדת הסקיל

ההתקנה היא פעולה חד פעמית. פותחים את .claude/skills/ (ב-Mac זה ~/.claude/skills/, בווינדוס C:\Users\<שם>\.claude\skills\), גוררים לשם את התיקייה כמו שהיא, ופותחים את Claude מחדש.

אחרי זה זה נראה ככה:

תכתוב לי פרומפט ל-Seedance לסרטון של בחור שנוסע בפרארי אדומה
ברחוב רטוב בלילה. 15 שניות, אנכי, יש לי תמונה שלו ותמונה של הרכב.

ותוך כמה שניות יש לכם פרומפט מוכן להדבקה.

עריכה והארכה של סרטון קיים

זו היכולת שהכי פחות מדברים עליה, והיא בדיוק מה שהופך את זה מצעצוע לכלי עבודה.

עריכה. אתם מעלים סרטון ומבקשים לשנות בו משהו. המודל נועל את יחס התמונה ואת האורך לפי המקור. הנוסחה שעובדת: מה בדיוק לשנות, איך זה משתנה מ-A ל-B, ומה נשאר.

Editing task. Preserve the composition, camera position, lighting and
performance rhythm of Video 1 exactly.

Change Omer's jacket from black leather to a beige canvas jacket, from the
first frame to the last. Everything else stays unchanged, including his
face, his hands, the car and the lighting.

Keep the original audio unchanged. No jump cuts, no flickering.

חשוב שתופיע מילת פעולה של עריכה: edit, add, insert, remove, delete, modify, replace, change to. בלעדיה המודל לא מזהה שזו משימת עריכה.

הארכה. מוסיפים שניות לסרטון קיים, קדימה או אחורה.

Extend Video 1 forward by 6 seconds. The Ferrari continues down the road,
slows, and pulls into a lit petrol station on the right. Omer steps out,
stretches, and looks back the way he came.

Match the grade, grain, lighting and camera behaviour of Video 1 exactly
so the join is invisible. Continue the existing engine and ambient audio
with no change in level. No music. No subtitles.

גם כאן צריכה להופיע מילת טריגר: extend forward, extend backward, continue.

ולשתי המשימות האלה, תוציאו MOV ולא MP4. זה מה ששומר על אותו צבע, אותה בהירות ואותו סאונד משני צידי התפר. ב-MP4 רואים את החיבור.

Upscale, ורק בסוף

אחרי שקיבלתם תוצאה שאתם מרוצים ממנה, נכנסים ל-Upscale Video בהיגספילד ומכפילים את הרזולוציה.

הסדר הזה הוא לא קיצור דרך, הוא השיטה: מייצרים קטן, בודקים, ומגדילים פעם אחת בסוף. מי שמייצר ישר בגדול משלם על כל ניסיון כושל במחיר מלא.

שבע טעויות שחוזרות אצל כולם

מה יצאלמהמה לעשות
יותר מדי קאטיםדחסתם יותר מדי עלילה לחלון זמןפחות פעולות לביט, או סרטון ארוך יותר
המודל המציא סצנהחלון זמן עם מעט מדי תוכןתוסיפו פירוט לביט הזה
הפנים השתנו באמצעלא כתבתם שורת עקביות"the face must stay consistent throughout, no identity drift"
הופיעו שתי דמויות זהותהמיפוי היה רק בתוך התמונהלקשור לפי מספר בטקסט
התנועה יצאה קפואהפירטתם כל תנועה בנפרדלתאר בגדול, לפרט רק את הרגעים המרכזיים
הסטוריבורד לא כובדסטוריבורד רב פאנלים הוא רפרנס רופףלעבור ל-Keyframes, תמונה נפרדת לכל שלב
תפר גלוי בהארכהייצאתם MP4להריץ שוב עם MOV

שורה תחתונה

Seedance 2.5 לא הופך אתכם ליוצרי תוכן.

הוא הופך את מה שאתם כבר יודעים לבקש לתוצאה שנראית כמו הפקה.

ההבדל בין מי שיוצא ממנו עם משהו שנכנס ישר לפיד לבין מי שיוצא עם עוד סרטון AI גנרי הוא לא הכלי, ולא התקציב. זה התדריך. ארבעה בלוקים, רפרנסים ממוספרים, ושורה אחת על עקביות.

תתחילו בקטן. סרטון אחד, 15 שניות, שתי תמונות רפרנס. תריצו את זה פעם אחת עם המבנה מלמעלה ותראו את הפער.

ואם אתם רוצים את השיטה המלאה, איך לייצר תוכן עם AI בלי לאבד את הקול שלכם, זה בדיוק מה שיש בהכשרה Invisible AI.

באהבה, מתן ועומר.