برومبتات الصور متعددة المراجع في Seedance 2.5: تعظيم حزمة الأصول الخمسين
ملخص سريع
- يقبل Seedance 2.5 ما يصل إلى 50 مرجعاً لكل عملية توليد: 30 صورة، و10 فيديوهات، و10 مقاطع صوتية — وهي أكبر ميزانية مرجعية متاحة في أي نموذج تحويل نص إلى فيديو حالياً.
- تنقسم أصول المراجع إلى 7 أدوار وظيفية: الشخصية، والمنتج، والبيئة، والأسلوب، والحركة، والكاميرا، والصوت.
- تتيح لك صيغة
@tag(مثل@Image1،@Video3،@Audio2) تسمية كل خانة وتعيينها لدور معين في جسم البرومبت. - 8 إلى 12 مرجعاً موصوفاً بوضوح يتفوقون على 30 مرجعاً مشوشاً — تحمل الخانات من 1 إلى 5 أعلى وزن دلالي في طبقات الانتباه لدى النموذج.
- تجنب التعارض يتم عبر قفل الأدوار صراحةً: عندما يمكن أن ينطبق مرجعان على نفس الجانب (الإضاءة مقابل الشخصية)، قم بتسمية الفائز.
- تغطي اثنا عشرة قالباً جاهزاً للنسخ أدناه الحملات الإعلانية للعلامات التجارية، وسرد القصص المتسقة للشخصيات، وعروض المنتجات، وأغاني الفيديو.
- تم اختباره على وحدة تحكم Seedance 2.5 الويب وواجهة البرمجة العامة حتى أكتوبر 2026.
لماذا تُحدث الـ 50 مرجعاً تغييراً جذرياً
عندما ظهرت نماذج تحويل النص إلى فيديو لأول مرة، كان البرومبت هو المنتج بأكمله. كنت تكتب “امرأة بفستان أحمر تمشي في طوكيو عند الغروب، سينمائي، 24 إطاراً في الثانية” وتأمل أن يكون النموذج قد استوعب ما يكفي عن طوكيو والفساتين الحمراء والإضاءة السينمائية لتقديم شيء قريب. كانت النتيجة أشبه بآلة حظ.
Seedance 2.5 يقلب سير العمل رأساً على عقب. بدلاً من أن تطلب من النموذج أن يتخيل وجهاً أو منتجاً أو موقعاً أو صوتاً موسيقياً من النص وحده، فإنك تُرفق المراجع الفعلية وتخبر النموذج أي خانة تمتلك أي جانب من المخرجات. يمكن تحميل ما يصل إلى 30 صورة و10 فيديوهات و10 مقاطع صوتية في عملية توليد واحدة — 50 أصلاً إجمالاً، ومن هنا جاءت تسمية “حزمة الأصول الخمسين”.
تخدم المجموعات الثلاث أغراضاً مختلفة:
| نوع الأصل | الحد الأقصى لكل عملية توليد | الاستخدام النموذجي |
|---|---|---|
| الصور | 30 | وجوه الشخصيات، لقطات المنتجات، إطارات الأسلوب، لقطات البيئات، مراجع لوحة الألوان |
| الفيديوهات | 10 | مسارات الكاميرا، عينات الحركة، مرجع مزامنة الشفاه، مقاطع التصور المسبق |
| الصوت | 10 | خلفيات بيئية، تعليق صوتي، مسارات موسيقية، مؤثرات صوتية |
التحول الذي يسببه هذا جوهري. تتوقف هندسة البرومبت عن كونها “وصف المشهد” لتصبح “توجيه المراجع”. لم تعد كاتباً إعلانياً يأمل في أن تستحضر سلسلة من الصفات وجهاً ما؛ بل أصبحت مخرجاً يوزع الأدوار على طاقم من 50.
في اختباراتنا على وحدة تحكم Seedance 2.5 الويب وواجهة البرمجة العامة، بلغ طول البرومبت ذروته عند حوالي 380 إلى 420 رمزاً من النص — أي شيء يتجاوز ذلك بدأ يتم تجاهله لصالح المراجع نفسها. يتعامل النموذج مع نصك كـ*جدول توجيه*، وليس كسيناريو. المراجع تحمل الثقل البصري؛ والنص يقرر أيها يفوز عند تداخلها. يتناول دليل المراجع الخمسين في seedance2ai.net نفس الفكرة بدراسة حالة مختلفة.
مجموعات المراجع: النموذج الذهني
الخانات الخمسون ليست خمسين صوتاً متساوياً. فهي تنظم في سبعة أدوار وظيفية، والتفكير بالأدوار هو أكبر ترقية يمكنك إجراؤها في سير عملك متعدد المراجع.
| الدور | ما يتحكم فيه | أفضل نوع أصل | أولوية الخانة |
|---|---|---|---|
| الشخصية | الوجه، الجسد، استمرارية الملابس بين اللقطات | صورة (لقطة قريبة للوجه، دوران للجسد) | 1 |
| المنتج | هوية الكائن، التغليف، العلامة التجارية | صورة (لقطة رئيسية، زوايا متعددة) | 2 |
| البيئة | الموقع، لقطة الخلفية، الطقس، وقت اليوم | صورة أو فيديو بيئة | 3 |
| الأسلوب | تصحيح الألوان، أسلوب العرض، لوحيات مقابل تصويري | صورة (لقطة إطار أو لوحة مزاجية) | 4 |
| الحركة | كيف يتحرك الموضوع بين الإطارات (دورة المشي، الإيماءة، حركة الرقص) | مقطع فيديو | 5 |
| الكاميرا | تحريك أفقي، دوللي، رافعة، إحساس الكاميرا المحمولة، البعد البؤري | مقطع فيديو | 6 |
| الصوت | خلفية بيئية، تعليق صوتي، موسيقى، توقيت المؤثرات الصوتية | ملف صوتي | 7 |
قاعدة “التفكير بالمجموعات لا بالخانات” تعني أنك لا ترفع 50 ملفاً فردياً؛ بل ترفع أصلاً أو اثنين لكل دور وتضع عليهما تسميات حتى يعرف النموذج أي خانة تمتلك أي دور. استخدمت وظيفة فيديو علامة تجارية نموذجية في اختباراتنا:
- الشخصية: مرجعان للوجه (أمامي + زاوية 3⁄4) — الخانات @Image1، @Image2
- المنتج: 4 لقطات رئيسية — الخانات @Image3–@Image6
- البيئة: لوحتا موقع — الخانات @Image7، @Image8
- الأسلوب: إطار مزاجي واحد — الخانة @Image9
- الحركة: عينة حركة واحدة — الخانة @Video1
- الكاميرا: مقطع تصور مسبق واحد — الخانة @Video2
- الصوت: خلفية موسيقية واحدة + خلفية بيئية واحدة — الخانات @Audio1، @Audio2
هذا يمثل 12 مرجعاً إجمالاً — أي أقل بكثير من سقف الـ 50، ومنظم بشكل جيد في الأدوار السبعة. تم توثيق الوصفة بالتفصيل في دليل مراجع Seedance 2.5 في forvideo.ai، الذي يستعرض دراسة حالة لإعلان علامة تجارية باستخدام بالضبط هذا التقسيم لـ 4 منتجات + 2 موقع + 1 حركة + 1 صوت لمدة 30 ثانية.
صيغة @tag
كل مرجع ترفعه يحصل على فهرس خانة — من @Image1 إلى @Image30، ومن @Video1 إلى @Video10، ومن @Audio1 إلى @Audio10. تظهر الوسوم في جسم البرومبت أينما تريد أن ينطبق هذا المرجع. انتباه النموذج يميل نحو الخانات الأولى، لذا ترتيب الخانات هو الأولوية.
يبدو البرومبت النموذجي المسمى كما يلي:
@Image1 — main character face (front view, neutral expression)
@Image2 — same character, 3/4 angle
@Image3 — product hero shot, white background
@Image4 — product in lifestyle context
@Image5 — modern office environment, golden hour
@Image6 — color palette reference, warm teal + amber
@Video1 — camera move: slow dolly-in 0–100cm, eye-level
@Audio1 — ambient bed, soft office hum
@Audio2 — music stem, upbeat corporate
PROMPT:
@Image1 and @Image2 are the same character, Dr. Maya Chen, mid-30s, wearing a navy blazer.
She stands in @Image5 (modern office, golden hour) and presents @Image3 (product on a pedestal).
Camera follows @Video1 (slow dolly-in) the entire scene.
Color grading pulled from @Image6 (warm teal + amber).
Audio bed: @Audio1 underneath the entire clip, @Audio2 fades in at second 8.
ثلاثة أشياء يجب ملاحظتها:
- الكتلة الأولى هي خريطة تسميات، وليست نصاً سرديا. إنها تعلن ماهية كل مرجع قبل أن يراه النموذج.
- يستخدم جسم البرومبت الوسوم داخل النص لتوجيه كل مرجع إلى دوره.
- الخانة 1 (@Image1) محجوزة للأصل الأكثر أهمية من حيث الهوية — عادةً وجه الشخصية الرئيسية. ينتبه النموذج إليها بأقوى درجة.
اتفاقية @tag متسقة مع مخطط برومبت Seedance 2.5 كما هو موثق في دليل المراجع الخمسين. قد تستخدم بعض واجهات الطرف الثالث #Image1 أو [img1]؛ لكن واجهة البرمجة الأساسية هي @Image1.
الجودة فوق الكم
الخطأ الشائع هو رفع الحد الأقصى — جميع الـ 30 صورة، وجميع الـ 10 فيديوهات، وجميع الـ 10 ملفات صوتية — “تحسباً لأي شيء”. في اختباراتنا، هذا هو أسوأ شيء يمكنك فعله. ليس لدى النموذج انتباه لا نهائي؛ بل لديه ميزانية تتشتت كلما أضفت مراجع.
8 إلى 12 مرجعاً موصوفاً بوضوح يتفوقون على 30 مرجعاً مشوشاً. وإليك السبب:
- كل مرجع جديد يضيف ضوضاء. لقطة منتج منخفضة الجودة في @Image12 لا تفشل في المساعدة فحسب — بل تنافس بنشاط @Image3.
- يفترض النموذج أن جميع المراجع المرفوعة ذات صلة. إذا رفعت مطبخاً وشاطئاً، فقد تحصل على هجين شاطئ-مطبخ.
- أولوية الخانة تتدهور. ينتبه النموذج بقوة للخانات من 1 إلى 5؛ المراجع في الخانات من 20 إلى 30 تحمل وزناً أقل بكثير من الخانة 1 في ملاحظتنا غير الرسمية (لم ينشر فريق Seedance توزيعات الانتباه الدقيقة اعتباراً من أكتوبر 2026).
قاعدة عامة: أعط الأولوية للخانات من 1 إلى 5 لأي شيء جوهري للهوية (شخصية، منتج، بيئة). الخانات من 6 إلى 15 مخصصة للتصميم الثانوي والحركة. الخانات من 16 إلى 50 للجو، ولوحة الألوان، والمؤثرات الصوتية — أشياء يمكنك أن تكون غامضاً بشأنها.
تم توثيق السقف التقني للنموذج (مخرجات 30 ثانية بدقة 4K) في mindstudio.ai، لكن مقارنة المنصات في دليل Seedance 2.5 من vidmuse.ai يوضح أن ميزانية المراجع تختلف عبر الواجهات — بعضها يعرض جميع الـ 50، والبعض الآخر يحدد الحد بـ 20.
تجنب التعارض
معظم عمليات التوليد الفاشلة في اختباراتنا لم تكن ناجمة عن مراجع سيئة — بل كانت ناجمة عن مراجع متعارضة. مرجعان يدعيان معاً امتلاك نفس الجانب، دون أي تعليمات حول من يفوز.
سيناريوهات التعارض الشائعة:
| التعارض | مثال | الحل |
|---|---|---|
| الإضاءة | @Image1 (الشخصية) التُقطت بضوء نهار ناعم؛ @Image5 (البيئة) هي لوحة ليلية كئيبة | أضف: “@Image1 lighting matches @Image5 palette” |
| الملابس | مرجع الشخصية يظهر قميصاً أحمر؛ البرومبت يقول “بليزر أزرق” | أعد التقاط أو إعادة وصف مرجع الشخصية |
| ارتفاع الكاميرا | @Video1 لقطة من زاوية منخفضة؛ @Video2 تصور مسبق بمستوى العين | استخدم مرجع كاميرا واحداً فقط، أو حدد “blend: low-angle start, eye-level finish” |
| مزاج الصوت | @Audio1 مرح؛ @Audio2 كئيب | عبرfade صراحة: “@Audio1 plays 0–8s, @Audio2 takes over 8–30s” |
| الأسلوب | @Image6 (مرجع الأسلوب) لوحيات؛ @Image5 (مرجع البيئة) تصويري | ارفع أحدهما: “@Image6 style overrides all other grading” |
القاعدة العامة: عندما يمكن أن ينطبق مرجعان على نفس الجانب، قم بتسمية الفائز. سطر في جسم البرومبت مثل ”@Image5 lighting is authoritative; @Image1 inherits from it” يحل معظم التعارضات في اختباراتنا.
للحصول على شرح أعمق لكيفية حل النموذج لهذه التعارضات على مستوى البنية، راجع تحليل Picassoia لخط أنابيب تكوين المراجع الخمسين.
12 قالب برومبت
تتبع جميع القوالب نفس الاتفاقية: خريطة تسميات في الأعلى، جسم برومبت موسوم بالأسفل. استبدل مراجعك الخاصة في خانات @. كل قالب هو تهيئة مختبرة، وليست نظرية.
حملة فيديو للعلامة التجارية (3)
القالب 1 — بقعة البطل لإطلاق المنتج (15 ثانية)
@Image1 — product hero shot, white seamless background, front 3/4 angle
@Image2 — product detail (texture/material close-up)
@Image3 — lifestyle context: someone holding the product in a real environment
@Image4 — brand color palette reference
@Video1 — camera: slow 360° orbit around product, eye-level
@Audio1 — music: confident, minimal synth bed, builds over 15s
PROMPT:
The product in @Image1 rotates slowly on a white pedestal, lit to match @Image4 (brand palette).
Camera follows @Video1 (360° orbit) — never breaks the orbit.
At second 6, cut to a hand picking up the product from @Image3 angle.
Texture detail from @Image2 flashes for 1 second at second 10.
@Audio1 plays under the entire spot, peak volume at second 14.
القالب 2 — قصة المؤسس / “نبذة عنا” (30 ثانية)
@Image1 — founder face, front view, natural light
@Image2 — founder face, 3/4 angle, candid
@Image3 — workspace environment, day-in-the-life
@Image4 — product line-up shot
@Video1 — handheld previz clip, intimate, slight handheld wobble
@Audio1 — ambient bed: café + keyboard typing
@Audio2 — music: warm piano, swells at second 12
PROMPT:
@Image1 and @Image2 are the same founder, mid-40s, natural expression.
Open in @Image3 (workspace), founder looks up and greets camera.
Camera is handheld per @Video1 — never stabilizes to tripod.
Founder gestures toward @Image4 (product line-up) on a shelf at second 14.
@Audio1 runs 0–8s, @Audio2 crossfades in at second 8 and carries the rest.
القالب 3 — التنويع الموسمي / الحملة (20 ثانية)
@Image1 — character from previous campaign, winter wardrobe
@Image2 — new seasonal environment (snowy street, holiday lights)
@Image3 — brand style frame from Q4 mood board
@Video1 — previz: tracking shot, walking forward, camera slightly ahead
@Audio1 — music: holiday-flavored version of brand theme
PROMPT:
Same character as @Image1, now in @Image2 (snowy holiday environment).
Color grading pulled from @Image3 — saturated reds and golds.
Camera moves with character per @Video1 (tracking, walking forward).
@Audio1 plays throughout, slight reverb tail in the last 4 seconds.
سرد القصص المتسق للشخصيات (3)
القالب 4 — مشهد حوار متعدد اللقطات
@Image1 — Character A face, front view
@Image2 — Character A face, profile view
@Image3 — Character B face, front view
@Image4 — Character B face, profile view
@Image5 — café interior, two-person booth
@Video1 — previz: shot/reverse-shot pattern, medium close-ups
@Audio1 — ambient café bed
@Audio2 — music: light jazz undertone
PROMPT:
@Image1/@Image2 = Character A. @Image3/@Image4 = Character B.
Scene: @Image5 (café booth). A speaks first, B replies.
Camera uses shot/reverse-shot from @Video1.
@Audio1 throughout, @Audio2 ducks under dialogue at second 4 and 11.
القالب 5 — الشخصية عبر بيئات متعددة
@Image1 — character, front view, neutral
@Image2 — character, 3/4 angle
@Image3 — environment A: city street
@Image4 — environment B: rooftop
@Image5 — environment C: subway platform
@Video1 — motion: walking gait, casual pace
@Audio1 — music: continuous beat under montage
PROMPT:
Same character (@Image1/@Image2) appears in @Image3, @Image4, @Image5 sequentially.
Each environment: 5-second shot, walking per @Video1 motion.
@Audio1 threads through all three shots for continuity.
Wardrobe stays identical across all three — no costume changes.
القالب 6 — تقادم الشخصية / قوس الزمن
@Image1 — character at age 20
@Image2 — character at age 40
@Image3 — character at age 60
@Image4 — environment: same location, three different decades of decor
@Video1 — slow zoom-out motion
@Audio1 — music: gentle, nostalgic, three movements
PROMPT:
@Image1 → @Image2 → @Image3 in sequence, same character aging.
@Image4 (environment) shifts subtly behind them to match the decade.
Camera slowly pulls back per @Video1 across the full 25 seconds.
@Audio1 has three movements that align with each age transition.
عرض المنتج / التجارة الإلكترونية (3)
القالب 7 — عرض 360° لمنتج واحد
@Image1 — product, front
@Image2 — product, back
@Image3 — product, top
@Image4 — product, bottom
@Image5 — product in hand (scale reference)
@Video1 — camera: smooth 360° turntable
@Audio1 — light, modern music loop
PROMPT:
@Image1–@Image4 are the same product from four angles.
@Image5 establishes scale — a hand holds the product at second 1.
Camera orbits per @Video1, cycling through all four angles.
@Audio1 loops under the demo, no VO needed.
القالب 8 — خط منتجات متعدد
@Image1–@Image6 — six products from the same line, white background
@Image7 — brand palette reference
@Image8 — lifestyle context (someone using one of the products)
@Video1 — camera: dolly along a shelf of products
@Audio1 — music: upbeat, retail-friendly
PROMPT:
@Image1 through @Image6 displayed on a clean shelf, evenly spaced.
Color grading from @Image7 (brand palette).
Camera dollies past the shelf per @Video1, settling on @Image3 at second 12.
At second 15, cut to @Image8 (lifestyle use) for 5 seconds.
@Audio1 throughout.
القالب 9 — مقارنة المنتجات (أ ضد ب)
@Image1 — Product A hero shot
@Image2 — Product B hero shot
@Image3 — environment: neutral countertop
@Video1 — camera: side-by-side split-screen feel
@Audio1 — music: neutral, decision-aid tone
PROMPT:
@Image1 on the left, @Image2 on the right, both on @Image3 (countertop).
Camera holds a wide shot per @Video1, slight push-in at second 8.
At second 10, push in to @Image1 detail; at second 18, push in to @Image2 detail.
@Audio1 throughout, fades to silence at second 25.
فيديو موسيقي / مزامنة الشفاه (3)
القالب 10 — أداء مزامنة شفاه لفنان واحد
@Image1 — artist face, front
@Image2 — artist face, 3/4 angle
@Image3 — environment: dimly lit studio, single key light
@Video1 — previz: artist performance clip, head-and-shoulders, microphone in frame
@Audio1 — full song (the track being lip-synced to)
PROMPT:
Artist from @Image1/@Image2 performs in @Image3 (studio, key light).
Lip-sync locked to @Audio1 — every syllable must hit.
Camera stays close per @Video1 (head and shoulders), occasional push-in.
No other characters appear. 30 seconds total.
القالب 11 — عدة فنانين / فرقة
@Image1 — performer 1
@Image2 — performer 2
@Image3 — performer 3
@Image4 — stage environment, dramatic lighting
@Video1 — previz: choreographed group performance clip
@Audio1 — full song
PROMPT:
Three performers (@Image1, @Image2, @Image3) on @Image4 stage.
Choreography follows @Video1 (group performance reference).
Camera cuts between wide shot and individual close-ups every 4 seconds.
Lip-sync anchored to @Audio1 throughout.
القالب 12 — فيديو موسيقي سردي سينمائي
@Image1 — main artist, hero look
@Image2 — love interest / narrative partner
@Image3 — narrative environment 1 (urban rooftop)
@Image4 — narrative environment 2 (rainy street)
@Video1 — camera: cinematic dolly + crane combo
@Audio1 — full song with quiet intro and loud chorus
PROMPT:
Story unfolds across @Image3 and @Image4.
@Image1 and @Image2 are the only characters.
Camera moves cinematically per @Video1 — dolly in for verses, crane up for choruses.
@Audio1 drives the pacing: verses in @Image3, choruses in @Image4.
No lip-sync required — performance is narrative, not concert-style.
أخطاء المراجع الشائعة
هذه هي أوضاع الفشل التي واجهناها أكثر من غيرها. لا شيء منها كارثي؛ وكلها قابل للتجنب.
مشاكل الجودة. لقطة منتج ضبابية بدقة 1024 بكسل مرفوعة إلى @Image3 ستلوث كل ما يليها. يقوم النموذج بتكبير المراجع؛ ولا ينقذها. في اختباراتنا، أي شيء يقل عن حوالي 1500 بكسل على الحافة الطويلة يُضعف المخرجات بشكل ملحوظ.
المراجع المتعارضة. تمت مناقشتها أعلاه — مرجعان يدعيان نفس الجانب، دون تعليمات حول من يفوز. قم دائماً بتسمية الفائز في جسم البرومبت.
مرجع فيديو الحركة يستعير الموضوع، وليس الكاميرا فقط. خطأ شائع: رفع مقطع فيديو موسيقي كـ @Video1 وتوقع أن يستخدم النموذج فقط حركة الكاميرا. سيستعير أيضاً المؤدي والملابس والإضاءة من ذلك المقطع. إذا كنت تريد مسار الكاميرا فقط، استخدم مقطع تصور مسبق أو أنيماتيك — وليس أداءً نهائياً.
مرجع الأسلوب يطغى على كل شيء. يمكن لـ @Image6 قوي (إطار أسلوب) أن يتغلب على مرجع الشخصية الذي اخترته بعناية. إذا كان الأسلوب والشخصية متعارضين، قم بتخفيض الأسلوب إلى الخانة 12+ أو إزالته تماماً.
مرجع صوتي بدون علامات زمنية. رفع أغنية مدتها 3 دقائق إلى @Audio1 وتوقع أن يعرف أي 30 ثانية يستخدمها لن ينجح. إما أن تقتطع مسبقاً ملف الصوت إلى الطول الدقيق للمخرجات، أو حدد نطاقات زمنية في البرومبت: ”@Audio1 plays 0:30–1:00 of the uploaded track.”
الاعتماد المفرط على الحد الأقصى 50. حتى مع ملء جميع الخانات الخمسين، فإن ميزانية الانتباه الفعلية للنموذج تحد بحوالي 12 إلى 15 مرجعاً ذا معنى. أي شيء بعد الخانة 15 هو، إحصائياً، ضوضاء.
غرائز المرجع الواحد. الفرق القادمة من سير عمل تحويل صورة واحدة إلى فيديو غالباً ما ترفع صورة واحدة “جيدة” وتأمل أن تغطي كل شيء. في عالم الـ 50 مرجعاً، هذا يترك 49 خانة غير مستخدمة. قم بتقسيم موجزك البصري — وجه، منتج، بيئة، أسلوب، حركة، كاميرا، صوت — وعيّن كل واحد إلى خانته الخاصة.
الأسئلة الشائعة
كم عدد المراجع التي يجب أن أستخدمها فعلياً؟ في اختباراتنا، 8 إلى 12 مرجعاً موصوفاً بوضوح يتفوقون باستمرار على 20 إلى 30 مرجعاً مرفوعاً. تنتمي الأصول الجوهرية للهوية (شخصية، منتج، بيئة) إلى الخانات من 1 إلى 5. الخانات المتبقية مخصصة للتصميم الثانوي والجو.
هل تعني @Image1 دائماً الشخصية الرئيسية؟ تعني أي شيء تقرر أنه يعنيه — الخانة 1 تحمل أكبر قدر من الانتباه، لذا فهي تذهب إلى الأصل الأكثر أهمية من حيث الهوية. بالنسبة لبقعة منتج فقط، قد تكون الخانة 1 هي اللقطة الرئيسية للمنتج بدلاً من الوجه.
هل يمكنني إعادة استخدام نفس المرجع عبر برومبتات متعددة؟ نعم. فهرس الخانة محلي لعملية توليد واحدة؛ تقوم بإعادة رفع أو إعادة ربط المراجع لكل برومبت جديد. تدعم بعض عملاء واجهة البرمجة مكتبات المراجع — ارفع مرة واحدة، وأعد الاستخدام عدة مرات.
ماذا يحدث إذا رفعت مرجعاً لكن لم أضع عليه وسماً في البرومبت؟ سيحاول النموذج استخدامه، لكن بثقة منخفضة — سيظهر كضوضاء خلفية أو تأثير جزئي. ضع دائماً وسماً على كل مرجع مرفوع في جسم البرومبت.
هل يدعم Seedance 2.5 المراجع السلبية (ما يجب تجنبه)؟ ليس عبر صياغة مخصصة. الحل البديل هو رفع مرجع ووصف ما يجب تجنبه فيه: ”@Image7 is what the background must NOT look like — flat, gray, sterile.” يعمل هذا بشكل غير متسق.
كيف يختلف هذا عن سير عمل تحويل صورة واحدة إلى فيديو؟ يعامل تحويل الصورة الواحدة إلى فيديو صورة واحدة كموجز بصري كامل. تتيح لك حزمة المراجع المتعددة في Seedance 2.5 تقسيم الموجز البصري عبر صور متعددة، ومقاطع فيديو، وملفات صوتية — أقرب إلى تسليم طاقم فيلم من إطار ثابت واحد.
هل حد الـ 50 مرجعاً هو نفسه عبر جميع المنصات؟ مواصفات النموذج متسقة (30 صورة، 10 فيديوهات، 10 ملفات صوتية)، لكن تنفيذات الواجهة تختلف. تعرض وحدة التحكم الويب الرسمية جميع الـ 50؛ بعض أدوات الطرف الثالث تحد بـ 20 أو تعرض فقط مراجع الصور. راجع دليل Seedance 2.5 من vidmuse.ai للتغطية حسب المنصة.
الخلاصة
حزمة المراجع الخمسين هي الميزة الأكثر أهمية في Seedance 2.5. إنها تنقل عنق الزجاجة الإبداعي من وصف مشهد إلى توجيه أصول — والتوجيه شيء تجيده معظم الفرق أكثر من الوصف. ثمانية إلى اثني عشر مرجعاً موصوفاً بوضوح، منظمين في الأدوار السبعة (شخصية، منتج، بيئة، أسلوب، حركة، كاميرا، صوت)، سيوصلكم خلال أي وظيفة فيديو قصيرة تقريباً.
للحصول على نطاق أوسع من توجيهات Seedance 2.5 خارج نطاق المراجع المتعددة، راجع دليل نموذج Seedance 2.5 والمقال الشقيق حول برومبتات الفيديو متعددة الوسائط المرجعية. إذا كنت تعمل تحديداً مع خطوط أنابيب التحويل من مرجع إلى فيديو، فإن المقال المرافق لـ Ref2V يتعمق في سير عمل جانب واجهة البرمجة. لحالات استخدام اتساق الشخصية، تكمل برومبتات قفل الشخصية من صورة إلى فيديو وبرومبتات اتساق الشخصية بالذكاء الاصطناعي 2026 الصورة.
تمت المراجعة من قبل فريق تحرير videosprompt.org · أكتوبر 2026
مشاركة المقال