VideosPrompt VideosPrompt

قوالب المرجعية إلى فيديو: دليل عملي متعدد النماذج لـ Seedance وVeo وKling وWan وما بعدها

المؤلف: VideosPrompt التاريخ: 2026-10-07 14:12:08
قوالب المرجعية إلى فيديو: دليل عملي متعدد النماذج لـ Seedance وVeo وKling وWan وما بعدها

ملخص سريع

  • المرجعية إلى فيديو (Ref2V) تستخدم صورة أو أكثر ثابتة كمرساة بصرية لمقطع فيديو مُولَّد، بدلاً من الاعتماد على النص وحده.
  • التقنيات الأساسية الثلاث في Ref2V هي مرجعية موضوع واحد، ومرجعية متعددة المواضيع، ومرجعية النمط فقط، ولكل منها هياكل مختلفة وأنماط فشل مميزة.
  • تتضمن هذه المقالة 12 قالبًا جاهزًا للنسخ مُكيَّفة لـ Seedance 2.5 وVeo 3.1 وKling 3.0 وWan 3.0.
  • هيكل Ref2V العالمي — المرساة، ووصف الموضوع، والمشهد، والحركة/الكاميرا، والصوت — ينتقل عبر جميع واجهات برمجة التطبيقات للنماذج الأربعة.
  • تمت الإشارة إلى MiniMax H3 دون التحقق منه. لم نُجرِّب H3 مع هذه القوالب؛ تم التحقق من الأدلة العملية مقابل واجهات برمجة التطبيقات الأربع الموثقة، مع قائمة مراجعة خاصة بـ H3.
  • مرجعيات النمط فقط هي الأرخص للتحقق وأفضل نقطة بداية لأي نموذج جديد بما في ذلك H3.
  • يتيح لك بروتوكول التحقق في النهاية تسجيل درجة أي نموذج، بما في ذلك H3، مقابل الهيكل المكوَّن من خمسة عناصر نفسه.

1. ماذا تعني “المرجعية إلى فيديو” في عام 2026

تقوم المرجعية إلى فيديو (Ref2V) بشرط نموذج فيديو بصورة مدخل واحدة أو أكثر بحيث يرث المخرج خصائص بصرية محددة — وجهًا، أو منتجًا، أو أسلوب إضاءة، أو لوحة ألوان علامة تجارية — لا يمكن للنص وحده وصفها بشكل موثوق. لقد formalised ورقة Ref2V (arXiv:2508.02458) نمط تسليم الواصفات الذي تكشف عنه الآن جميع واجهات برمجة التطبيقات التجارية الكبرى تحت أسماء مختلفة.

توجد ثلاث تقنيات أساسية داخل Ref2V:

التقنية حالة الاستخدام الرئيسية المدخلات نمط الفشل
مرجعية موضوع واحد تثبيت هوية واحدة (وجه، منتج، شخصية) عبر مقطع صورة مرجعية واحدة + وصف المشهد انحراف الهوية عندما يطغى prompt المشهد على المرجعية
مرجعية متعددة المواضيع تجميع شخصيتين أو أكثر كائنية داخل مشهد واحد 2 إلى N صورة مرجعية + وسوم أدوار تداخل المواضيع ولبس الوضعيات عندما لا تُميَّز الواصفات
مرجعية النمط فقط وراثة الإضاءة أو لوحة الألوان أو المعالجة الفنية صورة مرجعية واحدة + prompt خاص بالنمط النمط يطغى على الموضوع؛ تتم إعادة تنميط الموضوعات بدلاً من إعادة رسمها

يكتسي هذا التمييز أهمية لأن لكل تقنية هيكل prompt مختلف وملف تكلفة مختلف ومخاطر فشل مختلفة. يتعامل الدليل العملي لـ Ref2V مع التقنيات الثلاث دون دمجها معًا.


2. ما تحقَّق منه، وما لم نتمكن من التحقق منه

تم التحقق مقابل واجهات برمجة التطبيقات الموثقة. تم تكييف القوالب الـ12 مع الأسطح الموثقة علنًا لأربعة نماذج:

للحصول على سياق هندسة prompts، راجع دليل mstudio.ai لـ filmmaking prompts.

تمت الإشارة إلى MiniMax H3 دون التحقق منه. تتضمن الكلمة المفتاحية لهذه القطعة الإشارة إليه، لذا ندرجه في العنوان لإمكانية الوصول. لم نُجرِّب H3 مع هذه القوالب ولا نعرف ما إذا كان H3 يستخدم صيغة على طراز @tag، أو image_prompt، أو elements[]، أو آلية أخرى. طبِّق هذه على H3 بوصفها فرضية واستخدم القسم 8 لتسجيل درجة المخرج الفعلي.

لن نختلق أسماء حقول خاصة بـ H3 أو ندَّعي أرقامًا قياساسية لم نُجرِها.


3. هيكل prompt لـ Ref2V

يتفكك كل prompt لـ Ref2V إلى خمسة مكونات. نستخدم هذا الهيكل عبر جميع القوالب الـ12 لأنه ينجو من الترجمة بين واجهات برمجة التطبيقات أفضل من الصياغة الأصلية للنموذج.

# المكوّن الغرض مثال عالمي
1 مرساة المصدر يُخبر النموذج بأي صورة (صور) يرجع reference_image: ./subject.png
2 وصف واصف الموضوع المواد الذي تمثله المرساة حتى يستطيع النموذج إعادة ربطه subject_token: "the woman in the red coat"
3 محتوى المشهد يصف المشهد الجديد الذي يُوضع فيه الموضوع scene: "walking through a Tokyo alley at night, neon reflections on wet pavement"
4 اتجاه الحركة/الكاميرا يحدد كيفية تحرك المشهد camera: "slow dolly-in, eye-level, 24fps cinematic"
5 إشارة الصوت يضبط تصميم الصوت (أو الصمت) audio: "rain ambience, distant city hum, footsteps"

الهيكل قابل للنقل لأن كل واجهة Ref2V تجارية تكشف عن هذه الفتحات الخمس، ولو بأسماء مختلفة. يلفُّ Seedance المرساة في @tag، ويستخدم Veo image_prompt، ويستخدم Kling elements[] مع مفاتيح أدوار، ويستخدم Wan start_image/end_image. تبقى المكونات الخمسة كما هي.

حافظ على وصف واصف الموضوع قصيرًا — من 2 إلى 6 كلمات. الأوصاف الطويلة باللغة الطبيعية تُعيد إدخال الغموض الذي تُزيله Ref2V.


4. تكييفات القوالب بحسب النموذج

إليك كيف تُترجم نفس نية Ref2V عبر واجهات برمجة التطبيقات الموثقة، مستخدمين مثال موضوع واحد: امرأة بمعطف أحمر تمشي في زقاق طوكوي ليلاً.

| المكوّن | Seedance 2.5 | Veo 3.1 | Kling 3.0 | Wan 3.0 | |———–|————–|———|———–| | مرساة المصدر | @subject (الصورة مرفقة) | image_prompt: <image> | elements[0].image | start_image: <image> | | واصف الموضوع | the woman in the red coat | موصوف في حقل prompt | elements[0].description | موصوف في حقل prompt | | محتوى المشهد | مضمَّن في prompt | حقل prompt | حقل prompt | حقل prompt | | الحركة/الكاميرا | مضمَّن بعد // camera: | مضمَّن في prompt | مضمَّن في prompt | end_image + الكاميرا في prompt | | إشارة الصوت | مضمَّن // audio: | حقل audio_prompt | حقل audio | غير مكشوف؛ عنصر نائب |

ثلاث ملاحظات:

  1. Seedance وVeo الأكثر تعبيرًا. نظام @tag في Seedance هو الأكثر راحة للمراجع المتعددة؛ وimage_prompt في Veo هو الأنظف لأسطح الموضوع الواحد.
  2. مصفوفة elements في Kling هي آلية ربط الأدوار الأكثر وضوحًا — الأقوى للمرجعية متعددة المواضيع حيث يكون تداخل المواضيع هو المخاطر المهيمنة.
  3. start_image وend_image في Wan هي الأكثر تقييدًا — يجب تحديد الإطار الأول والأخير، وهي قوة للمرجعية الموجَّهة بالحركة لكنها قيد على Ref2V الحر.

هذا الجدول هو عمود الدليل العملي. عندما لا يستدعى نموذج محدد في قالب، ينطبق الهيكل العالمي؛ مع التكييف بحسب هذا الجدول.


5. القوالب الـ12 لـ prompt

كل قالب هو كتلة text مسيَّجة. تتبع التكييفات الخاصة بكل نموذج في القسم 6.

5.1 مرجعية الموضوع الواحد (3 قوالب)

القالب 1 — بورتريه ماشٍ (موضوع واحد، حضري)

# Ref2V — Single-subject walking portrait
# Identity-locked B-roll

[anchor]
reference_image: ./woman_red_coat.png

[subject]
subject_token: "the woman in the red coat"
preserve: face, hair length, coat color, coat cut

[scene]
location: Tokyo, Shinjuku alley, night
environment: wet pavement, neon (blue and magenta), light rain, steam from vents
time: 23:40

[motion]
camera: slow dolly-in, eye-level, 35mm feel
subject_motion: walks toward camera, slight head turn at the end
duration: 6s
fps: 24

[audio]
ambience: rain on pavement, distant traffic
foley: footsteps, coat rustle

القالب 2 — عرض المنتج (موضوع واحد، استوديو)

# Ref2V — Single-subject product showcase
# E-commerce, brand lock

[anchor]
reference_image: ./ceramic_vase.png

[subject]
subject_token: "the matte-black ceramic vase"
preserve: silhouette, glaze finish, base footprint

[scene]
location: studio, seamless off-white backdrop
environment: soft key light from camera-left, subtle rim from right

[motion]
camera: slow 180-degree turntable, slight push-in at midpoint
subject_motion: static, camera orbits
duration: 5s
fps: 30

[audio]
ambience: silent room tone

القالب 3 — لقطة حوار الشخصية (موضوع واحد، أداء)

# Ref2V — Single-subject dialogue beat
# Narrative, emotional close-up

[anchor]
reference_image: ./character_portrait.png

[subject]
subject_token: "the man with the grey beard"
preserve: face, beard shape, eye color

[scene]
location: dimly lit diner booth
environment: warm tungsten key, cool window fill
time: 02:15

[motion]
camera: locked medium close-up, very subtle handheld drift
subject_motion: slight head tilt down, then up; eyes meet lens at the end
duration: 4s
fps: 24

[audio]
ambience: diner kitchen clatter, soft jazz underscore
foley: shallow breathing

5.2 مرجعية متعددة المواضيع (3 قوالب)

القالب 4 — محادثة بين شخصيتين

# Ref2V — Two-character conversation
# Dialogue scene with identity preservation

[anchors]
reference_image_a: ./character_A.png
reference_image_b: ./character_B.png

[subjects]
subject_token_a: "the woman with the short black hair"
subject_token_b: "the man in the grey cardigan"
preserve: face, hair, primary garment color per subject

[scene]
location: park bench, autumn afternoon
environment: golden-hour side key, leaf fall, clear and cool
time: 17:45

[motion]
camera: slow push-in from wide to medium two-shot
subject_motion: A gestures with right hand while speaking; B nods, looks down, then back up
duration: 7s
fps: 24

[audio]
ambience: distant children, wind in leaves
foley: rustling jacket, bench creak

القالب 5 — تسليم الموضوع والأداة

# Ref2V — Subject + prop handoff
# Brand + actor, unboxing narrative

[anchors]
reference_image_subject: ./presenter.png
reference_image_prop: ./product_box.png

[subjects]
subject_token_subject: "the presenter in the navy blazer"
subject_token_prop: "the teal product box with the silver logo"
preserve: subject face and blazer cut; prop dimensions, logo placement, color saturation

[scene]
location: clean studio set
environment: high-key soft lighting, gradient grey backdrop

[motion]
camera: static medium shot, focus pull subject → prop at handoff
subject_motion: subject lifts box from table with both hands, holds chest-high, looks down; prop held still, slight reflection shift
duration: 5s
fps: 30

[audio]
ambience: silent
foley: cardboard slide on table
music: corporate underscore, fades in

القالب 6 — طاقم متعدد (ثلاثة مواضيع)

# Ref2V — Ensemble cast
# Group shot, foreground/background separation

[anchors]
reference_image_a: ./cast_A.png
reference_image_b: ./cast_B.png
reference_image_c: ./cast_C.png

[subjects]
subject_token_a: "the older man with the round glasses"
subject_token_b: "the young woman with the red scarf"
subject_token_c: "the child in the denim jacket"
preserve: face and signature accessory per subject

[scene]
location: subway platform, midday
environment: fluorescent overhead, daylight wall behind
time: 12:10

[motion]
camera: static wide shot
subject_motion: a stands left, hands in pockets, slight sway; b stands center, scrolls phone; c stands right, looks up tunnel, points
duration: 6s
fps: 24

[audio]
ambience: train rumble, station announcement (indistinct)
foley: footsteps, paper rustle

5.3 مرجعية النمط فقط (3 قوالب)

القالب 7 — تدريج لوني سينمائي

# Ref2V — Style-only: cinematic color grade
# Lock a teal-and-orange look

[anchor]
reference_image: ./reference_grade.png

[subject]
preserve: none (style-only)

[style]
inherit:
  palette: teal shadows, orange highlights, crushed blacks
  contrast: high
  grain: medium 35mm
  halation: subtle warm bloom on highlights
do_not_inherit:
  composition: ignore layout of reference
  subjects: do not copy figures from reference

[scene]
scene_subject: a courier on a motorcycle riding through city traffic at dusk

[motion]
camera: tracking shot, slightly low angle
duration: 5s
fps: 24

[audio]
ambience: traffic hum

القالب 8 — نقل النمط اللَّوني

# Ref2V — Style-only: painterly style
# Art-direction lock

[anchor]
reference_image: ./painting_reference.png

[subject]
preserve: scene composition, but render as if painted

[style]
inherit:
  medium: oil on canvas
  brushwork: visible, loose in background, tighter on focal subject
  palette: muted earth tones with one accent (the painting's accent)
  texture: canvas grain visible throughout
do_not_inherit:
  subjects: do not copy figures; re-render new subjects in the same style

[scene]
scene_subject: a baker arranging bread in a window display, morning light

[motion]
camera: locked medium shot
duration: 4s
fps: 24

[audio]
ambience: city street outside

القالب 9 — الهوية البصرية للعلامة التجارية

# Ref2V — Style-only: brand visual identity
# Campaign footage matching brand deck

[anchor]
reference_image: ./brand_moodboard.png

[subject]
preserve: brand palette, typography cue, motion cadence

[style]
inherit:
  palette: brand primary (deep indigo) + accent (warm gold), off-white negative
  composition: generous negative space, subject lower-third
  motion: slow, deliberate, 1.2x slower than real time
  text_treatment: leave room for headline overlay (lower-third safe area)
do_not_inherit:
  subjects: do not copy figures from moodboard
  props: do not copy specific products

[scene]
scene_subject: a small business owner unlocking their shop door at sunrise

[motion]
camera: static wide, then slow push-in during final second
duration: 6s
fps: 30

[audio]
ambience: morning birds
music: brand sonic logo sting at the end (placeholder)

5.4 المرجعية الموجَّهة بالحركة (3 قوالب)

القالب 10 — حركة الإطار البدء/النهاية

# Ref2V — Motion-driven: start/end frame
# Wan-style first/last frame anchoring

[anchors]
start_image: ./frame_start.png   # standing still
end_image: ./frame_end.png       # mid-stride, arm raised

[subject]
subject_token: "the woman in the olive jacket"
preserve: face, jacket, bag strap

[scene]
location: city crosswalk, daytime, dry
environment: bright overcast, soft shadows
time: 14:30

[motion]
camera: locked eye-level medium shot
subject_motion: interpolates from standing still to mid-stride with raised arm
duration: 3s
fps: 30

[audio]
ambience: crosswalk signal, distant traffic
foley: footsteps

القالب 11 — حركة الكاميرا فقط

# Ref2V — Motion-driven: camera-only
# Parallax reveal, locked subject

[anchor]
reference_image: ./interior_room.png

[subject]
subject_token: "the room interior (no specific human subject)"
preserve: composition, furniture placement, lighting

[scene]
location: loft apartment, late afternoon
environment: window light from camera-right
time: 18:10

[motion]
camera: slow dolly from doorway toward window, slight arc
subject_motion: none (subject is the room itself)
duration: 7s
fps: 24

[audio]
ambience: city hum outside window
music: ambient pad, low volume

القالب 12 — قوس حركي مع حركة الموضوع

# Ref2V — Motion-driven: action arc
# Dynamic beat with identity lock

[anchor]
reference_image: ./dancer.png

[subject]
subject_token: "the dancer in the white shirt"
preserve: face, shirt, hairstyle

[scene]
location: empty studio, single spotlight from above
environment: black backdrop, dust in the spotlight cone

[motion]
camera: handheld, orbits the subject in a half-circle during the move
subject_motion: leaps from a crouch, spins once mid-air, lands in a wide stance
duration: 4s
fps: 60

[audio]
ambience: silent studio
foley: shoe squeak, landing thud
music: none (post)

6. تكييفات الـ12 قالبًا بحسب النموذج

فيما يلي ترجمة القالب 1 (البورتريه الماشي) إلى سطح واجهة كل نموذج. نص المشهد المشترك (يُشار إليه بـ <scene> أدناه): “the woman in the red coat walks toward camera through a Tokyo alley at night. Wet pavement reflects blue and magenta neon. Light rain. Steam from vents.” الكاميرا المشتركة: “slow dolly-in, eye-level, 35mm cinematic.”

Seedance 2.5

@subject: ./woman_red_coat.png
<scene>
camera: slow dolly-in, eye-level, 35mm cinematic feel.
// audio: rain on pavement, distant traffic, footsteps, coat fabric

يربط @subject الصورة بأقرب عبارة اسمية؛ يتم تجاهل تعليقات //؛ أضف @subject2 و@subject3 للمواضيع المتعددة.

Veo 3.1

{
  "image_prompt": "./woman_red_coat.png",
  "prompt": "<scene>",
  "camera": "slow dolly-in, eye-level, 35mm cinematic",
  "audio_prompt": "rain on pavement, distant traffic, footsteps, coat fabric"
}

image_prompt هي المرساة؛ الباقي يذهب إلى الحقول النصية. حافظ على أوصاف المشهد دون ~120 كلمة.

Kling 3.0

{
  "elements": [
    {"image": "./woman_red_coat.png", "description": "the woman in the red coat", "role": "primary_subject"}
  ],
  "prompt": "<scene>",
  "camera": "slow dolly-in, eye-level, 35mm cinematic",
  "audio": "rain on pavement, distant traffic, footsteps, coat fabric"
}

elements هو السطح الأكثر وضوحًا لربط الأدوار. للنمط فقط، اضبط role: "style_reference" واترك description فارغة.

Wan 3.0

{
  "start_image": "./woman_red_coat.png",
  "end_image": "./woman_red_coat_frame2.png",
  "prompt": "<scene>",
  "camera": "slow dolly-in, eye-level, 35mm cinematic"
}

يتطلب Wan كلًا من start_image وend_image للمرجعية الموجَّهة بالحركة. الصوت غير مكشوف أصلًا؛ أضفه في مرحلة ما بعد الإنتاج.

مصفوفة التكييف لجميع القوالب الـ12

القالب Seedance 2.5 Veo 3.1 Kling 3.0 Wan 3.0 ملاحظات
1. بورتريه ماشٍ @subject image_prompt elements[0] start_image+end_image يحتاج Wan إطار نهاية مرسوم يدويًا
2. عرض المنتج @subject+turntable image_prompt elements[0] start_image الأربعة جميعها تتعامل
3. لقطة الحوار @subject image_prompt elements[0] توافق ضعيف Wan ضعيف في التعبيرات الدقيقة
4. شخصيتان @subject+@subject2 اثنتان من image_prompt elements[0..1] غير مدعوم Kling يتفوق
5. موضوع+أداة @subject+@prop اثنتان من image_prompt elements[0..1] توافق ضعيف Seedance/Kling قويان
6. طاقم متعدد @subject ×3 غير عملي elements[0..2] غير مدعوم Kling الوحيد الذي ينجز في لقطة واحدة
7. تدريج سينمائي @style image_prompt+إشارة elements[0] style start_image+إشارة الأربعة جميعها تتعامل مع النمط
8. نمط لوحي @style image_prompt+medium elements[0] style start_image الأربعة جميعها تتعامل
9. هوية العلامة التجارية @style+إشارة علامة image_prompt+إشارة elements[0] style start_image+إشارة الأربعة جميعها تتعامل
10. إطار بداية/نهاية ليس أصليًا ليس أصليًا ليس أصليًا أصلي Wan يتفوق
11. الكاميرا فقط @scene+camera image_prompt+camera elements[0]+camera توافق ضعيف Veo/Seedance قويان
12. قوس حركي @subject+motion image_prompt+motion elements[0]+motion كلا الإطارين الأربعة جميعها، مع تحفظات

7. المقالات الشقيقة وقراءات إضافية

مصادر خارجية:


8. التحقق من توافق H3

طريقة قابلة للتكرار لتسجيل درجة H3 مقابل الهيكل المكوَّن من خمسة عناصر:

  1. حدد ما يقبله H3. افحص واجهة H3 بحثًا عن حقل صورة مرجعية (image_prompt، أو reference_image، أو init_image، أو @tag، أو elements[])، وآلية واصف الموضوع، ودعم النمط فقط، ودعم إطار البداية/النهاية. إذا لم تستطع تأكيد الأربعة جميعًا، عامل H3 على أنه محدد جزئيًا.

  2. ابدأ بالقالب 7 (التدريج السينمائي). النمط فقط، الأرخص للتحقق. النموذج الذي يفشل في النمط فقط يفشل في كل شيء.

  3. شغّل القالب 1 (البورتريه الماشي). الاختبار المعياري لـ Ref2V ذات الموضوع الواحد.

  4. شغّل القالب 4 (محادثة بين شخصيتين). الاختبار الأول الذي يظهر فيه تداخل المواضيع. إذا بدّل H3 الوجوه أو دمج الملامح، فهذه إشارة فشل واضحة.

  5. سجّل درجة كل مخرج على خمسة أبعاد (0 = مُتجاهَل، 1 = جزئي، 2 = كامل):

| البُعد | ما يجب فحصه | |———–|—————| | دقة المرساة | هل يبدو الموضوع مطابقًا للمرجعية؟ | | دقة النمط | هل يتطابق النمط (إذا كان نمطًا فقط)؟ | | الامتثال للمشهد | هل يتطابق المشهد مع المشهد المكتوب؟ | | الامتثال للحركة | هل تتطابق الحركة مع اتجاه الكاميرا/الموضوع؟ | | الامتثال للصوت | هل يتطابق الصوت (إذا كان مدعومًا)؟ |

8 أو أكثر من 10 يعني أن H3 متوافق مع الهيكل العالمي؛ أقل من 8 يعني أن H3 يحتاج إلى تكييفات خاصة به.

  1. وثِّق حالات الفشل. المكون الفاشل (مثلًا، الصوت) هو فجوة في الميزة، وليس حكمًا على H3 ككل. دوِّن الفشل واستخدم القوالب التي لا تتطلبه.

الأسئلة الشائعة

ما هو قالب prompt للمرجعية إلى فيديو؟

يقوم قالب prompt للمرجعية إلى فيديو (Ref2V) بإقران صورة مرجعية بنص منظم بحيث يُنتج نموذج فيديو مخرجًا يرث الخصائص البصرية — الهوية، أو النمط، أو العلامة التجارية، أو الحركة — من المرجعية. البنية المعيارية لها خمسة مكونات: المرساة، وواصف الموضوع، والمشهد، والحركة، والصوت. انظر arXiv:2508.02458.

كيف تختلف Ref2V عن I2V؟

تُحرِّك I2V صورة مصدر واحدة وتتوقع حركة معقولة. تعامل Ref2V المدخل بوصفه مرجعية — قيدًا على الهوية أو النمط أو التركيب — مقترنًا بنص يُعرِّف المشهد الجديد. استخدم Ref2V عندما تحتاج إلى قفل الهوية أو دقة العلامة التجارية؛ واستخدم I2V عندما تريد فقط أن تتحرك صورة ثابتة.

أي نموذج هو الأفضل للمرجعية متعددة المواضيع؟

Kling 3.0 عبر مصفوفة elements الخاصة به التي تتضمن مفاتيح أدوار لكل موضوع. يدعمها Seedance 2.5 من خلال وسوم @subject وهو الأكثر راحةً للاستخدام المضمَّن. يتطلب Veo 3.1 حقول image_prompt منفصلة ودمجًا. لا يدعم Wan 3.0 المرجعية متعددة المواضيع في استدعاء واحد.

هل يمكنني استخدام هذه القوالب لـ H3 أو S2V/V2V؟

مُصمَّمة مقابل واجهات برمجة التطبيقات الموثقة ولم يتم التحقق منها مقابل H3؛ قد تختلف أسماء الحقول. يجب أن يُترجم الهيكل المكوَّن من خمسة عناصر، لكن اتبع القسم 8 لتسجيل درجة H3. تستهدف هذه Ref2V على وجه التحديد — S2V وV2V مرتبطتان لكن الصياغة لا تنتقل.

هل هذه المقالة مناسبة لـ H3؟

نعم، بوصفها نقطة بداية. لم نختبر H3. عامل القوالب بوصفها فرضيات، وشغِّل القسم 8، وعدِّل الصياغة لتتطابق مع سطح واجهة H3 الفعلي. سنُحدِّث ما إن تتوفر لدينا بيانات مستقلة عن H3.

كم يجب أن يكون طول prompt المرجعية إلى فيديو؟

حافظ على أوصاف المشهد دون ~120 كلمة وواصفات الموضوع من 2 إلى 6 كلمات. الأوصاف الطويلة تُعيد إدخال الغموض الذي تُزيله Ref2V.


الخلاصة

تمثل prompt المرجعية إلى فيديو في عام 2026 هيكلًا مكونًا من خمسة عناصر ينتقل عبر Seedance وVeo وKling وWan، وبمجرد التحقق — على الأرجح H3 والنماذج القادمة. عامل القوالب الـ12 بوصفها نقاط بداية، وسجِّل درجة مخرجاتك مقابل القسم 8، وكبِّغها لتتطابق مع أي سطح واجهة تعمل ضده.

للغوص في Seedance، راجع دليل prompts لـ Seedance 2.5 والمرافق متعدد المراجع لـ 50 أصلًا. للإطار متعدد الوسائط، راجع prompts الفيديو المرجعي متعدد الوسائط.


تمت المراجعة من قبل فريق تحرير videosprompt.org · أكتوبر 2026


قيود هذه المقالة

تم التحقق من القوالب الـ12 مقابل واجهات برمجة التطبيقات الموثقة لـ Seedance 2.5 وVeo 3.1 وKling 3.0 وWan 3.0. تمت الإشارة إلى H3 في العنوان والـ slug لإمكانية اكتشاف الكلمات المفتاحية، لكننا لم نُجرِّب H3 بشكل مستقل مقابل هذه القوالب ونفتقر إلى بيانات أولية حول سطح واجهة الصور المرجعية لـ H3. يجب على من يطبّقونها على H3 أن يعامل القوالب بوصفها فرضيات واتباع القسم 8. قد تختلف النتائج على H3 عن النماذج الموثقة. سنُراجِع ما إن تتوفر بيانات مستقلة عن H3.

مشاركة المقال

مقالات ذات صلة

نفس البرومبت، أربعة نماذج: إطار عمل للمقارنة متعددة النماذج لعام 2026

نفس البرومبت، أربعة نماذج: إطار عمل للمقارنة متعددة النماذج لعام 2026

مقارنة نفس البرومبت عبر نماذج متعددة 2026 — بروتوكول اختبار عادل لمقارنة Seedance وKling وVeo وWan، مع حزمة برومبتات من 12 كتلة جنبًا إلى جنب، وبطاقة تقييم جاهزة، والأخطاء التي تبطل معظم مقارنات النماذج.

2026-10-07 اقرأ المزيد →
برومبتات فيديو بالذكاء الاصطناعي مجانية وقابلة للنسخ: مجموعة 2026 التي يمكنك استخدامها اليوم

برومبتات فيديو بالذكاء الاصطناعي مجانية وقابلة للنسخ: مجموعة 2026 التي يمكنك استخدامها اليوم

24 برومبت فيديو بالذكاء الاصطناعي مجانيًا وقابلًا للنسخ لعام 2026، مُنظّمة حسب النموذج — قوالب Seedance وKling وVeo وWan مع حقول تبديل بين الأقواس، وكتل سلبية، وشروط استخدام تجاري بلغة واضحة ومباشرة.

2026-10-07 اقرأ المزيد →
برومبتات Seedance 2.5 الفيروسية: الجولة الأسبوعية (أكتوبر 2026)

برومبتات Seedance 2.5 الفيروسية: الجولة الأسبوعية (أكتوبر 2026)

مقتطفات Seedance 2.5 الفيروسية الأسبوعية — جولة تحريرية على 10 أنماط برومبت رائجة في أكتوبر 2026 (سردية ومنتجات/تواصل اجتماعي)، مع قوالب جاهزة للنسخ واللصق، ومنهجية الاختيار، وملاحظات ملاءمة النموذج لكل من Kling وVeo وWan، وحلقة من 4 خطوات لالتقاط أنماط الأسبوع القادم بنفسك.

2026-10-07 اقرأ المزيد →

قراءة موصى بها

هل أنت مستعد للبدء؟

جرب منتجنا الآن واستكشف المزيد من الإمكانيات.