دليل تعليمي

دليل أوامر Seedance 2.0

تتميز سلسلة Seedance 2.0 بدعمها الأصلي للتوليد المشترك للصوت والفيديو، مع قدرات فائقة في الفهم الدلالي والتفاعل متعدد الوسائط. يستعرض هذا الدليل كيفية كتابة الأوامر لـ Seedance 2.0 ويشارك تقنيات عملية تساعدك على إنشاء فيديوهات عالية الجودة تطابق رؤيتك وبأقصى درجات الكفاءة.

الصيغة الأساسية

تستطيع نماذج Seedance 2.0 الإشارة إلى أصول الفيديو والصور والصوت في آنٍ واحد، لترسيخ مظهر الشخصية، وتأثيرات الحركة، والأسلوب البصري، ونبرة الصوت بدقة متناهية. يقلل هذا إلى حد كبير من صعوبة كتابة الأوامر: فباستخدام صيغ أساسية بسيطة، يمكنك توجيه النموذج للاستفادة من أصولك متعددة الوسائط وإنشاء فيديوهات تلبي احتياجاتك بدقة وسرعة.

تنقسم مهام توليد الفيديو بالاعتماد على المواد المرجعية إلى ثلاثة أنواع: المرجع متعدد الوسائط، وتعديل الفيديو، وتمديد الفيديو. اختر الصيغة الأساسية التي تناسب نوع مهمتك.

المرجع متعدد الوسائط

استخرج عناصر محددة من أصولك (مثل عنصر أساسي، أو أسلوب، أو مشهد، أو صوت) لتوليد فيديو جديد تمامًا.

  • الأفضل لـ: نقل الحركة، وإعادة استخدام العناصر الأساسية، واستعارة الأجواء العامة، والمهام المشابهة
  • النماذج الموصى بها:
  • مرجع الصورة: بالرجوع إلى <Subject N> في <Image N>، قم بتوليد...
  • مرجع الفيديو: بالرجوع إلى <motion / camera work / style / sound> في <Video N>، قم بتوليد...
  • مرجع الصوت: بالرجوع إلى نبرة الصوت في <Audio N>، قم بتوليد...

تعديل الفيديوهات

إجراء تعديلات موضعية أو شاملة على فيديو موجود بالفعل. ويبقى كل ما لم تذكره دون تغيير بشكل افتراضي.

  • الأفضل لـ: الاستبدال الموضعي، وإزالة العناصر، وتغيير التفاصيل، والمهام المشابهة
  • النماذج الموصى بها:
  • إضافة عنصر: وصف دقيق لـ <element traits> + <when it appears> + <where it appears>
  • تعديل عنصر: تعديل <Video N> بدقة، وتغيير <original trait> إلى <new trait>
  • حذف عنصر: حدد العنصر المراد إزالته؛ ولتجنب تغيير العناصر الأخرى، يُفضل تحديدها صراحة في الأمر لتحسين النتائج

تمديد الفيديوهات

مواصلة الفيديو الأصلي على طول المحور الزمني، مع الحفاظ على تناسق الأسلوب السمعي البصري، والعناصر، والتدفق السردي.

  • الأفضل لـ: إكمال مسار القصة، أو تمديد حركة معينة، أو ملء الأجزاء المفقودة
  • النماذج الموصى بها:
  • تمديد فيديو: تمديد <Video N> للأمام/للخلف، لتوليد...
  • إكمال المسار: <Video 1> + <transition description> + ثم <Video 2> + <transition description> + ثم <Video 3>

ملاحظة

في مهام التعديل والتمديد، أشر إلى الفيديو مباشرة بصيغة <Video N>. ولا تكتب "بالرجوع إلى <Video N>"، حتى لا يتم تصنيف المهمة عن طريق الخطأ كمهمة مرجعية.

المهام المشتركة

يمكن أيضًا الجمع بين أنواع المهام الثلاثة المذكورة أعلاه.

  • الأفضل لـ: الإشارة إلى أصل معين في أثناء تعديل أصل آخر
  • النموذج الموصى به: بالرجوع إلى [reference dimension] لـ <Image/Video N>، قم بتعديل <Video X> بدقة، [specific edits]

أمثلة على الأوامر

أمثلة على الأوامر لسيناريوهات متعددة باستخدام Seedance 2.0 — لمساعدتك في إتقان التحكم بالمرجع متعدد الوسائط وتوليد النصوص. اختر النموذج الأقرب لعملك وقم بملاءمته.

توليد النصوص

الشعارات النصية (Slogans)

قالب الأمر:

「محتوى النص」+「وقت الظهور」+「مكان الظهور」+「طريقة الدخول」،「سمات النص (اللون، الأسلوب)」

نصيحة

يقوم Seedance 2.0 تلقائيًا بمطابقة أسلوب النص المناسب مع السياق. إذا كانت لديك متطلبات صارمة لمظهر النص، يرجى مراجعة "مرجع الصور المتعددة ← مرجع الشعار" أدناه.

المواد المرجعية

Image 1
Image 1

النتيجة

الأمر

أسلوب رسوم متحركة مرسومة يدويًا. يجلس ثلاثة أشخاص معًا يتناولون الدجاج المقلي من Image 1، في أجواء دافئة وودية. ثم يتلاشى المشهد تدريجيًا، ويظهر النص “快乐尽在 Seedance” ‏(“Joy is all in Seedance”) في منتصف الإطار.

الترجمة المصاحبة (Subtitles)

قالب الأمر:

تظهر الترجمة المصاحبة في أسفل الإطار، وتقرأ "..."، متزامنة بدقة مع الصوت.

النتيجة

المواد المرجعية

Tutorial illustration

الأمر

توليد فيديو بتعليق صوتي. يتحدث صوت رخيم وهادئ لرجل قائلاً: “In the vastness of the cosmos, our world is but a fleeting moment. And yet, within it, life flourishes against all odds.” يتغير المشهد ببطء من الليل إلى الفجر — حيث تتلاشى النجوم مع شروق الشمس من خلف الجبال. تظهر الترجمة المصاحبة أسفل الإطار تزامناً مع السرد الصوتي.

النتيجة

المواد المرجعية

Tutorial illustration

الأمر

يتحادث الشخصان الموضحان في الصورة داخل مكتب. تبدأ المرأة بالحديث أولاً: “你每次卡点到,是不是很享受这种刚刚好的感觉?” ‏(“You always arrive right on the dot — do you enjoy cutting it that close?”) ويرد الرجل مبتسمًا: “我有我的节奏” ‏(“I have my own rhythm”). تبدو المحادثة عفوية وطبيعية، مع ظهور نصوص الحوار المطابقة أسفل الإطار.

فقاعات الكلام (Speech Bubbles)

قالب الأمر:

「الشخصية」تقول: "..."؛ وأثناء حديثها، تظهر فقاعة بجانبها تحتوي على النص المنطوق.

النتيجة

المواد المرجعية

Tutorial illustration

الأمر

يركض الشخصان الموضحان في Image 1 بملابس رياضية على مضمار المدرسة. تنظر الفتاة إلى الفتى وتقول بابتسامة ثقة: “We can definitely do it!”. لقطة مقربة للفتى يرد فيها بتردد: “Are you sure؟”. العودة إلى لقطة متوسطة مقربة للفتاة وهي تقول بحماس: “Yes!” — بنبرة متفائلة وحاسمة. تظهر فقاعة بجانب المتحدث تحتوي على النص المطابق لكلامه.

النتيجة

المواد المرجعية

Tutorial illustration

الأمر

بالرجوع إلى الفتاة في Image 1 و Image 2: تقطف حبة فراولة في حقل فراولة، وتتذوقها، ثم تقول مبتسمة: “This is the real deal!”. تظهر فقاعة حولها تحتوي على النص المنطوق.

مرجع الصور

يدعم Seedance 2.0 المراجع متعددة الزوايا للعناصر، بالإضافة إلى مراجع الصور المتعددة مثل صور المشاهد والرسوم التخطيطية للمشاهد (Storyboards).

إذا كان ترتيب الصور مهمًا، يرجى تحميلها بالترتيب والإشارة إليها بدقة في الأمر مثل Image 1، Image 2، ... Image n.

مرجع العناصر متعدد الزوايا

يكفي توضيح الهدف المرجعي — يستجيب النموذج للتعليمات التي تشمل الأمثلة التالية (على سبيل المثال لا الحصر). المنتجات:

الأجهزة الإلكترونية الاستهلاكية

النتيجة

المواد المرجعية

Tutorial illustration

الأمر

استخرج الكاميرا من Image 1 و Image 2 و Image 3، واستبدل الخلفية باللون الأبيض. توضع الكاميرا على طاولة بيضاء؛ تركز العدسة عليها في لقطة مقربة، ثم تدور ببطء حولها باعتبارها العنصر الأساسي، لتظهر بوضوح واجهتها وجوانبها وخلفيتها.

المستلزمات المنزلية

النتيجة

المواد المرجعية

Tutorial illustration

الأمر

في مشهد منزلي ذي ألوان دافئة، تعرض لقطة متوسطة الكوب الحافظ للحرارة (Thermos) من الصور المرجعية. تتحرك الكاميرا بسلاسة لتتحول إلى لقطة مقربة؛ تدخل يد إلى الإطار بشكل طبيعي وتُمسك بجسم الكوب وترفعه، وتتبع الكاميرا حركة الدوران البسيطة لليد أثناء استعراض المنتج.

الشخصيات:

المواد المرجعية

Tutorial illustration

النتيجة

الأمر

بالرجوع إلى المرأة في Image 1 و Image 2 و Image 3، قم بتوليد مشهد لها وهي تتناول الكيك في مقهى.

مرجع الصور المتعددة

مرجع الشعار

النتيجة

المواد المرجعية

Tutorial illustration

الأمر

الخلفية عبارة عن ممر جوي مضاء بالنيون في مدينة مستقبلية، حيث تتحرك الطائرات بين الإعلانات الهولوغرافية. بالرجوع إلى الفتاة في Image 2: تبدأ بلقطة متوسطة للفتاة وهي تطلق فانوسًا هوائيًا فضيًا طائرًا يحمل عرضًا هولوغرافيًا، ثم تتراجع الكاميرا لتكشف عن سماء مليئة بالفوانيس الطائرة. يتلاشى الإطار تدريجيًا ويظهر الشعار من Image 1. الأسلوب العام: رسوم متحركة ثلاثية الأبعاد بأسلوب الخيال العلمي السايبربانك (3D cyberpunk).

مرجع العناصر المتعددة

النتيجة

المواد المرجعية

Tutorial illustration

الأمر

بالرجوع إلى القط والكلب في الصور: في شقة مريحة، يستلقي الكلب ليأكل من وعائه؛ يقترب القط ويلمس الكلب بمخلبه؛ يتوقف الكلب عن الأكل عند رؤيته للقط، وينام القط بالقرب من الكلب. لوحة ألوان دافئة.

مرجع العناصر المتعددة المتقدم

النتيجة

المواد المرجعية

Tutorial illustration

الأمر

يقع المشهد داخل المطعم الموضح في Image 4، المكتظ بالزبائن. تقوم الفتاة من Image 1، التي ترتدي الملابس الموضحة في Image 2، بترتيب الأشياء على المنصة. الفتى من Image 3 زبون؛ يتقدم نحوها، آملًا في طلب معلومات الاتصال الخاصة بها. يظل الشعار من Image 5 ظاهراً في الزاوية اليمنى السفلية من الإطار طوال الوقت.

مرجع القصص المصورة المتعددة (Multi-panel storyboard)

النتيجة

المواد المرجعية

Tutorial illustration

الأمر

بالرجوع إلى القصة المصورة (Storyboard) في الصورة، قم بتوليد مشهد قتال حاد. يظهر تكوين كل إطار بالترتيب، وبعد ذلك يتقاتل الاثنان بقوة.

مرجع القصة المصورة (Storyboard)

النتيجة

المواد المرجعية

Tutorial illustration

الأمر

بالرجوع إلى تأطير الإطار Image 3: تنتظر فتاة والدها حتى ينتهي من الطهي وتقول: “아빠, 배고파요! 밥 다 됐어요?” — مع رجوع شكلها إلى Image 1. ثم تتحرك الكاميرا يمينًا لتنتقل إلى تأطير Image 4؛ ويرد الأب، الذي يرجع شكله إلى Image 2، قائلاً: “거의 다 됐어, 조금만 기다려!” قطع رجوعي إلى لقطة مقربة لوجه الابنة الذي يبدو عليه خيبة الأمل قليلاً وهي تقول: “아직 멀었어요? 맛있는 냄새 나는데…” ثم انتقال لقطة مقربة للأب وهو يقول: “이제 진짜 금방이야。 "빨리빨리" 하지 말고 손부터 씻고 وا!”

مرجع الفيديو

يدعم Seedance 2.0 مرجع الفيديو — يكفي فقط أن تكون واضحًا بشأن ما تود توليده وما تشير إليه كمرجع.

إذا كان ترتيب الفيديوهات مهمًا، يرجى تحميلها بالترتيب والإشارة إليها بدقة في الأمر مثل Video 1، Video 2، ... Video n.

مرجع الحركة

السينما والتلفزيون

النتيجة

المواد المرجعية

Video 1
Tutorial illustration

الأمر

بالرجوع إلى حركة الشخصية ولغة اللقطات في Video 1، قم بتوليد مشهد قتال بين Image 2 و Image 1 — حيث Image 2 هو الشخص على اليسار، و Image 1 هو الشخص على اليمين. موسيقى خلفية حماسية.

التسويق

النتيجة

المواد المرجعية

Video 1

الأمر

بالرجوع إلى شكل ركض الحصان في Video 1، قم بتوليد جواد ذهبي يركض عبر المروج، ثم قم بتجميد لقطة ركضه المهيبة ليتلاشى ويتحول إلى قلادة ذهبية على شكل حصان.

مرجع حركة الكاميرا

النتيجة

المواد المرجعية

Video 1
Image 1
Image 1

الأمر

بالرجوع إلى حركة الكاميرا في Video 1، قم بإنشاء فيديو تصويري لمدينة تقنية: يكون المبنى الشاهق في Image 1 هو المركز البصري، نفس لقطة الهبوط السريع من منظور الشخص الأول، مظهرًا الطابع المستقبلي للمجمع في Image 1.

مرجع التأثيرات

السينما والتلفزيون

النتيجة

المواد المرجعية

Video 1
Image 1
Image 1

الأمر

بالرجوع إلى تأثير الجسيمات الذهبية في Video 1: بينما تعزف الشخصية الموضحة في Image 2 على الناي، يدور تأثير الجسيمات نفسه حولها.

التأثيرات المبتكرة

النتيجة

المواد المرجعية

Video 1
Image 1
Image 1

الأمر

بالرجوع إلى التأثير في Video 1، امنح الفتاة في Image 1 نفس الأجنحة، وبمسار ظهور ونمو جناحين متطابق تمامًا.

تعديل الفيديو

يدعم Seedance 2.0 تعديل الفيديو: بما في ذلك إضافة العناصر أو حذفها أو تعديلها؛ وتمديد الفيديو للأمام أو للخلف؛ وإكمال المسارات.

إذا كان ترتيب الفيديوهات مهمًا، يرجى تحميلها بالترتيب والإشارة إليها بدقة كـ Video 1، Video 2، ... Video n.

إضافة / حذف / تعديل العناصر

إضافة عناصر

النتيجة

المواد المرجعية

Video 1

الأمر

أضف دجاجاً مقلياً وبيتزا ووجبات خفيفة أخرى على الطاولة الموضحة في Video 1.

حذف عناصر

النتيجة

المواد المرجعية

Video 1

الأمر

أزل الأدوات والقطع الأخرى من على المكتب الموضح في Video 1، مع الحفاظ على المكتب نظيفاً ومرتباً — يتبقى فقط ما يحملانه بين أيديهما.

تعديل عناصر

النتيجة

المواد المرجعية

Video 1
Image 1
Image 1

الأمر

استبدل زجاجة العطر الموضحة في Video 1 بـ كريم الوجه من Image 1، مع الاحتفاظ بالحركة وزوايا الكاميرا دون تغيير.

تمديد الفيديو

ملاحظة

يقوم النموذج تلقائيًا بقص جزء الربط لعملية الدمج البصري (Compositing) — ولن يعيد توليد أي لقطات يحتوي عليها الفيديو المدخل بالفعل.

التمديد للخلف

النتيجة

المواد المرجعية

Video 1

الأمر

توليد أحداث ما بعد Video 1: يركض الرجلان المتأخران نحوهما، ويلتقي الخمسة أخيراً ويتبادلون أطراف الحديث بحرارة وود.

التمديد للأمام

النتيجة

المواد المرجعية

Video 1

الأمر

تمديد Video 1 للأمام: لقطة من فوق كتف الرجل الذي يرتدي الأبيض، وهو يقول: “It's not that bad. You're just stressed. Everyone goes through this, you just need to keep going.”

إكمال المسار

نصيحة

  • يقبل Seedance 2.0 بحد أقصى 3 فيديوهات مدخلة، على ألا يتجاوز الطول الإجمالي 15 ثانية.
  • يقوم التوليد تلقائيًا بقص أجزاء الربط للفيديو الأول والأخير، مع الاحتفاظ فقط بما هو مطلوب لعملية الدمج.

النتيجة

المواد المرجعية

Video 1
Video 2

الأمر

Video 1 — في اللحظة التي تهبط فيها ورقة الشجر، يتصاعد منها تأثير جسيمات ذهبية؛ تعصف هبة ريح — ثم يتم الانتقال إلى Video 2.

الصيغة المتقدمة

يعد Seedance 2.0 بمثابة مخرج ذكاء اصطناعي متعدد الوسائط: فهو يقرأ الأوامر النصية والصور ومقاطع الفيديو والملفات الصوتية في نفس الوقت، ويقسمها داخليًا إلى طبقة مكانية (ما يظهر داخل الإطار) وطبقة زمنية (كيف تتغير الأشياء بمرور الوقت) لفهم اللقطات وتوليدها.

وفقاً لذلك، فإن النص البرمجي الجيد لا يتألف من 'صفات ترويجية'، بل هو عبارة عن صيغة تعليمات هندسية دقيقة: مَن الشخص المطلوب، في أي مشهد، وما الحركة التي يقوم بها، مع أي حركة كاميرا ووفق أي ترتيب — بحيث تُسند كل تفصيلة إلى طبقتي المكان والزمان. الصيغة:

الصيغة المتقدمة للأمر: تحديد دقيق للعنصر الأساسي + تفاصيل الحركة + المشهد والبيئة + الإضاءة والألوان + حركة الكاميرا + الأسلوب البصري + جودة الصورة + المحددات

باختصار: حدد أولاً منْ يفعل ماذا، ثم عين أين وما هو الجو العام، ثم أخبر النموذج بكيفية التصوير، وأخيرًا اضبط النتيجة باستخدام سمات الأسلوب والجودة والمحددات. نوضح تالياً تفاصيل كل عنصر.

1. تحديد العناصر الأساسية

غالباً ما تحتوي الصورة المرجعية الواحدة على عناصر متعددة. للإشارة إلى كائن معين بدقة، يجب تعريف عناصرك صراحة. يمكن أن يكون العنصر شخصًا، أو أداة تصوير (Prop)، أو مشهدًا.

  • النموذج الموصى به: حدد الـ [subject's core traits] في <Image/Video N> بصفته <Subject N>
  • شروط السمات الأساسية: استخدم من 2 إلى 3 سمات ثابتة ومميزة وواضحة (الملابس، تسريحة الشعر، المظهر الخارجي، الفئة) بحيث يسهل التعرف على العنصر بشكل فريد
  • أمثلة:
  • تحديد المرأة التي ترتدي فستانًا أحمر وقبعة قش في Image 1 لتكون Subject 1
  • تحديد المرأة التي ترتدي فستانًا أحمر وقبعة قش في Image 1 لتكون Zhang Hong

ملاحظة

  • أشر صراحةً إلى العناصر في كل مرة تظهر فيها — لا تترك الإشارة ضمنية. هناك خياران مدعومان:
  • بالنسبة للمشاهد البسيطة التي لا تحتوي على عناصر معرفة مسبقًا، اكتب <Subject N>@<Image N> في كل مرة يظهر فيها العنصر، لتأكيد الربط بين العنصر والأصل. مثال: Zhang San@Image 1.
  • بالنسبة للمشاهد ذات العناصر المعرفة مسبقًا، التزم باستخدام نفس التسمية (Label) في كل مرة. مثال: حدد الرجل الطويل في Video 1 كـ Cop والرجل الأقصر كـ Thief، ثم استمر بالإشارة إليهما كـ Cop و Thief طوال النص.
  • حافظ على إيجاز الوصف. وتفادى التكرار والتعارضات الدلالية المربكة (مثل إعطاء صفات متناقضة لنفس العنصر).
  • يُفضّل التعبير عن العلاقات المكانية من خلال الصور المرجعية بدلاً من استخدام أوصاف نصية معقدة.

2. استخدام تسلسل اللقطات المتعاقبة (Shot-by-Shot)

تفصل البنية الداخلية للنموذج بين المكان والزمان. لذا، لإنتاج فيديو معقد، فإن الشكل المثالي للأمر هو الجدول المخطط للقطات: قسم الفيديو إلى لقطات متتالية ووصف كل لقطة ديناميكيًا، حسب ترتيب حدوثها — مَن + أين + ماذا يفعل + كيف تتحرك الكاميرا.

نصيحة عملية: اكتب تقسيمًا بسيطًا للقطات مثل "Shot 1 / Shot 2 / Shot 3" للفيديو، ثم ادمجها في الأمر التفصيلي الشامل.

  • مثال ضعيف: 'يجري رجل بتوتر عبر الشوارع؛ يبدو الكادر سينمائيًا للغاية.'
  • مثال قوي:
  • Shot 1: لقطة جانبية لزقاق شارع؛ يبدأ الرجل بالركض ببطء، مع تصاعد نبرة تنفس متسارعة تدل على العجلة.
  • Shot 2: يصطدم الرجل بكشك فاكهة؛ تتحرك الكاميرا بسرعة خاطفة (Whip pan) لتستقر على لقطة مقربة لوجهه المذعور.
  • Shot 3: يقفز الرجل من فوق جدار منخفض ويختفي؛ تتراجع الكاميرا ببطء وتثبت على الشارع الخالي.

قواعد محددة

  • استخدم واصفات مثل Shot 1 و Shot 2 و Shot 3 ونظّم المحتوى بترتيب حدوث الوقائع (الأهم فالأهم). لا تفرض مدة محددة لكل مقطع — دع النموذج يحدد إيقاع القصة وتدفقها بشكل طبيعي.

نصيحة

دعم التقيد بالتوقيت الدقيق من قبل النموذج (مثل '0-3 ثوانٍ') غير مستقر. وقد يؤدي فرض مدد زمنية محددة إلى نتائج غير دقيقة أو غريبة.

يُفضل تنظيم كل لقطة وفقًا لهذا الترتيب:

  1. حركة الكاميرا أو الانتقال البصري: مثل 'لقطة واسعة تتقرب ببطء'، 'كاميرا ثابتة'، 'قطع إلى...'.
  2. حركة وتعبير العنصر: الحركات الرئيسية وتغيرات تعبيرات الوجه للشخصية الأساسية أو الكائن.
  3. الموضع البصري أو التغير المكاني: المشهد، أو الموقع، أو العلاقات المكانية للعنصر.
  4. المعلومات الصوتية: المؤثرات السمعية، أو الحوار، أو الموسيقى التصويرية المرافقة لتلك اللقطة.

3. وصف الحركة

  • أعضاء جسم محددة + تحديد شدة الحركة — صف الحركات بالتفصيل وصولاً إلى اليدين، الساقين، الرأس، الكتفين والظهر، وأضف تفاصيل المدى والسرعة والقوة. أمثلة: يرفع يده ببطء، يلتفت برأسه سريعاً، يدفع الأرض بقدمه بقوة، يطأطأ رأسه قليلاً.
  • تفضيل الحركات الصغيرة واللطيفة والمستمرة — ابحث دائماً عن الأفعال الدقيقة البطيئة المترابطة؛ وتجنب الركض السريع، القفزات الكبيرة، والالتفافات الحادة وغيرها من الحركات المتفجرة أو الديناميكية للغاية. أمثلة: يمشي ببطء، يرفع يده بلطف، يميل رأسه لأسفل قليلاً، يجلس في حركة واحدة سلسة.
  • وصف الانتقالات بين الحركات — حدد بوضوح الزخم والانتقال المنساب بين الحركات المتتالية ليبقى تدفق الحركة متجانساً. أمثلة: يستغل قوة الالتفاف ليرفع يده، ينتقل بسلاسة من الثبات إلى رفع اليد.
  • تجسيد المشاعر في تفاصيل جسدية ملموسة — عبّر عن المشاعر عبر تفاصيل جسدية ملموسة بدلاً من الكلمات المجردة مثل 'حزين جداً' أو 'غاضب بشدة'. تفحص الجدول أدناه:
المشاعر المجردةالحركات والتفاصيل الجسدية الملموسة
الحزنرأس مطأطأ، كتفان يرتجفان طفيفاً، احمرار في العينين، أصابع تقبض بشكل لا إرادي على حافة الملابس، وعينان تغرورقان بالدموع دون أن تسقط
الفرحارتفاع زوايا الفم بشكل لا إرادي، ارتخاء الحاجبين والعينين، خطوات متسارعة وخفيفة، دندنة لحن بشكل غير واعٍ، وعدم القدرة على مقاومة الدوران في مكانه
التوتر / القلقالنظر المتكرر إلى ساعة اليد، نقر الأصابع على الطاولة بلا توقف، تنفس متسارع، نظرات متشتتة وزائغة، وقضم الأظافر دون وعي
الغضبقبضتان مشدودتان، فك منقبض، صدر ينبض ويعلو ويهبط بعنف، نظرات حادة كالشفرة، وخروج الكلمات بصعوبة من بين أسنان مطبقة
الارتياحزفير طويل وعميق، ارتخاء تام للكتفين المشدودين، ابتسامة خفيفة تبدو وكأنها تعود بعد غياب، وتوجيه النظر برفق نحو الأفق

4. حركة الكاميرا

يفهم النموذج مصطلحات تصوير الفيديو بدقة بالغة — ما عليك سوى استخدام المصطلحات السينمائية القياسية مباشرة، مثل: 'لقطة متوسطة (Medium shot)، لقطة مقربة (Close-up)، لقطة واسعة (Wide shot)، حركة تقريب بطيئة (Slow push-in)، تتبع جانبي سلس (Lateral tracking)، كاميرا مثبتة تماماً (Locked-off camera)'.

ملاحظة

حدد حركة كاميرا واحدة فقط في اللقطة الواحدة. إذ إن المطالبة بالتقريب والابتعاد والالتفاف والتتبع في آن واحد تزيد من عدم استقرار الإطار البصري.

5. الجودة والأسلوب والمحددات

تعتبر شروط الجودة والأسلوب والمحددات ركائز أساسية للتحكم بالمنتج النهائي. فهي ترسم الحدود الإبداعية للنموذج، وتوحد جودة الصورة والتوجه الفني، وتمنع العيوب البصرية والحيود العشوائي — وهي إعدادات أساسية لضمان خروج لقطات مستقرة ومثالية.

1. جودة الصورة — تحدد مستويات الوضوح وتفاصيل القوام والمظهر الضوئي، مما يرفع المستوى الأدنى للجودة. مثال: دقة عالية (High definition)، تفاصيل غنية، مظهر سينمائي، ألوان طبيعية، إضاءة ناعمة.

2. الأسلوب البصري (Style) — يضع التوجه الفني والمحيط اللوني العام، موحداً الأجواء الفنية. مثال: لوحة ألوان سايبربانك زرقاء وبنفسجية باردة، فيلم سينمائي عتيق (Vintage film)، درجات ألوان يابانية منعشة.

3. المحددات (Constraints) — بالغة الأهمية. تمنع المحددات بفعالية العيوب البصرية والتشوهات والعناصر غير المنطقية، لتؤطر عملية التوليد وتثبت المشهد. القوالب الشائعة:

  • تجنب الترجمة المصاحبة: 'حافظ على خلو الفيديو من أي ترجمة مكتوبة'، 'تجنب توليد أي نصوص أو ترجمات مصاحبة'
  • تجنب الشعارات: 'لا تقم بتوليد شعارات'
  • تجنب العلامات المائية: 'لا تقم بتوليد علامات مائية'

6. أمثلة تطبيقية متكاملة

مثالان يوضحان كيفية تجميع عناصر الصيغة المتقدمة في صياغة أمر حقيقي فعّال.

الأصول:

  • @Image 1: صورة نصفية للفتاة بطلة المشهد
  • @Image 2: صورة مرجعية لمشهد غرفة السكن
  • @Video 1: مرجع حركة كاميرا حوار داخلي (تقريب/ابتعاد بلقطة متوسطة أو تدوير بسيط للكاميرا)
  • @Audio 1: خلفية صوتية داخلية أو موسيقى خفيفة

الأمر

الفتاة الموضحة في Image 1@ هي البطلة؛ وتعد Image 2@ هي مرجع نمط مشهد السكن؛ وحركة الكاميرا تتبع مرجع Video 1@. Shot 1: في وقت الغروب، تمشي الفتاة Image 1@ بخطوات سريعة متجهة إلى باب السكن الموضح في Image 2@. تتبعها لقطة متوسطة مستقرة؛ تنساب أشعة شفق صفراء دافئة للداخل عبر النافذة لتنير الممر المظلم. تتوقف للحظة عند الباب، وتأخذ نفساً عميقاً، ويبدو على وجهها توتر طفيف. Shot 2: تدفع الفتاة Image 1@ الباب للأمام وتدخل. قطع لقطة حوارية داخلية متوسطة: يرفع زملاؤها في الغرفة رؤوسهم أثناء ترتيب الكتب، ويسألها أحدهم بابتسامة {How did the exam go? Did you pass?}. تقطع الكاميرا ببطء منتقلة بين لقطات نصفية مقربة بالتناوب لجميع أفراد الغرفة. Shot 3: تطأطأ الفتاة Image 1@ رأسها في البداية بنظرة حزينة ومنكسرة — وتتحرك الكاميرا للقطة مقربة لوجهها — ثم ترفع رأسها فجأة تملؤها الابتسامة المكتومة، وتضحك بصوت عالٍ قائلة {Fooled you all}. يركض وراءها زملاؤها مرحين لملاحقتها؛ تتراجع الكاميرا ببطء لتثبت في لقطة واسعة لغرفة السكن الضاحكة. على مدار الفيديو كله: مظهر فيلم وثائقي فائق الدقة، تدرجات لونية دافئة، إضاءة ناعمة؛ الملامح والتعبيرات مستقرة دون أي تشوه للوجوه، والحركة انسيابية وطبيعية دون ارتعاش أو تقطّع؛ مع دمج الخلفية الصوتية بشكل طبيعي ومتناغم مع Audio 1@.

نصائح عملية

توليد النصوص بفعالية

يستطيع لـ Seedance 2.0 توليد النصوص لبعض العبارات الشائعة وعرضها على الشاشة. يحدد النموذج تلقائياً نمطاً ولوناً مناسبين يتوافقان مع السياق العام، بالإضافة إلى إتاحة خيار تخصيص وكتابة تفاصيل اللون والأسلوب وحركة الدخول البصرية وتوقيت العرض ومكان النص في الأمر الفعلي. ويُفضّل استعمال الحروف والرموز الدارجة والشائعة وتفادي العبارات النادرة أو الرموز الغريبة لضمان تقديم جودة بصرية ثابتة ومثالية للنصوص المكتوبة. وتتنوع الاستخدامات الحالية المتاحة بين الشعارات والترجمات المصاحبة وفقاعات الحوار — يُرجى مراجعة أمثلة توليد النصوص الموضحة أعلاه لاستنباط القوالب المناسبة لمهامك.

تمديد الفيديو مقابل الدمج والتركيب (Stitching)

  • اللقطة الطويلة المتصلة (Continuous long take/تمديد الفيديو): مناسبة للمشاهد 'الهادئة' التي تعتمد على الحوار التفاعلي داخل موقع واحد — مثل المحادثات الطويلة، وتطور المشاعر التراكمي، والحركات البصرية على طول مسار واحد — مما يغمر المشاهد بتأثير لقطة واقعية واحدة متصلة دون انقطاع.
  • منعطفات الأحداث والإثارة (Segmented stitching/التجميع المجزأ): أفضل للتحولات المفاجئة في الحبكة أو المشاهد 'الحركية الصعبة' سريعة الإيقاع — كالطاردات والنزالات والتركيبات الإيقاعية (Montages). يتم توليد كل مقطع وجزء مرئي بشكل مستقل تماماً، ثم القيام بعملية تجميع وتحرير بصري نهائي في برامج المونتاج لضمان الحفاظ على إيقاع المشهد والتأثير الحركي البصري القوي.

في المشاريع الحقيقية والاحترافية، يُدمج الخياران معاً في المعتاد: يتم القيام بالتمدد الزمني أولاً للحصول على حوار طبيعي ومنسجم، ثم يتم تجميع لقطات قطع بصري (Cutaways) أو لقطات انتقالية تجميلية — للمحافظة على حالة المعايشة والاندماج الكاملة مع تنويع إيقاع ووتيرة العرض.

إستراتيجية إعداد وتنسيق الأصول

تعامل مع أصولك المرجعية المرفقة على أنها تؤدي أربعة أدوار عملية رئيسية:

  1. مرسى ومحدد الشخصية (Character anchor): يثبت مظهر وملامح الشخصية
  2. مؤسس جو المشهد والبيئة (Scene tone-setter): يحدد سمات المحيط العام والأسلوب الفني
  3. مرجع الكاميرا (Camera reference): يضبط أسلوب اللقطات وإيقاع الحركات
  4. الإيقاع والحالة المزاجية (Rhythm & mood): يستعين بالصوت للتحكم في الانفعالات وبصمة نبرة الصوت

الإعداد المثالي المُوصى به (إجمالي 4 إلى 5 أصول): من صورة إلى صورتين للشخصية (لقطة رأس مقربة / لقطة كاملة للجسد) + صورة للمشهد والبيئة + فيديو لمرجع حركة الكاميرا + مقطع صوتي مخصص.

نصيحة

تجنب تماماً ملء الخانات المتاحة ومجاوزة الحد الأقصى للأصول. فكثرة المدخلات تجعل من الصعب على النموذج ترتيب أولويات الملامح الفنية والتحكم الصحيح، مما يؤدي غالباً لحدوث تضارب في الأساليب البصرية، وصعوبة التعرف على العناصر، وفشل اللقطات وظهورها بشكل مغاير للتوقعات المرجوة.

إرشادات الاستخدام

اتساق اللغة وثباتها

حاول الحفاظ على ظهور الحوار بلغة واحدة متناسقة. وتجنب تماماً خلط اللغات في العبارة الواحدة (باستثناء الأسماء وأسماء الأعلام المحددة).

الرموز والدلالات الخاصة

يساعد استخدام النماذج الاصطلاحية للرموز في تمكين النموذج من التفرقة بسهولة بين تفاصيل المعلومات المتباينة:

نوع المعلوماتالرمز المُستعملمثال توضيحي
الموسيقى()(Fast-paced rock music plays in the background)
المؤثرات الصوتية<><A dog barks in the distance>
الحوار والعبارات المفوهة{}{Hello, world}. بالنسبة للحوارات بلغة أقل شيوعًا (ليست صينية أو إنجليزية)، حدد اسم اللغة، مثل: يقول باليابانية {こんにちは}.
عناوين الترجمة / الشروحات التوضيحية【】【Chapter 1: Departure】

الأسئلة الشائعة

حيود مظهر وملامح الشخصية (Character ID Drift)

المشكلة — عدم مطابقة وجه الشخصية المولدة للصورة المرجعية الحقيقية المرفقة، أو حدوث تحول للملامح في منتصف المقطع (ID drift)، مما يؤدي في بعض الأحيان إلى تفعيل فلاتر الفحص التلقائي للاشتباه في التشابه مع بعض مشاهير ونجوم الساحة العامة.

السبب الجذري — عدم فعالية صورة مرجع الوجه أو ضعف قوة تأثيرها في نموذج التدريب:

  • دمج الصور المرجعية: دمج لقطة ملامح الوجه في صورة واحدة ممتلئة بعناصر أخرى مثل أوضاع الجسد الكاملة، أو مراجع الملابس، أو تفاصيل الزينة الجانبية.
  • صغر حجم الوجه داخل الإطار البصري: ظهور الوجه بمساحة ضئيلة جداً في الصورة المرجعية المتداخلة، مما يصعب على النموذج التركيز الكافي على خصائص وملامح الوجه ويشتت قراءته مع تفاصيل الخلفية أو العناصر المكتظة المجاورة.

الحل الموصى به — تعزيز استقلالية وقوة تأثير مرجع الوجه بالخطوات التالية:

  1. تجهيز لقطة وجه مقربة حصرية: إلى جانب صورة الجسد الكاملة العادية، أضف صورة منفصلة تتضمن رأس الشخصية فقط (أقرب ما يكون لصورة الهوية — يفضل ملامح مريحة وهادئة وتفادي الخلفيات المعقدة أو تفاصيل الكتف).
  2. تحديد العنصر بوضوح متناهٍ في المضمون: 'ترجع ملامح وجه Subject 1 إلى Image 1 (لقطة مقربة للرأس)؛ ويرجع أسلوب التزيين والملابس إلى Image 2 (لقطة لكامل الجسد)'.
  3. تقديم الأصول الحيوية أولاً وفق الترتيب: كلما زادت أهمية الدقة والإشارة لأحد الأصول المرجعية المرفقة، توجب إدراجه مبكراً وبصورة متقدمة في نص الأمر.

ملاحظة

استعن دائماً بلقطة مقربة للوجه مع لقطة لكامل الجسد عند تزويد النموذج بمرجع الشخصية. ونوصي بتفادي استخدام مخططات الزوايا المتعددة (Multi-view sheets) — حيث إن رؤية الشخص نفسه من اتجاهات متباينة في نفس الصفحة قد تربك القراءة الفنية، ويصنفها النموذج كأشخاص مستقلين، مما يعمق بالتالي حدوث تشوهات وحيود الملامح.

قبل

يتحور وجه الشخصية في منتصف الفيديو لتبدو شبيهة بأحد المشاهير

بعد

يظل الوجه متسقًا بالكامل مع الصورة المرجعية من البداية وحتى النهاية

الترجمات المصاحبة والنصوص غير المرغوب فيها

المشكلة — ظهور نصوص ترجمة غريبة مرافقة للفيديو المولد دون كتابة أي توجيه بخصوصها في نص الأمر الخاص بك.

نصيحة

لا توجد للآن طريقة لمنع ظهور النصوص بشكل قطعي بنسبة 100% — ولكن تساعد الإرشادات المبينة أدناه في تقليل احتمالية ظهورها ورفع كفاءة جودة لقطاتك في المحاولات المختلفة.

  1. أضف محددات صارمة ومباشرة بنهاية الأمر المكتوب: 'حافظ على خلو وفراغ الفيديو تماماً من الترجمات'، 'تجنب كلياً إضافة أو توليد أي نصوص أو تفاصيل مقروءة على الإطلاق'.
  2. إذا كانت الصور أو الفيديوهات المرجعية المستخدمة تحتوي على نصوص وعلامات غير ضرورية لعملك، يستحسن مسحها وتنظيفها أولاً (باستعمال أدوات تحرير وتنقير الصور في Seedream أو Seedance) ومن ثم استخدام الأصل المفرّغ لإدخاله في التوليد.
  3. عندما تتيح طبيعة مشروعك ذلك، قم في البدء بالتوليد بنمط العرض الأفقي (Landscape)، حيث تتقلص احتمالات تداخل نصوص التلقين بشكل فارق مقارنة بالتوليد العمودي، ثم قم لاحقاً بقص أطراف الفيديو بالوضع العمودي في برنامج التعديل.

ظهور شعارات وعلامات مائية تطفلية

المشكلة — ظهور شعارات تجارية وتواقيع مرئية من منصات بث مشهورة في مقطع الفيديو المولد، على الرغم من عدم الإشارة إليها في أمر المعالجة.

الحل الموصى به — أدرج توجيهات استبعاد صريحة ومباشرة في أمرك المكتوب: 'تفادَ تمامًا جلب أو توليد علامات مائية مرئية'، 'تجنب نهائيًا إدراج شعارات تجارية'.

حيود الأسلوب الفني والمظهر الجمالي (Style Drift)

المشكلة — ترغب في توليد مظهر رسوم متحركة من فئة ثنائية الأبعاد (2D) أو ثلاثية الأبعاد (3D Anime)، لكن الصورة المرجعية محايدة وذات طابع واقعي تصويري دون قيامك بالتأكيد الفني اللازم في الأمر، مما يحوِّل النتيجة لتصوير سينمائي حي وواقعي مفرط للمشهد.

الحل الموصى به — عزز كتابة الأمر بإضافة واصفات فنية دقيقة ومصقولة مثل: 'أسلوب رسوم يابانية كرتونية ثنائية الأبعاد (2D Japanese anime style)'، أو 'مظهر أنمي ثلاثي الأبعاد بالروح الصينية (3D Chinese-style animation)'. ولإحكام تحرير اللقطة وضبطها بالشكل المطلوب، قم بتحويل نمط الصورة المرجعية نفسها إلى الأسلوب المنشود أولاً وبشكل منفصل، ثم نفذ توليد الفيديو اعتماداً عليها.

قبل

تلاشي وانحراف أسلوب الخيال التاريخي (Xianxia) تدريجيًا نحو مظهر تصويري واقعي

بعد

يحافظ على المظهر الفني الأصلي للرسوم ثلاثية الأبعاد الصينية الحاسوبية (CG) لطابع الـ Xianxia الملحمي

حدوث قفزات ورعشات بصرية عند نقاط دمج تمديد الفيديو

المشكلة — بعد القيام بتوليد تمديد زمني ولصقه مع اللقطة الأساسية القديمة، قد تلاحظ ارتجاجاً في الإطار أو قفزة غير متناسقة تفصل بين المقاطع لتشعر بنوع من الارتداد في مجريات الأحداث.

الحل الموصى به — في الوقت الراهن، نوصي بمعالجتها في مرحلة ما بعد الإنتاج يدويًا من خلال موازنة الإطارات الرئيسية (سيتم تطبيق معالجة شاملة لهذه المشكلة في الإصدارات التالية للنمذج):

  1. قم بإنشاء مشروع وإدراج المقاطع المراد تجميعها داخل منصة CapCut أو أي تطبيق لتحرير وتعديل الفيديو تفضله.
  2. عند أول نقطة تداخل، قم بقص وحذف 6 إطارات (Frames) من الجزء الأخير للمقطع الأول.
  3. وقم بقص وحذف إطار واحد (1 Frame) من طرف بداية المقطع الثاني اللاحق.
  4. كرر هذه الخطوة بدقة عند نقاط الربط والاتصال البصري والزمني كافة.
  5. اصدر المقطع وتأكد من عملية التصدير والمراجعة البصرية للتثبت من انسياب حركة الفيديو وسلاستها التامة.

نصيحة

حتى مع موازنة الإطارات ومطابقتها التامة، قد تظل هناك قفزات بصرية صغيرة وملحوظة. لذا ننصح بإنهاء توليد المقطع الممدد عند لحظة قطع الحدث البصري (Scene-cut moment)، والسماح للمقطع التالي بالبدء كلياً من الإطار الأول للقص البصري البديل لضمان الوقع المنسجم للعين.

قبل

قفزات إطارية ظاهرة وارتداد بصري في مجريات المشهد عند نقاط الدمج الزمني (عند الثانية 5 والثانية 20)

بعد

نقاط التقاط وتوصيل زمني أكثر انسيابية وسلاسة بكثير

مشكلة العناصر التوءم ومضاعفة الشخصيات (Twin Problem)

المشكلة — في اللقطات التي تزدحم بعدد من الأشخاص، وخاصة عند استعمال صورة مرجعية بنمط التناظر الشامل (الشكل من ثلاث اتجاهات / Turnaround Sheet)، قد يبادر النموذج بتوليد شخصيتين متطابقتين ونسختين متماثلتين تماماً داخل نفس المشهد البصري المولد.

الأسباب الجذرية:

  • عدم جودة وتحديد خصائص الشخصيات وتسميتها صراحة بنص الأمر، مما لا يسمح للنموذج بالتعرف والتمييز بين الأدوار المطلوبة بدقة.
  • تسبب اللقطات متعددة الزوايا المحصورة في صورة واحدة تشويشاً لقدرة استطلاع الوجوه داخل النموذج، مما يدفعه لتكرار واستنساخ الشخصيات الشبيهة ببعضها.

نصيحة

لا توجد للآن قنوات لمنع حدوث التكرار بنسبة كاملة 100% — ولكن تساعد المحاور المبينة تالياً في خفض هذه الاحتمالية للمستويات الدنيا وضمان سلامة نتاجاتك.

  1. ربط وتحصين كل شخصية بصورتها المرجعية: اضبط شخصيات العمل بوضوح واقرنها برمز الصورة الحقيقي المتطابق معها بالتزام تام بالقوالب المفصلة. مثال: يقوم الشخص المدعو Zhang San (من المرجع Image 1) برمي الدفتر الأخضر نحو الشخص المسمى Li Si (من المرجع Image 2) الواقف أمامه.
  2. إدراج محدد شامل وواضح في مؤخرة نص الأمر البرمجي: 'تجنب تماماً إظهار أي شخصيتين بملامح أو أزياء أو كماليات مظهرية متكررة ومتطابقة على مدار عمر الفيديو؛ امنع أي تأثيرات توءم أو استنساخ للمظهر؛ حافظ على بقاء نسخة متفردة وحيدة لكل شخصية مرئية في كل لقطة؛ لا تقم بجلب عناصر مكررة'.
  3. ترقية وتوجيه الأصول المرجعية بوعي: نوصي بالاستعانة بالصور التي تحوي فرداً وحيداً بوضوح تام وتفادي ملفات العرض من ثلاث جهات تماماً.
  4. اختصار وتحجيم نص الأمر: لا تعمد إلى إلصاق نصوص وسيناريوهات مطولة ومعقدة في التلقين — فالزيادة السردية غير الدقيقة تشتت النموذج. اختزل الأفكار غير المرافقة للمشهد المباشر وحافظ على تركيز وتكثيف التوجيهات الأساسية.

قبل

ظهور شخصية متطابقة مستنسخة (Twin) بحلول الثانية الثامنة (8s)

بعد

خسارة جودة الرؤية الفنية مع تتابع تمديد المشاهد

المشكلة — يسبب استخدام مقطع فيديو مولد مسبقاً وتمريره كمدخل لعملية تمديد لاحقة تشوهاً طفيفاً مستمراً في الكفاءة البصرية وجودة الصورة. ويؤدي تكرار العملية إلى تراكم الضرر، وظهور بقع لونية شاذة ومهتزة تبرز بشكل خاص على تعبيرات وملامح الوجوه.

الحل الموصى به — خطوات لتخفيف المشكلة حالياً (سيتم حلها جذرياً مع التحديثات البنيوية اللاحقة للنمذج):

  1. قم في البدء بتحويل المقطع الأصلي لنموذج منحوت رمادي/أبيض شبه صلصالي (White clay-render) عبر أداة Seedance 2.0، ثم مرر هذا النمط كمدخل رئيسي للمهمة التمديدية البديلة. نص الأمر التوجيهي المقترح للاستعانة به: 'قم بتحويل وتطهير كامل معالم الفيديو لنموذج ثلاثي الأبعاد باللون الأبيض وبطابع المنحوتات الصلصالية: تتحول كافة الشخوص لمجسمات ثلاثية دقيقة بلون أبيض ناصع لا تحوي أي إضافات لونية أو تضاريس وخامات أو ظلال جانبية، بخلفية بيضاء مطلقة، وبنية هيكلية ثابتة، مع انسيابية كاملة واستقرار في الحركة'.
  2. احرص على رفع أصول مرجعية ذات مستويات دقة ووضوح مرتفعة للغاية (High-resolution).
  3. قلل من تتابع جولات التمديد المسلسلة؛ وتفادَ التمديد المتراكم في أدوار متلاحقة مجهدة للجودة.

قبل

القيام بتمديد وتوليد مخرجات النموذج بشكل مباشر ومعقد دون تجهيز

بعد

معالجة المخرج والتعديل لنمط المنحوتات الصلصالية الطينية أولاً كخطوة تحضيرية تسبق عملية التمديد

حالات عدم توافق التأثيرات مع الآمال المرجوة

المشكلة — قد تفشل النواتج في التقاط ووصف المؤثرات المرئية الخاصة بالأوامر النصية بدقة. مثال: تطلب في الأمر 'أن يظهر الرقم 2999 في أسلوب رسوم تنازلية ومؤقت عد تنازلي'، لكن تتوالى الأرقام والرموز بشكل عشوائي وارتجاج غير منطقي في التوليد بدلاً من حركة العد المنظمة المنتظرة.

الحل الموصى به — نوصي بالإشارة للمؤثر المطلوب مستعيناً بـ فيديو مرجعي صريح: قم بتقديم وتحميل مقطع يحتوي على المؤثر والأسلوب المنشود لتدرك خوارزميات الذكاء الاصطناعي تفاصيل ونطق الحركة الميكانيكية للرقم بدقة. مثال: 'تظهر خانة وسلسلة الأرقام 2999 في المشهد مقتدية بنفس كيفية ونبرة وسلوك حركة الدخول الموضحة في Video 1'.

قبل

المواد المرجعية

Video 1 — مرجع للتأثير الفني المستهدف

حركة وتتابع ظهور الأرقام المرئية ترتجف بصورة عشوائية ومبعثرة

بعد

عند الاستعانة وإدراج فيديو مرجع تأثير تتابع الأرقام الدقيق، طابقت النتائج المخرجة تطلعاتك وبأقصى درجات الضبط البصري

تجاوز الحد الآمن لشخصيات الصور المرجعية

المشكلة — عند مجاوزة تقديم أكثر من 4 شخصيات مرجعية، تقل جودة واستقرار مقاطع الفيديو المخرجة بصورة واضحة: قد تنتج اللقطة أعداداً خاطئة وغير متوقعة للناس (بين غياب أفراد مطلوبين أو زيادة شخوص غرباء) أو حدوث عمليات تكرار.

الحل الموصى به — طرق علاجية عابرة تناسب المرحلة الحالية (سيتم تدشين تعديل تكميلي متكامل ضمن مخطط التحديث):

  1. تقسيم صور المجموعات الضخمة وتوليدها مرحليًا: اعمد على فرز الشخصيات في تجميعات صغيرة بحيث لا تتجاوز كل صورة 4 أفراد كحد أقصى. مثال: للمجموعة التي تحوي 6 أفراد، يمكن توزيع المجموعات في صورتين منفصلتين تحتوي كل منهما على 3 أفراد، لإتمام التوليد الخاص بهما خطوة بخطوة.
  2. ثم التحول بنمط (Image-to-video): اعتمد على استخدام تلك الصور الجماعية المجزأة كأصول مرجعية رئيسية ومعتمدة لبناء وإنتاج اللقطات السينمائية المنسجمة في المونتاج النهائي.

قبل

تزويد بـ 8 شخصيات مرجعية مقترنة ← تؤدي لإنتاج 9 أشخاص في المخرج البصري

بعد

تم تجميع الـ 8 شخصيات في صورتين كخطوة انتقال أولى، ثم تم توليد المشهد من نمط تحويل الصور إلى فيديو

اختلاف في بصمة ونبرة الصوت مقارنة بالمرجع الصوتي الملحق

المشكلة — عند الاستعانة بمقطع صوتي مرجعي لتغذية نبرة الكلام والمشاعر، قد تلاحظ ابتعاداً وفجوة واضحة بين مخارج الصوت في الفيديو المولد وبصمة النبرة الصوتية المدرجة بالأصل الصوتي.

الحل الموصى به:

  1. أضف تفاصيل وصفية مكثفة لنبرة وبصمة الصوت في المتن التلقيني للأمر، مثال: 'يتحدث بصوت عريض هادئ ووداد دافئ يحوي بحّة رجولية خفيفة في سن متوسط، مقتدياً ومعتمداً بالكامل على نبرة Audio 1@'.
  2. احرص على تقريب طبيعة تراكيب العبارات المنطوقة وحالة المشاعر مع نمط وأجواء المقطع المرجعي الصوتي المجرى — فالمجازاة الفنية تحسن ثبات محاكاة جرس الصوت بالنموذج وتقلل التشوه بنسبة عالية.

قبل

المواد المرجعية

Audio 1 — الملف الصوتي المدخل

نبرة ومخارج مخمل الصوت تبتعد ولا تتطابق مع الملف الصوتي المرفق

بعد

عند القيام بإبراز ووصف سمات وجرس نبرة الصوت في سياق الأوامر النصية، تحسنت دقة التطابق بصورة متقنة وفارقة