دليل تحويل المرجع إلى فيديو 2026
صورة المرجع ليست قيمة لشدة التأثير. إما أن تمنحها للنموذج أو لا، وثلاثة عشر نموذجًا من أصل 37 يمكنها قبولها.
باختصار
ثلاثة عشر نموذجًا من أصل 37 نموذجًا لتوليد الفيديو تقبل مرجعًا للشخصية: Seedance 2.0 و2.0 Fast و2.5، وVeo 3.1 و3.1 Lite، وWan 2.7 و3.0 و3.0 Prime، وKling 3.0 Motion Control، وMiniMax H3، وGemini Omni Flash، ونموذجا Happy Horse كلاهما. أما Kling 3.0 نفسه فلا يقبله. لا توجد قيمة لشدة المرجع، لذا تأتي النتائج من صورة المرجع: أمامية أو بزاوية ثلاثة أرباع، كبيرة داخل الإطار، بإضاءة متساوية، بتعبير محايد، حادة التفاصيل، والملف نفسه تمامًا في كل مرة.
صورة المرجع ليست قيمة لشدة التأثير. إما أن تمنحها للنموذج أو لا.
لا توجد قيمة 0.75 لضبطها، ولا نسبة خطأ في المعالم الوجهية لملاحقتها، ولا إعداد مُرمِّز لتهيئته. ما يحدد ما إذا كانت الشخصية ستبقى ثابتة طوال المقطع هو جودة الصورة التي تقدمها والنموذج الذي تقدمها إليه.
وكلاهما تحت سيطرتك بالكامل، وهذا أفضل مما كان سيقدمه أي مؤشر ضبط.
ما النماذج التي تقبل المرجع فعلًا
ثلاثة عشر نموذجًا من أصل 37 نموذجًا لتوليد الفيديو. والخطأ في هذه النقطة هو السبب الأكثر شيوعًا وراء استنتاج الناس أن تحويل المرجع إلى فيديو "لا يعمل":
Seedance 2.0 و2.0 Fast و2.5 · Veo 3.1 و3.1 Lite · Wan 2.7 و3.0 و3.0 Prime · Kling 3.0 Motion Control · MiniMax H3 · Gemini Omni Flash · Happy Horse وHappy Horse 1.1
الغائب اللافت: Kling 3.0 نفسه. فهو يدعم تحويل النص إلى فيديو والصورة إلى فيديو فقط. إذا كنت ترفع صورة وجه إلى Kling 3.0 وتراه يتجاهلها، فهذا هو السبب — هذه الإمكانية موجودة في Kling 3.0 Motion Control بدلًا منه.
ابدأ من تحويل المرجع إلى فيديو.
صورة المرجع هي كل شيء
كل النتائج ترث من هذا الملف، لذا يستحق عناية أكبر من الموجّه النصي.
أمامية أو بزاوية ثلاثة أرباع. الصورة الجانبية لا تعطي النموذج سوى عين واحدة ونصف فك ليعمل عليهما، فيخترع الباقي ويتغير هذا الاختراع مع كل إطار.
كبيرة داخل الإطار. الوجه الذي يشغل جزءًا صغيرًا من لقطة واسعة يحمل تفاصيل قليلة. قُصّ الصورة.
إضاءة متساوية. الظلال الحادة تُدمج كأنها جزء من بنية الوجه. الإضاءة المسطحة المتساوية تمنح النموذج الشكل الحقيقي.
تعبير محايد. الابتسامة العريضة في المرجع تميل إلى الاستمرار في لقطات لا تناسبها.
حادة التفاصيل. أي ضبابية في المرجع تتحول إلى تشوّه أثناء الحركة، ولا يستطيع أي موجّه إصلاحها.
إذا كنت تولّد المرجع بدلًا من تصويره، فولّده عن قصد: صورة شخصية نظيفة مصممة لهذا الغرض أفضل من إطار مقتطع من شيء آخر.
أعد استخدام الملف نفسه تمامًا في كل عملية توليد. ليس صورة مشابهة، بل الصورة نفسها. مرجعان متشابهان ينتجان شخصين متشابهين لكن مختلفين، وهذا بالضبط الإخفاق الذي تحاول تجنبه.
كتابة الموجّه حول المرجع
النموذج يرى الوجه. لا تصفه.
إنفاق كلمات الموجّه على "عينان بنيتان، فك حاد، شعر داكن" ينافس الصورة بدلًا من دعمها، وقد يبعد النتيجة عن المرجع الذي قدمته.
اكتب عمّا تفعله الشخصية، وأين توجد، وماذا تفعل الكاميرا:
"تمشي ببطء على طول جدار الميناء، وتنظر نحو البحر. إضاءة غائمة. الكاميرا تتحرك بمحاذاتها."
حافظ على صياغة ثابتة للمكان والإضاءة بين اللقطات، وغيّر الحركة فقط. هكذا تبدو مجموعة المقاطع عملًا واحدًا متماسكًا.
لماذا لا تزال الهوية تنحرف
ثلاثة أسباب حقيقية، ولا يتعلق أي منها بإعداد مفقود.
المدة. تثبت الهوية لبضع ثوانٍ وتتدهور على مدى ثوانٍ كثيرة. إذا صمد الوجه أربع ثوانٍ ثم تلاشى عند الثانية العاشرة، فولّد مقاطع أقصر واجمعها معًا في المونتاج.
جودة المرجع. تناولناها أعلاه، وهي السبب الأكثر شيوعًا بفارق كبير.
النموذج الخطأ. إذا كان النموذج لا يدعم المراجع، فلن يكون للمرجع أي تأثير على الإطلاق.
متى لا يكون تحويل المرجع إلى فيديو هو الأداة المناسبة
تسلسل متصل بدلًا من لقطات منفصلة. يربط Long Video Generator المقاطع بحيث يحمل كل مقطع المقطعَ المكتمل السابق ويواصل من إطاره الأخير، مع بقاء المراجع حاضرة طوال الوقت. وهذا يحافظ على البيئة إلى جانب الشخصية، وهو ما لا تستطيع المراجع وحدها فعله.
أداء محدد. تنقل أداة Motion Control الحركة من فيديو مرشد إلى صورة شخصية. عندما يكون لديك مقطع للحركة التي تريدها، فإن نقلها أفضل من وصفها.
مشاهد منفصلة عبر مواقع مختلفة. صُمم Series Generator لهذا الغرض.
نقاط بداية ونهاية دقيقة. من الإطار الأول إلى الأخير، على Seedance 2.0 و2.0 Fast فقط.
ما ليس حقيقيًا
لا توجد شدة للمرجع. لا توجد قيمة تتحكم في مدى التزام النموذج بالمرجع، في أي نموذج.
لا يوجد مقياس للمعالم الوجهية أو للانحراف. لا يوجد رقم منشور لانحراف الوجه لكل نموذج، ولا نسبة مئوية يجب البقاء دونها. المقالات التي تذكر رقمًا كهذا اختلقته.
لا يوجد مُرمِّز مرجعي مخصص يمكنك تهيئته، ولا أقنعة لمناطق محددة في أي مكان.
نموذج واحد يتيح قيمة seed: وهو Wan 2.7، الذي يقبل أيضًا موجّهًا سلبيًا. إنه الوحيد، ما يجعله الخيار الأمثل عندما تكون قابلية التكرار أهم من أي شيء آخر.
سير عمل يحقق الثبات
- أنشئ صورة مرجعية قوية واحدة واحفظها.
- اختر نموذجًا من بين النماذج الثلاثة عشر.
- اكتب عن الحركة والكاميرا، ولا تكتب عن الوجه أبدًا.
- ولّد مقاطع قصيرة. قيّم الهوية بصدق في نهاية المقطع، لا في بدايته.
- أعد استخدام المرجع المطابق نفسه في كل لقطة لاحقة.
الخطوة 1 هي التي تصنع النتيجة. وكل ما بعدها مجرد تكرار.
الكتالوج متاح في النماذج، ويُعرض سعر كل عملية توليد قبل تشغيلها، وأسعار الباقات موجودة في صفحة الأسعار.
الأسئلة الشائعة
ما النماذج التي تقبل صورة مرجعية؟▾
ثلاثة عشر من أصل 37: Seedance 2.0 و2.0 Fast و2.5، وVeo 3.1 و3.1 Lite، وWan 2.7 و3.0 و3.0 Prime، وKling 3.0 Motion Control، وMiniMax H3، وGemini Omni Flash، ونموذجا Happy Horse كلاهما. أما Kling 3.0 نفسه فيدعم تحويل النص إلى فيديو والصورة إلى فيديو فقط، لذا فإن رفع صورة وجه إليه لا يفيد بشيء.
ما شدة المرجع التي يجب أن أضبطها؟▾
لا توجد شدة للمرجع في أي نموذج. إما أن تقدم مرجعًا أو لا. ما يحدد النتيجة هو جودة الصورة والنموذج الذي يستقبلها، وكلاهما تحت سيطرتك بالكامل.
ما الذي يجعل الصورة المرجعية جيدة؟▾
أمامية أو بزاوية ثلاثة أرباع بدلًا من الجانبية، كبيرة داخل الإطار، بإضاءة متساوية دون ظلال حادة، بتعبير محايد، وحادة التفاصيل. أي ضبابية في المرجع تتحول إلى تشوّه أثناء الحركة، ولا يستطيع أي موجّه نصي إصلاحها. أعد استخدام الملف نفسه تمامًا في كل مرة، لأن مرجعين متشابهين ينتجان شخصين متشابهين لكن مختلفين.
هل يجب أن أصف الشخصية في الموجّه النصي أيضًا؟▾
لا. النموذج يرى الوجه. وصفه ينافس الصورة وقد يبعد النتيجة عن المرجع الذي قدمته. اكتب عمّا تفعله الشخصية، وأين توجد، وماذا تفعل الكاميرا، مع الحفاظ على صياغة ثابتة للمكان والإضاءة بين اللقطات.
لماذا لا يزال الوجه ينحرف؟▾
ثلاثة أسباب: المقطع طويل جدًا، إذ تثبت الهوية لبضع ثوانٍ وتتدهور على مدى ثوانٍ كثيرة؛ أو صورة المرجع ضعيفة؛ أو النموذج لا يدعم المراجع أصلًا. ولا يتعلق أي منها بإعداد مفقود.
متى يجب أن أستخدم شيئًا غير تحويل المرجع إلى فيديو؟▾
استخدم Long Video Generator للتسلسل المتصل، لأن ربط المقاطع يحافظ على البيئة إلى جانب الشخصية. واستخدم Motion Control عندما يكون لديك مقطع للحركة التي تريد نقلها. واستخدم Series Generator للمشاهد المنفصلة عبر مواقع مختلفة، وميزة من الإطار الأول إلى الأخير عندما تعرف صورتي البداية والنهاية بدقة.
هل يوجد مقياس للانحراف أو لدقة المعالم الوجهية؟▾
لا. لا يوجد رقم منشور لانحراف الوجه لكل نموذج، ولا نسبة مئوية يجب البقاء دونها. المقالات التي تذكر معدلات خطأ للمعالم الوجهية اختلقتها. نموذج واحد، هو Wan 2.7، يتيح قيمة seed إلى جانب موجّه سلبي، ما يجعله الخيار الأمثل عندما تكون قابلية التكرار هي الأهم.
