استخدمت مولد خلفيات بالذكاء الاصطناعي للتصميم للحركة قبل وجود أي حركة. كانت المشهد بحاجة إلى مقدمة قريبة، ومستوى منتج، وخلفية عميقة حتى يتمكن دفع لثوانٍ ثمانية من إنشاء تأثير المنظر الحقيقي. قدم Pippit أربع نسخ متباينة لزوايا القراءة خلال الغسق؛ اخترت الثانية وقمت بتحريك حركة للكاميرا بشكل محدود فقط.
الشكل 1. صفحة مولد خلفيات الذكاء الاصطناعي المستخدمة لاختبار مشهد متعدد الطبقات.
كان الوصف الخلفي في الواقع خريطة عمق
تجلس أغلفة الكتب في المقدمة قريبة من العدسة، وتشغل الطاولة من خشب البلوط والمصباح الأخضر مستوى المنتصف، في حين تشير نافذة المساء الزرقاء إلى الخلفية البعيدة. يفصل ضوء الغرفة الدافئ المنتج عن النافذة. يظل الثلث العلوي هادئًا بما يكفي للنصوص المستقبلية، على الرغم من أن اختبار الحركة هذا لا يحتوي على أي نص.
النص الخلفي الدقيق
إنشاء خلفية واقعية بنسبة 9:16 لأسلوب حياة لمصباح قراءة محمول بنكهة النعناع المتجمد الخيالي. بناء زاوية قراءة مدمجة عند الغسق مع ثلاث طبقات واضحة العمق: مشاهد ضبابية الطابع لصفوف الكتب في المقدمة القريبة، طاولة جانبية صغيرة من خشب السنديان في المنتصف مخصصة للمصباح، ونافذة في الخلفية العميقة مع ضوء المساء الأزرق الناعم. مطابقة زاوية الكاميرا بارتفاع المصباح، وترك مساحة نظيفة في الثلث العلوي من الصورة لوضع عنوان، مع تضمين منطقة ظل اتصال واقعي على الطاولة، واستخدام إضاءة دافئة ومناسبة للغرفة. لا أشخاص، لا شعارات، لا عناوين كتب قابلة للقراءة، لا مصابيح إضافية، لا نصوص. يجب أن تدعم التركيبة حركة كاميرا مستمرة وبطيئة دون الكشف عن مناطق فارغة أو غير متناسقة.
الشكل 2. أربع خيارات مخصصة للمشهد؛ الخيار الثاني أصبح المرجع الحركي.
النتيجة الأولى غيرت خطة التركيب الخاصة بي
في البداية خصصت الطاولة لمصباح، ولكن الخيارات التي تم إنشاؤها احتوت على مشاهد منتجات مكتملة مع مصابيح بالنعناع موضوعة بالفعل. استخدمت ذلك الإخراج بدلاً من وضع مصباح ثانٍ فوقه. هذا ميزة عملية لمراجعة الصورة قبل متابعة بقية سير العمل المخطط له: يمكن أن يستجيب التعليم التالي لما يوجد بالفعل.
بالضبط توجيه حركة الكاميرا.
استخدم الصورة الثانية المولدة لركن القراءة كمرجع بصري وحيد وقم بإنشاء فيديو جديد مدته 8 ثوانٍ بنسبة عرض إلى ارتفاع 9:16. احتفظ بتخطيط الغرفة، المصباح النعناعي، الطاولة الخشبية، الكتب، النافذة، وإضاءة الغسق. قم بإنشاء حركة بطيئة واحدة مستمرة بالكاميرا بنسبة لا تزيد عن 12 بالمائة، مع تأثير المنظر الطبيعي الطبيعي عبر الكتب في المقدمة، والمصباح في منتصف المشهد، والنافذة في الخلفية. يبقى المصباح مضاءً ودون تغيير مادي. بدون أشخاص، بدون أشياء جديدة، بدون نصوص، بدون تعليق صوتي، بدون قطع مشهد، وبدون تشوه الصورة. قم بتصيير الفيديو النهائي.
ما الذي يكشفه الدفع بالكاميرا.
الشكل 3. تُظهر ثلاث إطارات ثبات هندسة المصباح وزيادة التباعد بين طبقات العمق.
الفيديو 1. معاينة للحركة تم إنشاؤها لفيلم "قمت بإنشاء مشهد منتج لتحرك كاميرا مستمر." تتضمن حزمة التسليم ملف MP4 المطابق.
تتحرك الكتب الموجودة في المقدمة عبر الإطار بسرعة أكبر من المصباح، بينما يتغير النافذة بشكل أقل. ذلك الحركة النسبية هي التي تجعل دفع الكاميرا يبدو ذو أبعاد. شكل المصباح، حافة الطاولة، الحائط، والنافذة يظلون ثابتين خلال الإطارات المأخوذة، ولا تظهر أي منطقة جديدة عند الحدود.
قائمة مرجعية للخلفية للحركة المستمرة
قم بتعيين كائن معين لكل طبقة عمق بدلاً من طلب عمق غامض.
خصص سطح تلامس مقبول فيزيائيًا للمنتج.
اجعل نسبة الدفع صغيرة عندما يكون العنصر الوحيد المتاح هو المرجع.
منع إنشاء العناصر الجديدة وكشف الحدود أثناء الحركة.
تحقق من أن اتجاه الضوء وظلال التلامس يظلان ثابتين في الإطار النهائي.
لماذا يُعتبر هذا اختبار تصميم خلفية المنتج؟
لم أحكم على المشهد بناءً على الزخرفة فقط. يوفر الجدول سطح تلامس، ويوفر النافذة عمقًا وتباينًا باردًا، وتوفر الكتب في المقدمة فصل الحركة، ويوفر الجدار فراغًا سلبيًا. كل عنصر له وظيفة إنتاجية. هذا يجعل مشهد المنتج المُقسم قابلًا للاستخدام حتى قبل إضافة النصوص.
تظهر النتيجة أيضًا سبب ضرورة مراجعة حركة الكاميرا البارالاكسية عند الحدود. أثناء تقارب المشهد، يقتطع الإطار باتجاه الداخل بدلاً من كشف مساحة غير مرئية، لذا لا يحتاج النموذج إلى اختراع رف جديد أو حافة جدار أو امتداد نافذة. تبقى الإطار النهائي نسخة أقرب من التكوين الافتتاحي.
يترك الجدار العلوي النظيف مساحة لتكييف العنصر لاحقًا. يمكن أن يكون هناك عنوان قصير دون أن يعبر شعاع المصباح أو النافذة. سأختبر ذلك التصميم النصي كخطوة تخطيط منفصلة، لأن هذا الجيل قُصد به أن يُقتصر على جودة الخلفية والحركة.
الأسئلة الشائعة حول التحركات المستمرة للكاميرا
س1. لماذا يعتبر تأثير المنظر مهمًا؟
يسمح لحركة الكاميرا بالتعبير عن الفضاء. بدون حركة مختلفة عبر المقدمة، والوسط، والخلفية، قد يبدو الناتج مثل تكبير مسطح.
س2. لماذا تحدد التقدم إلى اثني عشر بالمئة فقط؟
تحافظ الحركة الصغيرة على الاقتراب من المرجع وتقلل من كمية المشاهد غير المرئية التي يجب أن يبتكرها النموذج.
س: هل يمكنني إضافة نص لاحقًا؟
نعم. تم تخصيص الثلث العلوي الهادئ لتعليق قصير واحد، ولكنني تركت هذا النص التجريبي خاليًا لتقييم استقرار الصورة بمفردها.
س: ما مقدار المقدمة الكافي لإظهار العمق؟
عادةً ما يحتاج مشهد مولد الخلفية بالذكاء الاصطناعي إلى طبقة مقدمة واضحة، ومستوى منتج واحد، وخلفية منفصلة. يمكن أن تؤدي الطبقات الإضافية إلى إرباك دون تحسين التقدم في الحركة.
س: متى يجب أن أتخلى عن حركة واحدة؟
في اختبار مولد الخلفية بالذكاء الاصطناعي، استخدم قطعًا عندما تمر الكاميرا عبر الأشياء، أو يتشوه المنتج، أو يختفي العنصر الرئيسي المرغوب إظهاره. تكون الاستمرارية ذات أهمية فقط إذا ما حافظت على وضوح الصورة.
العمق جعل حركة الكاميرا مفهومة.
أفضل مخرجات مُولّد الخلفيات بالذكاء الاصطناعي لم تكن مجرد غرفة جميلة كانت مشهداً مع مسار كاميرا معروف من خلال التعامل مع الصورة الثابتة كمجموعة من مستويات العمق، تمكنت من طلب حركة تظل مقيدة، قابلة للقراءة، ومخصّصة لهذه المصباح