दृश्य को अलग कर लें. रिटर्न JSON {"subject":"...","action":"...","setting":"...","shot":"...","style":"..."}: subject - कौन/क्या, action - एक कार्रवाई, setting - कहां और कब, shot - योजना और कोण (बंद/मध्यम/सामान्य, कैमरा स्तर), style—दृश्य शैली।
एक वीडियो प्रॉम्प्ट में एक कंकाल होता है, जैसे एक चलचित्र। इसे भागों में विभाजित करें: विषय (कौन/क्या), क्रिया (वह क्या कर रहा है), पर्यावरण (कहां और कब), शॉट (क्लोज़-अप, मध्यम, सामान्य), परिप्रेक्ष्य (आंखों का स्तर, ऊपर, नीचे), प्रकाश और मनोदशा (गर्म सूर्यास्त, ठंडी सुबह), शैली (यथार्थवाद, जल रंग, 3 डी)। तंत्रिका नेटवर्क विवरण को एक निर्देशक के अनुरोध की तरह पढ़ता है: जितना अधिक सटीक रूप से प्रत्येक भाग का नाम दिया जाता है, उतना ही कम यह आपके बारे में सोचता है। मुख्य तकनीक प्रति दृश्य एक क्रिया है। "एक बच्चा एक कागज़ का हवाई जहाज़ लॉन्च करता है" तो रुक जाएगा, लेकिन "दौड़ता है, कूदता है, पकड़ता है, हंसता है" कलाकृतियों में बिखर जाएगा। दूसरी तकनीक: पहले एक घने स्थिर फ्रेम का वर्णन करें, एक तस्वीर की तरह, और उसके बाद ही गति जोड़ें - मॉडल पहले एक स्थिर रचना बनाता है, और फिर उसे एनिमेट करता है। कार्यों के बजाय भावनाओं को लिखना एक सामान्य गलती है: "वायुमंडलीय", "महाकाव्य" को मॉडल द्वारा खराब समझा जाता है। इसे किसी दृश्यमान चीज़ से बदलें: "कैमरा धीरे-धीरे ज़ूम करता है, प्रकाश की किरण में धूल के कण।" नियम सरल है: यदि कोई क्रिया स्क्रीन पर नहीं दिखाई जा सकती, तो मॉडल उसे अनदेखा कर देगा।
त्वरित एआई समीक्षा के लिए समाधान सबमिट करने के लिए एक्सेस अनलॉक करें।