GUIDES · August 7, 2026 · 6 MIN READ

एक फोटो को AI वीडियो में कैसे बदलें

किसी भी फोटो को एक जीवंत AI वीडियो में बदलें: ऐसी स्रोत छवियां चुनें जो अच्छी तरह से एनिमेट हों, ऐसी गति को प्रॉम्प्ट करें जो दृश्य से संबंधित हो, और पहचान को पूरी तरह से स्थिर रखें।

इमेज-टू-वीडियो AI वीडियो में सबसे अधिक लाभ वाली सुविधा है: एक अच्छी तस्वीर अंदर, कुछ सेकंड का विश्वसनीय जीवन बाहर। यह वह जगह भी है जहाँ अधिकांश प्रयास विफल हो जाते हैं, क्योंकि लोग ऐसी गति की मांग करते हैं जिसे दृश्य समर्थन नहीं कर सकता। एक पोर्ट्रेट को कैमरे को घूमने की आवश्यकता नहीं होती है — उसे कान को फड़कने और पृष्ठभूमि बोकेह को सांस लेने की आवश्यकता होती है। यह मार्गदर्शिका एक स्रोत फोटो चुनने को कवर करती है जो साफ-सुथरा एनिमेट होता है, ऐसी गति प्रॉम्प्ट लिखने को कवर करती है जो दृश्य से संबंधित होती है, और विषय को पहचानने योग्य रूप से समान रखने को कवर करती है।

नीचे दिया गया उदाहरण एक एकल व्यक्तिगत-शैली की फोटो को चार-सेकंड की क्लिप में एनिमेट करता है। ManifoldGen में पोर्ट्रेट, पालतू जानवरों, उत्पाद शॉट्स और परिदृश्यों के लिए समान पाइपलाइन काम करती है।

गति के लिए बनी फोटो से शुरू करें

मॉडल केवल वही स्थानांतरित कर सकता है जिसे वह खंडित कर सकता है, इसलिए स्रोत की गुणवत्ता आपके प्रॉम्प्ट से अधिक तय करती है:

  • तेज विषय — आंखें, फर, या किनारे स्पष्ट फोकस में। गति कोमलता को दलदल में बदल देती है।
  • स्वच्छ पृष्ठभूमि अलगाव — विषय पृष्ठभूमि से स्पष्ट रूप से अलग। व्यस्त दृश्य मॉडल को यह अनुमान लगाने के लिए मजबूर करते हैं कि कुत्ता कहाँ समाप्त होता है और पार्क कहाँ शुरू होता है।
  • एकल विषय — प्रति फ्रेम एक व्यक्ति या जानवर। दो विषय क्लिप के बीच पहचान बदलते हैं; समूह एक अलग तकनीक हैं।
  • कुछ गति पहले से ही निहित है — हवा में उड़ते बाल, स्ट्रिंग लाइट, पानी। मॉडल मौजूदा ऊर्जा को नई ऊर्जा बनाने की तुलना में कहीं बेहतर तरीके से बढ़ाता है।
  • उचित रिज़ॉल्यूशन — लंबी भुजा पर लगभग 1024px। यदि नहीं, तो पहले अपस्केल करें; एनीमेशन उस विवरण को पुनर्प्राप्त नहीं कर सकता जो स्रोत में कभी नहीं था।

ऐसी गति को प्रॉम्प्ट करें जो दृश्य से संबंधित हो

PERSONAL PHOTO, GENTLE MOTION

INPUT

Source photo
Source photo

PROMPT

Gentle breeze moves the fur and the grass around the blanket, ears lift as the dog tilts its head slightly toward camera, string lights twinkle softly, background bokeh breathes, natural handheld micro-movement, subtle and lifelike.

OUTPUT — GENERATED WITH MANIFOLDGEN

· 4s

स्रोत स्टिल स्वयं इस इमेज प्रॉम्प्ट के साथ उत्पन्न किया गया था: "एक पार्क में पिकनिक कंबल पर बैठे एक गोल्डन रिट्रीवर की कैंडिड स्मार्टफोन फोटो, जीभ बाहर, पीछे पेड़ और बोकेह स्ट्रिंग लाइट, देर दोपहर की धूप का चमक, एक व्यक्तिगत फोटो की तरह थोड़ा अपूर्ण फ्रेमिंग।" ध्यान दें कि हर गति खंड फ्रेम में पहले से मौजूद किसी चीज़ का नाम बताता है — फर, घास, कान, लाइट, बोकेह। कुछ भी दृश्य को एक नया तत्व प्राप्त करने के लिए नहीं कहता है।

उस प्रॉम्प्ट को परिवेशीय परतों की चेकलिस्ट के रूप में पढ़ें: पर्यावरणीय (फर और घास पर हवा), अभिव्यंजक (कैमरे की ओर सिर झुकाना), वायुमंडलीय (टिमटिमाती रोशनी), ऑप्टिकल (साँस लेने वाली बोकेह), और कैमरा (हैंडहेल्ड माइक्रो-मूवमेंट)। प्रत्येक परत के लिए एक खंड, प्रत्येक एक दृश्यमान तत्व से जुड़ा हुआ है। यह संरचना ही है जिसके कारण परिणाम एक मोर्फ के बजाय एक जीवंत क्षण के रूप में पढ़ा जाता है।

पहचान स्थिर रखें

पहचान का बहाव — चेहरे का आकार बदलना, निशान का विस्थापन — वह विफलता मोड है जिसे लोग सबसे पहले नोटिस करते हैं। तीन बचाव:

  • गति को डिफ़ॉल्ट रूप से सूक्ष्म रखें। गति की हर इकाई विषय को फिर से बनाने का एक मौका है; "थोड़ा", "धीरे से", और "सूक्ष्म" भार-वहन करने वाले शब्द हैं, न कि भराव।
  • छोटे बदलावों से परे कभी भी पोज़ बदलने के लिए न कहें। सिर झुकाना, पलकें झपकाना, साँस लेना, वज़न बदलना काम करता है। खड़े होना, मुड़ना, दूर चलना काम नहीं करता।
  • उपलब्ध होने पर कम शक्ति का उपयोग करें। कम इमेज स्ट्रेंथ आउटपुट को स्रोत पिक्सेल के करीब रखती है, गति कम होने की कीमत पर — चेहरों और पालतू जानवरों के लिए सही व्यापार।

यदि पहली पीढ़ी वैसे भी बहती है, तो कुछ और छूने से पहले गति खंडों की संख्या को आधा कर दें। अतिभारित प्रॉम्प्ट मॉडल को तात्कालिक बनाते हैं।

एक पुन: प्रयोज्य इमेज-टू-वीडियो कंकाल

[Environmental motion] moves [ambient elements],
[small expressive action] as [subject] [micro-gesture toward camera],
[atmospheric layer] softly, background [optical layer] breathes,
natural handheld micro-movement, subtle and lifelike.
जो पहले से चल रहा है उसे एनिमेट करें

हर अच्छे इमेज-टू-वीडियो क्लिप के पीछे का एक नियम: फ्रेम में मौजूद गति को बढ़ाएँ, कभी भी ऐसी गति पेश न करें जिसके लिए एक नई वस्तु, अंग, या प्रकाश स्रोत की आवश्यकता हो। हवा, पलक झपकाओ, साँस लो, टिमटिमाओ, लहरें — फिर रुक जाओ।

समस्या निवारण

  • विषय पिघल जाता है या प्रजाति बदल जाती है — बहुत अधिक गति का अनुरोध किया गया। दो खंडों में काटें और "सूक्ष्म" जोड़ें।
  • क्लिप एक स्थिर ज़ूम जैसा दिखता है — आपने कैमरे का वर्णन किया लेकिन दृश्य का नहीं। कैमरा भाषा को हवा, पलक झपकाने और प्रकाश खंडों से बदलें।
  • नई वस्तुएँ दिखाई देती हैं (अतिरिक्त कुत्ते, तैरते पत्ते) — आपके प्रॉम्प्ट ने फोटो में अनुपस्थित तत्वों को पेश किया। केवल दृश्यमान चीजों का वर्णन करें।
  • गति मजबूत शुरू होती है फिर जम जाती है — क्लिप की लंबाई प्रॉम्प्ट की ऊर्जा से अधिक है। 4 सेकंड तक रखें या "हवा लगातार चलती रहती है" जैसा एक निरंतर परिवेशीय खंड जोड़ें।
  • पृष्ठभूमि बुरी तरह से विकृत हो जाती है — इमेज स्ट्रेंथ बढ़ाएँ / मोशन स्ट्रेंथ कम करें ताकि विषय के हिलने पर वातावरण स्थिर रहे।
  • चेहरा बार-बार कोशिश करने पर समानता खो देता है — हर बार मूल फ़ाइल से पुन: उत्पन्न करें, न कि पहले से एनिमेटेड फ्रेम से।

अपने कैमरा रोल से तीन तस्वीरें चुनें, उन्हें स्टूडियो में ऊपर दिए गए कंकाल के माध्यम से चलाएं, और जो भी क्लिप फिर से देखने लायक हो उसे रखें — फिर मोशन शैलियों की तुलना करने के लिए /tools/cinematic-cameras के तहत विभिन्न प्रीसेट के माध्यम से उसी स्रोत को आज़माएं।

Try these prompts on your own shot.

Every example on this page was generated with ManifoldGen. Open the Studio and run the same structure on your idea.

Open Studio