Hoe je een foto omzet in een AI-video
Verander elke foto in een levendige AI-video: kies bronafbeeldingen die goed animeren, vraag om beweging die bij de scène past, en houd de identiteit perfect stabiel.
Afbeelding-naar-video is de meest krachtige functie in AI-video: één goede foto erin, een paar seconden geloofwaardig leven eruit. Het is ook waar de meeste pogingen mislukken, omdat mensen vragen om beweging die de scène niet kan ondersteunen. Een portret heeft geen camera nodig om te draaien — het heeft een oor nodig om te trillen en de achtergrondbokeh om te ademen. Deze gids behandelt het kiezen van een bronfoto die netjes animeert, het schrijven van bewegingsprompts die bij de scène passen, en het herkenbaar houden van het onderwerp.
Het onderstaande voorbeeld animeert een enkele foto in persoonlijke stijl tot een clip van vier seconden. Dezelfde pijplijn werkt voor portretten, huisdieren, productfoto's en landschappen in ManifoldGen.
Begin met een foto die gemaakt is voor beweging
Het model kan alleen bewegen wat het kan segmenteren, dus de bronkwaliteit bepaalt meer dan je prompt doet:
- Scherp onderwerp — ogen, vacht of randen scherp in focus. Beweging versterkt zachtheid tot brij.
- Schone achtergrondscheiding — onderwerp duidelijk onderscheiden van de achtergrond. Drukke scènes dwingen het model te raden waar de hond eindigt en het park begint.
- Enkel onderwerp — één persoon of dier per frame. Twee onderwerpen wisselen halverwege de clip van identiteit; groepen zijn een andere techniek.
- Enige beweging al geïmpliceerd — wapperend haar, lichtslingers, water. Het model verlengt bestaande energie veel beter dan het nieuwe energie uitvindt.
- Redelijke resolutie — ongeveer 1024px aan de lange zijde. Upscale eerst indien niet; animatie kan geen details herstellen die de bron nooit had.
Vraag om beweging die bij de scène past
INPUT

PROMPT
Gentle breeze moves the fur and the grass around the blanket, ears lift as the dog tilts its head slightly toward camera, string lights twinkle softly, background bokeh breathes, natural handheld micro-movement, subtle and lifelike.OUTPUT — GENERATED WITH MANIFOLDGEN
· 4s
De bronafbeelding zelf werd gegenereerd met deze afbeeldingsprompt: "Oprechte smartphonefoto van een golden retriever zittend op een picknickkleed in een park, tong uit, bomen en bokeh lichtslingers erachter, late middagzonflits, licht imperfecte kadrering zoals een persoonlijke foto." Merk op dat elke bewegingsclausule iets benoemt dat al in het frame aanwezig is — vacht, gras, oren, lichten, bokeh. Niets vraagt de scène om een nieuw element te krijgen.
Lees die prompt als een checklist van omgevingslagen: omgevingsfactoren (briesje op vacht en gras), expressief (hoofd kantelt naar camera), atmosferisch (fonkelende lichtjes), optisch (ademende bokeh), en camera (handheld microbeweging). Eén clausule per laag, elk gekoppeld aan een zichtbaar element. Die structuur zorgt ervoor dat het resultaat leest als een levendig moment in plaats van een metamorfose.
Identiteit stabiel houden
Identiteitsverandering — gezichten die vervormen, markeringen die verschuiven — is de fout die mensen het eerst opmerken. Drie verdedigingen:
- Houd beweging standaard subtiel. Elke eenheid van beweging is een kans om het onderwerp opnieuw te tekenen; "lichtjes", "voorzichtig" en "subtiel" zijn dragende woorden, geen opvulling.
- Vraag nooit om houdingsveranderingen die verder gaan dan kleine. Hoofdkantelingen, knipperen, ademhalingen, gewichtsverschuivingen werken. Opstaan, omdraaien, weglopen niet.
- Gebruik een lage sterkte indien beschikbaar. Een lagere beeldsterkte houdt de uitvoer dichter bij de bronpixels ten koste van minder beweging — de juiste afweging voor gezichten en huisdieren.
Als de eerste generatie toch afwijkt, halveer dan het aantal bewegingsclausules voordat je iets anders aanraakt. Overladen prompts zorgen ervoor dat het model improviseert.
Een herbruikbaar beeld-naar-video skelet
[Environmental motion] moves [ambient elements],
[small expressive action] as [subject] [micro-gesture toward camera],
[atmospheric layer] softly, background [optical layer] breathes,
natural handheld micro-movement, subtle and lifelike.De enige regel achter elke goede beeld-naar-video clip: verleng beweging die al in het frame bestaat, introduceer nooit beweging die een nieuw object, ledemaat of lichtbron zou vereisen. Wind, knipper, adem, fonkel, rimpel — en stop dan.
Probleemoplossing
- Onderwerp smelt of verandert van soort — te veel gevraagde beweging. Terugbrengen naar twee clausules en "subtiel" toevoegen.
- Clip ziet eruit als een statische zoom — je beschreef de camera maar niet de scène. Vervang camertaal door bries-, knipper- en lichtclausules.
- Nieuwe objecten verschijnen (extra honden, zwevende bladeren) — je prompt introduceerde elementen die afwezig waren op de foto. Beschrijf alleen zichtbare dingen.
- Beweging begint sterk en bevriest dan — de cliplengte overschrijdt de energie van de prompt. Houd het bij 4 seconden of voeg één aanhoudende omgevingsclausule toe zoals "wind blijft gestaag doorgaan".
- Achtergrond vervormt erg — verhoog de beeldsterkte / verlaag de bewegingssterkte zodat de omgeving stabiel blijft terwijl het onderwerp beweegt.
- Gezicht verliest gelijkenis bij nieuwe pogingen — genereer elke keer opnieuw vanuit het originele bestand, niet vanuit een eerder geanimeerd frame.
Kies drie foto's uit je camerarol, haal ze door het bovenstaande skelet in Studio, en bewaar de clip die een herhaling waard is — probeer vervolgens dezelfde bron met verschillende presets onder /tools/cinematic-cameras om bewegingsstijlen te vergelijken.
Try these prompts on your own shot.
Every example on this page was generated with ManifoldGen. Open the Studio and run the same structure on your idea.