Gids voor AI-videoprompts: 7 geteste oplossingen voor betere video's
De meeste mislukte AI-videoprompts zijn niet het gevolg van een gebrek aan verbeelding. Ze ontstaan door gewoonten die werkten bij het genereren van afbeeldingen, maar tekortschieten wanneer een model beweging, timing, camerabewegingen, consistentie van het onderwerp en soms ook audio in dezelfde clip moet genereren.
Deze gids voor AI-videoprompts richt zich op zeven praktische verbeteringen voor moderne videogeneratie. De tips zijn bedoeld voor de modellen die makers momenteel op PixVerse kunnen vergelijken, waaronder Seedance 2.0, HappyHorse 1.0, PixVerse V6, PixVerse C1, Kling O3 en Kling 3.0. Ze zijn ook breed toepasbaar op andere AI-videogeneratoren, omdat de knelpunten hetzelfde zijn: overladen prompts, vage stijlaanduidingen, tegenstrijdige camerabewegingen, schijnbare negatieve prompts, snelheidswoorden die schokkerigheid veroorzaken, afwijkingen van de referentieafbeelding en algemene kwaliteitsbijvoeglijke naamwoorden.
Het doel is niet om elke prompt korter of technischer te maken. Het doel is om elke instructie een duidelijke functie te geven. Een sterke tekst-naar-videoprompt vertelt het model eerst wat belangrijk is, geeft één helder bewegingsverloop, bewaakt de consistentie van het onderwerp en gebruikt concrete visuele taal in plaats van algemene smaakwoorden.
Als je vóór de bewegingsprompt een stilstaand beeld nodig hebt, begin dan met de gids voor GPT Image 2-prompts en gebruik het goedgekeurde beeld vervolgens in PixVerse afbeelding-naar-video met een afzonderlijke bewegingsprompt.
Test AI-videoprompts op PixVerse
Hoe we deze AI-videoprompts hebben getest
Voor dit artikel hebben we alle zeven promptvoorbeelden in PixVerse gegenereerd met dezelfde basisinstellingen voor videogeneratie en met audio ingeschakeld voor elke clip. Het doel is niet om één modelspecifieke truc aan te prijzen, maar om de promptstructuur afzonderlijk te beoordelen terwijl de testomgeving consistent blijft. De bronvideo’s zijn gegenereerd met een duur van ongeveer 5 seconden per stuk; zes clips gebruiken horizontale uitvoer van 1280x720, terwijl het voorbeeld met de referentieafbeelding verticale uitvoer van 720x1280 gebruikt. Elk bestand bevat een audiotrack.
Onze benchmark is praktisch en niet gericht op ranglijsten. We hebben elke video beoordeeld aan de hand van zes productiecriteria:
- Naleving van de prompt: Volgt de clip de kerninstructie?
- Bewegingscontrole: Is de belangrijkste handeling duidelijk te volgen, zonder schokkerigheid of visuele vervorming?
- Consistentie van het onderwerp: Behouden producten, mensen of objecten hun vorm?
- Camerastabiliteit: Blijft het opgegeven cameratraject vloeiend?
- Geschiktheid voor audio: Geeft de prompt het model bruikbare geluidsaanwijzingen?
- Bruikbaarheid voor productie: Kan de clip worden gebruikt in een blog, advertentieconcept, pitch of prompttutorial zonder de lezer te verwarren?
Deze regels zijn opgesteld als modeloverstijgende vuistregels, omdat de meeste huidige AI-videogeneratoren dezelfde knelpunten hebben: afwijkingen door de tijd heen, dubbelzinnige bewegingen, instabiele cameratrajecten en concurrerende instructies voor het onderwerp.
Voor meer context over de modellen kun je onze review van Seedance 2.0, vergelijking van HappyHorse 1.0 en Seedance 2.0 en Kling O3 en Kling 3.0 op PixVerse bekijken.
Tip 1: Langere prompts leveren slechtere resultaten op, geen betere
Een langere prompt kan veiliger aanvoelen, omdat je het model daarmee meer details lijkt te geven. In de praktijk verwateren lange AI-videoprompts vaak de belangrijkste instructie. De eerste zin biedt de meeste controle, terwijl latere details zwakke suggesties kunnen worden die elkaar in de weg zitten.
Veelgemaakte fout: Denken dat een prompt van 200 woorden meer controle biedt
Slechte prompt:
Videoprompt: Een luxe parfumfles in een elegante studio, prachtige belichting, filmische reflecties, hoogwaardige reclame-uitstraling, dure materialen, zachte deeltjes, vloeiende beweging, verfijnde sfeer, hoge kwaliteit, delicate textuur, een dramatische camerabeweging, emotionele storytelling, de uitstraling van een luxemerk, realistisch glas, gouden vloeistof, sprankelende lichtaccenten, slow motion, elegante schaduwen, perfecte compositie, geen vervorming, geen flikkering, geen slechte anatomie, geen rommelige achtergrond, geen extra objecten, professionele video, virale reclamestijl.
Deze prompt lijkt gedetailleerd, maar de meeste details zijn algemeen of overbodig. Het model moet kiezen tussen productbeweging, belichting, stijl, reflecties, deeltjes, kwaliteitslabels en negatieve formuleringen. De kerninstructie raakt ondergesneeuwd.
Waarom dit misgaat
Videomodellen verwerken tekst als een reeks instructies. Hoe eerder en duidelijker de kernhandeling wordt genoemd, hoe gemakkelijker het model die gedurende de video kan behouden. Dit is vooral belangrijk voor langere clips, waarbij samenhang door de tijd heen al meer van het model vraagt. OpenAI’s Sora-onderzoek merkt op dat videomodellen nog steeds moeite hebben met exacte fysica en oorzaak-gevolgrelaties. Zwakke instructies toevoegen na het hoofdidee levert dus niet automatisch meer controle op.
Verbetering van de prompt
Gebruik een structuur van 50-80 woorden:
Sentence 1: subject + action + location.
Sentence 2: camera + style.
Sentence 3: constraints.
Betere prompt:
Videoprompt: Een doorzichtige glazen parfumfles staat op zwart marmer terwijl warm randlicht door de gouden vloeistof schijnt. De fles maakt een zeer kleine presentatiedraai, net genoeg om een stukje van de zijkant te onthullen, en keert daarna terug naar een centrale positie als blikvanger. Langzame macrobeweging naar voren vanaf de hoogte van het etiket naar de dop, luxe studiobelichting voor producten, zacht goudstof achter de fles. Eindig met een stabiel, gecentreerd productbeeld, geen tekst over het beeld, geen extra objecten. Audio: subtiele glasbeweging, zacht omgevingsgeluid van de studio.
Praktijktest van de prompt
Testopzet: PixVerse-videogeneratie met dezelfde basisinstellingen als bij alle zeven voorbeelden. Generatie-instellingen: 5 seconden, 720p-resolutie, beeldverhouding 16:9, audio ingeschakeld voor subtiele glasbeweging en omgevingsgeluid van de studio. Wat deze test controleert: of een compacte prompt de productidentiteit, ingetogen beweging, belichting en cameracontrole kan behouden zonder de belangrijkste handeling te laten ondersneeuwen.
In deze test voor een productreclame werkte de heldere prompt doordat de belangrijkste handeling eenvoudig te volgen bleef: een productfles maakt een ingetogen presentatiebeweging terwijl de camera naar voren beweegt in een gecontroleerde reclameopstelling. De fles blijft gecentreerd, de gouden vloeistof blijft duidelijk zichtbaar door het glas en het warme tegenlicht creëert een duidelijke luxe productuitstraling zonder een lange lijst bijvoeglijke naamwoorden.
De belangrijkste les: kort betekent niet vaag. Een compacte prompt met een duidelijk onderwerp, één ingetogen handeling, één camerabeweging en enkele beperkingen werkt vaak beter dan een lange prompt vol losse voorkeuren.
Tip 2: “Filmisch” is vrijwel nutteloos
“Filmisch” is een van de meest gebruikte woorden in AI-videoprompts, maar het is te breed om betrouwbaar te zijn. Het kan verwijzen naar horrorschaduwen, romantisch gouden licht, documentair realisme, sciencefictionnevel of allerlei andere, niet-gerelateerde filmstijlen.
Veelgemaakte fout: “Filmisch” gebruiken als kwaliteitsschakelaar
Slechte prompt:
Videoprompt: Een gepensioneerde detective loopt ’s nachts door een regenachtig steegje. Filmisch, professioneel, dramatisch, filmkwaliteit.
Dit geeft het model een sfeer, maar geen specifieke uitstraling. Het resultaat kan donker, licht, noir, uit de hand gefilmd, glanzend, rauw of iets daartussenin zijn.
Waarom dit misgaat
Trainingsdata verbinden brede woorden als “filmisch” met veel verschillende visuele verdelingen. Een model weet niet welke variant van “filmisch” je bedoelt, tenzij je de daadwerkelijke visuele taal benoemt: de lichtopstelling, het lenskarakter, de compositie, het cameratraject, het kleurenpalet of een herkenbare aanwijzing voor een regisseursstijl. Runway’s Gen-3 Alpha-onderzoek benadrukt zeer beschrijvende onderschriften met veel informatie over het tijdsverloop. Dat herinnert ons eraan dat concrete visuele taal beter werkt dan vage labels.
Verbetering van de prompt
Vervang “filmisch” door een gerichte visuele aanwijzing:
Director-style composition, lighting setup, lens behavior, aspect ratio, or color palette.
Betere prompt:
Videoprompt: Een gepensioneerde detective in een lange donkere jas loopt ’s nachts door een doorweekte steeg. Langzame camerabeweging naar voren van een totaalshot naar een medium close-up, rood en blauw neonlicht weerspiegeld op natte kasseien, eenpuntsperspectief door de steeg, anamorfische 2.39:1-lensflare van echte neonreclames, sigarettenrook die voor zijn gezicht langs trekt. Audio: regen op de bestrating, verkeer in de verte, zacht gezoem van neon.
Praktijktest van de prompt
Testopzet: PixVerse-videogeneratie met dezelfde basisinstellingen als bij alle zeven voorbeelden. Generatie-instellingen: 5 seconden, 720p-resolutie, beeldverhouding 16:9, audio ingeschakeld voor regen en stadsgeluiden. Wat deze test controleert: of specifieke filmtaal een stabielere sfeer creëert dan het algemene woord “filmisch”.
De test met de regenachtige steeg werkte doordat de prompt zichtbare filmelementen benoemde: doorweekte kasseien, neonreflecties, eenpuntsperspectief, een langzame camerabeweging naar voren en noirbelichting. De detective blijft het visuele anker, terwijl de diepte van de steeg, de natte grond en de rood-blauwe reclames de sfeer creëren. De clip voelt filmisch aan doordat de prompt beschrijft hoe het shot eruit moet zien, niet doordat hij steunt op het woord “filmisch”.
Tip 3: Camerabewegingen stapelen veroorzaakt schokkerigheid
AI-videomodellen kunnen camerabewegingen volgen, maar zijn gemakkelijker te sturen wanneer de beweging één hoofdrichting heeft. Het stapelen van camera-aanwijzingen leidt vaak tot schokkerigheid, afdwalen of ongewenste overgangen.
Veelgemaakte fout: Verschillende camerarichtingen combineren
Slechte prompt:
Videoprompt: Een miniatuurmagneettrein rijdt door een stad in een glazen terrarium. De camera beweegt naar voren, draait naar links, cirkelt rond de trein, kantelt omhoog langs de mostorens en voegt schokken van een handcamera toe.
Dit klinkt als een echte filmbeweging, maar bij het genereren levert het te veel ruimtelijke vectoren op. Het model kan proberen ze achter elkaar uit te voeren of ze samen te voegen tot een instabiele beweging.
Waarom dit misgaat
Camerabeweging is ruimtelijk. Naar voren bewegen, horizontaal draaien, rondcirkelen, kantelen en schokken van een handcamera beschrijven elk een andere bewegingsvector. Wanneer je er meerdere stapelt, moet het model bepalen welke domineert en wanneer het moet omschakelen. Dat kan een zichtbare schommeling op het overgangspunt veroorzaken. Onderzoekssystemen zoals Direct-a-Video en MotionCtrl scheiden camerabeweging ook van objectbeweging. Dat ondersteunt deze praktische regel: laat één prompt niet vijf cameravectoren tegelijk dragen.
Verbetering van de prompt
Gebruik één hoofdcamerabeweging plus één aanwijzing voor het bewegingskarakter:
Main motion: slow push-in.
Texture: slight handheld feel.
Betere prompt:
Videoprompt: Een miniatuurmagneettrein glijdt door een stad in een glazen terrarium op een laboratoriumtafel, langs mostorens, kleine ramen en condensdruppels op de glazen wanden. Camera: één vloeiende zijwaartse volgbeweging evenwijdig aan de trein, met slechts een lichte handcamera-uitstraling. Houd de trein gecentreerd terwijl de achtergrond voorbijschuift. Audio: zacht elektrisch gezoem, lichte railtrillingen, waterdruppels op glas, gedempt omgevingsgeluid van de ruimte.
Praktijktest van de prompt
Testopzet: PixVerse-videogeneratie met dezelfde basisinstellingen als bij alle zeven voorbeelden. Generatie-instellingen: 5 seconden, 720p-resolutie, beeldverhouding 16:9, audio ingeschakeld. Wat deze test controleert: of één zijwaartse volgbeweging een klein onderwerp duidelijk zichtbaar kan houden terwijl de achtergrond beweging creëert.
Dit voorbeeld is nuttig omdat de scène veel verleidelijke bronnen van camerachaos bevat: glasreflecties, kleine gebouwen, condens, een bewegende trein en een macroschaal. De betere prompt geeft het model slechts één cameravector en gebruikt vervolgens de bewegende achtergrond om visuele energie te creëren. Controleer bij de beoordeling of de trein gecentreerd blijft, of de glasreflecties stabiel blijven en of het geluidsontwerp de miniatuurschaal ondersteunt zonder die te overheersen.
De gegenereerde clip is een van de duidelijkste demonstraties in deze reeks. De trein blijft onder in beeld goed te volgen, terwijl de met mos bedekte terrariumstad parallax en diepte creëert. Doordat de prompt één zijwaartse volgbeweging gebruikt in plaats van bewegingen naar voren, horizontale draaibewegingen, cirkelbewegingen en kantelingen te stapelen, bevat de scène beweging zonder dat de camera zichzelf tegenwerkt.
Tip 4: Er zijn geen negatieve prompts
Veel makers nemen hun Stable Diffusion-gewoonten mee naar videoprompts en schrijven negatieve promptlijsten zoals “negatief: schokkerigheid, gebogen ledematen, flikkering, vervorming”. In de meeste AI-videogeneratoren is dit geen echt veld voor negatieve prompts. Het is gewoon meer tekst.
Veelgemaakte fout: “Negatieve” instructies in de prompt schrijven
Slechte prompt:
Videoprompt: Een horlogemaker repareert een zwevende kubus met uurwerkmechaniek onder een bureaulamp. Negatief: schokkerigheid, slechte handen, gebogen vingers, flikkering, vervorming, kapotte tandwielen, instabiele belichting.
Dit kan het resultaat verslechteren, omdat het model de woorden “schokkerigheid”, “gebogen ledematen” en “vervorming” nog steeds leest. In plaats van die concepten te blokkeren, kan de prompt storende associaties oproepen.
Waarom dit misgaat
Tenzij de interface een specifiek veld voor negatieve prompts biedt, wordt alle prompttekst doorgaans als positieve instructie behandeld. Een model begrijpt “negatief:” niet automatisch als een harde uitsluiting. Als je stabiliteit wilt, benoem dan rechtstreeks de gewenste stabiele toestand.
Verbetering van de prompt
Gebruik positief geformuleerde beperkingen:
Face remains stable.
Limbs move naturally.
Lighting remains consistent with no flicker.
Body proportions stay consistent throughout.
Betere prompt:
Videoprompt: Een horlogemaker gebruikt een messing pincet om één transparant tandwiel in een kleine zwevende kubus met uurwerkmechaniek te plaatsen, onder een warme bureaulamp. De camera beweegt langzaam naar voren van de handen naar de kubus. De handen bewegen natuurlijk, de randen van het tandwiel blijven scherp, de kubus blijft gecentreerd en het warme lamplicht blijft constant zonder flikkering. Audio: klikken van het messing pincet, tikken van een klein tandwiel, rustig omgevingsgeluid van de werkplaats.
Praktijktest van de prompt
Testopzet: PixVerse-videogeneratie met dezelfde basisinstellingen als bij alle zeven voorbeelden. Generatie-instellingen: 5 seconden, 720p-resolutie, beeldverhouding 16:9, audio ingeschakeld voor kleine mechanische geluiden en omgevingsgeluid van de werkplaats. Wat deze test controleert: stabiliteit van de handen, helderheid van objectranden, consistente belichting en of positieve beperkingen zichtbare artefacten verminderen.
Dit voorbeeld maakt het probleem met negatieve prompts duidelijk, omdat handen, kleine tandwielen, transparante randen en warm licht allemaal gevoelig zijn voor artefacten. In plaats van op te sommen wat niet mag gebeuren, beschrijft de betere prompt de gewenste toestand: natuurlijke handen, scherpe tandwielranden, een gecentreerde kubus en stabiel lamplicht. Vergelijk bij de beoordeling of de beperkingen het gemakkelijker maken om de kubus beeld voor beeld te inspecteren.
Het resultaat geeft de kijker een duidelijk inspectiepunt: het pincet, de transparante kubus en de tandwieldetails blijven onder de bureaulamp visueel van elkaar gescheiden. De hand is dichtbij genoeg om het model op de proef te stellen, maar de positieve beperkingen maken het gewenste gedrag duidelijk. Daardoor is de clip bruikbaarder dan een negatieve lijst die onbedoeld woorden als “vervorming” of “slechte handen” herhaalt.
Tip 5: Het woord “snel” verlaagt de uitvoerkwaliteit
“Snel” lijkt nuttig als je snelheid wilt, maar het stuurt videomodellen vaak richting instabiele beweging. Het probleem wordt groter wanneer de prompt al complexe actie, camerabewegingen, deeltjes of meerdere onderwerpen bevat.
Veelgemaakte fout: Elk element snel laten bewegen
Slechte prompt:
Videoprompt: Een longboarder rijdt snel een bergweg af, snelle camera, snelle bochten, snelle bewegingsonscherpte, dynamische snelheid, intense actie, snelle beweging.
Dit creëert verschillende concurrerende elementen met hoge snelheid. Het model moet het onderwerp, de camera, de effecten en de timing van de scène tegelijk laten bewegen, wat kan leiden tot schokkerigheid en visuele vervorming.
Waarom dit misgaat
Snelheid is niet alleen een stijl. Ze stelt ook eisen aan het tijdsverloop. Wanneer meerdere elementen tegelijk versnellen, moet het model anatomie, objectvorm, cameratraject, samenhang van de achtergrond en timing van effecten behouden onder een hogere bewegingsdruk. Beschrijf in plaats van “snel” de fysieke signalen die snelheid zichtbaar maken.
Verbetering van de prompt
Vervang “snel” door fysieke bewegingsdetails:
Feet strike the ground with force.
Each stride fully extends.
Arms swing at 90 degrees.
Motion blur trails from the background, not the face.
Betere prompt:
Videoprompt: Een downhill-longboarder leunt een bocht in op een door regen gladde bergweg, met diep gebogen knieën en de achterste hand enkele inches boven het asfalt. Elk wiel werpt een dunne waterspray naar buiten terwijl reflectoren langs de weg uitrekken tot zachte strepen op de achtergrond. De camera blijft laag naast het board in één stabiel volgshot. Helm en jas blijven stabiel. Audio: zoemende wielen, gesis van de natte weg, winddruk, één carvebeweging van het board.
Praktijktest van de prompt
Testopzet: PixVerse-videogeneratie met dezelfde basisinstellingen als bij alle zeven voorbeelden. Generatie-instellingen: 5 seconden, 720p-resolutie, beeldverhouding 16:9, audio ingeschakeld. Wat deze test controleert: of fysieke bewegingstaal een gevoel van snelheid kan creëren zonder het model te overbelasten.
Dit voorbeeld vermijdt het woord “snel” en maakt snelheid toch zichtbaar. Het board helt, de knieën buigen diep, de wielen werpen water op en de reflectoren op de achtergrond rekken uit tot bewegingsstrepen. Controleer bij de beoordeling of de longboarder anatomisch stabiel blijft, of de camera laag en stabiel blijft en of het geluid van wielen en nat asfalt snelheid creëert zonder visuele vervorming.
Het resultaat brengt snelheid over via fysieke aanwijzingen in plaats van het woord “snel”. De lage camerapositie, reflecties op de natte weg, diep gebogen rijhouding en waterspray laten de afdaling snel aanvoelen, terwijl het lichaam en het board duidelijk te volgen blijven. Dat is precies de kern van deze tip: snelheid is beter te sturen wanneer je haar beschrijft als oorzaak en gevolg.
Tip 6: Je referentieafbeelding opnieuw beschrijven veroorzaakt afwijkingen in het onderwerp
Afbeelding-naar-videoprompts moeten niet alles herhalen wat al zichtbaar is in de geüploade afbeelding. Als de afbeelding al een vormvaste zwarte handtas onder een spotlight toont en de prompt dezelfde tas nogmaals in iets andere woorden beschrijft, krijgt het model twee inputs voor hetzelfde onderwerp: de afbeelding en de tekst. Kleine verschillen daartussen kunnen afwijkingen veroorzaken.
Veelgemaakte fout: De referentieafbeelding opnieuw beschrijven
Slechte prompt voor afbeelding-naar-video:
Videoprompt: Een zwarte leren handtas met een gebogen handvat, zilveren sluiting, vormvaste tasvorm, gestikte panelen en een donkere studioachtergrond staat onder een dramatische spotlight.
Als die details al in de afbeelding staan, kan de prompt het model uitnodigen om ze opnieuw te interpreteren. Het resultaat kan het silhouet van het object veranderen, het materiaal aanpassen, decoratieve details verplaatsen of de achtergrond vervangen.
Waarom dit misgaat
Een referentieafbeelding is al een sterke visuele instructie. Door het zichtbare onderwerp opnieuw te beschrijven, creëer je een tweede instructiekanaal dat mogelijk niet perfect overeenkomt met de pixels. Gebruik de prompt om de identiteit te behouden voor wat de afbeelding niet kan tonen: beweging en cameragedrag.
Verbetering van de prompt
Beperk de prompt voor afbeelding-naar-video tot drie taken:
motion instruction, camera instruction, and one consistency rule.
Betere prompt:
Videoprompt: Houd het referentieobject volledig intact. Voeg alleen een rustige camerabeweging naar voren toe vanuit de huidige kadrering, terwijl een smal lichtaccent langzaam over het zichtbare oppervlak trekt. Behoud het exacte silhouet, de materialen, decoratieve details, achtergrond, lichtrichting en compositie van de referentieafbeelding. Audio: zacht omgevingsgeluid van een tentoonstellingsruimte, lichte glasresonantie, subtiel geritsel van stof.
Praktijktest van de prompt
Testopzet: PixVerse-videogeneratie met dezelfde basisinstellingen als bij alle zeven voorbeelden. Generatie-instellingen: 5 seconden, 720p-resolutie, beeldverhouding 9:16, afbeelding-naar-video met audio ingeschakeld voor subtiele materiaalgeluiden en omgevingsgeluid van de ruimte. Wat deze test controleert: of een referentiegestuurde prompt de productidentiteit kan behouden terwijl camerabeweging en lichtbeweging worden toegevoegd.
Dit voorbeeld werkt alleen als de referentieafbeelding het object al vastlegt. De prompt vermijdt bewust het opnieuw beschrijven van kleur, vorm, materiaal of decoratieve details en vraagt het model niet om verborgen mechanismen of onzichtbare interne onderdelen te verzinnen. Controleer bij de beoordeling of de handtas hetzelfde silhouet, dezelfde sluitingspositie, handvatvorm, leertextuur en donkere studioachtergrond behoudt terwijl de camera en het lichtaccent beweging creëren. Als het model het object verandert, concurreert de prompt waarschijnlijk nog steeds met de referentieafbeelding.
De gegenereerde clip is bewust ingetogen. Daardoor past hij goed bij deze tip: het product blijft de blikvanger, de spotlight houdt de visuele taal dicht bij de referentie en de beweging blijft beperkt tot een camerabeweging naar voren voor de presentatie, in plaats van een transformatie. Voor referentiegestuurde productvideo’s is saaie stabiliteit vaak waardevoller dan ambitieuze beweging.
Tip 7: Algemene kwaliteitswoorden doen niets
Woorden als “geweldig”, “mooi”, “hoge kwaliteit”, “episch” en “professioneel” komen vaak voor in AI-videoprompts, maar bieden zelden betrouwbare controle. Het zijn veelgebruikte labels die met te veel soorten resultaten worden geassocieerd.
Veelgemaakte fout: De prompt vullen met kwaliteitsbijvoeglijke naamwoorden
Slechte prompt:
Videoprompt: Een geweldige, mooie, epische festivalscène met beelden van hoge kwaliteit, verbluffende beweging, professionele belichting en perfecte compositie.
Deze prompt vertelt het model dat het resultaat goed moet zijn, maar niet wat “goed” in deze scène betekent.
Waarom dit misgaat
Algemene kwaliteitswoorden putten uit brede verdelingen. “Episch” kan een weids landschap, een gevecht, een gloeiende hemel, enorme schaal, zware muziek, slow motion of fantasiepantser betekenen. Een model kan je exacte bedoeling niet afleiden, tenzij je het bijvoeglijk naamwoord vervangt door iets zichtbaars en specifieks.
Verbetering van de prompt
Vervang elk algemeen bijvoeglijk naamwoord door een benoemde, zichtbare aanwijzing:
Director-style composition.
Lighting setup.
Lens specification.
Color palette.
Material behavior.
Betere prompt:
Videoprompt: Een nachtelijk vliegerfestival vindt plaats op een witte zoutvlakte bedekt met een dunne, spiegelende laag water. Drie doorschijnende vliegers in de vorm van diepzeewezens zweven boven het terrein, met blauwgroene bioluminescente ribben die onder de stof pulseren. Langzame camerabeweging naar voren vanuit een laag standpunt, van reflecties op enkelhoogte naar de dichtstbijzijnde vliegerstaart, het karakter van een 24mm-groothoeklens, cyaan-magenta kleurcontrast, lantaarns langs de horizon. Audio: flapperende stof, trillingen van strakgespannen touw, voetstappen in ondiep water, geroezemoes van publiek in de verte.
Praktijktest van de prompt
Testopzet: PixVerse-videogeneratie met dezelfde basisinstellingen als bij alle zeven voorbeelden. Generatie-instellingen: 5 seconden, 720p-resolutie, beeldverhouding 16:9, audio ingeschakeld voor stof, voetstappen en publieksgeluiden. Wat deze test controleert: of specifieke visuele aanwijzingen meer stijlconsistentie creëren dan algemene kwaliteitswoorden.
Dit voorbeeld vervangt elk algemeen kwaliteitswoord door iets zichtbaars: reflecties op een zoutvlakte, doorschijnende vliegers in de vorm van wezens, bioluminescente ribben, een lage camerahoogte, een groothoekkarakter, cyaan-magenta contrast en lantaarns aan de horizon. Controleer bij de beoordeling of het model de bijzondere visuele identiteit behoudt in plaats van af te glijden naar een algemene festivalscène.
Het resultaat behoudt het belangrijkste idee: doorschijnende vliegers in de vorm van diepzeewezens met blauwgroene gloeiende ribben. Het camerastandpunt oogt hoger dan de kadrering op enkelhoogte uit de prompt, dus de camera-instructie wordt niet perfect gevolgd. Toch is de visuele identiteit veel sterker dan bij een prompt die alleen “mooi episch festival” zegt. Dat bewijst de waarde van concrete zelfstandige naamwoorden, lichtaanwijzingen en kleurrelaties.
Extra herschreven prompts
Deze twee extra herschrijvingen combineren verschillende tips van hierboven.
Vage prompt voor een futuristische stad
Slechte prompt:
Videoprompt: Maak een coole filmische AI-video over een futuristische stad. Maak hem mooi, realistisch, dramatisch, van hoge kwaliteit en viraal.
Wat er mis is: Deze prompt gaat in tegen Tip 2 en Tip 7. Hij steunt op “filmisch”, “mooi”, “dramatisch” en “hoge kwaliteit” zonder een concreet shot te benoemen. Er is geen onderwerp, geen handeling, geen cameratraject, geen tijdsverloop en geen eindbeeld.
Verbeterde prompt:
Videoprompt: Een onthulling van een futuristische stad van 6 seconden. De camera glijdt laag boven een door regen natte straat, met blauwe holografische borden die in het wegdek weerspiegelen. Eén bezorgdrone passeert dicht langs de lens en stijgt op naar een glazen toren. Vloeiende voorwaartse volgbeweging, koel blauw palet, warm licht bij de toreningang, zachte regen, verkeer in de verte, één passerende drone.
Overladen actieprompt
Slechte prompt:
Videoprompt: Een longboarder racet snel een bergweg af, ontwijkt verkeer, springt over een omgevallen boom, glijdt door vonken, snijdt naar een droneshot, snijdt naar een close-up van een wiel, snijdt naar een reflectie in een helm en eindigt daarna met een logo en vuurwerk, allemaal in 5 seconden, snelle camera, perfect geluid.
Wat er mis is: Deze prompt gaat in tegen Tip 1, Tip 3, Tip 4 en Tip 5. Hij is te lang, stapelt handelingen, voegt schijnbare uitsluitingen toe door overladen formuleringen en gebruikt “snel” voor te veel bewegende elementen. Het model kan energie genereren, maar kan de scène niet netjes afronden.
Verbeterde prompt:
Videoprompt: Een downhill-longboarder leunt een bocht in op een door regen gladde bergweg, met diep gebogen knieën en de achterste hand enkele inches boven het asfalt. Elk wiel werpt een dunne waterspray naar buiten terwijl reflectoren langs de weg uitrekken tot zachte strepen op de achtergrond. De camera blijft laag naast het board in één stabiel volgshot. Helm en jas blijven stabiel. Audio: zoemende wielen, gesis van de natte weg, winddruk, één carvebeweging van het board.
Een direct te kopiëren sjabloon voor AI-videoprompts
Gebruik deze structuur wanneer je een heldere eerste poging wilt:
Videoprompt: [Onderwerp] + [één handeling] + [locatie]. [Eén camerabeweging] + [specifieke stijl, lens, belichting of compositie]. [Positieve beperkingen: wat stabiel moet blijven, wat afwezig moet zijn en of audio nodig is].
Voorbeeld:
Videoprompt: Een keramische koffiekop staat op een donkere houten tafel terwijl stoom in langzame krullen opstijgt. Langzame macrobeweging naar voren, warm wolfraamlicht van opzij, geringe scherptediepte, rustige achtergrond van een ochtendcafé. De vorm van de kop blijft stabiel, geen tekst over het beeld, audio bevat zacht omgevingsgeluid en een licht tikje van een lepel.
Belangrijkste les
Betere AI-videoprompts zijn niet langer. Ze zijn helderder. Zet het onderwerp, de actie en de locatie voorop. Vervang ‘cinematisch’ en algemene kwaliteitswoorden door specifieke visuele aanwijzingen. Gebruik één camerabeweging. Vermijd onechte negatieve prompts. Vervang ‘snel’ door details over de fysieke beweging. Beschrijf bij beeld-naar-video de referentieafbeelding niet opnieuw.
Deze verbeteringen werken bij de meeste huidige AI-videogeneratoren, omdat ze gedeelde zwakke punten van videogeneratie aanpakken: afwijkingen in de loop van de tijd, vage stijlkeuzes, cameratrillingen, inconsistentie van het onderwerp en overbelaste beweging. PixVerse is hierbij handig, omdat makers dezelfde prompt kunnen vergelijken met Seedance 2.0, HappyHorse 1.0, PixVerse V6, PixVerse C1, Kling O3 en Kling 3.0 zonder de workflow in afzonderlijke tools opnieuw op te bouwen.
FAQ
Wat is een goede AI-videoprompt?
Een goede AI-videoprompt geeft het model een duidelijk shot: onderwerp, actie, locatie, één camerabeweging, zichtbare stijlaanwijzingen en enkele positief geformuleerde randvoorwaarden. ‘Een glazen parfumfles op zwart marmer, langzame presentatiedraai, warm randlicht, stabiele reflectie’ is sterker dan ‘een cinematische luxe productvideo’.
Hoe lang moet een AI-videoprompt zijn?
Voor veel tekst-naar-videoprompts is 50 tot 80 woorden een bruikbaar uitgangspunt. Zet het onderwerp, de actie en de locatie voorop en voeg daarna camerabeweging, belichting, bewegingsdetails en audio toe. Als de eerste zin vaag is, zorgen meer woorden meestal voor minder controle.
Waarom werkt ‘cinematisch’ niet goed in AI-videoprompts?
‘Cinematisch’ is te breed voor betrouwbare prompts voor AI-videogeneratoren. Gebruik in plaats daarvan concrete filmische beeldtaal, zoals ‘35mm-uitstraling met een camera uit de hand’, ‘regenachtige steeg met neonreflecties’, ‘langzame dollybeweging naar voren’, ‘hard tegenlicht’ of ‘warme lichtbronnen in beeld op de achtergrond’.
Ondersteunen AI-videogeneratoren negatieve prompts?
Sommige tools hebben een apart veld voor negatieve prompts, maar een normaal videopromptveld leest doorgaans alle tekst als instructie. Schrijf in plaats van een lijst met fouten positief geformuleerde randvoorwaarden: ‘handen blijven natuurlijk’, ‘camera blijft stabiel’, ‘achtergrond blijft leeg’ of ‘productsilhouet blijft intact’.
Hoe schrijf ik een beeld-naar-videoprompt zonder het onderwerp te veranderen?
Beschrijf bij beeld-naar-videoprompts de geüploade afbeelding niet opnieuw. Gebruik de prompt voor beweging, cameragedrag, veranderingen in belichting, audio en stabiliteitsregels: ‘Houd het referentieobject intact. Voeg een rustige camerabeweging naar voren toe. Behoud het silhouet, het materiaal, de achtergrond en de compositie.’
Welke AI-videogenerator moet ik gebruiken om prompts te testen?
Voor dit artikel werd bij alle zeven tests dezelfde generatieconfiguratie in PixVerse gebruikt. Dezelfde tips voor AI-videoprompts zijn toepasbaar op de meeste huidige generatoren, omdat ze gedeelde problemen aanpakken: vage stijlkeuzes, afwijkingen in de loop van de tijd, cameratrillingen, overbelaste beweging en inconsistentie ten opzichte van de referentieafbeelding.
Welke voorbeelden van AI-videoprompts zijn nuttig om te testen?
Bruikbare voorbeelden van AI-videoprompts testen één vaardigheid tegelijk: een productdraai voor bewegingsprecisie, een regenachtige steeg voor stijlcontrole, één volgshot voor camerastabiliteit en een prompt met een referentieobject voor consistentie van het onderwerp. Beoordeel het resultaat op het volgen van de prompt, bewegingscontrole, samenhang door de tijd heen, gereedheid van de audio en bruikbaarheid voor productie.