Sådan laver du talking head-videoer med AI (lavt budget)
Tre måder at lave talking-head-stil videoer med AI — prissammenligning, manuskriptskabeloner, billedtekster og udgivelsesspecifikationer til TikTok, Shorts og Reels.

talking head video — Denne guide forklarer emnet med praktiske trin, eksempler og en arbejdsgang, du kan bruge med det samme.
En video med talende hoveder kræver ikke nogen på kamera. AI-voiceover plus stock-visuals og undertekster giver dig en publicerbar video fra en enkelt bærbar computer – den største omkostning, der er tilbage, er din tid. Denne guide gennemfører først tallene på tre måder — on-camera vært, AI-voiceover og AI-avatar — og gennemgår derefter en femtrins arbejdsgang med en scriptskabelon og udgivelsesspecifikationer, som du kan kopiere som de er.
Tre tilgange: Regn tallene først

| TilgangForudgående investeringPer-video produktionHovedulempe | |||
| Vært foran kamera | Lys, mikrofon, træning foran kameraet | Indspilning plus genoptagelser; Tidsomkostning er uforudsigelig | Høj barriere for at komme på kamera; fridage trækker produktionen ned |
| AI voiceover + visuelle elementer | Næsten nul | Manuskript → voiceover → sammensætte visuelle elementer; Kort rørledning | Billeder og billedtekster bærer alt; Et svagt emne falder til jorden |
| AI-avatar | Brugerdefineret ansigts- og stemmeopsætning | Hurtig at generere, men læbesynkronisering og gestus kræver gentagne justeringer | Stiv levering; Seerne kan straks genkende det |
Hvem hver passer til:
- Vært foran kamera: folk, der bygger et personligt brand eller tillidsdrevet indhold (anmeldelser, førstehåndserfaring). Intet kan erstatte tillid ansigt til kameraet.
- AI voiceover + visuelle elementer: Folk, der ikke ønsker at vise deres ansigt og vil teste emner i stort omfang. Den dækker tutorials, opsummeringer og forklaringslignende indhold — og det er fokus i denne guide.
- AI-avatar: konti, der har brug for en fast "vært"-persona og poster meget ofte. Produktionspipelinen er lang; Det anbefales ikke, når man lige er startet.
Den femtrins AI-arbejdsgang for talende hoveder
1. Skriv manuskriptet. Struktur: én hook → tre point → én opfordring til handling. Budgetlængde er ~140–160 ord pr. minut, så en 60-sekunders video varer cirka 140–160 ord; Hvis du er over, så skær et point – skynd dig ikke med tempoet. Skabelonen får sin egen sektion nedenfor.
- Generer voiceoveren. Smid manuskriptet ind i en Tekst-til-tale-værktøj. Nøglen her er ikke at vælge en stemme – det er korrekturlæsning: tilføj tegnsætning, der matcher talte rytme; forskriv alt, som motoren har tendens til at misforstå (homografer som "read" og "live", navne, tal) til en form, den ikke kan få forkert; Lyt hele nummeret igennem, før du eksporterer. Når AI-voiceovers går galt, er det næsten altid fordi ingen korrekturlæste manuskriptet.

- Saml det visuelle. For en video uden kamera kan visuelle elementer opdeles i tre typer: b-roll, tekstkort (nøglepunkter på skærmen) og skærmoptagelser (til tutorials). Brug en Værktøj til ansigtsløs video at matche visuals med manuskriptsektioner – én visuel idé pr. sektion, og aldrig lade et enkelt billede ligge på skærmen i 20 sekunder.
- Tilføj billedtekster. Mange scroller med lyden slukket; En talking-head-video uden undertekster kunne lige så godt ikke eksistere. Kør voiceoveren gennem en Auto-captions værktøj, og så tjekker du linje for linje — egennavne og tal er, hvor fejlene hober sig op. Tre stylingregler: skriv stort nok til at læse, højst to linjer på skærmen, og hold dig fri af platformens UI-zoner (nederst og højre kant). Hvis du hellere vil generere billedteksten først og style den separat, så brug Videoundertekstgenerator.
- Omslag og titel. Vælg en ramme fra den færdige video med reel information i, eksporter den som cover, og tilføj en stor tekstlinje. Lad ikke titlen gentage forsideteksten: forsiden vækker nysgerrigheden, titlen formidler informationen.
En scriptskabelon, du kan kopiere
Skelettet: 1 krog → 3 punkter (hver leder med konklusionen, udvider derefter i 2–3 sætninger) → 1 opfordring til handling.
Et gennemarbejdet eksempel (~60 sekunder, værktøjsvejledningsstil):
Du behøver ikke at lære et komplet redigeringssystem for at lave én video med talende hoved. (krog) Først, manuskriptet: skriv det ordret, læg tempoet på cirka 140 ord i minuttet, og bryd enhver sætning op, du støder på, højt. Så voiceoveren: forskriv ord, som AI'en måske læser forkert, marker pauserne selv — lad den ikke køre igennem et helt afsnit i ét åndedrag. Til sidst, undertekster: mange ser med på lydløs, så ingen undertekster betyder, at videoen lige så godt ikke eksisterer. Tre trin, og du har noget, du kan udgive. Hvilket trin sidder du fast på? Fortæl mig det i kommentarerne. (opfordring til handling)
Byt et nyt emne ind, og dette skelet skalerer til batch-skrivning — men de tre punkter skal være indhold, du selv har filtreret. Skabelonens kontrolstruktur, ikke kvaliteten.
TikTok / Shorts / Reels udgivelsesspecifikationer i et overblik
Specifikationerne nedenfor er platformenes offentliggjorte regler; Varighederne er praktiske forslag:
| Platform Billedformat Varighed Forside | |||
| TikTok | 9:16 (1080×1920) | 45–90 sekunder er et solidt udgangspunkt for talende hoved | Vælg en ramme; Understøttet forsidetekst |
| YouTube Shorts | 9:16 (1080×1920) | Op til 3 minutter distribueres som Shorts — henvist til den officielle side | Udvalgt fra videorammer; Ingen separat billedupload |
| Instagram Reels | 9:16 (1080×1920) | Kortere vinder; Bliv ved med at snakke-hoved under ~90 sekunder | Vælg en ramme, eller upload et vertikalt coverbillede |
En 9:16-eksport kan sendes ud til alle tre platforme — der er ikke behov for separate versioner. De eneste ting, der er værd at håndtere pr. platform, er omslaget og hvordan du skriver titlen.
YouTubes politik for uautentisk indhold: AI-talende hoved kan ikke springe dette over
Siden juli 2025 har YouTubes monetiseringspolitik erstattet "gentagende indhold" med "uautentisk indhold" — rettet direkte mod masseproduceret, skabelonbaseret indhold uden menneskelig kreativ input; Overlad den officielle side for det med småt. Hvad det betyder for AI-talende hoved-videoer: AI-skrevet manuskript, AI-voiceover, AI-sammensatte visuals, udgivet præcis som genereret — ren volumen som det vil sandsynligvis ikke bestå en monetiseringsvurdering.
Bundlinjen er at holde det menneskelige kreative lag i egne hænder: du vælger emnerne, du leverer synsvinklen, du træffer redigeringsbeslutningerne — AI håndterer kun udførelsen. Spil ikke på denne her: at miste indtægter efter kanalen er taget af, koster langt mere end at gøre det rigtigt fra starten. Denne artikel lover heller ikke trafik eller indtægter — politikker og algoritmer ændrer sig; Det menneskelige kreative lag er det eneste, du faktisk kontrollerer.
Er daglig opslag bæredygtigt?
Flaskehalsen i AI-produktionen af talende hoveder er scripting og korrekturlæsning, ikke rendering. Den bæredygtige tilgang er batching: skriv en uges manuskripter på én fast dag, lav voiceovers og visuelle elementer i én batch, og spred korrekturlæsning af billedtekster ud over ugen. Det er langt mere stabilt end at lave hver video fra bunden hver dag, og det er nemmere at holde kvalitetslinjen. I stedet for at jagte en daglig upload, så sæt en rytme, du kan fortsætte med i otte uger i træk.
Hvis du vil gå dybere med fortællingsvideoer, er hele arbejdsgangen med Sådan laver du en filmopsummeringsvideo; For hvordan hele værktøjskæden hænger sammen, se AI-videoredigering forklaret.
FAQ
Vil AI-voiceoveren ikke lyde falsk?
Den robotagtige fornemmelse kommer mest fra dårlig formulering og misforståede ord. Skriv scriptet, som folk faktisk taler, marker pauser i hånden, og forskriv alt, hvad engine gør forkert – det fjerner de fleste af de åbenlyse signaler. Publikum for informativt talende hovedindhold går op i selve informationen; Deres tolerance for stemmen er højere, end man skulle tro.
Kan ansigtsløse videoer med talende hoveder tjene penge på?
Ja, men de skal bestå platformens originalitetsvurdering. Tag YouTube: politikken, der blev opdateret i juli 2025, retter sig mod masseproduceret uautentisk indhold, ikke "indhold, der brugte AI." Hvis et menneske vælger emnerne, leverer synspunktet og træffer redigeringsbeslutningerne, er du stadig inden for reglerne. Se platformens officielle sider for præcise vilkår — denne artikel lover ingen indtægter.
Hvor mange ord bør et 60-sekunders manuskript være?
Med ~140–160 ord i minuttet, cirka 140–160 ord. Det er bedre at lande pointen på 130 ord end at proppe 200 ord ind og skynde tempoet — når leveringen først bliver hurtigere, kan hverken billedteksterne eller publikum følge med.
Skal jeg lave tre separate versioner til de tre platforme?
Nej. En 9:16 vertikal eksport fungerer på alle tre; Det, der skal håndteres pr. platform, er omslaget (reglerne for billedvalg er forskellige) og hvordan du skriver titlen. Udgiv den samme video overalt først, se hvilken platform der tager den op, og tilpas så til den.
Hvad er filgrænserne for at lave talking-head-videoer med Recapo?
Upload direkte fra browseren — almindelige formater som MP4 og MOV understøttes, med op til 6 GB kildemateriale pr. opgave. Voiceover, undertekster, vertikal størrelse og eksport af omslag foregår alle i ét arbejdsområde, så du ikke flytter filer mellem apps.
Hvert trin i denne arbejdsgang — voiceover, undertekster, visuel samling og eksport af omslag — kører fra ende til anden i Recopos browserarbejdsområde, uden installationer. Opret en konto, tag manuskriptet til din næste talking-head-video, og kør de fem trin én gang.
Referencer og officielle kilder
- YouTube Hjælp: Oplys ændret eller syntetisk indhold
- Monetiseringspolitikker for YouTube-kanaler
- YouTube anbefalede upload-kodningsindstillinger


