En VTT-fil (Web Video Text Tracks-fil) er et almindeligt tekstformat, der bruges til at vise tidsstyret tekst – såsom undertekster, billedtekster og kapitelmarkører – synkroniseret med HTML5-video- og lydindhold. Udviklet som en W3C-webstandard, VTT-filer tilbyder avancerede funktioner som tekstformatering, identifikation af talere og præcis placering, hvilket gør dem til det foretrukne format til webbaserede videoer.
VTT-filer følger en bestemt struktur, som browsere og videoafspillere kan fortolke. Hver VTT-fil indeholder følgende hovedkomponenter:
Sådan ser en almindelig VTT-fil ud:
WEBVTT
00:00:01,000 –> 00:00:04,500
Velkommen til dagens præsentation
om bedste praksis inden for transskription.
00:00:05,000 –> 00:00:08,750
Vi tager os af alt, hvad du har brug for
at lære om billedtekstformater.
Bemærk, at VTT-tidsstempler bruger punkter før millisekunder (00:00:01.000), mens SRT-filer bruger kommaer. Denne lille forskel har betydning – hvis du bruger det forkerte skilletegn, vil det ødelægge dine undertekster.
Det, der adskiller VTT fra enklere formater, er dets understøttelse af avanceret formatering:
Disse funktioner gør VTT-filer særligt værdifulde til tilgængeligt webindhold hvor lydbehandlingen og højttalerens klarhed forbedrer forståelsen.
VTT-filer er almindelig tekst, så du har flere muligheder for at se og redigere dem:
Teksteditorer: Enhver almindelig teksteditor (Notepad, TextEdit, VS Code) kan åbne VTT-filer. Du vil se den rå tekst og tidsstemplerne, hvilket gør det nemt at foretage hurtige rettelser.
Medieafspillere: VLC og de fleste moderne videoafspillere viser VTT-undertekster, når filen har samme navn som din videofil. Du skal blot placere begge filer i samme mappe.
Webbrowsere: Da VTT er det indbyggede HTML5-format til undertekster, gengiver browsere disse filer problemfrit ved hjælp af
Undertekstredaktører: Der findes særlige værktøjer, der sikrer synkroniseret afspilning sammen med underteksterne, så du kan justere timingen, mens du ser videoen.
Der er to primære måder at oprette VTT-filer på:
Manuel oprettelse: Åbn et tekstredigeringsprogram, tilføj overskriften “WEBVTT”, og skriv derefter dine undertekster med præcise tidsstempler. Denne fremgangsmåde fungerer for korte klip, men bliver upraktisk for længere indhold – en video på en time kan indeholde hundredvis af individuelle undertekstlinjer.
Automatisk generering: Software til transskription analyserer din lyd eller video og genererer automatisk VTT-filer med tidskoder. Moderne AI-transskription håndterer identifikation af talere og opnår en høj nøjagtighed, hvilket gør denne metode til standarden for fagfolk, der håndterer store mængder videomateriale. Platforme som Sonix kombinere automatiseret transskription med generering af VTT-filer, hvor både identifikation af talere og tidskodning håndteres samtidigt.
For tv-produktionsselskaber, advokatfirmaer, der behandler vidneforklaringer, eller uddannelsesinstitutioner, der undertekster forelæsningsarkiver, forvandler automatiseret generering af VTT det, der før tog flere dage, til en strømlinet arbejdsgang.
Selvom VTT har visse tekniske fordele, vil du ofte have brug for begge formater. Store sociale platforme som LinkedIn og X (Twitter) accepterer kun SRT-filer, mens din hjemmesides HTML5-afspiller kræver VTT.
Selve konverteringen er ganske enkel – de væsentligste forskelle er:
VTT-format:
SRT-format:
I stedet for manuelt at vedligeholde separate filer, Automatiserede værktøjer til undertekster kan eksportere begge formater fra ét enkelt kildetranskript. Dette sikrer ensartethed på tværs af platforme og sparer samtidig for dobbeltarbejde.
Selv de bedste automatisk genererede undertekster har gavn af en manuel gennemgang. Når du redigerer VTT-filer, skal du fokusere på:
Justering af tidsindstillinger: Sørg for, at underteksterne vises lidt før ordene udtales og forsvinder kort efter. Sørg for, at læsehastighed for billedtekster holder sig under 160–180 ord pr. minut for at sikre en behagelig læseoplevelse.
Tekstnøjagtighed: Et enkelt forkert ord kan ændre betydningen fuldstændigt – hvis ”nu” bliver til “ikke”, vender budskabet på hovedet. Sammenlign de automatisk genererede undertekster med den faktiske lyd.
Højttaleretiketter: Ved interviews, vidneforklaringer eller paneldebatter gør en tydelig angivelse af, hvem der taler, det lettere for seerne at følge med i samtalen.
Linjeskift: Begræns hver billedtekst til højst to linjer med ca. 42 tegn pr. linje for at sikre god læsbarhed på alle enheder.
I professionelle arbejdsgange anvendes der ofte browserbaserede redigeringsværktøjer, der synkroniserer undertekstteksten med videoafspilningen, så man kan opdage problemer med timingen og foretage rettelser, mens man ser videoen.
VTT-filer har to funktioner, der bliver stadig vigtigere ud over den grundlæggende undertekstning:
Overholdelse af tilgængelighed: Den WCAG-retningslinjer Det anbefales at bruge undertekster til videoindhold, og lovgivning som ADA og Section 508 kræver dette i mange sammenhænge. Den europæiske tilgængelighedslov, hvor fristen for overholdelse er den 28. juni 2025, stiller krav om tilgængelige videoer inden for EU’s e-handel. VTT’s støtte til beskrivende lyd og detaljeret identifikation af talere bidrager til at opfylde disse krav.
Synlighed i søgeresultaterne: Søgemaskiner kan ikke se dine videoer, men de kan læse dine undertekstfiler. Da videoer spiller en stadig større rolle i søgeresultaterne, gør VTT-filer det muligt at finde dit talte indhold. For forskere, der analyserer interviewoptagelser, juridiske teams, der gennemsøger arkiver med vidneforklaringer, eller marketingfolk, der ønsker at maksimere indholdets rækkevidde, forvandler VTT-filer videoen fra en lukket kasse til søgbar og indekserbar tekst.
VTT-filer understøtter tekstformatering, placering, talermærker og CSS-tilpasning, mens SRT-filer kun indeholder almindelig tekst med tidsstempler. VTT bruger punkter til millisekunder (00:00:01.000), mens SRT bruger kommaer (00:00:01,000). VTT er den webbaserede standard for HTML5-video; SRT har bredere kompatibilitet med ældre systemer.
Ja. Den vigtigste del af konverteringen består i at ændre kommaer til punkter og tilføje “WEBVTT”-overskriften. Mange transskriptionsplatforme eksporterer begge formater samtidigt, hvilket eliminerer behovet for manuel konvertering.
Absolut. Søgemaskiner indekserer undertekst, hvilket gør det talte indhold i din video søgbart. Videoer med undertekster har en tendens til at rangere bedre og vises oftere i søgeresultaterne, fordi indholdet bliver læsbart for søgerobotter.
Alle de store browsere – Chrome, Firefox, Safari og Edge – har understøttet VTT-filer siden 2015. Formatet fungerer via HTML5-elementet
Indsæt et
Model Context Protocol ændrer den måde, hvorpå AI-assistenter forbinder sig til eksterne værktøjer og podcasts…
Retsreferenter, der hver måned skal håndtere snesevis af vidneforklaringer, står over for et nyt spørgsmål: Hvordan kan AI-assistenter…
Din AI-assistent er smart. Dine mødeoptagelser er fulde af indsigter. Men at få dem…
Du har 80 timers interviewoptagelser, en deadline, der nærmer sig, og en AI-assistent, som du…
Kan du huske dengang, hvor man for at analysere en podcast var nødt til at kopiere dele af transskriptionen ind i ChatGPT og gentage processen…
Tidligere var det nødvendigt at jonglere med flere forskellige værktøjer for at finde den rigtige transskriptionsløsning til HR og rekruttering…
Denne hjemmeside bruger cookies.