---
title: "Video till SRT: Gratis, privat undertextgenerator | Yaps"
description: "Video till SRT, gratis och i din webbläsare. Släpp in en MP4 och få en tidsinställd .srt eller .vtt tillbaka, med varje cue som kan redigeras. Ingenting laddas upp och det finns inget storlekstak."
canonical: "https://www.yaps.ai/sv/verktyg/undertextgenerator"
language: "sv-SE"
---

[Gratis verktyg](/sv/verktyg)Av Yaps

# Video till SRT, utan upload.

Släpp in en video eller en ljudfil och få en tidsinställd SRT eller VTT tillbaka. Inget konto, ingen filstorleksbegränsning och filen lämnar aldrig din dator.

Körs på din maskin · Ingenting laddas upp

Startar upp undertextmotorn

Släpp en video- eller ljudfil

MP4, MOV, MP3, WAV, M4A – valfri längd

SRT och VTT Inget laddat upp Varje cue kan redigeras

## Om detta verktyg

## Hur man konverterar en video till SRT utan att ladda upp den

Välj en fil, vänta, ladda ner .srt. Den enda ovanliga delen är var arbetet sker. De flesta video till SRT omvandlare skickar din fil till en server, lägger den i en kö och skickar en länk till dig via e-post när den är klar. Den här laddar en talmodell i din webbläsarflik och kör den på din egen maskin, så filen läses från din disk och lämnar den aldrig.

Den första körningen laddar ner modellen, ungefär 80MB. Det är en engångskostnad. Din webbläsare cachar den, så nästa fil du släpper börjar transkribera direkt. Om din webbläsare stöder WebGPU, vilket Chrome och Edge gör på de senaste datorerna, körs modellen på ditt grafikkort och är mycket snabbare. Om inte, faller den tillbaka till WebAssembly på CPU, som är långsammare men fungerar överallt.

Eftersom vi inte betalar för servertid finns det inget filstorlekstak, inget längdtak, ingen kö och ingen daglig gräns. En två timmars inspelning är bra. Det kommer att ta ett tag på en äldre bärbar dator, och fliken måste vara öppen medan den fungerar, men ingenting avbryter dig efter tio minuter.

## MP4 till SRT, MOV till SRT, MP3 till SRT: vad du kan besöka

Släpp in en MP4 och din webbläsare läser ljudspåret ur den, vilket är allt talmodellen behöver.Detsamma gäller MOV-, WebM- och MKV-filer vars ljudcodec din webbläsare kan avkoda.Ljudfiler går direkt in: MP3 , WAV , M4A, FLAC och OGG fungerar alla, så mp3 till SRT och ljud till SRT är samma två klick som video till SRT .

Det finns en ärlig hake. Avkodningen görs av din webbläsare snarare än av oss, så en fil med en ovanlig ljudcodec kan misslyckas med att öppnas trots att den spelar bra i VLC. Om det händer, exportera ljudet som en MP3 eller en WAV med valfri redigerare och släpp in det istället. Tiderna stämmer fortfarande överens med originalvideon, så länge du inte har trimmat eller flyttat ljudet.

Endast ljudfiler beter sig på exakt samma sätt. Du får samma signaler och samma .srt, bara utan någon bild i förhandsgranskningspanelen ovanför cue-listan.

## SRT eller VTT: vilken undertextfil behöver du egentligen?

SRT och VTT har samma sak, en numrerad lista med ledtrådar med en starttid, en sluttid och lite text. De skiljer sig åt i skiljetecken och i vem som förväntar sig dem.

SRT är standard. YouTube, Vimeo, LinkedIn, Premiere Pro, Final Cut och DaVinci Resolve tar alla en .srt utan klagomål, och det gör de flesta sociala plattformar också. Om du inte är säker på vilken du behöver, ta SRT.

VTT, ibland skrivet WebVTT, är webbstandarden. Det är vad ett HTML5-spårelement förväntar sig, så det är rätt val om videon går på din egen sida eller till en spelare som Video.js eller Plyr. Den börjar med ett WEBVTT-huvud och använder ett punkt i stället för ett kommatecken före millisekunderna.

Den här sidan exporterar båda från samma ledtrådar, plus en vanlig transkription med tiderna bortskalade om du bara vill ha orden för showanteckningar eller ett blogginlägg. Att ladda ner en hindrar dig inte från att ladda ner de andra, så om en plattform avvisar ett format kan du ta tag i det andra utan att köra filen igen.

## Varför tidsstämplar på ordnivå ger bättre undertexter

De flesta gratis SRT-generatorer använder undertexter på chunknivå.Modellen lämnar tillbaka ett textblock med en början och ett slut, och verktyget hackar det blocket efter antal tecken.Resultatet läser dåligt.En cue ändras mitt i en fras, ett ord strandar på en egen rad och texten glider en halv sekund bort från talet.

Det här verktyget frågar modellen om tidsstämplar på ordnivå, så att det vet när varje enskilt ord sades. Kedjor bryts sedan där högtalaren faktiskt pausar, och var och en är begränsad till cirka 84 tecken eller sex sekunder, så ingenting sitter på skärmen för länge för att vara snyggt eller för kort för att kunna läsas.

Det betyder också inga föräldralösa fragment. En cue som skulle lämna ett eller två ord dinglande balanseras istället mot sin granne. I praktiken ägnar du din tid åt att fixa det udda felhörda namnet snarare än att ändra tid på hela filen, och omtiming är den del av undertextning som äter en eftermiddag.

## Redigera varje cue innan du exporterar filen SRT

Talmodeller får fel namn, jargong och akronymer. Var och en av dem gör det, betald eller gratis, så den verkliga frågan är inte om du behöver fixa något utan hur irriterande fixningen är.

Varje ledtråd på den här sidan är ett textfält. Klicka på det, korrigera ordet och exporten tar ändringen. Tider är orörda av en redigering, så att fixa en stavning kan inte slå filen ur synk.

Ovanför kölistan finns en liveförhandsvisning. Videon spelas upp med bildtexten ritad över den där en tittare skulle se den, och cue-listan följer spelhuvudet så att du kan titta och läsa på en gång. Klicka på valfri tidskod för att hoppa spelaren till det ögonblicket. Om du bläddrar eller börjar skriva, följer automatiskt stegen åt sidan för ett ögonblick istället för att dra raden du läste upp under dig.

När det ser rätt ut laddar du ner .srt eller .vtt. Det du redigerade är vad du får.

## En gratis SRT generator utan registrering, ingen vattenstämpel och ingen storleksgräns

Det finns inget konto, ingen e-postvägg och ingen vattenstämpel. Du loggar inte in för att ladda ner filen, och filen är inte stämplad med vårt namn. Ingenting på den här sidan hålls tillbaka bakom en betalnivå.

Det är inte generositet, det är aritmetik. Undertexttjänster på serversidan betalar för GPU-tid per minut av din video, så de måste mäta dig: tio gratisminuter, en registrering för mer, en vattenstämpel för att annonsera. Eftersom modellen körs i din webbläsare på din hårdvara kostar en tvåtimmarsfil oss precis vad en tvåminutersfil kostar, vilket är ingenting. Det finns inget att mäta.

Handlingen är att arbetet sker på din maskin. En lång fil på en gammal bärbar dator tar längre tid än på någon annans serverfarm, och fliken måste vara öppen tills den är klar. För de flesta är det ett rimligt byte mot en fil som aldrig lämnar byggnaden och ett verktyg som aldrig ber om ett kort.

## Vad detta inte kan göra: det gör en undertextfil, inte en textad video

Detta verktyg producerar en undertextfil. Det går inte att bränna bildtexter i videon. Det är en verklig gräns och värt att säga rent ut, eftersom många sidor som rankas för dessa sökningar i tysthet betyder det andra.

En undertextfil finns bredvid din video. Du laddar upp .srt-filen till YouTube, eller drar den till din editor, och spelaren ritar texten. Det är det rätta svaret för YouTube, för tillgänglighet och överallt där en tittare kan slå på och av textning. Det är fel svar för sociala flöden som autospelar tyst, där orden måste vara en del av bilden.

För det har skrivbordsappen Yaps automatisk textning. Den använder ordtiming på samma sätt som den här sidan gör, men renderar formaterade, ord för ord bildtexter till en ny MP4, med typsnitt, färger och position du väljer. Samma tillvägagångssätt på enheten, fortfarande ingenting laddat upp. Om det du ville ha var en textad video snarare än en bildtextfil, är det verktyget för jobbet.

## Hur man använder undertextgenerator i din webbläsare

1. ### Öppna undertextgeneratorn

Gå till yaps.ai/tools/subtitle-generator i Chrome, Edge, Safari eller Firefox. Talmodellen börjar laddas ner i bakgrunden medan du hittar din fil, så den första körningen går snabbare än den ser ut. Inget att installera och inget konto att skapa.
2. ### Släpp in din video- eller ljudfil

Dra en MP4, MOV, MP3, WAV eller M4A till släppzonen, eller klicka för att söka efter den. Filen läses direkt från din disk. Det finns inget uppladdningssteg, ingen storleksbegränsning och ingen kö.
3. ### Vänta på signalerna

Verktyget avkodar ljudet, kör talmodellen och gånger varje ord. Kedjor bryts sedan där talaren pausar och balanseras så att ingen rad lämnas med ett bortsprunget ord. Längre filer tar längre tid, så låt fliken vara öppen medan den fungerar.
4. ### Kontrollera timingen i förhandsvisningen

Spela upp videon med bildtexten överlagd. Cue-listan följer spelhuvudet, så att du kan läsa med och se allt som landar tidigt eller sent. Klicka på valfri tidskod för att hoppa spelaren till det ögonblicket.
5. ### Åtgärda fel ord

Varje cue är ett redigerbart fält. Korrigera ett misshört namn eller en akronym och exporten hämtar ändringen. Att redigera texten flyttar aldrig tidpunkterna, så ingenting går ur synk.
6. ### Ladda ner .srt eller .vtt

Exportera SRT för YouTube, Vimeo och de flesta redigerare, eller VTT för en HTML5-spelare på din egen webbplats. En vanlig utskrift utan tider är också tillgänglig, och du kan ta alla tre.

## Frågor

**Har min video laddats upp någonstans?**

Nej. Talmodellen körs i din webbläsarflik, så filen läses från din disk och skickas aldrig till en server. Det är också därför det inte finns någon filstorlek och ingen kö: vi betalar inte för att bearbeta det.

**Är det verkligen gratis, och vad är haken?**

Det är gratis utan konto, ingen e-post och ingen vattenstämpel. Haken är ärlig och liten: arbetet körs på din dator, så en lång fil på en äldre dator tar längre tid än på en betaltjänst, och fliken måste vara öppen tills den är klar.

**Finns det en filstorlek eller längdgräns?**

Nej. Ingenting laddas upp, så det finns inget uppladdningstak och ingen minutkostnad att mäta. En två timmars inspelning kommer att fungera. Det tar helt enkelt längre tid än två minuter och din webbläsare behöver tillräckligt med minne för att hålla det avkodade ljudet.

**Kan jag konvertera en MP4 till SRT?**

Ja. Släpp MP4 och webbläsaren läser ljudspåret ur det. MOV, WebM och MKV fungerar vanligtvis också, liksom MP3, WAV, M4A, FLAC och OGG. Om en fil inte öppnas fungerar det alltid att exportera ljudet som en MP3 först.

**Vad är skillnaden mellan SRT och VTT?**

De har samma signaler. SRT är det format som stöds mest och är vad YouTube, Vimeo, Premiere och de flesta sociala plattformar förväntar sig. VTT, eller webbenVTT, är webbstandarden som används av HTML5-spelare. Båda erbjuds här, genererade från samma tidpunkter.

**Kan den bränna undertexterna i videon?**

Inte i webbläsaren. Den här sidan ger dig en undertextfil att ladda upp tillsammans med din video. Yaps-skrivbordsappen har Auto Captions, som renderar ordtidsanpassade, formaterade bildtexter till en ny MP4 för flöden där texten måste vara en del av bilden.

**Hur exakt är det?**

Den använder Whisper, samma modellfamilj bakom de flesta betalda transkriptionstjänster. Tydligt tal kommer fram väldigt bra. Accenter, överhörning, bakgrundsmusik och tekniska namn är svårare, vilket är anledningen till att varje cue förblir redigerbar innan du exporterar.

**Fungerar det på andra språk än engelska?**

Ja. Modellen är flerspråkig och känner av det talade språket automatiskt. Det är en liten modell, så den är starkast på tydlig engelska och gemensamma europeiska språk. Den transkriberar på vilket språk som än talas, den översätts inte.

**Kan jag redigera undertexterna innan jag laddar ner?**

Ja. Varje cue är ett redigerbart textfält och exporten använder vad du än skrev. Redigering av text ändrar inte tidpunkterna, så en stavningskorrigering kan inte pressa filen ur synk. Klicka på valfri tidskod för att hoppa över förhandsvisningen till det ögonblicket.

**Fungerar det offline?**

Första körningen behöver en anslutning för att hämta modellen, cirka 80MB. Efter att din webbläsare har cachelagrat den, körs själva transkriptionen lokalt utan att röra nätverket, även om du fortfarande behöver ladda sidan. För ett helt offline-arbetsflöde kör skrivbordsappen Yaps modellerna på din dator.

**Hur lägger jag till filen SRT på YouTube?**

Öppna videon i YouTube Studio, gå till Undertexter, välj ditt språk, välj sedan Ladda upp fil och välj Med timing. Ladda upp den .srt du laddade ner här. Samma fil släpps direkt in i Premiere, Final Cut eller Resolve som ett bildtextspår.

**Varför är mina signaler korta?**

Kedjor bryts där högtalaren pausar och begränsas till ungefär 84 tecken eller sex sekunder, vilket är det intervall som de flesta spelare och plattformar visar bekvämt. Korta signaler är avsiktliga. De håller texten läsbar och stoppar en rad som hänger på skärmen efter att högtalaren har gått vidare.

## Fler gratis verktyg

[Ljud till text Har du redan en inspelning? Transkribera filen istället.](/sv/verktyg/ljud-till-text) [Filler ordräknare](/sv/verktyg/rakna-utfyllnadsord) [Text till tal Skriv något och hör det läsas tillbaka på 31 språk.](/sv/verktyg/text-till-tal) [Tal till text Prata och se hur det blir till text i din webbläsare.](/sv/verktyg/tal-till-text) [Alla gratisverktyg Varje Yaps webbläsarverktyg, alla körs på din egen maskin.](/sv/verktyg)

Börja japa Mac · Windows · Linux · Android

## Lägg dem nu på videon.

Ordtidsanpassade, formaterade bildtexter renderade direkt till en ny MP4.

[Ladda ner för Mac](https://github.com/richawo/yaps-releases/releases/latest)

Kräver macOS 13.0+ (Apple Silicon rekommenderas)iOS kommer snart
