Ljud till text
Transkribera intervjuer, poddar, föreläsningar och röstmemon i webbläsaren. Redigera texten och exportera TXT, SRT eller VTT.
Välj språket som talas i inspelningen, oberoende av sidans språk.
Första användningen kräver internet för att hämta Whisper-modellen från Hugging Face och AI-komponenter från externa jsDelivr CDN:er. Webbläsaren kan cachelagra dem. Håll fliken öppen; hastigheten beror på enheten.
Ljudet och transkriptionen stannar på enheten och laddas inte upp.
Första användningen kräver internet för att hämta Whisper-modellen från Hugging Face och AI-komponenter från externa jsDelivr CDN:er. Webbläsaren kan cachelagra dem. Håll fliken öppen; hastigheten beror på enheten.
Granska resultatet: noggrannhet garanteras inte. Identifiering av talare stöds inte. Verktyget översätter inte, sammanfattar inte och skiljer inte mellan talare.
Transkribera en inspelning i tre steg
- 1
Välj ljud
Välj en inspelning med tydligt tal från enheten.
- 2
Transkribera ljud
Välj språket i inspelningen och starta lokal transkribering.
- 3
Ladda ned TXT
Granska och redigera texten, kopiera eller ladda sedan ned den.
Användning av transkriptionen
- Gör intervjuinspelningar till sökbar text.
- Förbered poddtranskriptioner för redigering och tillgänglighet.
- Gå igenom föreläsningar eller gör röstmemon till anteckningar.
Vanliga frågor
Laddas min ljudinspelning upp?
Ljudet och transkriptionen stannar på enheten och laddas inte upp. Första användningen kräver internet för att hämta Whisper-modellen från Hugging Face och AI-komponenter från externa jsDelivr CDN:er. Webbläsaren kan cachelagra dem. Håll fliken öppen; hastigheten beror på enheten.
Vilka ljudinspelningar kan jag transkribera?
En ljudfil, upp till 100 MiB och 5 minuter. Format som stöds: MP3, M4A, WAV, AAC, OGG, OGA, Opus, FLAC, WebM, WebA.
Vilket språk ska jag välja?
Välj språket som talas i inspelningen, oberoende av sidans språk.
Hur exakt är transkriptionen?
Granska resultatet: noggrannhet garanteras inte. Identifiering av talare stöds inte. Verktyget översätter inte, sammanfattar inte och skiljer inte mellan talare.