Àudio a text
Transcriu entrevistes, pòdcasts, classes i notes de veu al navegador. Edita el text i exporta TXT, SRT o VTT.
Tria l’idioma parlat a la gravació, independentment de l’idioma de la pàgina.
El primer ús necessita Internet per descarregar el model Whisper de Hugging Face i els components d’IA de jsDelivr CDN externes. El navegador els pot guardar a la memòria cau. Mantén la pestanya oberta; la velocitat depèn del dispositiu.
L’àudio i la transcripció es queden al dispositiu i no es pugen.
El primer ús necessita Internet per descarregar el model Whisper de Hugging Face i els components d’IA de jsDelivr CDN externes. El navegador els pot guardar a la memòria cau. Mantén la pestanya oberta; la velocitat depèn del dispositiu.
Revisa el resultat: la precisió no està garantida. No s’admet la identificació de parlants. Aquesta eina no tradueix, resumeix ni separa parlants.
Transcriu una gravació en tres passos
- 1
Tria àudio
Tria al dispositiu una gravació amb veu clara.
- 2
Transcriu àudio
Selecciona l’idioma de la gravació i inicia la transcripció local.
- 3
Descarrega TXT
Revisa i edita el text, després copia’l o descarrega’l.
Usos de la transcripció
- Converteix entrevistes gravades en text que es pugui cercar.
- Prepara transcripcions de pòdcasts per editar i millorar l’accessibilitat.
- Repassa classes gravades o converteix notes de veu en apunts.
Preguntes freqüents
Es puja la meva gravació d’àudio?
L’àudio i la transcripció es queden al dispositiu i no es pugen. El primer ús necessita Internet per descarregar el model Whisper de Hugging Face i els components d’IA de jsDelivr CDN externes. El navegador els pot guardar a la memòria cau. Mantén la pestanya oberta; la velocitat depèn del dispositiu.
Quines gravacions d’àudio puc transcriure?
Un fitxer d’àudio, fins a 100 MiB i 5 minuts. Formats compatibles: MP3, M4A, WAV, AAC, OGG, OGA, Opus, FLAC, WebM, WebA.
Quin idioma he de triar?
Tria l’idioma parlat a la gravació, independentment de l’idioma de la pàgina.
És precisa la transcripció?
Revisa el resultat: la precisió no està garantida. No s’admet la identificació de parlants. Aquesta eina no tradueix, resumeix ni separa parlants.