Áudio para texto
Transcreva entrevistas, podcasts, aulas e notas de voz no navegador. Edite o texto e exporte TXT, SRT ou VTT.
Escolha o idioma falado na gravação, independentemente do idioma da página.
A primeira utilização exige Internet para descarregar o modelo Whisper do Hugging Face e os componentes de IA de jsDelivr CDNs externos. O navegador pode guardá-los em cache. Mantenha o separador aberto; a velocidade depende do dispositivo.
O áudio e a transcrição ficam no seu dispositivo; não são enviados.
A primeira utilização exige Internet para descarregar o modelo Whisper do Hugging Face e os componentes de IA de jsDelivr CDNs externos. O navegador pode guardá-los em cache. Mantenha o separador aberto; a velocidade depende do dispositivo.
Reveja o resultado: a precisão não é garantida. A identificação de oradores não é suportada. Esta ferramenta não traduz, resume nem separa oradores.
Transcrever uma gravação em três passos
- 1
Escolher áudio
Escolha no seu dispositivo uma gravação com fala clara.
- 2
Transcrever áudio
Escolha o idioma da gravação e inicie a transcrição local.
- 3
Descarregar TXT
Reveja e edite o texto, depois copie ou descarregue.
Utilizações da transcrição
- Transformar uma entrevista gravada em texto pesquisável.
- Preparar transcrições de podcasts para edição e acessibilidade.
- Rever aulas gravadas ou transformar notas de voz em apontamentos.
Perguntas frequentes
A minha gravação é enviada?
O áudio e a transcrição ficam no seu dispositivo; não são enviados. A primeira utilização exige Internet para descarregar o modelo Whisper do Hugging Face e os componentes de IA de jsDelivr CDNs externos. O navegador pode guardá-los em cache. Mantenha o separador aberto; a velocidade depende do dispositivo.
Que gravações de áudio posso transcrever?
Um ficheiro de áudio, até 100 MiB e 5 minutos. Formatos suportados: MP3, M4A, WAV, AAC, OGG, OGA, Opus, FLAC, WebM, WebA.
Que idioma devo escolher?
Escolha o idioma falado na gravação, independentemente do idioma da página.
A transcrição é precisa?
Reveja o resultado: a precisão não é garantida. A identificação de oradores não é suportada. Esta ferramenta não traduz, resume nem separa oradores.