Áudio para texto
Transcreva entrevistas, podcasts, aulas e notas de voz no navegador. Edite o texto e exporte TXT, SRT ou VTT.
Escolha o idioma falado na gravação, independentemente do idioma da página.
O primeiro uso exige internet para baixar o modelo Whisper do Hugging Face e os componentes de IA de jsDelivr CDNs externos. O navegador pode guardá-los no cache. Mantenha a aba aberta; a velocidade depende do dispositivo.
O áudio e a transcrição ficam no seu dispositivo; não são enviados.
O primeiro uso exige internet para baixar o modelo Whisper do Hugging Face e os componentes de IA de jsDelivr CDNs externos. O navegador pode guardá-los no cache. Mantenha a aba aberta; a velocidade depende do dispositivo.
Revise o resultado: a precisão não é garantida. A identificação de falantes não é suportada. Esta ferramenta não traduz, resume nem separa falantes.
Transcreva uma gravação em três passos
- 1
Escolher áudio
Escolha no seu dispositivo uma gravação com fala clara.
- 2
Transcrever áudio
Escolha o idioma da gravação e inicie a transcrição local.
- 3
Baixar TXT
Revise e edite o texto, depois copie ou baixe.
Usos da transcrição
- Transformar uma entrevista gravada em texto pesquisável.
- Preparar transcrições de podcasts para edição e acessibilidade.
- Revisar aulas gravadas ou transformar notas de voz em anotações.
Perguntas frequentes
Minha gravação é enviada?
O áudio e a transcrição ficam no seu dispositivo; não são enviados. O primeiro uso exige internet para baixar o modelo Whisper do Hugging Face e os componentes de IA de jsDelivr CDNs externos. O navegador pode guardá-los no cache. Mantenha a aba aberta; a velocidade depende do dispositivo.
Quais gravações de áudio posso transcrever?
Um arquivo de áudio, de até 100 MiB e 5 minutos. Formatos suportados: MP3, M4A, WAV, AAC, OGG, OGA, Opus, FLAC, WebM, WebA.
Qual idioma devo escolher?
Escolha o idioma falado na gravação, independentemente do idioma da página.
A transcrição é precisa?
Revise o resultado: a precisão não é garantida. A identificação de falantes não é suportada. Esta ferramenta não traduz, resume nem separa falantes.