Voz para texto (Whisper)
Transcrição de voz gratuita e privada no seu navegador. Transcreva ou traduza áudio e vídeo com o OpenAI Whisper no seu dispositivo, grave pelo microfone e exporte em TXT ou legendas SRT.
🔒 Executa completamente no seu navegador — nada é enviadoReconhecimento de voz Whisper executado no seu dispositivo
Esta ferramenta transforma palavras faladas em texto com o Whisper, o modelo aberto de reconhecimento de voz lançado pela OpenAI. Ao contrário da maioria dos serviços de transcrição online, nada é enviado para um servidor: o áudio é descodificado pelo navegador, reamostrado para 16 kHz mono e entregue ao modelo num Web Worker em segundo plano. A página escolhe o motor mais rápido disponível: WebGPU nas placas gráficas e nos navegadores que o suportam, ou WebAssembly na CPU em todos os outros casos. Na primeira utilização, os pesos do modelo são transferidos do Hugging Face; a partir daí ficam na cache do navegador, pelo que as sessões seguintes arrancam muito mais depressa.
Pode transcrever entrevistas, aulas, podcasts, notas de voz e gravações de reuniões, ou a faixa de áudio de um ficheiro de vídeo. Os clipes curtos podem ser gravados diretamente a partir do microfone. As gravações longas são processadas em janelas sobrepostas de 30 segundos, e a barra de progresso mostra quantas janelas já estão concluídas.
Transcrições, traduções e legendas
Escolha Transcribe para obter o texto no idioma original ou Translate to English para que o Whisper escreva uma versão em inglês de uma fala noutro idioma. A deteção automática ouve os primeiros 30 segundos para identificar o idioma; se a gravação começar com música ou silêncio, selecionar o idioma manualmente dá melhores resultados. Ative os carimbos de tempo para ver quando cada frase foi dita e transfira um ficheiro de legendas SRT que pode carregar em editores de vídeo, no YouTube ou em leitores multimédia.
Dicas para resultados precisos
Um áudio nítido importa mais do que qualquer outra coisa. Grave perto do microfone, evite música de fundo e deixe falar uma pessoa de cada vez. O Whisper base é um modelo compacto, por isso nomes, jargão técnico e sotaques fortes podem precisar de uma rápida correção manual: reveja sempre o texto antes de o publicar. Se o seu dispositivo tiver pouca memória, feche outros separadores pesados antes de transcrever ficheiros longos e mantenha este separador aberto até a transcrição estar concluída.
Como usar
- Adicione o áudioArraste um ficheiro de áudio ou vídeo para a caixa, ou prima «Record from microphone» e fale.
- Escolha o idioma e a tarefaDeixe o idioma em «Auto-detect» ou selecione-o e depois escolha «Transcribe» ou «Translate to English».
- Execute o WhisperPrima «Transcribe». O modelo é transferido uma única vez e depois é executado no seu dispositivo enquanto a barra de progresso enche.
- Exporte o textoAtive os carimbos de tempo se precisar deles e depois copie a transcrição ou transfira-a como .txt ou como legendas .srt.