Áudio e vídeo para texto e resumo — transcrição automática de fala, extração de pontos-chave e limpeza de fala

📂

Ou selecione um arquivo de áudio / vídeo (OGG, MP3, WAV, FLAC, M4A, MP4, WebM)

Palestras, reuniões ou gravações de voz são processadas diretamente no seu dispositivo.

A primeira transcrição baixa o modelo Whisper off-line selecionado uma vez e depois é armazenado em cache. Seu arquivo nunca sai do seu dispositivo.

📖 Vocabulário de termos e nomes específicos (opcional)

Sem ele, nomes raros, títulos e termos profissionais são reconhecidos como palavras cotidianas semelhantes: o nome de um colega se divide em duas palavras comuns, uma marca se transforma em um substantivo aleatório, um termo de palestra em um absurdo familiar. Liste essas palavras aqui, separadas por vírgulas, e o modelo as reconhecerá com mais precisão. O resto do discurso não é afetado: nada é descartado ou forçado a corresponder à lista.

Configuração rápida:

20–30 palavras funcionam melhor do que uma lista longa: o modelo lê apenas o início do prompt e descarta o resto.

É grátis para usar?

Sim, totalmente grátis e sem cadastro. A ferramenta roda inteiramente no seu navegador: o arquivo nunca vai para um servidor, então o servidor não gasta nem CPU nem tráfego — não há nada a cobrar. Sem marcas d’água, sem limites de tamanho ou de quantidade de arquivos.