Carregando…
0%
Enviar áudio
Transcreve um arquivo de áudio já gravado com o mesmo pipeline (transcrição + diarização) da gravação ao vivo. O resultado fica salvo no Histórico.
Arraste um arquivo de áudio aqui ou
wav, mp3, m4a, ogg, webm…
-
Processando…
Selecione uma sessão à esquerda.
Vocabulário customizado
Termos que o modelo tenta acertar com prioridade.
Configurações da sessão
Aplicar reinicia a captura ao vivo com os novos valores.
Passado ao modelo por segmento. "Auto-detect" deixa o modelo identificar — modelos Canary não têm auto-detect e exigem um idioma explícito. Canary-1b só cobre en/de/es/fr; para português use canary-1b-v2, parakeet-tdt-0.6b-v3 ou um modelo whisper.
Troca imediata, sem reiniciar a captura.
Baixar modelo do Hugging Face
Silêncio necessário antes de fechar o segmento de fala.
700ms
Quantos dB acima do ruído ambiente um som precisa estar para contar como fala. Suba se o app estiver captando ruído de fundo; desça se estiver cortando sua voz baixa.
9 dB
Quão confiante o detector de fala precisa estar para abrir um segmento em um arquivo enviado. Suba se ruídos estiverem virando texto ("Obrigado", "Ah não"); desça se fala baixa estiver sendo ignorada. A gravação ao vivo usa o "Corte de ruído" acima.
0.30
Remove offset DC, ruído de baixa frequência (~80 Hz) e normaliza o volume de cada segmento antes da transcrição. Desligue para comparar a precisão com/sem.