Problemas de transcrição de áudio

Quando transcrições são imprecisas, estão faltando ou o trabalho falha — veja como corrigir.

21 de mai. de 2026

O Vulgate transcreve uploads de áudio usando modelos de conversão de fala para texto de alta qualidade. A grande maioria dos arquivos retorna com transcrições utilizáveis, mas alguns problemas comuns aparecem — este artigo os cobre.

O trabalho termina em erro

Abra Uploads → Processamento na barra lateral e clique na linha que falhou para ver o motivo específico. Os mais comuns são:

  • Formato não suportado — Converta com ffmpeg para MP3 ou WAV e reenvie. Aceitamos MP3, M4A, AAC, WAV, FLAC, OGG, Opus e containers de vídeo comuns (a faixa de áudio é transcrita).
  • Arquivo silencioso — Um arquivo com menos de alguns segundos de conteúdo audível não pode ser transcrito. Confirme que o arquivo reproduz de forma audível no seu player local.
  • Arquivo muito longo — Arquivos longos podem expirar. Divida com ffmpeg:
    ffmpeg -i input.mp3 -f segment -segment_time 3600 -c copy chunk_%03d.mp3
    
    Depois envie cada parte individualmente.
  • Limite de gastos excedido — Os créditos de ingestão do seu plano para o mês acabaram. Faça upgrade ou aguarde até o próximo ciclo.

Para outras mensagens de falha, copie o texto exato e envie um email para info@vulgate.ai com o ID do Trabalho.

A transcrição está imprecisa

A qualidade da transcrição é principalmente uma função da qualidade da entrada:

  • Ruído de fundo. Cafés, multidões, zumbido de ar-condicionado ou vento degradam seriamente a precisão. Grave novamente em um ambiente mais silencioso, se possível.
  • Múltiplos oradores sobrepostos. O Vulgate detecta turnos de fala, mas falas sobrepostas frequentemente se misturam. Gravar cada orador separadamente em sua própria faixa e enviar separadamente produz resultados dramaticamente melhores.
  • Taxa de amostragem baixa. Arquivos amostrados a 8 kHz (áudio de telefone antigo, alguns VoIP) apresentam mais erros do que 16 kHz ou superior.
  • Sotaques ou dialetos fortes. A maioria dos dialetos principais é bem suportada, mas sotaques regionais muito fortes podem produzir transcrições literais-mas-erradas ("council" → "consul").
  • Vocabulário especializado. Termos teológicos, jurídicos ou científicos podem ser transcritos foneticamente.

Áudio em múltiplos idiomas

Se uma gravação alterna entre idiomas (por exemplo, um sermão em italiano com passagens litúrgicas em latim), a transcrição seguirá o idioma dominante e tropeçará no secundário. Melhor prática: divida o arquivo nos limites de idioma antes de enviar, mesmo que sejam apenas dois arquivos.

Quando entrar em contato conosco

Envie um email para info@vulgate.ai com o ID do Trabalho se:

  • Você receber uma mensagem de falha não coberta acima.
  • A qualidade da transcrição for dramaticamente pior do que o esperado em um arquivo que você verificou estar limpo.
  • O mesmo arquivo falhar repetidamente apesar de estar bem dentro dos limites de tamanho e formato.

Relacionados

Pesquisar ajuda