Comece com áudio WAV, MP3 ou M4A
Use gravações de reuniões, entrevistas, notas de voz, palestras, podcasts ou outros áudios que você tenha permissão para processar. Fala nítida e gravação limpa costumam gerar uma transcrição inicial melhor do que microfones distantes, muito ruído de fundo, áudio saturado ou várias pessoas falando ao mesmo tempo.
Arquivos longos são mais fáceis de gerenciar quando a gravação tem um nome descritivo e uma origem conhecida. Guarde o original até a revisão da transcrição, para que sempre seja possível conferir trechos importantes.
Transcreva localmente com uma estrutura útil
O reconhecimento de fala é executado no computador Windows. A transcrição pode incluir marcações de tempo e rótulos posicionais opcionais de locutor para facilitar a navegação e a revisão de conversas com várias pessoas.
Os rótulos de locutor indicam turnos, como Locutor 1 e Locutor 2; eles não identificam uma pessoa pelo nome. Acrescente nomes reais somente depois de confirmar quem estava falando e se é apropriado identificá-la no documento.
Corrija uma vez e use o texto de várias formas
Corrija nomes, números, pontuação e termos importantes na transcrição editável. Copie um trecho para um documento, crie notas de reunião e itens de ação ou use os dados de tempo para criar legendas.
A transcrição automática é um bom primeiro rascunho, não um substituto para ouvir o áudio quando a redação exata é importante. Registros jurídicos, médicos, financeiros, disciplinares e outros documentos com consequências relevantes exigem uma revisão cuidadosa com base no áudio original.
