Empieza con audio WAV, MP3 o M4A
Usa grabaciones de reuniones, entrevistas, notas de voz, clases, pódcasts u otro audio que tengas permiso para procesar. Una voz clara y una grabación limpia suelen producir una mejor transcripción inicial que los micrófonos lejanos, el ruido de fondo intenso, el audio saturado o varias personas hablando a la vez.
Los archivos largos son más fáciles de gestionar cuando la grabación tiene un nombre descriptivo y una procedencia conocida. Conserva el original hasta haber revisado la transcripción para poder comprobar siempre las palabras importantes.
Transcribe localmente con una estructura útil
El reconocimiento de voz se ejecuta en el equipo con Windows. La transcripción puede incluir códigos de tiempo y etiquetas opcionales de hablante por posición para facilitar la navegación y la revisión de conversaciones con varias personas.
Las etiquetas de hablante describen turnos como Hablante 1 y Hablante 2; no identifican a nadie por su nombre. Añade nombres reales solo después de comprobar quién hablaba y si resulta apropiado identificarlo en el documento.
Corrige una vez y reutiliza el texto de varias formas
Corrige los nombres, los números, la puntuación y la terminología importante en la transcripción editable. Copia un pasaje en un documento, crea notas y tareas pendientes de una reunión o usa los datos de tiempo para preparar subtítulos.
La transcripción automática ofrece un buen primer borrador, pero no sustituye la escucha cuando importan las palabras exactas. Los registros legales, médicos, financieros, disciplinarios y de otras materias con consecuencias importantes requieren una revisión minuciosa comparándolos con el audio original.
