1. Wählen Sie aus, was Sie erfassen möchten
Setzen Sie für Live-Texte den Cursor an die gewünschte Stelle und starten Sie die Erkennung. Wählen Sie für eine Besprechung oder einen Anruf die Windows-Audioquellen aus, die Sie aufzeichnen dürfen. Öffnen Sie bei einer vorhandenen Aufnahme eine unterstützte WAV-, MP3- oder M4A-Datei.
Sie bestimmen, wann die Erkennung oder Aufzeichnung beginnt und endet. Eindeutige Zustände für inaktiv, hört zu, wird verarbeitet, abgeschlossen und Fehler zeigen auf einen Blick, was die App gerade tut.
2. Lassen Sie Ihren PC die Spracharbeit übernehmen
VTA Dictate führt Spracherkennung und Transkription lokal durch. Live-Diktate können direkt in das aktive Textfeld einfließen, während längere Audiodateien zu einem Transkript werden, das Sie anhalten, durchsuchen, bearbeiten und später erneut aufrufen können.
Optionale Sprecherkennzeichnungen trennen abwechselnde Stimmen als Sprecher 1, Sprecher 2 und so weiter. Sie strukturieren ein Gespräch, ohne Personen identifizieren oder gespeicherte Stimmprofile erstellen zu wollen.
3. Prüfen, gestalten und exportieren
Korrigieren Sie Namen, Satzzeichen und Fachbegriffe, bevor Sie ein Transkript als Protokoll verwenden. Erstellen Sie eine kürzere Besprechungszusammenfassung, erfassen Sie Aufgaben oder kopieren Sie ausgewählte Passagen in das Dokument oder den Chat, in dem Sie sie benötigen.
Enthält das Transkript Zeitangaben, exportieren Sie SRT- oder VTT-Untertitel für einen Videoeditor, Mediaplayer, Kurs oder Social-Media-Beitrag. Das Ergebnis muss weiterhin von Ihnen geprüft werden: Spracherkennung, Sprechertrennung, Zusammenfassungen und automatische Zeitangaben profitieren allesamt von einer kurzen menschlichen Kontrolle.
