1. 取り込む内容を選ぶ
リアルタイムで文章を作る場合は、入力する場所へカーソルを置いて認識を開始します。会議や通話では、録音の許可を得たWindows音声ソースを選びます。既存の録音には、対応するWAV、MP3、M4Aファイルを開いてください。
認識や録音をいつ開始・終了するかは自分で管理できます。待機中、認識中、処理中、完了、エラーの状態が明確に表示されるため、アプリの動作を一目で把握できます。
2. 音声処理をPCに任せる
VTA Dictateは音声認識と文字起こしをローカルで実行します。リアルタイム音声入力はアクティブなテキスト欄へ流れ、長い音声は、一時停止、検索、編集、再確認ができる文字起こしになります。
任意の話者ラベルにより、交互に話す声を「話者1」「話者2」などとして分けられます。人物の特定や保存用音声プロファイルの作成は行わず、会話を整理するためのラベルです。
3. 確認、整理、書き出し
文字起こしを記録として使う前に、名前、句読点、分野固有の用語を修正します。短い会議要約を作成し、アクション項目をまとめるか、必要な箇所を文書やチャットへコピーできます。
文字起こしに時間情報があれば、動画エディター、メディアプレーヤー、講座、SNS投稿向けにSRTまたはVTT字幕を書き出せます。最終確認は利用者自身が行ってください。音声認識、話者分離、要約、自動タイミングはすべて、人による短い確認で改善できます。
