音声から完成した成果物へ

VTA Dictateの仕組み

その場で話すか、録音済み音声から始めます。VTA Dictateなら、音声から編集可能なテキスト、メモ、字幕までをわかりやすい流れで作成できます。

所要時間4分
Windows PCでデスクトップマイクを使い、ハンズフリーで文章を書く人物

1. 取り込む内容を選ぶ

リアルタイムで文章を作る場合は、入力する場所へカーソルを置いて認識を開始します。会議や通話では、録音の許可を得たWindows音声ソースを選びます。既存の録音には、対応するWAV、MP3、M4Aファイルを開いてください。

認識や録音をいつ開始・終了するかは自分で管理できます。待機中、認識中、処理中、完了、エラーの状態が明確に表示されるため、アプリの動作を一目で把握できます。

2. 音声処理をPCに任せる

VTA Dictateは音声認識と文字起こしをローカルで実行します。リアルタイム音声入力はアクティブなテキスト欄へ流れ、長い音声は、一時停止、検索、編集、再確認ができる文字起こしになります。

任意の話者ラベルにより、交互に話す声を「話者1」「話者2」などとして分けられます。人物の特定や保存用音声プロファイルの作成は行わず、会話を整理するためのラベルです。

3. 確認、整理、書き出し

文字起こしを記録として使う前に、名前、句読点、分野固有の用語を修正します。短い会議要約を作成し、アクション項目をまとめるか、必要な箇所を文書やチャットへコピーできます。

文字起こしに時間情報があれば、動画エディター、メディアプレーヤー、講座、SNS投稿向けにSRTまたはVTT字幕を書き出せます。最終確認は利用者自身が行ってください。音声認識、話者分離、要約、自動タイミングはすべて、人による短い確認で改善できます。

VTA Dictateを見る

話した内容を、もっと使える成果物に。

Windows全体への音声入力、許可を得た会話の録音、音声の文字起こし、会議メモの整理、字幕の書き出しを、1つのデスクトップ環境で行えます。