WAV、MP3、M4A音声から始める
会議の録音、インタビュー、ボイスメモ、講義、ポッドキャストなど、処理する許可を得た音声を使用します。離れたマイク、大きな背景雑音、音割れ、複数人の同時発話がある録音より、明瞭な発話ときれいな録音のほうが、通常は精度の高い文字起こしの土台になります。
長時間のファイルは、内容が分かる名前と明確な入手元を付けると管理しやすくなります。重要な表現をいつでも確認できるよう、文字起こしの確認が終わるまで元の録音を保管してください。
便利な構造を付けてローカルで文字起こし
音声認識はWindowsパソコン上で実行されます。文字起こしにはタイムスタンプと任意の位置ベース話者ラベルを追加でき、目的の箇所への移動や複数人での確認がしやすくなります。
話者ラベルは「話者1」「話者2」のように発話の交代を示すもので、個人を名前で特定するものではありません。実際に誰が話したのか、その文書で名前を示すことが適切かを確認してから、実名を追加してください。
一度修正すれば、テキストを多用途に活用
編集可能な文字起こしで、名前、数字、句読点、重要な用語を修正します。一部を文書へコピーし、会議メモやアクション項目を作成したり、タイミング情報から字幕を作ったりできます。
自動文字起こしは優れた初稿ですが、正確な表現が重要な場合に音声を聞く作業の代わりにはなりません。法律、医療、金融、懲戒など、重大な影響を伴う記録は、元の音声と慎重に照合してください。
