多少の誤りを許容できる文章に音声を使う
問題の説明、制約、合格条件、コメント、コミットメッセージの下書き、課題の説明、長いAIプロンプトを音声で入力します。こうした文章では話す速さを生かせ、後から修正できます。正確な構文を音声入力することも可能ですが、波括弧、演算子、大文字と小文字、ファイル名、インデントが増えるほど修正の負担は急速に大きくなります。
実用的なのは、音声でスクラッチパッドへ入力し、確認してからターミナルやエディターへ貼り付ける方法です。このひと手間には意味があります。認識された言葉が即座にコマンドとして実行されるのを防げます。
音声認識を実行処理へ直結しない
シェルは、一つの記号の誤認識を、リダイレクト、ワイルドカード、コマンド置換、パスの変更、破壊的なフラグとして解釈する可能性があります。管理者権限のターミナルでは危険性がさらに高まります。パスワード入力や安全な入力欄に音声入力を使用しないでください。
Enterキーは手動で押してください。ファイル、権限、認証情報、デプロイ、リモートシステムを変更するコマンドは、表示された内容を一文字ずつ確認します。dry-runや状態確認コマンドを優先し、再帰操作の前にパスを確定してください。
安全上の境界
音声でコマンドの下書きを作ることはできますが、確認と実行は人が行うべきです。認識結果によってEnterキーが自動的に押されるワークフローを設定しないでください。
構造化プロンプトを段階的に入力
最初に目標と関連情報を述べます。次に、制約、対象となるファイルやシステム、変更してはいけない動作、成功の確認方法を列挙します。秘密情報、顧客データ、独自ソースコード、個人情報を含める前に一度立ち止まってください。ローカルで音声入力しても、最終的なプロンプトを受け取るAIサービスのプライバシー条件は変わりません。
名前、バージョン、日付、否定表現、「デプロイしない」のような指示を確認してください。音声認識の誤りはもっともらしい単語になる傾向があり、読み飛ばしやすいためです。
複数の入力方法を組み合わせる
音声、キーボード、マウス、スイッチアクセス、スクリーンリーダーのコマンドは互いに補完できます。フォーカス位置を見えるようにし、停止用ショートカットを用意して、未送信のテキストを保持してください。聞き取り中かどうか分からなくなるモードは避けます。疲労や発話の状態は一日の中でも変わるため、操作を一つの入力方法だけに依存させないでください。
職場で合理的配慮を検討する場合は、一般的な音声入力の基準だけで適合性を判断せず、本人の実際の作業と環境を評価してください。
