在语言容错度高的环节使用语音
可以口述问题陈述、约束条件、验收标准、注释、提交消息草稿、问题说明或较长的 AI 提示词。这些内容能发挥叙述速度的优势,也容许之后修改。听写精确语法并非不可能,但遇到括号、运算符、大小写、文件名和缩进时,修改负担会迅速增加。
一个实用方法是先用语音输入到草稿区,检查后再粘贴到终端或编辑器。这个额外边界本身就是一项功能:它能防止识别出的语音立即变成命令。
绝不要把识别结果直接连接到执行操作
Shell 可能把一个识别错误的符号解释为重定向、通配符、命令替换、路径变更或破坏性标志。管理员权限终端会进一步放大风险。不要把密码提示框和安全字段作为听写目标。
请手动按下 Enter 键。如果命令会更改文件、权限、凭据、部署或远程系统,应逐字逐符号阅读呈现出的命令。优先使用试运行和状态查询命令。执行递归操作前,请先解析并确认路径。
安全边界
语音可以起草命令,但应由人工核对并执行。不要把工作流设置成让识别结果自动按下 Enter 键。
分步骤口述结构化提示词
先说明目标和相关背景,再列出约束条件、范围内的文件或系统、必须保持不变的行为,以及验证成功的方法。在说出密钥、客户数据、专有源代码或个人信息前先停下来考虑。本地听写这一步并不会改变最终接收提示词的 AI 服务所适用的隐私条款。
检查名称、版本、日期、否定词,以及“不要部署”之类的指令。语音错误往往会形成看似合理的词语,因此浏览时很容易漏过。
构建混合输入工作流
语音、键盘、鼠标、开关控制和屏幕阅读器命令可以相互配合。让焦点保持可见,提供停止快捷键,保留尚未发送的文本,并避免使用无法明确判断系统是否正在监听的模式。疲劳程度和语音表现可能在一天中发生变化,因此控制方式不应只依赖一种输入方法。
评估工作场所便利安排时,应考察当事人的实际任务和环境,不要假定一项通用听写基准就能证明适用性。
