博客

在 Mac 的 Cursor 中使用语音输入而不破坏代码

了解如何在 Mac 版 Cursor 中口述提示词,区分自然语言与精确代码,补充上下文,并在 Agent 执行前完成检查。

作者 tsuvic发布 约 2 分钟

TalkTalkType 目前只支持英语和日语听写。此译文用于介绍产品,并不表示已经支持中文听写。

在 Cursor 中,语音输入最适合说明意图、限制条件、故障现象和预期结果。代码、文件路径、标识符、命令和完整错误信息则更适合手动输入或粘贴,因为这些内容往往不能容忍任何字符错误。

更可靠的工作方式是混合输入:先把光标放在 Cursor 的聊天输入框中,用自然语言说明问题,再通过 Cursor 的上下文功能加入准确的技术材料,最后在发送前检查完整提示词。

口述问题,手动输入代码

语音适合解释为什么需要修改。你可以说明当前行为、目标行为、不能改变的条件、已经尝试的方法和验收标准。这些背景通常比一句简短命令更有价值。

文件路径、函数名、软件包版本、正则表达式、Shell 命令、环境变量、堆栈信息和必须编译通过的代码,应当输入或粘贴。一个字符错误就可能指向错误文件,或者改变命令的实际作用。

例如,可以口述:“登录回调在本地成功,但部署后失败。保留现有会话格式,不要修改数据库结构。”然后粘贴准确错误,并把相关函数和测试加入上下文。

在撰写与执行之间保留检查步骤

Cursor 的官方快捷键文档把聊天输入与发送、排队、接受、拒绝和执行生成结果区分开来。快捷键还可以重新映射,因此不同安装环境的操作可能不完全相同。

在执行任何操作前结束录音。松开录音快捷键,确认文字进入正确输入框,删除重复表达,并确认焦点仍在目标位置。完成这些检查后再发送。

请求迁移、依赖变更、删除、终端命令或大范围重构时,这一步尤其重要。语音应该加快指令撰写,而不是取消 Agent 行动前的审核边界。

使用 Cursor 自己的功能补充上下文

长篇说明不能代替精确上下文。Cursor 可以把选中的代码、文件、剪贴板内容和其他引用加入聊天。不同模式的权限也不同:Agent 可以探索、编辑和运行工具,Ask 更适合只读调查。

用语音表达任务目标和判断标准。用代码选择、文件引用、日志粘贴和模式选择控制提供给 Cursor 的证据与权限。

如果原因尚不明确,先在 Ask 中调查。等目标修改和边界清楚后,再切换到 Agent。

把长提示词拆成短小区块

技术提示词可以分为问题、预期行为、限制条件、相关文件和验证方法。

每次只口述一个区块。标题、准确文件名、命令和测试名称应当手动输入。这样比一段连续转写更容易发现遗漏,也能避免重要例外埋在长段落末尾。

例如,“验证:运行现有身份验证测试,不更新快照”就给出了清晰的完成标准。

在说出项目细节前检查隐私设置

Cursor 说明,AI 请求会经过 Cursor 后端。其当前数据使用文档表示,启用 Privacy Mode 后,客户数据不会用于训练,并与模型提供商采用零数据保留安排,但仍受文档列出的安全例外约束。免费和付费用户都可以使用 Privacy Mode。

这并不意味着任何内容都适合口述。不要说出密钥、API 密钥、访问令牌、生产凭据、客户隐私数据,或组织政策禁止发送给 AI 的源代码。

语音输入工具在文本到达 Cursor 前也会处理音频与转写。应分别评估语音输入路径和 Cursor 请求路径。

把 TalkTalkType 作为输入层

TalkTalkType 会在按住 Option-Space 时录音,并把结果返回到原先获得焦点的输入框。在 Cursor 中,草稿可以直接留在当前聊天,而不必经过单独的转写编辑器。

Clean 会在保留含义和语气的前提下轻度整理自然语言,Raw 会保留更多原始转写。两种模式都不应猜测代码或修正标识符。请在口述后加入准确技术材料,并在发送前检查组合后的提示词。

在任意 Mac 应用中使用听写介绍了焦点输入框传递和剪贴板备用路径。

当解释成为瓶颈时使用语音

在 Cursor 中,语音输入最有价值的场景是补充上下文:为什么这个问题重要,哪些部分不能改变,以及如何验证结果。

如果任务主要是语法,请手动输入。口述推理,输入准确字符,附上证据,并在发送前检查。这样的分工能更快创建完整提示词,同时避免让 Agent 猜测关键细节。

博客