博客

在 Mac 上为 Claude 语音输入:让长提示词在发送前保持可编辑

介绍如何在 Mac 上向 Claude 进行语音输入,区分移动端语音模式,并在发送前控制长提示词、文件、代码与敏感信息。

作者 tsuvic发布 约 3 分钟

TalkTalkType 目前只支持英语和日语听写。此译文用于介绍产品,并不表示已经支持中文听写。

Claude 能处理很长的上下文,但这不代表长提示词可以一直即兴说到按下发送。

在 Mac 上,语音输入最适合这样的情况:任务本身已经清楚,可是一边打字一边补充背景与限制时,重要条件容易被省略。你可以直接在 Claude 的普通输入框里说话,先检查转成的文字,再附上或粘贴准确资料,最后发送。

实际做法很简单:用语音表达判断和理由,用原文保存证据,并在发送前编辑。

Mac 语音输入不同于 Claude 移动端语音模式

Anthropic 为 iOS 与 Android 版 Claude 提供听写和语音模式。移动端听写会把讲话转换成文字提示词;语音模式则支持完整的语音对话,包括 Claude 的语音回复。这些都是移动端功能。

在 Mac 上,通用听写工具可以把可编辑文字送入浏览器或桌面应用中的普通 Claude 输入框。发送前,你仍然可以调整顺序、补充标题、粘贴代码、附加文档或删除一句话。

当对话本身就是工作时,语音模式更合适。需要检查、复用提示词,或与文件和精确文本组合时,语音输入更合适。

长提示词应先说明需要什么决定

Claude 可以处理详细指令,但如果真正的任务藏在几段背景之后,发送前就很难快速检查。

更稳妥的顺序是:

  1. 先说需要的决定或交付物。
  2. 解释相关背景。
  3. 补充限制条件与非目标。
  4. 提供资料。
  5. 规定输出形式。

例如:

请判断这个流程应该留在应用层,还是迁移到数据平台。系统会处理医疗信息,并且已经使用 AWS Web 应用和独立分析环境。请比较安全边界、运维、成本、可观测性与故障恢复。不要假设团队拥有大型平台团队。最后给出推荐架构,以及哪些条件会改变这一结论。

第一句已经说明任务。后面的背景用于改变判断,而不是遮住主题。

用语音说明上下文,用粘贴保留精确内容

语音适合解释“为什么重要”。如果一个字符就可能改变含义,就不适合依赖语音。

以下内容应直接输入、复制或上传:

  • 代码、JSON、YAML、SQL 与 Shell 命令
  • 文件路径、URL、Issue 编号与 Commit Hash
  • 模型名、API 名称与版本号
  • 精确引文、合同与政策文字
  • 日志、堆栈、表格与测量值

然后用语音补充这些材料应如何使用:哪一部分最权威、需要比较什么、哪些内容可以忽略,以及证据应回答什么问题。

Claude 支持在聊天和 Projects 知识库中上传文档。与其朗读文档,不如上传后说明分析目的。文件负责保留原始资料,提示词负责保留你的判断方向。

需要长期复用的上下文应放进 Projects

Anthropic 的 Projects 在付费计划中提供带有独立聊天、知识库和项目指令的工作空间。相同文档、术语或判断规则需要多次使用时,这种方式更合适。

不要每次重新口述稳定背景。把长期信息放入项目,只说今天发生变化的部分:

  • 当前需要的决定
  • 新增的证据
  • 对默认规则的例外
  • 本次对话需要的结果

这样可以减少重复,也更容易检查。重要限制也不会只存在于某一次即兴提示词里。

分开证据、假设与未确认事项

说话时,事实很容易自然滑向解释。如果边界不清楚,Claude 可能把假设当成已经确认的前提。

可以使用明确标签:

  • 证据: 文档、日志或当前系统显示的内容
  • 假设: 暂时按真实处理的条件
  • 未确认: 还没有验证的问题
  • 请求: 即使仍有不确定性,也希望 Claude 给出的结果

例如:

证据:当前每月成本约为 1,000 美元,向量搜索端点是最大的固定成本。假设:本季度文档量保持在 1,000 页以内。未确认:上线后的并发量。请求:请给出即使并发达到当前估计五倍也能安全运行的最小架构。

这些标签不一定要保留在最终文本里。它们的作用是避免流畅口述隐藏每句话的确定程度。

TalkTalkType 让 Claude 输入框保持在原位

TalkTalkType 会在按住 Option-Space 时录音,并把结果返回原来有焦点的输入框。Claude 可以继续停留在浏览器或桌面应用里,你可以边说边检查。

Clean 会轻度整理,同时保留内容、顺序与语气。Raw 会保留更完整的转写,包括重新起句。两种模式都不能保证代码、数字和标识符完全准确,因此仍需用键盘检查。

一个实用流程是:把光标放在 Claude 输入框,先说任务与理由,再附加或粘贴证据;如果有多项要求,就加入清晰标签;最后进行一次编辑。Mac 任意应用中的语音输入说明了焦点输入和剪贴板备用方式。在 Mac 上向 ChatGPT 语音输入则在另一个 AI 界面中解释了同样的“可编辑提示词”差异。

敏感信息应在进入 Claude 前检查

语音输入只改变输入方式,不会改变发送目的地或数据规则。不要口述密码、API 密钥、访问令牌、私有凭据或生产环境秘密。除非账户、工作区和组织规则允许,否则应从日志和文档中删除客户数据与内部标识。

Anthropic 表示,Claude 移动端听写会在转写后删除音频,也不会保留用于训练生成模型。但第三方 Mac 听写在文字到达 Claude 前有自己的处理路径。不要把移动端说明直接套用到所有配置,应分别检查两个阶段。

Mac 私密语音输入介绍了音频与转写在进入 Claude 前的路径。最终提示词与附件随后由所使用的 Claude 账户和工作区规则管理。

当遗漏条件才是真正瓶颈时使用

简短问题可能直接打字更快。

语音输入真正有价值的情况,是第一轮回答后经常需要补一句:“我忘了三个重要限制。”先说需要的决定,再说变化中的背景,粘贴精确证据,标记假设,并在发送前检查。

Claude 只能根据真正进入提示词的条件进行判断。只要语音输入能让关键条件不再消失,它就有价值。

博客