Quando o contexto decide a resposta, um prompt útil é longo. Ele carrega a restrição, a abordagem que você já tentou, a exceção que quebrou a última resposta e o motivo pelo qual a solução óbvia não se aplica aqui. Você sabe tudo isso antes de tocar no teclado. Digitar levaria dois minutos, então você digita um terço em vinte segundos e envia isso.
O modelo responde ao terço que você enviou.
Falar parece o conserto óbvio. Diga em voz alta esses dois minutos inteiros, e as partes que você teria cortado por preguiça sobrevivem.
Depois você lê a transcrição. Ela começa duas vezes. Há um "é..." antes da cláusula importante, uma frase abandonada na metade, uma correção feita em voz alta. Colado no campo do prompt, isso não é claramente melhor do que a versão curta que você teria digitado.
A pergunta, então, não é se deve ditar o prompt. É quanto do que você disse deve chegar ao campo de texto.
O que você corta costuma ser o que o modelo precisava
Repare em quais palavras somem quando você encurta um prompt à mão. A restrição sobrevive, porque parece ser o próprio pedido. O contexto vai embora primeiro: a versão do framework, o que você tentou na terça-feira, o motivo pelo qual não pode mudar o schema. Quem decide é o esforço, e o esforço não faz ideia de qual frase carrega a resposta.
O TalkTalkType conta uma gravação mantida como um ditado, seja qual for o conteúdo. Quarenta palavras e quatrocentas custam o mesmo. Isso não faz de você um redator de prompts melhor. Só remove o motivo específico pelo qual você estava cortando.
A fala falha em lugares diferentes da digitação
Prompts digitados falham por omissão. Prompts falados falham por resíduo.
Uma gravação mantida acumula o falso começo, a hesitação antes de uma palavra difícil, a meia frase que você abandonou quando uma formulação melhor apareceu. Nada disso é erro de transcrição. As palavras foram ditas, então uma transcrição fiel as mantém.
É por isso que um app de ditado para prompts não está pronto quando o reconhecimento é preciso. A decisão que resta é editorial, e ela pertence a quem sabe para onde esse texto está indo.
A escolha é Clean ou Raw, não uma fileira de predefinições
O TalkTalkType expõe essa decisão como uma escolha de duas posições: Clean e Raw. Não há um seletor de destinos nem uma predefinição de reescrita.
O Clean faz uma limpeza leve e fiel. Ele mantém cada palavra falada, a ordem, o registro e a brevidade pretendida, e remove apenas sons de hesitação inequívocos, quando removê-los não pode mudar o sentido. Não parafraseia, não expande, não resume, não torna nada mais educado. Uma frase curta permanece curta. O resultado volta em uma única linha.
O Raw devolve a transcrição sem nenhuma alteração. Nenhum modelo de limpeza é executado. A primeira coisa que você vê é o que você disse.
Os dois cobrem gravações diferentes. O Clean cabe à gravação em que a sua formulação exata é o ponto, incluindo a frase estranha que você escolheu de propósito e o trecho que você quis manter curto. O Raw cabe a uma gravação que você pretende editar sozinho, ou a uma que contém um nome próprio que a limpeza poderia suavizar demais.
Nenhum dos dois reescreve o seu prompt por você, e isso é proposital. Ao pressionar o atalho, o app captura o aplicativo em foco e classifica o campo sob o cursor com uma tabela fixa, não com um palpite. O resultado limpo chega como um rascunho, e a primeira colagem é fiel. Se você quiser reformulá-lo — transformar uma explicação falada em uma instrução mais enxuta —, o passo opcional Voice Patch permite falar um refinamento antes de inserir o texto, sem jamais reescrever em silêncio aquela primeira colagem. O ditado contextual no Mac acompanha como o destino é lido e onde a adaptação acontece, e onde não acontece.
Todos os planos incluem Clean e Raw. Os planos diferem nos ditados semanais, no tempo de voz, no limite de entradas limpas e na duração da gravação, não em quais modos você pode executar.
Os dois modos, lado a lado:
| Modo | O que mantém | O que muda | Quando usar |
|---|---|---|---|
| Clean | Cada palavra falada, a ordem, o registro e a brevidade pretendida | Remove apenas sons de hesitação inequívocos; não parafraseia, não expande, não resume, não torna nada mais educado | A gravação em que a sua formulação exata é o ponto, incluindo a frase estranha que você escolheu de propósito |
| Raw | A transcrição inteira, sem nenhuma alteração | Nada; nenhum modelo de limpeza é executado | Uma gravação que você pretende editar sozinho, ou uma que contém um nome próprio que a limpeza poderia suavizar demais |
O que o medidor conta decide o que você ousa dizer
O Free inclui 30 ditados e 15 minutos de voz por semana, com cada gravação limitada a 60 segundos. O Plus está listado a US$ 1 por mês por 80 ditados e 30 minutos. O Pro custa US$ 7 por 500 ditados, 250 minutos e um limite de 120 segundos. O Max custa US$ 18 por 1.200 ditados e 600 minutos. Os números atuais estão na página de preços do TalkTalkType.
A limpeza tem sua própria cota semanal. O Free permite 20 entradas limpas por semana e o Plus 60; o Pro e o Max não têm uma cota de limpeza separada. Uma gravação Raw não gasta nada disso, porque nada roda sobre o texto.
Dessa aritmética saem dois hábitos, e não são os que uma contagem de palavras produziria.
Refazer uma frase dentro da mesma gravação é grátis. Diga a restrição, perceba que saiu errada, diga de novo direito, e deixe a limpeza descartar a metade abandonada. Começar do zero com uma segunda gravação não é grátis, então vale mais terminar uma gravação ruim do que soltar a tecla.
O limite de 60 segundos no Free e no Plus é a fronteira real, e é uma que você sente enquanto fala. Um minuto é bastante prompt. Não é suficiente para um fluxo de consciência solto, e essa é exatamente a pressão certa.
O campo do prompt já tem o seu cursor dentro
Segure Option-Espaço, fale, solte. O texto chega ao campo que estava com foco, que para este trabalho é o campo de prompt no Cursor, no ChatGPT, ou em um terminal onde você já estava digitando. A colagem direta usa a permissão de Acessibilidade do macOS, e a entrega via área de transferência continua disponível quando um app protegido recusa entrada automatizada. O app roda na barra de menus no macOS 26 ou posterior.
Esse destino importa mais aqui do que em uma mensagem curta. Um prompt é escrito ao lado daquilo a que se refere. Mudar para uma janela separada para ditar, e depois carregar o resultado de volta, reintroduz a interrupção que você estava tentando eliminar. O ditado em qualquer aplicativo no Mac mostra como esse caminho até o cursor com foco se comporta entre diferentes apps.
Nada disso guarda o prompt em um servidor. Áudio, transcrições brutas e texto limpo não ficam retidos pelo serviço, e o histórico curto de sessão do app de Mac vive na memória e desaparece quando o app é encerrado. O ditado privado no Mac acompanha uma gravação em cada etapa desse caminho.
Comece pelos três prompts que você encurtou esta semana
Encontre-os no seu histórico. São aqueles em que a resposta ficou quase certa, e em que a sua mensagem de acompanhamento acabou fornecendo o contexto que você tinha deixado de fora.
Dite cada um novamente como uma única gravação, com a restrição, a tentativa anterior e a exceção incluídas. Envie o resultado. Compare com a resposta que você recebeu da primeira vez, e note se a sua mensagem de acompanhamento ainda seria necessária.
Você pode baixar o TalkTalkType para Mac e fazer essa comparação dentro da cota semanal gratuita. O que isso não vai resolver é a gravação que você ainda está montando na cabeça, aquela em que você ainda não sabe o que está perguntando. Ditar essa é um experimento diferente, e geralmente precisa primeiro da resposta a uma pergunta menor.