Limpeza e dicionário
O que acontece com a sua transcrição entre a conversão de fala em texto e a inserção: o dicionário, a limpeza por regras, as exceções por app e o polimento opcional por LLM local.
Todo ditado passa pela mesma sequência curta no seu Mac. Nada aqui usa a rede.
A sequência
Conversão de fala em texto com o motor selecionado.
Substituições do dicionário personalizado, sempre aplicadas.
Limpeza — por regras, ou pelo LLM local se você optou por ele — apenas quando o aprimoramento está ativo para o app em primeiro plano.
Inserção por colagem ou por digitação.
Limpeza por regras
Este é o conjunto completo de regras. A limpeza não remove começos errados nem a palavra "like".
- Remove "um", "uh" e "erm" isolados e o "you know" de duas palavras, correspondendo apenas a tokens inteiros.
- Junta repetições imediatas de palavras, então "the the" vira "the".
- Junta os espaços em branco.
- Deixa a primeira letra maiúscula.
- Acrescenta um ponto se o texto termina em letra ou dígito.
Exceções por app
O Settings › Enhancement › "Clean up transcripts by default" está ativo. As exceções são identificadas pelo bundle id do app. O "Add current app…" adiciona o último app que você usou fora do Keebye, com o oposto do padrão. Cada entrada tem uma caixa de seleção e um botão "Remove".
Dicionário personalizado
Settings › Dictionary: "Replace spoken words with fixed spellings." Digite o que o Keebye ouve em "heard as…" e a grafia que você quer em "write as…", depois pressione Add (o Enter também funciona). O Remove apaga uma entrada. O estado vazio diz "No replacements yet."
- Corresponde apenas a palavras inteiras, nunca dentro de uma palavra maior.
- A correspondência ignora maiúsculas e minúsculas; a substituição mantém a grafia que você digitou.
- As chaves podem ter várias palavras. A correspondência mais longa vence.
- Aplicado a todo ditado, esteja a limpeza ativa ou não para o app.
Polimento por LLM local (opcional)
O Keebye pode entregar a transcrição a um modelo de linguagem local em vez de usar a limpeza por regras. O modelo é o Qwen3-1.7B (Q4_K_M GGUF, cerca de 1,28 GB), rodando no llama.cpp com Metal. Ele usa amostragem greedy com o raciocínio desligado, limite de 64 tokens e prazo de 2 segundos. Qualquer falha volta para a limpeza por regras.
Uma checagem de fidelidade avalia a saída do LLM antes de ela ser usada: precisa manter pelo menos metade das ocorrências de palavras da entrada, não passar do dobro da contagem de palavras da entrada mais quatro, não conter nenhuma frase ou sequência de quatro palavras repetida três vezes ou mais, e não estar vazia. Fora isso, a saída do LLM é descartada.