Oprydning og ordbog
Hvad der sker med din transskription mellem tale-til-tekst og indsættelse: ordbogen, den regelbaserede oprydning, undtagelser pr. app og valgfri finpudsning med lokal LLM.
Hver diktering går gennem samme korte pipeline på din Mac. Intet her bruger netværket.
Pipelinen
Tale-til-tekst med den valgte motor.
Erstatninger fra din egen ordbog, altid anvendt.
Oprydning — regelbaseret, eller den lokale LLM, hvis du har valgt det — kun når forbedring er slået til for den forreste app.
Indsættelse via paste eller skrivning.
Regelbaseret oprydning
Dette er hele regelsættet. Oprydningen fjerner ikke falske starter eller ordet "like".
- Fjerner selvstændige "um", "uh", "erm" og toordsformen "you know" og matcher kun hele tokens.
- Slår umiddelbare ordgentagelser sammen, så "the the" bliver "the".
- Slår mellemrum sammen.
- Gør det første bogstav til stort.
- Tilføjer et punktum, hvis teksten slutter på et bogstav eller et ciffer.
Undtagelser pr. app
Settings › Enhancement › "Clean up transcripts by default" er slået til. Undtagelser knyttes til appens bundle-id. "Add current app…" tilføjer den seneste app, du brugte, som ikke var Keebye, med det modsatte af standardindstillingen. Hver post har et flueben og en "Remove"-knap.
Egen ordbog
Settings › Dictionary: "Replace spoken words with fixed spellings." Skriv det, Keebye hører, i "heard as…" og den stavemåde, du vil have, i "write as…", og tryk så på Add (Enter virker også). Remove sletter en post. Den tomme tilstand viser "No replacements yet."
- Matcher kun hele ord, aldrig inde i et længere ord.
- Matchningen skelner ikke mellem store og små bogstaver; erstatningen beholder de store og små bogstaver, du skrev.
- Nøgler kan bestå af flere ord. Det længste match vinder.
- Anvendes på hver diktering, uanset om oprydning er slået til for appen eller ikke.
Finpudsning med lokal LLM (tilvalg)
Keebye kan sende transskriptionen til en lokal sprogmodel i stedet for til den regelbaserede oprydning. Modellen er Qwen3-1.7B (Q4_K_M GGUF, cirka 1,28 GB), der kører gennem llama.cpp med Metal. Den bruger greedy sampling med tænkning slået fra, et loft på 64 tokens og en deadline på 2 sekunder. Enhver fejl falder tilbage til regelbaseret oprydning.
En trofasthedsvagt tjekker LLM-outputtet, før det bruges: det skal bevare mindst halvdelen af forekomsterne af ordene i inputtet, ikke overstige det dobbelte af inputtets antal ord plus fire, ikke indeholde en sætning eller en firordsfrase, der gentages tre gange eller mere, og ikke være tomt. Ellers smides LLM-outputtet væk.