Spring til dokumentationens indhold
Keebye Docs

Oprydning og ordbog

Hvad der sker med din transskription mellem tale-til-tekst og indsættelse: ordbogen, den regelbaserede oprydning, undtagelser pr. app og valgfri finpudsning med lokal LLM.

Hver diktering går gennem samme korte pipeline på din Mac. Intet her bruger netværket.

Pipelinen

  1. Tale-til-tekst med den valgte motor.

  2. Erstatninger fra din egen ordbog, altid anvendt.

  3. Oprydning — regelbaseret, eller den lokale LLM, hvis du har valgt det — kun når forbedring er slået til for den forreste app.

  4. Indsættelse via paste eller skrivning.

Regelbaseret oprydning

Dette er hele regelsættet. Oprydningen fjerner ikke falske starter eller ordet "like".

  • Fjerner selvstændige "um", "uh", "erm" og toordsformen "you know" og matcher kun hele tokens.
  • Slår umiddelbare ordgentagelser sammen, så "the the" bliver "the".
  • Slår mellemrum sammen.
  • Gør det første bogstav til stort.
  • Tilføjer et punktum, hvis teksten slutter på et bogstav eller et ciffer.

Undtagelser pr. app

Settings › Enhancement › "Clean up transcripts by default" er slået til. Undtagelser knyttes til appens bundle-id. "Add current app…" tilføjer den seneste app, du brugte, som ikke var Keebye, med det modsatte af standardindstillingen. Hver post har et flueben og en "Remove"-knap.

Egen ordbog

Settings › Dictionary: "Replace spoken words with fixed spellings." Skriv det, Keebye hører, i "heard as…" og den stavemåde, du vil have, i "write as…", og tryk så på Add (Enter virker også). Remove sletter en post. Den tomme tilstand viser "No replacements yet."

  • Matcher kun hele ord, aldrig inde i et længere ord.
  • Matchningen skelner ikke mellem store og små bogstaver; erstatningen beholder de store og små bogstaver, du skrev.
  • Nøgler kan bestå af flere ord. Det længste match vinder.
  • Anvendes på hver diktering, uanset om oprydning er slået til for appen eller ikke.

Finpudsning med lokal LLM (tilvalg)

Keebye kan sende transskriptionen til en lokal sprogmodel i stedet for til den regelbaserede oprydning. Modellen er Qwen3-1.7B (Q4_K_M GGUF, cirka 1,28 GB), der kører gennem llama.cpp med Metal. Den bruger greedy sampling med tænkning slået fra, et loft på 64 tokens og en deadline på 2 sekunder. Enhver fejl falder tilbage til regelbaseret oprydning.

En trofasthedsvagt tjekker LLM-outputtet, før det bruges: det skal bevare mindst halvdelen af forekomsterne af ordene i inputtet, ikke overstige det dobbelte af inputtets antal ord plus fire, ikke indeholde en sætning eller en firordsfrase, der gentages tre gange eller mere, og ikke være tomt. Ellers smides LLM-outputtet væk.