Opprydding og ordliste
Hva som skjer med transkripsjonen din mellom tale-til-tekst og innsetting: ordlisten, regelbasert opprydding, overstyringer per app og valgfri finpuss med lokal LLM.
Hver diktering går gjennom samme korte kjede på Mac-en din. Ingenting her bruker nettverket.
Kjeden
Tale-til-tekst med den valgte motoren.
Erstatninger fra den egne ordlisten, alltid brukt.
Opprydding — regelbasert, eller den lokale LLM-en hvis du har slått den på — bare når forbedring er aktivert for appen som er forrest.
Innsetting ved innliming eller skriving.
Regelbasert opprydding
Dette er hele regelsettet. Oppryddingen fjerner ikke feilstarter eller ordet "like".
- Fjerner frittstående "um", "uh" og "erm" og det to ord lange "you know", og treffer bare hele ord.
- Slår sammen umiddelbare ordgjentakelser, så "the the" blir "the".
- Slår sammen mellomrom.
- Gjør den første bokstaven stor.
- Legger til punktum hvis teksten slutter på en bokstav eller et tall.
Overstyringer per app
Settings › Enhancement › "Clean up transcripts by default" er på. Overstyringer nøkles på appens bundle-id. "Add current app…" legger til den siste appen du brukte som ikke var Keebye, med det motsatte av standardvalget. Hver oppføring har en avkrysningsboks og en "Remove"-knapp.
Egen ordliste
Settings › Dictionary: "Replace spoken words with fixed spellings." Skriv det Keebye hører i "heard as…" og stavemåten du vil ha i "write as…", og trykk Add (Enter fungerer også). Remove sletter en oppføring. Tomtilstanden sier "No replacements yet."
- Treffer bare hele ord, aldri inne i et større ord.
- Treff skiller ikke mellom store og små bokstaver; erstatningen beholder skrivemåten du skrev inn.
- Nøkler kan være flere ord. Det lengste treffet vinner.
- Brukes på hver diktering, uansett om opprydding er aktivert for appen.
Finpuss med lokal LLM (valgfritt)
Keebye kan gi transkripsjonen til en lokal språkmodell i stedet for den regelbaserte oppryddingen. Modellen er Qwen3-1.7B (Q4_K_M GGUF, rundt 1,28 GB) som kjører gjennom llama.cpp med Metal. Den bruker greedy sampling med tenkning avslått, et tak på 64 tokener og en frist på 2 sekunder. Enhver feil faller tilbake til regelbasert opprydding.
En troskapskontroll sjekker LLM-utdataen før den brukes: den må beholde minst halvparten av ordforekomstene i inndataen, ikke overstige det dobbelte av ordantallet pluss fire, ikke inneholde noen setning eller firordsfrase som gjentas tre ganger eller mer, og ikke være tom. Ellers forkastes LLM-utdataen.