Tisztítás és szótár
Mi történik az átirattal a beszédfelismerés és a beszúrás között: a szótár, a szabályalapú tisztítás, az appra szabott kivételek és a választható helyi LLM-es csiszolás.
Minden diktálás ugyanezen a rövid láncon fut végig, a Maceden. Semmi nem használ hálózatot.
A lánc
Beszéd-szöveg átírás a kiválasztott motorral.
Az egyéni szótár helyettesítései, mindig.
Tisztítás — szabályalapon, vagy a helyi LLM-mel, ha bekapcsoltad — csak akkor, ha az előtérben lévő apphoz engedélyezett.
Beszúrás beillesztéssel vagy gépeléssel.
Szabályalapú tisztítás
Ez a teljes szabálykészlet. A tisztítás nem távolítja el a félbehagyott kezdéseket, sem a "like" szót.
- Kiveszi az önmagában álló "um", "uh", "erm" hangot és a kétszavas "you know" kifejezést, csak teljes tokent illesztve.
- Összevonja a közvetlen szóismétléseket, így a "the the" "the" lesz.
- Összevonja a szóközöket.
- Nagybetűvel írja az első karaktert.
- Pontot tesz a végére, ha a szöveg betűre vagy számjegyre végződik.
Appra szabott kivételek
A Settings › Enhancement › "Clean up transcripts by default" be van kapcsolva. A kivételek az app bundle id-jéhez kötődnek. Az "Add current app…" felveszi azt az appot, amelyet a Keebye előtt utoljára használtál, az alapértelmezés ellentétével. Minden bejegyzéshez tartozik egy jelölőnégyzet és egy "Remove" gomb.
Egyéni szótár
Settings › Dictionary: "Replace spoken words with fixed spellings." Írd be a "heard as…" mezőbe, amit a Keebye hall, a "write as…" mezőbe pedig a kívánt írásmódot, majd nyomd meg az Add gombot (az Enter is működik). A Remove törli a bejegyzést. Az üres állapot szövege: "No replacements yet."
- Csak teljes szóra illeszkedik, hosszabb szó belsejére soha.
- Az illesztés nem érzékeny a kis- és nagybetűkre; a csere megtartja az általad beírt írásmódot.
- A kulcs több szó is lehet. A leghosszabb találat győz.
- Minden diktálásra érvényes, függetlenül attól, hogy az apphoz be van-e kapcsolva a tisztítás.
Helyi LLM-es csiszolás (választható)
A Keebye a szabályalapú tisztítás helyett át tudja adni az átiratot egy helyi nyelvi modellnek. A modell a Qwen3-1.7B (Q4_K_M GGUF, körülbelül 1,28 GB), amely a llama.cpp-n keresztül, Metallal fut. Greedy mintavételt használ kikapcsolt gondolkodással, 64 tokenes korláttal és 2 másodperces határidővel. Bármilyen hiba esetén visszaáll a szabályalapú tisztításra.
Egy hűségellenőrzés használat előtt megvizsgálja az LLM kimenetét: meg kell tartania a bemeneti szóelőfordulások legalább felét, nem haladhatja meg a bemeneti szószám kétszeresét plusz négyet, nem tartalmazhat háromszor vagy többször megismételt mondatot vagy négyszavas kifejezést, és nem lehet üres. Egyébként a Keebye eldobja az LLM kimenetét.