Ugrás a dokumentáció tartalmára
Keebye dokumentáció

Tisztítás és szótár

Mi történik az átirattal a beszédfelismerés és a beszúrás között: a szótár, a szabályalapú tisztítás, az appra szabott kivételek és a választható helyi LLM-es csiszolás.

Minden diktálás ugyanezen a rövid láncon fut végig, a Maceden. Semmi nem használ hálózatot.

A lánc

  1. Beszéd-szöveg átírás a kiválasztott motorral.

  2. Az egyéni szótár helyettesítései, mindig.

  3. Tisztítás — szabályalapon, vagy a helyi LLM-mel, ha bekapcsoltad — csak akkor, ha az előtérben lévő apphoz engedélyezett.

  4. Beszúrás beillesztéssel vagy gépeléssel.

Szabályalapú tisztítás

Ez a teljes szabálykészlet. A tisztítás nem távolítja el a félbehagyott kezdéseket, sem a "like" szót.

  • Kiveszi az önmagában álló "um", "uh", "erm" hangot és a kétszavas "you know" kifejezést, csak teljes tokent illesztve.
  • Összevonja a közvetlen szóismétléseket, így a "the the" "the" lesz.
  • Összevonja a szóközöket.
  • Nagybetűvel írja az első karaktert.
  • Pontot tesz a végére, ha a szöveg betűre vagy számjegyre végződik.

Appra szabott kivételek

A Settings › Enhancement › "Clean up transcripts by default" be van kapcsolva. A kivételek az app bundle id-jéhez kötődnek. Az "Add current app…" felveszi azt az appot, amelyet a Keebye előtt utoljára használtál, az alapértelmezés ellentétével. Minden bejegyzéshez tartozik egy jelölőnégyzet és egy "Remove" gomb.

Egyéni szótár

Settings › Dictionary: "Replace spoken words with fixed spellings." Írd be a "heard as…" mezőbe, amit a Keebye hall, a "write as…" mezőbe pedig a kívánt írásmódot, majd nyomd meg az Add gombot (az Enter is működik). A Remove törli a bejegyzést. Az üres állapot szövege: "No replacements yet."

  • Csak teljes szóra illeszkedik, hosszabb szó belsejére soha.
  • Az illesztés nem érzékeny a kis- és nagybetűkre; a csere megtartja az általad beírt írásmódot.
  • A kulcs több szó is lehet. A leghosszabb találat győz.
  • Minden diktálásra érvényes, függetlenül attól, hogy az apphoz be van-e kapcsolva a tisztítás.

Helyi LLM-es csiszolás (választható)

A Keebye a szabályalapú tisztítás helyett át tudja adni az átiratot egy helyi nyelvi modellnek. A modell a Qwen3-1.7B (Q4_K_M GGUF, körülbelül 1,28 GB), amely a llama.cpp-n keresztül, Metallal fut. Greedy mintavételt használ kikapcsolt gondolkodással, 64 tokenes korláttal és 2 másodperces határidővel. Bármilyen hiba esetén visszaáll a szabályalapú tisztításra.

Egy hűségellenőrzés használat előtt megvizsgálja az LLM kimenetét: meg kell tartania a bemeneti szóelőfordulások legalább felét, nem haladhatja meg a bemeneti szószám kétszeresét plusz négyet, nem tartalmazhat háromszor vagy többször megismételt mondatot vagy négyszavas kifejezést, és nem lehet üres. Egyébként a Keebye eldobja az LLM kimenetét.