Prejsť na obsah dokumentácie
Keebye Docs

Úprava textu a slovník

Čo sa s prepisom deje medzi prevodom reči na text a vložením: slovník, úprava podľa pravidiel, výnimky pre jednotlivé aplikácie a voliteľné doladenie lokálnym LLM.

Každé diktovanie prejde tou istou krátkou linkou priamo na vašom Macu. Nič z toho nepoužíva sieť.

Spracovanie krok za krokom

  1. Prevod reči na text zvoleným enginom.

  2. Náhrady z vlastného slovníka, uplatňujú sa vždy.

  3. Úprava — podľa pravidiel, alebo lokálnym LLM, ak ste ho zapli — len keď je vylepšovanie zapnuté pre aplikáciu vpredu.

  4. Vloženie zo schránky alebo písaním.

Úprava podľa pravidiel

Toto je celá sada pravidiel. Úprava neodstraňuje falošné začiatky ani slovo "like".

  • Odstraňuje samostatné "um", "uh", "erm" a dvojslovné "you know", vždy len ako celé tokeny.
  • Zlučuje bezprostredné opakovania slov, takže z "the the" bude "the".
  • Zlučuje biele znaky.
  • Zväčšuje prvé písmeno.
  • Dopĺňa bodku, ak text končí písmenom alebo číslicou.

Výnimky pre jednotlivé aplikácie

Nastavenia › Enhancement › "Clean up transcripts by default" je zapnuté. Výnimky sa ukladajú podľa bundle id aplikácie. "Add current app…" pridá poslednú aplikáciu mimo Keebye, ktorú ste použili, s opačným nastavením, než je predvolené. Každá položka má zaškrtávacie políčko a tlačidlo "Remove".

Vlastný slovník

Nastavenia › Dictionary: "Replace spoken words with fixed spellings." Do poľa "heard as…" napíšte, čo Keebye počuje, a do "write as…" zápis, ktorý chcete, potom stlačte Add (funguje aj Enter). Remove položku vymaže. Prázdny stav znie "No replacements yet."

  • Zodpovedá len celým slovám, nikdy nie vnútri dlhšieho slova.
  • Porovnanie nerozlišuje veľkosť písmen; náhrada zachová veľkosť, ktorú ste napísali.
  • Kľúč môže byť aj viacslovný. Vyhráva najdlhšia zhoda.
  • Uplatní sa pri každom diktovaní, či už je pre danú aplikáciu úprava zapnutá, alebo nie.

Doladenie lokálnym LLM (voliteľné)

Keebye môže prepis namiesto úpravy podľa pravidiel odovzdať lokálnemu jazykovému modelu. Modelom je Qwen3-1.7B (Q4_K_M GGUF, približne 1,28 GB) bežiaci cez llama.cpp s Metalom. Používa greedy sampling s vypnutým uvažovaním, limit 64 tokenov a dvojsekundový termín. Akékoľvek zlyhanie sa vráti k úprave podľa pravidiel.

Výstup LLM pred použitím preverí poistka vernosti: musí zachovať aspoň polovicu výskytov slov zo vstupu, nesmie prekročiť dvojnásobok počtu slov vstupu plus štyri, nesmie obsahovať vetu ani štvorslovnú frázu zopakovanú trikrát a viackrát a nesmie byť prázdny. Inak sa výstup LLM zahodí.