Přejít na obsah dokumentace
Keebye Docs

Úprava textu a slovník

Co se s přepisem děje mezi převodem řeči na text a vložením: slovník, úprava podle pravidel, výjimky pro jednotlivé aplikace a volitelné doleštění lokálním LLM.

Každé diktování projde stejnou krátkou linkou přímo na vašem Macu. Nic z toho nepoužívá síť.

Zpracování krok za krokem

  1. Převod řeči na text zvoleným enginem.

  2. Náhrady z vlastního slovníku, uplatňují se vždy.

  3. Úprava — podle pravidel, nebo lokálním LLM, pokud jste ho zapnuli — jen když je vylepšování zapnuté pro aplikaci vpředu.

  4. Vložení vložením ze schránky nebo psaním.

Úprava podle pravidel

Toto je celá sada pravidel. Úprava neodstraňuje přeřeky ani slovo "like".

  • Odstraňuje samostatné "um", "uh", "erm" a dvouslovné "you know", vždy jen jako celé tokeny.
  • Slučuje bezprostřední opakování slov, takže z "the the" bude "the".
  • Slučuje bílé znaky.
  • Zvětšuje první písmeno.
  • Doplňuje tečku, pokud text končí písmenem nebo číslicí.

Výjimky pro jednotlivé aplikace

Nastavení › Enhancement › "Clean up transcripts by default" je zapnuté. Výjimky se ukládají podle bundle id aplikace. "Add current app…" přidá poslední aplikaci mimo Keebye, kterou jste použili, s opačným nastavením, než je výchozí. Každá položka má zaškrtávátko a tlačítko "Remove".

Vlastní slovník

Nastavení › Dictionary: "Replace spoken words with fixed spellings." Do pole "heard as…" napište, co Keebye slyší, a do "write as…" zápis, který chcete, pak stiskněte Add (funguje i Enter). Remove položku smaže. Prázdný stav zní "No replacements yet."

  • Odpovídá jen celým slovům, nikdy ne uvnitř delšího slova.
  • Porovnání nerozlišuje velikost písmen; náhrada zachová velikost, kterou jste napsali.
  • Klíč může být i víceslovný. Vyhrává nejdelší shoda.
  • Uplatní se u každého diktování, ať už je pro danou aplikaci úprava zapnutá, nebo ne.

Doleštění lokálním LLM (volitelné)

Keebye může přepis místo úpravy podle pravidel předat lokálnímu jazykovému modelu. Model je Qwen3-1.7B (Q4_K_M GGUF, asi 1,28 GB) běžící přes llama.cpp s Metalem. Používá greedy sampling s vypnutým uvažováním, limit 64 tokenů a dvousekundový termín. Jakékoli selhání se vrátí k úpravě podle pravidel.

Výstup LLM před použitím prověří pojistka věrnosti: musí zachovat aspoň polovinu výskytů slov ze vstupu, nesmí překročit dvojnásobek počtu slov vstupu plus čtyři, nesmí obsahovat větu ani čtyřslovnou frázi zopakovanou třikrát a víckrát a nesmí být prázdný. Jinak se výstup LLM zahodí.