Czyszczenie i słownik
Co dzieje się z transkrypcją między rozpoznaniem mowy a wstawieniem tekstu: słownik, czyszczenie oparte na regułach, wyjątki per aplikacja i opcjonalny szlif lokalnym LLM.
Każde dyktowanie przechodzi na Twoim Macu przez ten sam krótki potok. Nic tutaj nie korzysta z sieci.
Potok przetwarzania
Zamiana mowy na tekst wybranym silnikiem.
Zamiany z własnego słownika, stosowane zawsze.
Czyszczenie — regułowe albo lokalnym LLM, jeśli je włączyłeś — tylko wtedy, gdy poprawianie jest włączone dla aplikacji na wierzchu.
Wstawianie przez wklejenie albo wpisywanie.
Czyszczenie oparte na regułach
To pełny zestaw reguł. Czyszczenie nie usuwa falstartów ani słowa "like".
- Usuwa samodzielne "um", "uh", "erm" oraz dwuwyrazowe "you know", dopasowując wyłącznie całe wyrazy.
- Skleja bezpośrednie powtórzenia wyrazów, więc "the the" staje się "the".
- Redukuje nadmiarowe odstępy.
- Zapisuje pierwszą literę wielką.
- Dodaje kropkę, jeśli tekst kończy się literą albo cyfrą.
Wyjątki per aplikacja
Settings › Enhancement › "Clean up transcripts by default" jest włączone. Wyjątki są zapisywane po identyfikatorze bundle aplikacji. "Add current app…" dodaje ostatnią aplikację inną niż Keebye, z ustawieniem odwrotnym do domyślnego. Każdy wpis ma pole wyboru i przycisk "Remove".
Własny słownik
Settings › Dictionary: "Replace spoken words with fixed spellings." Wpisz to, co Keebye słyszy, w polu "heard as…", a pisownię, jakiej chcesz, w polu "write as…", i naciśnij Add (Enter też działa). Remove usuwa wpis. Pusta lista pokazuje "No replacements yet."
- Dopasowuje tylko całe wyrazy, nigdy fragmentu dłuższego słowa.
- Dopasowanie ignoruje wielkość liter; zamiana zachowuje pisownię, którą wpisałeś.
- Klucz może mieć kilka wyrazów. Wygrywa najdłuższe dopasowanie.
- Stosowane do każdego dyktowania, niezależnie od tego, czy czyszczenie jest włączone dla danej aplikacji.
Szlif lokalnym LLM (opcjonalny)
Keebye może oddać transkrypcję lokalnemu modelowi językowemu zamiast czyszczenia regułowego. Modelem jest Qwen3-1.7B (Q4_K_M GGUF, około 1,28 GB) uruchamiany przez llama.cpp z Metalem. Używa zachłannego próbkowania z wyłączonym myśleniem, limitu 64 tokenów i terminu 2 sekund. Każda awaria oznacza powrót do czyszczenia regułowego.
Zanim wynik LLM zostanie użyty, sprawdza go strażnik wierności: wynik musi zachować co najmniej połowę wystąpień wyrazów z wejścia, nie przekroczyć podwójnej liczby wyrazów wejściowych plus cztery, nie zawierać zdania ani czterowyrazowej frazy powtórzonej trzy razy lub więcej, i nie być pusty. W przeciwnym razie wynik LLM jest odrzucany.