Sari la conținutul documentației
Keebye Docs

Curățare și dicționar

Ce se întâmplă cu transcrierea între conversia vorbirii în text și inserare: dicționarul, curățarea pe bază de reguli, excepțiile per aplicație și șlefuirea opțională cu LLM local.

Fiecare dictare trece prin același lanț scurt de pași, pe Mac-ul tău. Nimic de aici nu folosește rețeaua.

Lanțul de pași

  1. Conversia vorbirii în text, cu motorul selectat.

  2. Înlocuirile din dicționarul personalizat, aplicate întotdeauna.

  3. Curățarea — pe bază de reguli, sau cu LLM-ul local dacă ai activat-o — doar când îmbunătățirea e activă pentru aplicația din prim-plan.

  4. Inserarea prin lipire sau prin tastare.

Curățarea pe bază de reguli

Acesta e setul complet de reguli. Curățarea nu elimină începuturile greșite și nici cuvântul "like".

  • Elimină "um", "uh" și "erm" izolate, precum și "you know" din două cuvinte, potrivind doar tokenuri întregi.
  • Comasează repetările imediate de cuvinte, așa că "the the" devine "the".
  • Comasează spațiile albe.
  • Scrie prima literă cu majusculă.
  • Adaugă un punct dacă textul se termină cu o literă sau o cifră.

Excepții per aplicație

Settings › Enhancement › "Clean up transcripts by default" e activ. Excepțiile sunt identificate prin bundle id-ul aplicației. "Add current app…" adaugă ultima aplicație non-Keebye folosită, cu opusul valorii implicite. Fiecare intrare are o bifă și un buton "Remove".

Dicționar personalizat

Settings › Dictionary: "Replace spoken words with fixed spellings." Scrie ce aude Keebye în "heard as…" și ortografia pe care o vrei în "write as…", apoi apasă Add (merge și Enter). Remove șterge o intrare. Starea goală spune "No replacements yet."

  • Se potrivește doar cu cuvinte întregi, niciodată în interiorul unui cuvânt mai lung.
  • Potrivirea ignoră majusculele; înlocuirea păstrează forma pe care ai scris-o.
  • Cheile pot avea mai multe cuvinte. Câștigă potrivirea cea mai lungă.
  • Se aplică la fiecare dictare, indiferent dacă curățarea e activă pentru aplicația respectivă.

Șlefuire cu LLM local (opțională)

Keebye poate da transcrierea unui model de limbaj local, în locul curățării pe bază de reguli. Modelul e Qwen3-1.7B (Q4_K_M GGUF, aproximativ 1,28 GB), rulat prin llama.cpp cu Metal. Folosește eșantionare greedy, cu raționamentul dezactivat, o limită de 64 de tokenuri și un termen de 2 secunde. Orice eșec revine la curățarea pe bază de reguli.

O verificare de fidelitate se uită la rezultatul LLM-ului înainte să fie folosit: trebuie să păstreze cel puțin jumătate din aparițiile cuvintelor din intrare, să nu depășească dublul numărului de cuvinte din intrare plus patru, să nu conțină nicio propoziție sau secvență de patru cuvinte repetată de trei ori sau mai mult și să nu fie gol. Altfel, rezultatul LLM-ului e aruncat.