Към съдържанието на документацията
Документация на Keebye

Изчистване и речник

Какво се случва с транскрипцията ви между разпознаването на реч и вмъкването: речникът, изчистването по правила, изключенията за отделни приложения и дошлифоването с локален LLM по избор.

Всяка диктовка минава през един и същ кратък конвейер на вашия Mac. Нищо тук не използва мрежата.

Конвейерът

  1. Превръщане на реч в текст с избрания двигател.

  2. Замени от собствения речник, прилагат се винаги.

  3. Изчистване — по правила или с локалния LLM, ако сте го включили — само когато подобряването е включено за приложението най-отпред.

  4. Вмъкване чрез поставяне или писане.

Изчистване по правила

Това е пълният набор от правила. Изчистването не премахва започнати наново фрази, нито думата "like".

  • Премахва самостоятелните "um", "uh", "erm" и двусловното "you know", като съвпада само с цели думи.
  • Свива непосредствените повторения на думи, така че "the the" става "the".
  • Свива празните места.
  • Прави първата буква главна.
  • Добавя точка, ако текстът завършва с буква или цифра.

Изключения за отделни приложения

Settings › Enhancement › "Clean up transcripts by default" е включено. Изключенията се задават по bundle id на приложението. "Add current app…" добавя последното приложение, различно от Keebye, което сте използвали, с обратната на стойността по подразбиране. Всеки запис има поле за отметка и бутон "Remove".

Собствен речник

Settings › Dictionary: "Replace spoken words with fixed spellings." Въведете това, което Keebye чува, в "heard as…", и изписването, което искате, в "write as…", после натиснете Add (Enter също работи). Remove изтрива запис. Празното състояние гласи "No replacements yet."

  • Съвпада само с цели думи, никога вътре в по-дълга дума.
  • Съвпадението не различава малки и главни букви; заместващият текст запазва изписването, което сте въвели.
  • Ключовете могат да са от няколко думи. Най-дългото съвпадение печели.
  • Прилага се при всяка диктовка, независимо дали изчистването е включено за приложението.

Дошлифоване с локален LLM (по избор)

Keebye може да подаде транскрипцията на локален езиков модел вместо на изчистването по правила. Моделът е Qwen3-1.7B (Q4_K_M GGUF, около 1,28 GB) и работи през llama.cpp с Metal. Използва greedy sampling с изключено мислене, ограничение от 64 токена и краен срок от 2 секунди. Всяка неуспешна обработка се връща към изчистването по правила.

Предпазител за точност проверява изхода на LLM, преди да бъде използван: той трябва да запази поне половината от срещанията на думи от входа, да не надхвърля двойния брой думи на входа плюс четири, да не съдържа изречение или четирисловна фраза, повторена три или повече пъти, и да не е празен. В противен случай изходът на LLM се отхвърля.