Перейти до вмісту документації
Keebye Docs

Очищення і словник

Що відбувається з розшифровкою між розпізнаванням мовлення і вставкою: словник, очищення за правилами, перевизначення для окремих застосунків і необовязкове шліфування локальною LLM.

Кожне диктування проходить один і той самий короткий конвеєр на вашому Mac. Мережа тут не використовується ніде.

Конвеєр

  1. Розпізнавання мовлення вибраним рушієм.

  2. Заміни з власного словника — застосовуються завжди.

  3. Очищення — за правилами або локальною LLM, якщо ви її увімкнули — лише коли для активного застосунку увімкнене покращення.

  4. Вставка через буфер обміну або набором.

Очищення за правилами

Це повний набір правил. Очищення не прибирає обірвані початки фраз і слово "like".

  • Видаляє окремо розташовані "um", "uh", "erm" і двослівне "you know", збігаючись лише з цілими словами.
  • Згортає повтори слів, що йдуть підряд: "the the" стає "the".
  • Стискає пробіли.
  • Робить першу літеру великою.
  • Додає точку, якщо текст закінчується літерою або цифрою.

Перевизначення для окремих застосунків

Settings › Enhancement › "Clean up transcripts by default" увімкнено. Перевизначення привязані до bundle id застосунку. "Add current app…" додає останній застосунок, яким ви користувалися (крім Keebye), зі значенням, протилежним до значення за замовчуванням. У кожного запису є галочка і кнопка "Remove".

Власний словник

Settings › Dictionary: "Replace spoken words with fixed spellings." Введіть те, що чує Keebye, у поле "heard as…", а потрібне написання — у "write as…", потім натисніть Add (Enter теж працює). Remove видаляє запис. Порожній стан виглядає як "No replacements yet."

  • Збігається лише з цілими словами, ніколи всередині довшого слова.
  • Порівняння не враховує регістр; заміна зберігає той регістр, який ви ввели.
  • Ключ може складатися з кількох слів. Перемагає найдовший збіг.
  • Застосовується до кожного диктування, незалежно від того, чи увімкнене очищення для застосунку.

Шліфування локальною LLM (за бажанням)

Keebye може передати розшифровку локальній мовній моделі замість очищення за правилами. Модель — Qwen3-1.7B (Q4_K_M GGUF, близько 1.28 GB), працює через llama.cpp з Metal. Використовується жадібне семплювання з вимкненим міркуванням, обмеження в 64 токени і дедлайн 2 секунди. Будь-який збій відкочує до очищення за правилами.

Перед використанням вивід LLM перевіряє захист точності: він повинен зберегти не менше половини входжень слів початкового тексту, не перевищувати подвійну кількість слів початкового тексту плюс чотири, не містити реченння чи чотирислівної фрази, повтореної три рази й більше, і не бути порожнім. Інакше вивід LLM відкидається.