Очищення і словник
Що відбувається з розшифровкою між розпізнаванням мовлення і вставкою: словник, очищення за правилами, перевизначення для окремих застосунків і необовязкове шліфування локальною LLM.
Кожне диктування проходить один і той самий короткий конвеєр на вашому Mac. Мережа тут не використовується ніде.
Конвеєр
Розпізнавання мовлення вибраним рушієм.
Заміни з власного словника — застосовуються завжди.
Очищення — за правилами або локальною LLM, якщо ви її увімкнули — лише коли для активного застосунку увімкнене покращення.
Вставка через буфер обміну або набором.
Очищення за правилами
Це повний набір правил. Очищення не прибирає обірвані початки фраз і слово "like".
- Видаляє окремо розташовані "um", "uh", "erm" і двослівне "you know", збігаючись лише з цілими словами.
- Згортає повтори слів, що йдуть підряд: "the the" стає "the".
- Стискає пробіли.
- Робить першу літеру великою.
- Додає точку, якщо текст закінчується літерою або цифрою.
Перевизначення для окремих застосунків
Settings › Enhancement › "Clean up transcripts by default" увімкнено. Перевизначення привязані до bundle id застосунку. "Add current app…" додає останній застосунок, яким ви користувалися (крім Keebye), зі значенням, протилежним до значення за замовчуванням. У кожного запису є галочка і кнопка "Remove".
Власний словник
Settings › Dictionary: "Replace spoken words with fixed spellings." Введіть те, що чує Keebye, у поле "heard as…", а потрібне написання — у "write as…", потім натисніть Add (Enter теж працює). Remove видаляє запис. Порожній стан виглядає як "No replacements yet."
- Збігається лише з цілими словами, ніколи всередині довшого слова.
- Порівняння не враховує регістр; заміна зберігає той регістр, який ви ввели.
- Ключ може складатися з кількох слів. Перемагає найдовший збіг.
- Застосовується до кожного диктування, незалежно від того, чи увімкнене очищення для застосунку.
Шліфування локальною LLM (за бажанням)
Keebye може передати розшифровку локальній мовній моделі замість очищення за правилами. Модель — Qwen3-1.7B (Q4_K_M GGUF, близько 1.28 GB), працює через llama.cpp з Metal. Використовується жадібне семплювання з вимкненим міркуванням, обмеження в 64 токени і дедлайн 2 секунди. Будь-який збій відкочує до очищення за правилами.
Перед використанням вивід LLM перевіряє захист точності: він повинен зберегти не менше половини входжень слів початкового тексту, не перевищувати подвійну кількість слів початкового тексту плюс чотири, не містити реченння чи чотирислівної фрази, повтореної три рази й більше, і не бути порожнім. Інакше вивід LLM відкидається.