Chuyển đến nội dung tài liệu
Tài liệu Keebye

Dọn dẹp và từ điển

Chuyện gì xảy ra với bản transcript của bạn giữa lúc chuyển giọng nói thành văn bản và lúc chèn: từ điển, dọn dẹp theo quy tắc, override theo ứng dụng và bước đánh bóng bằng LLM cục bộ mà bạn phải tự bật.

Mọi lượt đọc đều đi qua cùng một chuỗi xử lý ngắn ngay trên máy Mac của bạn. Không bước nào ở đây dùng đến mạng.

Chuỗi xử lý

  1. Chuyển giọng nói thành văn bản bằng engine đã chọn.

  2. Thay thế theo từ điển tùy chỉnh, luôn được áp dụng.

  3. Dọn dẹp — theo quy tắc, hoặc bằng LLM cục bộ nếu bạn đã tự bật — chỉ khi tính năng cải thiện đang bật cho ứng dụng ở phía trước.

  4. Chèn bằng paste hoặc gõ mô phỏng.

Dọn dẹp theo quy tắc

Đây là toàn bộ tập quy tắc. Việc dọn dẹp không loại bỏ những câu nói dở dang hay từ "like".

  • Loại bỏ "um", "uh", "erm" khi đứng một mình, và cụm hai từ "you know", chỉ khớp trọn token.
  • Gộp các từ lặp liền nhau, nên "the the" thành "the".
  • Gộp khoảng trắng.
  • Viết hoa chữ cái đầu.
  • Thêm dấu chấm nếu văn bản kết thúc bằng một chữ cái hoặc chữ số.

Override theo ứng dụng

Settings › Enhancement › "Clean up transcripts by default" đang bật. Các override được đánh khóa theo bundle id của ứng dụng. "Add current app…" thêm ứng dụng không phải Keebye mà bạn dùng gần nhất, với giá trị trái ngược với mặc định. Mỗi dòng có một hộp kiểm và một nút "Remove".

Từ điển tùy chỉnh

Settings › Dictionary: "Replace spoken words with fixed spellings." Nhập điều Keebye nghe được vào "heard as…" và cách viết bạn muốn vào "write as…", rồi nhấn Add (Enter cũng được). Remove xóa một dòng. Trạng thái rỗng hiện "No replacements yet."

  • Chỉ khớp trọn từ, không bao giờ khớp bên trong một từ dài hơn.
  • Việc khớp không phân biệt chữ hoa chữ thường; phần thay thế giữ đúng kiểu chữ bạn đã nhập.
  • Khóa có thể gồm nhiều từ. Kết quả khớp dài nhất thắng.
  • Được áp dụng cho mọi lượt đọc, dù việc dọn dẹp có bật cho ứng dụng đó hay không.

Đánh bóng bằng LLM cục bộ (phải tự bật)

Keebye có thể đưa bản transcript cho một mô hình ngôn ngữ cục bộ thay vì dọn dẹp theo quy tắc. Model là Qwen3-1.7B (Q4_K_M GGUF, khoảng 1.28 GB) chạy qua llama.cpp với Metal. Nó dùng greedy sampling, tắt phần suy luận, giới hạn 64 token và thời hạn 2 giây. Mọi thất bại đều quay về dọn dẹp theo quy tắc.

Một lớp bảo vệ độ trung thực kiểm tra đầu ra của LLM trước khi dùng: nó phải giữ ít nhất một nửa số lần xuất hiện của các từ trong đầu vào, không vượt quá hai lần số từ đầu vào cộng bốn, không chứa câu hay cụm bốn từ nào lặp lại ba lần hoặc hơn, và không được rỗng. Nếu không, đầu ra của LLM bị loại bỏ.