ข้ามไปยังเนื้อหาเอกสาร
Keebye Docs

การเก็บกวาดและพจนานุกรม

เกิดอะไรขึ้นกับข้อความถอดเสียงระหว่าง speech-to-text กับการแทรก: พจนานุกรม การเก็บกวาดตามกฎ การตั้งค่าแยกรายแอป และการขัดเกลาด้วย LLM ในเครื่องแบบเลือกเปิดเอง

การพิมพ์ด้วยเสียงทุกครั้งผ่าน pipeline สั้น ๆ ชุดเดียวกันบน Mac ของคุณ ไม่มีขั้นตอนใดในนี้ใช้เครือข่ายเลย

Pipeline

  1. speech-to-text ด้วยเอนจินที่เลือกไว้

  2. การแทนที่จากพจนานุกรมส่วนตัว ใช้เสมอ

  3. การเก็บกวาด — ตามกฎ หรือด้วย LLM ในเครื่องหากคุณเลือกเปิดไว้ — เฉพาะเมื่อเปิดการปรับแต่งสำหรับแอปที่อยู่หน้าสุด

  4. การแทรกด้วยการวางหรือการพิมพ์

การเก็บกวาดตามกฎ

นี่คือชุดกฎทั้งหมด การเก็บกวาดไม่ได้ตัดการเริ่มพูดผิด ๆ ออก และไม่ตัดคำว่า "like"

  • ตัดคำ "um", "uh", "erm" ที่อยู่เดี่ยว ๆ และวลีสองคำ "you know" ออก โดยจับคู่เฉพาะทั้งโทเคนเท่านั้น
  • ยุบคำที่ซ้ำติดกันทันที เช่น "the the" กลายเป็น "the"
  • ยุบช่องว่างให้เหลือเท่าที่จำเป็น
  • เปลี่ยนอักษรตัวแรกเป็นตัวใหญ่
  • เติมจุดท้ายประโยคหากข้อความจบด้วยตัวอักษรหรือตัวเลข

ค่าแยกรายแอป

Settings › Enhancement › "Clean up transcripts by default" เปิดอยู่ ค่าแยกรายแอปอ้างอิงด้วย bundle id ของแอป ปุ่ม "Add current app…" จะเพิ่มแอปที่ไม่ใช่ Keebye ตัวล่าสุดที่คุณใช้ โดยตั้งค่าตรงข้ามกับค่าเริ่มต้น แต่ละรายการมีช่องทำเครื่องหมายและปุ่ม "Remove"

พจนานุกรมส่วนตัว

Settings › Dictionary: "Replace spoken words with fixed spellings." พิมพ์สิ่งที่ Keebye ได้ยินลงในช่อง "heard as…" และการสะกดที่คุณต้องการลงในช่อง "write as…" แล้วกด Add (กด Enter ก็ได้) ปุ่ม Remove ลบรายการทิ้ง สถานะว่างเปล่าจะแสดง "No replacements yet."

  • จับคู่เฉพาะทั้งคำ ไม่จับคู่ภายในคำที่ยาวกว่า
  • การจับคู่ไม่สนใจตัวพิมพ์เล็กใหญ่ ส่วนคำแทนที่จะคงรูปแบบตัวพิมพ์ตามที่คุณพิมพ์ไว้
  • คีย์เป็นหลายคำได้ คู่ที่ยาวที่สุดชนะ
  • ใช้กับการพิมพ์ด้วยเสียงทุกครั้ง ไม่ว่าจะเปิดการเก็บกวาดสำหรับแอปนั้นหรือไม่ก็ตาม

การขัดเกลาด้วย LLM ในเครื่อง (เลือกเปิดเอง)

Keebye ส่งข้อความถอดเสียงให้โมเดลภาษาในเครื่องแทนการเก็บกวาดตามกฎได้ โมเดลคือ Qwen3-1.7B (Q4_K_M GGUF ราว 1.28 GB) ที่รันผ่าน llama.cpp ด้วย Metal มันใช้ greedy sampling โดยปิดการคิดเป็นขั้นตอน จำกัดที่ 64 โทเคน และมีเส้นตายที่ 2 วินาที หากล้มเหลวไม่ว่าด้วยเหตุใด ระบบจะกลับไปใช้การเก็บกวาดตามกฎ

ตัวป้องกันความถูกต้องจะตรวจผลลัพธ์ของ LLM ก่อนนำไปใช้: ต้องคงจำนวนคำที่ปรากฏในข้อความต้นทางไว้อย่างน้อยครึ่งหนึ่ง ต้องไม่เกินสองเท่าของจำนวนคำต้นทางบวกสี่ ต้องไม่มีประโยคหรือวลีสี่คำใดซ้ำตั้งแต่สามครั้งขึ้นไป และต้องไม่ว่างเปล่า มิฉะนั้นผลลัพธ์ของ LLM จะถูกทิ้ง