การเก็บกวาดและพจนานุกรม
เกิดอะไรขึ้นกับข้อความถอดเสียงระหว่าง speech-to-text กับการแทรก: พจนานุกรม การเก็บกวาดตามกฎ การตั้งค่าแยกรายแอป และการขัดเกลาด้วย LLM ในเครื่องแบบเลือกเปิดเอง
การพิมพ์ด้วยเสียงทุกครั้งผ่าน pipeline สั้น ๆ ชุดเดียวกันบน Mac ของคุณ ไม่มีขั้นตอนใดในนี้ใช้เครือข่ายเลย
Pipeline
speech-to-text ด้วยเอนจินที่เลือกไว้
การแทนที่จากพจนานุกรมส่วนตัว ใช้เสมอ
การเก็บกวาด — ตามกฎ หรือด้วย LLM ในเครื่องหากคุณเลือกเปิดไว้ — เฉพาะเมื่อเปิดการปรับแต่งสำหรับแอปที่อยู่หน้าสุด
การแทรกด้วยการวางหรือการพิมพ์
การเก็บกวาดตามกฎ
นี่คือชุดกฎทั้งหมด การเก็บกวาดไม่ได้ตัดการเริ่มพูดผิด ๆ ออก และไม่ตัดคำว่า "like"
- ตัดคำ "um", "uh", "erm" ที่อยู่เดี่ยว ๆ และวลีสองคำ "you know" ออก โดยจับคู่เฉพาะทั้งโทเคนเท่านั้น
- ยุบคำที่ซ้ำติดกันทันที เช่น "the the" กลายเป็น "the"
- ยุบช่องว่างให้เหลือเท่าที่จำเป็น
- เปลี่ยนอักษรตัวแรกเป็นตัวใหญ่
- เติมจุดท้ายประโยคหากข้อความจบด้วยตัวอักษรหรือตัวเลข
ค่าแยกรายแอป
Settings › Enhancement › "Clean up transcripts by default" เปิดอยู่ ค่าแยกรายแอปอ้างอิงด้วย bundle id ของแอป ปุ่ม "Add current app…" จะเพิ่มแอปที่ไม่ใช่ Keebye ตัวล่าสุดที่คุณใช้ โดยตั้งค่าตรงข้ามกับค่าเริ่มต้น แต่ละรายการมีช่องทำเครื่องหมายและปุ่ม "Remove"
พจนานุกรมส่วนตัว
Settings › Dictionary: "Replace spoken words with fixed spellings." พิมพ์สิ่งที่ Keebye ได้ยินลงในช่อง "heard as…" และการสะกดที่คุณต้องการลงในช่อง "write as…" แล้วกด Add (กด Enter ก็ได้) ปุ่ม Remove ลบรายการทิ้ง สถานะว่างเปล่าจะแสดง "No replacements yet."
- จับคู่เฉพาะทั้งคำ ไม่จับคู่ภายในคำที่ยาวกว่า
- การจับคู่ไม่สนใจตัวพิมพ์เล็กใหญ่ ส่วนคำแทนที่จะคงรูปแบบตัวพิมพ์ตามที่คุณพิมพ์ไว้
- คีย์เป็นหลายคำได้ คู่ที่ยาวที่สุดชนะ
- ใช้กับการพิมพ์ด้วยเสียงทุกครั้ง ไม่ว่าจะเปิดการเก็บกวาดสำหรับแอปนั้นหรือไม่ก็ตาม
การขัดเกลาด้วย LLM ในเครื่อง (เลือกเปิดเอง)
Keebye ส่งข้อความถอดเสียงให้โมเดลภาษาในเครื่องแทนการเก็บกวาดตามกฎได้ โมเดลคือ Qwen3-1.7B (Q4_K_M GGUF ราว 1.28 GB) ที่รันผ่าน llama.cpp ด้วย Metal มันใช้ greedy sampling โดยปิดการคิดเป็นขั้นตอน จำกัดที่ 64 โทเคน และมีเส้นตายที่ 2 วินาที หากล้มเหลวไม่ว่าด้วยเหตุใด ระบบจะกลับไปใช้การเก็บกวาดตามกฎ
ตัวป้องกันความถูกต้องจะตรวจผลลัพธ์ของ LLM ก่อนนำไปใช้: ต้องคงจำนวนคำที่ปรากฏในข้อความต้นทางไว้อย่างน้อยครึ่งหนึ่ง ต้องไม่เกินสองเท่าของจำนวนคำต้นทางบวกสี่ ต้องไม่มีประโยคหรือวลีสี่คำใดซ้ำตั้งแต่สามครั้งขึ้นไป และต้องไม่ว่างเปล่า มิฉะนั้นผลลัพธ์ของ LLM จะถูกทิ้ง