Povedz, čo som povedal: diktovanie bez prepisovania od AI
AI prepisuje diktovanie: stráca spresnenia, obracia význam. Prečo doladenie cez LLM parafrázuje vaše slová a Keebye zostáva doslovné.
O diktovaní vylepšovanom AI existuje sťažnosť, ktorá znie paradoxne, kým si ju neprežijete: prepis bol v poriadku — pokazilo to to, čo sa stalo po prepise. Povedali ste jednu vec a nástroj doručil vyhladenú, sebavedomú, trochu inú vec. Spresnenie potichu vypadlo. Opatrná formulácia odstránená. Veta prestavaná na niečo, čo by ste nikdy nepovedali. A v najhoršej podobe tohto vzorca — v tej, pre ktorú ľudia nástroj na mieste zahodia — sa preklopí význam. Z „Nenasadzuj, kým neprejdú testy“ vyjde na druhom konci inštrukcia o nasadzovaní, bez toho ne-.
Pri príležitostnom diktovaní je to otrava. Pri tom, ako diktovanie naozaj používam — kŕmim promptami Claude Code, pracovný postup z textu Riadenie Claude Code hlasom —, je to jed. Kódovací agent berie vaše slová ako špecifikáciu. Nevie, že vás váš nástroj na diktovanie parafrázoval. Ak sa spresnenie, ktoré robilo inštrukciu bezpečnou, kdesi medzi vašimi ústami a terminálom vyhladilo preč, agent vesele vykoná vyhladenú verziu. Presnosť je celým zmyslom promptu a vrstva prepisovania od AI je stroj na odstraňovanie presnosti, ktorý pritom výsledok robí premyslenejším na pohľad.
Prečo AI nástroje na diktovanie prepisujú, čo ste povedali?
Odpoveď na úrovni kategórie nie je, že by si niekto zaumienil skresľovať reč. Je v tom, že „upratať tento prepis“ je naozaj lákavá funkcia a zrejmým spôsobom, ako ju postaviť, je prehnať surový prepis cez jazykový model.
Surová reč je neupratovaná — výplňové slová, falošné štarty, opakované slová, chýbajúca interpunkcia. LLM požiadaný, aby to upratal, vyprodukuje nádherný výstup. Problémom je, že jazykový model neupravuje tak, ako upravuje ľudský korektor, keď škrtne „ehm“. Regeneruje. Výstupom je nový text, ktorý model považuje za dobrú verziu vášho vstupu, a práve v tom „dobrom“ vám uniká váš zámer. Modely trénované smerom k ochote a plynulosti majú názory: opatrné formulácie vyzerajú ako šum, spresnenia vyzerajú ako neporiadok, neohrabaná, ale presná formulácia vyzerá ako niečo na vylepšenie. Väčšinou je prepísanie neškodné. Je však pravdepodobnostné a z výstupu nedokážete povedať, ktoré vety boli prepísané a ktoré zložené. Vyhladenie je rovnomerné; vernosť nie.
To je hlboký problém liniek s doladením cez LLM: zlyhávajú potichu a sebavedomo. Rozpoznávač reči, ktorý vás zle počuje, zvyčajne vyprodukuje niečo viditeľne nesprávne. Vrstva prepisovania, ktorá vás zradí, vyprodukuje niečo viditeľne správne — gramatické, uveriteľné, oblečené do vášho hlasu — a presne preto sa obrátené „nenasadzuj“ odošle namiesto toho, aby ste ho zachytili.
Doslovné predvolene
Postoj Keebye je jednoduchý: to, čo počul model na prevod reči na text, je to, čo pristane pri vašom kurzore. Predvolene medzi prepisom a vaším terminálom nesedí žiadny jazykový model, ktorý by skladal lepšiu verziu vás — predvolenou fázou doladenia je krátky zoznam deterministických pravidiel, a to je všetko.
Je to zámerná stávka a pochádza z použitia pri vibe codingu. Keď je vaše diktovanie riadiacim kanálom pre kódovacích agentov, úlohou nástroja je preprava, nie autorstvo. Autorom ste vy; agent je publikum; vrstva diktovania nemá mať názory. Ten pracovný postup — vyslovovať celé prompty namiesto ich písania — je rozpísaný v texte hlasové diktovanie pre AI prompty.
Doladenie cez LLM v Keebye existuje — dostanem sa k nemu —, ale zapína sa dobrovoľne, beží úplne na vašom počítači a funguje pod strážcom navrhnutým tak, aby odmietol bežné formy odklonu, nekontrolovaného rozpínania a opakovania. Ak výstup túto kontrolu neprejde, Keebye sa vráti k pravidlám. Predvolené zostávajú pravidlá.
Čo teda to čistenie textu vlastne robí?
Doslovné nemusí znamenať surové. Keebye prináša voliteľný priechod čistenia — vylepšenie, predvolene zapnuté a prebiteľné pre jednotlivé aplikácie —, ale je založené na pravidlách, nie na modeli, a úplný zoznam toho, čo robí, sa zmestí do jedného odseku.
Odstráni samostatne stojace výplňové slová (um, uh, erm, you know). Zlúči bezprostredné opakovania slov — z „the the“ sa stane „the“. Zlúči biele znaky. Prvé písmeno zmení na veľké a doplní koncovú bodku, ak ste vetu neukončili. To je celý zoznam. Pravidlá sú deterministické a úzko vymedzené; zámerne nepreskupujú vetné členy, neodstraňujú zápory ani nenahrádzajú slová synonymami.
Skôr než sa čistenie spustí, uplatnia sa vaše nahradenia zo slovníka — používateľom definované zámeny pre žargón a vlastné mená, ktoré rečové modely mrzačia, takže „pnpm“ a názvy vašich modulov dorazia napísané tak, ako ich píše váš kód.
A ak je pre vás aj priechod založený na pravidlách väčším zásahom, než chcete, vylepšenie vypnite a Keebye vloží surový prepis z rečového modelu: s výplňovými slovami, opakovaniami a všetkým. V niektorých kontextoch — keď niekoho citujete, keď diktujete do poľa, kde koncová bodka rozbíja veci — je surový prepis lepšou voľbou a prebitie pre jednotlivé aplikácie vám ho umožní zvoliť.
Dobrovoľné doladenie a strážca vernosti okolo neho
Teraz ten LLM, ku ktorému som sľúbil, že sa dostanem. Pre ľudí, ktorí chcú múdrejšie čistenie, ponúka Keebye voliteľný režim doladenia (polish_mode nastavený na local_llm): malý model Qwen3 bežiaci priamo na zariadení cez llama.cpp, akcelerovaný cez Metal, nič sa nikam neposiela. Jeho inštrukcie sú úzkou verziou doladenia — oprav interpunkciu a veľké písmená, odstráň výplňové slová, zachovaj presné slová, jazyk a význam používateľa, zachovaj kód a názvy súborov doslovne. Generovanie je deterministické (greedy sampling, ten istý vstup → ten istý výstup) a má strop; ak model zamrzne za hranicou dvojsekundového termínu, jeho výstup sa zahodí.
Inštrukcie sú však nádeje a tento článok existuje preto, lebo nádeje nie sú zárukami. Každý výsledok doladený LLM preto prejde cez strážcu vernosti, než sa smie dotknúť vášho kurzora. Výstup si musí zachovať aspoň 50 % tokenov pôvodného prepisu. Nesmie sa nafúknuť — čokoľvek nad zhruba dvojnásobkom pôvodnej dĺžky (plus štyri tokeny) neprejde. Nekontrolované opakovanie sa deteguje. Ak doladený výsledok jednu z týchto kontrol neprejde, Keebye ho zahodí a vráti sa namiesto neho k čisteniu podľa pravidiel.
Tento strážca zachytí ťažkú stratu tokenov, nekontrolované rozpínanie a opakovanie skôr, než výstup modelu stihne nahradiť prepis vyčistený pravidlami. Je to heuristika, nie sémantický dôkaz: krátke prepísanie alebo zmenený zápor by cez jeho prahy stále mohli prejsť. Ak si spresnenie nemôže dovoliť ujsť, nechajte doladenie cez AI vypnuté a vložený text si pred odoslaním skontrolujte.
Úprimné limity
Doslovné znamená doslovné. Ak sa rozkecáte, pristane vaše rozkecanie — aj dobrovoľné doladenie je inštruované a strážené smerom k čisteniu, nie ku komponovaniu, takže Keebye nespraví z motajúcej sa myšlienky ostrú inštrukciu. Disciplína hovoriť to, čo myslíte, zostáva na vás.
Čistenie podľa pravidiel je zámerne hlúpe. Odstráni „um“; neopraví vám gramatiku, neprestavia rozbiehavú vetu a nevšimne si, že ste si protirečili. Čokoľvek múdrejšie by znovu zaviedlo tie rozhodnutia podľa úsudku, kvôli ktorých vyhnutiu tento návrh existuje.
A vernosť chráni pred prepisovaním, nie pred zlým rozpoznaním. Ak rečový model počuje „cache“ ako „cash“, tá chyba sa verne zachová — strážca netuší, čo ste chceli povedať, iba to, čo bolo prepísané. Doslovné diktovanie presúva hranicu dôvery na model prevodu reči na text; neodstraňuje ju. (Súvisiace: ak je vaším problémom, že model prepisuje úplne v nesprávnom jazyku, je to iné zlyhanie s iným riešením — pripnite si jazyk diktovania.)
A napokon rámovanie celej kategórie: doladenie cez AI nie je podvod a veľa používateľov naozaj uprednostní výstup, ktorý sa číta hladšie, než ako hovoria. Ak ste to vy, iné nástroje sa do toho opierajú dobre a naše porovnania to hovoria úprimne — Keebye vs Wispr Flow aj Keebye vs Superwhisper obsahujú skutočnú sekciu „kedy sedí ten druhý nástroj lepšie“.
Preprava, nie autorstvo
Dohoda, ktorú Keebye ponúka, je zámerne úzka: vy hovoríte a ľahko vyčistený prepis pristane tam, kde je váš kurzor. Keď sú tie slová promptami pre agenta, ktorý podľa nich doslovne koná, je úzkosť funkciou. Najdrahšia vec, ktorú môže nástroj na diktovanie vývojárovi spraviť, nie je preklep. Je to plynulá veta, ktorú ste nikdy nepovedali.
Keebye je v predbežnom prístupe pre macOS. Spustite bezplatnú skúšobnú verziu nižšie, nadiktujte „Nenasadzuj, kým neprejdú testy“ a skontrolujte, či presne toto obmedzenie prežije čistenie. Tento test je celý produkt.
Otestujte inštrukciu, ktorá si nemôže dovoliť ujsť
Spustite bezplatnú skúšobnú verziu a nadiktujte prompt s kritickým spresnením — najmä so záporom — a potom si pozrite, čo dorazí.
Start free trialEarly access: we'll email you the moment the macOS build is ready — your 14 days start when you first sign in from the app.
Čítať ďalej
Diktovanie promptov paralelným agentom, dráha po dráhe
Keď bežia dvaja či traja kódovací agenti naraz, úzkym hrdlom sa stáva promptovanie. Hlasový postup, ako kŕmiť paralelné dráhy bez opustenia tej svojej.
Riadenie Claude Code hlasom: stavanie v paralelných dráhach
AI agenti spravili z písania úzke hrdlo. Praktický postup na diktovanie promptov, revízií a korekcií v paralelných agentných dráhach na macOS.
Diktovanie, ktoré prežije terminál
Vkladanie diktovania potichu zlyháva v termináloch, SSH, tmux a non-QWERTY rozloženiach. Prečo tam schránka zlyháva a čo robí režim písania.