Alle grote AI-programmeertools kregen het afgelopen jaar spraakinvoer, dus de
eerste vraag is niet langer of u een prompt kunt dicteren. Claude Code heeft
/voice, Cursor heeft spraakinvoer met een ingedrukte toets in het
Agents-venster, en VS Code heeft dicteren ingebouwd in de chat, de editor en de
terminal.
De vraag die overblijft is smaller en nuttiger: elk van deze tools dekt het ene vak waarin u met het model praat, en geen ervan dekt de twintig andere plekken waar een ontwikkelaar de hele dag tekst typt. Dat gat is het hele argument voor een systeembrede dicteertool, en het is meteen de reden dat het interessante effect van voice coding geen snelheid is — het is dat gesproken prompts drie keer langer uitvallen dan getypte, en dat die extra lengte precies de context is die het model miste.
De feiten over andere tools hieronder zijn gecontroleerd op 17 augustus 2026.
| Tool | Hoe u het start | Waar het werkt | Waar de audio heen gaat |
|---|---|---|---|
| Claude Code | /voice, daarna Space ingedrukt houden (of één keer tikken om te starten en nog een keer om te versturen) |
CLI-prompt en agentweergave; ook de VS Code-extensie | Servers van Anthropic |
| Cursor | Ctrl+M ingedrukt houden in het Agents-venster |
Promptvak van agent en chat | Servers van Cursor |
| VS Code | ⌘I in de chat, ⌥⌘V in de editor |
Chat, Agents-venster, editors en terminals | Standaard op uw apparaat |
Drie details verdienen het om uit die tabel te worden gelicht.
Het dicteren van Claude Code is op het werk afgestemd. Termen als regex,
OAuth, JSON en localhost worden als term herkend, en de naam van uw huidige
project en van uw git-branch worden automatisch als herkenningshints
meegegeven — daarom komt de branch waarop u werkt correct gespeld uit de tekst en
niet fonetisch. De transcriptie verbruikt geen tokens en telt niet mee voor de
limieten die /usage laat zien.
Het is ook het meest afgeschermd. /voice vereist een Claude.ai-account: het
is niet beschikbaar wanneer Claude Code draait op een Anthropic-API-sleutel, op
Amazon Bedrock, op de Agent Platform van Google Cloud of op Microsoft Foundry, en
organisaties met HIPAA-compliance aan hebben het via beleid uitgeschakeld. Het
heeft een lokale microfoon nodig, dus het werkt niet via SSH, niet in Claude Code
op het web en niet in VS Code Remote, Dev Containers en Codespaces.
Op privacy is VS Code de uitzondering. Het ingebouwde dicteren verwerkt de microfoonaudio op uw apparaat en heeft geen internetverbinding nodig zodra het model is gedownload. De functie is als experimenteel gemarkeerd en is niet beschikbaar in VS Code voor het web, op Intel-Macs, op 32-bits- en Arm32-systemen en op musl-gebaseerde Linux-distributies zoals Alpine — daar springt de Speech-extensie bij in.
Het snelheidscijfer klopt, maar wordt oververkocht. De veelgeciteerde Stanford-studie — Ruan et al., 2016 — mat Engelse tekstinvoer op een iPhone 6 Plus en vond spraak 2,93 keer sneller dan het schermtoetsenbord: 153 woorden per minuut tegen 52. Een ontwikkelaar achter een mechanisch toetsenbord typt geen 52 woorden per minuut, dus de eerlijke vermenigvuldiger voor dit publiek is kleiner.
Het effect dat er wél toe doet, is wat er met de lengte van de prompt gebeurt. Typen legt een prijs op elke extra zin, en het eerste wat mensen schrappen is de achtergrond, omdat achtergrond optioneel voelt en het verzoek niet. Dus de getypte prompt is "fix de auth-middleware, hij geeft 401 bij refresh" en de gesproken versie is datzelfde plus de twee dingen die u al probeerde, het bestand dat u verdenkt, de foutmelding woordelijk en de voorwaarde dat de token-helper niet mag veranderen omdat drie andere services hem aanroepen.
Dat verschil is geen beleefdheid. Elk van die bijzinnen haalt een vertakking weg die het model anders had moeten raden, en verkeerd raden is wat de diff oplevert die u weggooit. Dezelfde studie vond bij spraak ongeveer de helft van het foutpercentage tijdens het invoeren — 5,30% tegen 11,22% gecorrigeerd — en dat is een manier om te zeggen dat hardop denken niet rommeliger is dan typen, alleen langer.
Er is een tweede-orde-effect dat het benoemen waard is. Een bug hardop beschrijven dwingt u hem in volledige zinnen te formuleren, en ongeveer één op de vijf keer lost u hem midden in de zin op, voordat het model aan de beurt is. Dat is rubber-duck debugging met een transcriptie.
Alle drie de implementaties zetten de tekst op één plek: in het vak waar u het model aanspreekt. Dat vak is een kleine fractie van de tekst die een ontwikkelaar schrijft.
Er is ook een beperking in de werkwijze waar mensen op stuklopen: geen van de ingebouwde opties werkt via SSH of in een dev container, omdat de microfoon op uw machine zit en de tool ergens anders draait. Ontwikkelt u op een externe host — steeds gebruikelijker — dan is de eigen spraakinvoer van de assistent juist daar niet beschikbaar waar u de dag doorbrengt, terwijl een dicteerapp op uw laptop gewoon blijft werken, omdat die in het terminalvenster typt zoals een toetsenbord dat doet.
Een systeembrede tool is één sneltoets die tekst invoegt waar de cursor ook staat, zodat hetzelfde gebaar werkt in het agentvak van Cursor, in een textarea in de browser, in een terminal en in Slack. Daar staat tegenover dat het weer een abonnement is en weer iets om te leren, en voor wie alleen ooit in één agentpaneel dicteert, is de ingebouwde optie echt genoeg. Stand op 17 augustus 2026:
| Tool | Gratis abonnement | Betaald | Opvallend |
|---|---|---|---|
| Wispr Flow | 2.000 woorden per week op desktop, 1.000 op de iPhone | $12 per gebruiker per maand bij jaarbetaling, $15 per maand | Mac, Windows, iOS, Android |
| superwhisper | Gratis abonnement met meer dan 100 talen en kleine modellen | Pro vanaf $8 per maand bij jaarbetaling | Lokale modellen, het best op Apple Silicon |
| Aqua Voice | 1.000 woorden, eenmalig | Pro $8 per maand; Max $24 per maand met realtimemodus en spraakopdrachten | Alleen cloud |
| Speak-Y | 2.000 woorden per week, zonder creditcard | Pro en Pro+ | Meer dan 67 talen, vergadermodus zonder bot, gratis lokale MCP-server |
De dimensie om op te vergelijken is niet de prijs maar waar de audio heen gaat. Een tool die op uw machine transcribeert en een tool die elk dictaat naar de API van een leverancier stuurt, zijn van buiten hetzelfde product en van binnen heel verschillende producten zodra u dicteert over klanten, inloggegevens of onuitgebracht werk.
Een eerlijke lijst, want net doen alsof dat niet zo is, is precies waarom mensen er na een week weer mee stoppen.
handleAuthRefresh, --no-verify, een reguliere
expressie, een JSON-blok, een bestandspad. Die dicteren en daarna corrigeren
duurt langer dan ze typen. Typ de symbolen, spreek de zinnen uit.Het patroon dat een werkdag overleeft, is gemengde invoer: spreek de alinea uit,
typ de namen en houd ondertussen beide handen op het toetsenbord. Claude Code is
daar uitdrukkelijk voor gebouwd — de transcriptie wordt op de cursorpositie
ingevoegd en de cursor blijft aan het eind staan, dus u kunt Space ingedrukt
houden, een zinsdeel uitspreken, een functienaam typen en Space opnieuw
ingedrukt houden.
Speak-Y is de systeembrede helft van de opzet: druk op een sneltoets, spreek, en
de tekst verschijnt waar de cursor al stond — Cursor, VS Code, JetBrains, een
terminal, een browser, Slack. Het vervangt /voice in Claude Code niet; het dekt
de beschrijving van de pull request en de bugmelding die /voice nooit te zien
krijgt. De interpunctie gaat automatisch en meer dan 67 talen werken zonder dat u
iets omzet, wat uitmaakt als u in de ene taal denkt en uw repository in een
andere staat.
Het gratis abonnement is 2.000 woorden per week zonder creditcard, op macOS 14.0 en nieuwer en Windows 10 en nieuwer, plus een iOS-toetsenbord in hetzelfde abonnement. De installatiegids behandelt de rechten en het kiezen van een sneltoets.
Er is een tweede verband tussen dicteren en AI-assistenten dat makkelijk over het hoofd wordt gezien. De ingebouwde MCP-server van Speak-Y is gratis op elk abonnement en laat Claude Code, Cursor of ChatGPT uw opnames en vergadertranscripties lokaal lezen — zo is de context die u dicteert niet de enige context die de agent heeft. De beslissing die uw team over de auth-flow nam, staat dan in een transcriptie die de assistent kan doorzoeken, in plaats van in uw herinnering aan een gesprek.
Bestaat uw werk uit meer vergaderingen dan prompts, dan is vergadertranscripties koppelen aan code in Cursor de volgende stap, en twintig prompts die via MCP werken behandelt wat u eigenlijk moet vragen zodra die verbinding er is.
Ja. Voer /voice uit in de CLI om dicteren aan te zetten en houd daarna Space ingedrukt terwijl u spreekt, of tik één keer om te starten en nog een keer om te versturen. Het vereist Claude Code v2.1.69 of nieuwer en een Claude.ai-account — het is niet beschikbaar wanneer Claude Code zich aanmeldt met een API-sleutel, Amazon Bedrock, Google Cloud of Microsoft Foundry. De audio wordt naar de servers van Anthropic gestreamd in plaats van op uw machine getranscribeerd, en verbruikt geen tokens en telt niet mee voor uw gebruikslimieten.
Ja. Cursor voegde ingebouwde spraakinvoer toe in versie 2.0 op 29 oktober 2025, en versie 3.1 van 13 april 2026 breidde die uit in het Agents-venster: houd Ctrl+M ingedrukt om te spreken, met een golfvorm, een timer en knoppen om te annuleren of te bevestigen. De hele opname wordt vastgelegd en in één keer getranscribeerd. De tekst belandt in het promptvak van de agent — voor de editor, voor Cmd+K of voor de terminal hebt u nog steeds een systeembrede dicteertool nodig.
Omdat lengte goedkoop is. Spreken gaat ongeveer drie keer sneller dan typen, dus verdwijnt de rem die mensen "fix de auth-bug" laat schrijven in plaats van drie zinnen achtergrond. Die extra zinnen zijn precies de context die het model nodig heeft — welke bestanden u al hebt uitgesloten, wat de foutmelding werkelijk zei en wat er niet mag veranderen.
Dat hangt van de tool af, en het is de moeite waard om dat te controleren voordat u iets gevoeligs dicteert. Het ingebouwde dicteren van VS Code verwerkt de microfoonaudio op uw apparaat en heeft na het downloaden van het model geen verbinding meer nodig. De /voice van Claude Code streamt de audio naar de servers van Anthropic. Cursor transcribeert aan de serverkant. Van de apps van derden draait superwhisper lokale modellen op Apple Silicon, terwijl Aqua Voice in de cloud werkt.
In alles waar de exacte tekens ertoe doen. Namen van variabelen, reguliere expressies, shell-vlaggen, JSON en bestandspaden komen er vaak genoeg verkeerd uit dat corrigeren meer kost dan typen zou hebben gekost. Dicteer het proza — de prompt, de reviewopmerking, de commit message, de bugmelding — en typ de symbolen.