Voice coding: prompts dicteren in Claude Code en Cursor

Alle grote AI-programmeertools kregen het afgelopen jaar spraakinvoer, dus de eerste vraag is niet langer of u een prompt kunt dicteren. Claude Code heeft /voice, Cursor heeft spraakinvoer met een ingedrukte toets in het Agents-venster, en VS Code heeft dicteren ingebouwd in de chat, de editor en de terminal.

De vraag die overblijft is smaller en nuttiger: elk van deze tools dekt het ene vak waarin u met het model praat, en geen ervan dekt de twintig andere plekken waar een ontwikkelaar de hele dag tekst typt. Dat gat is het hele argument voor een systeembrede dicteertool, en het is meteen de reden dat het interessante effect van voice coding geen snelheid is — het is dat gesproken prompts drie keer langer uitvallen dan getypte, en dat die extra lengte precies de context is die het model miste.

De feiten over andere tools hieronder zijn gecontroleerd op 17 augustus 2026.

Wat elke assistent al doet

Tool Hoe u het start Waar het werkt Waar de audio heen gaat
Claude Code /voice, daarna Space ingedrukt houden (of één keer tikken om te starten en nog een keer om te versturen) CLI-prompt en agentweergave; ook de VS Code-extensie Servers van Anthropic
Cursor Ctrl+M ingedrukt houden in het Agents-venster Promptvak van agent en chat Servers van Cursor
VS Code ⌘I in de chat, ⌥⌘V in de editor Chat, Agents-venster, editors en terminals Standaard op uw apparaat

Drie details verdienen het om uit die tabel te worden gelicht.

Het dicteren van Claude Code is op het werk afgestemd. Termen als regex, OAuth, JSON en localhost worden als term herkend, en de naam van uw huidige project en van uw git-branch worden automatisch als herkenningshints meegegeven — daarom komt de branch waarop u werkt correct gespeld uit de tekst en niet fonetisch. De transcriptie verbruikt geen tokens en telt niet mee voor de limieten die /usage laat zien.

Het is ook het meest afgeschermd. /voice vereist een Claude.ai-account: het is niet beschikbaar wanneer Claude Code draait op een Anthropic-API-sleutel, op Amazon Bedrock, op de Agent Platform van Google Cloud of op Microsoft Foundry, en organisaties met HIPAA-compliance aan hebben het via beleid uitgeschakeld. Het heeft een lokale microfoon nodig, dus het werkt niet via SSH, niet in Claude Code op het web en niet in VS Code Remote, Dev Containers en Codespaces.

Op privacy is VS Code de uitzondering. Het ingebouwde dicteren verwerkt de microfoonaudio op uw apparaat en heeft geen internetverbinding nodig zodra het model is gedownload. De functie is als experimenteel gemarkeerd en is niet beschikbaar in VS Code voor het web, op Intel-Macs, op 32-bits- en Arm32-systemen en op musl-gebaseerde Linux-distributies zoals Alpine — daar springt de Speech-extensie bij in.

Waarom een gesproken prompt meer context meedraagt

Het snelheidscijfer klopt, maar wordt oververkocht. De veelgeciteerde Stanford-studie — Ruan et al., 2016 — mat Engelse tekstinvoer op een iPhone 6 Plus en vond spraak 2,93 keer sneller dan het schermtoetsenbord: 153 woorden per minuut tegen 52. Een ontwikkelaar achter een mechanisch toetsenbord typt geen 52 woorden per minuut, dus de eerlijke vermenigvuldiger voor dit publiek is kleiner.

Het effect dat er wél toe doet, is wat er met de lengte van de prompt gebeurt. Typen legt een prijs op elke extra zin, en het eerste wat mensen schrappen is de achtergrond, omdat achtergrond optioneel voelt en het verzoek niet. Dus de getypte prompt is "fix de auth-middleware, hij geeft 401 bij refresh" en de gesproken versie is datzelfde plus de twee dingen die u al probeerde, het bestand dat u verdenkt, de foutmelding woordelijk en de voorwaarde dat de token-helper niet mag veranderen omdat drie andere services hem aanroepen.

Dat verschil is geen beleefdheid. Elk van die bijzinnen haalt een vertakking weg die het model anders had moeten raden, en verkeerd raden is wat de diff oplevert die u weggooit. Dezelfde studie vond bij spraak ongeveer de helft van het foutpercentage tijdens het invoeren — 5,30% tegen 11,22% gecorrigeerd — en dat is een manier om te zeggen dat hardop denken niet rommeliger is dan typen, alleen langer.

Er is een tweede-orde-effect dat het benoemen waard is. Een bug hardop beschrijven dwingt u hem in volledige zinnen te formuleren, en ongeveer één op de vijf keer lost u hem midden in de zin op, voordat het model aan de beurt is. Dat is rubber-duck debugging met een transcriptie.

Waar de ingebouwde spraakinvoer ophoudt

Alle drie de implementaties zetten de tekst op één plek: in het vak waar u het model aanspreekt. Dat vak is een kleine fractie van de tekst die een ontwikkelaar schrijft.

Er is ook een beperking in de werkwijze waar mensen op stuklopen: geen van de ingebouwde opties werkt via SSH of in een dev container, omdat de microfoon op uw machine zit en de tool ergens anders draait. Ontwikkelt u op een externe host — steeds gebruikelijker — dan is de eigen spraakinvoer van de assistent juist daar niet beschikbaar waar u de dag doorbrengt, terwijl een dicteerapp op uw laptop gewoon blijft werken, omdat die in het terminalvenster typt zoals een toetsenbord dat doet.

Wat een systeembrede dicteertool toevoegt, en wat het kost

Een systeembrede tool is één sneltoets die tekst invoegt waar de cursor ook staat, zodat hetzelfde gebaar werkt in het agentvak van Cursor, in een textarea in de browser, in een terminal en in Slack. Daar staat tegenover dat het weer een abonnement is en weer iets om te leren, en voor wie alleen ooit in één agentpaneel dicteert, is de ingebouwde optie echt genoeg. Stand op 17 augustus 2026:

Tool Gratis abonnement Betaald Opvallend
Wispr Flow 2.000 woorden per week op desktop, 1.000 op de iPhone $12 per gebruiker per maand bij jaarbetaling, $15 per maand Mac, Windows, iOS, Android
superwhisper Gratis abonnement met meer dan 100 talen en kleine modellen Pro vanaf $8 per maand bij jaarbetaling Lokale modellen, het best op Apple Silicon
Aqua Voice 1.000 woorden, eenmalig Pro $8 per maand; Max $24 per maand met realtimemodus en spraakopdrachten Alleen cloud
Speak-Y 2.000 woorden per week, zonder creditcard Pro en Pro+ Meer dan 67 talen, vergadermodus zonder bot, gratis lokale MCP-server

De dimensie om op te vergelijken is niet de prijs maar waar de audio heen gaat. Een tool die op uw machine transcribeert en een tool die elk dictaat naar de API van een leverancier stuurt, zijn van buiten hetzelfde product en van binnen heel verschillende producten zodra u dicteert over klanten, inloggegevens of onuitgebracht werk.

Waar spraak echt slecht in is

Een eerlijke lijst, want net doen alsof dat niet zo is, is precies waarom mensen er na een week weer mee stoppen.

Het patroon dat een werkdag overleeft, is gemengde invoer: spreek de alinea uit, typ de namen en houd ondertussen beide handen op het toetsenbord. Claude Code is daar uitdrukkelijk voor gebouwd — de transcriptie wordt op de cursorpositie ingevoegd en de cursor blijft aan het eind staan, dus u kunt Space ingedrukt houden, een zinsdeel uitspreken, een functienaam typen en Space opnieuw ingedrukt houden.

Hoe dit werkt in Speak-Y

Speak-Y is de systeembrede helft van de opzet: druk op een sneltoets, spreek, en de tekst verschijnt waar de cursor al stond — Cursor, VS Code, JetBrains, een terminal, een browser, Slack. Het vervangt /voice in Claude Code niet; het dekt de beschrijving van de pull request en de bugmelding die /voice nooit te zien krijgt. De interpunctie gaat automatisch en meer dan 67 talen werken zonder dat u iets omzet, wat uitmaakt als u in de ene taal denkt en uw repository in een andere staat.

Het gratis abonnement is 2.000 woorden per week zonder creditcard, op macOS 14.0 en nieuwer en Windows 10 en nieuwer, plus een iOS-toetsenbord in hetzelfde abonnement. De installatiegids behandelt de rechten en het kiezen van een sneltoets.

Er is een tweede verband tussen dicteren en AI-assistenten dat makkelijk over het hoofd wordt gezien. De ingebouwde MCP-server van Speak-Y is gratis op elk abonnement en laat Claude Code, Cursor of ChatGPT uw opnames en vergadertranscripties lokaal lezen — zo is de context die u dicteert niet de enige context die de agent heeft. De beslissing die uw team over de auth-flow nam, staat dan in een transcriptie die de assistent kan doorzoeken, in plaats van in uw herinnering aan een gesprek.

Bestaat uw werk uit meer vergaderingen dan prompts, dan is vergadertranscripties koppelen aan code in Cursor de volgende stap, en twintig prompts die via MCP werken behandelt wat u eigenlijk moet vragen zodra die verbinding er is.

FAQ

Ondersteunt Claude Code spraakinvoer?

Ja. Voer /voice uit in de CLI om dicteren aan te zetten en houd daarna Space ingedrukt terwijl u spreekt, of tik één keer om te starten en nog een keer om te versturen. Het vereist Claude Code v2.1.69 of nieuwer en een Claude.ai-account — het is niet beschikbaar wanneer Claude Code zich aanmeldt met een API-sleutel, Amazon Bedrock, Google Cloud of Microsoft Foundry. De audio wordt naar de servers van Anthropic gestreamd in plaats van op uw machine getranscribeerd, en verbruikt geen tokens en telt niet mee voor uw gebruikslimieten.

Kan ik prompts dicteren in Cursor?

Ja. Cursor voegde ingebouwde spraakinvoer toe in versie 2.0 op 29 oktober 2025, en versie 3.1 van 13 april 2026 breidde die uit in het Agents-venster: houd Ctrl+M ingedrukt om te spreken, met een golfvorm, een timer en knoppen om te annuleren of te bevestigen. De hele opname wordt vastgelegd en in één keer getranscribeerd. De tekst belandt in het promptvak van de agent — voor de editor, voor Cmd+K of voor de terminal hebt u nog steeds een systeembrede dicteertool nodig.

Waarom werken gesproken prompts beter dan getypte?

Omdat lengte goedkoop is. Spreken gaat ongeveer drie keer sneller dan typen, dus verdwijnt de rem die mensen "fix de auth-bug" laat schrijven in plaats van drie zinnen achtergrond. Die extra zinnen zijn precies de context die het model nodig heeft — welke bestanden u al hebt uitgesloten, wat de foutmelding werkelijk zei en wat er niet mag veranderen.

Wordt spraakdictaat lokaal of in de cloud verwerkt?

Dat hangt van de tool af, en het is de moeite waard om dat te controleren voordat u iets gevoeligs dicteert. Het ingebouwde dicteren van VS Code verwerkt de microfoonaudio op uw apparaat en heeft na het downloaden van het model geen verbinding meer nodig. De /voice van Claude Code streamt de audio naar de servers van Anthropic. Cursor transcribeert aan de serverkant. Van de apps van derden draait superwhisper lokale modellen op Apple Silicon, terwijl Aqua Voice in de cloud werkt.

Waar is spraak slecht in bij het programmeren?

In alles waar de exacte tekens ertoe doen. Namen van variabelen, reguliere expressies, shell-vlaggen, JSON en bestandspaden komen er vaak genoeg verkeerd uit dat corrigeren meer kost dan typen zou hebben gekost. Dicteer het proza — de prompt, de reviewopmerking, de commit message, de bugmelding — en typ de symbolen.