Ein moderierter Usability-Test verlangt alles gleichzeitig: das Skript abarbeiten, den Teilnehmer beobachten und aufschreiben, was schiefgeht. Speak-Y nimmt Ihnen das Schreiben ab. Legen Sie vor der Studie Ihre Beobachtungscodes – Problem, Confusion (Verwirrung), Quote (Zitat), Idea (Idee) – unter Einstellungen → Notizen als Notiztypen an, jeden mit eigenem Hotkey. In jeder Zoom-Session drücken Sie ⌥1…⌥4 in dem Moment, in dem etwas passiert, ohne den Blick abzuwenden; Speak-Y heftet eine Markierung dieses Typs ans Transkript. Nach der Session benennen Sie den Teilnehmer P3 und taggen die Aufnahme mit study-checkout. Am Ende gehen Sie die Sessions Typ für Typ durch und bitten Ihren KI-Assistenten, alle Problem-Notizen der Studie zu gruppieren, mit Teilnehmercodes und Zeiten.
Diese Anleitung beschreibt die macOS-App mit Stand vom 1. Oktober 2026 und begleitet eine ganz gewöhnliche Studie: fünf 50-minütige Sessions mit einem Checkout-Prototyp, eine Moderatorin auf Zoom und ein Produktteam, das bis Freitag belegte Ergebnisse sehen will.
Bei Kundeninterviews reicht eine Markierung pro Zitat – Kundeninterviews an einem Abend zu Zitaten zeigt diese Routine. Ein Usability-Test liefert etwas anderes: Beobachtungen, die Sie später in Probleme, Verwirrungen, Zitate und Ideen sortieren. Sortiert man erst hinterher, heißt das, fünf Stunden Audio noch einmal anzuhören.
Typisierte Markierungen verlegen dieses Sortieren in die Session. Ein Druck auf ⌥2 für Confusion ist der erste Codierdurchgang: Jede Beobachtung hat bereits eine Kategorie, eine Zeit und die Worte des Teilnehmers, sodass das Affinity Mapping mit sortierten Belegen beginnt statt vor einer leeren Wand.
Öffnen Sie Einstellungen → Notizen. Unter Notiztypen gibt es bereits einen Typ – Moment markieren auf ⌥1. Klicken Sie auf den Stift daneben und benennen Sie ihn in Problem um. Dann für jeden weiteren Code:
| Code | Wann verwenden | Hotkey |
|---|---|---|
| Problem | der Teilnehmer scheitert an einer Aufgabe oder nimmt einen falschen Weg | ⌥1 |
| Confusion | er zögert, scrollt zurück, sagt „Moment, wo ist…“ | ⌥2 |
| Quote | ein Satz, den Sie im Bericht haben wollen | ⌥3 |
| Idea | Ihnen fällt eine Lösung ein oder der Teilnehmer schlägt eine vor | ⌥4 |
Bleiben Sie bei vier oder fünf Typen, sonst denken Sie über Tasten nach statt zuzusehen. Legen Sie die Namen vor der ersten Session fest. Eine Markierung behält den Typnamen, mit dem sie gesetzt wurde; wer also nach der dritten Session „Confusion“ in „Friction“ umbenennt, teilt seine Studie in zwei Namen auf. Die Hotkeys wirken nur, während ein Meeting aufgezeichnet wird; den Rest der Zeit tut ⌥2, was es sonst auch tut.
Prüfen Sie den Tarif anhand der Länge Ihrer Sessions. Stand 1. Oktober 2026:
| Tarif | Längstes Meeting | Meeting-Zeit pro Monat |
|---|---|---|
| Free | 30 Minuten | 2 Stunden |
| Pro | 60 Minuten | 10 Stunden |
| Pro+ | 4 Stunden | 40 Stunden |
Fünf 50-minütige Sessions passen in Pro. Eine auf eine Stunde angesetzte Session, die überzieht, würde bei Minute 60 enden; für längere Sessions nehmen Sie Pro+. Die Windows-App nimmt Meetings mit Sprechernamen und Tags auf, aber ohne Markierungen, daher braucht diese Routine den Mac.
Als Nächstes die Einwilligung. Speak-Y nimmt auf Ihrem Mac auf und tritt dem Call nie bei, deshalb kündigt die Plattform die Aufnahme nicht an: Sagen Sie zu Beginn, dass Sie aufzeichnen und wer es hören wird, und schreiben Sie denselben Satz in die Einladung. Ist es legal, Meetings aufzuzeichnen geht die Regeln nach Ländern durch. Sagen Sie dem Teilnehmer auch, was aufgenommen wird: Ton – Ihr Mikrofon und der Ton, den Ihr Mac wiedergibt –, nicht der Bildschirm, den er teilt.

Starten Sie den Zoom-Call. Speak-Y fragt über dem Aufnahmeknopf Als Meeting aufzeichnen? – klicken Sie auf das Häkchen (erscheint nichts, stellen Sie Einstellungen → Interface & Behavior → Meeting-Modus auf Manual oder Auto). Ein Panel über dem Aufnahmeknopf zeigt Ihre Typen mit Farben und Hotkeys. Es erscheint beim Start der Aufnahme, wenn Sie mit der Maus über den Knopf fahren und wenn Sie eine Markierung setzen, und bleibt für den Teilnehmer unsichtbar, während Sie Ihren Bildschirm teilen.
Öffnen Sie die Aufnahme unter Meetings. Speak-Y nummeriert die Sprecher in der Reihenfolge, in der sie zuerst gesprochen haben; meist eröffnen Sie, also sind Sie Speaker 1 und der Teilnehmer Speaker 2.
P3 ein und drücken Sie Enter. Nehmen Sie den Code, nicht den Namen: Alles, was aus dem Transkript entsteht – kopierte Zitate, geteilte Aufnahmen, das, was Ihr Assistent liest –, übernimmt diese Bezeichnung. Die Zuordnung von Codes zu Namen führen Sie in Ihrer Rekrutierungstabelle.study-checkout ein und klicken Sie auf Neuen Tag erstellen. Ab der zweiten Session ist der Tag einen Klick entfernt. Fügen Sie einen Segment-Tag wie first-time-buyer hinzu, wenn Sie später Gruppen vergleichen wollen.Über dem Transkript, neben den Tabs, zeigt die Aufnahme eine Leiste mit Chips: Alle Notizen mit der Gesamtzahl, dann ein Chip pro Typ mit eigener Anzahl – Problem · 5, Confusion · 4, Quote · 3. Klicken Sie auf Problem, und nur die Problem-Markierungen bleiben an den Beiträgen; die Pfeile neben den Chips springen von einer zur nächsten, und der Zähler zeigt, wo Sie sind: 1 / 5.
Jeder markierte Beitrag ist in der Farbe des Typs eingefärbt und trägt ein Badge wie Problem · 14:05, die Wörter des 15-Sekunden-Fensters sind hervorgehoben. Um den Moment zu hören, klicken Sie mit der rechten Maustaste auf den Beitrag → Ab hier anhören. Erst die Problems, dann die Confusions: Minuten pro Session statt eines kompletten Nachhörens.

Die Durchsicht Session für Session zeigt, was passiert ist; der Bericht braucht, was immer wieder passiert. Das ist eine Aufgabe für einen KI-Assistenten, der alle fünf Transkripte lesen kann. Verbinden Sie Claude, ChatGPT, Cursor oder einen anderen MCP-Client einmalig unter Einstellungen → Integrationen – Meeting-Notizen mit KI-Assistenten verbinden führt Schritt für Schritt durch – und fragen Sie:
Der Assistent listet die Aufnahmen mit dem Tag auf und liest dann jedes Transkript: Jeder Beitrag beginnt mit dem Namen des Sprechers und der Zeit, und ein Abschnitt Notes führt jede Markierung mit ihrer Zeit, ihrem Typ und den ersten Worten des zugehörigen Beitrags auf. Codes, Tag und Teilnehmernamen sind genau das, wonach er gruppiert. Die Suche von Speak-Y schaut nicht in Markierungen hinein, fragen Sie also nach dem Tag, nicht nach einem Stichwort.
Das Lesen geschieht lokal aus der Speak-Y-Bibliothek auf Ihrem Mac, aber das Modell des Assistenten läuft in der Cloud, die gelesenen Transkripte gehen also dorthin. Und der Assistent entscheidet, was er zitiert: Bevor ein Thema in den Bericht kommt, öffnen Sie die Aufnahme und spielen den Moment ab. Prompts, mit denen Sie die KI zu Ihren Meetings befragen enthält weitere Anfragen dieser Art.

Ergebnisse verlassen Sie in zwei Formen. Für den Research-Kanal drücken Sie bei einer Session auf To channel: Die Kolleginnen und Kollegen erhalten das Transkript mit Sprechernamen und die Meeting-Zusammenfassung, Ende-zu-Ende-verschlüsselt, während das Audio auf Ihrem Mac bleibt. Die Zusammenfassung behält die Sprechernamen, mit denen sie erstellt wurde – eine spätere Umbenennung von Speaker 2 in P3 ändert sie nicht –, lesen Sie also vor dem Teilen auch sie, nicht nur das Transkript, und achten Sie auf Persönliches, das laut gesagt wurde: eine E-Mail-Adresse, einen Firmennamen, einen namentlich erwähnten Kollegen. Ihre Markierungen bleiben in einer geteilten Aufnahme privat – das Menü am rechten Ende der Tab-Zeile zeigt Privat –, bis Sie sie für diesen Kanal sichtbar schalten; ein Meeting in einem Team-Kanal teilen beschreibt den Rest.
Für den Bericht klicken Sie mit der rechten Maustaste auf einen Beitrag → Beitrag als Zitat kopieren. Es kommt als «Text» — P3, 14:05 an: der Teilnehmercode und die Zeit, zu der der Beitrag beginnt, sodass jeder zu dem Moment zurückkehren kann.

Die Codes einzurichten dauert einmalig fünf Minuten. Jede Session kostet ein paar Tastendrücke und danach eine Minute; die Auswertung ist ein gefilterter Durchgang pro Aufnahme und ein paar Fragen an Ihren Assistenten – ein Nachmittag statt einer Woche Nachhören. Arbeitet Ihr Research-Team in einem Speak-Y-Workspace, erklärt die Teams-Seite, wie Kanäle jede Session an einem Ort halten.
Legen Sie Ihre Notizkategorien in Speak-Y als Notiztypen an (Einstellungen → Notizen → Notiztyp hinzufügen), geben Sie jedem Typ einen Hotkey, etwa ⌥1 für Problem und ⌥2 für Confusion, und nehmen Sie die Session als Meeting auf. Während der Session drücken Sie die Taste direkt nach dem Ereignis; Speak-Y heftet eine Markierung dieses Typs ans Transkript und hebt die letzten 15 Sekunden Sprache in der Farbe des Typs hervor.
Nein. Speak-Y nimmt nur Ton auf: Ihr Mikrofon und den Ton, den Ihr Mac wiedergibt, also die Stimme des Teilnehmers aus Zoom, Teams oder Meet. Was der Teilnehmer auf dem Bildschirm tut, wird nicht erfasst. Bitten Sie ihn, laut zu denken, sprechen Sie als Moderator aus, was Sie sehen, und nehmen Sie Video bei Bedarf mit der Meeting-Plattform auf.
Ja, mit einem MCP-Client wie Claude, ChatGPT oder Cursor, der mit Speak-Y verbunden ist. Der Assistent listet die Aufnahmen mit Ihrem Studien-Tag auf und liest jedes Transkript, das einen Abschnitt Notes mit Zeit, Typ und zugehörigem Beitrag jeder Markierung enthält. Bitten Sie ihn, alle Problem-Notizen nach Thema mit Teilnehmercodes und Zeiten zu gruppieren, und prüfen Sie dann jedes Zitat in der App.
Mit Stand vom 1. Oktober 2026 nimmt Free bis zu 30 Minuten pro Meeting und 2 Stunden pro Monat auf, Pro bis zu 60 Minuten pro Meeting und 10 Stunden pro Monat und Pro+ bis zu 4 Stunden pro Meeting und 40 Stunden pro Monat. Sessions mit 45–50 Minuten passen in Pro; können sie länger als eine Stunde dauern, nehmen Sie Pro+. Der MCP-Server ist in jedem Tarif enthalten.
Benennen Sie den Sprecher des Teilnehmers mit einem Code wie P3 statt mit seinem echten Namen, dann steht in geteilten Aufnahmen, kopierten Zitaten und allem, was Ihr Assistent liest, P3. Ihre Markierungen bleiben in einer geteilten Aufnahme privat, solange Sie sie nicht für den Kanal sichtbar schalten. Prüfen Sie das Transkript vor dem Teilen auf Namen, E-Mail-Adressen oder Firmenangaben, die der Teilnehmer laut gesagt hat.