朝9時の未読20件は、ほとんどがタイピングの仕事です。Slackへの短い返事が十数件、挨拶と結びが必要なメールが数通、そして自分は別の言語で考えているのに英語で書いてくる同僚が1人。この3種類はどれも、返信しているアプリから離れずに、Speak-Yで音声で答えられます。
返信欄にカーソルを置き、右⌘キーを押したまま答えを話して離す——テキストはカーソルの位置に貼り付けられます。メールなら、口述の最後に「format as email」のようなトリガーフレーズを付けると、Speak-YのAIが話した内容を整ったメールにしてから貼り付けます。英語の返信なら「translate to English」で締めくくります。設定は5分ほどで、一度だけです。
このガイドではMac版アプリを使います。ラベルはSpeak-Yの画面に表示されるとおりに記載しており、2026年9月30日時点で確認しています。
3つあり、この順番で進めます。
| 名前 | トリガーフレーズ | プロンプト(AI指示) |
|---|---|---|
| Email Formatter | format as email | Format this as a short professional email with a greeting and a sign-off. Keep my wording and facts. Spell these names exactly: Siobhan Kowalczyk, Tomás Nguyen, Northwind. |
| To English | translate to English | Translate this into natural, friendly English. Keep it short. Return only the translation. |
トリガーフレーズは口述の最後に言う言葉です。Speak-Yの入力欄の下にあるヒントにも、「このコマンドを有効にするためにディクテーションの最後に言う言葉。」とそのまま書かれています。コマンドは1台のMacではなく、アカウントに保存されます。

スレッドの返信欄をクリックし、右⌘を押したまま話して離します。画面下部の録音ボタンは、キーを押しているあいだ波形を表示し、離すと「処理中…」に変わります。一瞬のち、返信全体がタイプしたかのように欄に貼り付けられます。何も送信されません。読んでから、Returnは自分で押します。
速くするための習慣が2つあります。
話すのは速い作業です。スタンフォード大学の研究(Ruan et al., 2016)では、音声入力が毎分153語、スマートフォンのキーボードが52語でした。40語のSlackの返事なら、話すのに15秒ほどです。同じキーはMail、ブラウザのGmail、Teams、Linear、ターミナルでも使えます。Speak-Yはカーソルのある入力欄ならどこにでも貼り付けるからです。そのために必要なアクセシビリティの権限は、インストールガイドで説明しています。
返信を開いて本文をクリックし、右⌘を押したまま、隣の席の人に説明するように話します。最後にトリガーフレーズを付けます。
tell Siobhan the renewal is fine at the new price, we only need the signed order form by Friday, and ask whether Tomás can join the kickoff on the fourteenth — format as email
キーを離すと、Speak-Yは「format as email」をEmail Formatterコマンドとして認識し、その前のテキストをプロンプトと一緒にAIへ送り、生の口述の代わりに結果——挨拶、本文、結び——を貼り付けます。トリガーフレーズそのものはメールに入りません。フレーズが認識されなかった場合は、話したとおりの口述がそのまま貼り付けられるので、最悪でもあとから編集できるふつうの返信になるだけです。
トリガーフレーズは口述の終わり近くで探されるので、最後に言ってください。コマンドの実行中、録音ボタンには「Processing with AI...」と表示され、ふつうの口述より少し時間がかかります。メールを開いてから送信を押すまで、上のような返信なら1分もかかりません。
名前は、ディクテーションがもっとも間違えやすいところです。「Siobhan」が「Shivon」になるのは、認識エンジンが知らない語を音から推測するからです——その理由は音声認識のしくみで説明しています。
Mac版のSpeak-Yには独立したカスタム語彙リストがないので、確実な対策は、Email Formatterのプロンプトにすでに入っている1行、つまり正しい綴りです。メールを整えるAIはこの行を読み、コマンドを実行するたびに、近い誤りを指定した綴りに直します。リストには実際にやり取りする相手だけを入れ、新しい顧客が現れたら更新してください。
コマンドを使わずに送る返信には、さらに2つの手があります。設定 → Generalの高度な認識は、対応言語でより精度の高い文字起こしを行います。音声は外部の音声認識サービスへ送られ、初回に同意を求められ、プライバシーの「モデルトレーニングのオプトアウト」がオフになるので、有効にする前にダイアログを読んでください。そしてテキストは送信ではなく貼り付けなので、間違った名字はダブルクリック1回で直せます。

Speak-Yは67以上の言語を認識し、口述する言語と送る言語が同じである必要はありません。自分の言語で返信を口述し、「translate to English」で締めくくると、To Englishコマンドが英語にした返信を欄に貼り付けます。自分の言語の文の終わりに英語が入るのが不自然に感じるなら、トリガーフレーズを自分の言語で設定してもかまいません——コマンドの中のただのテキストです。
コマンドでカバーできない場面には、別の方法が2つあります。

現実的な受信箱:Slackの返事が12件、メールが6通、英語での返信が2件。
話して読む時間はおよそ15分で20件の返信。キーボードを使うのはReturnと、ときどきの修正だけです。

返信が音声中心になったら、次にタイピングが残るのは会議後のフォローアップです。Speak-Yの無料MCPサーバーを使うと、ClaudeやChatGPTがあなたのマシン上で会議の文字起こしを読めるので、フォローアップのメールを実際に話された内容から書き始められます——そして同じホットキーは、Claude CodeとCursorへのプロンプトの口述にもそのまま使えます。
はい。返信欄をクリックし、右⌘キー(Macの既定のホールドホットキー)を押したまま話して離します。Speak-YはSlackでもほかのアプリでも、カーソルのある場所にテキストを貼り付けますが、送信はしません。返信を読んでから、Returnは自分で押します。
カスタム音声コマンドを作ります:設定 → コマンドモード → Configure voice commands → コマンドを追加。名前、「format as email」のようなトリガーフレーズ、欲しいメールの形を説明するプロンプトを入力します。口述の最後にトリガーフレーズを言うと、Speak-Yは生のテキストではなく整えたメールを貼り付けます。
Mac版アプリには独立した単語リストはありません。綴りを確実に指定できる場所は音声コマンドのプロンプトです。たとえば「Spell these names exactly: Siobhan Kowalczyk, Tomás Nguyen」と書いておけば、コマンドを実行するたびにAIが近い誤りを直します。設定 → Generalの高度な認識を使うと精度はさらに上がり、貼り付けたテキストは送信前にいつでも修正できます。
はい。トリガーフレーズ「translate to English」と翻訳を求めるプロンプトでコマンドを作り、自分の言語で口述してそのフレーズで締めくくります。組み込みのfree promptを使うことも、終わったディクテーションをあとからAI処理 → 英語に翻訳で訳すこともできます。