コンテンツにスキップ

初回セットアップ

最初に開くと、9 つの画面を順に進みます。話し方に要らない画面は飛ばします。各画面の下に、次にやることが 1 行で出ます。

  1. 言語を選ぶ

    11 の言語から 1 つ選びます。最初に選ばれているのはシステムの言語です。選んだものが、画面の言語、会話の言語、地域の 3 つの初期値になり、ここから先の画面はその言語で出ます。3 つは、あとから設定で別々に変えられます。

    言語を選ぶ画面

  2. 使う前に知っておくことを読む

    答えが間違うことがあること、変更は承認してから行うこと、API の料金は提供元から請求されること、会話は選んだ提供元に送られることの 4 つが出ます。読んだら「4つの点を読んで理解しました」にチェックを入れて進みます。詳しくは安全に使うためににあります。この画面ができる前にセットアップを終えていた人には、次に開いたときに同じ内容が一度だけ出ます。

    使う前に知っておくことの画面

  3. 会話のモデルの API キーを入れる

    提供元を選んで API キーを入れ、「検証して保存」を押します。キーは実際に問い合わせて確かめ、使えると分かったときだけ保存します。会話には、その提供元の標準のモデルを使い、つなぎの一言には、軽くて速いモデルを使います。どちらも、あとから設定で変えられます。

    API キーを検証して保存した画面

  4. 話し方を選ぶ

    「声で話す」「文字で打ち、返事は声で聞く」「文字だけで使う」から選びます。

    話し方で「声で話す」を選んだ画面

  5. 聞き取りのモデルを準備する(声で話すとき)

    搭載しているメモリに合わせて、Qwen3-ASR か、MLX で動く Whisper を勧めます。「モデルを準備する」を押すと、モデルを取得してこの Mac で動かします。ブラウザの中で動く Whisper も選べます。

    おすすめのモデルの準備が終わった画面

  6. 読み上げを選ぶ(返事を声で聞くとき)

    会話の言語を話せるものだけが出ます。日本語なら、macOS の声、Qwen3-TTS、VOICEVOX、AivisSpeech です。Qwen3-TTS は 16GB 以上のメモリで選べ、モデル(約 1.9GB)を取得してこの Mac で動かします。macOS の声を選んだときは、その言語の声が入っているかを調べ、無ければシステム設定のどこで足すかを案内します。

    読み上げの準備ができた画面

  7. マイクを許可する(声で話すとき)

    「マイクを検証する」を押すと、macOS がマイクの許可を求めます。「許可」を押すと、実際に音を受け取れるかを確かめます。

    マイクを確かめた画面

  8. ほかの準備を待つ

    記憶の意味検索のモデルを準備します。日本語で声で話すときは、相槌の種類を判定するモデルと、話し終わりを判定する MaAI も準備します。準備できなかったものは、やり直すか、あとに回せます。あとに回したものは、設定の「モデル」で準備します。

    ほかの準備が終わった画面

  9. 確かめて始める

    選んだ内容を見て、「この内容で始める」を押します。

    選んだ内容の確認の画面

始まったら、MIC OFF を押して話しかけるか、入力欄に文字を打って送ります。話しかけ方は使い方にあります。

Agent のジョブを使うなら、続けて Agent の CLI を準備します。