まず見落とされがちな細部から。Claudeの音声モードは「順番制」だ。あなたが一文話し終えてから、Claudeが返答を考え始める。これはOpenAIが最近ChatGPTの音声機能に導入した「デュプレックス」方式とは根本的に異なる——GPT-Liveシリーズは、あなたが話している最中でも同時に返答を生成でき、まるで人間同士の会話のように割り込みも可能だ。Claudeはそうではない。あなたが話を止めるのを大人しく待ち、それから反応する。Anthropic自身もこの制約を認めており、複数の質問をする場合は一気に3つ詰め込まず、1つずつ質問するよう推奨している。息継ぎの間をシステムが「発話終了」と誤認識しやすいためだ。
この仕組みの違いが、Claude音声モードを使いこなすコツを決めている。
起動方法とモデル選択
音声モード自体は2025年から存在していたが、今年7月にAnthropicは実質的なアップグレードを行った。それまで音声は反応速度重視で能力の低いHaikuモデルのみで動作していた(遅延を抑えるため)が、現在はより高性能なSonnetとOpusでも音声対話が可能になり、さらに接続済みのアプリの内容を直接コンテキストとして取得できるようになった。操作方法は、モバイルアプリ(iOS・Android対応、Anthropicによればモバイル体験が最も快適とのこと)で右下の黒い波形アイコン——隣のマイクアイコンではない——をタップし、マイク権限を許可すれば音声モードが開始する。話し終えるとClaudeが自動的に返答を生成し、再度「Stop」をタップすると音声モードが終了する。モデルは画面下部のセレクターで切り替え可能:Haikuは速度重視、Sonnetは日常タスクに最も手軽、Opusは複雑なタスク向けだが有料アカウント限定となる。










