Apple Intelligence / AI
ChatGPT、iPhoneで「話して仕事を任せる」方向へ。Voice+Workのモバイル対応で何が変わる?
ChatGPTのモバイル版で、VoiceからWorkやConnected Appsを使ったAgent的な作業へつなげる機能が拡大します。iPhoneへ話しかける「相談」から実作業を任せる方向へどう変わるのか整理します。
りんご好きringozuki.comiPhoneへ話しかけることが、そのまま「仕事を依頼する操作」になり始めます。OpenAIはChatGPTのモバイル体験を拡張し、VoiceとWork、Plugins / Connected Appsなどをつなげる方向を打ち出しました。これまでの音声AIは「話して答えてもらう」が中心でしたが、これからは話した内容をもとに文書を作る、情報をまとめる、接続したサービスを使うなど、実際の作業まで進める場面が増えます。
Voice+Workがモバイルへ
OpenAIの9月23日付リリースノートは、Web・iOS・AndroidのVoiceでプラグインを使う体験と、Web・モバイルのWorkで音声を使う体験の拡張を案内しています。音声で話す入口から、作業結果が残るWorkへ依頼をつなぐ動きです。
WorkはPlus/Proなど対象有料プラン向けです。Free/GoでもChatのVoiceから各プランで使えるプラグインを利用できますが、同じWork機能が開放されるという意味ではありません。提供状況はプラン、地域、アプリ版、組織の設定や段階展開に左右されます。
iPhoneで話すだけで何を頼める?
OpenAIが挙げているのは、文書、プレゼンテーション、表計算の作成、接続アプリやブラウザーを使う作業です。たとえば作りたい資料の目的を話し、出来上がった内容を文字やファイルで確認する使い方になります。
依頼の入口は声でも、成果物の確認まで音声だけに限定されません。短いやりとりで目的を伝えた後、画面で結果を見るという使い分けができます。
文書、メール、Slack、Web、プレゼン
文書やプレゼン資料を作る機能と、外部サービス内の情報を扱う機能は別です。メールやSlackの情報を使いたい場合は、そのサービスの接続と必要な権限が前提になります。
OpenAIはGmailやGoogle Calendarの接続、Slackとの連携も案内しています。ただし、アカウントに接続できることが、その中の情報をすべて読み取れたり、任意の送信・変更を行えたりするという意味ではありません。使える操作は各プラグインと組織の設定に従います。
Cloud Browserを使う作業
WorkのCloud browserは、スマートフォン内のブラウザーとは別にクラウド上で動くブラウザーです。対応するWebサイトの閲覧やフォーム操作などに使われ、サインインが必要な場合は利用者の入力を待ちます。
端末でログイン済みのアカウントが、そのまま無条件に渡されるわけではありません。サイトの対応状況にも制約があり、重要な操作には確認が必要です。Free/GoはCloud browserの対象外です。
Plugins / Connected Appsとの連携
Voiceから利用できるのは、そのアカウントと選択中の体験で使えるツールです。接続、サインイン、アクセス許可、アクションの制限は引き継がれます。音声に切り替えたからといって、使える権限が増えるわけではありません。
管理された組織ではVoiceとWorkの両方へのアクセスが必要です。個人向けプランの画面で見えるものと、職場のアカウントで許可されているものが同じとは限りません。
GPT-6 Astra / Sol / LunaとVoice
話すための音声モデルと、作業を進めるためのモデルは分けて見る必要があります。OpenAIのVoice案内では、Liveの音声体験はプランに応じたGPT-Live-1/miniが支えます。
一方、Workでのモデル選択にはGPT-6 Astra、Sol、Lunaなどが関係します。SolとLunaはWork/Codex向けで、通常のChatの選択肢とは異なります。選べるモデルと利用量はプラン・組織設定に従うため、「Astra/Sol/Lunaがそのまま音声を生成する」「全利用者が声で自由に選べる」という説明は正確ではありません。
スマホで始めてデスクトップへ
クラウドで動くWorkの会話は、Web・モバイル・デスクトップ間で同期されます。移動中にスマートフォンから依頼を始め、後で大きな画面で成果物を確認する使い方ができます。
これはデスクトップ上のローカルファイルやアプリへの権限まで自動で与える機能ではありません。クラウド作業の継続と、手元のコンピューターでの操作は別の条件です。
音声入力から「音声で仕事を依頼」へ
音声入力は文字を打つ手間を減らします。VoiceとWorkの組み合わせでは、伝えた目的を受けて、必要な処理を進めるところまでが依頼の対象になります。
りんご好きとしては、文章を入力する方法が増えたこと以上に、成果物を頼むまでの距離が短くなる点が気になります。目的や制約を伝え、出来上がりを見て直していく役割は利用者に残ります。
何でも勝手に実行するわけではない
Web・モバイルで承認が必要になった場合は、画面上で内容を確認して承認または拒否します。OpenAIは、この場面で声による承認は対応していないと説明しています。
通話を終えても、進行中のWorkがテキストで続く場合がありますが、権限や確認が不要になるわけではありません。音声の利用枠とWorkの作業量にも、それぞれの利用条件が適用されます。
iPhoneがAI Agentのリモコンになる?
ここは機能名ではなく、使い方のたとえです。手元のiPhoneで目的を伝え、処理は必要な場所で進み、結果を自分で確認する。そうした入口として考えると、スマートフォンの役割が広がって見えます。
便利さは、任せられる範囲と確認すべき範囲が分かりやすくてこそです。まずは自分のアカウントで使える機能を確かめながら、声で頼むことと画面で確認することを組み合わせる使い方になりそうです。
変化の本質は音声認識の精度ではありません。「話す → AIが答える」から、「話す → AIが必要なツールを使って作業する」へ進み始めたことです。スマートフォンが、AI Agentへ仕事を渡すための常時携帯リモコンに近づいています。
この記事をシェア
今回の主な情報源
- OpenAI9月23日のVoiceとWorkのモバイル拡張↗
- OpenAIChatGPT Voiceのモデル・利用条件・承認方法↗
- OpenAIChatGPT Workのモバイル対応とモデル・権限↗
- OpenAICloud browserの対応範囲と確認操作↗
※製品仕様・価格は発表時点の情報です。