WWDC 2026のSiri AIとApp Intents:理解から実行へ
WWDC 2026のSiri AIとApp Intentsを、AppleとGoogleのGemini協力、アプリ操作の仕組み、Androidスマホエージェントの実行確認から解説します。
- WWDC 2026で示されたSiri AIの重要点は、個人文脈や画面上の内容を理解し、App Intentsで公開されたアプリ操作へつなぐ構成です。
- iOS 27と英語版Siri AIベータは2026年9月14日に提供予定で、日本語を含む5言語は10月に予定されています。端末、機能、言語、地域は個別に確認します。
- AppleとGoogleはAI分野での協力を公式に発表し、GoogleのGemini技術を基盤に構築したApple Foundation ModelsがApple Intelligenceを支えます。
- FoneClawでは、設定済みモデルと100以上のAndroid向け内蔵ツールを組み合わせ、対象選択、必要な権限、承認設定、実行、保存結果まで確認できます。
Siri AIが理解から実行へ進む仕組み
WWDC 2026で示されたSiri AIの変化は、回答を豊かにするだけではありません。Appleは、利用可能な個人文脈、画面上の内容、継続した会話を使って依頼を理解し、アプリが提供する操作へつなぐ構成をSiri AIの公式発表で案内しています。理解した内容を実際のスマホ操作へ変える部分が重要です。
たとえば、画面に表示した名刺について「この人を連絡先へ追加して」と頼む場合、AIは氏名、電話番号、メールアドレスのほか、会社名や役職など画像から読み取れる情報を整理できます。ただし、読み取れる項目と連絡先作成ツールで保存できる項目は同じとは限りません。FoneClawで新規連絡先として保存できるのは、表示名と、少なくとも一方の電話番号またはメールアドレスです。
この流れでは、依頼の理解、利用可能なアクション、対象の選択、権限や承認、実際の実行、保存結果の確認がそれぞれ別の層になります。高性能なモデルでも、対象アプリが操作を公開していなければ保存には進めません。操作が利用可能でも、対象人物が曖昧なら確定前に止める必要があります。
提供時期も更新されています。Appleは9月の製品発表で、iOS 27の無料アップデートと英語版Siri AIベータを2026年9月14日に提供する予定だと案内しました。2026年9月10日時点では予定日前です。日本語を含む追加言語は10月に予定されており、現在の利用条件は端末、機能、言語、地域ごとに確認します。
発表された機能と利用条件を分ける
Apple IntelligenceはSiri AIだけを指す名称ではありません。AppleはApple Intelligenceの機能発表で、文章、画像、コミュニケーション、ショートカットなど、日常のシステム体験に関わる複数のAI機能を紹介しています。Siri AIは、その基盤を使って個人文脈とアプリ操作を結び付ける役割を持ちます。
画面上の内容を理解できれば、「この名刺」「この商品」「このメッセージ」のような指示で対象を示しやすくなります。個人文脈が利用できれば、連絡先、メール、メッセージ、予定などから関連情報を探せます。会話を続けられれば、最初の依頼に対して「携帯番号を使って」「メールアドレスも確認して」と条件を修正できます。
一方、発表された機能と手元の端末で使える機能は分けて確認します。対応ハードウェア、iOS 27、Siri AIの提供段階、選択言語、地域、対象アプリの実装がそろって初めて、目的の流れを試せます。すでに対応機種を所有している場合は、新しい端末の購入を前提にせず、Appleの対応一覧と端末上の表示を確認できます。
9月14日に予定されているのは英語版ベータです。フランス語、日本語、韓国語、ポルトガル語、スペイン語は10月の対応予定に含まれます。日本語が追加されても、すべての地域と機能が同時に利用可能になるとは限りません。詳しい日程と条件は、iOS 27のSiri AIはいつから?対応条件と使い方で確認できます。
AppleとGoogleのAI協力を正しく理解する
AppleとGoogleのAI協力は公式に確認されています。両社のAI協力に関する共同声明では、GoogleのGeminiモデルとクラウド技術を基盤として、Appleが次世代のApple Foundation Modelsを構築する複数年の協力が説明されています。
AppleもApple Foundation Modelsの技術解説で、GoogleのGemini技術を使って構築したモデルを示しています。これらのApple Foundation ModelsはApple Intelligenceの基盤となり、Siri AIを含む機能の理解や生成を支えます。
ここで区別したいのは、基盤となるモデル技術、Appleが提供するApple Intelligence、ユーザーが話しかけるSiri、アプリ操作を公開するApp Intentsです。Siri AIは消費者向けGeminiアプリそのものではありません。また、公式なモデル協力だけから、個々の依頼が常に同じ経路でGoogleへ送られるとは判断できません。
モデル層の役割は、画面や会話から意図を解釈し、必要な情報を構造化することです。名刺の例なら、人名、会社、役職、電話番号、メールアドレスを読み分けられます。しかし、読み取ったすべての項目をそのまま保存できるとは限りません。連絡先へ保存するには、作成ツールが受け付ける表示名、電話番号、メールアドレスへ内容を絞り、権限と承認条件を満たす必要があります。
App Intentsが依頼を実行可能にする
App Intentsは、アプリの機能やデータをSiri、ショートカットなどのシステム機能から利用できる形で公開する仕組みです。AppleのApp Intents公式資料では、操作と対象データを構造化して提供する方法が説明されています。モデルが自然な依頼を理解した後、実際に呼び出せる操作を決める層です。
連絡先を扱うアプリなら、人物を検索する、連絡先を作成する、既存項目を開くといった操作が考えられます。タスク管理アプリなら、項目の作成、期限の変更、完了状態の更新が対象になります。アプリ側が公開する操作と対象が明確であれば、Siriは会話で受け取った依頼を具体的なアクションへ結び付けやすくなります。
AppleのWWDC開発者向けApp Intents解説も、アプリの機能をシステム体験へ組み込む方法を紹介しています。実用上は、どのアプリのどのデータを変更するか、同名の対象が複数ないか、必要な権限があるか、実行後にどこへ保存されたかを確認することが大切です。
理解と実行の関係をさらに掘り下げるなら、App Intentsと機械呼び出し可能なアプリ: AIエージェントがスマホ操作を実行する仕組みが役立ちます。自然な会話、構造化された操作、対象の特定、実行結果という流れを分けると、モデルを変えただけでは利用できる操作が増えない理由も明確になります。
AIからスマホ操作までの層を比べる
Siri AIとAndroidスマホエージェントを比べる場合は、ブランド名より、依頼が保存結果へ到達するまでの層を確認します。Apple側ではSiri、Apple Intelligence、App Intents、対応アプリ、システム権限がつながります。FoneClawでは、設定済みモデル、現在画面や選択画像、100以上の内蔵ツール、Android権限、接続済みアカウント、承認設定が実行経路を作ります。
| 層 | Siri AIとApple環境 | FoneClawとAndroid環境 |
|---|---|---|
| 入力 | 音声、会話、利用可能な画面・個人文脈 | ユーザーが開始する音声・テキスト入力、現在画面、選択画像 |
| 理解 | Apple Intelligenceを支えるモデルが意図や文脈を処理 | 設定済みモデルが依頼と渡された文脈を整理 |
| 利用可能な操作 | システム機能とアプリが提供するApp Intents | 有効にしたAndroid向け内蔵ツール |
| 対象 | アプリが提供する項目やシステム上の対象 | 実際に取得した連絡先、予定、メッセージ、端末状態など |
| 実行条件 | 端末、提供状況、アプリ対応、権限 | Android権限、アカウント、ツールの有効化、承認ポリシー |
| 完了確認 | 変更先のアプリやシステム画面で結果を確認 | ツール結果と保存先の実データを確認 |
FoneClawでは、モデルによる判断とAndroid上の操作を分けて追えます。画面や画像を文脈として渡し、作業の進行を見ながら、利用可能なツールへ進みます。承認方法は全体とツール単位で設定できるため、すべての操作で同じ確認になるのではなく、現在の方針に沿って実行されます。
Android上で操作が行われても、モデルによる理解まで常に端末内で完結することを示すものではありません。入力した内容の処理経路は、設定したモデル提供元と接続方法によって決まります。画面や画像を渡すときは、必要な範囲を選び、秘密情報や無関係な個人情報を除いてから使います。
名刺画像からAndroid連絡先を作成する
FoneClawでの流れを、展示会でもらった名刺をAndroid連絡先へ登録する場面で考えます。ユーザーは名刺の写真を一枚選び、「氏名、会社、役職、電話番号、メールアドレスを読み取り、既存の連絡先を確認してから新規登録案を見せて」と依頼します。
最初に必要なのは、画像を扱える設定済みモデルと、実際に選択した名刺画像です。FoneClawは画像から読める項目を整理し、氏名の漢字、電話番号の桁、メールアドレス、会社名、役職を確認用に表示できます。文字が不鮮明な項目や複数の電話番号がある場合は、ユーザーが採用する値を選びます。会社名や役職を読み取れても、連絡先作成ツールの保存項目は表示名、電話番号、メールアドレスに限られます。
次に、連絡先の検索・一覧ツールを有効にし、Androidの連絡先読み取り権限を許可したうえで、表示名または電話番号を使って既存候補を探します。この検索・一覧操作も承認設定の対象となり、実際の動作は現在の全体およびツール別の方針に従います。メールアドレスを検索条件として直接指定するのではなく、名前または電話番号で得た候補を開き、登録済みのメールアドレスを含む内容を確認します。
同じ電話番号またはメールアドレスを持つ連絡先が見つかった場合、新しい連絡先は作成されません。表記が似ているだけで同一人物か判断できない候補については、ユーザーが既存レコードを確認して新規作成を止めるか決めます。複数の連絡先を自動統合したり、既存連絡先を自動更新したりする流れには進めません。
新規作成を選ぶ場合は、表示名と、少なくとも一方の電話番号またはメールアドレスを確認します。連絡先作成ツールを有効にし、Androidの連絡先読み取り権限と書き込み権限を許可する必要があります。作成操作も承認設定の対象であり、現在の全体およびツール別の方針に沿って、AndroidのContacts Providerへ端末内連絡先を一件作成します。保存先アカウントの任意選択やクラウド同期を前提にはしません。
作成後は返答だけで完了とせず、表示名または電話番号で連絡先を検索し、保存された表示名、電話番号、メールアドレスを確認します。途中で処理が止まった場合も、すぐ新規作成を繰り返さず、まず同じ表示名または電話番号で候補を探します。保存済みなら内容を確認し、見つからなければ作成の段階だけを再実行します。
この作業を詳しく進める場合は、AIでAndroid連絡先を作成して重複チェック:保存前確認からFoneClawの直接作成までで、画像の選択、重複候補の扱い、保存後の確認を順に確認できます。
保存結果まで確認できる一件から始める
WWDC 2026のSiri AIとApp Intentsから得られる実用的な視点は、AIの回答だけでスマホ操作を評価しないことです。一件の依頼について、入力、理解、利用可能な操作、対象、権限、承認、実行、保存結果がつながっているかを確認します。
- 現在使える端末と機能を確認します。
- 名刺一枚など、対象が明確な依頼を選びます。
- 画像から抽出された情報と、保存可能な表示名、電話番号、メールアドレスを分けて見直します。
- 連絡先読み取り権限と承認設定を確認し、表示名または電話番号で既存候補を検索します。
- 新規作成が必要なら、読み取り・書き込み権限、保存内容、現在の承認設定を確認します。
- 作成後に保存された端末内連絡先を検索し、実際の結果を読み返します。
- 失敗した場合は、保存済みか確認してから不足した操作だけを再実行します。
Apple端末では、Siri AIの提供後に、目的のApp Intentsが利用できるかを確認します。Androidでは、FoneClawで設定済みモデル、必要なツール、Android権限、対象アカウント、承認方針を準備できます。FoneClawの現在の対応範囲はFoneClawの機能ページで確認でき、Androidへの導入はFoneClawのダウンロードページから進められます。
複数段階の作業が途中で止まった場合は、スマホAIエージェントの失敗診断と復旧:原因切り分け、権限回復、失敗したツールだけ再実行する手順が役立ちます。最初から全工程を繰り返すのではなく、保存先を確認し、権限、対象、未実行の操作を切り分けることで、重複や意図しない変更を避けながら完了へ進めます。