※本記事は、Googleによる年次開発者会議の基調講演「Google I/O '26 Keynote」の内容を基に作成されています。動画の詳細情報は https://www.youtube.com/watch?v=wYSncx9zLIU でご覧いただけます。本記事では、基調講演の内容を要約しております。なお、本記事の内容は原発表者の見解を正確に反映するよう努めていますが、要約や解釈による誤りがある可能性もありますので、正確な情報や文脈については、オリジナルの動画をご視聴いただくことをお勧めいたします。
本基調講演には、Google CEOのSundar Pichai氏、Google DeepMind CEOのDemis Hassabis氏、Antigravityを率いるVarun Mohan氏、Geminiアプリ・Labs・AI Studio担当VPのJosh Woodward氏、Search責任者のLiz Reid氏、Search製品担当VPのRobby Stein氏、ShoppingおよびAds担当VPのVidhya Srinivasan氏、Workspace担当VPのSuz Chambers氏、Android XR担当VPのShahram Izadi氏、AIエンジニアのNishtha Bhatia氏、そしてSamsungのJay Kim氏が登壇し、Gemini 3.5 FlashおよびGemini Omniの発表、Google Antigravity 2.0、Gemini Spark、AI Search、Generative Media、Android XRのAIグラスなど、Googleの最新AI技術と製品アップデートが紹介されました。また、Googleの各種AIプロダクトの公式情報については https://gemini.google/ や https://blog.google/ もご参照ください。
1. オープニング
1-1. オープニング映像とSundar Pichaiの登壇挨拶
冒頭、会場のスクリーンには様々な人々の声を集めた映像が流れました。「ここまでどれほど遠くまで来たか、立ち止まって実感してほしい」「私たちが一緒に作ってきたすべてのものに力をもらって、課題を見て『自分なら解決できる』と言える勇気を持った人がどれだけいるか」「未来を見据えて、私たち全員に決める権利がある」「AIは、世界で最も複雑な科学の問題を解くための最高の道具」「私たちは飛び立つ」といった言葉が次々と紡がれていきます。続いて教育者の方が「私はコードの書き方を知りませんが、何かを作るという選択肢が、教育者としての私に多くの可能性を開いてくれました」と語り、レストランオーナーの方が「メニューからマーケティング、在庫管理まで、Geminiは多くのことを手伝ってくれることに気づきました」と続けます。さらに「すべてが可能な世界で、私たちは病気を治すという大きなミッションに全力で取り組んでいます。非常に大きな挑戦ですが、新しい技術が手元にあります。大切なのは、私たちが何を作ることを選ぶかです」というメッセージの後、子どもの「こんにちは、僕はMatteoです。兄のTomasがこのAIアシスタントを僕のために作ってくれました」という言葉が流れ、「だから、何でも作ればいいというものではなく、大切なものを作ろう」というメッセージで映像が締めくくられました。
拍手の中、Sundar Pichai: Shoreline、そして世界中から視聴している皆さん、こんにちは。今年もI/Oに戻ってこられて嬉しく思います。今年は本当に素晴らしい1年でした。絶え間ない出荷と急速な技術の進歩があり、極めて速いペースで進展しています。私自身もそれを実感していまして、今年は本当に密度の濃い年でした。実は私が今年やってきたことを示した画像がありまして……(笑い)まあ今年が私のラッキーイヤーになることを願っています。TPUを差し込んでいる私の絵はかなり正確ですね。ただ宇宙に打ち上げる前にやることはまだ山ほどあるかもしれませんが、頑張っています。
冗談はさておき、これは本当に並外れた瞬間です。私たちが会社をAIファーストに転換してから10年が経ちました。AIがミッションを前に進め、多くの人々の生活の質を高めるうえでどれほど重要かを、私たちは理解しています。だからこそ私たちはAIイノベーションに対して、他とは違う、フルスタックのアプローチを取ってきました。カスタムのマイクロチップと安全な基盤から、世界クラスの研究とモデル、そして数十億人にリーチする製品とプラットフォームまで、すべてを一貫して構築しています。これによって反復と革新をより速く進めることができ、会社のあらゆる部分が照らされています。人々が私たちのAIを使う様子は本当に並外れたものです。期末試験の準備をする学生がGeminiアプリを使い、ミュージシャンやアーティストがLyriaやVeoのような生成AIモデルをクリエイティブな流れの一部として使い、デベロッパーがコードを書いてアイデアを形にしています。私自身もGeminiを様々な使い方で活用していまして、最近では両親の通院内容を理解するためにGeminiを使いました。皆さんも同じようなことをしていると思います。こうした人々がAIをどう使っているかという物語こそ、進歩を測る最良の指標です。
1-2. AI利用規模の爆発的成長
Sundar Pichai: AIの普及規模を理解するためにもう一つ素晴らしい指標があります。トークンです。これは私たちのモデルが処理する基本的なデータ単位で、その大部分が人々が解こうとしている問題を表しています。2年前、私たちは月間9.7兆トークンを処理していました。これは膨大な数字でした。昨年のI/Oではそれが約480兆トークンに増え、印象的な成長でした。そして現在、その数字はさらに7倍に増えて、月間3.2クアドリリオン(千兆)トークンに達しました。I/Oのキーノートで「クアドリリオン」という単語を口にする日が来るとは想像もしていませんでしたが、こうなりました。これを「トークン極大化」と呼ぶ人もいるかもしれませんし、それも一理あるでしょう。それでも私はこの数字が、私たちの製品と、特に私たちのデベロッパーたちが何を作っているかについて、重要な物語を語っていると思っています。
毎月850万人以上の人々が、私たちのモデルで新しいアプリや体験を構築しています。さらに、モデルのAPIは現在毎分190億トークンを処理しており、過去12ヶ月で375社以上のお客様がそれぞれ1兆トークン以上を処理しました。これは様々な業界でのAIへの並外れた需要を示しています。製品への需要も同様に並外れていまして、月間10億ユーザー超の製品が13個あり、そのうち5つは月間30億ユーザーを超えています。Geminiモデルこそが、より多くの人々がより頻繁に私たちの製品を使う主な理由です。
その筆頭がSearchです。Searchは他のどの製品よりも多くの人々に生成AIの恩恵を届けています。AI Overviewsは今や月間25億人以上のユーザーを持ち、AI Modeは私たちのSearchへの過去最大の改良として大きな躍進を遂げました。たった1年で月間10億ユーザーを超えました。SearchでAI搭載機能を使う人ほど、より頻繁にSearchを使うようになっています。私はSearchが個別のクエリではなく、継続的な会話のような形に変わってきていることが気に入っています。これがより深いインサイトをもたらし、Webの広がりに接続してくれます。
もう一つ急成長したのがGeminiアプリです。昨年のI/O時点で月間4億ユーザーでしたが、現在は9億ユーザーを超え、1年で2倍以上になりました。同時に日次リクエストは7倍以上に増えました。Personal Contextのようなユニークな機能を追加し、応答をよりカスタマイズされた有用なものにしています。Nano Bananaモデルでは現在5000万枚以上の画像が作られていて、これは昨年の新スターになりました。皆さんが本当に楽しんでくれていることを知っています。
1-3. 製品内会話AIの拡大
Sundar Pichai: Geminiアプリの外でも、私たちは多くの製品の中でGeminiともっと自然な会話ができるようにしてきました。最近MapsはこのI/Oで過去10年で最大のアップグレードを受け、Ask Mapsという新機能が含まれています。ユーザーはこれを使って、より複雑で長い質問をしています。実際の親からのクエリを紹介しましょう。「子どもが今しがた鴨の池に落ちて、結婚式が30分後に始まります。新しいドレスを買うにはどの店に行けばいいですか?」結果を聞きたいですね。
この会話型AIをさらに2つの製品に持ち込みました。まずAsk YouTubeです。毎日多くの人々がYouTubeを開いて様々なことを尋ねています。素晴らしい動画はたくさんありますが、時にどこから始めればいいかわからないことがあります。Ask YouTubeはその体験を一変させます。例えば3歳のお子さんにペダル付き自転車の乗り方を教えたい、しかも子はすでにバランスバイクには乗れる、そんなときYouTubeに尋ねるだけです。情報は理解しやすくナビゲートしやすく整理され、要約と役立つコツが得られます。あなたの関心に最も合った動画が表示され、特定の教え方を試したければそれを学ぶことができます。何より、動画は最も関連性の高い部分に直接ジャンプし、お子さんに自転車を教えた経験を思い出させてくれます。Geminiは文脈も覚えているので、「ハンドブレーキ付きの自転車を買うべきか、ペダルブレーキ付きを買うべきか」と聞けば継続的な会話になります。実際、情報は比較しやすいようテーブル形式で構成されます。Ask YouTubeはテスト開始済みで、今夏に米国で広く展開します。
ここまで会話型のテキストクエリを見てきました。私が音声だけで済ませたいことはたくさんあります。これがオーディオモデルの技術的ブレークスルーのおかげで、より可能になっています。Docs Liveという新機能はコラボレーションを次のレベルに引き上げます。これまでGeminiでドキュメントを作るには非常に精密なプロンプトを書く必要がありました。Docs Liveでは頭の中のアイデアを口頭で吐き出すだけで、Geminiが処理してくれます。製品チームのデモで見てみましょう。すべてリアルタイムで、早送りはしていません。
デモではプレゼンターが「明日、母校の高校でキャリアデーの卒業生プレゼンがあって、ソフトウェアエンジニアとしての仕事について話すポイントを作りたいのですが、どこから始めればいいかわかりません。Driveから私のレジュメを取ってきてもらえますか。退屈かもしれないので、生徒にとって面白いプレゼンになるよう、ちょっと笑える例え話を入れてもらえますか。それから学校からメールが届いていたと思います。件名は『キャリアデーのロジスティクス』だったはずです。そこから詳細を取って、自分の方向性と時間がわかるようにドキュメントの一番上に置いてください」と話します。要件を更新してそのままドラフトに変えると拍手が起き、続けて「いいけど少し詰まりすぎていますね。例え話をテーブル形式にして理解しやすくして、それから兄が私にソフトウェアエンジニアになるきっかけをくれたという話を追記してください。見落とさないようドキュメントの一番上に太字で」と指示し、再び形を整えていきました。
Sundar Pichai: これからは音声だけで新しいドキュメントを作って直接編集できるようになります。Docs LiveはProとUltraのお客様向けに今夏ローンチし、同じく高性能な音声機能がGmailとGoogle Keepにも来ます。
1-4. インフラ投資と第8世代TPU
Sundar Pichai: 私たちの製品全体でこのイノベーションの速度を出荷できる、それを支えるためにはインフラへの巨大な投資が必要で、私たちはまさに今と未来のために投資してきました。2022年には年間310億ドルを設備投資に費やしました。今年はその約6倍、1800億から1900億ドルになる見込みです。この投資の重要な部分がカスタムマイクロチップです。10年前、私たちはまさにこのI/Oのステージで最初の商用Tensor Processing Unit、つまりTPUを発表しました。それ以来、業界がAIのために構築する方法を変革してきました。
最近、Cloud Nextで第8世代TPUを発表しました。私たちは初めて、訓練と推論にそれぞれ専用のアーキテクチャを持つデュアルチップアプローチを取りました。TPU 8tと8iです。見た目は似ていますが実際にはかなり異なります。8tは大規模な事前学習に最適化されていて、前世代の生のコンピュート能力の約3倍を持ちます。訓練インフラへのアプローチも大きく変えました。JAXとPathwaysにより、訓練はもはや単一の大規模データセンターの境界に縛られません。代わりに私たちは複数の拠点にまたがってシームレスに訓練を分散でき、グローバルで100万を超えるTPUにスケールします。これによって世界最大の訓練クラスターを構築する能力を得ました。モデル構築者にとってこれは、より大きく能力の高いモデルを数ヶ月ではなく数週間で訓練できることを意味します。
TPU 8iは推論用に設計されています。各ステップで速度を大幅に向上させました。なぜなら、Searchでの27年の経験から、レイテンシは重要だとわかっているからです。皆さんに体感していただくため、将来のFlashモデルを8i上で動かすプロンプトをお見せします。「Chrome Dinoゲームを作って」と入力して送信ボタンを押します。応答がリアルタイムで生成されます。見ながら右上のトークン毎秒に注目してください。スピードはかなり驚異的で、ほぼ毎秒1500トークンに達しています。プロンプトを書く時間のほうが長いくらいで、ゲーム自体もなかなか楽しいですね。
スピードに加えて、持続可能なスケーリングも考えています。両チップはエネルギー効率が高く、ワットあたり性能で最大2倍を実現します。TPUたちは今年のI/Oに向けて頑張って練習してきました。舞台裏のクリップを見てみましょう。映像ではTPU同士が「いい週末だった?」「希少がんのデータセット全部にわたってタンパク質を折りたたんでただけ。そっちは?」「今後50年の気候データをシミュレートしてた。僕はパグの画像を作ってたよ。会計士の格好をしたパグを見たことある?」と雑談する場面が映され、続いて「よく聞けTPU。I/Oがすぐ始まる。タスクを終わらせなきゃ。何兆ものタスクが待ってる。キャッシュをクリアしろ。Timmy!ファンを乾かして起動しろ。何やってるんだ?モンタージュ作ってる。降りてきて手伝え!」というやり取りで会場を沸かせました。Timmy TPUはI/Oの後すぐにベッドに飛び込めることでしょう。
1-5. ワールドモデルへの導入とDemis登壇
Sundar Pichai: 私たちのコンピュートのイノベーションが、私たちの進歩を可能にしています。今日はそのうち3つの領域、モデル、コーディング、エージェントについて深掘りしたいと思います。まずワールドモデルにおけるエキサイティングな進展から始めましょう。ワールドモデルによってAIはテキストを予測することから現実をシミュレートすることへと移行します。Google DeepMindのDemisとチームは、このモデルの能力の境界を押し広げる取り組みを続けてきました。詳しくお話しいただくためにDemisをお迎えしましょう。
Demis Hassabis: こんにちは、皆さん。ここに来られて本当に嬉しいです。この1年でAIの能力は急速に拡張しました。今や私たちのために計画し行動できるエージェントが手元にあります。汎用人工知能は、もう数年先のことに過ぎません。今日は私たちがAGIの構築でどこまで来たかをお話しします。昨年、私はGeminiの並外れたマルチモーダル能力を拡張してワールドモデル、つまり世界を理解しシミュレートできるAIへと進化させるビジョンを語りました。これはAGI到達における重要な側面であり、AIアシスタントの構築からロボットの訓練まで、あらゆることに重要になります。そして今、私たちは次の大きな一歩を踏み出します。
2. Gemini Omni
2-1. Gemini Omniの発表・物理理解の進化・動画生成と編集
Demis Hassabis: 喜んでお知らせします。Gemini Omniを発表します。これは私たちの新しいモデルで、あらゆる入力からあらゆるものを作り出すことができます。Geminiはその知性を、私たちの最高の生成メディアモデルと組み合わせて、世界理解、マルチモダリティ、編集において新しいレベルをもたらします。Veo、Nano Banana、Genieといったモデルは、すでに極めてリアルな動画、画像、インタラクティブシミュレーションを生成できます。完璧ではないにせよ、これらのモデルはすでに直感的な物理についていくつかの印象的な感覚を示してきました。Omniではさらに前進しました。これは運動エネルギーや重力といった事柄のシミュレーションにおける大きな変化です。
これまでのシステムはこうした概念を捉えるのに苦労していました。Geminiの世界に関する知識と推論能力が、Omniには色濃く表れています。これによって複雑なアイデアを非常に正確な動画に翻訳できます。「タンパク質の折りたたみについてクレイメーション風の解説動画を作って」というようなシンプルなプロンプトを与えるだけで、こうした結果が得られます。動画ではナレーターが「タンパク質はアミノ酸の鎖として始まります。それがアルファヘリックスのようなパターンや、ベータシートと呼ばれる平らな部分に折りたたまれ、完璧な三次元の形を作ります」と説明する映像が生成されました。
Demis Hassabis: しかし最初の生成は始まりに過ぎません。創造プロセスは一回のステップで終わることはめったになく、通常は反復的なものです。Nano Bananaが画像編集のあり方を変えたのと同じように、Omniは会話的な言葉で動画を編集するための、はるかに自然な方法を提供します。個人的なタッチを加えたり、例えばこのセルフィーのように、楽しい方法で現実を変えたりできます。ディテールとスタイルを簡単に調整したり、要素を追加したりすることもできます。シーン全体があなたの新しいアイデアを反映して変化します。シンプルな円がブラックホールに変わったり、夕方の散歩がより生き生きとしたシーンになったり、あらゆるものが新しい現実を作るためのキャンバスになります。
Omniに何ができるのか見てみましょう。私たちは動画から始めましたが、時間が経つにつれてOmniはあらゆる入力からあらゆる出力を生成できるようになります。これは常に私たちがGeminiで目指してきたゴールでしたし、最初からマルチモーダルに構築した理由でもあります。道のりはより困難でしたが、その基盤が今、実を結びつつあります。
2-2. Omni Flashリリース・SynthID拡張・透明性のための業界連携
Demis Hassabis: 本日、私たちはOmniシリーズの最初のモデルとしてGemini Omni Flashをローンチします。これは既に私たちの製品全体で利用可能になっていて、後ほど詳細をお聞きいただけます。これまでの進展に興奮していますし、Omni Proについても近いうちに全貌をお伝えします。皆さんの作品を見るのが待ちきれません。Sundarに戻します。
Sundar Pichai: ありがとう、Demis。大きな進展ですね。生成AIが良くなるほど、透明性への必要性も高まっています。研究によれば、人々が高品質なディープフェイク動画を正しく識別できるのは4本に1本だけです。3年前、私たちは肉眼では見えない透かしであるSynthIDをローンチしました。ローンチ以来、SynthIDは1000億の画像と動画、そして6万年分のオーディオに透かしを埋め込んできました。何百万もの人々がGeminiアプリでSynthID検出器を使ってAI生成コンテンツを検証しています。今、私たちはさらに踏み込んで、Content Credentials Verificationを製品全体に追加しています。このツールはコンテンツの出所がAIなのかカメラなのか、そして生成AIツールで編集されているかどうかを示します。
この例ではGeminiはこの写真がPixelのカメラで撮影され、その後Googleフォトで編集されたことを判別できます。私たちはより多くの人々がこのツールに簡単にアクセスできるようにしたいと考えています。そこでSynthIDとContent Credentials VerificationをSearchとChromeに拡張します。Circle to Searchで囲んだり、Chromeで右クリックして「これはAIで作られた?」と尋ねるだけで済みます。明確な回答と、他の役立つ文脈も得られます。例えばこの画像は昨年SNSでバズりました。明らかに偽物です。私はハンバーガーを食べませんから。他の人にとってはこれほど明白ではないかもしれません。そこでこうしたツールが本当に役立つわけです。
これがスケールするのは、より多くのパートナーが自分自身のAI生成コンテンツに透かしを入れる決断をした場合だけです。NVIDIAは昨年からSynthIDを使い始めました。そして本日、OpenAI、Kakao、Eleven LabsもSynthIDを採用することを発表できて嬉しく思います。業界をまたいだこのコラボレーションが進むのを見るのは素晴らしいことです。私たちはさらに多くのパートナーに利用可能性を広げ、AI時代の透明性のスタンダードを確立したいと考えています。
2-3. Gemini 3.5 Flashの発表と社内導入のフィードバックループ
Sundar Pichai: これがワールドモデルでの進展でした。次にGemini 3ファミリーの次の一歩について話しましょう。Gemini 3は数ヶ月前にローンチされて以来、ユーザーに最も多く使われているシリーズです。デベロッパーがFlashを日常のツールとして使い、Proモデルのマルチモーダル機能と深い推論で素晴らしい体験を構築している様子を見るのは嬉しいことです。私たちはこれらのモデルの品質向上に懸命に取り組んできました。特にエージェント型コーディング、長時間タスク、実世界のワークフローに焦点を当てています。
そして本日、Gemini 3.5 Flashをご紹介できることを嬉しく思います。これは最先端の知性とアクションを融合させたシリーズの最初のモデルです。2点強調したいと思います。1点目は、3.1 Proと比較すると、Flashはほぼすべてのベンチマークで全体的に優れています。コーディングで大きな進歩を遂げていますし、GDPベンチマーク(実世界で経済的価値のある多くのタスクをカバーするベンチマーク)での驚くべき向上を見てください。2点目は、3.5 Flashが極めて高性能なモデルで、最高のモデルに匹敵する最前線にいながら、はるかに高速だということです。だからこそ知性対出力速度のチャートで見ると、このモデルは右上の象限で独自の階級に位置しています。出力トークン毎秒で見ると、他のフロンティアモデルより4倍速く、使っていてとても気持ちのいいものです。
この新しいモデルは私たちGoogleにとって大きな変化をもたらしています。私たちは新しいバージョンのエージェントベースの開発プラットフォーム、Antigravityで3.5 Flashを使ってきました。これが私たちの構築速度を大幅に加速させました。3月の時点で、社内のデベロッパー向けに日次5000億トークンを処理していました。その数字は数週間ごとに2倍になっていきました。今では1日に3兆トークン以上を処理しています。このスケールが効果的なフィードバックループを生み、3.5の品質向上を助けてくれました。そして本日、これをAntigravityのデベロッパーの皆さんにお届けします。詳しい説明のためにVarunに登場してもらいましょう。
3. Google Antigravity
3-1. Antigravity 2.0と新しい能力群
Varun Mohan: デベロッパーにとって本当に並外れた時代です。私たちは書くことを支援するAIツールから、行動できるエージェントへと移行しつつあります。これらのエージェントは開発の障壁を下げ、誰でもデベロッパーになれるようにしてきました。忙しいCEOでさえも、です。実際、Sundarは先週Google Antigravityを使ってGoogleのコードベースのバグを修正しました。
11月にAntigravity IDEをローンチしたとき、私たちはエージェント駆動のコアIDE体験を洗練させ、開発の進む方向性を示すための初めての種類の実験的エージェントを追加しました。すでに数百万人のユーザーがAntigravityを使っていまして、本日さらに多くを発表します。私たちは多様なタスク、好み、そして率直に言えば製品へのフィードバックを見てきました。これらの学びをすべて受け止めました。今、Antigravityはそのエージェント機能、プラットフォーム、統合、製品機能のスイートを大きく拡張します。手始めに、フルなCLI体験、Antigravity SDK、Geminiのオーディオモデルによるネイティブな音声サポート、そしてAndroid、Firebase、Google AI Studioを含む多くの製品とプラットフォームとの統合をローンチします。
これらすべてを本日からお試しいただけます。そして最も重要なのは、その中心にあるAntigravity 2.0です。これはまったく新しいスタンドアロンのデスクトップアプリで、エージェントに最適化された体験という当初のビジョンを真に実現したものです。この新しいAntigravityはエージェントを最優先にして作られており、エージェントのコアな会話、エージェントが生成するアーティファクト、そしてマルチエージェントのオーケストレーションに焦点を当てています。先ほども言ったとおり、エージェントが何より最優先です。Sundarが述べたように、これこそがGoogleのチームが大きな価値を生み出すために使っているまさにその体験です。Antigravity Agent Harness(Geminiが現実世界のタスクを実行するための見えないフレームワーク)は、サブエージェント、フック、非同期タスク管理といった新しいコアプリミティブによってはるかに高度になりました。
これらすべての基盤にあるのがGeminiモデルです。Antigravity Harnessと共同最適化されたGemini 3.5 Flashが土台です。
3-2. OSをゼロから構築する実験
Varun Mohan: もちろん、エンジニアとして私たちは、このエージェントとモデルの能力の境界をどこまで押し広げられるか見てみたくて仕方ありませんでした。そこで、新しいAntigravityとGemini 3.5 Flashを使って、極めて複雑で印象的だと考えたタスクをエージェントに依頼しました。動作するオペレーティングシステムをゼロから構築することです。結果には私たち自身が驚きました。Antigravityは非同期的にこの課題を一貫した計画へと分解し、並列のサブエージェントを通じてタスクを処理し、自分自身のテストを作成し、実行し、反復していきました。12時間以上にわたって、93個のサブエージェントが並列に動き、15,000を超えるモデルリクエストを行い、26億トークンを処理して、空のプロジェクトから動作するオペレーティングシステムのコアへと変えていきました。
これはGemini 3.1 Proでは不可能だったでしょう。しかしGemini 3.5 Flashの性能効率とコスト効率のおかげで、完全に動作するオペレーティングシステムの構築にかかったAPIクレジットは1000ドル未満で済みました。Antigravityのエージェントは、スケジューラからメモリ管理、ファイルシステムに至るまで、すべての行のコードを書きました。すべて自律的なエージェントチームによって作成され、監査され、テストされたのです。文脈をお伝えしておくと、OSをゼロから開発するのは極めて困難で、何ヶ月もかかる仕事です。私たちは単にアプリを作ったのではなく、アプリを動かせるシステムそのものを作ったのです。
そのオペレーティングシステムが動いているところを直接見てみましょう。これがAntigravityが作ったOSのターミナルウィンドウです。動作するOSをデモするのは簡単ではないのですが、システムが機能するか確かめるために何か試してみましょう。インストールできるユーティリティの一つに sl というものがあります。ls のよくあるタイプミスですね。ネタバレせずに見せますと……ほら、できました。AntigravityのロゴをのせたかっこいいSL(蒸気機関車)が画面を横切っていくのが見えます。
しかし、Doomが動かなければ本物のOSとは言えませんよね。今Doomを動かそうとしているのですが、うまくいきません。判明したのは、必要なビデオとキーボードのドライバが存在しないということです。新しいAntigravityで修正してみましょう。プロンプトはすでに用意してあるので貼り付けます。
3-3. Antigravity 2.0デモと他成果・性能最適化・コスト効率
Varun Mohan: これが走っている間に、Antigravity 2.0を見てみましょう。ご覧のとおり、Antigravity 2.0は完全にエージェント中心で、すべてのエージェントの会話とプロジェクトがサイドに並んでいます。過去に行った会話をざっと見てみましょう。私はDoomについての興味深い事実を扱ったデモが気になっていました。そこでエージェントにリサーチしてもらいました。エージェントは右側のパネルに作成・プロットし、さらに私のためにかっこいいアーティファクトも作ってくれました。Nano Banana Proを使ってインフォグラフィックを作成し、たった今書いたコードを使ってグラフを生成し、そしていくつかの興味深いテーブルも作成しました。
ご覧のとおり、Antigravity 2.0は徹底的にエージェントを優先しており、エージェントと対話するための最高のプラットフォームとして最適化されています。先ほどの会話に戻って進捗を確認してみましょう。Antigravityは大量のリサーチを行い、100行以上のコードを書き、ついにOSを構築しました。動くかどうか見てみましょう。決定的な瞬間です。素晴らしい。Antigravity製のOSでDoomを遊ぶのは楽しく印象的ですが、それだけではありません。私たちはエージェントに写真編集スイート、リアルタイムメッセージングアプリ、マルチユーザーコラボレーションプラットフォームの構築も依頼し、すべて同じような結果が得られました。数日かかるエンジニアリング作業が、数時間、あるいは数分で完了するようになります。
これを可能にしているのが、新しいサブエージェント協調機能です。これはAntigravityで初期のリサーチプレビューとして提供する予定です。最後に、3.5 Flashは非常に高速です。Sundarが述べたとおり、このモデルは他のフロンティアモデルより4倍速いのですが、エージェントベースのコーディングは非常にトークンを消費します。そこで私たちはAntigravity上で最適化を施しました。Flashを4倍ではなく、Antigravity上で12倍速くしたのです。本日からこの体験の片鱗を皆さんにお届けできることに興奮しています。今日お見せしているのは単なるビジョンではありません。Antigravityを誰のためにも最も完全なエージェント開発プラットフォームへと構築する方法そのものです。
私たちはGoogleのエコシステムとともにそれを行います。皆さんがすでに使っている技術スタックやツールと統合したり、Antigravity Agent Harnessを使ってGoogle製品全体のエージェント体験を支えたりすることで実現します。本日、Antigravity 2.0はグローバルにすべての人に利用可能になります。デベロッパーキーノートでも、新しい機能をすべてデモしますのでぜひご覧ください。Sundarに戻します。
Sundar Pichai: ありがとう。Varunの言ったOS全体が、サブエージェントのチームによってわずか12時間で、しかも非常に低コストで構築されたというのは本当に並外れたことです。Flashの強みは、最先端レベルの能力を、同等のフロンティアモデルの半額未満で提供できる点にあります。多くの企業がまだ5月だというのに、年間のトークン予算を使い切りつつあるという話を聞いています。Flashと他の最先端モデルを組み合わせて使えば、企業は多くのコストを節約できます。文脈としてお伝えすると、Google Cloudのトップ企業は1日に約1兆トークンを処理しています。彼らがワークロードの80%を他の最先端モデルから3.5 Flashへと切り替えれば、年間で10億ドル以上を節約できることになります。これは本当の節約で、事業に再投資できる金額です。
Gemini 3.5 Flashは本日から、私たちの製品とAPI全体で誰でも利用可能になります。3.5 Proについても本当にワクワクしています。社内で使っていて、大きな改善を示しています。試したくて待ちきれないことは承知しています。来月までお待ちください。
4. Gemini Spark
4-1. Gemini Sparkの紹介とダッシュボード・複合タスクのデモ
Sundar Pichai: Gemini 3.5とAntigravityは、エージェントとエージェント機能の新しい世界を切り開きます。私たちはデベロッパーや企業にエージェントをお届けすることに、しばらく取り組んできました。今、私たちは強力なエージェントを安全かつ確実に消費者に届けることに強く注力しています。そうすればエージェントは誰のためにも働くことができます。すでに私たちの様々な製品ではエージェント駆動の体験がたくさんありますが、私が特に興奮しているのが、Geminiアプリに直接お届けするものです。ご紹介します、Gemini Sparkです。これはあなたのデジタルライフをやり遂げるのを助けてくれる、パーソナルAIエージェントで、あなたの指示のもとに行動を起こしてくれます。
このサービスはGoogle Cloud上の専用バーチャルマシンで動き、24時間365日利用可能です。そう、ラップトップを閉じてしまっても大丈夫です。このモデルはGemini 3.5とGoogle Antigravity Harnessが支えていて、長時間にわたるタスクをバックグラウンドで難なくこなせます。Sparkは様々なツールとシームレスに統合され、まずは私たち自身のツールから始まり、今後数週間でMCPを通じてサードパーティのツールとも繋がっていきます。Sparkは最も都合の良い方法で使えます。Geminiアプリからでも、近いうちにはメールやチャットからでも使えるようになります。詳しくはJoshから紹介してもらいましょう。
Josh Woodward: ありがとうございます。皆さんお会いできて嬉しいです。Sparkがどう動くか、私の私生活の例でお見せしましょう。これが新しくゼロから再設計されたGeminiです。これについては後ほど詳しくお話しします。早速Sparkに入りましょう。すぐ目に入るのが、バックグラウンドで進行中の様々なタスクが並んだダッシュボードです。これらをチェックできますし、まずはタスクを貼り付けてみます。これは比較的シンプルですが、とても便利な例です。「チームへのメールの下書きを手伝ってください。先週のGeminiのライブローンチとマイルストーンをすべてまとめてください。/ghostwriterを使ってください」と入れます。いくつかのことが起きています。すべてをまとめるという指示で、ドキュメント、メール、チャット全体から、このアップデートに必要な最も重要な情報を引き出します。/ghostwriterは先週の期間で見たものすべても使います。
これはパーソナルスキルで、メールが私らしく聞こえるように書かれたものです。Sparkではオンラインで見つけたお気に入りのスキルをアップロードできます。これはバックグラウンドに残しておきましょう。モデルがツールを呼び始めているのが見えます。私生活からのもう一つの例に移ります。私たちは近所のパーティを計画していまして、これはかなり複雑なプロンプトです。出欠の確認、参加者と持ち寄りリスト、まだ登録していない近所の人へのメール送信のリマインドが必要です。ここで素晴らしいのは、Sparkがステップ・バイ・ステップで進めていく様子が見えることです。これらのステップ、そしてそこで節約される時間を見てください。あなたが持っているスキルやアプリと連携して動きます。
素晴らしいのは、Geminiがこれを分解して、ファイルも作ってくれることです。一つ目はGoogleスプレッドシート上のライブRSVPトラッカーです。誰が確認したか、誰がまだなのかが見えます。面白いのは、これがGmailと繋がっているので更新されるという点です。8行目のL. Thompsonが確認したら、これが自動的に更新されるのが見えます。素晴らしいですね。さらに、まだ登録していない様々なゲストを追跡し、リマインダーメールを送ります。これも実行されます。ドラフトが作成され、私のコントロール下にあるので、私が送信できます。最後にこのプロンプトは近所のパーティ用の短いプレゼンテーションも作成しました。Googleスライドで直接作成され、シームレスに統合され、行き止まりに巨大なバウンスハウスを設置するといった情報まで引き込んでいます。すべてバックグラウンドで、しかも私のコントロール下で進行しています。Geminiはさらに踏み込んで、住宅所有者協会が6月5日金曜日の午後より前は許可していないという情報まで、Google Drive内のファイルから引き出してくれます。すべてをまとめるのに本当に役立つ機能です。
4-2. モバイル・Chrome・Android Halo・価格改定
Josh Woodward: これがラップトップで動くSparkの例でした。Sparkは外出先でも非常に便利で、AndroidとiPhoneの両方で動きます。私の携帯で見てみましょう。Sparkを開くと、今話した2つのタスクがすべてのデバイス間で同期されているのが見えます。これは本当に便利です。Sparkは頭の中にあるすべてのことを記録するのに優れています。とても忙しいときは、アシスタントに直接タスクを渡すだけでよいのです。Sparkがそれを捕まえて実行してくれます。これを見てください。「いくつかのメッセージのバンドルを作ってほしい。まず、Sundarとのこれからの会議をすべて見つけて、見逃さないように明るいピンクに変更して。次に、昨夜新しい近所の人のJohnに会った。彼と家族にまだ登録していないので近所のパーティへの招待メッセージを書いて。三つ目、学年末までに子どもたちのためにやるべき重要なことのドキュメントを作って。期限と優先度で分類して、わかりやすくして。何も見落とさないように」と送信します。
私が話すスピードに合わせて、Geminiが私が話すと同時にすべての文脈を記録していくのが見えます。これは1つのメッセージの束として始まりましたが、バックグラウンドでは個別のタスクへと分解されていきます。これで私は携帯を置いて他のことに移れます。Sparkがバックグラウンドで私のために働いてくれます。後で進捗を確認しましょう。これはI/Oの場で私たちが初めて携帯を置いて、それに働かせることができる瞬間の一つです。素晴らしいですね。
安全性を最優先にしているため、Gemini Sparkは今週、信頼できるテスターに段階的にロールアウトし、来週からは米国のGoogle AI Ultraのお客様向けにベータ版として提供します。私たちはこの新しい種類の支援を、できるだけ多くの人々に届けたいと考えています。そのために月額100ドルの新しいUltraプランを導入します。最上位のUltraプランをお使いの方々に対しては、最大限の制限が必要な方のために、月額250ドルから200ドルへと値下げします。これからもまだまだ続きます。
今夏のうちに、Gemini SparkがChrome内で直接動作するようになり、ウェブ全体を横断するエージェント型ブラウザとして機能します。あなたの指示に応じてタスクに行動を起こせます。さらに携帯上のエージェント専用ハブ、Android Haloも構築中で、年内に登場予定です。Sundarが述べたとおり、私たちはGoogleで新しいエージェントの時代に入りました。皆さんが何を作るのか見るのが楽しみです。Sundarに戻します。
Sundar Pichai: ありがとう。Gemini Sparkが皆さんのために様々なことをこなしてくれるのを見るのは素晴らしいことです。私自身も様々な種類のエージェントを試してきて、その可能性が見えています。エージェントを使いやすく、安全で、本当に役立つものにするにはまだ初期段階です。だからこそ私はGemini Sparkにとても興奮しています。私たちはこれらすべてを、どこにいる消費者にとっても安全な形で1つにまとめる基盤を構築しています。皆さんに試してもらいたいと思っています。私たちは今、Geminiのエージェントの時代に入りました。Gemini Sparkは皆さんに見ていただいた最初の体験ですが、これは3.5モデルとAntigravityによって可能になっています。この組み合わせが、私たちのミッションを実現し、製品をはるかに有用なものへと変革する新しい方法をもたらしてくれます。
5. Search
5-1. AI Searchへの全面シフトと新Searchボックス・統合体験
Sundar Pichai: これがどのようにSearchを変革していくか楽しみで仕方ありません。Searchは私たちの最大のイノベーションです。この1年は、私たちの情報ミッションの中心でどれほど多くのイノベーションが可能かを証明してくれました。エージェント時代に入る今、Searchはかつてないほど便利でパワフルになります。次に何が来るのか、Lizにお話しいただきましょう。
Liz Reid: Searchには毎日数十億の質問が寄せられています。時には世界中が同じことを検索することもありますが、それよりも多くの場合、あなたの質問はあなた自身と同じくらいユニークです。だからこそ私たちは、心に浮かんだことを何でも尋ねられるようにしようと取り組んできました。それを実現するために、検索エンジンの最良の部分とAIの最良の部分を組み合わせる作業を進めてきました。
この変革はAI Overviewsから始まりました。覚えていらっしゃるなら、ちょうど1年前、この同じステージでAI Modeをローンチしました。これは私たちの最も強力なAI検索で、最も高度なGeminiモデルを搭載しています。本日からこれをGemini 3.5にアップグレードします。Sundarが言ったとおり、AI Modeは月間10億ユーザーを超え、ローンチ以来、AI Modeのクエリは四半期ごとに2倍以上に成長するという驚異的な伸びを見せています。Searchで何ができるかをユーザーが学ぶにつれて、皆さんはより多くを尋ねるようになっています。そのため直近の四半期では、Searchのクエリ数が過去最高を記録しました。しかしさらに驚くべきことに、皆さんはSearchが本当にそれを処理できると知っているからこそ、非常に具体的な詳細を含む本物の質問を投げかけているのです。Searchとは、より深い本物の会話を交わすようになっています。だから単に近場のハイキングコースを尋ねるのではなく、「景色が良くて犬連れOKの近場のハイキング旅行の旅程と、駐車スペースがちゃんとある昼食場所を組み立ててもらえる?」と聞くようになります。
今、私たちはGoogle Searchの次の章に入ろうとしています。「AI機能をたくさん備えたSearch」ではなく、「Google SearchはAI Searchそのものになる」のです。AI Searchは、私たちの最先端のGeminiモデル、最新のエージェント機能、世界の情報の完全なカバレッジ(毎分10億以上の事実更新、毎日数十億の新しいウェブページのインデックス、そして人類の無限の視点への接続)を一つにまとめて活用できる場所です。心に浮かんだことなら何でも、Googleを開いて文字通り何でも尋ねることができます。
手始めに、新しいインテリジェントなSearchボックスのローンチを発表します。かつてSearchボックスは制限されたスペースでしたが、AIによって徹底的に作り直されました。あなたの好奇心とともに進化する機能です。質問を入力するときに、SearchがAI搭載のサジェストで質問を磨くのを助けてくれます。これは単なるオートコンプリート以上のもので、思いつかなかったかもしれないニュアンスを提示してくれるので、適切な質問を簡単に立てることができます。私たちの最も先進的なAIツールが、新しいSearchボックスから直接アクセス可能です。テキスト、画像、ファイル、動画など、様々なモダリティで質問することもでき、Searchはそれらすべてを推論します。これは25年以上前のリリース以来、Searchボックスへの最大のアップグレードです。本日からロールアウトを開始します。
さらに、AI OverviewsとAI Modeを一つの便利なAI Search体験に統合することで、Searchとの会話を継続しやすくします。メインのSearch結果ページの質問と回答から、AI Modeでのフォローアップ質問へとスムーズに移行できます。文脈は保持され、会話はより深くなります。リンクとソースは皆さんが探索したいかもしれないものとさらに関連性の高いものとなり、AIとインターネットから最良の結果を得続けられます。良いニュースとして、この新しいAI Search機能は本日から、世界中のデスクトップとモバイルで利用可能です。
5-2. Search Agents・生成UI・カスタムミニアプリ
Liz Reid: さて、SundarとJoshが先ほどエージェントへのアプローチとその可能性について話してくれました。今、私たちはこのビジョンに向けてエキサイティングな一歩を踏み出します。Search内で直接、あなたの様々なタスクのために複数のAIエージェントを作成・管理できるようにします。私たちはSearchエージェントの時代に入っていきます。手始めに、24時間365日バックグラウンドであなたのために働く情報エージェントを設定できます。エージェントはあなたが必要なときに、まさに具体的なニーズを見つけ出し、行動を起こすのを助けてくれます。Searchでは一度に複数のエージェントをアクティブにすることができ、あなたにとって重要なすべてのことを最新の状態に保ち、進展を追い続けてくれます。
これはGemini Sparkとも連携して、皆さんの生産性を高めてくれます。実際に使ってみましょう。例えば、皆さんが金融に非常に詳しくて、P/Eが15未満、キャッシュフローがプラス、低負債の大手バイオテック株について必要なときに知りたいとします。今では、それをすべて尋ねるだけで、エージェントが働き始めます。複雑な質問に答え、計画を立てます。エージェントは緊急性を判断し、皆さんがすぐに情報を必要としていることを理解し、情報が変化したときに探すためのトリガーを設定し、必要なツールとデータ接続を選択します。私たちのリアルタイム金融データに直接接続するので、株価や市場が動くときの市場へのインサイトを毎秒最新で受け取れます。
接続されると、エージェントはスマートでコンパクトな最新情報を届けてくれます。これは何が起きているかを理解するのに役立ち、シグナルとノイズを分けるのに役立ちます。エージェントはクラウドソース型のリサーチプラットフォーム、ニュースサイト、ソーシャルメディアといった非常に関連性の高いコンテンツにも接続します。これは、そのコンテンツを最も必要としている人々、最も気にかけている人々が、まさに必要なタイミングでサイトやクリエイターの新しいコンテンツを見つけるのにも役立ちます。アパートを探していると想定してみてください。立地、自然光、空室状況といったすべての基準を含めて探しているものをすべてリストすると、エージェントは様々なサイト、ソーシャルメディア、フォーラムを横断してウェブ全体をスキャンし続けます。あるいはスニーカー好きの方なら、好きなアスリートがコラボやスニーカーの発売を発表したときに通知してくれるよう頼むだけです。ブログからShopping Graphまですべてをモニターするので、見逃すことはありません。この夏には情報エージェントに皆さんを助けてもらえます。知りたいことなら何でも、Searchに最新情報を求めるだけで済みます。
情報エージェントは、Searchで皆さんを助けるために最初に導入する多くのエージェントの一つです。だから、何かを見つけたい、確認したい、予約したい、購入したい、あるいはそれ以外のことも、Searchはそれを実行できます。Searchにはエージェント型コーディングももたらします。これは皆さんの質問のためだけのカスタム体験を構築するためです。これがどう機能するかについてはRobbyから説明してもらいましょう。
Robby Stein: 私たちは、Searchの最良のバージョンは皆さんのために特別に作られたものだと信じています。これは、皆さんの質問にとって最も役立つフォーマットで情報を届けるSearchです。その洗練には何年もかかりました。だから皆さんが買い物をしているなら商品を見せ、データについて尋ねるなら図表を見せ、インスピレーションを探しているなら美しいビジュアル要素を見せます。今、私たちはこれを次のレベルへ持っていきます。AntigravityとGemini 3.5 Flashのエージェント型コーディング機能をSearchに直接持ち込みます。だからSearchは、皆さんの質問に対して理想的なフォーマットを瞬時に完全にカスタマイズして構築できます。動的なレイアウト、インタラクティブなウィジェット、体験全体について話しているのです。すべてが皆さんのためにカスタムビルドされます。これはSearchスケールでのエージェント型コーディングです。
例を挙げます。私が宇宙物理学を理解しようとしている学生だとしましょう。Searchを開いて「ブラックホールは時空にどう影響しますか?」と尋ねます。すると、AI Overview内に直接インタラクティブな画像が得られます。Searchは、この複雑な概念について、私が本当に理解するためにはそれと対話する必要があると理解しているのです。これはまだ基礎レッスンのようなものですから、フォローアップしてみます。「連星ブラックホールのような2つの軌道を回る天体がどう重力波を生成するか教えてください」。Searchは私の具体的な質問のために完全にカスタマイズされた、新しいインタラクティブアニメーションを動的にリアルタイムで構築します。軌道の分離や質量比といったパラメータをいじることができますし、これは本当にクールです。波形パターンが変化し、小さなブラックホールが大きなブラックホールの周りを回るのが見えます。基礎を理解したら、ここでこれらの参考文献を学ぶことができ、LIGOの発見論文のようなものを読んでさらに学ぶこともできます。
このようなカスタムUIを、数十億ものユニークな質問のためにSearchがどう作るのか、不思議に思うかもしれません。Gemini 3.5 Flashを使って、Searchは理想的な応答を最初から計画します。Searchはレイアウトを設計し、構築するカスタムコンポーネントを決定し、リサーチを行い、最後にコードをデプロイします。このような応答でカスタムコンポーネントを構築するために、SearchはAntigravityによって駆動されるエージェント型コーディングプラットフォームを呼び出します。これによって安全なコンテナ化された環境でファイルを読み書きし、コードを実行できます。これはVarunがOS全体を構築するのを見たときと同じ技術で、私たちはその機能をSearchに直接持ち込んでいます。AntigravityによるGenerative UIはこの夏Searchでローンチします。すべての人に無料で。
スマートウォッチがどう動くか、新しい旅行のコスト分析、その他多くのことを理解したいなら、皆さんの質問と同じくらいユニークな応答を受け取ることになります。さらに一歩進めましょう。プロジェクトの中には一度きりの質問ではなく、長期にわたるタスクもあります。だから今、Searchはツール、トラッカー、ダッシュボードのようなカスタム体験全体を構築するのを手伝えるようになりました。私はこれをSearch内で自分のミニアプリを作るようなものだと考えていますが、すでにたくさん作りました。これは結婚式の計画や引越しの管理のように、長期にわたって行ったり来たりして取り組むタスクに本当に便利です。どう思いますか?一緒に作ってみますか?よし、デモを見てみましょう。
私は木曜日にいつも、毎週末の家族向けアクティビティのアイデアを探しています。今しがた「今週末の家族との楽しいアクティビティ」を検索したところで、もちろんAI Modeは素晴らしい応答を出してくれましたが、新しいものがあります。Searchが事前に週末のプランナーを作るよう提案してくれているのです。Searchがインタラクティブな画像のためにGenerative UIを最初から作るのと同じ方法で、これも作れるようになります。
始めましょう。今日のデモのために、その仕組みをのぞき見できるようにしました。構築中、リアルタイムの推論ステップとコード生成の流れが見えます。ここでSearchは、適切なコンポーネントが何か、単に取得する情報だけでなく、それを表示する最良の方法を考えています。私はGmail、フォト、カレンダーを安全に接続することを選びました。SearchがPersonal Contextを使って、私の提案をはるかに有用にできるようにです。これはパーソナライズのために、Gmailの予約情報、カレンダーなどを参照することを意味します。よし、できあがったようです。このアプリには美しいプランナーがあって、ドライブ時間と天気をすでに予想しています。Searchは私に2人の子どもがいることを知っています。彼らは動物が大好きで、長男はチェスを覚え始めました。だから、この2番目は長男にとってすごくクールなものなので気に入りそうです。でも私は2人の子ども両方を幸せにしなきゃいけないので、Happy Hollow Park & Zooを選びます。これは私のカレンダーと同期しているので、午後の予定はすでに友人と会ってこの試合を観るためにブロックされています。
その下には素晴らしいレストランの予約候補が並んでいて、マップにきれいに配置されています。エージェントを見て、マップをもっと上の方に持ってきてほしいと思います。妻と私も金曜日の夜にデートをしたいんです。だから、これを調整し続けますし、もっと速くやるために、ここにもう一つプロンプトを貼り付けて、毎週金曜の夜のデートを追加して上に移動させます。先ほどと同様、これはプランナーのカスタマイズが必要だと考え、リアルタイムの情報を探し、私の好みを再度チェックします。すごい、すごく速いですね。このアプリはGoogleからのあらゆる情報を使ってすばやく構築でき、今やマップが一番上に、金曜日の夜のデートタブがここに見えるようになりました。下にスクロールするとこの素晴らしい場所を見つけられます。シッターが来た後、いくつかのクールなレストランがあります。これを選んで、出かける準備ができます。
週末プランは、妻のDanielleからのオーケーをもらうまで完成しません。彼女にこのアプリを共有できるので、ここで共有してコピーします。携帯で開いてみましょう。彼女に送ると、彼女の携帯ではこう見えます。Danielleが見てくれたようですが、後で家に帰ったときにフィードバックをくれるようです。それは後で対処します。私はカレンダーに追加するだけです。Searchはこれを家族全員のカレンダーに追加してくれて、設定完了です。来週もまたここに戻ってきて、家族との新しい週末を計画します。
私たちはAntigravityをSearchに持ち込みます。それによってGenerative UIはこの夏利用可能になります。購読者から始めて、今後数ヶ月で、このようなカスタム体験を構築できるようになります。Searchエージェントからエージェント型コーディングまで、このAI Searchは皆さんの質問が何であれ、もっと多くのことができます。エージェント機能はSearchの使い方を変革しています。買い物の仕方も含めてです。詳しくはVidhyaから説明してもらいましょう。
5-3. Agentic Commerceの3要素
Vidhya Srinivasan: AIの並外れた進歩により、私たちは本当に新しい時代に入っています。エージェント型コマースの基盤を構築してきました。そして今、その未来を皆さんにお届けします。Googleでは1日に10億回以上の買い物が行われていて、何年にもわたって、私たちは皆さんが探しているものを手に入れられるよう、ブランドや小売業者と皆さんを繋いできました。
これはShopping Graphから始まりました。これは世界で最も包括的な商品カタログです。600億以上のリスティングを持ち、常に更新されています。Shopping Graphのスケールを、私たちの最先端のGeminiモデルと組み合わせると、まったく新しい買い物の仕方が楽しめます。よりスマートで、より賢く、より楽しいものです。エージェント型コマースに関して、私たちはこの未来を実現するための3つの主要な構成要素を提供することに注力しています。
第一に、Universal Commerce Protocol、つまりUCPです。UCPはエージェント型コマースにとって、HTTPがウェブにしたのと同じことをします。UCPはエージェントとシステムのための共通言語を提供します。これは、すべての主要プレイヤーが買い物の旅全体で機能するためのオープンソース標準です。つまり商品リサーチからチェックアウト、配送追跡まで、すべてが極めてシームレスになります。業界全体がこれを支持してくれているのを見られて嬉しく思います。私たちは素晴らしい創設パートナーグループとともにUCPを共同開発しローンチしました。そして最近、Amazon、Meta、Microsoft、Salesforce、Stripeを迎えました。彼らはこのオープン標準を導いていくのを助けてくれます。私たち全員が何かに合意するのは、これが初めてかもしれません。今、私たちはUCPをローカルフードデリバリープロバイダーやホテルといったより多くの垂直分野に、さらにYouTubeや他の製品にも持ち込んでいます。今後数ヶ月のうちに、Google製品でUCPを活用した体験を、カナダ、オーストラリア、英国といったより多くの地域に拡大します。
これが2番目の構成要素、Agent Payments Protocol、つまりAP2へと繋がります。エージェント型決済に関する一番の質問は、「エージェントが暴走して、私が望まないもの、例えばバイクみたいなものを買わないとどうやって確信できるのか?」というものです。これは妥当な質問で、だからこそ私たちはAP2を作りました。これは皆さんのAIエージェントが皆さんに代わって安全に支払いを行えるよう設計されていますが、常に皆さんのコントロール下にあります。私たちにとって2つのことが重要です。ガードレールを設けることと、説明責任を確保することです。
まずガードレールから話しましょう。今、私たちは厳密なガードレールの設定を簡単にしました。皆さんが望む特定のブランドと製品、そして使いたい金額をエージェントに伝えるだけです。条件が満たされれば自動的に購入を行います。しかしガードレールは説明責任があってこそ機能します。AP2は皆さん、販売者、決済処理業者の間に透明で検証可能な関係を作ります。AP2はデータの安全性を保護するためにプライバシー保護技術を使い、改ざん防止のデジタルマンデートにより、エージェントが常に皆さんに代わって行動していることを保証し、永続的なデジタル監査証跡を提供します。だから商品を返品する必要があるとき、皆さんと販売者は同じ記録を見ることになります。支払い情報は保護され、データはプライベートに保たれ、購入は安全に保たれます。今後数ヶ月のうちに、Gemini Sparkを皮切りに、AP2をGoogle製品に統合し始めます。
これらのプロトコルがこの新時代の基盤を支えています。それがエージェント型コマースの最後の構成要素へと繋がります。Universal Cartを発表できることを嬉しく思います。これは本当にスマートなショッピングカートです。販売者全体、サービス全体で機能します。Searchを閲覧しているとき、Geminiと会話しているとき、YouTubeを見ているとき、あるいはGmailを読んでいるときでさえ、カートに商品を追加できます。商品を追加すると、カートはバックグラウンドで皆さんのために働きます。プロモーションや割引を探し、価格履歴を教えてくれ、商品の在庫が戻ったときに知らせてくれます。すべてがGeminiモデルで動いているので、モデルが進化するにつれてカートはさらに賢くなります。だからスーパーパワーを持って買い物しているようなものだと考えてください。
もう一つのブレークスルーは、知的な推論をどう適用するかです。例えば、皆さんが初めての自作PCを組み立てているとします。良いレビューのマザーボードを見つけてカートに追加します。皆さんはすでにプロセッサを選んでいますが、そのプロセッサが違うソケットタイプのマザーボードを必要とすることに気づいていません。皆さんのカートはこれを検出して代替案を提案し、望ましくない問題を防いでくれます。次に私のお気に入りの機能ですが、カートは皆さんのために隠れた節約を見つけることができます。私のように様々な特典付きの様々な支払いカードを持っていると、割引を追跡するのは難しいものです。今では追う必要はありません。カートがGoogle Walletに統合されているので、それをやってくれます。
例を挙げましょう。ここに今週初めにカートに追加したいくつかの商品について、Targetからのオファーがあります。これを見て、今すぐ買いたいと思います。さらに、UCPによってカートからのチェックアウトが極めてシームレスになります。お気に入りのブランドのいくつかでは、Google Payを使って数タップでGoogleから直接チェックアウトすることも、商品を直接小売店のサイトに移動してそこで購入することもできます。Universal Cartは今夏、米国のSearchとGeminiアプリでローンチし、続いてYouTubeとGmailでも提供されます。本日お見せした構成要素は、エージェント型コマースの基盤を作るだけでなく、皆さんがGoogleで買い物をする方法をより効果的に、より賢く、より楽しくなるよう変革しています。良いお買い物を。Lizに戻します。
Liz Reid: 本日、検索エンジンの最良の部分とAIのパワーを統合して、これまで以上に役立つパワフルなGoogle Searchを構築する方法をご覧いただきました。Searchエージェントが24時間365日皆さんのために働く場所。エージェント型コーディングによって、Searchが皆さんの質問と同じくらいユニークな体験を構築できる場所。エージェント型コマースのパワーがもはや未来の概念ではなく、今ここにある場所です。AI Searchを使えば、Googleは皆さんが何でも見つけ、理解し、構築し、実行するのを助けることができます。だから、ぜひ尋ねてみてください。
6. Gemini
6-1. Geminiアプリのこれまでと再設計(Neural Expressive)
Josh Woodward: 皆さん、こんにちは。またお会いできて嬉しいです。今朝はいくつかの並外れたブレークスルーをご覧いただきましたが、これはまだ始まりに過ぎません。Geminiアプリから多くのものをお見せしたいと思います。早速始めましょう。この夏の間、Geminiは急速な進化を遂げました。月間9億人を超えるユーザーがGeminiアプリを開いています。その成長は、私たちが新機能を出荷するスピードから来ています。1年前にはこれらの機能はどれも存在しませんでした。今や、Geminiは誰にとっても最高のクリエイティブツールになりました。これまで想像もできなかった方法で画像、動画、音楽を作ることができます。Personal Contextを通じて、Geminiをよりカスタマイズされたものにしました。Gmail、フォト、その他のアプリを安全に接続して、特化したサポートを得られます。
先週、Personal Contextを世界中のユーザーへ、アプリ内で直接拡大しました。何百万もの人々が毎日それを使っています。彼らは商品や旅行のおすすめのパーソナライズ、あるいはキャリアチェンジのような人生の大きな決断を考えるパートナーとして役立てています。私の場合は、近所のパーティに登場する素敵なミニバンに合うタイヤを選ぶ相談相手として使いました。学生のためのGeminiの性能もこの1年で高めました。ガイド付き学習に使え、練習問題を作り、すべてのノートと課題を一箇所に保存する専用のノートブックを使うこともできます。この同じノートブックは直接NotebookLMに同期されます。NotebookLM自体は、複雑な情報を理解しやすい知識に変えるために、すでに15億を超えるノートブック、ポッドキャスト、プレゼンテーションスライドなどを作るのに使われています。
Sundarが先ほど話したように、私たちは新しいGemini 3.5 Flashモデルをローンチします。これが本日お見せする一連の新機能を提供します。これらはすべてGeminiアプリで起きています。Geminiアプリは230を超える国、70を超える言語で利用可能で、世界で最も広く利用可能なAIシステムです。Geminiは、より多くの人々が使うユニバーサルアシスタントになりつつあります。日常生活のために設計されています。デザインの話に触れますと、これが本日3つあるアップデートの1つ目です。本日発表するのは、Geminiの体験を一からまったく再設計したということです。アプリを開いた瞬間から、Neural Expressiveと呼ばれる息をのむような新しいデザイン言語でお迎えします。微細なアニメーション、鮮やかな色彩、新しいタイポグラフィ、そしてアプリ全体にわたる触覚レスポンスを追加しました。しかし良いデザインは見た目だけの問題ではなく、どう機能するかも重要なのは私たちもわかっています。
そこで体験全体を引き上げました。リミックスしやすい組み込みのテンプレートで、美しい画像、動画、音楽を見つけて作るのを簡単にしました。Gemini Liveの体験も完全に変革しました。今では立ち上がりが速くなり、より統合されたように感じます。近いうちに、目的に合った地域の方言を選べるようになります。リバプール訛りのような素敵なアクセントの組み合わせがあります。この機能と、他の多くの地域方言は数週間後にリリースされます。私のお気に入りの部分は、新しいNeural Expressiveデザイン言語でモデルの応答をどう扱うかです。ここですべてが実現します。長文のテキスト塊は見ません。代わりにGeminiは、まさにSearchのGenerative UIのように、皆さんのためだけにリアルタイムで応答を慎重に組み立てます。スクロールすると、Geminiによってカスタムに作られたインタラクティブな画像が見えるかもしれません。それを通して情報を新しいレベルで探索できます。一目で読めるタイムラインや、埋め込まれた動画を見ることもあります。ライトモードかダークモードかにかかわらず、体験全体が流麗で未来的で、極めて自然に感じられます。一番良い部分はNeural Expressiveが今この瞬間からAndroid、iOS、ウェブでグローバルにロールアウトされるということです。
6-2. Gemini Omniアプリ統合・Daily Brief・Sparkカスタムワークフロー
Josh Woodward: Geminiアプリの完全な再設計を新しい基盤として、今、私たちはGeminiのクリエイティブ能力を引き上げます。これが2つ目のアップデートです。Gemini Omniは本日から有料のお客様向けにGeminiアプリにやってきます。テキスト、画像、動画の入力を組み合わせてアイデアを実現できます。使ってみた感想として、動画にとってのNano Banana瞬間がやってきたと感じました。動画の作成と編集がこれほど簡単だったことはありません。どう機能するか見てみましょう。
Sashuを紹介します。彼女は新しい曲を制作中で、短いティザー動画を作りたいと考えています。彼女はこの生の動画を共有し、いくつかの視覚的な参照を追加します。そしてここがクールな部分です。動画のスタイルを変えたり、カメラアングルを360度ビューに変えたりすることさえできます。それからGeminiがすべてをまとめます。こんな見た目になります。すべてGeminiの中で行われました。ご覧のとおり、Omniは動きの物理を理解していて、画像の本質を失うことなく現実世界に効果を巧妙に追加しています。動画を作って、リミックスして、編集することがこれほど簡単だったことはありません。今、頭の中にあるすべてのアイデアをGeminiで実現できます。世界中のGoogle AI Plus、Pro、Ultraのお客様は、今日から直接アプリでGemini Omniを試すことができます。
本日の3つ目のアップデートは、Geminiにエージェントがやってくるということです。これはGeminiにとって大きな変化です。エージェントは質問に答えるだけでなく、皆さんのためにプロアクティブに働くからです。何を意味するかをお見せするために、すぐに使える最新のエージェントの一つ、Daily Briefを紹介します。これは個人的なブリーフで、毎朝最初に見るためにデザインされています。どう機能するかご覧ください。ここでGeminiが私の受信箱、カレンダー、タスク全体から情報を合成しているのが見えます。Geminiは私が知る必要のある最重要事項を見つけ出します。本を返すといったことを忘れないようにできます。これは単にデータを要約するだけでなく、トピック別に整理してくれます。次のステップも提案してくれます。この旅行情報を使って、すぐに次のステップを取れます。すべてが朝のサマリーにコンパクトにまとめられ、一目で読めるように作られています。皆さんに試していただきたいと思います。Daily Briefは本日から、米国のGoogle AI Plus、Pro、Ultraの登録者向けにロールアウトされます。これが朝食前に得られるサポートです。
Daily Briefに加えて、上級ユーザーがGemini Sparkを使って独自のカスタムワークフローを構築できるようにします。先ほどイベントの初めの方で、私がいくつかのタスクを送ったのを覚えていらっしゃると思います。チェックして結果を見てみましょう。携帯からこれを送ったのを思い出していただけるでしょう。ラップトップで開いて同期されているのを見ましょう。ラップトップで開くと、タスクがここで3つに分かれているのが見えます。1、2、3。実はとても良い機能があります。皆さんの入力を求める特定のタスクがあって、必要なものだけを実行するよう承認できます。ここで確認してみます。これは学年プランナーのチェックリストです。私は今から学年末まで覚えておくべきことのリストを作るようGeminiに頼みました。開いてみると、この機能の素晴らしい点は、Googleドキュメント形式すべてが利用できることです。クリックして、ここで各子ども別のチェックリストを見られます。すべてこのように分割されていて、日付、活動、色分けを一つずつ簡単に確認できます。すべて一箇所に統合されています。これは本当に時間の節約になります。
これらすべての例から見えるのは、私たちがエージェントを使いやすく、安全で、確実なものにしたいと考えているということです。リマインダーとして、Sparkは今週、信頼できるテスター向けにロールアウトを開始し、米国のGoogle AI Ultraのお客様向けのベータ版として来週リリースします。SparkのバージョンはGemini WorkspaceとGemini Enterpriseにも提供します。これはまだ始まりに過ぎません。今夏中にロールアウトする機能がたくさんあります。MCP統合は本当にエキサイティングです。これによってSparkがより多くのタスクを、よりプロアクティブで効果的な方法で扱えるようになります。想像してみてください。Sparkがカレンダーの予定を見て、土曜日のお子さんのTボール試合でおやつ当番だとわかるとします。Sparkはそれを覚えていないようにInstacartの注文を直接準備することさえできるでしょう。Sparkはナッツフリーのおやつを選ぶことも忘れません。この夏の間、Sparkと統合してくれる素晴らしいパートナー陣が控えています。
6-3. Gemini for Mac OSのボーナス発見とユーザーストーリー(Holly)
Josh Woodward: 新しいアップデートは3つだけと約束しましたが、もう一つあります。先月、私たちはMac OS向けのGeminiアプリをローンチしました。これが画面上での見た目です。本当に美しいです。この小さなチームがAntigravityを使って一からこのネイティブアプリを構築しました。100日未満で100を超える機能を作りました。2週末前、Macアプリで実験していたとき、本日皆さんと共有したいクールなものを見つけました。見てみたいですか?
私たちは長い夏休みに出かける予定で、2匹の犬の預け先を見つける必要があります。これは私たちの2匹の犬の写真で、Hank(イイ顔ですね)と、Louis Cinnamon(最もユニークな犬の名前の一つ)です。通常、新しい場所に犬を預けるときには、書類をたくさん用意する必要があります。アレルギー、ワクチン、履歴、すべてを集めなければなりません。面倒です。だからこの機能、Mac OS上のGeminiでできるのは、このように複数のドキュメントを一度に開くことです。すべてを選択して、Fnキーを長押しするだけで、預け先へのメールを口述できます。どう機能するかご覧ください。「こんにちは、今週木曜日から、いえ、今週金曜日から、私の2匹の犬、Louis CinnamonとHankを預ける必要があります。彼らは初めて行きますが、とても友好的です。これらのファイルを彼らの詳細、アレルギー、最新のワクチン情報のテーブルに変えて、第一印象が良くなるようメールを親しみやすい雰囲気にしてください」。よし、Fnキーを離します。MacBookの下でGeminiが考えているのが見えます。
私がFinderでファイルを選択していたので、マルチモーダル理解を使ってこれはPDFを読み、請求書の画像を開いて、すべてを私の声でコントロールしました。だからすべての複雑な情報を取り込めて、結果が出てきます。テーブルも入っています。この機能のもう一つ素晴らしい点は、修正もできることです。私が木曜日と言って、それから金曜日に修正したのを覚えていますか?この機能はその変更を捉え、自動的に私の入力を整えてくれます。これが、皆さんの声を使ったときのGeminiのパワーです。Gemini SparkのこれらのMacアプリでの新しい音声機能も、この夏にやってきます。
それでは、これが今日のすべてです。今日は本当にGeminiのアップデートが盛りだくさんでした。Neural Expressiveで体験全体を再設計しました。新しいGemini OmniモデルとGemini 3.5 Flashモデルをローンチします。Gemini 3.5 Proも近日中に登場予定で、今すぐGeminiを活用していただけます。Daily BriefやGemini Sparkといった新機能のおかげで、Geminiは皆さんが寝ている間も働き続けてくれます。これらすべては、パーソナルで、プロアクティブで、皆さんの日常生活で効果的なユニバーサルアシスタントというビジョンへとさらに近づけてくれます。学生でも、忙しい親でも、小規模事業のオーナーでも、皆さんがGeminiで何を作るのか見るのが待ちきれません。
ここで会場には、ユーザーであるHollyの映像が流れました。
Holly: こんにちは、Hollyです。2005年に韓国から米国に引っ越してきました。私たち家族は料理が大好きで、だからレストランを開くことにしました。でもレストランを経営するのは大変です。とはいえGeminiは多くのことを手伝ってくれます。メニューからマーケティング、予算、在庫管理まで。「先月私はごま油をどれくらい注文しましたか?」「先月は5ガロン注文されました」。AntigravityとStitchを使って、お客様向けのカスタムチャットボットを含めるようサイトを再構築さえしました。しかしある日、私たちは急に皿洗い機を探す必要がありました。そのときアイデアが浮かびました。小規模事業者と利用者がもっと早くお互いを見つけられるようにしたい、と。そこで私は小さなチームを集めて、Geminiモデルを使ってWorkOnwardという包括的な採用プラットフォームを構築しました。私たちのサイトは他の求人サイトとは違います。求人投稿を翻訳し、テキストメッセージだけで求人を投稿できるようにしました。この機能はテクノロジーに詳しくない人々にとって便利で、人々が自分の居場所を見つけるのを助けます。私たちの小さなツールは今や、ニューヨーク市で1万3千人のユーザーを持つプラットフォームになりました。これは労働者と小規模事業者の尊厳を尊重することについてで、これこそがAIのパワーだと思います。
7. Generative Media
7-1. Google Pics・Stitchのアップデート
Suz Chambers: ご存じのとおり、私たちのモデルと製品は新しいブレークスルーを切り開きますが、本当のブレークスルーは技術そのものではなく、それをどう活用するかです。皆さんがデザイナー、起業家、アーティストであれば、私たちの製品はアイデアが浮かんだ瞬間と、それを実現する瞬間との間のギャップを縮めるのに役立ちます。最良の状態にあるとき、技術は人間の創造性のためのキャンバスになります。本日、私はアイデアの実現を助けてくれる3つの製品についてお話ししたいと思います。
まずはNano Bananaの力に、皆さんが望むより大きなクリエイティブコントロールを加えた製品から始めましょう。Google Workspaceの新製品、Google Picsを紹介します。Picsは画像作成・編集のツールで、パーティのチラシからインフォグラフィックまで、思いつくほぼあらゆるものを作るのを助けます。皆さんが望むクリエイティブコントロールが効きます。どれほど簡単か見てください。ベース画像をキャンバスとして始めます。面白いのは、Picsが皆さんの作品の中身と、オブジェクト同士がどう関係しているかを理解しているということです。要素にカーソルを合わせてクリックすれば削除できます。あるいはオブジェクトのサイズをフレームに合うよう変えることもできます。レイアウトが整ったら、テキストを追加・編集したり、すべてを数クリックで翻訳したりできます。クールですね。Picsを含む私たちのクリエイティブツールからの出力はすべて、SynthIDで透かしが入れられます。Picsはこの夏にリリースされます。
もしもっと多くのことをしたかったらどうでしょうか。アプリやウェブサイトをデザインしたいかもしれません。今や、UIを素早く構築できます。Google中のチームが、私たちのデザイン製品Stitchを使って、ざっくりしたアイデアを美しいUIデザインに変えています。しかし私たちだけではありません。過去1年間で、世界はStitchを使って1億を超えるUIスクリーンを作りました。この勢いを継続するために、本日新しいデザイン方法を紹介します。どう機能するか見てみましょう。私の友人のTylerとJennyはピザ会社を持っています。彼らはピザを作るのは得意ですが、ウェブサイトをデザインした経験はありません。1つのプロンプトで、StitchがUIをライブで作る作業を始めます。これは最初の一歩に過ぎませんが、洗練させたい場合は、プロンプトを書くか自分の声を使って、Stitchと協力できます。例えば「ヘッダーのテキストを大きくして、複数のピザの選択肢を強調するようメニューを更新して」と直接言うことができます。レイアウトはリアルタイムで更新されます。Stitchは多くのツールと繋がっているので、デザインをコードにエクスポートしたり、数クリックでサイトを立ち上げたりできます。このStitchのアップデートは、本日からグローバルにユーザーへロールアウトされます。
7-2. Google Flowのアップデート
Suz Chambers: どんな新しい技術でも、最も面白い部分は、そこから人々が何を作るかを見ることです。だからこそ私たちは初日から、クリエイティブな人々のために、そして彼らと一緒に、モデルとツールを構築してきました。素晴らしいパートナーたちと、私たちが一緒に作ったものを少しご紹介します。「皆さんは、人間が最もクリエイティブでなければならない時代にいる」「Toto、私たちはもうカンザスにはいないみたいね」「そうですね」「やりましょう」というクリエイターたちの声と作品が流れました。
そのコラボレーションの精神が、昨年のI/OでGoogle Flowをリリースする原動力でした。今日、何百万もの人々がそれを使って、これまでにない方法で画像、映画、音楽を作っています。この進歩を継続するために、Gemini Omni、新しいエージェント、カスタムツール、音楽リミックスをローンチします。
Gemini Omniから始めましょう。この生の動画フッテージを見てください。私はこの歩き方が好きです。スタイルとスピードはそのままにしておきましょう。シンプルなプロンプトとスタイル参照を使うことで、Omniは元のパフォーマンスを保ったまま、背景を変え、視覚効果を加え、他の要素を追加することができます。今では、シーンの他のすべてを保ちながら、新しいキャラクターを追加することもできます。
2つ目の大きなアップデートを見てみましょう。Google Flowに新エージェントが登場します。最初は、Flowは一度に1つのプロンプトしか実行できませんでした。今では皆さんのエージェントが複数のアクションを一度に実行できます。たった1枚の画像から、このシーンに最適なカメラアングルを見つけるようエージェントに頼むことができます。この機能は画像の中で起きていることを分析し、最も興味深い視点を構想し、瞬時に1枚の画像を16本のユニークな動画に変えます。エージェントは大規模な編集も処理できます。例えばこれらすべてのシーンを朝から夜遅くに変えるといった作業です。文脈の理解は極めて正確です。砂漠の空が暗くなり、ヘッドライトが灯って粉塵を照らします。このエージェントは真のコラボレーターで、皆さんが大規模に作成・編集するのを助けてくれます。
次のアップデートはFlowのツールです。Flow内で直接、どんなクリエイティブツールでもvibe-codeで作れます。動画エフェクト、伝統的アニメーション、テキスト追加のような、皆さんのユニークなクリエイティブプロセスに合わせて、皆さん自身のために特別に作られます。本日から、ツールの作成、共有、リミックスを始められます。
ビジュアルの魔法はまだ始まりに過ぎません。Google Flow Musicは、アーティストがオリジナル曲を作るのを助けるために、同じクリエイティブコントロールをもたらします。私たちのチームメンバーの一人が、このピアノのリフを数ヶ月考えていました。オリジナルの録音を聴いてみましょう。これはとてもクールな基盤ですが、彼女はこれをバンドガイド用のデモに変えたかったのです。そこで彼女はFlow Musicにピアノの演奏を録音し、バンドのシンガーにインスピレーションを与えるために、女性ボーカルのR&B曲を作るよう頼みました。聴いてみましょう。
これは最終結果ではありませんが、この曲はバンドが次に何を録音するか決めるのに役立ちました。Google FlowとGoogle Flow Musicのこれらの新機能は、本日からご利用いただけます。ミュージシャンから小規模事業者まで、vibe-codeを使う作り手からアーティストまで、本当のブレークスルーは技術ではなく、皆さんが生み出すものです。皆さんの作品を見るのが待ちきれません。
8. Intelligent Eyewear
8-1. Android XR・ディスプレイ付きグラス近況・オーディオグラス発表とパートナーシップ
Shahram Izadi: XRにとって素晴らしい時代です。AIはヘッドセット、グラス、そしてその他のデバイス上で、本当に新しい体験をもたらし続けています。SamsungやQualcommとともに、Snapdragon向けに最適化して構築している新しいプラットフォームAndroid XRは、この革新的なハードウェアをGeminiと結びつけます。皆さんが必要なときに支援を提供しつつ、活動の邪魔をしません。Android XRにとっての次の大きなマイルストーンがAIグラスです。このAIグラスには2つのタイプがあり、両方とも皆さんの携帯に接続し、一日中ハンズフリーの支援を提供してくれます。
昨年、私たちはI/Oのステージでスマートグラスを披露しました。レンズに小さなディスプレイが入っていて、必要なときにちょうど目の前で役立つ情報を得ることができます。Uberの迎えの詳細を一目で確認したり、移動中にリアルタイム翻訳を得たりするようなことです。Glanceable Widgetのような機能を使って、一目で見られる要素を作ることもできます。最初の波のデベロッパーがすでにグラス体験を構築していて、Trusted Tester Programの拡大によって、今年中にもっと多くのニュースをお届けする予定です。
今年ローンチするものについて話しましょう。本日、私たちの最初のオーディオグラスがこの秋にやってくることをお知らせできて嬉しく思います。皆さんを支援するために設計されていて、Geminiは画面に表示されるのではなく、皆さんの耳元で個人的に話します。このグラスのおかげで、皆さんはハンズフリーのまま、音楽を聴いたり、写真を撮ったり、電話をかけたり、ポケットに手を入れなくても携帯のアプリを開いたりすることができます。私自身は料理が好きなのですが、本のレシピ通りに作るタイプではないので、料理中にGeminiから提案をもらえるのが嬉しいんです。
このオーディオグラスには素晴らしいパートナー陣が結集しました。Gentle MonsterやWarby Parkerのような、世界トップクラスのアイウェアデザイナーが象徴的なデザインを作っています。世界を代表する電子機器企業であるSamsungが、業界全体の標準を打ち立てる革新的な新しいデバイスと体験を構築しています。私たちGoogleもこのグラスに最高の貢献をしています。もちろん、このグラスはAndroidデバイスでもiOSデバイスでもペアリングできます。素晴らしいですよね。本日、皆さんに自分で見ていただきます。私たちの友人でパートナーであるSamsungのJay Kimをお迎えして、世界に向けて紹介してもらいましょう。
Jay Kim(Samsung): Samsungで私たちのビジョンは、すべての人の人生により多くの意味をもたらし、未来を共に形作ることです。Googleとの緊密なパートナーシップの中で、私たちは自信を持ってやり取りできるよう支援するAIグラスを紹介します。Samsungの精密なエンジニアリングと専門性で作られていて、私たちは形、機能、有意義な知性を組み合わせて、皆さんが身につけたいと思うものを作り出しました。グラスにおいてはミリ単位が重要です。本日、アイウェアの仲間であるWarby ParkerとGentle Monsterと共に作り上げた、新しいスタイルを紹介できることに興奮しています。
ここで会場には、デザイナーたちのインタビュー映像が流れました。「人々はいつも『破壊しなければならない』と言います。でも私たちは『何が破壊されるのか』を考えなければなりません。私は普通のメガネより美しく見えるAIグラスを作りたかったんです。それが私たちの目標です。これは技術とファッションのバランスです。これは単なる製品ではありません。これはすべて、認識と感情についてです。心。それがDNAです。私は人々に自信を感じてほしい。それを身につけたとき、ある種の勇気と繋がるような感覚、まるで反逆のような感覚を抱いてほしいのです。それが私たち自身だからです。それがGentle MonsterがGoogleとSamsungと組むことの意味です」「グラスは非常に個人的な製品で、皆さんの世界の見方と、世界からどう見られるかを形作ります。ここに見えるのは、Warby Parker初のスマートグラスデザインの進化形です。AIグラスへの私たちのビジョンは、美しいグラスをデザインしたいという願いから始まりました。私たちはしばしば様々なアート作品、アーティスト、時代からインスピレーションを得ます。技術を隠すのではなく、それを称えることが私たちにとって重要でした」「これは人々が見るのを助けるだけでなく、世界をより深く理解するのを助けます。私たちは人々に世界を完全に感じてほしい。それがこの技術の魔法です。Gemini、どっちがより似合う?」
Shahram Izadi: 美しいでしょう?これらは、この秋にやってくるもっと多くのコレクションのうち、最初の2つのデザインです。
8-2. ライブデモ(Maps・DoorDash・メッセージ・ウォッチ連携)
Shahram Izadi: さて、何の時間かわかりますか?ライブデモを見たい方はいらっしゃいますか?Nishthaも一緒にここに登場します。彼女を迎えるためにGeminiに音楽をかけてもらいましょう。Geminiは皆さん全員を見ることができます。注目してください。観客が盛り上がるほど、音楽も盛り上がります。Gemini……音楽が始まりました。音楽を流して!さあどうぞ。Nishtha、ようこそ。ようこそ、Nishtha。
Nishtha Bhatia: ありがとう。
Shahram Izadi: 私はWarby Parkerのモデルを身につけていて、NishthaはGentle Monsterのグラスを身につけています。素敵ですよ、Nishtha。
Nishtha Bhatia: ありがとう、Ram。
Shahram Izadi: 本日のデモのために、グラスからのオーディオをステージのスピーカーにストリーミングしますが、もちろん通常の使用では、Geminiは私たちにプライベートに話しかけるだけです。前回ステージに立ったとき、スマートグラスでのGoogle Mapsの豊かな体験を見ていただきました。このグラスでのMapsも便利で、特にPersonal Contextの機能と組み合わせるとなおさらです。
Nishtha Bhatia: 携帯なしで。今は私が頼むだけです。先週Giannaと会った場所に案内してください。
Gemini: こんにちは、Nishtha。これは先週の通り、Redwood Grove Natural Preserveへのルートです。最初にcold brewを買いに止まりますか?
Nishtha Bhatia: はい、Gemini。お願いします。
Gemini: はい。Coupa Cafeに立ち寄って、徒歩でナビゲーションを開始します。Bill Graham Parkwayに向かって振り向いてください。
Shahram Izadi: グラスを使えば、Mapsは文脈と皆さんの目の前にあるものをよりよく理解できるので、「右側にコーヒーショップがあります」のような詳細な道案内が得られます。コーヒーの話と言えば、Nishtha、Geminiにcold brewを事前に注文する方法を見せてもらえますか?
Nishtha Bhatia: いいアイデアですね。Gemini、さっき話したお店から、いつも通りのコーヒーを注文してください。
Gemini: わかりました。DoordashでCoupa Cafeからnitro cold brewを注文します。
Shahram Izadi: この画面では、Nishthaの携帯がポケットの中にあるのが見えますが、GeminiはDoordashのようなアプリを立ち上げ、画面上の様々なオプションを自動でクリックしてコーヒーを注文できます。もうすぐ、Nishthaが確認するために注文が用意されます。完了です。
Gemini: Coupa Cafeのnitro cold brewの注文を準備しました。確認しますか?
Nishtha Bhatia: はい。20%のチップを追加してください。
Shahram Izadi: これだけの練習を経て、これが今日彼女の15杯目のcold brewです。辛抱強く対応してくれたコーヒーショップに感謝します。
Nishtha Bhatia: その通りです。準備の話と言えば、ステージに来る前にテキストメッセージをミュートしておいたので、何があるか見てみましょう。ねえGemini、私が見逃した重要なメッセージはありますか?
Gemini: はい。家族のグループチャットが、今夜7時に夕食を一緒にしたいと言っています。それから、日々のアファメーションのリマインダーがあります。「あなたは強い……」
Nishtha Bhatia: わかりました。アファメーションは後でね。でも、その夕食をカレンダーに追加してください。
Gemini: わかりました。チームのお祝いの直後の午後7時に、家族の夕食イベントをカレンダーに追加します。
Shahram Izadi: 素晴らしい。ありがとう。Geminiはミュートしたテキストを要約するだけでなく、カレンダーアプリにアクセスしてイベントも追加します。さて、スマートグラスが携帯と一緒にどう機能するか見てきましたが、スマートウォッチに繋がって一目見られる表示にしたらどうでしょうか?Google I/Oは観客との自撮りなしには完結しませんが、今回はやり方が違います。皆さん、ポーズをとってください!Gemini、この素晴らしい観客の写真を撮って、カートゥーンに変えて、空に大きな風船を追加して、明るい色で「Google I/O 2026」と書いてください。さあ、ポーズをとって!よし。これがうまくいけば、みんな大盛り上がりです。スマートグラス上のNano Bananaは素晴らしくて、ほんの数秒でスマートウォッチ上にプレビューが見えるはずです。ドラムロール……出ました!ありがとう、Nishtha。Nishthaに拍手を。デモはうまくいきました!AIグラスの未来はとても明るく感じられます。
象徴的なブランドからの息をのむデザイン、Samsungのエンジニアリングと専門性、Geminiからの個人的でプロアクティブな支援、Googleからのカスタマイズされたアプリと機能、そしてデベロッパーエコシステム、これらすべてが私たちの最初のグラスにこの秋に登場します。続報をお待ちください。次はDemisが登場します。ありがとうございました。
9. クロージング
9-1. Demisによる総括・AGI観・セキュリティとScience
Demis Hassabis: スマートグラスの進歩は本当に急速で、皆さん全員に試してもらいたいと思っています。本日、私たちは次世代モデルであるGemini 3.5とOmni、Antigravity 2.0における新しいコーディング機能、SearchやGemini Sparkでのエージェントなど、多くのものをお見せしました。Geminiが毎日数十億人が使っているこれだけ多くのGoogle製品を変革していくのを見るのは並外れたことです。
これらすべての進展は、AIがいかに急速に発展しているかを示しています。長くこの分野に身を置いてきた私たちにとっても、信じられないほどの感覚です。AGIは視野に入っていますし、これまで作られた中で最も高度で大きな影響力を持つ技術になるでしょう。きちんと管理されれば、AIは想像を超える人類の進歩を後押しできます。私たちは希望に満ちた瞬間にいると同時に、大きな責任を伴う瞬間にもいます。私たちは潜在的な課題を理解し、エージェント型システム、そして最終的にはAGIそのものの安全性を確保するために、利用可能なすべてのツールを使わなければなりません。
注目されているリスク領域の一つがサイバーセキュリティです。Googleはこの分野に長年投資してきましたし、世界のコードベースを守るのに役立つ最先端の能力と深い専門知識を提供しています。私たちにはCode Security AgentやCodeMenderのようなツールがあり、これらは重要なソフトウェアの脆弱性を自動で発見し修正します。本日、私たちは特定の専門家グループを招いて新しいCodeMender APIをテストしてもらい、近いうちにもっと広くローンチします。
私がこれまでのキャリアでAIに取り組んできた理由を振り返ると、それを科学と世界理解を進める最良のツールだと見ていたからです。その夢が現実になりつつあり、AIがほぼあらゆる分野の科学者を助け始めているのを見るのは、本当に素晴らしいことです。この勢いに乗って、Gemini for Scienceを発表できることを嬉しく思います。このプラットフォームは、研究を加速するために多くの最先端AIツールを組み合わせます。Geminiは複雑な問題を解くのを助けることができますが、私たちの新しいLabsプロトタイプは日常の科学的タスクを簡素化します。新しい出版物の進展を追ったり、研究目標を使用可能なコードに変換したり、新しい仮説を立てたりすることなどです。
9-2. シミュレーション・生物学・新薬開発・特異点への展望
Demis Hassabis: 科学のためのもう一つの強力なツールがシミュレーションです。AIシミュレーションは、直接モデル化するには複雑すぎる動的システムを理解し予測するために、極めて重要になるでしょう。これの素晴らしい例がAlphaEarth Foundationsです。これは地球というプラネットのデジタルツインで、森林破壊や食料安全保障といった問題に取り組むのを助けてくれます。
シミュレーションはすでに非常に役立つことが証明されています。私たちの先端モデルWeatherNextは、嵐の進路を従来のシステムよりも速く正確に予測できます。昨年の嵐シーズンに天気がどう役立ったか見てみましょう。映像では気象機関の関係者が次のように説明しました。「熱帯低気圧や台風は極めて急速に変化するため、他のタイプの気象システムよりも予測が難しいのです。Googleでは、私たちはWeatherNextを開発しています。これはグローバルな気象予測のAIモデルで、こうした嵐の方向と強度も予測します。2025年、WeatherNextはジャマイカでのカテゴリー5の嵐を、これまで以上に正確に3日前に予測しました。この嵐は非常に深刻な被害をもたらし、生命を脅かすものでした。早期警報のおかげで、特定の地域から避難するよう公衆に事前通知でき、それによって人々の命を救うことができました。WeatherNextは、Melissaに対してより正確かつ積極的に予測する上で、極めて価値のあるツールです。今後、WeatherNextや他のAIモデルが、Hurricane Centerでの定常的な予測ツールキットの一部になると確信しています」
Demis Hassabis: 将来、私たちはより複雑な創発システム、もしかすると仮想細胞さえもシミュレートできるようになるでしょう。AlphaFoldやAlphaGenomeのような私たちの生物学モデルは、世界中で数百万の科学者が使う標準的な研究ツールとなり、それぞれの分野で大きなブレークスルーを生み出しています。私はこれを「デジタル速度の科学」と呼んでいます。解決策に至る速度と、それを活用できる研究者への普及速度の両方の意味でです。
私はずっと、AIの最も重要な応用は人間の健康を改善することだと信じてきました。Isomorphic Labsでは、業界トップのパートナーに支えられて、新薬開発をさらに加速するため、分子間相互作用のモデルを構築しています。現在、私たちはいくつかのプロジェクトで前臨床段階にあり、免疫疾患やがんに対する潜在的な治療法も含まれています。私たちのミッションは、新薬発見のプロセスを再構想することです。いつかすべての病気を解決できるようになる、というゴールに向かってです。数年前には不可能に見えたことが、今は到達可能だと確信しています。
Googleの最先端の研究と製品は、AGIの並外れた可能性を解き放ち、世界に恩恵をもたらすのを助けるでしょう。今この瞬間を振り返ったとき、私たちはシンギュラリティへの幕開けの端緒にいたのだと気づくでしょう。これは人類にとって極めて重要な瞬間になります。この技術は人間の創意工夫のためのパワーマルチプライアとなり、すべての人の生活の質を高める、科学的発見と進歩の新たな黄金時代へと私たちを導いてくれるでしょう。私たちは皆さんと一緒に未来を築くことを楽しみにしています。ありがとうございました。Google I/Oをぜひ引き続きお楽しみください。