
Google、あらゆる入力を動画に変える「Gemini Omni」を発表:新モデルが挑む「不気味の谷」の克服
Googleは、あらゆる入力から動画などを生成・編集できるネイティブマルチモーダルモデルGemini Omniと、高速な推論でAIエージェント構築を支援するGemini 3.5 Flashを発表した。これにより、物理法則を理解した自然な動画生成や、開発タスクを高速化する自律エージェントの実現が可能となり、エンタープライズ利用を見据えた安全対策も導入された。
Googleが主催する開発者向けの年次イベント。例年、AndroidやChrome、AI関連の最新技術や製品のロードマップが発表される。2026年の開催では、1998年の設立以来最大となる検索インターフェースの刷新や、Gemini 3.5 Flashを基盤とした検索の自律化、動的なUI生成技術などが主要なトピックとして扱われた。

Googleは、あらゆる入力から動画などを生成・編集できるネイティブマルチモーダルモデルGemini Omniと、高速な推論でAIエージェント構築を支援するGemini 3.5 Flashを発表した。これにより、物理法則を理解した自然な動画生成や、開発タスクを高速化する自律エージェントの実現が可能となり、エンタープライズ利用を見据えた安全対策も導入された。

GoogleはGoogle I/O 2026で、複数のサービスや小売店を横断して買い物かごを一元化する「Universal Cart」を発表した。これは、AIが価格監視や互換性検証を行い、オープン規格「Universal Commerce Protocol (UCP)」と代理購入時のセキュリティを担保する「Agent Payments Protocol (AP2)」により、AIエージェントによる自律的な購買支援を可能にするものだ。

GoogleはGoogle I/O 2026で、エージェント処理に特化した高速・低コストな新モデルGemini 3.5 Flashと、自律型エージェント開発プラットフォームAntigravity 2.0を発表した。これにより、企業は年間10億ドル以上のコスト削減を期待でき、個人向けには常時稼働する自律型AIエージェントGemini Sparkを提供するなど、AIエージェント社会実装への移行を明確にした。

Googleは「I/O 2026」で、テキスト入力欄の動的拡張やマルチモーダル入力に対応した25年ぶりの検索ボックスデザイン刷新を発表した。バックグラウンドで常時検索を行う「Information Agent」や、自動電話架電・予約連携、複数サービスを横断する「Universal Cart」などのエージェント機能を順次導入し、ユーザー個人に最適化されたミニアプリ構築を可能にする。