
Google、あらゆる入力を動画に変える「Gemini Omni」を発表:新モデルが挑む「不気味の谷」の克服
Googleは、あらゆる入力から動画などを生成・編集できるネイティブマルチモーダルモデルGemini Omniと、高速な推論でAIエージェント構築を支援するGemini 3.5 Flashを発表した。これにより、物理法則を理解した自然な動画生成や、開発タスクを高速化する自律エージェントの実現が可能となり、エンタープライズ利用を見据えた安全対策も導入された。
Googleが開発した画像生成AIモデル。Chromeのサイドパネルに統合されており、Web上の画像をベースにした編集や、プロンプトからの新規画像生成、ECサイトの商品を自室の写真に合成するシミュレーションなどが可能。

Googleは、あらゆる入力から動画などを生成・編集できるネイティブマルチモーダルモデルGemini Omniと、高速な推論でAIエージェント構築を支援するGemini 3.5 Flashを発表した。これにより、物理法則を理解した自然な動画生成や、開発タスクを高速化する自律エージェントの実現が可能となり、エンタープライズ利用を見据えた安全対策も導入された。

GoogleはGoogle I/O 2026で、エージェント処理に特化した高速・低コストな新モデルGemini 3.5 Flashと、自律型エージェント開発プラットフォームAntigravity 2.0を発表した。これにより、企業は年間10億ドル以上のコスト削減を期待でき、個人向けには常時稼働する自律型AIエージェントGemini Sparkを提供するなど、AIエージェント社会実装への移行を明確にした。

GoogleはMac向けに専用のGeminiデスクトップアプリをリリースし、ウェブブラウザを介さない直接的なAI体験を提供することで、Appleとの提携による「不可視化」リスクを回避しつつ、プラットフォームの主導権確保を目指している。このネイティブアプリはSwiftで開発され、画面認識機能によりユーザーの作業文脈を理解し、OpenAIやAnthropicとのデスクトップAIアシスタント競争を激化させる戦略的意図がある。

Googleが画像生成モデル「Nano Banana」ファミリーの使い分けガイドと本格的なプロンプティングガイドを相次いで公開した。Gemini 3ファミリーの推論能力を基盤とするこのモデル群は、2026年3月時点で3世 […]

AI検索エンジン分野で存在感を示すスタートアップ企業であるPerplexityは、複数の言語モデルや画像・動画生成AIを組み合わせて自律的なワークフローを実行する新たなプラットフォーム「Perplexity Comput […]

Googleは2026年1月29日、同社のWebブラウザ「Chrome」に対して、最新のAIモデル「Gemini 3」を基盤とした大規模なアップデートを開始した。 これまでのブラウザにおけるAI機能が、ページの要約や文章 […]

2022年の登場以来、生成AIブームの火付け役として独走を続けてきたChatGPTに、明らかな異変が起きている。 市場分析会社Sensor Towerが2025年12月5日に発表した最新データによると、ChatGPTのユ […]

2025年8月26日、Googleはかねてより「nano-banana」のコードネームで知られ、AIコミュニティで大きな話題を呼んでいた次世代画像生成・編集モデルを、正式に「Gemini 2.5 Flash Image」 […]

2025年8月、AIコミュニティが静かな、しかし熱狂的な興奮に包まれた。AIモデルを評価するサイト「LMArena」に、突如として現れた正体不明の画像生成AI「nano-banana」が、これまでの画像生成モデルとは一線 […]