
Google、あらゆる入力を動画に変える「Gemini Omni」を発表:新モデルが挑む「不気味の谷」の克服
Googleは、あらゆる入力から動画などを生成・編集できるネイティブマルチモーダルモデルGemini Omniと、高速な推論でAIエージェント構築を支援するGemini 3.5 Flashを発表した。これにより、物理法則を理解した自然な動画生成や、開発タスクを高速化する自律エージェントの実現が可能となり、エンタープライズ利用を見据えた安全対策も導入された。
Veo 3.1 is a state-of-the-art video generation model from Google. It focuses on high-quality cinematic output and incorporates DeepMind's SynthID technology to embed digital watermarks into generated content for identification and safety.

Googleは、あらゆる入力から動画などを生成・編集できるネイティブマルチモーダルモデルGemini Omniと、高速な推論でAIエージェント構築を支援するGemini 3.5 Flashを発表した。これにより、物理法則を理解した自然な動画生成や、開発タスクを高速化する自律エージェントの実現が可能となり、エンタープライズ利用を見据えた安全対策も導入された。

Googleが画像生成モデル「Nano Banana」ファミリーの使い分けガイドと本格的なプロンプティングガイドを相次いで公開した。Gemini 3ファミリーの推論能力を基盤とするこのモデル群は、2026年3月時点で3世 […]

AI検索エンジン分野で存在感を示すスタートアップ企業であるPerplexityは、複数の言語モデルや画像・動画生成AIを組み合わせて自律的なワークフローを実行する新たなプラットフォーム「Perplexity Comput […]

2026年2月、動画生成AIの勢力図が決定的に塗り替えられようとしている。TikTokを運営するByteDanceが週末に突如として公開した最新の動画生成モデル「Seedance 2.0」は、画質向上のみならず、これまで […]

Googleは2025年10月16日(現地時間)、最新の動画生成AIモデル「Veo 3.1」を発表した。同時に、AI映像制作ツール「Flow」に同モデルを統合し、音声生成の全面的なサポートやオブジェクトの追加・削除といっ […]