
Google、あらゆる入力を動画に変える「Gemini Omni」を発表:新モデルが挑む「不気味の谷」の克服
Googleは、あらゆる入力から動画などを生成・編集できるネイティブマルチモーダルモデルGemini Omniと、高速な推論でAIエージェント構築を支援するGemini 3.5 Flashを発表した。これにより、物理法則を理解した自然な動画生成や、開発タスクを高速化する自律エージェントの実現が可能となり、エンタープライズ利用を見据えた安全対策も導入された。
ロンドンを拠点とするAIスタートアップ。テキストからリアルなAIアバター動画を生成する技術で知られ、現在は企業のナレッジ共有やリスキリングを支援する「対話型AIエージェント」への転換を進めている。Fortune 100企業の多くを顧客に持ち、Google VenturesやNVIDIAなどから多額の出資を受けている。

Googleは、あらゆる入力から動画などを生成・編集できるネイティブマルチモーダルモデルGemini Omniと、高速な推論でAIエージェント構築を支援するGemini 3.5 Flashを発表した。これにより、物理法則を理解した自然な動画生成や、開発タスクを高速化する自律エージェントの実現が可能となり、エンタープライズ利用を見据えた安全対策も導入された。

AI大規模言語モデルは人間的な意味でのパーソナリティを持たないが、開発者の設計や人間のフィードバック、ユーザーの知覚によって、多様な対話スタイルが形成される。このAIのパーソナリティは、人間の判断力や生理的反応に影響を与え、過度な従順さや認知的な降伏を促す可能性があるため、社会的な問題として認識し、批判的思考を維持することが重要である。

ロンドンを拠点とするAIスタートアップ、Synthesiaが新たなマイルストーンを打ち立てた。同社は2026年1月26日、シリーズEラウンドにおいて2億ドル(約300億円)の資金調達を完了し、企業評価額が40億ドル(約6 […]

メディア、サービス、教育を手がけるBertelsmannが主導した調査によると、生成AIがメディア企業の多くの分野にわたって、利用が加速していることが明らかとなった。 多くのメディア企業が生成AIの導入を進めている Be […]