
FLUX 3 Videoが一般提供、20秒の音声付き動画を1.20ドルから生成
Black Forest Labsが音声付き最長20秒の「FLUX 3 Video」を一般提供した。ドラフト再現と秒単価を備える一方、性能首位は同社の内部評価に基づく。
Gemini Omni Flashは、あらゆる形式のデータ(テキスト、画像、動画、音声)を一つのモデルでシームレスに処理することを目指した統合型マルチモーダルモデルである。従来の複数の専門モデルを使い分けるルーティング方式を廃し、単一のAPI構造で高度な生成・編集機能を提供する。動画生成モデルVeoの後継としての役割も担い、パフォーマンスの向上と開発者向けのインフラ簡素化を同時に実現する。

Black Forest Labsが音声付き最長20秒の「FLUX 3 Video」を一般提供した。ドラフト再現と秒単価を備える一方、性能首位は同社の内部評価に基づく。

Googleは、あらゆる入力から動画などを生成・編集できるネイティブマルチモーダルモデルGemini Omniと、高速な推論でAIエージェント構築を支援するGemini 3.5 Flashを発表した。これにより、物理法則を理解した自然な動画生成や、開発タスクを高速化する自律エージェントの実現が可能となり、エンタープライズ利用を見据えた安全対策も導入された。

GoogleはGoogle I/O 2026で、エージェント処理に特化した高速・低コストな新モデルGemini 3.5 Flashと、自律型エージェント開発プラットフォームAntigravity 2.0を発表した。これにより、企業は年間10億ドル以上のコスト削減を期待でき、個人向けには常時稼働する自律型AIエージェントGemini Sparkを提供するなど、AIエージェント社会実装への移行を明確にした。

ChatGPTなどの大規模言語モデル(LLM)が、感情知能(EI)テストで人間を大幅に上回る成績を収めたという衝撃的な研究結果が発表された。スイスのジュネーブ大学とベルン大学の研究チームによるこの発見は、AIが人間の感情 […]