Google DeepMindが公開した2つの生成メディアモデル
Google DeepMindは、画像生成・編集モデル「Nano Banana 2 Lite」と、対話型動画生成・編集モデル「Gemini Omni Flash」を公開した。Nano Banana 2 Liteは一般提供され、1枚あたり約4秒で画像を生成し、従来比5倍の高速化と1000枚あたり0.034ドルという低コストを実現する。Gemini Omni Flashはパブリックプレビュー段階で、出力1秒あたり0.10ドルで動画の生成・編集を可能にする。
Interactions APIで連携する新しいクリエイティブワークフロー
両モデルはInteractions APIを通じて連携でき、Nano Bananaで参照画像を生成し、Omni Flashでそれをアニメーション化するといった使い方ができる。例えば、ECアプリが商品写真を基にシネマティックな動画を自動生成するようなワークフローが想定される。これにより、大量の画像・動画を扱う開発者パイプラインのレイテンシーとコストが大幅に削減される。
「Lite戦略」が示すAI市場の方向性
Nano Banana 2 Liteという名称からも分かるように、Googleは「高速・低コスト・大量処理」を重視するLite戦略をAI市場に持ち込んでいる。これは、かつてのソフトウェア業界で見られた「標準版とLite版の棲み分け」をAIモデルにも適用し、高ボリュームなユースケースを囲い込もうとする動きと解釈できる。今後は、高性能なPro系モデルと、高速・低コストなLite系モデルの二極化が進む可能性がある。
