Gemini Omni 1.1 Flashで詳細な制御での構築が可能に
Googleが動画生成AI「Gemini Omni 1.1 Flash」に新機能を追加した。シーン拡張、キーフレーム指定、複数解像度対応、ビデオリファレンスなど、クリエイターが動画を「作る」のではなく「コントロールする」ための仕組みが揃った。
従来の生成AIは「プロンプトを書いたら完全に任せる」が基本だった。Gemini Omniも当初はそうだったが、今回のアップデートで変わった。シーン拡張では、前後10秒の文脈を参照することで、視覚的な一貫性を保ちながら動画を継ぎ足せる。キーフレーム指定では「このショットはここから始まり、ここで終わる」と枠を決めることで、カメラワークを狙い通りに作れる。つまり、指示の精度で出来が決まる時代になった。
AIの鬼の視点としては、ここが面白い。生成が「速く、安く」なるほど、実は使い手の意図設定の負荷が高まる。360p解像度での軽量プレビューが従来比60%高速、コスト1/3というのは素晴らしいが、その効果は「試行錯誤が増える」ことだ。解像度を3段階から選べるということは、試案は低解像度で速く回し、確定後に高解像度化する流れが当たり前になるということ。つまり、「作る時間」より「意図を詰める時間」が勝負になる。ここまで来ると、AIは単なる「作り手」ではなく「プロトタイピング・パートナー」だ。
中小企業の実務には大きな含意がある。これまで、社内で動画コンテンツを作ろうとすると、外注か専任者の採用が選択肢だった。だが、このツールなら違う。営業資料、商品紹介、クライアント向けプレゼン動画といった「短編」を、社内の実務者が作れるようになる。低解像度で試案を素早く作り、クライアントやチーム内で意見を集めてから高解像度化する。そこまで回すために必要なのは、強いスキルではなく、「何を見せたいのか」の明確さだけだ。
※ 上記は配信元記事をもとにAIの鬼編集部が要約・再構成したものです。正確な内容は出典元をご確認ください。
このニュースの全文は、配信元でお読みいただけます。 Google DeepMindで元記事を読む →


