Google、動画制作を簡素化するGemini Omniを発表

Google の公式発表によると、新しい AI モデル Gemini Omni により、動画の編集と制作が対話のように簡単になりました。この技術により、ユーザーは簡単にカメラアングルを変更したり、オブジェクトを置き換えたり、さらには簡単なスケッチをリアルなアニメーションに変換することができます。

Gemini Omni の機能紹介

今年の I/O カンファレンスで、Google は初めて Gemini Omni Flash を紹介しました。これは Omni シリーズの最初のモデルです。Omni は動画の作成と編集を非常に簡単にし、ユーザーはテキスト、画像、動画、または音声の参照から高品質の動画を生成し、自分の動画を編集することもできます。Omni は物理に対する直感的な理解と Gemini の現実世界の知識を組み合わせて、よりリアルな出力を生み出すことができます。

開発者の革新アプリケーション

Google は最近、開発者に Omni を開放し、多くのクリエイターがこの技術を利用してさまざまなプロジェクトに取り組んでいます。以下はいくつかの注目すべきデモです。

「Omni は動画の編集を非常に簡単にします。ユーザーはカメラアングルを変更したり、環境を切り替えたり、映画のようなズーム効果を適用したりできます。これらすべてが、元のシーンの文脈を失うことなく行えます。」

Google

例えば、クリエイターの Leon Lin はこの機能を利用して、約 20 種類の異なる角度から都市に立つ女性の映像をキャプチャし、近距離と遠距離、正面と側面、上方と下方からの撮影を示し、背景はシーンに応じて変化します。

独特な視覚効果の創造

Omni はユーザーが動画のストーリーを変更し、従来の方法では撮影できないシーンを創造することを可能にします。例えば、クリエイターの Carlos Santana は、音だけで屋外のシーンを昼から夜に変え、雲や雨の音を追加し、葉をオレンジ色にし、地面を雪で覆いました。

「Omni は知識と創造性を組み合わせ、ユーザーが現実の論理に合ったシーンを創造できるようにします。」

Google

さらに、クリエイターの Pan は Omni を利用してスケッチをリアルな動画に変換し、日常の物品を面白い方法で再解釈し、レモンを潜水艦に、コーヒーカップを熱気球に変えました。

多様なアプリケーションシーン

Omni は動画のスタイルや視覚効果を変更し、ユーザーのビジョンに合ったコンテンツを創造することもできます。クリエイターの Jerrod Lew は Omni のこの機能をテストし、女性が街を歩く映像を 4 種類の異なるアニメーションスタイルに変換し、実写からアニメ、クレイアニメなどにスムーズに切り替えました。

Hyperagent チームは Omni を利用して 3 つの異なるコンセプトを視覚化し、デザイン提案を空っぽの公園の映像に重ね、アニメーションを使ってビジネスダッシュボードを説明し、タスクをゲーム化しました。

ユーザーは Gemini アプリ、Google Flow、Google AI Studio、Gemini API、または Gemini Enterprise Agent Platform でこの技術を体験できます。

資料出典:Google 公式発表

Nakumura
Nakumura
関連サイト:中文版 / TechRitualThe Base Principle