Google、Gemini Omniが動画生成を会話並みに簡単化
出典:Google公式
詳細を読む
Google傘下のGoogle DeepMindは、あらゆる入力から様々なコンテンツを生成できる新モデルGemini Omniを発表しました。第一弾となるGemini Omni Flashは、動画の生成や編集を会話するのと同じくらい手軽に行えるのが特長です。同社は開発に携わった研究者3人へのインタビューを公開し、モデルの狙いや今後の展望を語ってもらいました。
インタビューに応じたのは、研究科学者のモハマド・ババイザデ氏、プロダクトマネージャーのアニシュ・ナンジア氏、研究エンジニアのサラ・シュー氏の3人です。3人はOmniのビジョンや、動画生成から着手した理由について語りました。クリエイターにとって何が便利なのかも具体的に説明しています。
3人はインタビュー中、Omniで何ができるかについて自由に想像を膨らませました。髪型を入れ替えたり、自分たちをナマケモノに変身させたり、目の前のテーブルにサラ氏の猫を出現させたりできるかを話し合いました。モハマド氏は「これには上限がない」と述べています。
今後の展開についてサラ氏は「ここからさらに良くなっていくだけだ」と語り、Omniの進化に自信を見せました。Googleは今回、実際のインタビュー映像も公開しており、開発陣の生の声を通じてOmniの可能性を伝えています。