旅の途中+第2世代、「バルペンハイマー」完成までの7つのステップにカルパシーが驚愕 | 実際のテスト体験を添付

旅の途中+第2世代、「バルペンハイマー」完成までの7つのステップにカルパシーが驚愕 | 実際のテスト体験を添付

数日前、バービー・ハイモアがインターネットで話題になって以来、ネットユーザーたちは、MidJourney+Gen-2 を使用して映画を作る魔法のようなスキルを絶えず「再現」しています。

あるネットユーザーが自身のチュートリアルを更新したが、そのチュートリアルではバルベンハイマーの制作にたった7つのステップしか必要とせず、カルパシー氏から「映画制作業界2.0」と称賛された。

完全なプロット、6 つのショット、7 つのステップで完成した 20 秒の短編アニメーション。これを見れば、曹志でさえ自分を専門家と呼ぶでしょう。

バービーヘマーを完成させる7つのステップ、その効果は驚異的

詳細なデモンストレーションを以下に示します。

1. ChatGPTはストーリーボードと字幕の作成に役立ちます

2. ストーリーボードのスクリプトに基づいて、Midjourney を使用して各ショットの冒頭で画像を生成します。

これは、7 つのステップから成るプロセスの中で、少しハードルが高い唯一のステップかもしれません。各画像に対するプロンプトの言葉を自分で作成する必要があります。

しかし、画像をクリックして拡大すると、プロンプトの単語がそれほど長くないことがわかります。英語の基礎知識がある友人なら、少し努力すればできます。

以下は、短編映画の他のいくつかのシーンの開始画像です。すべて Midjourney を使用して生成されています。

3. ビデオ内のシーンのトーンの一貫性を確保するには、写真編集ソフトウェアを使用して各写真のトーンを調整する必要があります。

たとえば、短編映画の色調はレトロなスタイルなので、Midjourney によって生成された元の画像はそれと一致しない可能性があります。

写真編集ソフトウェアで調整すると、すべてのシーンのスタイルの一貫性が高まります。

4. Gen-2 を使用して各写真をアニメーション化し、6 枚の写真を 6 つのショットに変換します。

5. 次に、ElevenLabs を使用して字幕の音声を生成します。

6. その後、FinalCut Pro を使用してアニメーション、サウンド、特殊効果を組み合わせると、短編映画が基本的に完成します。

7. Capcut を使用して字幕を追加すれば完了です。

テスト後に発見された経験

簡単そうに見えますが、実際に自分で試してみると、明確な計画がなければ満足のいく映画を作るのはやはり簡単ではないことがわかりました。

最大の障害は、Gen-2 のアニメーションは特定の画像に基づいてランダムにしか生成できないため、人間の顔に関しては歪みが多くなることです。

もともと私は、ボス・マーが宇宙船を手でこすっているビデオを作りたかったのですが、キャラクターの顔がひどく歪んでいて、各ビデオの最初のフレームだけがボス・マー自身で、1秒後にボス・マーが誰になるのか全くわからなかったことに気付きました。

なので、Gen-2を使って有名人関連の動画を作りたい場合、今のところほぼ不可能です。

さらに、これらの顔の歪みやキャラクターの動きは完全にランダムであり、ユーザーの制御の範囲外です。

あるネットユーザーは、4秒ごとに最後のフレームのスクリーンショットを撮り、Gen-2に新しいアニメーションを生成させ続けるビデオを作成しました。

約40秒後、最初はアメリカンコミック風のアニメキャラクターだった映像のキャラクターが、まるで彫刻のように歪んでしまった。

画像に明らかな動的手がかりがあったとしても、Gen-2 はまだそれを理解できないため、生成された効果が期待どおりにならない可能性があります。

キャラクターの動きをうまく制御できず、満足のいくアニメーションを生成するには、同じ絵を長時間試す必要がある場合があります。

したがって、現時点で Gen-2 が達成できる効果から判断すると、より複雑なスクリプトに自由に適応できる可能性は低いと考えられます。

そのため、脚本を書く際には、人物の顔のクローズアップなどのシーンを極力避けることが求められます。

しかし、将来的に Gen-2 がプロンプトと画像を完全に組み合わせて、プロンプトの説明に従って画像が動くようになれば、その効果は飛躍的に向上するでしょう。

その他のMidjourney+Gen-2の効果

偉大な芸術家は故郷に戻り、Gen-2 を使用して「オッペンハイマー」のいくつかのシーンを制作しました。その作品は非常にリアルで、本物と区別がつかないほどでした。

同時に、類似のシーンとPika Labによって生成されたシーンの違いも比較しました。

下の写真はピカラボの効果を示しています。

冒頭の「バービー・ハイモア」コーナー以外にも、多くのネットユーザーがGen-2とMidjouneyのゴールデンコンビを利用して、アニメ開発の副業を始めた。

素晴らしいアニメーション効果のデモンストレーションを見てみましょう。

デモンストレーションでの顔の変形はそれほど大きくなく、実際の測定とは大きく異なることがわかります。作者は何度も試行錯誤して、小さな顔の歪みの効果を発見した可能性が高いです。

一部のネットユーザーが、マーベルの有名キャラクターの予告編を作成しました。その効果は非常にリアルです。アニメーションの特殊効果や光と影が加わり、まるで公式のマーベル作品のような雰囲気です。

これはネットユーザーによって生成されたホラー映画の予告編であり、Gen-2の文字の歪みをうまく利用してホラー映画の雰囲気を高めています。

このクリップも、ネットユーザーがMJ+Gen-2を使用して作成した非常に芸術的なビデオであり、監督がポストプロダクションで新しいカメラ効果を追加しています。

油絵の静止画から生成したアニメーションです。少し歪んでいますが、効果はとても良いです。

<<:  クラッシュラマ2!マイクロソフトの13億パラメータphi-1.5は、単一のA100でトレーニングされ、SOTAを更新します

>>:  ひと口引くとバラが生き返ります! Googleは画像ダイナミクスを生成することを提案しており、すべてのものに魂が宿ることになる

ブログ    
ブログ    

推薦する

「コピー+貼り付け」に別れを告げ、ディープラーニングOCRに基づくPDFからテキストへの変換を実現

[[403226]]従来の講義には通常、PDF スライドのセットが付属します。一般的に、このような講...

法律分野で初の「1対多」の人間と機械の競争が始まり、AI弁護士が契約書審査で人間を上回る

この記事はAI新メディアQuantum Bit(公開アカウントID:QbitAI)より許可を得て転載...

教師あり学習と教師なし学習:専門家がギャップを定義

教師あり学習、教師なし学習、半教師あり学習の特徴と、それらが機械学習プロジェクトでどのように使用され...

マイクロソフトが人工知能の小規模スタートアップBonsaiを買収

海外メディアの報道によると、マイクロソフトは水曜日、小規模な人工知能スタートアップ企業であるボンサイ...

SQL Serverは最短経路検索アルゴリズムを実装しています

これは去年の質問です。今日メールを整理していたら偶然見つけました。とても興味深いと思ったので書き留め...

Google は人工知能の分野で「堀」を持っていないのでしょうか?

少し前、匿名の人物が、Google 社内の研究者による研究メモを Discord プラットフォームに...

マイクロソフトのAI画像ジェネレーターが自社の従業員から報告:有害な画像を生成する可能性がある

CNBCによると、3月7日、マイクロソフトのエンジニアが米連邦取引委員会(FTC)に、同社の人工知能...

カメラのようにズームして、写真の細部を塗りつぶし、スタイルをカスタマイズ。AIペイントツールMidjourneyが再びアップデート

有名な AI ペイントツール Midjourney が再びユーザーに衝撃を与えました。先月バージョン...

エンタープライズ向け人工知能プラットフォームの選択ガイド

企業における人工知能の応用はますます広範になってきており、産業化される可能性もあります。既存のデータ...

もう終わりですか? LK-99は単なる強磁性体であり、超伝導体ではない。北京大学などの研究論文が発表された。

これまで、韓国における常温超伝導の再現に関する多くの研究で示された重要な指標は、常温常圧の条件下で、...

人工知能、機械学習、ディープラーニングの違い

私たちは皆、「人工知能」という言葉をよく知っています。結局のところ、ターミネーター、マトリックス、エ...

Chen Danqi 氏のグループによるマスク言語モデルに関する研究: 15% のマスク率は最適ではないが、40% は維持可能か?

少し前に、スローン財団は2022年度スローン研究賞の受賞者を発表しました。Chen Danqi、Fa...

ボルチモア、これまでで最も厳しい顔認識禁止法を制定する可能性

米国のボルチモア市で検討されている条例は、民間人だけでなく法執行機関や政府機関による顔認識技術の購入...

...