旅の途中+第2世代、「バルペンハイマー」完成までの7つのステップにカルパシーが驚愕 | 実際のテスト体験を添付

旅の途中+第2世代、「バルペンハイマー」完成までの7つのステップにカルパシーが驚愕 | 実際のテスト体験を添付

数日前、バービー・ハイモアがインターネットで話題になって以来、ネットユーザーたちは、MidJourney+Gen-2 を使用して映画を作る魔法のようなスキルを絶えず「再現」しています。

あるネットユーザーが自身のチュートリアルを更新したが、そのチュートリアルではバルベンハイマーの制作にたった7つのステップしか必要とせず、カルパシー氏から「映画制作業界2.0」と称賛された。

完全なプロット、6 つのショット、7 つのステップで完成した 20 秒の短編アニメーション。これを見れば、曹志でさえ自分を専門家と呼ぶでしょう。

バービーヘマーを完成させる7つのステップ、その効果は驚異的

詳細なデモンストレーションを以下に示します。

1. ChatGPTはストーリーボードと字幕の作成に役立ちます

2. ストーリーボードのスクリプトに基づいて、Midjourney を使用して各ショットの冒頭で画像を生成します。

これは、7 つのステップから成るプロセスの中で、少しハードルが高い唯一のステップかもしれません。各画像に対するプロンプトの言葉を自分で作成する必要があります。

しかし、画像をクリックして拡大すると、プロンプトの単語がそれほど長くないことがわかります。英語の基礎知識がある友人なら、少し努力すればできます。

以下は、短編映画の他のいくつかのシーンの開始画像です。すべて Midjourney を使用して生成されています。

3. ビデオ内のシーンのトーンの一貫性を確保するには、写真編集ソフトウェアを使用して各写真のトーンを調整する必要があります。

たとえば、短編映画の色調はレトロなスタイルなので、Midjourney によって生成された元の画像はそれと一致しない可能性があります。

写真編集ソフトウェアで調整すると、すべてのシーンのスタイルの一貫性が高まります。

4. Gen-2 を使用して各写真をアニメーション化し、6 枚の写真を 6 つのショットに変換します。

5. 次に、ElevenLabs を使用して字幕の音声を生成します。

6. その後、FinalCut Pro を使用してアニメーション、サウンド、特殊効果を組み合わせると、短編映画が基本的に完成します。

7. Capcut を使用して字幕を追加すれば完了です。

テスト後に発見された経験

簡単そうに見えますが、実際に自分で試してみると、明確な計画がなければ満足のいく映画を作るのはやはり簡単ではないことがわかりました。

最大の障害は、Gen-2 のアニメーションは特定の画像に基づいてランダムにしか生成できないため、人間の顔に関しては歪みが多くなることです。

もともと私は、ボス・マーが宇宙船を手でこすっているビデオを作りたかったのですが、キャラクターの顔がひどく歪んでいて、各ビデオの最初のフレームだけがボス・マー自身で、1秒後にボス・マーが誰になるのか全くわからなかったことに気付きました。

なので、Gen-2を使って有名人関連の動画を作りたい場合、今のところほぼ不可能です。

さらに、これらの顔の歪みやキャラクターの動きは完全にランダムであり、ユーザーの制御の範囲外です。

あるネットユーザーは、4秒ごとに最後のフレームのスクリーンショットを撮り、Gen-2に新しいアニメーションを生成させ続けるビデオを作成しました。

約40秒後、最初はアメリカンコミック風のアニメキャラクターだった映像のキャラクターが、まるで彫刻のように歪んでしまった。

画像に明らかな動的手がかりがあったとしても、Gen-2 はまだそれを理解できないため、生成された効果が期待どおりにならない可能性があります。

キャラクターの動きをうまく制御できず、満足のいくアニメーションを生成するには、同じ絵を長時間試す必要がある場合があります。

したがって、現時点で Gen-2 が達成できる効果から判断すると、より複雑なスクリプトに自由に適応できる可能性は低いと考えられます。

そのため、脚本を書く際には、人物の顔のクローズアップなどのシーンを極力避けることが求められます。

しかし、将来的に Gen-2 がプロンプトと画像を完全に組み合わせて、プロンプトの説明に従って画像が動くようになれば、その効果は飛躍的に向上するでしょう。

その他のMidjourney+Gen-2の効果

偉大な芸術家は故郷に戻り、Gen-2 を使用して「オッペンハイマー」のいくつかのシーンを制作しました。その作品は非常にリアルで、本物と区別がつかないほどでした。

同時に、類似のシーンとPika Labによって生成されたシーンの違いも比較しました。

下の写真はピカラボの効果を示しています。

冒頭の「バービー・ハイモア」コーナー以外にも、多くのネットユーザーがGen-2とMidjouneyのゴールデンコンビを利用して、アニメ開発の副業を始めた。

素晴らしいアニメーション効果のデモンストレーションを見てみましょう。

デモンストレーションでの顔の変形はそれほど大きくなく、実際の測定とは大きく異なることがわかります。作者は何度も試行錯誤して、小さな顔の歪みの効果を発見した可能性が高いです。

一部のネットユーザーが、マーベルの有名キャラクターの予告編を作成しました。その効果は非常にリアルです。アニメーションの特殊効果や光と影が加わり、まるで公式のマーベル作品のような雰囲気です。

これはネットユーザーによって生成されたホラー映画の予告編であり、Gen-2の文字の歪みをうまく利用してホラー映画の雰囲気を高めています。

このクリップも、ネットユーザーがMJ+Gen-2を使用して作成した非常に芸術的なビデオであり、監督がポストプロダクションで新しいカメラ効果を追加しています。

油絵の静止画から生成したアニメーションです。少し歪んでいますが、効果はとても良いです。

<<:  クラッシュラマ2!マイクロソフトの13億パラメータphi-1.5は、単一のA100でトレーニングされ、SOTAを更新します

>>:  ひと口引くとバラが生き返ります! Googleは画像ダイナミクスを生成することを提案しており、すべてのものに魂が宿ることになる

ブログ    
ブログ    

推薦する

AIは教育分野にどのように貢献できるのでしょうか?

調査機関Markets&Marketsの予測によると、2023年までに世界の教育業界における...

心が開かれました!将来、人工知能がもたらす素晴らしい生活は、あなたが想像する以上のものになるかもしれません...

人工知能といえば、多くの人が「未来の技術」という遠近感、移動機能を備えた空中の高層ビル、いつでも世界...

Objective-C 実装と主要なソートアルゴリズムのグラフィカルなデモンストレーション比較

[[176714]] Objective-C を使用していくつかの基本的なソート アルゴリズムを実装...

海外の科学者が「AI漢方」を開発:舌診断システムの精度は最大94%

10月23日、中国医学では2000年以上もの間、人の舌の色や形を観察して病気を診断してきたと報じら...

AIアルゴリズム企業パシフィック・フューチャー・テクノロジーの文化観光ソリューションがOCTカラープラネットに上陸

ディープな旅行がますます高品質の観光オプションに浸透するにつれて、観光型の観光はもはや現代人の旅行ニ...

2020年世界人工知能会議が開催されます! AI が人間の言語の高度な能力をいかにして習得するかをご覧ください。

2020年7月9日、2020年世界人工知能大会(WAIC)クラウドサミットが正式に開幕しました。I...

プロンプトエンジニアリング

プロンプト エンジニアリング (コンテキスト プロンプトとも呼ばれる) は、モデルの重み/パラメータ...

データが増えるほど、AIの意思決定モデルは脆弱になる

データは人工知能システムを構築するために必要な重要なインフラストラクチャです。データは、AI システ...

テクノロジーファイナンスからスマートファイナンスまで、民生銀行の革新的な人工知能の応用をご覧ください

[51CTO.comからのオリジナル記事] 「インターネット+」から「インテリジェンス+」まで、革新...

...

...

60年間の浮き沈みを経て、人工知能はどれだけの偏見や誤った判断を経験するのでしょうか?

過去 2 年間で、人工知能とディープラーニングは起業の分野で人気が高まってきました。シリコンバレーの...

ガートナー:世界の会話型 AI 支出は 2023 年に 186 億ドルに達すると予測

8月1日、ガートナーの最新レポートによると、カスタマーサービスセンター(CC)テクノロジー、会話型A...

検証可能な AI に向けて: 形式手法の 5 つの課題

人工知能は、学習、問題解決、合理的な思考や行動など、知能と直感的に関連付けられる機能を含め、人間の知...

AI脳を搭載したドローン:群衆の中の暴力的な人々を正確に識別できる

[[233174]]もしある日私を殴りたくなったら、ただ殴って終わりにできると思いますか?今はそんな...