OpenAIがテキストから動画を生成するAIジェネレーター「Sora」をリリース

OpenAIがテキストから動画を生成するAIジェネレーター「Sora」をリリース

OpenAI が Sora をリリースし、テキストからビデオへの AI コンテンツ生成競争に参入。 Sora は、ユーザーのプロンプトに基づいて最長 1 分間のビデオを生成できます。

同社は、東京の街を歩く女性やゴールドラッシュ時代のカリフォルニアの歴史的映像など、SORAで制作した印象的なビデオをいくつか披露した。

Sora プレビューは現在、一般公開されていますが、セキュリティ専門家やクリエイターなどの特定のグループにも公開される予定です。同社は、クリエイティブな専門家にとって最も役立つモデルに進化させる方法についてのフィードバックを得るために、特定の個人にアクセスを許可しています。全体的なリリース日はまだ発表されていません。

「私たちは、誤報、憎悪コンテンツ、偏見などの分野の専門家である『レッドチーム』と協力して、このモデルに対して敵対的テストを実施しています」と同社は述べた。「また、動画がSoraによって生成されたかどうかを判断できる検出分類器など、誤解を招くコンテンツの検出に役立つツールも構築しています。」

OpenAI は、この種の技術を考案した最初の企業ではありません。 Meta、Google、その他いくつかの企業は、同様の製品の独自バージョンをリリース済み、またはリリース準備中です。市場で最も人気のあるソリューションには、Stability AI、Runway、Pika、Google Lumiere などがあります。しかし、業界アナリストは、Sora のビデオ品質はほとんどの競合他社よりも優れていると指摘しています。おそらく、それが Sora のデモが大きな話題と誇大宣伝を生み出した理由でしょう。

OpenAIによると、Soraが他のモデルより優れている点は、その驚異的なリアリティと、短いプロンプトからより長いビデオクリップを生成できる能力だ。 Sora は言語に対する深い理解に基づいており、プロンプトを理解し、キャラクターや感情を生成することができます。

Sora のデモでは、いくつかの単語からビデオを生成する機能が示されましたが、単一の画像や一連のフレームからビデオを生成する機能は示されませんでした。

Sora の発売は興奮を生んだが、懸念もいくつかあった。この技術はディープフェイクを作成し、誤った情報を広めるのに使用される可能性があります。 Sora では、不適切な実在の人物や、ポルノや暴力を含むコンテンツを作成するためにプラットフォームを使用するなど、コンテンツに対していくつかの制限が設けられると予想されます。

「誤情報の解決には、ある程度の緩和策を講じる必要がありますが、それには社会とソーシャルメディアネットワークの理解も必要です」と、DALL-Eチームの主任研究員兼リーダーであるアディティア・ラメシュ氏は述べた。

Sora に関するもう一つの懸念は、他者の著作権を侵害する可能性があることです。 OpenAI は、トレーニング データはライセンスを受けたコンテンツまたは公開されているコンテンツから取得されると主張していますが、何が「公開されている」かについては常に曖昧さが残ります。 OpenAI がこの問題を解決できない場合、多くの訴訟に直面する可能性があります。

Sora には、複雑なシーンの物理を正確にシミュレートする上でもいくつか問題があります。たとえば、キュ​​ーの空間的な詳細がわかりにくくなる可能性があります。

Sora は、一般ユーザーにテキストを使用した AI 搭載ビデオを作成する機能を提供します。テキストからビデオへの変換技術が映画やテレビ番組の制作業界を脅かすまでにはまだまだ長い道のりがありますが、エンターテインメント業界に大きな混乱をもたらす可能性もあります。

現時点では、OpenAI はそこまで先のことを考えていません。同社は、不適切なコンテンツや誤情報を拒否し、C2PAガイドラインに従ってSoraが制作した動画にラベルを付けるなど、プラットフォームの基本的な安全機能の向上に注力する。(C2PAは、出版社や企業などがメディアにメタデータを埋め込んで、その出所や関連情報を検証できるようにするオープンな技術標準である。C2PAはAI生成画像だけでなく、カメラメーカーや報道機関などもメディアコンテンツの出所や履歴、出所を証明するために同じ標準を採用している。)

<<:  1024解像度で最速モデル、ByteDanceのオープンモデルSDXL-Lightningがリリース

>>:  顔認識は終わったのか?最初の「顔ハイジャック」型バンキングトロイの木馬が誕生

ブログ    
ブログ    
ブログ    

推薦する

拡散モデルを使用してビデオを生成することもでき、その結果は非常に印象的です。新しいSOTAが達成されました。

この記事はAI新メディアQuantum Bit(公開アカウントID:QbitAI)より許可を得て転載...

プレイヤー同士のアライアンス形成が加速しているが、アライアンスは自動運転の新たな活路となり得るのか?

さまざまなメーカーが続々と参入し、スマートカー市場はますます熱を帯びています。このような背景から、ス...

...

450、バックトラッキング アルゴリズムとは何ですか? 一度見れば理解できますが、実際に書いてみると失敗します。

バックトラッキングアルゴリズムとは何ですか? Baidu 百科事典では、バックトラッキング アルゴリ...

...

困難な選択のターミネーター: さまざまな問題に対する機械学習アルゴリズム

データサイエンスを学び始めた頃、特定の問題に対してどのアルゴリズムを選択すればよいのかという疑問によ...

ゼロから始める: すぐに使えるニューラルネットワークを作成することもできます

何か新しいことを受け入れたり、始めたりするのは決して簡単なことではありません。機械学習は、新しいプロ...

論文と新しいビデオはこちら、サウスイースト大学が「室温超伝導体」LK-99の奇妙な抵抗挙動を説明

最近、各国の科学者らが韓国の「常温超伝導」物質LK-99に関する研究を発表し、悲観的な見方をする人が...

人間の髪の毛のわずか200分の1の太さ!科学者たちは脳のように電気を生成できる「ナノワイヤーネットワーク」を構築した

今日の主流の人工知能技術は、ある意味では脳の構造にヒントを得たものです。しかし、コンピュータの計算能...

トークン化ガイド: バイトペアエンコーディング、WordPiece およびその他の方法 Python コードの詳細な説明

2022年11月にOpenAIのChatGPTがリリースされて以来、大規模言語モデル(LLM)が非常...

懸念にもかかわらず、CIOはAIGCの利点を探求し、活用し続けています。

OpenAIは2022年11月にChatGPTをリリースし、その後Microsoftから100億ド...

...

建設現場での死傷者を減らすには? 10のAI手法をご紹介します

この記事の結論から始めましょう。AI と機械学習は、ビデオ信号を 24 時間 365 日リアルタイム...