OpenAIがテキストから動画を生成するAIジェネレーター「Sora」をリリース

OpenAI が Sora をリリースし、テキストからビデオへの AI コンテンツ生成競争に参入。 Sora は、ユーザーのプロンプトに基づいて最長 1 分間のビデオを生成できます。

同社は、東京の街を歩く女性やゴールドラッシュ時代のカリフォルニアの歴史的映像など、SORAで制作した印象的なビデオをいくつか披露した。

Sora プレビューは現在、一般公開されていますが、セキュリティ専門家やクリエイターなどの特定のグループにも公開される予定です。同社は、クリエイティブな専門家にとって最も役立つモデルに進化させる方法についてのフィードバックを得るために、特定の個人にアクセスを許可しています。全体的なリリース日はまだ発表されていません。

「私たちは、誤報、憎悪コンテンツ、偏見などの分野の専門家である『レッドチーム』と協力して、このモデルに対して敵対的テストを実施しています」と同社は述べた。「また、動画がSoraによって生成されたかどうかを判断できる検出分類器など、誤解を招くコンテンツの検出に役立つツールも構築しています。」

OpenAI は、この種の技術を考案した最初の企業ではありません。 Meta、Google、その他いくつかの企業は、同様の製品の独自バージョンをリリース済み、またはリリース準備中です。市場で最も人気のあるソリューションには、Stability AI、Runway、Pika、Google Lumiere などがあります。しかし、業界アナリストは、Sora のビデオ品質はほとんどの競合他社よりも優れていると指摘しています。おそらく、それが Sora のデモが大きな話題と誇大宣伝を生み出した理由でしょう。

OpenAIによると、Soraが他のモデルより優れている点は、その驚異的なリアリティと、短いプロンプトからより長いビデオクリップを生成できる能力だ。 Sora は言語に対する深い理解に基づいており、プロンプトを理解し、キャラクターや感情を生成することができます。

Sora のデモでは、いくつかの単語からビデオを生成する機能が示されましたが、単一の画像や一連のフレームからビデオを生成する機能は示されませんでした。

Sora の発売は興奮を生んだが、懸念もいくつかあった。この技術はディープフェイクを作成し、誤った情報を広めるのに使用される可能性があります。 Sora では、不適切な実在の人物や、ポルノや暴力を含むコンテンツを作成するためにプラットフォームを使用するなど、コンテンツに対していくつかの制限が設けられると予想されます。

「誤情報の解決には、ある程度の緩和策を講じる必要がありますが、それには社会とソーシャルメディアネットワークの理解も必要です」と、DALL-Eチームの主任研究員兼リーダーであるアディティア・ラメシュ氏は述べた。

Sora に関するもう一つの懸念は、他者の著作権を侵害する可能性があることです。 OpenAI は、トレーニングデータはライセンスを受けたコンテンツまたは公開されているコンテンツから取得されると主張していますが、何が「公開されている」かについては常に曖昧さが残ります。 OpenAI がこの問題を解決できない場合、多くの訴訟に直面する可能性があります。

Sora には、複雑なシーンの物理を正確にシミュレートする上でもいくつか問題があります。たとえば、キューの空間的な詳細がわかりにくくなる可能性があります。

Sora は、一般ユーザーにテキストを使用した AI 搭載ビデオを作成する機能を提供します。テキストからビデオへの変換技術が映画やテレビ番組の制作業界を脅かすまでにはまだまだ長い道のりがありますが、エンターテインメント業界に大きな混乱をもたらす可能性もあります。

現時点では、OpenAI はそこまで先のことを考えていません。同社は、不適切なコンテンツや誤情報を拒否し、C2PAガイドラインに従ってSoraが制作した動画にラベルを付けるなど、プラットフォームの基本的な安全機能の向上に注力する。（C2PAは、出版社や企業などがメディアにメタデータを埋め込んで、その出所や関連情報を検証できるようにするオープンな技術標準である。C2PAはAI生成画像だけでなく、カメラメーカーや報道機関などもメディアコンテンツの出所や履歴、出所を証明するために同じ標準を採用している。）

<<: 1024解像度で最速モデル、ByteDanceのオープンモデルSDXL-Lightningがリリース

>>: 顔認識は終わったのか？最初の「顔ハイジャック」型バンキングトロイの木馬が誕生

ブログ

アニメーション + 原理 + コード、トップ 10 の古典的なソートアルゴリズムを解釈する

OpenAIがテキストから動画を生成するAIジェネレーター「Sora」をリリース

アニメーション + 原理 + コード、トップ 10 の古典的なソートアルゴリズムを解釈する

韓国初のAI女性キャスターが誕生。本物と間違えられ議論を巻き起こす。AIサベイニングはすでに存在していた

農業革命：農業ロボットの台頭

未成年者の顔情報の処理には保護者の個別の同意が必要です

行列乗算の3Dインサイト: これがAIの思考法

将来に影響を与える戦略的テクノロジートレンドトップ10

Wikipedia+巨大模型で幻想を破れ！スタンフォードWikiChatはGPT-4を上回り、精度は97.3%

推薦する

拡散モデルを使用してビデオを生成することもでき、その結果は非常に印象的です。新しいSOTAが達成されました。

プレイヤー同士のアライアンス形成が加速しているが、アライアンスは自動運転の新たな活路となり得るのか？

450、バックトラッキングアルゴリズムとは何ですか? 一度見れば理解できますが、実際に書いてみると失敗します。

困難な選択のターミネーター: さまざまな問題に対する機械学習アルゴリズム

ゼロから始める: すぐに使えるニューラルネットワークを作成することもできます

論文と新しいビデオはこちら、サウスイースト大学が「室温超伝導体」LK-99の奇妙な抵抗挙動を説明

人間の髪の毛のわずか200分の1の太さ！科学者たちは脳のように電気を生成できる「ナノワイヤーネットワーク」を構築した

トークン化ガイド: バイトペアエンコーディング、WordPiece およびその他の方法 Python コードの詳細な説明

懸念にもかかわらず、CIOはAIGCの利点を探求し、活用し続けています。

建設現場での死傷者を減らすには？ 10のAI手法をご紹介します

超リアル！リアルタイムの高品質レンダリング、ダイナミックな都市シーンモデリングのためのストリートガウス分布