テイラー・スウィフトが本物の中国語を話す動画が話題になっている。ほぼ完璧な唇の動きと時間通りのパフォーマンスが特徴だ。その背後にはAIツールがあることが判明した。

テイラー・スウィフトが本物の中国語を話す動画が話題になっている。ほぼ完璧な唇の動きと時間通りのパフォーマンスが特徴だ。その背後にはAIツールがあることが判明した。

ここ2日間、アメリカ人女性歌手テイラー・スウィフトが中国語を話す短い動画が、さまざまなソーシャルプラットフォームで人気となっている。中には600万回以上再生されているものもあります。

ビデオの中で、テイラー・スウィフトは自信に満ちた表情で流暢で本格的な中国語を話している。初期の吹き替え映画のヒロインたちのアクセントはほとんどなく、唇の動きも原作と一致している。

画像出典: Weibo @会火

まだビデオを見ていない方のために、まずは簡単に見てみましょう。

ビデオ作成者: johnhuu は英語を教えています

どうですか、魔法のようじゃないですか?

テイラー・スウィフトだけでなく、レイチェル・ブロズナハン、トランプ、エマ・ワトソン、ミスター・ビーンも本格的な中国語をマスターしていることがわかります。さらに、スケッチ俳優の蔡明は土槽会議で「流暢な英語を披​​露した」。

著者は、ビデオ制作には、本物の音声翻訳の習得、音声の複製、唇の形の置き換えという 3 つの重要な要素があり、それぞれのステップをうまく実行する必要があると述べています。しかし、具体的にどのようなモデルが使用されたかは明らかにしなかった。

この動画が人気を博した後、新たな試みを始める人が増え、動画の背後で使用されている AI 生成ツール「HeyGen」についても知るようになりました。

Twitterユーザーの@Gorden_Sunも、テイラー・スウィフトが中国語を話している動画を作成した。今回は彼女の唇の動きが完璧で、タイミングと口の形がまさにその瞬間に一致していた。 「音質は実はかなり似ている」とコメントした人もいました。

作者によると、動画内の翻訳はHeyGenによって自動的に行われ、品質はあまり良くないかもしれないとのこと。動画をアップロードして、翻訳する言語を選択するだけでよいとのこと。

動画の字幕は作者自身が追加しており、HeyGenにはこの機能はありません。さらに、ビデオの登場人物は感情的な回復がまだ欠けています。

ただし、HeyGen は無料で試すことができますが、長い待ち時間が必要です。技術に精通している人は、音声テキスト変換の whisper、テキスト翻訳の GPT、サウンドの複製とオーディオ生成の so-vits-svc、オーディオと一致するリップシンクビデオを生成する GeneFace++ などのオープンソースの代替手段を探すこともできます。

中国語と英語の交流に加えて、海外では英語を日本語に翻訳する試みも行われており、結果も非常に良好です。同氏によると、このビデオもHeyGenを使用して作成されたという。

さらに驚くべきことに、HeyGen を使用して最大 6 つの異なる言語を話すビデオを作成した人もいます。 「HeyGenはコンテンツ制作の分野に破壊的変化をもたらすだろう」とコメントする人もいた。

それで、HeyGenの起源は何でしょうか?実は、この動画は2か月以上前に話題になっていたことが判明した。

HeyGen: Midjourneyと同じくらい優れたAIビデオジェネレーター

当時、HeyGenは超リアルなデジタルヒューマンを生成しており、その制作に自ら参加したのは創設者のJoshua Xu氏でした。キャラクターの表情や動き、表情などが鮮やかに映し出されます。

HeyGen のこのビデオは大きな話題を呼んでいますが、エフェクトにはまだ欠陥があるため、誰もが改良版を期待しています。

HeyGenの創設者ジョシュア・シューのAI生成デジタルヒューマンは瞬きが多すぎる

HeyGenの背後にある会社はShiyun Technologyと呼ばれ、2020年に設立されました。彼らは当初、AI デジタルヒューマン生成に専念しており、創設者の Joshua Xu 氏は Snapchat で機械学習を担当する主任エンジニアでした。

徐之尚氏はかつてブログ投稿で、2022年7月に製品が発売されてから178日後、同社のARR(年間経常収益)が100万米ドルに達したと書いた。

HeyGen は、より安価で時間を節約できるビデオ作成方法をユーザーに提供します。これにより、従来のビデオ制作における高コスト、長いサイクル、人員の煩雑さ、高い機材要件などの問題が解決されます。

<<:  あなたの GPU は Llama 2 のような大規模なモデルを実行できますか?このオープンソースプロジェクトを試してみてください

>>:  来年のIT投資の見通しは有望です。成長率はGDPの3倍です。 CIOの75%がAIへの支出を増やす

ブログ    
ブログ    

推薦する

人工知能はデータセンター管理における破壊的技術となる

データ センターは、他のテクノロジー ベースの業界と同様に、革新を続けなければ成功できません。従来の...

...

人工知能にとって2019年は厄介な年だった。資金は必要だったが、使えるお金がなかったのだ。

2019年、中国の人工知能分野への投資・融資熱は大幅に低下し、取引量も急減した。恥ずかしいことに、...

1行のコードで大規模モデルのパフォーマンスが10%向上、開発者は無料でランチを楽しめる

大規模なモデルを微調整するための「無料ランチ」ができました。たった 1 行のコードで、パフォーマンス...

...

NVIDIA の最も強力な汎用大型モデル Nemotron-4 が登場! 15Bが62Bに勝ち、ターゲットはA100/H100です。

最近、NVIDIA チームは、8T トークンでトレーニングされた 150 億のパラメータを持つ新しい...

モデルの好みはサイズだけですか?上海交通大学は32の大規模モデルについて人間の嗜好の定量的要素を包括的に分析した。

現在のモデルトレーニングパラダイムでは、嗜好データの取得と使用が不可欠な部分になっています。トレーニ...

人工知能の長所と短所について知っておくべき10の事実

[[202058]] 1. 人工知能があなたの仕事を奪いに来ます。自分のキャリアを守るためには、機械...

...

...

人工知能に置き換えられる可能性が最も高い 12 の職業、あなたの職業もその中に含まれていますか?

AlphaGo が囲碁の名人に勝利し、百度の無人自動車が第五環状線を走行し、マイクロソフトの Xi...

AI特許出願件数は世界第1位で、世界総出願件数の約4分の3を占める。

先日蘇州で開催された中国人工知能産業2020年年次大会で発表された「2020年中国人工知能発展報告書...

Java仮想マシンオブジェクトの生存判定とガベージコレクションアルゴリズム

[[323332]]この記事では主に、オブジェクトが生きているかどうかを判断する方法を説明し、Jav...

ロボットは人工知能技術に基づいて人間の表情を作る

信頼関係を築く上で、私たちの表情が果たす役割は非常に大きいにもかかわらず、ほとんどのロボットの顔はプ...

偽の顔を正確に生成します! Amazonの新しいGANモデルは死角のないオールラウンドな美しさを提供します

最近、Amazon One の研究者は、生成された画像を明示的に制御できる GAN をトレーニングす...