AIテキスト翻訳システムの品質が44%向上し、500億以上のパラメータを使用して200の言語を翻訳

AIテキスト翻訳システムの品質が44%向上し、500億以上のパラメータを使用して200の言語を翻訳

Meta Platforms は本日、Meta が社内開発した、200 言語のテキストを翻訳できる人工知能システムである NLLB-200 のシステム コードをオープンソース化しました。

Meta 社は、研究者が NLLB-200 をソフトウェア プロジェクトに簡単に適用できるように設計された一連のツールも発表しました。

Metaによれば、NLLB-200が理解できる200の言語の多くは、他のAI翻訳システムでは十分にサポートされていないとのこと。現在、最も広く使用されている翻訳ツールは 25 未満のアフリカ言語をサポートしていますが、NLLB-200 は最大 55 のアフリカ言語をサポートしています。

Meta 氏は、翻訳精度も NLLB-200 が他のツールより優れている点の 1 つであると述べました。 Meta は、機械翻訳されたテキストの品質を測定するために使用されるアルゴリズムである BLEU 評価システムを精度基準として使用します。 Meta は、NLLB-200 の BLEU スコアが以前の平均より 44% 高いと主張しています。

「私たちは、200種類の言語間で翻訳できる自社開発のAIモデルをオープンソース化したばかりです。その多くは、現在の翻訳システムではサポートされていません」とMetaのCEO、マーク・ザッカーバーグ氏は述べた。「私たちはこのプロジェクトを『No Language Left Behind(取り残された言語はない)』と呼んでいます。私たちが使用しているAIモデリング技術は、世界中の何十億もの人々が話す言語の高品質な翻訳を実現しています。」

NLLB-200 には、AI システムがデータを処理する方法を決定する構成である 500 億を超えるパラメーターがあります。 AI システムのパラメータが多ければ多いほど、その精度は高くなります。

NLLB-200 の多数のパラメータは、200 の言語を高精度でサポートできる唯一の要因ではありません。NLLB-200 システムは、Meta のエンジニアによって開発された他の多くの AI イノベーションも活用しています。

Meta は、社内で開発された LASER ツールキットを使用して機械学習関連の研究をサポートしています。このツールキットにより、研究者はニューラルネットワークをトレーニングして、ある言語で特定のタスクを実行し、比較的簡単に他の言語に適応させることができるため、翻訳に役立ちます。 Meta は、LASER の改良バージョンである LASER3 をサポートするために、新しい NLLB-200 システムを開発しました。

LASER のオリジナル バージョンには、テキストを AI システムが理解できる数学的表現に変換する特殊なコンポーネントである LSTM と呼ばれるニューラル ネットワークが含まれていました。この数学的表現は、より正確な翻訳結果を生成するのに役立ちます。 LASER3 では、Meta は LSTM ニューラル ネットワークを、同じタスクをより効率的に実行できる高度な自然言語処理モデルである Transformer に置き換えました。

Meta は、トレーニング データの収集に使用されるシステムのアップグレードや AI トレーニング ワークフローの変更など、他のいくつかの方法を使用して NLLB-200 の機能を改善しました。

Meta は、自社開発の Research SuperCluster スーパーコンピューター (写真) を使用して NLLB-200 をトレーニングしました。 Meta が 1 月に Research SuperCluster を初めて発表したとき、同社はこのシステムには 6,080 個の Nvidia の最新の A100 データセンター GPU が搭載されており、最終的には 16,000 個の GPU にアップグレードされると述べていました。

Meta は NLLB-200 を使用して Facebook、Instagram、その他のプラットフォームでより優れた自動翻訳機能を提供する予定であり、システムが 1 日あたり 250 億件以上の翻訳をサポートすることを期待しています。

Meta は社内で NLLB-200 の普及に努めるとともに、他の組織が独自のソフトウェア プロジェクトにこのシステムを適用できるよう支援する予定です。

Meta には、NLLB-200 に加えて、AI のトレーニングに使用できるオープンソース コードと、翻訳の精度を評価するための FLORES-200 と呼ばれるデータセットがあります。 Meta は、非営利団体が NLLB-200 を導入できるよう最大 20 万ドルの資金を提供します。さらに、Meta は Wikimedia Foundation と協力して、Wikipedia の記事に自動翻訳技術を適用します。

<<:  大規模なモデルをトレーニングするのは本当に難しいのでしょうか?事前トレーニング済みで使いやすく、非常に効率的な「Li Bai」モデル ライブラリが登場しました。

>>:  銀行における会話型 AI – 企業が犯しがちな 3 つの間違い

ブログ    
ブログ    
ブログ    
ブログ    

推薦する

2020年に人工知能はどのように発展するでしょうか?知っておくべき6つのトレンド

過去1年を振り返ると、人工知能の発展は繁栄し、多彩なものであったと言えます。人工知能が3回連続で政府...

物流自動化への人工知能導入の大きな影響

自動化はテクノロジーを利用して、人間がより多くのタスクを完了できるようにします。物流の自動化をあらゆ...

...

AI時代に従業員がIT業務の価値を証明する方法

[[251301]]ロボットがあなたの仕事を奪う可能性はありますか? あなたはロボットの仕事を手伝う...

自然言語処理の商業的価値を示す5つの成功事例

これら 5 つの組織は、自然言語処理 (NLP) を使用して、顧客へのサービスの向上、反復的なタスク...

...

20以上のモバイルハードウェア、Int8超高速推論、エンドサイド推論エンジンPaddle Lite 2.0が正式にリリースされました

PaddlePaddleは今年8月、端末やエッジデバイス向けのエッジ推論エンジン「Paddle Li...

MITのロボットは、浸透する無線周波数を使って隠れた物体を感知する

[[391062]]海外メディアの報道によると、世界中の研究者がロボットが周囲の状況をよりよく認識...

びっくり! 7万時間の訓練を経て、OpenAIのモデルは「Minecraft」で木材の設計を学習した。

最近、GPTを忘れてしまったかのようなOpenAIが新たなアイデアを思いつきました。大量のラベルなし...

【WOT2018】孫林:テクノロジーが業界を変える。貝殻探しビジネスにおけるAIの応用

[51CTO.comより引用] 2018年5月18日〜19日、51CTO主催のグローバルソフトウェア...

高密度の手動ラベルなしで下流の高密度予測タスクを実行するための自己教師学習法がリリースされました

[[399115]]事前トレーニングにより、下流のタスクのパフォーマンスが大幅に向上することが示され...

CoBEVFlow: 車両と道路の協調認識におけるタイミングの非同期の問題を解決

この記事は、Heart of Autonomous Driving の公開アカウントから許可を得て転...

5分で様々な人工知能技術を紹介

人工知能は、コンピューターが人間と同様のレベルの知能を発揮できるようにするさまざまな技術を網羅する幅...

専門家の洞察: 5G とロボットの未来を実現する

[[423559]] 5Gの開発と導入は、特にアジアで加速しています。現場ではさまざまな試験が進行中...