この記事はLeiphone.comから転載したものです。転載する場合は、Leiphone.com公式サイトにアクセスして許可を申請してください。 マイクロソフトは本日、数兆個のパラメータ(予測の根拠となるモデル内の変数)を含む AI モデルをトレーニングする新しい方法を導入する DeepSpeed ライブラリの更新バージョンをリリースしました。 Microsoft によれば、3D 並列処理と呼ばれるこのテクノロジは、さまざまなワークロードのニーズに適応でき、特に電力を大量に消費する非常に大規模なモデルの効率をバランスさせることができるという。
数十億のパラメータを持つ単一の大規模 AI モデルにより、さまざまな困難な領域で大きな進歩が可能になりました。研究によると、AI が優れたパフォーマンスを発揮できるのは、言語、文法、知識、概念、文脈のニュアンスを理解できるためであり、スピーチを要約したり、リアルタイムのゲーム チャットで不適切な単語を除外したり、複雑な法的文書を解析したり、さらには GitHub を検索してコードを生成することも可能になります。 しかし、モデルのトレーニングには大量のコンピューティング リソースが必要です。 2018年のOpenAIの分析によると、大規模なAIトレーニングに必要なコンピューティング能力は2012年から2018年にかけて30万倍に増加し、およそ3.5か月ごとに倍増し、ムーアの法則のペースをはるかに上回っています。 強化された DeepSpeed は、データ並列トレーニング、モデル並列トレーニング、パイプライン並列トレーニングという 3 つの技術を活用して、「兆スケール」のモデル トレーニングを可能にします。 1兆パラメータのモデルをトレーニングするには、少なくとも400個のNvidiaの最新A100 GPU(それぞれ最大40GBのメモリを搭載)が必要であり、Microsoftは50%の効率で稼働する4,000個のA100が必要で、トレーニングを完了するには約100日かかると見積もっています。これは、1万枚以上のグラフィックカードを搭載した、マイクロソフトとOpenAIが共同設計したAIスーパーコンピューターにはかないません。これほどの大規模環境では、高い計算効率を達成することは困難です。 DeepSpeed は、大規模なモデルを 4 つのパイプライン ステージに分割し、さらに小さなコンポーネント (レイヤー) に分割します。各パイプライン ステージのレイヤーは、実際のトレーニングを実行する 4 つの「ワーカー」にさらに分割されます。各パイプラインは 2 つの並列データ インスタンス間で複製され、ワーカーはマルチ GPU システムにマップされます。 Microsoft によれば、これらおよびその他のパフォーマンスの改善により、1 兆パラメータの AI モデルのトレーニングに必要な Nvidia V100 GPU をわずか 800 個に削減できるという。 DeepSpeed の最新バージョンには、GPU とそのホスト CPU 上のコンピューティング リソースとメモリ リソースを活用して、単一の V100 で最大 130 億のパラメータを持つモデルをトレーニングする ZeRO-Offload テクノロジーも含まれています。マイクロソフトは、これは最先端のものより 10 倍強力であり、データ サイエンティストはより少ないコンピューティング リソースを使用してトレーナーをトレーニングできると主張しています。 「これら(DeepSpeed の新技術)は、極めて高い計算、メモリ、通信効率を提供し、数十億から数兆のパラメータを持つモデルのトレーニングをサポートします」と Microsoft はブログ投稿で述べています。「これらの技術により、極めて長い入力シーケンスも可能になり、単一の GPU、数千の GPU を備えたハイエンド クラスター、または非常に低速のイーサネット ネットワークを備えたローエンド クラスターを備えたハードウェア システムのパワーが解放されます。当社は、ディープラーニング トレーニングの速度と規模の限界を押し広げながら、急速に革新を続けます。」 |
<<: 企業がAI対応データベースを使用してAI導入を加速する方法
>>: 役立つ情報 | 115 行のコードで数独パーサーを作成する方法を段階的に説明します。
視覚化と視覚分析では、高帯域幅の視覚認識チャネルを使用してデータをグラフィック表現に変換し、インタラ...
ビデオ編集は、編集者が適切なフレームを見つけてつなぎ合わせる必要がある、時間と労力を要する作業です。...
顔を入れ替えた動画は、DL を悪用した大きな結果です。インターネット上にあなたの写真がある限り、あな...
[[211656]] 「人工知能を人間の生活に取り入れたいなら、人間とコミュニケーションできる言語能...
10 月 29 日現在、大規模言語モデル (LLM) では即座に回答を出すことができないため、質問を...
現在、多くのディープラーニング モデルがモバイル アプリに組み込まれています。デバイス上で機械学習を...
[[195041]]機械学習を始めるにあたって、万能のアプローチは存在しません。私たちは皆、少しずつ...
[[361089]] 「ロボットは製造業の頂点であり、その応用と製造は国のハイエンド製造業の重要な指...
機械学習の急速な発展により、インテリジェントな音声処理のための強固な理論的および技術的基盤が築かれま...
「新しいインフラ」は新たな方向性を表しています。新旧の成長原動力の転換という文脈において、「新インフ...