昨日10月9日、財連社は、百度の文心ビッグモデル4.0が集中的なトレーニングを受けており、リリースの準備がほぼ整っていると報じた。今日、IT Home は、基盤となるアーキテクチャ、インフラストラクチャ、トレーニング データ セット、コストなどの重要な情報を含む Wenxin 4.0 の詳細も知りました。 まず核心的な結論から始めましょう。
次に、啓示の詳細を見てみましょう。 Wanka Cluster によってこれまでにトレーニングされた最大のパラメーター モデル?IT Homeが入手した情報によると、文心モデル4.0のパラメータ規模は、パラメータが公開されているすべてのLLMよりも大きく、文心モデル4.0のパラメータ規模は兆レベルを超えると予想されるという。 このパラメータ量だけ見ると、それほど悪くないと思う人も多いでしょう。何しろ、現在公開されている情報によると、GPT-4のパラメータ数はすでに約1兆8千億にも上ります。しかし、内部告発者はさらに、Wenxin Model 4.0はまだ単一のモデルであり、GPTや他の多くの大規模言語モデルで使用されている混合エキスパートモデル(MoE)を採用していないと述べました。 以前、「天才ハッカー」ジョージ・ホッツ氏は、GPT-4がハイブリッドモデルを採用している理由は、モデルのパラメータスケールを2200億以上にすることが不可能だからだと明かした。 OpenAI はモデルの改善を望んでいますが、トレーニングに時間がかかると、効果は減少します。 したがって、Baidu が単一のモデルでブレークスルーを達成できたとしても、モデルの機能も大幅に向上するかどうかは、実際にリリースされて初めてわかることになります。 これほど多数のパラメータを持つモデルには、大量の計算能力が必要になります。現在のニュースでは、 Wenxin 4.0 は Wanka AI クラスターでトレーニングされており、これは Wanka 規模のクラスターを使用してトレーニングされた中国初の大規模言語モデルと見なされるべきです。 万華クラスターのコンセプトとは?現在中国では、ファーウェイとアリババのみが万華AIクラスターを構築したことを明らかにしていますが、それに基づいた具体的なモデルが発売されたという話はまだありません。 これは、Wanka クラスターを構築するのは簡単ではなく、それを最大限に活用するのはさらに難しいことを示しています。分析によると、PaddlePaddle の深い統合のおかげで、このような規模のモデルを Wanka クラスターに基づいてトレーニングできるのです。 コストが高騰し、一般向けに少量の検査が実施されているトレーニングコストが増加しているだけでなく、Wenxin 4.0の推論コストも3.5と比較して大幅に増加していることが明らかになりました。IT Homeはまだ1000トークンあたりの具体的な推論コストを入手していませんが、以前の約8〜10倍であると噂されており、これはまだ高使用率(MFU)条件下です。利用率が低い場合、コストは増加し続けると予想されます。 最後に、 Baiduの社内従業員によると、実際に少量のトラフィックでWenxin Model 4.0の秘密のテストを開始したとのこと。少数のWenxin Yiyanユーザーがすでに最新バージョンのモデルを使用しており、早ければ来週にも正式に発表される予定だ。 多くの人々は、この声明の方が信頼性が高いと信じており、テクノロジーコミュニティにおける最近のいくつかの暴露からもいくつかの手がかりを見ることができます。おそらく、Wenxin Yiyan で質問するときは、Wenxin モデル 4.0 を使用しているのでしょう。生成された結果が GPT-4 と競合できるかどうかはわかりません。 IT Home は、上記の情報は公式に確認されたものではなく、その正確性は各自が判断すべきであることを改めて強調します。 |
<<: 新しいAI技術がアルツハイマー病の薬のターゲット発見に役立つ
速すぎる、速すぎる。一晩で遅延なく大規模なモデルが生成されます...このスピードをぜひ体験してくださ...
テキスト ロゴのデザインはデザイナーの創造性と経験に大きく依存しますが、その中でも各テキスト要素のレ...
近年、拡散モデルはテキストから画像への生成において大きな成功を収め、画像生成品質の向上、推論パフォー...
現在、人類は急速に人工知能の時代に突入しています。人工知能技術の急速な発展、モノのインターネット、ビ...
ここ2年間、RPA+AI(インテリジェント自動化プロセス)が頻繁に言及されています。企業/機関のデジ...
ソラは発売後すぐにリバースエンジニアリングによって「解剖」されたのでしょうか? !リーハイ大学とマイ...
先ほど、グローバル AI 人材レポートが発表されました。世界のトップクラスの AI 人材のうち、約半...
新型コロナウイルスと闘っている多くの国々は、駅や空港で国民に体温検査を受けるよう命じている。この状況...
[[197951]]基本概念このセクションでは、勾配降下法をより一般化するために、機械学習アルゴリズ...
[[375635]] 2020 年は激動の年であり、組織は数多くの課題に直面しました。 2021年に...
映画「トンネル戦争」修復前と修復後の比較。画像はインタビュー対象者より提供新華社北京1月1日(記者フ...
産業用ロボットは、さまざまな産業用タスクを自動的に実行できる一種の機器として、製造、組み立て、梱包、...