この記事はAI新メディアQuantum Bit(公開アカウントID:QbitAI)より許可を得て転載しています。転載の際は出典元にご連絡ください。 グラフは、ノードとエッジで編まれたネットワークである非常に便利なデータ構造です。たとえば、ナレッジグラフはそのようなネットワークです。 このようなデータを処理するために、グラフ埋め込み、つまり高次元ネットワークを低次元ベクトルに変換する機能が使用されます。処理後、機械学習モデルはそれを簡単に使用できます。 上の図のように、ノードが数個、エッジが数十個しかない場合、グラフの埋め込みは難しくありません。 数十億のノードと数兆のエッジがあったらどうなるでしょうか?従来のグラフ埋め込み方法はあまり良くありません。 しかし現在、Facebook はPyTorch-BigGraph (略してPBG ) と呼ばれる新しいツールをオープンソース化しました。 これを使用すると、任意の大きさのグラフをすばやく埋め込むことができます。また、 GPUはまったく必要ありません。 オープンソース モデルを自分でトレーニングできるだけでなく、7,800 万ノードの Wikidata データを使用して事前トレーニングされたモデルもあり、直接ダウンロードして使用できます。 PBG が出版された後、友人たちは急いで互いにこう伝えました。 LeCun 先生も個人的に 2 回転送しました。 開発方法 PBG は、1 億 2000 万ノードの完全なFreeBaseナレッジ グラフを使用してトレーニングされた分散システムです。 トレーニング中、PBG はグラフ上のすべてのエッジの大きなリストを消費します。各エッジは両端のノードによって定義され、一方がソースでもう一方がターゲットです。定義内の 2 つのポイント間にも関係があります (関係タイプ)。 次に、PBG は各ノードの特徴ベクトル (埋め込み) を出力し、ベクトル空間内で隣接する 2 つのノードを近づけ、隣接しないノードを遠ざけます。 こうすることで、周囲の分布が似ているノードがベクトル空間内で互いに近くなり、グラフの本来の意味が保持されます。 さらに、異なる関係ごとに、異なる計算方法で「近接スコア」をカスタマイズできます。このようにして、ノードの埋め込みをさまざまな種類の関係間で共有できます。 もっと早く、もっと早く 大規模なグラフ データを迅速に処理するために、PBG は次の魔法を使用します。
トレーニング後、FB15k、Youtube、LiveJournalなどのグラフでテストされました。 研究チームによれば、PBG は従来のものと同じグラフ埋め込み品質を備えているが、必要な時間は大幅に短縮されているという。 あなたもぜひ試してみてください。 PBG もトレーニングする必要があります。 とにかく、GPUは必要ありません。 トレーニングしたくない場合は、完全な WikiData で事前トレーニングされたモデルもあります。 必要なポータルはすべてここにあります。 コードポータル: https://github.com/facebookresearch/PyTorch-BigGraph 食用指数: https://torchbiggraph.readthedocs.io/en/latest/ 紙の転送ポータル: https://arxiv.org/abs/1903.12287 ブログポータル: https://ai.facebook.com/blog/open-sourcing-pytorch-biggraph-for-faster-embeddings-of-extremely-large-graphs/ |
<<: Google のロボット工学プログラムは度重なる失敗からどのような教訓を得たのでしょうか?
>>: AI と機械学習: 大きなデマか、それとも大きな希望か?
人工知能 (AI) ベンチマークは、モデルを測定および比較するための方法を提供します。ベンチマークを...
韓国のチームが達成した室温超伝導は、世界中の主要な研究室で再現の熱狂を引き起こした。先ほど、もう一つ...
近年、コア技術の継続的な進歩と市場需要の継続的な解放により、ドローン産業は急速に発展しています。アプ...
11月7日午前2時、人工知能のスタートアップ企業OpenAIが初のDevDay開発者会議を開催し、C...
現在、人工知能(AI)は、人事、サプライチェーン、マルチレベルマーケティングなど、さまざまな分野で広...
この記事は公開アカウント「Reading Core Technique」(ID: AI_Discov...
人工知能 (AI): ChatGPT などのツールの最近の登場により、AI はビルダーの間で注目を集...
[[418851]] [51CTO.com クイック翻訳]非常に複雑な技術的アプリケーションで A...
COVID-19 パンデミックの影響で、2020 年末までに推定 60% の企業がワークロードをクラ...
近年、人工知能はロボットが人間のように考え、行動することを可能にする強力なツールへと発展しました。さ...
[[431747]]最近、第 1 回 Microsoft Research Summit の 2 日...
1. はじめに生成 AI は間違いなくゲームを変えるテクノロジーですが、ほとんどのビジネス上の問題...
Google は最新のブログ投稿で、テキスト分類タスクで BERT レベルのパフォーマンスを達成でき...