統計ウェブサイト: https://mlcontests.com/ 著者はいくつかの重要な結論に達しました: プラットフォームタイプこの調査では、著者らは 16 のプラットフォームで合計 83 の競技を数えました。これらのコンテストの賞金総額は 270 万ドルを超え、最も賞金の高いコンテストは Driven data が主催する Facebook AI Image Similarity Challenge: Matching Track で、賞金は最大 20 万ドルです。 競技種別調査によると、2021 年に最も一般的な競争の種類はコンピューター ビジョンと自然言語処理です。これは、NLP コンテストが全体のコンテストのわずか 7.5% を占めていた 2020 年と比べて大きな変化です。 数多くの NLP コンテストの中でも、Zindi は AI4D (Artificial Intelligence for Development Africa) と共同で、アフリカの言語を英語または他の言語に翻訳したり、アフリカの言語で感情分析を実行したりするコンテストを最も多く開催してきました。 言語とフレームワークこの調査では、主流の機械学習フレームワークは依然として Python に基づいています。 Scikit-learn は非常に汎用的で、ほぼすべての分野で使用されています。 当然のことながら、最も人気のある 2 つの機械学習ライブラリは Tensorflow と Pytorch です。その中でも、ディープラーニングのコンテストではPytorchが最も人気があります。 2020 年と比較して、ディープラーニングのコンテストで PyTorch を使用する人の数は急増しており、PyTorch フレームワークは毎年急速に発展しています。 チャンピオンモデル教師あり学習古典的な機械学習の問題では、Catboost や LightGBM などの勾配ブースティング モデルが主流です。たとえば、屋内測位とナビゲーションに関する Kaggle コンテストでは、参加者はリアルタイムのセンサー データに基づいて屋内でのスマートフォンの位置を予測するアルゴリズムを設計する必要があります。チャンピオン ソリューションには、ニューラル ネットワーク、LightGBM、K 近傍法の 3 つのモデリング アプローチが検討されました。しかし、最終的なパイプラインでは、LightGBM と K-Nearest Neighbors でのみ最高スコアを達成しました。 コンピュータビジョン 2012 年に AlexNet が ImageNet コンテストで優勝して以来、CNN アルゴリズムは、特にコンピューター ビジョンにおける多くのディープラーニングの問題に使用されるアルゴリズムになりました。
最後に、RNN と CNN の組み合わせが可能になり、これはおそらくコンピューター ビジョンにおける最も高度なアプリケーションです。データが CNN に適しているが、時間的特徴が含まれている場合、ハイブリッド RNN と CNN 技術が好ましい戦略となる可能性があります。 他のアーキテクチャの中でも、EfficientNet はモデルの精度と効率の両方の向上に重点を置いている点で際立っています。 EfficientNet は、複合係数というシンプルだが効果的な手法を使用してモデルを増幅し、スケーリング戦略を使用して 7 つの異なる次元のモデルを作成します。その精度は、ほとんどの畳み込みニューラル ネットワークの SOTA レベルを超えています。 NLP2020 年と同様に、NLP 分野での大規模言語モデル (Transformer など) の採用は 2021 年に大幅に増加し、過去最高に達しました。著者は約 6 つの NLP ソリューションを発見しましたが、それらはすべてトランスフォーマーに基づいています。 優勝チーム著者らはデータセット内の 35 ゲームの勝者を追跡しました。そのうち、このコンテストでこれまで一度も賞を獲得したことがないのはわずか9人でした。 2020年と比較すると、多くの大会で優勝経験のある古参参加者が何度も優勝し、初めて優勝する人はわずかであり、割合に目立った変化はないことがわかります。 アドバンテージプログラム機械学習のコンテストで優勝した提案の中で、統合モデルは好まれる方法の 1 つになりました。アンサンブル法の中で最も一般的に使用されるアプローチは平均化です。これは、複数のモデルを構築し、それらの出力の平均を追加することでそれらを組み合わせ、より堅牢なパフォーマンスを実現します。 アンサンブル法の応用例Kaggle の「キャッサバの葉の病気の分類」コンテストでは、参加者はキャッサバの葉の画像を健康なもの、または 4 種類の病気に分類する必要がありました。チャンピオン ソリューションには、CropNet、EfficientNet B4、ResNext50、Vit の 4 つの異なるモデルが含まれており、平均化方式が使用されます。 |
>>: なぜディープラーニングは非パラメトリックなのでしょうか?
新型コロナウイルス感染症の流行から2、3年が経ち、私たちの日常生活の機能を維持するために、データセン...
この記事はLeiphone.comから転載したものです。転載する場合は、Leiphone.com公式...
[[427083]] 9月29日、中国サイバースペース管理局は他の8つの中央部門とともに、「インタ...
テキスト推奨は、推奨システムの応用シナリオとして、商業的に実装されて成功しています。最もよく知られて...
C# アルゴリズムはプログラマーの面接でよく出題されますが、C# アルゴリズムを使用してそれをどのよ...
[[411067]]サイエンスフィクションと現実がこれほど近づいたことはかつてありませんでした。 「...
[[203607]]教育革命が静かに起こっています。この革命はトップダウンの制度改革ではなく、ボトム...
[[327717]] 今日はオープンソース プロジェクトを紹介します。このプロジェクトの素晴らしい...
ビッグデータダイジェスト制作ただ! OpenAI は GPT シリーズのメジャーアップデートをリリー...
[[192373]]業界分析2016 年、世界のディープラーニング市場規模は 2 億 2,700 万...
テクノロジーは私たちの生活に常に影響を与えています。社会として私たちはテクノロジーに大きく依存するよ...