この記事はAI新メディアQuantum Bit(公開アカウントID:QbitAI)より許可を得て転載しています。転載の際は出典元にご連絡ください。 ある日、パラメータ調整者がディープラーニング モデルをトレーニングしていました。使用された 2 つのデータ セットには、異なる損失関数がありました。データ セットのサイズは固定されておらず、毎日増加していました。 彼は少し心配していました。エポック番号をどうやって設定すればいいのでしょうか? 苦労しているうちに、彼は突然思いつきました。なぜエポック番号を設定する必要があるのだろう?必要なのは、各バッチに対して独立した同一分布サンプリング(IID サンプリング) を実行することだけです。 この考えを検証するために、貂蝉は多くの論文を読みました。トレーニング方法を紹介する際に、反復回数のみに言及し、エポックについては言及しない人が増えていることに気づきました。 彼は、エポック社がデータセットが限られていることを暗示し強調しており、それが厄介なだけでなく潜在的に「有害」であると考えました。 Epoch を削除してループのネスト レベルの数を減らすことは常に良いことです。 そこで彼は Reddit で議論を始めました。「Epoch は時代遅れか、あるいは有害か?」 Epochは冗長ですか?この見解に同意する人もいます。
しかし、パラメータ調整者は、各サンプルが定期的に使用されているかどうかが疑問点であると感じています。IID サンプリングによって同じ分布が保証されており、同じ頻度で使用することは誤解を招きます。 反対派はこう信じている。
最終的に、Tiaocanxia は、この論争は統計学における「頻度学派VSベイズ学派」、つまりデータセットが確実であるべきか不確実であるべきかという論争に少し似ていると結論付けました。 モデルを比較するにはどうすればいいですか?Diaocanxia は、損失曲線を作成するためにバッチ損失を使用する人もいることにも気づきました。彼は、これが Epoch Loss よりも参考資料として価値があると考えています。 対戦相手はあなたのアプローチが良いと考えていますが、Epoch はまだ有用です。 同じハードウェアであっても、異なるモデルの異なるアルゴリズムの効率によって大きな違いが生じる可能性があるからです。
最後に、あるネットユーザーが CV モデルを例にこのトピックの素晴らしい要約を作成し、損失を視覚化する 4 つの方法をリストし、どの方法をどのような状況で使用するかを紹介しています。 損失/エポックは、モデルが同じ画像を理解するために何回観察する必要があるかを示します。 損失/反復は、必要なパラメータ更新の回数を示します。これはオプティマイザーを比較するときに役立ち、より速くトレーニングしたり、より高い精度を達成したりするのに役立ちます。 損失/合計画像表示は、アルゴリズムが画像のどの程度を見たかによる損失を示します。データを使用する際の 2 つのアルゴリズムの効率を比較するのに適しています。 アルゴリズムが 500,000 枚の画像で 70%、100 万枚の画像で 75% を取得する場合、それはおそらく 500,000 枚の画像で 50%、100 万枚の画像で 80% を取得する場合よりも優れています。 さらに、バッチ サイズの影響も排除されます。これにより、異なる GPU でトレーニングされた異なるバッチ サイズのモデル間の公平な比較が可能になります。 損失/時間も重要です。新しいモデルによってエポックが 100 削減されても、各反復が 100 倍遅くなる場合、このモデルは選択されません。 Loss/Time はハードウェアの特定のパフォーマンスに関連し、十分に正確ではありませんが、これについては論文には書きません。しかし、自分のマシン上でモデルのパラメータを評価するには良い方法です。 データ拡張を使用する場合はどうでしょうか?一部のネットユーザーは、データ拡張中に Epoch が少し冗長であると指摘しています。データ セットが小さすぎるため、わずかな違いがある各サンプルのバージョンを人為的に多数追加します。それらを同じ頻度で使用する必要はありません。 反対派は、正規化の一形態としてのデータ拡張によって過剰適合が軽減されると主張しますが、実際に導入される情報は、モデルをトレーニングするときに元のデータセットに限定されます。元のデータセットが十分に小さい場合、Epoch はトレーニング セット全体をモデルに表示することを意味しますが、それでも意味があります。 誰かが尋ねました:
パラメータ調整機能:
△ERA(Endless Random Enhancement)の頭文字は「時代」を意味します |
<<: 自動運転の安全上のリスクはどこから来るのでしょうか?
>>: AIの冬がまた来るのか?アメリカ人教授がarXivにAIを批判する記事を掲載し、Redditのネットユーザーから批判された
LLaVA (Large Language and Vision Assistant) は、画像翻訳...
この記事はLeiphone.comから転載したものです。転載する場合は、Leiphone.com公式...
人口減少と人件費の高騰が進む中、ロボットは産業構造改革の中核となっている。ロボットが産業のアップグレ...
Meta は 9 月 4 日に、研究者がコンピューター ビジョン モデルのバイアスを確認するのに役立...
LLM搭載のAIエージェントで論文を自動作成できるようになりました!ウェブサイト: https:/...
この記事はLeiphone.comから転載したものです。転載する場合は、Leiphone.com公式...
マイクロソフトは9月12日、Microsoft Designerの適用プラットフォームを拡大し、We...
人工知能と機械学習は市場で注目されている技術であり、その重要性は 2020 年にピークに達しました。...
ジェネレーティブ AI は人工知能コミュニティに旋風を巻き起こしました。個人も企業も、Vincent...
[[201793]]導入毎晩残業して家に帰るときは、Didiやシェア自転車を使うこともあります。ア...
強化学習と意思決定に関する学際会議 (RLDM) の重要な前提は、複数の分野が長期にわたる目標指向の...