この記事はAI新メディアQuantum Bit(公開アカウントID:QbitAI)より許可を得て転載しています。転載の際は出典元にご連絡ください。 どのようなバグが Pytorch ライブラリの95% に影響を及ぼし、 Tesla の AI ディレクターにさえ問題を引き起こす可能性があるのでしょうか? この虫は確かに小さいですが、かなり「狡猾」です。 これは最近 Reddit で話題になっています。ネットユーザーが一般的なPytorch+Numpy の組み合わせを使用しているときにこれを発見しました。 最も重要なことは、コードがスムーズに実行できたとしても、モデルの精度に影響するということです。 さらに、ネットユーザーの間で熱く議論されたもう一つのポイントは次の通り。
何が起こっているのか?この事件の原因は、PyTorchでNumPyを使用して乱数を生成する際に、データの前処理の制限により、複数のプロセスがデータを並列にロードするが、最終的に各プロセスから返される乱数は同じになることをネットユーザーが発見したことでした。 彼はまた、自分の主張を裏付ける例も挙げた。 以下は、3 つの要素のランダムなベクトルを返すデータセットの例です。ここで使用されるバッチ サイズは 2 で、ワーカー プロセスの数は 4 です。 すると、不思議なことが起こりました。各プロセスによって返される乱数が同じになったのです。 この結果は本当にわかりにくいです。ちょうど、Xiao Ming が特定の距離を歩くのにどれくらい時間がかかるかを尋ねる数学の文章題で、計算すると負の数になるようなものです。 この問題を発見した後、ネットユーザーはGitHubから10万個以上のPyTorchライブラリをダウンロードし、同じ方法を使って乱数を生成した。 結果はさらに衝撃的で、 95% 以上のライブラリがこの問題に悩まされています。 その中には、PyTorch の公式チュートリアルや OpenAI のコードも含まれています。Tesla AI ディレクターの Karpathy 氏でさえ、「騙された」と認めています。 しかし、正直に言うと、このバグを解決するのは難しくありません。各エポックでシードをリセットするか、 Python の組み込み乱数ジェネレーターを使用してこの問題を回避します。 それはバグですか?この問題はすでに解決できるのに、なぜこれほど大きな議論を呼んでいるのでしょうか? ネットユーザーの注目が「哲学的」なレベルにまで高まったからだ。 これはバグですか? Reddit の誰かがこう考えました: これはバグではありません。
この見解が大きな騒動を引き起こし、多くの人が彼が問題の核心を見落としていると考えました。
別のネットユーザーも、このバグは実際にはデフォルトのプログラムで実行している場合にのみ発生するため、より多くのユーザーに指摘されるべきだと述べた。 そして、Pytorch ライブラリの 95% 以上がこれに悩まされていますが、これは決して誇張ではありません。 ある人は、以前の辛い経験を次のように話しました。
また、95% 以上のユーザーが使用時にエラーを経験する場合、コードが間違っていると付け加えたユーザーもいます。
PyTorch で落とし穴に遭遇したことがありますか?上記のバグは偶然ではありません。PyTorch を使用する人が増えるにつれて、バグもどんどん発見されます。ある Web サイトには PyTorch の落とし穴をまとめた記事もあり、49 万回も閲覧されています。 ベクトル、関数から model.train() まで、それが実際のバグであるか、自ら招いたバグであるかにかかわらず、誰もが経験する血と涙の物語は本当に異なります。 それで、PyTorch での経験について、共有できる血と涙の物語はありますか? |
<<: 音声認識技術は急速に発展しており、その規模は今後5年間で300億近くに達するだろう。
>>: アルゴリズムから離れた「ジレンマ」に直面し、専門家はシナリオベースの洗練されたガバナンスの実行を提案している。
1. テキスト生成入門まず、現段階で人気のテキスト生成について紹介します。 1.人工知能の発展段階人...
医師が患者を治療するための薬を説明するために数文を書くと、AI が必要な薬の正確な構造を自動的に生成...
ソフトバンクによる英国の半導体事業アームのエヌビディアへの660億ドルでの売却計画は、米国、英国、欧...
中学校では、数学の描画ほど恐ろしいものはありませんでした。多くの問題にはすぐに利用できる解析的解法が...
ACL 2023 受賞論文が発表されました!合計75件の論文が提出され、6件の賞が選ばれました。優...
英国の著名な分析機関オックスフォード・エコノミクスが発表したデータによると、今から10年後の2030...
データの不均衡は機械学習における一般的な課題であり、あるクラスの数が他のクラスを大幅に上回り、偏った...
[[275567]]週末に集中的に流行した後、顔を変えるソフトウェアZAOの人気はようやく落ち着きを...
[[333587]]重み制約は、ディープラーニング ニューラル ネットワーク モデルのトレーニング ...
[51CTO.com クイック翻訳] イスラエルのベングリオン国際空港は、世界で最も安全な空港の一つ...