偉大なカルパシー氏はOpenAIを辞任し、当初は1週間の休暇を取ると脅していた。 写真 しかし、瞬く間に、新しいプロジェクトが GitHub で公開され、毎日何千ものスターを獲得しました。 写真 相変わらずおなじみのカードの方式: 大規模モデルのトークン化で一般的に使用される BPE (バイト ペア エンコーディング) アルゴリズムを処理し、アルゴリズムの最小かつ最もクリーンなコード バージョンを実装するための 74 行の Python コード。 平: 写真 約 30,000 個の星がある nanoGPT に少し似ているように感じますか? この波はネットユーザーに本当に推測させました:
結局のところ、カルパシー氏は、テスラ社の元AIディレクターやOpenAIの創設メンバーという肩書きに加え、ネットユーザーの間では「AI分野の偉大な慈善家」や「複雑な問題を単純化するのが得意なカルパシー先生」(犬の頭)として最もよく知られている。 BPE コードの最小化バージョン今回カルパティ先生がどんなご飯を作ったのか、詳しく見てみましょう。 写真 プロジェクト名 minbpe がすべてを物語っています。つまり、BPE アルゴリズムの最小かつ最もクリーンなコード バージョンです。 BPE (Byte Pair Encoding) は、GPT-2 で普及したトークン化アルゴリズムです。現在、GPT シリーズ、Llama シリーズ、Mistral を含む多くの大規模モデルがこのアルゴリズムを使用して単語セグメンテーションをトレーニングしています。 BPE の主な利点は次のとおりです。
minbpe プロジェクトでは、Karpathy は 2 つのトークナイザーを提供しており、どちらもトークナイザーの 3 つの主な機能を実行できます。
具体的には、basic.py では、minbpe は 74 行の Python コードを使用して、テキスト上で直接実行される BPE アルゴリズムの最も単純な実装を完了します。 写真 regex.py では、minbpe は正規表現を使用して入力テキストをさらに分割する正規表現トークナイザーを実装します。 さらに、正規表現トークナイザーに基づいて、minbpe は gpt4.py で GPT4Tokenizer も提供しており、オンライン tiktoken ライブラリの GPT-4 を正確にトークン化できます。 注: Tiktoken は高速な BPE トークナイザーです。 写真 base.py は、トレーニング、エンコード、デコード用のスタブが含まれ、保存および読み込み機能を提供し、いくつかの一般的な補助ツール機能を統合する基本クラスです。実際のアプリケーションでは、開発者はこの基本クラスを継承して特定の単語分割機能を実装する必要があります。 カルパシー氏は、テイラー・スウィフトのWikipediaテキストで2つの主要なトークナイザーのトレーニングを試みたと述べました。 train.py を M1 MacBook で実行すると約 25 秒かかります。 まだ質問がある場合は心配しないでください。Ka先生がビデオを公開する予定です。 写真 Karpathy 氏は OpenAI を去りましたが、彼の「次の章」は Large Language Model System (LLM OS) になるだろうと多くの人が推測しています。 写真 彼の正式な職業はまだ明らかにされていないが、カルパシーはすでに「人々を教え、教育する」という副業を始めているようなので、皆さんも始めることができるだろう。 参考リンク: https://github.com/karpathy/minbpe/ |
<<: GitHub ホットリスト 1 位: 数百万のトークン コンテキスト、動画も生成可能、カリフォルニア大学バークレー校制作
>>: AIを使ってアニメーションを作成する方法と、さまざまなツールがあなたを待っています
「未来を今日どのように実現するか。その答えはシミュレーションだ」と、NVIDIAの創業者兼CEOのジ...
海外メディアTech Xploreによると、MITの研究者らは最近、新しいタンパク質分子の構造を事前...
新しいGTAゲームの予告編を見ましたか?この予告編は3つのギネス世界記録を破り、再生回数は1億回を超...
3nmプロセス、H100をはるかに超える性能!つい最近、海外メディアのDigiTimesが、コードネ...
著者 | ユン・チャオユーザーと情報の間には、検索か推奨のいずれかが存在します。百度の執行副社長であ...
Google からもう 1 人の中核社員が退職することが明らかになりました。今回逃亡したのは、Dee...
この記事はLeiphone.comから転載したものです。転載する場合は、Leiphone.com公式...
ディープニューラルネットワークは、数学モデルを使用して画像やその他のデータを処理する多層システムであ...
[[419760]] 「クラブアップルの木は、その赤みがかった色にもかかわらず、霧雨の中にひとりぼっ...
電卓が普及した後、そろばんの使い方しか知らなかった会計士は失業した。ゴールドマン・サックスは最盛期に...
新しい報告によると、私たちは人工知能革命の瀬戸際に立っている。この革命において、私たちが作り出すテク...
スマート車両ネットワーキング、インテリジェンス、アーキテクチャ技術の発展に伴い、自動車ではファームウ...