OpenAI が GPT-3 の微調整機能を公開、コマンド 1 行で実現可能!精度は最大4倍に向上します

OpenAI が GPT-3 の微調整機能を公開、コマンド 1 行で実現可能!精度は最大4倍に向上します

この記事はAI新メディアQuantum Bit(公開アカウントID:QbitAI)より許可を得て転載しています。転載の際は出典元にご連絡ください。

OpenAI は、ユーザーが GPT-3 のカスタマイズされたバージョンを作成できるようにすると発表しました。

手順は非常に簡単で、コマンド 1 行だけで実行できます。

最大4倍の改善">

微調整後、GPT-3 のカスタマイズされたバージョンは、さまざまなアプリケーションで明らかな改善が見られます。

OpenAIは、さまざまなアプリケーションの精度を83%から95%に直接向上させ、エラー率を50%削減できると述べた。

小学校の算数の問題を解く正解率も2~4倍向上します。

最大4倍の改善">

このようにして、多くの研究開発担当者は巨人の肩に立ち、独自の AI モデルをゼロからトレーニングすることなく、1,750 億のパラメータを持つ大規模モデルを直接微調整することができます。

これに対してネットユーザーたちは次のように叫んだ。

今ではチャットボットを直接トレーニングできるので、時間とコストを大幅に節約できます。

最大4倍の改善">

たとえば、この税金アプリケーション - Keeper Tax。

明らかに、OpenAI は GPT-3 をより多くの人々に利用できるようにするために努力を惜しみませんでした。

微調整には多くの利点がある

OpenAI がすでに証明しているように、微調整には多くの利点があります。

今年6月、研究チームはわずか80件のテキストのデータセットをトレーニングに使用し、GPT-3の音声の危険性を大幅に低減し、表現をより人間らしくした。

(下図の青い線は学習済みモデル、赤い線は基本モデルを表しています。スコアが高いほど性能が良いことを意味します)

最大4倍の改善">

実際、多くのアプリケーションではすでに GPT-3 のカスタマイズされたバージョンが使用されており、良好なパフォーマンスを発揮しています。

たとえば、この税金アプリケーション - Keeper Tax。

GPT-3 のカスタマイズされたバージョンを使用して、請求書のさまざまなデータを識別し、ユーザーが税控除の対象となる経費を見つけるのに役立ちます。

キーパータックスによれば、微調整されたGPT-3を使い始めてから、アプリの認識精度は毎週約1%ずつ向上し、精度は従来の85%から93%にまで向上したとのこと。

最大4倍の改善">

人工知能検索ツール「Elicit」を見てみましょう。

ユーザーが検索した質問に基づいて、インテリジェントに結果を提供できます。

GPT-3 のカスタマイズされたバージョンを使用した後、Elicit によって得られた結果は、理解度で 24%、精度で 17%、全体で33%向上しました。

最大4倍の改善">

ユーザーのコメントをインテリジェントに読み取ることができる、Viable というアプリケーションもあります。

多数のレビューから、苦情や質問など、ユーザーの重要な提案を読み取ることができます。

カスタマイズされた GPT-3 により、ユーザーフィードバックを識別するアプリの精度が 66% から90%に向上しました。

最大4倍の改善">

実際、向上したのは精度だけではありません。

カスタマイズされた GPT-3 には、時間と出力結果の多様性の点でより明らかな利点があります。

どのように摂取しますか?

OpenAI は、GPT-3 を微調整するには、おおよそ 3 つのステップが必要だと述べています。

トレーニング データを準備してアップロードし、モデルをトレーニングして微調整し、最後にそれを使用します

このうち、トレーニングデータは JSONL ドキュメントである必要があります。このステップが GPT-3 を優れたものにする鍵となります。

微調整モデルの作成は OpenAI CLI で行います。手順も非常に簡単です。データ ファイルをアップロードし、微調整ジョブを作成し、ジョブが完了するまで数分または数時間待つだけです。

最後に、微調整されたモデルを使用する場合は、コマンド ラインの fine_tuned_model フィールドをモデル名に置き換えるだけです。

最大4倍の改善">

具体的な手順はOpenAIの公式サイトに記載されていますので、記事末尾のリンク2を参照してください。

もちろん、より強力な GPT-3 を使用する場合は、コストが増加します。

微調整されたモデルの 1K トークンあたりのコストは、基本バージョンよりも50%高くなります。

OpenAIの技術者はインタビューでこう語った。「この機能を開発したとき、AI研究の経験がない人でも使えるようにしたいと考えていました。

多くのネットユーザーも、GPT-3 を使用して多くの興味深いアプリケーションを作成したというメッセージを残しました。

たとえば、ある人はおとぎ話を語る睡眠ポッドキャストを書きました。

最大4倍の改善">

<<:  AIコピーライティングの11のメリット

>>:  データ拡張とは何ですか?

ブログ    
ブログ    
ブログ    

推薦する

データサイエンティストと開発者向けの新しいツールであるAmazon SageMakerが中国で利用可能になりました

【51CTO.comオリジナル記事】機械学習は誕生以来、多くの分野で応用されてきましたが、現時点では...

AI時代におけるコンピュータのマクロ的な意義について語る

実際、私たち人間は、そのようなことを心配する必要はありません。科学者は、人工知能が人間の脳のレベルに...

グラフニューラルネットワークは急成長を遂げており、最新の進歩はここにあります

[[346023]]グラフニューラルネットワーク (GNN) は近年急速に発展しており、最近の会議で...

企業が人工知能を活用してサービスをパーソナライズする方法

パーソナライズされたサービスが大きなメリットをもたらすことは間違いありません。うまく行けば、投資収益...

GPT-4 はもう怠け者ではありません! OpenAI、5つの大型モデルを最大80%割引で販売

OpenAI深夜アップデート! 5 つの大きなモデルが一気に投げられました。新しい GPT-4 Tu...

...

...

...

もはや魅力的ではない Google は次の IBM になるのでしょうか?深刻な高齢化、イノベーションへのサポートの喪失、従業員の信頼の喪失、人材流出

ジェミニが世論に大騒ぎを引き起こした後、ピチャイ氏の辞任を求める声があらゆるところで聞かれた。過去 ...

HiLM-D: 自動運転のためのマルチモーダル大規模言語モデル

この記事は、Heart of Autonomous Driving の公開アカウントから許可を得て転...

NTRU 1.2 リリース Java 用 NTRU 暗号化アルゴリズム ライブラリ

NTRU 1.2 バージョンには多くの機能強化とバグ修正が含まれていますが、このバージョンは以前のバ...

2021年のスマートシティの変革と再構築のトレンド

現代では、混沌とした賑やかな都市がどんどん増え、実際に「スマートシティ」の称号を競い合っています。そ...

効果はSDXLを超える!香港中文大学の博士課程学生が3億4000万枚の画像でトレーニングした超リアルな肖像画合成ツールを発表

AIが描く人物をよりリアルにするため、香港中文大学の博士課程の学生たちは3億4000万枚の画像を使っ...

CES 2020 における AI による心を読む

この記事はLeiphone.comから転載したものです。転載する場合は、Leiphone.com公式...