20,000語の記事を処理できる、初の商用32kコンテキストオープンソースモデル「Giraffe」が登場

20,000語の記事を処理できる、初の商用32kコンテキストオープンソースモデル「Giraffe」が登場

注意メカニズムに依存する大規模言語モデル (LLM) は通常、トレーニング中に固定のコンテキスト長を使用します。これにより、モデルが処理できる入力シーケンスの長さに上限が設定されます。そのため、文脈の「長さの外挿」手法を探求する研究は数多くあります。

コンテキスト長の外挿とは、より短いコンテキスト長でトレーニングされた LLM を使用し、より長いコンテキスト長でさらにトレーニングすることなく、より長いコンテキスト長で評価することを指します。その中でも、ほとんどの研究は注意機構における位置符号化システムの変更に焦点を当てています。

現在、Abacus.AI の研究チームは、LLaMA または LLaMA 2 モデルに基づく既存のコンテキスト長外挿法について広範な調査を実施し、新しい切り捨て戦略を提案しました。


  • 論文アドレス: https://arxiv.org/abs/2308.10882
  • プロジェクトアドレス: https://github.com/abacusai/long-context

この切り捨て戦略の有効性を検証するために、この研究では 3 つの新しい 13B パラメータの長いコンテキスト モデルをリリースしました。Giraffe には、LLaMA-13B に基づいてトレーニングされた 2 つのモデル (コンテキスト長はそれぞれ 4k と 16k) と、LLaMA2-13B に基づいてトレーニングされた 1 つのモデル (コンテキスト長は 32k) が含まれています。このモデルは、LLaMA2 に基づく 32k コンテキスト ウィンドウを備えた最初のオープン ソース LLM でもあります。

Abacus.AIのCEOであるBindu Reddy氏がTwitterで紹介した。

32k コンテキスト ウィンドウの概念とは何ですか?これは約 24,000 語であり、オープンソース モデル Giraffe は 20,000 語の長い記事を処理できることを意味します。

画像出典: https://twitter.com/akshay_pachaar/status/1694326174158143619

方法の紹介

コンテキストの長さが増加すると、LLM アーキテクチャのアテンション メカニズムによってメモリ使用量と計算が 2 乗的に増加するため、長さの外挿法が重要になります。

この研究では、現在有効なコンテキスト長外挿法のいくつかをまとめ、線形スケーリング、xPos、ランダム位置エンコーディングなど、どの方法が最も効果的かを判断するために包括的なテストを実施しました。さらに、研究チームはいくつかの新しい方法も提案しており、そのうちの1つである「切り捨て」はテストに非常に効果的でした。

まず、LLM のパフォーマンスを評価する際の難しさの 1 つは、適切な評価方法を選択することです。一般的に使用される指標は、次のトークンの難しさです。これは、コンテキストに基づいて次のトークンを予測するモデルの能力を測定します。しかし、研究チームは、この指標で良好な結果を得るには通常、利用可能なコンテキスト全体のごく一部に基づいて、適度に一貫性のあるテキスト分布を生成することで達成できると考えているため、長いコンテキストには適していません。

長いコンテキストの状況でのモデルのパフォーマンスを分析するために、この研究では、モデルの再現精度を測定指標として使用し、モデルの長いコンテキストのパフォーマンスを評価するための 3 つのデータセット、LongChat-Lines、FreeFormQA、および AlteredNumericQA を公開しました。このうち、LongChat-Lines はキーと値の取得タスクに使用され、FreeFormQA と AlteredNumericQA は自然な質問データセットに基づく質問応答データセットです。これら 3 つのデータセットは、キー値検索タスクと質問応答タスクにおける LLM の機能を評価できます。モデルが焦点を当てるコンテキストの長さが長いほど、精度が高くなります。

実験と結果

研究チームは、上記の 3 つの新しいデータセットを使用して、いくつかのコンテキスト長外挿方法に関する評価実験を実施しました。 LongChat-Lines の実験結果を以下の表 1 に示します。

FreeFormQA および AlteredNumericQA データセットの評価結果を以下の表 2 および 3 に示します。

全体的に、線形スケーリングが最も効果的であり、切り捨てにはある程度の可能性があり、xPos メソッドは微調整に適応できません。

興味のある読者は、原著論文を読んで研究内容の詳細を知ることができます。

<<:  AIによる労働者排除の進捗が発表され、真っ先に影響を受けるのは女性、アジア人、ホワイトカラー労働者!誰も免れることはできない

>>: 

推薦する

「ビッグデータによる既存顧客殺し」を厳しく罰し、アルゴリズムがユーザーにより良いサービスを提供できるようにする

7月2日、国家市場監督管理総局は「価格違反に対する行政処罰(意見募集稿)」を発表し、ダンピング、価格...

公開鍵暗号を解読することは可能ですか?

Q: 正しくインストールされ、操作されていれば、公開鍵インフラストラクチャ (PKI) は破られな...

素晴らしい瞬間を振り返りましょう! IEEE Spectrumが2023年の最もホットなAIストーリーをレビュー

また冬が来て、終わりに近づいています。気温も少し上がり、広大な空と大地にはまだ溶けきれない白が残って...

...

...

中国は2022年に耐量子暗号アルゴリズムを開発し、2025年に実装予定

[[248782]]量子コンピュータが実用化されるまでにはしばらく時間がかかるだろうが、国際的な暗号...

IoTミツバチ:私たちの未来を救う技術

ミツバチは植物から植物へと飛び回って餌を探しながら、受粉という重要な役割も担っています。しかし、過去...

FMI2017----人工知能とビッグデータが時代を力づける

2017年8月5日、ペガサスが主催する「FMI人工知能&ビッグデータサミットフォーラム」が北京国家会...

戻れる幼少時代!快手が「子供になる」特殊効果をリリース

「子供時代に戻りたい。子供の頃はよく食べて、よく寝て、あまり考えないことが好きだった」。山西省大同市...

大好きです!初心者に適した 7 つの高品質 AI プロジェクト

人工知能が本格的に普及しつつあります。AIの知識を学ばなければ、自分が新時代の後継者だと言えるでしょ...

ディープラーニングをもっと有効活用するにはどうすればいいでしょうか?

企業向けにディープラーニングを実装する前に、ビジネスリーダーがこの画期的なテクノロジーの機能と特徴...

ジェネレーティブ AI がデジタル変革の優先事項に与える影響

2024 年に向けて、CIO は生成型 AI の可能性とリスクを考慮してデジタル アジェンダを再構築...

人工知能はデマですか?人工知能が日常生活にもたらす変化を感じられますか?

しかし、メディアで大いに宣伝された後、人々は AlphaGo が Deep Blue と同じレベルに...

人工知能とモノのインターネット: インターネット通信の未来

人工知能 (AI) とモノのインターネット (IoT) の登場により、通信およびインターネット技術業...

2020年のIT開発トレンドは刺激的

[[274294]] [51CTO.com クイック翻訳] Future Today Researc...