Google の最新のオープンソース Gemma モデルが Llma-2 を数秒で上回りました。

Google の最新のオープンソース Gemma モデルが Llma-2 を数秒で上回りました。

ジェマとは

ジェマ 軽量で最先端のオープンモデルシリーズで、  ジェミニ 同じ研究と技術をモデル化します。 Google DeepMind と Google の他のチームによって開発された Gemma は、ふたご座にヒントを得たもので、その名前は「宝石」を意味するラテン語の gemma を反映しています。 Google は、モデルの重み付けのリリースに合わせて、開発者のイノベーションをサポートし、コラボレーションを促進し、Gemma モデルの責任ある使用をガイドするための関連ツールもリリースします。

知っておくべき重要な詳細は次のとおりです。

  • モデルウェイトには、Gemma 2B と Gemma 7B の 2 つのサイズがあります。事前トレーニング済みおよび命令調整済みのバリアントが各サイズごとにリリースされます。
  • 新しい「Responsible Generative AI Toolkit」は、Gemma を使用してより安全な AI アプリケーションを作成するためのガイダンスと基本ツールを提供します。
  • すべての主要フレームワーク (JAX、PyTorch、TensorFlow) およびネイティブの Keras 3.0 の推論と教師あり微調整 (SFT) 用のツールチェーンが提供されます。
  • すぐに使用できる Colab および Kaggle ノートブック、および Hugging Face、MaxText、NVIDIA NeMo、TensorRT-LLM などの一般的なツールとの統合により、Gemma を簡単に使い始めることができます。
  • 事前トレーニング済みで命令調整済みの Gemma モデルは、ノートパソコン、ワークステーション、または Google Cloud で実行でき、Vertex AI および Google Kubernetes Engine(GKE)に簡単にデプロイできます。
  • NVIDIA™ (NVIDIA®) GPU や Google Cloud TPU など、複数の AI ハードウェア プラットフォームにわたる最適化により、業界をリードするパフォーマンスが保証されます。
  • 利用規約は、責任ある商業的使用および配布を許可します。

Gemma モデルは、現在市場で最大かつ最も強力な AI モデルである Gemini とテクノロジーおよびインフラストラクチャ コンポーネントを共有しています。これにより、Gemma 2B および 7B は、他のオープン モデルと比較して、その規模でクラス最高のパフォーマンスを実現できます。さらに、Gemma モデルは開発者のラップトップまたはデスクトップ コンピューターで直接実行できます。驚くべきことに、Gemma は主要なベンチマークで大型モデルを上回り、安全性と責任ある出力に関する厳しい基準も満たしています。

上図の評価データから判断すると、Gemma 7Bモデルの性能はすでに同レベルのLlma-2 7Bよりも優れており、Llama-2 13Bも完全に上回っています。次回は、ジェマの最新モデルをいち早く体験する方法を紹介します。

オラマがジェマを運営

まず、コンピュータにollama [1]がインストールされていることを確認してください。まだインストールしていない場合は、「わずか数分で大規模なローカル言語モデルをデプロイ!」という記事を参照してください。

ollama を正常にインストールしたら、コマンド ラインに次のコマンドを入力して、Gemma 2b または Gemma 7b モデルを実行できます。

 ollama run gemma:2b # Or ollama run gemma:7b

このコマンドを実行すると、Gemma 2B または Gemma 7B モデルが自動的にダウンロードされます。コンピュータに十分なメモリがある場合は、次のコマンドを使用して、量子化されていないバージョン、つまり精度の高いバージョンをインストールし、より良い結果を得ることができます。

 ollama run gemma:2b-instruct-fp16 # Or ollama run gemma:7b-instruct-fp16

ollamaに加えて、 llama.cpp [2]も使用できます。  またはgemma.cpp [3]  ジェマを体験しに来てください。

llama.cpp Gemma を実行する

ソース: https://github.com/ggerganov/llama.cpp/pull/5631

gemma.cpp Gemmaを実行する

ソース: https://github.com/google/gemma.cpp

この記事では、Google の最新の Gemma オープンソース モデルを体験する 3 つの方法を紹介します。興味のある方は、このモデルの効果を体験してください。

参考文献

[1]オラマ:   https://ollama.com/

[2]llama.cpp:   https://github.com/ggerganov/llama.cpp

[3] gemma.cpp:   https://github.com/google/gemma.cpp


<<:  Karpathy が OpenAI を離れ、2 時間の AI コースを開始! GPTトークナイザーをゼロから構築する

>>:  モデル融合、ハイブリッド専門家、小規模LLM、2024年のLLMの発展方向を理解するためのいくつかの論文

ブログ    
ブログ    
ブログ    
ブログ    

推薦する

...

40年前、袁龍平が田んぼで教えている姿はこんな感じです!ネットユーザーがAIを使って貴重な動画を復元し悲しみを表現

この記事はAI新メディアQuantum Bit(公開アカウントID:QbitAI)より許可を得て転載...

...

Python 密度クラスタリング アルゴリズム - DBSCAN の実践

この記事の主な内容:序文DBSCAN クラスタリング アルゴリズムパラメータ選択DBSCANアルゴリ...

Stability AI、GPUなしでローカルで実行できるStable Code 3Bモデルをリリース

文芸グラフィックの分野で非常に人気となっている Stability AI は、本日、2024 年向け...

...

...

AI 駆動型スマートビルは将来のトレンドになるでしょうか?

人工知能 (AI) は、建物の管理と制御の方法に革命をもたらし、これまで以上に効率的でコスト効率の高...

データサイエンスがソーシャルメディアマーケティング戦略をどう変えるか

人工知能の広範な応用は今日よく知られていますが、人工知能は具体的にどのように企業のソーシャル メディ...

Javaは一般的な組み合わせアルゴリズムを実装する

Java は一般的な組み合わせアルゴリズムを実装しています。{31311133,33113330} ...

...

「車輪の再発明」を拒否し、EasyDL で AI カスタム開発を体験できます

[[414878]]私たちは、あらゆるものが感知され、接続され、インテリジェントになる世界に突入して...

今年、AIがサイバーセキュリティに影響を及ぼす可能性がある3つの重要な方法

この記事では、超強力なソーシャル攻撃から AI 搭載 PC まで、AI が今年サイバーセキュリティを...