HowToJP

「vllm」のインストール・使い方

[vllm](https://github.com/vllm-project/vllm)は、大規模言語モデル(LLM)の推論とサービングに対する高速で使いやすいライブラリです。このプロジェクトは、注意力のキーと値メモリの効率的な管理を可能にするPagedAttentionと、並列サンプリング、ビームサーチなどの様々なデ

章 有坂

章 有坂

オープンソースソフトウェアのトレンドを追いかけてます。

vllmは、大規模言語モデル(LLM)の推論とサービングに対する高速で使いやすいライブラリです。このプロジェクトは、注意力のキーと値メモリの効率的な管理を可能にするPagedAttentionと、並列サンプリング、ビームサーチなどの様々なデコーディングアルゴリズムを使用した高スループットのサービングを提供します。vLLMは、Hugging Faceの多くのモデルをシームレスにサポートしており、Aquila & Aquila2、LLaMA & LLaMA-2などのアーキテクチャを含みますSource 0

インストール・導入方法

vLLMはPythonパッケージとして提供されており、PyPIから簡単にインストールできます。以下のコマンドを実行してインストールできます:

pip install vllm

使い方

vLLMの具体的な使用方法は公式ドキュメントに記述されていますが、一般的な使用方法は以下の通りです:

  1. 必要なモデルをダウンロードします。
  2. モデルをロードし、必要な設定を行います。
  3. テキストの入力をモデルに渡し、出力を取得します。

具体的なコード例や使用例は、プロジェクトのGitHubページや公式ドキュメントを参照してくださいSource 0

荘 有坂

章 有坂

オープンソースソフトウェアのプロ / ベテランのソフトウェア技術者 / Github専門家

オープンソースソフトウェアが好きな編集部が、GithubやGitlabなどの新着リポジトリやトレンドのプロジェクトを分かりやすく紹介。

(広告表示)当サイトは友達紹介プログラム等に参加しています。ご登録により、編集部に紹介料が還元される場合があります。 This site contains referral links. We may get a small commission from purchases or sign-ups made through them at no extra cost to you.