メインコンテンツまでスキップ

GenAIモデル

Neatは、LLiMaで準備されたLLM、VLM、ASRモデルに対して、GenAI APIを使用します。これは、Modelの生成モデル版であり、デプロイされたモデルのディレクトリをロードし、リクエストを作成し、アプリケーション内で実行するか、HTTP経由で提供します。

アプリケーションがモデルにテキストの生成、画像の質問への回答、ツールの呼び出し、またはオーディオの文字起こしを要求する場合に、これらのAPIを使用します。分類、検出、セグメンテーション、または埋め込みモデルなど、固定形状の識別モデルには、従来のModel APIを使用します。

GenAIの適用範囲

GenAIのパスは、Neatの他の部分と同じ高レベルの構造を持ちます。

  1. Modalix用のモデルアーティファクトを準備またはダウンロードします。
  2. モデルをターゲットに配置します。通常は/media/nvme/llima/models/の下に配置します。
  3. C++またはPythonアプリケーションからモデルをロードします。
  4. リクエストを直接送信するか、GenAIServerを通じてモデルを公開します。
  5. 完全な結果を読み取るか、ストリーミングされた出力を消費します。

LLiMaは、GenAIモデルの準備、コマンドラインテスト、およびベンチマークを担当します。Neatは、モデルがアプリケーション内で使用された後の、アプリケーション向けのAPIとランタイム統合を担当します。モデルの準備の詳細については、LLiMa を搭載した生成AIを参照してください。

アプリケーションの境界を選択

組み込みアプリケーションのロジックや、モデルと同じプロセスで実行する必要があるテストには、直接呼び出しを使用します。クライアントが Neat ランタイムにリンクする必要がない場合、または 1 つのプロセスで複数のモデルにリクエストをルーティングする必要がある場合は、サーバーを使用します。

次のステップ