【質問&回答】LLMをオフラインで実行する方法
16:02
253再生
1. はじめに
1.1 質問
「プロンプトを知られたくない、トレーニングに使われたくない。LLMをオフラインで実行したい!」
1.2 解決策
【オフライン環境】でLLMを実行する方法として、プログラミング不要で無料の「LM Studio(エルエムスタジオ)」を紹介します。
2. LM Studioを使ったオフラインLLM実行
2.1 LM Studioとは
・オープンソースのLLMをローカル環境で実行するためのアプリケーション
・Windows、Mac、Linuxに対応
・LLMをAPI経由で外部アプリケーションから利用可能にする機能も搭載
2.2 LM Studioのインストール
・LM Studioの公式サイトから、OSに合ったバージョンをダウンロードし、インストール
https://lmstudio.ai/
2.3 実行ステップ
・モデルの選択
・ローカルマシンへのダウンロード
・ダウンロードしたモデルのロード
・会話ウィンドウでの会話開始
3. モデルの選択とダウンロード
3.1 モデル選択画面
LM Studio起動時に表示されるモデル選択画面で、モデル名を検索しダウンロード
3.2 モデル選択の注意点
・LLMの動作には、ローカルマシンのハードウェアスペックが影響
・特にGPUの有無とメモリの大きさが重要
3.3 パラメータ数とPCスペックの関係
・LLMの性能はパラメータ数で表され、数が多いほど高性能ですが、より高いPCスペックが必要
・パラメータ数の単位は、例えば7B=70億個
3.4 PCスペックの確認方法
LM Studioの画面左にあるアイコンから「ディスカバー(Discover)」を選択し、「ハードウェア(Hardware)」項目でGPUの有無とメモリサイズ(RAM)を確認
3.5 推奨モデル
一般的なオフィス用ノートパソコン(GPUなし、メモリ16GB)での推奨モデルを紹介します。
・Qwen(クウェン)-7B:日本語の自然さ、速度ともにバランスが良いモデルです。
・Llama(ラマ)3 2-3B:8GBまたは4GBのメモリでも動作
・Microsoft Phi(マイクロソフト ファイ)3.1 128k:非常に軽量で、4GBメモリでも動作
4. モデルのロードと会話
4.1 モデルのロード
・LM Studioの画面左にある「チャット(Chat)」を選択し、チャット画面上部の「SELECT MODEL TO LOAD」からダウンロードしたモデルを選択し、「ロードモデル(Load Model)」をクリックします。
4.2 会話の開始
・ロード完了後、画面下のプロンプト入力ボックスにテキストを入力し、会話を開始
・オフライン環境でのLLM実行のため、インターネット接続は不要
1.1 質問
「プロンプトを知られたくない、トレーニングに使われたくない。LLMをオフラインで実行したい!」
1.2 解決策
【オフライン環境】でLLMを実行する方法として、プログラミング不要で無料の「LM Studio(エルエムスタジオ)」を紹介します。
2. LM Studioを使ったオフラインLLM実行
2.1 LM Studioとは
・オープンソースのLLMをローカル環境で実行するためのアプリケーション
・Windows、Mac、Linuxに対応
・LLMをAPI経由で外部アプリケーションから利用可能にする機能も搭載
2.2 LM Studioのインストール
・LM Studioの公式サイトから、OSに合ったバージョンをダウンロードし、インストール
https://lmstudio.ai/
2.3 実行ステップ
・モデルの選択
・ローカルマシンへのダウンロード
・ダウンロードしたモデルのロード
・会話ウィンドウでの会話開始
3. モデルの選択とダウンロード
3.1 モデル選択画面
LM Studio起動時に表示されるモデル選択画面で、モデル名を検索しダウンロード
3.2 モデル選択の注意点
・LLMの動作には、ローカルマシンのハードウェアスペックが影響
・特にGPUの有無とメモリの大きさが重要
3.3 パラメータ数とPCスペックの関係
・LLMの性能はパラメータ数で表され、数が多いほど高性能ですが、より高いPCスペックが必要
・パラメータ数の単位は、例えば7B=70億個
3.4 PCスペックの確認方法
LM Studioの画面左にあるアイコンから「ディスカバー(Discover)」を選択し、「ハードウェア(Hardware)」項目でGPUの有無とメモリサイズ(RAM)を確認
3.5 推奨モデル
一般的なオフィス用ノートパソコン(GPUなし、メモリ16GB)での推奨モデルを紹介します。
・Qwen(クウェン)-7B:日本語の自然さ、速度ともにバランスが良いモデルです。
・Llama(ラマ)3 2-3B:8GBまたは4GBのメモリでも動作
・Microsoft Phi(マイクロソフト ファイ)3.1 128k:非常に軽量で、4GBメモリでも動作
4. モデルのロードと会話
4.1 モデルのロード
・LM Studioの画面左にある「チャット(Chat)」を選択し、チャット画面上部の「SELECT MODEL TO LOAD」からダウンロードしたモデルを選択し、「ロードモデル(Load Model)」をクリックします。
4.2 会話の開始
・ロード完了後、画面下のプロンプト入力ボックスにテキストを入力し、会話を開始
・オフライン環境でのLLM実行のため、インターネット接続は不要
生成AIビジネスで、第二の人生を切り拓く🚀現役アメリカ在住エンジニアが贈る生成AIインスピレーション💡
Mamoru@元大阪大学准教授-アメリカ大手AIチップ製造企業エンジニア
- 01:261.
はじめにー「オフラインでLLMを利用したい!」
- 02:052.
「LM Studio」をインストールする
- 01:093.
言語モデルの選定~ロード~会話実行の流れ
- 08:254.
パソコンのスペックに応じたお勧めの3つの言語モデル
- 01:495.
言語モデルのロードと会話の実行方法
- 01:106.
さいごに
コメント

感想・質問・応援メッセージを書こう
Zenta
2025年2月25日
実際にダウンロードして、自分でできるのは先の話になると思いますが、今日の話でイメージがよくわかりました。ありがとうございました。
