LOCAL LLM MODELS
ローカルLLM の比較
ローカル環境の Mac で実際に動かして測った9モデルと、重みが公開されていてローカルでも動かせる31モデルの一覧です。必要メモリと速度が実測できているのは、実際に動かした9モデルだけです。
COMPARISON DATABASE
ローカルで実際に動かして測った9モデル
実測値です。並び順は指定した項目の降順であり、総合順位ではありません。項目ごとに得意・不得意が入れ替わります。
表の見方:モデル名をクリック → このサイトが実際に測った結果(35問の回答全文)↗ Hugging Face → 重み・ライセンス(別タブ)↗ OpenRouter → 価格・提供元(別タブ)ローカル / クラウド → どこで動かして測ったか
モデル名モデル名を選ぶと、このサイトが実際に測った結果(35問の回答全文・採点の理由)を開きます。右の小さなボタンは外部サイトへのリンクです。 | 提供元モデルを提供している組織・プロジェクトの表記です。 | 必要メモリメモリは扱う文章の長さ(文脈)でほぼ決まる。業務文書の要約なら 8K〜32K が目安。MacBook Pro(M5 Max・メモリ128GB)での実測値です。別の機械では変わります。 | 生成速度MacBook Pro(M5 Max・メモリ128GB)でOllamaを使い、毎秒生成できたトークン数です。別の機械では変わります。 | 規模公開情報にあるパラメータ数です。必要メモリや生成速度を直接示す値ではありません。 | 量子化モデルの重みを、ローカルで実行しやすい形式に圧縮する設定です。この表の手元モデルはすべてQ4_K_Mです。 | 答えられない質問への対応答えが存在しない5種類の質問を各9回試行し、正しく「確認が必要」と保留できた回数/取得できた試行回数です。 | 出典仕様の確認に使ったHugging Faceのモデルカードへのリンクです。 |
|---|---|---|---|---|---|---|---|
| LLM-jp(国立情報学研究所) | 文脈 8K: 22.2GB / 32K: 29.4GB 最大文脈(65,536トークン)で読み込んだ時: 37.4GB 機材判定・メモリ順の基準: 文脈32K: 29.4GB | 4.8 トークン/秒 | 33.2B | Q4_K_M | 18/45 | Hugging Face | |
| LLM-jp(国立情報学研究所) | 文脈 8K: 22.7GB / 32K: 29.2GB 最大文脈(65,536トークン)で読み込んだ時: 38.4GB 機材判定・メモリ順の基準: 文脈32K: 29.2GB | 5.9 トークン/秒 | 33.2B | Q4_K_M | 0/45 | Hugging Face | |
| rinna | 文脈 8K: 22.4GB / 32K: 28.9GB 最大文脈(32,768トークン)で読み込んだ時: 28.9GB 機材判定・メモリ順の基準: 文脈32K: 28.9GB | 4 トークン/秒 | 32.8B | Q4_K_M | 45/45 | Hugging Face | |
| LLM-jp(国立情報学研究所) | 文脈 8K: 22.2GB / 32K: 23.8GB 最大文脈(65,536トークン)で読み込んだ時: 26.4GB 機材判定・メモリ順の基準: 文脈32K: 23.8GB | 58.7 トークン/秒 | 32.1B | Q4_K_M | 9/45 | Hugging Face | |
| IBM | 文脈 8K: 6.9GB / 32K: 11.0GB 最大文脈(131,072トークン)で読み込んだ時: 27.7GB 機材判定・メモリ順の基準: 文脈32K: 11.0GB | 37.1 トークン/秒 | 8.8B | Q4_K_M | 27/45 | Hugging Face | |
| LLM-jp(国立情報学研究所) | 文脈 8K: 6.8GB / 32K: 10.1GB 最大文脈(65,536トークン)で読み込んだ時: 14.8GB 機材判定・メモリ順の基準: 文脈32K: 10.1GB | 39.7 トークン/秒 | 8.6B | Q4_K_M | 9/36 | Hugging Face | |
| 文脈 8K: 9.6GB / 32K: 9.9GB 最大文脈(131,072トークン)で読み込んだ時: 10.2GB 機材判定・メモリ順の基準: 文脈32K: 9.9GB | 50.6 トークン/秒 | 8.0B | Q4_K_M | 36/45 | Hugging Face | ||
LLM-jp-4 8B (thinking)ローカル↗ Hugging Face日本語特化 | LLM-jp(国立情報学研究所) | 文脈 8K: 6.6GB / 32K: 9.9GB 最大文脈(65,536トークン)で読み込んだ時: 14.6GB 機材判定・メモリ順の基準: 文脈32K: 9.9GB | 25.5 トークン/秒 | 8.6B | Q4_K_M | 0/45 | Hugging Face |
Llama-3-ELYZA-JP 8Bローカル↗ Hugging Face日本語特化 | ELYZA | 文脈 8K: 6.2GB / 32K: 非対応(最大 8K) 最大文脈(8,192トークン)で読み込んだ時: 6.2GB 機材判定・メモリ順の基準: 文脈8K: 6.2GB | 38.5 トークン/秒 | 8.0B | Q4_K_M | 0/45 | Hugging Face |
COMPARISON DATABASE
ローカルでも動かせるモデルの仕様
実測値です。並び順は指定した項目の降順であり、総合順位ではありません。項目ごとに得意・不得意が入れ替わります。
表の見方:モデル名をクリック → このサイトが実際に測った結果(35問の回答全文)↗ Hugging Face → 重み・ライセンス(別タブ)↗ OpenRouter → 価格・提供元(別タブ)ローカル / クラウド → どこで動かして測ったか
モデル名モデル名を選ぶと、このサイトが実際に測った結果(35問の回答全文・採点の理由)を開きます。右の小さなボタンは外部サイトへのリンクです。 | 提供元モデルを提供している組織・プロジェクトの表記です。 | 出所クラウドはOpenRouter API経由、ローカルはMacBook Pro M5 MaxでOllamaを使って測定したことを示します。2つの測定環境の数値は同列に扱いません。 | ライセンスモデルの重みや利用条件に関するライセンスです。 | 規模公開情報にあるパラメータ数です。必要メモリや生成速度を直接示す値ではありません。 | 文脈長一度の処理で参照できる入力と出力のテキスト量の上限です。トークン数で表記しています。 | 入力価格APIへ入力する100万トークン当たりの掲載価格です。 | 出力価格APIから出力される100万トークン当たりの掲載価格です。 | 入力データの学習利用APIへ送信した入力データが学習に使われるかを示す項目です。今回のモデルは未確認です。 | 出典仕様の確認に使ったHugging Faceのモデルカードへのリンクです。 | 取得日仕様・価格などの一次情報を確認した日です。業務日本語ベンチマークの測定日とは異なります。 |
|---|---|---|---|---|---|---|---|---|---|---|
| DeepSeek | クラウド(OpenRouter API) | MIT | 763.2B | 1,048,576トークン | $0.015 / 100万トークン | $0.75 / 100万トークン | 未確認 | 一次情報 | ||
| DeepSeek | クラウド(OpenRouter API) | MIT | 304.2B | 1,048,576トークン | $0.0115 / 100万トークン | $1.28 / 100万トークン | 未確認 | 一次情報 | ||
| DeepSeek | クラウド(OpenRouter API) | MIT | 1598.8B | 1,048,576トークン | $0.2088 / 100万トークン | $0.4176 / 100万トークン | 未確認 | 一次情報 | ||
| DeepSeek | クラウド(OpenRouter API) | MIT | 1650.5B | 1,048,576トークン | $1.32 / 100万トークン | $3.96 / 100万トークン | 未確認 | 一次情報 | ||
| クラウド(OpenRouter API) | Apache-2.0 | 31.3B | 262,144トークン | $0.09 / 100万トークン | $0.34 / 100万トークン | 未確認 | 一次情報 | |||
| ローカル(Ollama) | Apache-2.0 | 8.0B | 未確認 | 該当なし | 該当なし | 未確認 | 一次情報 | |||
| Z.ai | クラウド(OpenRouter API) | MIT | 753.3B | 1,048,576トークン | $0.41 / 100万トークン | $3.99 / 100万トークン | 未確認 | 一次情報 | ||
| Z.ai | クラウド(OpenRouter API) | glm-5.3 | 753.3B | 1,048,576トークン | $1.4 / 100万トークン | $4.4 / 100万トークン | 未確認 | 一次情報 | ||
| Z.ai | クラウド(OpenRouter API) | MIT | 321.3B | 1,048,576トークン | $0.15 / 100万トークン | $0.5 / 100万トークン | 未確認 | 一次情報 | ||
| OpenAI | クラウド(OpenRouter API) | Apache-2.0 | 116.8B | 131,072トークン | $0.037 / 100万トークン | $0.17 / 100万トークン | 未確認 | 一次情報 | ||
| OpenAI | クラウド(OpenRouter API) | Apache-2.0 | 20.9B | 131,072トークン | $0.018 / 100万トークン | $0.09 / 100万トークン | 未確認 | 一次情報 | ||
| IBM | クラウド(OpenRouter API) | Apache-2.0 | 8.8B | 131,072トークン | $0.06 / 100万トークン | $0.25 / 100万トークン | 未確認 | 一次情報 | ||
| IBM | ローカル(Ollama) | Apache-2.0 | 8.8B | 未確認 | 該当なし | 該当なし | 未確認 | 一次情報 | ||
| Tencent | クラウド(OpenRouter API) | Apache-2.0 | 780.0B | 1,048,576トークン | $0.834 / 100万トークン | $2.501 / 100万トークン | 未確認 | 一次情報 | ||
| MoonshotAI | クラウド(OpenRouter API) | modified-mit | 1026.9B | 262,144トークン | $0.6712 / 100万トークン | $3.35 / 100万トークン | 未確認 | 一次情報 | ||
| Poolside | クラウド(OpenRouter API) | openmdw-1.1 | 117.6B | 1,048,576トークン | $0.09 / 100万トークン | $0.18 / 100万トークン | 未確認 | 一次情報 | ||
| Meta | クラウド(OpenRouter API) | Llama 3.3 Community License | 70.6B | 131,072トークン | $0.1 / 100万トークン | $0.32 / 100万トークン | 未確認 | 一次情報 | ||
Llama-3-ELYZA-JP 8Bローカル↗ Hugging Face日本語特化 | ELYZA | ローカル(Ollama) | Llama 3 Community License | 8.0B | 未確認 | 該当なし | 該当なし | 未確認 | 一次情報 | |
| LLM-jp(国立情報学研究所) | ローカル(Ollama) | Apache-2.0 | 33.2B | 未確認 | 該当なし | 該当なし | 未確認 | 一次情報 | ||
| LLM-jp(国立情報学研究所) | ローカル(Ollama) | Apache-2.0 | 8.6B | 未確認 | 該当なし | 該当なし | 未確認 | 一次情報 | ||
| LLM-jp(国立情報学研究所) | ローカル(Ollama) | Apache-2.0 | 32.1B | 未確認 | 該当なし | 該当なし | 未確認 | 一次情報 | ||
| LLM-jp(国立情報学研究所) | ローカル(Ollama) | Apache-2.0 | 33.2B | 未確認 | 該当なし | 該当なし | 未確認 | 一次情報 | ||
LLM-jp-4 8B (thinking)ローカル↗ Hugging Face日本語特化 | LLM-jp(国立情報学研究所) | ローカル(Ollama) | Apache-2.0 | 8.6B | 未確認 | 該当なし | 該当なし | 未確認 | 一次情報 | |
| Xiaomi | クラウド(OpenRouter API) | MIT | 1024.2B | 1,050,000トークン | $0.435 / 100万トークン | $0.87 / 100万トークン | 未確認 | 一次情報 | ||
| MiniMax | クラウド(OpenRouter API) | minimax-community | 427.0B | 1,048,576トークン | $0.3 / 100万トークン | $1.2 / 100万トークン | 未確認 | 一次情報 | ||
| Mistral | クラウド(OpenRouter API) | Apache-2.0 | 8.9B | 262,144トークン | $0.15 / 100万トークン | $0.15 / 100万トークン | 未確認 | 一次情報 | ||
| Mistral | クラウド(OpenRouter API) | Apache-2.0 | 24.0B | 256,000トークン | $0.0938 / 100万トークン | $0.25 / 100万トークン | 未確認 | 一次情報 | ||
| rinna | ローカル(Ollama) | Apache-2.0 | 32.8B | 未確認 | 該当なし | 該当なし | 未確認 | 一次情報 | ||
| Qwen | クラウド(OpenRouter API) | 未確認 | 未確認 | 1,000,000トークン | $0.32 / 100万トークン | $1.28 / 100万トークン | 未確認 | 一次情報 | ||
| Qwen | クラウド(OpenRouter API) | Apache-2.0 | 27.8B | 1,000,000トークン | $0.42 / 100万トークン | $3.0 / 100万トークン | 未確認 | 一次情報 | ||
| Qwen | クラウド(OpenRouter API) | qwen-community-1.0 | 180.0B | 1,000,000トークン | $0.15 / 100万トークン | $0.47 / 100万トークン | 未確認 | 一次情報 |