公開中のカタログを、その場で集計しています
現在は11系列・104モデル、14グループ・105GPUを収録しています。このページの件数は紹介文へ手入力せず、計算機と同じデータから生成しています。
このレポートで確認できること
- モデル
- 87件のモデル別公開資料を参照。うち62件はKVキャッシュの構造別計算に対応し、42件は重み中心の限定表示です。
- GPU
- 52件のメーカー資料を参照。51件は比較可能な演算値を収録し、それ以外は容量・帯域を中心に扱います。
- 確認日
- 2026-07-29(日本時間)
- レポート更新
- 2026-08-13(日本時間)
- 実機検証
- 未実施です。メーカー・モデル公開元の資料と公開ベンチマークによる計算検証であり、各組み合わせの動作保証ではありません。
モデル系列ごとの収録状況
「構造確認済み」は、層数、attention head、KV head、head dimensionとKV配置を公開設定から確認し、モデル固有のKVキャッシュ式へ渡せるモデルです。特殊なMoE、MLA、recurrent・linear attention等は、構造を標準式へ無理に当てはめません。
| 比較軸 | 収録数 | 構造確認済み | パラメータ範囲 | 資料例 |
|---|---|---|---|---|
| Qwen | 25件 | 14件 | 0.49〜403.4 B | 公開元の設定 |
| Llama | 13件 | 11件 | 1.24〜405.9 B | 公開元の設定 |
| Gemma | 17件 | 9件 | 0.27〜30.7 B | 公開元の設定 |
| DeepSeek | 14件 | 6件 | 1.78〜1,600 B | 公開元の設定 |
| Mistral | 14件 | 3件 | 3.85〜675 B | 公開元の設定 |
| Phi | 6件 | 6件 | 3.82〜14.7 B | 公開元の設定 |
| gpt-oss | 2件 | 0件 | 21〜117 B | 公開元の設定 |
| SmolLM2 | 3件 | 3件 | 0.13〜1.71 B | 公開元の設定 |
| Granite | 2件 | 2件 | 2.53〜8.17 B | 公開元の設定 |
| OLMo | 4件 | 4件 | 1.48〜32.2 B | 公開元の設定 |
| Falcon | 4件 | 4件 | 1.67〜10.3 B | 公開元の設定 |
表は横方向にスクロールできます。
GPUメーカーごとの収録状況
VRAMと物理メモリ帯域はメーカー公称値を使います。キャッシュを加味した「実効帯域」は混ぜません。比較可能なdense BF16/FP16演算値が公開されていないGPUは、演算律速の速度を算出しません。
| 比較軸 | 収録数 | VRAM範囲 | 帯域範囲 | 演算値あり | 資料例 |
|---|---|---|---|---|---|
| NVIDIA | 65件 | 6〜288 GB | 168〜8,000 GB/s | 35件 | メーカー資料 |
| AMD | 28件 | 8〜48 GB | 288〜960 GB/s | 16件 | メーカー資料 |
| Intel | 12件 | 4〜32 GB | 124〜608 GB/s | 0件 | メーカー資料 |
表は横方向にスクロールできます。
計算に使う情報と、使わない情報
- モデル重みは総パラメータ数と量子化形式、KVキャッシュは構造確認済みモデルだけモデル固有式で計算します。
- GPU側はVRAM、物理メモリ帯域、比較可能な演算値、公開ベンチマークから得た利用率の範囲を使います。
- 販売価格、在庫、レビュー点数、アフィリエイト報酬率は、必要VRAMと生成速度の計算に使いません。
- VRAMを超えた場合はCPUオフロードの成功や速度を仮定せず、速度を算出しません。
画面での確認方法
トップの計算結果で「詳しい内訳と根拠」を開くと、選択したモデルとGPUの確認日、資料リンク、推定区分を確認できます。式、固定係数、公開ベンチマークによる検算は計算方法と根拠に分けて掲載しています。
このレポートの限界
件数の多さは精度を意味しません。推論エンジン、ドライバー、量子化実装、冷却、電力制限、コンテキスト、同時利用で実測は変わります。構造未確認または比較可能な仕様がない場合は、推測値を補わず「算出しない」範囲を残します。
