公開中のカタログを、その場で集計しています

現在は11系列・104モデル、14グループ・105GPUを収録しています。このページの件数は紹介文へ手入力せず、計算機と同じデータから生成しています。

このレポートで確認できること

モデル
87件のモデル別公開資料を参照。うち62件はKVキャッシュの構造別計算に対応し、42件は重み中心の限定表示です。
GPU
52件のメーカー資料を参照。51件は比較可能な演算値を収録し、それ以外は容量・帯域を中心に扱います。
確認日
2026-07-29(日本時間)
レポート更新
2026-08-13(日本時間)
実機検証
未実施です。メーカー・モデル公開元の資料と公開ベンチマークによる計算検証であり、各組み合わせの動作保証ではありません。

モデル系列ごとの収録状況

「構造確認済み」は、層数、attention head、KV head、head dimensionとKV配置を公開設定から確認し、モデル固有のKVキャッシュ式へ渡せるモデルです。特殊なMoE、MLA、recurrent・linear attention等は、構造を標準式へ無理に当てはめません。

計算機に収録するモデル系列の内訳
比較軸収録数構造確認済みパラメータ範囲資料例
Qwen25件14件0.49〜403.4 B公開元の設定
Llama13件11件1.24〜405.9 B公開元の設定
Gemma17件9件0.27〜30.7 B公開元の設定
DeepSeek14件6件1.78〜1,600 B公開元の設定
Mistral14件3件3.85〜675 B公開元の設定
Phi6件6件3.82〜14.7 B公開元の設定
gpt-oss2件0件21〜117 B公開元の設定
SmolLM23件3件0.13〜1.71 B公開元の設定
Granite2件2件2.53〜8.17 B公開元の設定
OLMo4件4件1.48〜32.2 B公開元の設定
Falcon4件4件1.67〜10.3 B公開元の設定

表は横方向にスクロールできます。

GPUメーカーごとの収録状況

VRAMと物理メモリ帯域はメーカー公称値を使います。キャッシュを加味した「実効帯域」は混ぜません。比較可能なdense BF16/FP16演算値が公開されていないGPUは、演算律速の速度を算出しません。

計算機に収録するGPUの内訳
比較軸収録数VRAM範囲帯域範囲演算値あり資料例
NVIDIA65件6〜288 GB168〜8,000 GB/s35件メーカー資料
AMD28件8〜48 GB288〜960 GB/s16件メーカー資料
Intel12件4〜32 GB124〜608 GB/s0件メーカー資料

表は横方向にスクロールできます。

計算に使う情報と、使わない情報

  • モデル重みは総パラメータ数と量子化形式、KVキャッシュは構造確認済みモデルだけモデル固有式で計算します。
  • GPU側はVRAM、物理メモリ帯域、比較可能な演算値、公開ベンチマークから得た利用率の範囲を使います。
  • 販売価格、在庫、レビュー点数、アフィリエイト報酬率は、必要VRAMと生成速度の計算に使いません。
  • VRAMを超えた場合はCPUオフロードの成功や速度を仮定せず、速度を算出しません。

画面での確認方法

トップの計算結果で「詳しい内訳と根拠」を開くと、選択したモデルとGPUの確認日、資料リンク、推定区分を確認できます。式、固定係数、公開ベンチマークによる検算は計算方法と根拠に分けて掲載しています。

このレポートの限界

件数の多さは精度を意味しません。推論エンジン、ドライバー、量子化実装、冷却、電力制限、コンテキスト、同時利用で実測は変わります。構造未確認または比較可能な仕様がない場合は、推測値を補わず「算出しない」範囲を残します。