ローカルLLM GPU・VRAM計算機

モデルとGPUを選ぶと、4bit・8bit・FP16ごとの生成速度、初回応答、必要メモリを比較できます。登録は不要です。

モデル

GPU構成

選択中GeForce RTX 4090

GB
GB/s
入力・コンテキスト任意
tokens
tokens

量子化別比較

モデルとGPUを選び、「計算する」を押してください。