llama.cpp で GPU 2台構成で性能向上
CUDA13で確認。GPU2台で利用している場合、 –split-mode tensor を使えば分散が2倍近く高速になる。gemma 4-31b で利用したところ、デフォルト( –split-m… Read more ›
CUDA13で確認。GPU2台で利用している場合、 –split-mode tensor を使えば分散が2倍近く高速になる。gemma 4-31b で利用したところ、デフォルト( –split-m… Read more ›
GPUを交換した後、PCの起動が遅い。ログオン画面までに1-2分かかるようになった。解決までの備忘録。 TL;DR “NVIDIA LocalSystem Container” サービスのエラーが… Read more ›