【今度はちゃんと動いた】Gemma4 12Bを使ってみた話②【RTX5060ti】
はじめに
前回のつづきです。
LM Studioランタイムアップデートがあり、Gemma4 12BのLM Studio公式モデル(Staffピックモデル)が動作するようになりました。

環境と設定
LM Studio環境で確認します。
Windows 11 Pro
Ryzen5 3600 64GB(DDR4-3200)
NVIDIA RTX5060ti 16GB


動作確認
パフォーマンス
簡単な文章を生成します。

コンテキストをMAXまで填めます。(小説・銀河鉄道の夜を何度も要約&コピペ)

性能
論理問題


正解です。36.58 token/s
東大入試(文系)数学問題


37.3 token/s
ミニゲーム生成

37.4 token/s

※ ゲーム等のテストプロンプトは下記事に記載しています。
Vision機能の動作確認

まとめ
性能は、公式解説によるとE4B以上、26B以下という事ですが、26Bでも上手くCPUオフロード調整すれば、MoEアーキテクチャなので、128kコンテキストサイズで20〜40 token/s程度は出ます。
単純なテキスト生成用途であれば、12Bの利点は少ないかもしれません。
以下、関連する記事の【PR】です。
