VLM選び

自分の場合、クラウドで使うにしても結局閉じられた空間で利用する場合は32B以下になるので現時点ではLLMと同じ傾向ですね。Qwen3.XかGemma4とあとはOrnith-1.0-35Bかなと。

まずは今年のモデルから本格的にマルチモーダル対応になって本格的に評価し始めたのですがVLM系もLLM系と同じようにプロンプトエンジニアリング的に指示を出さなくてもグラフの解読(分析)はできるようです。

現在はとりあえず100パターンの観測波形でQwen、GemmaのDense、MoEおよびQwenはthink/no thinkの6パターンでの比較評価まではやりきろうと思っています。これが終わったらQwen系は最新版に置き換えという感じで3.8 27BとOrnith 35で評価すべきなのかなと思っています。


いいなと思ったら応援しよう!