ツール一覧に戻る
Gemma 4 31B
Gemma 4 31BはGoogleの最新のオープン密結合マルチモーダルモデルで、高速かつ高品質な推論を求める開発者に効率的な文章・画像生成を提供します。
ツール概要
Gemma 4 31Bは、DeepMindのフラッグシップオープンモデルの中で最大の密結合モデルです。画像とテキストをネイティブに処理し、Cerebras Cloud上では1,800 tokens/s超の高速推論を実現します。Apache 2.0ライセンスで提供され、商用利用、改変、再配布が自由です。
パラメーター効率が非常に高く、31Bでありながら数学やコードのベンチマークでかつての200B+モデルに匹敵する性能を示します。同規模のモデルと比較して、必要トークン数が約5分の1と少なく、より短く明確な回答を高速に返します。
主な制約は31Bという上限で、複雑なエージェント的な長期計画タスクではより大規模なモデルに劣る可能性があります。蒸留に関する詳細は公開されておらず、モデル性能の上限を完全には評価できません。ローカル展開には32GB以上のVRAMまたはユニファイドメモリが必要で、新規に組むデスクトップ(RTX 5090 32G)は約42万円、MacBook Air M5 32GBは約13万円程度です。量子化後は約20GBの空き容量が必要です。
ローカルで低レイテンシ・高品質な推論を求める開発者や研究者、特にプログラミング支援や数学タスクに適しています。超大規模モデルによる自律的な長期作業や、クリエイティブな画像生成が最優先される用途には向いていません。