Google、Gemma 3 QATモデルを発表:RTX 3090 1枚でも容易に実行可能
Googleは最近、Gemma3シリーズの新しいバージョンを発表し、多くのAI愛好家を興奮させました。リリースからわずか1ヶ月後、Googleはメモリ要求を大幅に削減しながらモデルの高品質を維持することを目的とした、量子化感知訓練(QAT)で最適化されたGemma3を発表しました。具体的には、QATで最適化されたGemma3 27Bモデルは、メモリ要求が54GBから14.1GBに大幅に削減され、NVIDIA RTX 3090で実行できるようになりました。