Gemma4

未分類

【量子化の聖杯】Google Gemma 4 QAT公開!学習段階から4ビット化を織り込み、精度低下を「完全克服」したオンデバイスLLMの破壊的インパクトを解説

📝 本日のニュース概要 前日のGemma 4 12Bに続き、Google DeepMindがとんでもない爆弾を投下しました。事後量子化(PTQ)による精度低下に終止符を打つ、学習段階から4ビット化を織り込んだ「QAT(Quantizatio...
プログラミング

【衝撃】4BモデルがGPT-5超え!? コーディングエージェント「SmallCode」の知能密度がヤバすぎる

📝 本日のニュース概要 巨大LLMの時代は終わったのか?わずか4B(40億)パラメータの軽量モデルを使用しながら、コーディングベンチマークで87%という驚異的なスコアを叩き出したエージェント「SmallCode」がRedditで大炎上中。モ...
ローカルLLM

【衝撃】Qwen3.6がMTPで2.5倍速へ!RTX 3090で262k文脈を維持する「ローカル自律コーディング」の夜明け

📝 本日のニュース概要 Google Gemma 4の専売特許だったMTP(Multi-Token Prediction)が、ギークたちの手によってQwen 3.6へ電撃移植!シングルRTX 3090で256Kコンテキストを回しつつ、コーデ...
ハードウェア&インフラ

【Geek Terminal】RTX 5090 Blackwell真価発揮!Gemma 4 × NVFP4が叩き出す「爆速」の衝撃と、露呈した4bitの壁

📝 本日のニュース概要 2026年4月、ローカルLLM界隈はRTX 50シリーズ(Blackwell)のネイティブ4bit演算「NVFP4」の実装で沸騰しています。Gemma 4 26BをvLLMやllama.cppで動かした際の圧倒的なス...