MoE

ローカルLLM

【geek-terminalニュース】Kimi K3重み公開でローカルLLM勢がVRAM戦争へ突入

📝 本日のニュース概要 以前お伝えしたKimi K3と中国オープンウェイトAI論争の続報です。今回は政策論ではなく、Kimi K3のweights公開を受けて、実際に手元で動くのか、A100/H200級GPUが何枚必要なのか、Hugging...
ローカルLLM

【geek-terminalニュース】Qwen3.8予告、VRAMとFable 5対抗でローカルLLM勢がざわつく最新情報

📝 本日のニュース概要 Alibaba Qwen3.8 Max Previewの予告とopen-weight化の話題を、Claude Fable 5、Kimi K3、VRAM要求、MoE設計、Redditの反応から深掘りします。 以前お伝え...
ローカルLLM

【geek-terminalニュース】巨大MoE戦争の最新情報

📝 本日のニュース概要 Kimi K3、DeepSeek V4 Pro、GLM-5.2がベンチマーク、蒸留疑惑、ライセンス、サービングコストで同じ土俵に乗り始めた巨大MoE戦争を深掘り。オープンウェイト陣営の勢力図がどう組み替わるのかを整理...
ローカルLLM

【geek-terminalニュース】Kimi K3参戦、2.8T級MoEと1M contextがオープンウェイト最前線を押し広げる

📝 本日のニュース概要 以前お伝えしたKimi K3の続報です。Moonshot AIの2.8兆パラメータ級open-weight MoE、1Mトークン文脈、Kimi Delta Attention、Artificial Analysis上...
ローカルLLM

【geek-terminalニュース】Thinking Machines初のオープンウェイトモデルInkling公開の最新情報

📝 本日のニュース概要 Thinking Machines Labが初のオープンウェイト基盤モデルInklingを公開。975B total/41B activeのMoE、1Mトークン文脈、マルチモーダル対応、Tinkerでの微調整、そして...
ハードウェア&インフラ

【geek-terminalニュース】Apple M7 Ultra 1.5TB統一メモリ噂の最新情報

📝 本日のニュース概要 以前お伝えしたApple Siliconの統一メモリ問題の続報です。Apple M7 Ultraが最大1.5TBのRAMをサポートする可能性が報じられ、ローカルLLM界隈ではGPU枚数ではなく巨大ユニファイドメモリ箱...
ローカルLLM

【geek-terminalニュース】744B MoEを25GB RAMで動かす?ローカルLLM省メモリ限界突破ログ

📝 本日のニュース概要 以前お伝えしたPuzzle-75BやMiniMax巨大MoEの続報です。今回はGLM-5.2 744B MoEを消費者環境で動かす省メモリ実装、Qwen3.6 NVFP4/Unsloth量子化、speculative...
ローカルLLM

【geek-terminalニュース】NVIDIA Puzzle-75B-A9B、75B級MoEをローカルGPU圏内へ押し込む最新情報

📝 本日のニュース概要 NVIDIAのNemotron-Labs-3-Puzzle-75B-A9Bを深掘り。Nemotron-3-Super由来の圧縮ハイブリッドMoE、Iterative Puzzle、NVFP4、そしてRedditで話題...
ローカルLLM

【geek-terminalニュース】MiniMax 2.7兆パラメータ級オープンモデル計画の最新情報

📝 本日のニュース概要 MiniMaxが2.7兆パラメータ規模のLLMを開発中で、2026年後半にもオープンウェイト/オープンソース公開を計画していると報じられました。MoE、active params、量子化、配布、ローカル推論の限界まで...
ハードウェア&インフラ

【geek-terminalニュース】LongCat-2.0公開、“NVIDIAなし巨大MoE”がAIインフラ競争を揺らす最新情報

📝 本日のニュース概要 Meituanが公開したLongCat-2.0を深掘り。1.6T総パラメータ、約48Bアクティブ、35T tokens超、AI ASIC superpods、1M contextという公式情報を軸に、“NVIDIAな...