MoE

AIツール&サービス

【geek-terminalニュース】DeepSeek V4 Pro 0813 API展開で揺れる推論インフラ戦争

📝 本日のニュース概要 以前お伝えしたDeepSeek APIコスト論とV4 Flash実務評価の続報です。OpenRouter上で話題化したDeepSeek V4 Pro 0813を起点に、1Mトークン文脈、MoE、APIルーティング、キ...
ローカルLLM

【geek-terminalニュース】Kimi K3量子化、711GBから478GBへ押し込むローカルLLM実測沼

📝 本日のニュース概要 以前お伝えしたKimi K3ローカル実行の続報です。今回はKimi K3の重み公開そのものではなく、Unsloth IQ2-XXS量子化で711GB級から478GB級へ縮め、実機構成とベンチでどこまで現実のマシンに押...
ローカルLLM

【geek-terminalニュース】DeepSeek V4 Flash 0731の癖評価、ARC-AGI高得点と実運用の不安定さが同時に燃える

📝 本日のニュース概要 以前お伝えしたDeepSeek V4 Flash低価格推論・ローカル実行の続報です。今回はベンチ順位ではなく、ARC-AGI、コーディング、非コーディング、ツール呼び出し、KV cache量子化、キャッシュ設計で挙動...
商用巨大LLM

【geek-terminalニュース】ByteDance 10兆パラメータ級AIモデル訓練報道の最新情報

📝 本日のニュース概要 以前お伝えしたQwen3.8-MaxやKimi K3など兆級MoE競争の続報です。ByteDanceが最大10兆パラメータ級のAIモデルを訓練していると報じられ、中国フロンティアAI競争はモデルサイズ、MoE設計、訓...
ローカルLLM

【geek-terminalニュース】DeepSeek V4 Flash実測、284B MoEを“手元で動かす”時代の最新情報

📝 本日のニュース概要 以前お伝えしたDeepSeek V4 Flash 0731更新の続報です。今回は重み公開やAPI価格ではなく、284B MoEを単一MI300Xやローカル環境でどこまで動かせるのかという実測・運用限界・低コスト推論の...
ローカルLLM

【geek-terminalニュース】Qwen3.8追加サイズ展開でローカルLLM勢が再燃

📝 本日のニュース概要 以前お伝えしたQwen3.8-Max本体発表の続報です。今回は2.4兆パラメータ級の看板モデルではなく、ローカル勢が実際に触れる可能性のある追加サイズ展開、27B級モデル、オープンウェイト予定、MoE巨大化競争が手元...
ローカルLLM

【geek-terminalニュース】Qwen3.8-Maxと27Bローカル期待の最新情報

📝 本日のニュース概要 AlibabaのQwen3.8-Max発表と、Qwen3.8-27BをめぐるローカルLLM勢の熱狂を整理。2.4兆パラメータMoE、100万トークン文脈、オープンウェイト予定、VRAM見積もり、量子化待ちの現場感まで...
ローカルLLM

【geek-terminalニュース】Kimi K3を29GB RAMで動かすWASTE疑惑、LocalLLaMAがまた限界突破へ

📝 本日のニュース概要 以前お伝えしたKimi K3重み公開・分散推論の続報です。今回は2.8T級MoEを29GB RAMで動かすとされるWeight-Aware Streaming Tensor Engine、通称WASTEを深掘りします...
ローカルLLM

DeepSeek V4 Flash 0731で価格性能比が再崩壊か

📝 本日のニュース概要 以前お伝えしたDeepSeek V4 Flashと低価格推論競争の続報です。0731更新、重み公開、API公開ベータ、Artificial Analysisのベンチ、GPT-5.6 Luna比の価格性能まで、ローカル...
ローカルLLM

【geek-terminalニュース】Kimi K3実機祭り、80枚RTX 5090報告とAgentENV公開で巨大MoEが手元インフラ案件へ

📝 本日のニュース概要 以前お伝えしたKimi K3重み公開・VRAM論の続報です。今回は配布可否ではなく、2.8T級MoEを80×RTX 5090で動かしたというReddit発の実機報告、Kimi Delta AttentionやStab...