MoE

ローカルLLM

【geek-terminalニュース】DeepSeek V4.1 Flashで1M文脈とFP4 KV Cacheが来た件

📝 本日のニュース概要 DeepSeek V4.1 Flashを、単なる新モデルではなく長時間エージェントの記憶コストを変える推論ランタイム部品として深掘りします。1Mコンテキスト、FP4 KV Cache、Cross-Layer Atte...
ローカルLLM

【geek-terminalニュース】Qwen3.8-Flash-Next実測祭り、Mac最適化とGLM比較の最新情報

📝 本日のニュース概要 以前お伝えしたQwen3.8-Flash-Next疑惑の続報です。今回は公式ベンチではなく、LocalLLaMA周辺で共有されているMac実測、大容量RAM、N-gramオフロード、GLM-5.3-Flash比較、そ...
ローカルLLM

【geek-terminalニュース】Z.ai GLM-5.3本体がHugging Faceで公開、ローカルLLM勢のモデル選定表がまた揺れる

📝 本日のニュース概要 以前お伝えしたGLM-5.3-Flash公開の続報です。今回はZ.ai公式Hugging Faceに登場したGLM-5.3本体のオープンウェイト化を、Flashとの違い、753B規模、vLLM/SGLang/Tran...
ローカルLLM

【geek-terminalニュース】Qwen3.8-Flash-Next疑惑、125B MoEなのに6B activeというQwen4先出し級アーキテクチャの最新情報

📝 本日のニュース概要 以前お伝えしたQwen3.8-27B評価の続報です。今回は、Qwen3.8-Flash-Nextと呼ばれる125B MoE・6B active・マルチモーダル・Qwen4アーキテクチャ先行プレビュー疑惑を、公式確認済...
ローカルLLM

【geek-terminalニュース】Ox Alpha=GLM-5.3-Flash確認騒動と低単価フロンティア推論の最新情報

📝 本日のニュース概要 以前お伝えした低価格Flash戦略の続報です。OpenRouter上の謎モデルOx AlphaとZ.aiのGLM-5.3-Flashをめぐる確認・同定騒動、Hugging Face公開、320B総パラメータ・18Bア...
ローカルLLM

【geek-terminalニュース】DeepSeek V4 Flash Vision Expの噂で画像理解コスト再計算へ

📝 本日のニュース概要 以前お伝えしたDeepSeek V4 Flashの続報です。今回は、コミュニティで話題化しているVision対応Flashモデル疑惑を、公式確認済みのDeepSeek-VL情報と切り分けながら、低コストAPI、ローカ...
ローカルLLM

【geek-terminalニュース】Qwen3.8 35B-A3B、開発者コメントで待望論が再燃

📝 本日のニュース概要 以前お伝えしたQwen3.8-27B FP8公開・ローカル実行評価の続報です。今回はまだ正式リリースされていないMoE構成モデル『Qwen3.8 35B-A3B』を巡る動きに焦点を当てます。r/LocalLLaMAで...
ローカルLLM

【geek-terminalニュース】Qwen3.8拡散、27Bローカル実用圏と35B-A3B観測の最新情報

📝 本日のニュース概要 以前お伝えしたQwen3.8-27B FP8公開の続報です。今回は27B単体ではなく、r/LocalLLaMAでの複数スレッド、35B-A3Bらしきモデルの観測、The Decoder報道まで含め、ローカルLLM界隈...
ローカルLLM

【geek-terminalニュース】Qwen3.8拡散、27Bローカル実用圏と35B-A3B観測の最新情報

📝 本日のニュース概要 以前お伝えしたQwen3.8-27B FP8公開の続報です。今回は27B単体ではなく、r/LocalLLaMAでの複数スレッド、35B-A3Bらしきモデルの観測、The Decoder報道まで含め、ローカルLLM界隈...
ローカルLLM

【geek-terminalニュース】Qwen3.8-2.4T-A95Bオープンウェイト化、巨大MoEの実機攻略戦が始まる

📝 本日のニュース概要 以前お伝えしたQwen3.8-Maxと巨大MoE競争の続報。Qwen3.8-2.4T-A95Bの公開で、LocalLLaMA界隈はベンチ順位よりも量子化、VRAM、SSDオフロード、27B派生モデルへの期待で沸騰して...