ローカルLLM

ローカルLLM

【geek-terminalニュース】Qwen3.8-Flash-Next実測祭り、Mac最適化とGLM比較の最新情報

📝 本日のニュース概要 以前お伝えしたQwen3.8-Flash-Next疑惑の続報です。今回は公式ベンチではなく、LocalLLaMA周辺で共有されているMac実測、大容量RAM、N-gramオフロード、GLM-5.3-Flash比較、そ...
ローカルLLM

【geek-terminalニュース】Z.ai GLM-5.3本体がHugging Faceで公開、ローカルLLM勢のモデル選定表がまた揺れる

📝 本日のニュース概要 以前お伝えしたGLM-5.3-Flash公開の続報です。今回はZ.ai公式Hugging Faceに登場したGLM-5.3本体のオープンウェイト化を、Flashとの違い、753B規模、vLLM/SGLang/Tran...
ローカルLLM

【geek-terminalニュース】Qwen3.8-Flash-Next疑惑、125B MoEなのに6B activeというQwen4先出し級アーキテクチャの最新情報

📝 本日のニュース概要 以前お伝えしたQwen3.8-27B評価の続報です。今回は、Qwen3.8-Flash-Nextと呼ばれる125B MoE・6B active・マルチモーダル・Qwen4アーキテクチャ先行プレビュー疑惑を、公式確認済...
ローカルLLM

【geek-terminalニュース】Ox Alpha=GLM-5.3-Flash確認騒動と低単価フロンティア推論の最新情報

📝 本日のニュース概要 以前お伝えした低価格Flash戦略の続報です。OpenRouter上の謎モデルOx AlphaとZ.aiのGLM-5.3-Flashをめぐる確認・同定騒動、Hugging Face公開、320B総パラメータ・18Bア...
ローカルLLM

【geek-terminalニュース】IBM Granite 4.2、企業向けオープンウェイトLLMに推論とエージェント能力を載せる

📝 本日のニュース概要 IBM Granite 4.2をめぐる報道とコミュニティ反応を整理。Apache 2.0、ローカルLLM、agentic RL、VRAM、ベンチマーク論争まで深掘りします。 【事象の全貌と背景】IBMのGranite...
ローカルLLM

【geek-terminalニュース】Apple M6/M5 Ultra MacがローカルLLM箱として刺さる理由

📝 本日のニュース概要 以前お伝えしたApple SiliconのローカルLLM機材論の続報です。AppleがM6、M5 Ultra、新Mac Studio、新Mac miniを発表し、コミュニティではGPUカードではなく大容量ユニファイド...
ローカルLLM

【geek-terminalニュース】Qwen3.8-27B量子化実測とCode Arena上位入り疑惑、LocalLLaMAが沸騰

📝 本日のニュース概要 以前お伝えしたQwen3.8-27B評価の続報です。今回はReddit / r/LocalLLaMAで話題化した量子化比較、reasoning_effort設定、Code Arena 9位報告を、公式確認済み情報とコ...
ローカルLLM

【geek-terminalニュース】DeepSeek V4 Flash Vision Expの噂で画像理解コスト再計算へ

📝 本日のニュース概要 以前お伝えしたDeepSeek V4 Flashの続報です。今回は、コミュニティで話題化しているVision対応Flashモデル疑惑を、公式確認済みのDeepSeek-VL情報と切り分けながら、低コストAPI、ローカ...
ローカルLLM

【geek-terminalニュース】LFM2.5-DSpark、最大3.18倍高速デコードの最新情報

📝 本日のニュース概要 Liquid AIのLFM2.5向けDSpark draft modelが、投機的デコードで最大3.18倍の高速化をうたっています。モデルの賢さを上げる話ではなく、出力品質を維持したままレイテンシと推論コストを削る、...
ローカルLLM

【geek-terminalニュース】GLM-5.3がベンチマーク首位も重み公開延期、ローカルLLM勢は指をくわえて待つのみ

📝 本日のニュース概要 以前お伝えしたGLM-5.3(2026/08/15)の続報です。Z.aiのGLM-5.3がArtificial Analysis関連の評価でオープンモデル首位級の結果を見せつつ、肝心のモデル重み公開は約2週間延期され...