ローカルLLM

ローカルLLM

【geek-terminalニュース】DeepSeek V4 Flash Vision Expの噂で画像理解コスト再計算へ

📝 本日のニュース概要 以前お伝えしたDeepSeek V4 Flashの続報です。今回は、コミュニティで話題化しているVision対応Flashモデル疑惑を、公式確認済みのDeepSeek-VL情報と切り分けながら、低コストAPI、ローカ...
ローカルLLM

【geek-terminalニュース】LFM2.5-DSpark、最大3.18倍高速デコードの最新情報

📝 本日のニュース概要 Liquid AIのLFM2.5向けDSpark draft modelが、投機的デコードで最大3.18倍の高速化をうたっています。モデルの賢さを上げる話ではなく、出力品質を維持したままレイテンシと推論コストを削る、...
ローカルLLM

【geek-terminalニュース】GLM-5.3がベンチマーク首位も重み公開延期、ローカルLLM勢は指をくわえて待つのみ

📝 本日のニュース概要 以前お伝えしたGLM-5.3(2026/08/15)の続報です。Z.aiのGLM-5.3がArtificial Analysis関連の評価でオープンモデル首位級の結果を見せつつ、肝心のモデル重み公開は約2週間延期され...
ローカルLLM

【geek-terminalニュース】GLM-5.3がベンチマーク首位も重み公開延期、ローカルLLM勢は指をくわえて待つのみ

📝 本日のニュース概要 以前お伝えしたGLM-5.3(2026/08/15)の続報です。Z.aiのGLM-5.3がArtificial Analysis関連の評価でオープンモデル首位級の結果を見せつつ、肝心のモデル重み公開は約2週間延期され...
ローカルLLM

【geek-terminalニュース】Qwen3.8 35B-A3B、開発者コメントで待望論が再燃

📝 本日のニュース概要 以前お伝えしたQwen3.8-27B FP8公開・ローカル実行評価の続報です。今回はまだ正式リリースされていないMoE構成モデル『Qwen3.8 35B-A3B』を巡る動きに焦点を当てます。r/LocalLLaMAで...
ローカルLLM

【geek-terminalニュース】RTX3060を4枚束ねてDeepSeek V4 Flashを爆速稼働させた自作ハック魂

📝 本日のニュース概要 以前お伝えしたDeepSeek V4 Flashのローカル実行高速化ネタの続報です。今回はRTX 3060を4枚束ねてq4_k_xl量子化のDeepSeek-V4-Flashを稼働させ、実測100 tok/sを叩き出...
ローカルLLM

【geek-terminalニュース】Qwen3.8-27BがDeepSeek V4・GPT-5.6と同格?ベンチマーク比較でLocalLLaMAが沸騰

📝 本日のニュース概要 以前お伝えしたQwen3.8-27B FP8公開・ローカル実行評価の続報です。今回はr/LocalLLaMA、r/singularityで『RTX 3090一枚で回る27.8BモデルがDeepSeek V4やGPT-...
ローカルLLM

【geek-terminalニュース】Qwen3.8拡散、27Bローカル実用圏と35B-A3B観測の最新情報

📝 本日のニュース概要 以前お伝えしたQwen3.8-27B FP8公開の続報です。今回は27B単体ではなく、r/LocalLLaMAでの複数スレッド、35B-A3Bらしきモデルの観測、The Decoder報道まで含め、ローカルLLM界隈...
ローカルLLM

【geek-terminalニュース】Qwen3.8拡散、27Bローカル実用圏と35B-A3B観測の最新情報

📝 本日のニュース概要 以前お伝えしたQwen3.8-27B FP8公開の続報です。今回は27B単体ではなく、r/LocalLLaMAでの複数スレッド、35B-A3Bらしきモデルの観測、The Decoder報道まで含め、ローカルLLM界隈...
ローカルLLM

【geek-terminalニュース】Qwen3.8-27B FP8公開、ローカルLLM勢がテンプレ修正と旧版同一疑惑まで即検証

📝 本日のニュース概要 以前お伝えしたQwen3.8-2.4T-A95B公開の続報です。今回は巨大MoEではなく、実際にローカル勢が触れる27B級denseモデル、Qwen3.8-27B FP8に焦点を当てます。Apache 2.0、FP8...