ローカルLLM

ローカルLLM

【geek-terminalニュース】3B級オンデバイス画面理解VLM「LFM2.5-VL-3B」の最新情報

📝 本日のニュース概要 Liquid AIが公開したLFM2.5-VL-3Bを深掘り。3.1B規模で画面理解、OCR、物体グラウンディング、複数画像推論、関数呼び出しまで統合し、GUI自動化をクラウドVLM依存から剥がす部品になり得るのかを...
ローカルLLM

【geek-terminalニュース】Qwen3.8-2.4T-A95Bオープンウェイト化、巨大MoEの実機攻略戦が始まる

📝 本日のニュース概要 以前お伝えしたQwen3.8-Maxと巨大MoE競争の続報。Qwen3.8-2.4T-A95Bの公開で、LocalLLaMA界隈はベンチ順位よりも量子化、VRAM、SSDオフロード、27B派生モデルへの期待で沸騰して...
ローカルLLM

【geek-terminalニュース】Meta Muse Glimmer 30BがGGUF化、RTX 3090単体実行でローカルLLM勢が沸騰

📝 本日のニュース概要 以前お伝えしたMeta Muse CodeβとMuse Spark権限境界の続報です。Metaが30BのオープンウェイトモデルMuse GlimmerをApache 2.0で公開。今回は政策論ではなく、GGUF化され...
ローカルLLM

【geek-terminalニュース】Kimi K3量子化、711GBから478GBへ押し込むローカルLLM実測沼

📝 本日のニュース概要 以前お伝えしたKimi K3ローカル実行の続報です。今回はKimi K3の重み公開そのものではなく、Unsloth IQ2-XXS量子化で711GB級から478GB級へ縮め、実機構成とベンチでどこまで現実のマシンに押...
ローカルLLM

【geek-terminalニュース】DeepSeek V4 Flash 0731の癖評価、ARC-AGI高得点と実運用の不安定さが同時に燃える

📝 本日のニュース概要 以前お伝えしたDeepSeek V4 Flash低価格推論・ローカル実行の続報です。今回はベンチ順位ではなく、ARC-AGI、コーディング、非コーディング、ツール呼び出し、KV cache量子化、キャッシュ設計で挙動...
ローカルLLM

OpenWeight免除でローカルLLM配布の前提が変わる

📝 本日のニュース概要 以前お伝えしたOpen-weight AI規制論争の続報です。米AI安全フレームワークでopen-weightモデルが政府の安全性レビュー対象から外れる見通しが報じられ、LocalLLaMA界隈ではモデル公開、ミラー...
ローカルLLM

【geek-terminalニュース】DeepSeek V4 Flash実測、284B MoEを“手元で動かす”時代の最新情報

📝 本日のニュース概要 以前お伝えしたDeepSeek V4 Flash 0731更新の続報です。今回は重み公開やAPI価格ではなく、284B MoEを単一MI300Xやローカル環境でどこまで動かせるのかという実測・運用限界・低コスト推論の...
ローカルLLM

【geek-terminalニュース】Qwen3.8追加サイズ展開でローカルLLM勢が再燃

📝 本日のニュース概要 以前お伝えしたQwen3.8-Max本体発表の続報です。今回は2.4兆パラメータ級の看板モデルではなく、ローカル勢が実際に触れる可能性のある追加サイズ展開、27B級モデル、オープンウェイト予定、MoE巨大化競争が手元...
ローカルLLM

【geek-terminalニュース】Qwen3.8-Maxと27Bローカル期待の最新情報

📝 本日のニュース概要 AlibabaのQwen3.8-Max発表と、Qwen3.8-27BをめぐるローカルLLM勢の熱狂を整理。2.4兆パラメータMoE、100万トークン文脈、オープンウェイト予定、VRAM見積もり、量子化待ちの現場感まで...
ローカルLLM

【geek-terminalニュース】MiniMax H3、Hugging Face公開とComfyUI Day-0対応でローカル動画生成勢の実験素材に

📝 本日のニュース概要 MiniMax H3のオープンウェイト公開、ComfyUIのDay-0対応、AI動画ランキングでの評価、そしてRedditコミュニティのリアルな反応を深掘りします。ランキング首位より重要なのは、今日ワークフローに組み...