GGUF

ローカルLLM

【geek-terminalニュース】Kimi K3重み公開でローカルLLM勢がVRAM戦争へ突入

📝 本日のニュース概要 以前お伝えしたKimi K3と中国オープンウェイトAI論争の続報です。今回は政策論ではなく、Kimi K3のweights公開を受けて、実際に手元で動くのか、A100/H200級GPUが何枚必要なのか、Hugging...
ローカルLLM

【geek-terminalニュース】llama.cpp MCP対応でローカルLLMが実行主体へ近づく最新情報

📝 本日のニュース概要 llama.cppのfull MCP supportがコミュニティで話題化。ローカルLLMが単なるチャットから、MCP経由で手元のツールを叩くエージェント基盤へ変わる可能性を、権限境界、WebUI/CLI、Reddi...
ローカルLLM

【geek-terminalニュース】Thinking Machines初のオープンウェイトモデルInkling公開の最新情報

📝 本日のニュース概要 Thinking Machines Labが初のオープンウェイト基盤モデルInklingを公開。975B total/41B activeのMoE、1Mトークン文脈、マルチモーダル対応、Tinkerでの微調整、そして...
ローカルLLM

【geek-terminalニュース】Bonsai 27Bの最新情報:27B推論モデルを1-bit/Ternaryでスマホ級へ押し込むローカルLLM圧縮実験

📝 本日のニュース概要 以前お伝えしたBonsai 1-bit系の続報です。PrismMLが発表したBonsai 27Bは、Qwen3.6-27B由来の27B級オープンウェイト推論モデルを1-bit binary版と1.58-bit ter...
未分類

【完全ローカル音声AI】Googleが「Gemma 4 12B」を突如公開!エンコーダーレスの奇跡、16GBメモリのノートPCで爆速稼働する時代へ

📝 本日のニュース概要 Google DeepMindが、エンコーダーを完全に排除した画期的なネイティブ・マルチモーダルモデル「Gemma 4 12B」を公開しました!これまでローカル音声AIを動かすには、Whisperなどの重厚な外部エン...
未分類

【ローカルLLM】400ドルでQwen3.6-27Bを爆速駆動!中古RTX 3060を2枚並べる変態コスパDIYハックの全貌

📝 本日のニュース概要 数千ドルの最新GPUはもう不要?RedditのLocalLLaMAコミュニティで、中古のGeForce RTX 3060 12GBを2枚並べた「約400ドル(約6万円)環境」の検証報告が熱狂を呼んでいます。中規模実用...
未分類

【ローカルLLM】QwenMTP完全保存版!785個のMTP完全保持&検閲排除の「35B-A3B Heretic」がローカルLLM界を震撼させる噂を徹底解剖

📝 本日のニュース概要 2026年5月22日、ik_llama.cppの最適化によってQwen3.6 35Bが12GB VRAMで110 tok/sという驚異的な爆速駆動を記録したニュースをお伝えしましたが、今回はその系譜におけるさらなる「...
ハードウェア&インフラ

【Local AI】押し入れの3060が「VRAMタンク」に化ける!旧型GPUを接ぎ木するLocalLLaMA民の執念と変態ハックの全貌

📝 本日のニュース概要 2026年、AIモデルの巨大化は止まりません。最新のRTX 60シリーズ(仮)を待つLocal LLMユーザーたちが選んだのは、意外にも「旧型GPUの増設」という泥臭い生存戦略でした。Reddit(r/LocalLL...
ローカルLLM

【衝撃】VRAM不足は過去の遺物へ。ついに降臨した「1-Bit LLM」の実稼働コードを徹底解剖【Bonsai / GGUF】

📝 本日のニュース概要 ついに「量子化の最終回答」が、研究論文の枠を飛び越えて僕らのGPUに降臨しました。重みわずか1ビット。理論上の極限と言われたBitNet系アーキテクチャが、PrismMLの手によって『Bonsai』としてGGUF実装...