LocalLLaMA

ローカルLLM

【geek-terminalニュース】Qwen3.8予告、VRAMとFable 5対抗でローカルLLM勢がざわつく最新情報

📝 本日のニュース概要 Alibaba Qwen3.8 Max Previewの予告とopen-weight化の話題を、Claude Fable 5、Kimi K3、VRAM要求、MoE設計、Redditの反応から深掘りします。 以前お伝え...
ローカルLLM

【geek-terminalニュース】Kimi K3参戦、2.8T級MoEと1M contextがオープンウェイト最前線を押し広げる

📝 本日のニュース概要 以前お伝えしたKimi K3の続報です。Moonshot AIの2.8兆パラメータ級open-weight MoE、1Mトークン文脈、Kimi Delta Attention、Artificial Analysis上...
商用巨大LLM

【geek-terminalニュース】Kimi K3公開でAPI価格と1Mコンテキスト疑惑が同時炎上

📝 本日のニュース概要 Moonshot AIのKimi公式サイトがK3を掲げ、RedditではWeb/App公開、API価格、ベンチマーク、巨大コンテキスト仕様をめぐって議論が急加速。公式に確認できる事実と、コミュニティ発の未確認情報を切...
ローカルLLM

【geek-terminalニュース】Bonsai 27Bの最新情報:27B推論モデルを1-bit/Ternaryでスマホ級へ押し込むローカルLLM圧縮実験

📝 本日のニュース概要 以前お伝えしたBonsai 1-bit系の続報です。PrismMLが発表したBonsai 27Bは、Qwen3.6-27B由来の27B級オープンウェイト推論モデルを1-bit binary版と1.58-bit ter...
ローカルLLM

【geek-terminalニュース】Godot内LLMの最新情報

📝 本日のニュース概要 以前お伝えしたローカルLLM実行ハックの続報です。今回はGemma 4をGodot内で、GDScriptとVulkan computeだけで動かすというコミュニティ発の実験を整理します。公式・大手メディアによる裏取り...
ハードウェア&インフラ

【geek-terminalニュース】Apple M7 Ultra 1.5TB統一メモリ噂の最新情報

📝 本日のニュース概要 以前お伝えしたApple Siliconの統一メモリ問題の続報です。Apple M7 Ultraが最大1.5TBのRAMをサポートする可能性が報じられ、ローカルLLM界隈ではGPU枚数ではなく巨大ユニファイドメモリ箱...
ローカルLLM

【geek-terminalニュース】廃GPU15枚ベンチが映す中古VRAM経済圏の最新情報

📝 本日のニュース概要 LocalLLaMAで話題の「廃GPU15枚ベンチ」を深掘り。K80、P100、V100など退役NVIDIA Tesla系GPUを現代AIワークロードで使う発想は、最新GPU礼賛とは逆方向のローカルLLM文化です。た...
ローカルLLM

【geek-terminalニュース】画像to3DがiPhone内で20秒?端末内3D生成の最新情報

📝 本日のニュース概要 Redditで話題になった「local image to 3D」「2GB RAM」「20s」「Apple Silicon」「iPhone」という投稿を起点に、画像から3Dを端末内で生成する流れを深掘り。公式裏付けのな...
ローカルLLM

【geek-terminalニュース】744B MoEを25GB RAMで動かす?ローカルLLM省メモリ限界突破ログ

📝 本日のニュース概要 以前お伝えしたPuzzle-75BやMiniMax巨大MoEの続報です。今回はGLM-5.2 744B MoEを消費者環境で動かす省メモリ実装、Qwen3.6 NVFP4/Unsloth量子化、speculative...
ローカルLLM

【geek-terminalニュース】MiniMax 2.7兆パラメータ級オープンモデル計画の最新情報

📝 本日のニュース概要 MiniMaxが2.7兆パラメータ規模のLLMを開発中で、2026年後半にもオープンウェイト/オープンソース公開を計画していると報じられました。MoE、active params、量子化、配布、ローカル推論の限界まで...