AIニュース

ローカルLLM

【geek-terminalニュース】llama.cpp MCP対応でローカルLLMが実行主体へ近づく最新情報

📝 本日のニュース概要 llama.cppのfull MCP supportがコミュニティで話題化。ローカルLLMが単なるチャットから、MCP経由で手元のツールを叩くエージェント基盤へ変わる可能性を、権限境界、WebUI/CLI、Reddi...
商用巨大LLM

【geek-terminalニュース】Claude Opus 5の最新情報

📝 本日のニュース概要 AnthropicがClaude Opus 5を発表。Fable 5級に近い能力を半分の価格で狙う新Opusを、ベンチ、価格、effort設定、音声モード、コミュニティの反応から深掘りします。 以前お伝えしたClau...
商用巨大LLM

【geek-terminalニュース】Gemini Flash三連発の最新情報

📝 本日のニュース概要 GoogleがGemini 3.6 Flash、3.5 Flash-Lite、3.5 Flash Cyberを発表。単なる新モデル追加ではなく、エージェント実行単価を削りに来たFlash戦略を深掘りします。 【事象の...
ローカルLLM

【geek-terminalニュース】Qwen3.8予告、VRAMとFable 5対抗でローカルLLM勢がざわつく最新情報

📝 本日のニュース概要 Alibaba Qwen3.8 Max Previewの予告とopen-weight化の話題を、Claude Fable 5、Kimi K3、VRAM要求、MoE設計、Redditの反応から深掘りします。 以前お伝え...
ローカルLLM

【geek-terminalニュース】Thinking Machines初のオープンウェイトモデルInkling公開の最新情報

📝 本日のニュース概要 Thinking Machines Labが初のオープンウェイト基盤モデルInklingを公開。975B total/41B activeのMoE、1Mトークン文脈、マルチモーダル対応、Tinkerでの微調整、そして...
ローカルLLM

【geek-terminalニュース】Bonsai 27Bの最新情報:27B推論モデルを1-bit/Ternaryでスマホ級へ押し込むローカルLLM圧縮実験

📝 本日のニュース概要 以前お伝えしたBonsai 1-bit系の続報です。PrismMLが発表したBonsai 27Bは、Qwen3.6-27B由来の27B級オープンウェイト推論モデルを1-bit binary版と1.58-bit ter...
ローカルLLM

【geek-terminalニュース】Godot内LLMの最新情報

📝 本日のニュース概要 以前お伝えしたローカルLLM実行ハックの続報です。今回はGemma 4をGodot内で、GDScriptとVulkan computeだけで動かすというコミュニティ発の実験を整理します。公式・大手メディアによる裏取り...
ローカルLLM

【geek-terminalニュース】廃GPU15枚ベンチが映す中古VRAM経済圏の最新情報

📝 本日のニュース概要 LocalLLaMAで話題の「廃GPU15枚ベンチ」を深掘り。K80、P100、V100など退役NVIDIA Tesla系GPUを現代AIワークロードで使う発想は、最新GPU礼賛とは逆方向のローカルLLM文化です。た...
商用巨大LLM

GPT-5.6公開とChatGPT Workの最新情報

📝 本日のニュース概要 OpenAIがGPT-5.6を一般公開し、Sol/Terra/Lunaの3層モデルとChatGPT Workを同時に打ち出しました。低コスト高性能モデル競争と、チャットUIから完遂型ワークフローAIへの重心移動を深掘...
プログラミング

【geek-terminalニュース】GLM-5.2がDatabricksの標準コーディングエンジンに採用報道、オープンモデル実運用フェーズへ

📝 本日のニュース概要 以前お伝えした中国系オープンモデルと可用性リスクの続報です。今回はGLM-5.2がDatabricksの大規模コード基盤でAnthropic Opus 4.8と統計的に同等、かつ低コストだったため標準コーディングエン...