LocalLLaMA

ローカルLLM

【geek-terminalニュース】DeepSeek V4.1 Flashで1M文脈とFP4 KV Cacheが来た件

📝 本日のニュース概要 DeepSeek V4.1 Flashを、単なる新モデルではなく長時間エージェントの記憶コストを変える推論ランタイム部品として深掘りします。1Mコンテキスト、FP4 KV Cache、Cross-Layer Atte...
ローカルLLM

【geek-terminalニュース】Qwen3.8-27B量子化、4-bit実用域と1-bit崩壊ラインの最新情報

📝 本日のニュース概要 以前お伝えしたQwen3.8-27B量子化実測の続報です。BF16比99%をうたうtask-aware quant、4-bit運用の実用性、1-bitでの品質崩壊ラインを、Reddit/HN/Lobste.rsの現場...
ローカルLLM

【geek-terminalニュース】CADローカルLLMの最新情報

📝 本日のニュース概要 以前お伝えした3D自動設計ハックの続報。llama.cppとFreeCADをつなぎ、ローカルLLMで3Dプリント可能な機械部品生成へ向かう個人設計自動化パイプラインを深掘りします。 以前お伝えしたRhinoMCP系3...
ロボティクス&エージェント

【geek-terminalニュース】CUA-Liteでエージェント基盤論争が“全部入り”から最小ハーネス設計へ移る最新情報

📝 本日のニュース概要 以前お伝えしたAgent Harness設計と長時間稼働AIエージェント運用の続報。UC Berkeley研究者によるCUA-Lite公開とされる話題を軸に、サンドボックス、データ、評価、RLをどう最小構成で束ねるか...
セキュリティ&脆弱性

【geek-terminalニュース】TIP脱獄と商用ガードレール除去の最新情報

📝 本日のニュース概要 以前お伝えしたASCII smugglingやAbliteration/Heretic系の続報。GPT-6 AstraがTIP攻撃で24時間以内に脱獄されたという未検証報告と、オープンウェイトモデルの安全ガードレール...
AIツール&サービス

【geek-terminalニュース】ChatGPT・Claude・Grok同時不安定化疑惑とAI冗長化の最新情報

📝 本日のニュース概要 以前お伝えしたClaude系アクセス可用性問題の続報です。ChatGPT、Claude、Grokが同時期に不安定化したとのコミュニティ報告を軸に、公式裏付けの限界、Reddit/HNの反応、ローカルLLM・マルチモデ...
ハードウェア&インフラ

【geek-terminalニュース】AIメモリ供給網の最新情報

📝 本日のニュース概要 Intelのメモリ事業復帰観測と、中国CXMTのHBM3E初期生産報道を軸に、AI性能のボトルネックがモデル単体からHBM・大容量メモリ・先端パッケージングへ移る流れを深掘りします。 以前お伝えしたローカルLLMの大...
ローカルLLM

【geek-terminalニュース】Qwen3.8-Flash-Next実測祭り、Mac最適化とGLM比較の最新情報

📝 本日のニュース概要 以前お伝えしたQwen3.8-Flash-Next疑惑の続報です。今回は公式ベンチではなく、LocalLLaMA周辺で共有されているMac実測、大容量RAM、N-gramオフロード、GLM-5.3-Flash比較、そ...
学術研究

【geek-terminalニュース】ベンチ信頼危機の最新情報

📝 本日のニュース概要 Terminal-Bench 4.0の順位変動、31,000件超の時間別LLMベンチ分析、Google DeepMindの暗号的な二重盲検評価案を軸に、LLMベンチマークの再現性・汚染・監査問題を深掘りします。 以前...
ローカルLLM

【geek-terminalニュース】Z.ai GLM-5.3本体がHugging Faceで公開、ローカルLLM勢のモデル選定表がまた揺れる

📝 本日のニュース概要 以前お伝えしたGLM-5.3-Flash公開の続報です。今回はZ.ai公式Hugging Faceに登場したGLM-5.3本体のオープンウェイト化を、Flashとの違い、753B規模、vLLM/SGLang/Tran...