ローカルLLM

プログラミング

【geek-terminalニュース】GLM-5.2がDatabricksの標準コーディングエンジンに採用報道、オープンモデル実運用フェーズへ

📝 本日のニュース概要 以前お伝えした中国系オープンモデルと可用性リスクの続報です。今回はGLM-5.2がDatabricksの大規模コード基盤でAnthropic Opus 4.8と統計的に同等、かつ低コストだったため標準コーディングエン...
ローカルLLM

【geek-terminalニュース】NVIDIA Puzzle-75B-A9B、75B級MoEをローカルGPU圏内へ押し込む最新情報

📝 本日のニュース概要 NVIDIAのNemotron-Labs-3-Puzzle-75B-A9Bを深掘り。Nemotron-3-Super由来の圧縮ハイブリッドMoE、Iterative Puzzle、NVFP4、そしてRedditで話題...
ローカルLLM

【geek-terminalニュース】MiniMax 2.7兆パラメータ級オープンモデル計画の最新情報

📝 本日のニュース概要 MiniMaxが2.7兆パラメータ規模のLLMを開発中で、2026年後半にもオープンウェイト/オープンソース公開を計画していると報じられました。MoE、active params、量子化、配布、ローカル推論の限界まで...
企業動向&ビジネス

【geek-terminalニュース】中国AI輸出制限検討でDeepSeek/Qwenの可用性リスクが浮上

📝 本日のニュース概要 中国当局が最先端AIモデルへの海外アクセス制限を検討したと報じられ、DeepSeek、Qwen、Doubao、GLM系モデルの可用性リスクが開発者視点で注目されています。決定済みの禁止ではなく検討段階ですが、API、...
ハードウェア&インフラ

【geek-terminalニュース】Ryzen AI Halo Dev KitはローカルAI開発機になれるのか

📝 本日のニュース概要 AMD Ryzen AI Halo Dev Kitをめぐり、4000ドル級の小型ローカルAI開発機として注目が集まっています。ただし公式・大手メディアによる裏付けが提示データ内にないため、仕様や性能値は断定せず、関連...
ローカルLLM

【geek-terminalニュース】100%ローカル声AIの実装公開、音声入力から応答までクラウドを介さないLocalLLaMA的アシスタントが熱い

📝 本日のニュース概要 以前お伝えした完全ローカルAIエージェント/ローカルLLM運用の続報です。今回は、音声入力、音声認識、LLM応答、音声合成までをローカル環境で閉じるvoice-to-voice assistant実装を深掘りします。...
ローカルLLM

【geek-terminalニュース】DeepSeek DSparkでローカルLLM推論高速化が実運用検証フェーズへ

📝 本日のニュース概要 以前お伝えしたDeepSeek-V4/DSparkとDFlash・llama.cpp高速化の続報です。DeepSeekのDSpark、DeepSeek-V4-Flash、llama.cppパッチ、RTX 5090/R...
ハードウェア&インフラ

【geek-terminalニュース】LongCat-2.0公開、“NVIDIAなし巨大MoE”がAIインフラ競争を揺らす最新情報

📝 本日のニュース概要 Meituanが公開したLongCat-2.0を深掘り。1.6T総パラメータ、約48Bアクティブ、35T tokens超、AI ASIC superpods、1M contextという公式情報を軸に、“NVIDIAな...
セキュリティ&脆弱性

【geek-terminalニュース】中国360のMythos対抗サイバーAIと“サイバー核抑止”論の最新情報

📝 本日のニュース概要 以前お伝えしたClaude Mythos自律ハッキングAI論の続報です。中国360 Security TechnologyがAnthropic Mythosに対応する国内向けサイバーAIツールを開発したと発表し、AI...
ローカルLLM

【geek-terminalニュース】DFlashのllama.cpp統合報告、ローカルLLM高速化が“周辺ハック”から日常運用へ近づく続報

📝 本日のニュース概要 以前お伝えしたDFlashトレンドの続報です。RedditのLocalLLaMAで「DFlash support merged into llama.cpp」と話題になり、ローカルLLM推論のtok/s、メモリ効率、...