2026-07

ローカルLLM

【geek-terminalニュース】744B MoEを25GB RAMで動かす?ローカルLLM省メモリ限界突破ログ

📝 本日のニュース概要 以前お伝えしたPuzzle-75BやMiniMax巨大MoEの続報です。今回はGLM-5.2 744B MoEを消費者環境で動かす省メモリ実装、Qwen3.6 NVFP4/Unsloth量子化、speculative...
ロボティクス&エージェント

【geek-terminalニュース】VLA実機化の最新情報:ロボットAIが“すごい動画”からベンチマークと実機把持へ降りてきた

📝 本日のニュース概要 LingBot-VLA 2.0、LeRobot v0.6.0、1X NEOの25自由度ハンドを軸に、ロボット基盤モデルが研究室デモから実機運用の議論へ移る現在地を整理します。LIBERO再現、把持性能、クロスエンボデ...
商用巨大LLM

【geek-terminalニュース】GPT-5.6 Sol検証フェーズの最新情報

📝 本日のニュース概要 以前お伝えしたGPT-5.6一般公開の続報です。今回はSol/Terra/Lunaの発表概要ではなく、Solの推論レベル運用、Responses API、自律ポストトレーニング、数学証明PDF、SimpleBench...
ローカルLLM

【geek-terminalニュース】NVIDIA Puzzle-75B-A9B、75B級MoEをローカルGPU圏内へ押し込む最新情報

📝 本日のニュース概要 NVIDIAのNemotron-Labs-3-Puzzle-75B-A9Bを深掘り。Nemotron-3-Super由来の圧縮ハイブリッドMoE、Iterative Puzzle、NVFP4、そしてRedditで話題...
プログラミング

【geek-terminalニュース】GLM-5.2がDatabricksの標準コーディングエンジンに採用報道、オープンモデル実運用フェーズへ

📝 本日のニュース概要 以前お伝えした中国系オープンモデルと可用性リスクの続報です。今回はGLM-5.2がDatabricksの大規模コード基盤でAnthropic Opus 4.8と統計的に同等、かつ低コストだったため標準コーディングエン...
AIツール&サービス

Meta Muse Spark 1.1低価格APIの最新情報

📝 本日のニュース概要 MetaがMuse Spark 1.1とMeta Model APIのパブリックプレビューを発表。1Mトークン文脈、マルチエージェント、コーディング、マルチモーダル性能に加え、The Decoder報道の低価格API...
商用巨大LLM

GPT-5.6公開とChatGPT Workの最新情報

📝 本日のニュース概要 OpenAIがGPT-5.6を一般公開し、Sol/Terra/Lunaの3層モデルとChatGPT Workを同時に打ち出しました。低コスト高性能モデル競争と、チャットUIから完遂型ワークフローAIへの重心移動を深掘...
ローカルLLM

【geek-terminalニュース】MiniMax 2.7兆パラメータ級オープンモデル計画の最新情報

📝 本日のニュース概要 MiniMaxが2.7兆パラメータ規模のLLMを開発中で、2026年後半にもオープンウェイト/オープンソース公開を計画していると報じられました。MoE、active params、量子化、配布、ローカル推論の限界まで...
商用巨大LLM

【geek-terminalニュース】Grok 4.5価格性能ショックの最新情報

📝 本日のニュース概要 Grok 4.5をめぐり、ベンチマーク競争より推論単価がアプリ設計を変えるのではないかという議論が浮上。ただし公式に確認できる具体的な価格数値は提示資料内にありません。 【事象の全貌と背景】Grok 4.5をめぐる今...
商用巨大LLM

【geek-terminalニュース】GPT-Liveの最新情報:音声AIが“ターン制チャット”から常時割り込み可能な会話プロセスへ

📝 本日のニュース概要 OpenAIのGPT-Liveにより、ChatGPT Voiceは聞くことと話すことを同時に扱うLive体験へ進化。API実装者にとってはRealtimeモデル、VAD、レイテンシ、推論委譲、UX設計の再設計ポイント...