ローカルLLM

【geek-terminalニュース】DeepSeek DSpark投機デコードの最新情報

📝 本日のニュース概要 DeepSeek-V4向け投機的デコーディング・フレームワークDSparkを深掘り。MTP-1比60〜85%高速化という報道、論文PDF、LocalLLaMA/NVIDIAフォーラム周辺の実測議論を整理します。 以前...
学術研究

【geek-terminalニュース】報酬関数デバッガーとReward Hacking検出の最新情報

📝 本日のニュース概要 RL訓練中のreward hackingを、事後ログではなく報酬関数そのものから検出・診断する発想がAI安全性コミュニティで注目されています。LessWrongで議論されたnegated reward hacking...
プログラミング

【geek-terminalニュース】Kuma WebGPU化?PyTorchモデルを自己完結WebGPU実行パッケージへ

📝 本日のニュース概要 Redditで話題のKuma構想を深掘り。PyTorchモデルを、Pythonなし・サーバー推論なし・重量級ランタイムなしで、WebGPU上に直接載せるという噂レベルの実験が何を意味するのかを解説します。 【事象の全...
商用巨大LLM

【geek-terminalニュース】GPT-5.6 Sol政府審査アクセスの最新情報

📝 本日のニュース概要 OpenAIのGPT-5.6 Sol初期提供に米政府の顧客別審査が関与すると報じられ、クラウドAIの可用性、ローカルLLM回帰、開発者主権の論点が一気に接続されています。 【事象の全貌と背景】以前お伝えしたClaud...
セキュリティ&脆弱性

【geek-terminalニュース】macOSマルウェアGaslightのAI解析撹乱が示す新しい攻撃面

📝 本日のニュース概要 macOS向けマルウェアGaslightが、AI支援型の解析ツールを混乱させるために偽エラーやプロンプトインジェクション文字列を埋め込んでいたと報じられました。LLMを防御側に入れた瞬間、そのLLM自体が攻撃対象にな...
ロボティクス&エージェント

【geek-terminalニュース】AIエージェント観測の最新情報:eval harness・権限・コスト・失敗ログが本番運用の主戦場へ

📝 本日のニュース概要 以前お伝えしたモデル統治・ゼロトラスト権限管理の続報。今回は、AIエージェントを本番で使うための評価ハーネス、観測可能性、権限、メモリ、ツール実行、コスト計測、失敗パターン検出に焦点を当てます。 【事象の全貌と背景】...
ハードウェア&インフラ

【geek-terminalニュース】IBMサブ1nmチップ技術、AI推論の電力壁に半導体側から殴り込む

📝 本日のニュース概要 IBMが2026年6月25日に発表した世界初とされるサブ1nmチップ技術を深掘り。nanostack、0.7nm世代トランジスタ、爪サイズ1000億トランジスタ級という主張が、AI推論・ローカルLLM・データセンター...
企業動向&ビジネス

【geek-terminalニュース】GLM-5.2価格侵攻、米国AI市場で始まる限界費用バトル

📝 本日のニュース概要 以前お伝えしたZ.ai GLM-5.2公開の続報。今回はベンチマーク表ではなく、米国市場での低価格クラウド採用、推論API価格、1ドルあたりの処理能力という商用利用側の争点を深掘りします。 以前お伝えしたZ.ai G...
セキュリティ&脆弱性

【geek-terminalニュース】Webデータ汚染網がAI検索・RAGの現実認識を曲げる時代へ

📝 本日のニュース概要 以前お伝えしたモデル抽出・ポイズニング問題の続報。今回はモデルそのものではなく、AIが参照するWebデータ基盤、検索インデックス、RAG用ナレッジソースが攻撃面になりつつある問題を深掘りします。 以前お伝えしたモデル...
AIツール&サービス

【geek-terminalニュース】Mistral OCR 4でPDF RAGの入口が構造化レイヤー化する最新情報

📝 本日のニュース概要 以前お伝えしたBaidu Unlimited OCRの続報。今回はMistral OCR 4を中心に、OCRが単なる文字起こしから、引用付きJSON、構造化出力、RAG投入前の文書理解レイヤーへ進化している流れを深掘...