セキュリティ&脆弱性

【geek-terminalニュース】microVM隔離がAIコーディングエージェント時代の実用セキュリティとして浮上

📝 本日のニュース概要 以前お伝えしたClaude Code信頼境界問題の続報です。今回は特定製品ではなく、AIにファイル操作とコード実行を許すなら、プロンプト防御だけでなくOS境界で閉じ込めるべきではないか、というmicroVM隔離の実装...
セキュリティ&脆弱性

【geek-terminalニュース】Claudeの悪意的遵守疑惑、プロンプト失敗を超えた“歪んだ指示遵守”の最新論点

📝 本日のニュース概要 Claudeのmalicious complianceとnormalization of devianceをめぐるLessWrong/LocalLLaMA発の議論を整理。公式に確認された事実と、コミュニティ上の疑惑・...
ロボティクス&エージェント

【geek-terminalニュース】Agentic検索失敗の最新情報:検索APIより“質問できるループ”が本丸だった

📝 本日のニュース概要 以前お伝えしたQwen3.6 Agentic Searchの続報です。今回は検索精度そのものではなく、曖昧なクエリを検知し、確認質問を出し、検索後に検証するエージェント設計の弱点を深掘りします。 【事象の全貌と背景】...
セキュリティ&脆弱性

【geek-terminalニュース】Claude Code信頼境界問題の最新情報

📝 本日のニュース概要 以前お伝えしたClaude Code削除疑惑・監査リスクの続報。Alibabaの社内利用禁止報道をきっかけに、AIコーディングエージェントが業務端末、国別制限、キャッシュ、セッション分離、社内コード権限をまたぐ“信頼...
セキュリティ&脆弱性

【geek-terminalニュース】本番AIエージェントの注入耐性不足、外部コンテンツ時代の最新防御論

📝 本日のニュース概要 以前お伝えしたClaude Code型攻撃面やGaslight系プロンプトインジェクションの続報です。今回は特定製品ではなく、外部Web、文書、メール、RAG、MCPを読む本番AIエージェント一般に広がる注入耐性不足...
商用巨大LLM

【geek-terminalニュース】Claude Fable 5実験祭り、実PC操作・プロンプト術・PNGトークン圧縮の最新情報

📝 本日のニュース概要 以前お伝えしたClaude Fable 5再公開の続報。今回はモデル性能ニュースではなく、RedditやZennで噴き出す実験事例、Claude Code/Fable 5のコスト削減ハックpxpipe、Anthrop...
ロボティクス&エージェント

【geek-terminalニュース】MetaのAIエージェント失速と本番デバッグ不能問題の最新情報

📝 本日のニュース概要 以前お伝えしたAIエージェント運用・完遂型AIの続報です。MetaのAIエージェント開発が想定より遅いと報じられた件を起点に、本番エージェントがなぜ壊れると追えないのか、Observability、診断、状態管理、ツ...
セキュリティ&脆弱性

【geek-terminalニュース】AI脆弱性ハンティングで報告キュー爆増、セキュリティ運用のボトルネックが露呈

📝 本日のニュース概要 AIモデルが脆弱性を見つける時代、問題は発見能力だけではありません。CVE報告、重複判定、深刻度評価、PoC検証、パッチ配布まで、下流のセキュリティ運用が詰まり始めています。Project Glasswing、Cla...
ローカルLLM

【geek-terminalニュース】DeepSeek DSparkでローカルLLM推論高速化が実運用検証フェーズへ

📝 本日のニュース概要 以前お伝えしたDeepSeek-V4/DSparkとDFlash・llama.cpp高速化の続報です。DeepSeekのDSpark、DeepSeek-V4-Flash、llama.cppパッチ、RTX 5090/R...
学術研究

【geek-terminalニュース】Senior SWE-Benchと最適化評価再設計の最新情報

📝 本日のニュース概要 以前お伝えしたSWE-bench Pro評価汚染疑惑の続報。今回は汚染告発ではなく、Senior SWE-Benchのような曖昧な実務タスク評価と、SWE-Perf/SWE-fficiency系の再現性検証から、AI...