2026-07

セキュリティ&脆弱性

【geek-terminalニュース】本番AIエージェントの注入耐性不足、外部コンテンツ時代の最新防御論

📝 本日のニュース概要 以前お伝えしたClaude Code型攻撃面やGaslight系プロンプトインジェクションの続報です。今回は特定製品ではなく、外部Web、文書、メール、RAG、MCPを読む本番AIエージェント一般に広がる注入耐性不足...
商用巨大LLM

【geek-terminalニュース】Claude Fable 5実験祭り、実PC操作・プロンプト術・PNGトークン圧縮の最新情報

📝 本日のニュース概要 以前お伝えしたClaude Fable 5再公開の続報。今回はモデル性能ニュースではなく、RedditやZennで噴き出す実験事例、Claude Code/Fable 5のコスト削減ハックpxpipe、Anthrop...
ロボティクス&エージェント

【geek-terminalニュース】MetaのAIエージェント失速と本番デバッグ不能問題の最新情報

📝 本日のニュース概要 以前お伝えしたAIエージェント運用・完遂型AIの続報です。MetaのAIエージェント開発が想定より遅いと報じられた件を起点に、本番エージェントがなぜ壊れると追えないのか、Observability、診断、状態管理、ツ...
セキュリティ&脆弱性

【geek-terminalニュース】AI脆弱性ハンティングで報告キュー爆増、セキュリティ運用のボトルネックが露呈

📝 本日のニュース概要 AIモデルが脆弱性を見つける時代、問題は発見能力だけではありません。CVE報告、重複判定、深刻度評価、PoC検証、パッチ配布まで、下流のセキュリティ運用が詰まり始めています。Project Glasswing、Cla...
ローカルLLM

【geek-terminalニュース】DeepSeek DSparkでローカルLLM推論高速化が実運用検証フェーズへ

📝 本日のニュース概要 以前お伝えしたDeepSeek-V4/DSparkとDFlash・llama.cpp高速化の続報です。DeepSeekのDSpark、DeepSeek-V4-Flash、llama.cppパッチ、RTX 5090/R...
学術研究

【geek-terminalニュース】Senior SWE-Benchと最適化評価再設計の最新情報

📝 本日のニュース概要 以前お伝えしたSWE-bench Pro評価汚染疑惑の続報。今回は汚染告発ではなく、Senior SWE-Benchのような曖昧な実務タスク評価と、SWE-Perf/SWE-fficiency系の再現性検証から、AI...
企業動向&ビジネス

【geek-terminalニュース】OpenAI政府5%持分案の最新情報

📝 本日のニュース概要 以前お伝えしたGPT-5.6 Sol政府審査・AIアクセス主権論争の続報です。OpenAIが米政府に5%持分を与える案を協議していると報じられ、AI APIアクセス、国家関与、資本構造、開発者リスクが一気に接続され始...
商用巨大LLM

【geek-terminalニュース】Claude Fable 5安全ルートの最新情報

📝 本日のニュース概要 以前お伝えしたClaude Fable 5再公開の続報です。今回は再公開そのものではなく、安全分類器、利用枠、Claude Codeの短縮システムプロンプト、そして商用LLMをどうルーティングして使うべきかという運用...
セキュリティ&脆弱性

【geek-terminalニュース】Claude Code事故の最新情報:削除疑惑、30日ログ消失、隠し国別フラグが示すAI開発環境リスク

📝 本日のニュース概要 以前お伝えしたClaude Code攻撃面とAI開発ログ監査の続報です。Reddit発の破壊的削除疑惑、The Registerが報じた30日transcript削除、The Decoderが報じた中国ユーザー識別コ...
学術研究

【geek-terminalニュース】Meta Brain2Qwerty v2、非侵襲MEGで脳から文章復元へ

📝 本日のニュース概要 Meta AIのBrain2Qwerty v2は、非侵襲MEGから自然文タイピング過程を復号するbrain-to-text研究。61%単語精度報道と公式情報を照合し、BCIが医療デモから人間I/O研究へ近づく意味を深...