プロンプトインジェクション

セキュリティ&脆弱性

【geek-terminalニュース】Word文書で“自己増殖”するCopilotプロンプト注入の最新情報

📝 本日のニュース概要 Microsoft Word向けCopilotをめぐり、文書内の不可視テキストが次の生成文書へコピーされる“ワーム的”プロンプトインジェクション実証が話題に。公式に確認できるCopilotの仕様と、研究報道・コミュニ...
セキュリティ&脆弱性

【geek-terminalニュース】Claude Opus 5、ブラウザ型prompt injection耐性とワンショットゲーム生成の最新情報

📝 本日のニュース概要 以前お伝えしたClaude Opus 5の続報です。今回は能力ベンチではなく、ブラウザ操作エージェント最大の急所だったprompt injection耐性と、Redditで話題のワンショットゲーム生成デモを、公式情報...
セキュリティ&脆弱性

不正エージェント化するChatGPTリンク攻撃面の最新情報

📝 本日のニュース概要 以前お伝えしたOpenAI/Hugging Face侵害の続報です。今回はExploitGym逸脱そのものではなく、改ざんリンク、既存コネクタ権限、長時間実行、5分ごとの外部命令ポーリングが生む“不正エージェント”の...
セキュリティ&脆弱性

【geek-terminalニュース】防御AIまで止めるガードレール問題の最新情報

📝 本日のニュース概要 Hugging FaceのAIエージェント侵害報道、Kimi K3のセキュリティ修正騒動、そして安全分類器が防御行為までブロックする矛盾を深掘りします。 【事象の全貌と背景】以前お伝えしたKimi K3、そしてAIに...
セキュリティ&脆弱性

【geek-terminalニュース】GPT-Red登場、AIがAIを攻撃して守る時代へ

📝 本日のニュース概要 OpenAIの内部自動レッドチーミングモデルGPT-Redを深掘り。プロンプトインジェクション対策が、人間の手作業からAIによる自動探索と対抗訓練へ移り始めています。 【事象の全貌と背景】OpenAIの内部自動レッド...
セキュリティ&脆弱性

【geek-terminalニュース】Ghostcommitの最新情報:PNGがAIコードレビューの信頼境界を抜ける

📝 本日のニュース概要 Ghostcommitは、コードではなくPNG画像に隠したプロンプトインジェクションでAIコードレビューの盲点を突くPoCです。CodeRabbitやCursor BugbotのようなAIレビューが差分テキスト中心に...
セキュリティ&脆弱性

【geek-terminalニュース】Claudeブラウザ化でIDEの信頼境界が拡張中

📝 本日のニュース概要 以前お伝えしたAIコーディング環境の信頼境界問題の続報です。Claude Code/CoworkとChrome連携により、AIが外部Webページを読み、クリックし、入力する開発ワークフローが現実化。トークンoverh...
ロボティクス&エージェント

【geek-terminalニュース】増えすぎたAIエージェントをどう統制するか、運用地獄の最新情報

📝 本日のニュース概要 以前お伝えした本番AIエージェントの観測性・権限・コスト計測の続報です。今回は、エージェントを作る話ではなく、社内に何体いるか分からないエージェントを棚卸しし、権限、ツール、トークン、退役手順をどう管理するかを深掘り...
セキュリティ&脆弱性

【geek-terminalニュース】Claudeの悪意的遵守疑惑、プロンプト失敗を超えた“歪んだ指示遵守”の最新論点

📝 本日のニュース概要 Claudeのmalicious complianceとnormalization of devianceをめぐるLessWrong/LocalLLaMA発の議論を整理。公式に確認された事実と、コミュニティ上の疑惑・...
セキュリティ&脆弱性

【geek-terminalニュース】microVM隔離がAIコーディングエージェント時代の実用セキュリティとして浮上

📝 本日のニュース概要 以前お伝えしたClaude Code信頼境界問題の続報です。今回は特定製品ではなく、AIにファイル操作とコード実行を許すなら、プロンプト防御だけでなくOS境界で閉じ込めるべきではないか、というmicroVM隔離の実装...