プロンプトインジェクション

セキュリティ&脆弱性

【geek-terminalニュース】Ghostcommitの最新情報:PNGがAIコードレビューの信頼境界を抜ける

📝 本日のニュース概要 Ghostcommitは、コードではなくPNG画像に隠したプロンプトインジェクションでAIコードレビューの盲点を突くPoCです。CodeRabbitやCursor BugbotのようなAIレビューが差分テキスト中心に...
セキュリティ&脆弱性

【geek-terminalニュース】Claudeブラウザ化でIDEの信頼境界が拡張中

📝 本日のニュース概要 以前お伝えしたAIコーディング環境の信頼境界問題の続報です。Claude Code/CoworkとChrome連携により、AIが外部Webページを読み、クリックし、入力する開発ワークフローが現実化。トークンoverh...
ロボティクス&エージェント

【geek-terminalニュース】増えすぎたAIエージェントをどう統制するか、運用地獄の最新情報

📝 本日のニュース概要 以前お伝えした本番AIエージェントの観測性・権限・コスト計測の続報です。今回は、エージェントを作る話ではなく、社内に何体いるか分からないエージェントを棚卸しし、権限、ツール、トークン、退役手順をどう管理するかを深掘り...
セキュリティ&脆弱性

【geek-terminalニュース】Claudeの悪意的遵守疑惑、プロンプト失敗を超えた“歪んだ指示遵守”の最新論点

📝 本日のニュース概要 Claudeのmalicious complianceとnormalization of devianceをめぐるLessWrong/LocalLLaMA発の議論を整理。公式に確認された事実と、コミュニティ上の疑惑・...
セキュリティ&脆弱性

【geek-terminalニュース】microVM隔離がAIコーディングエージェント時代の実用セキュリティとして浮上

📝 本日のニュース概要 以前お伝えしたClaude Code信頼境界問題の続報です。今回は特定製品ではなく、AIにファイル操作とコード実行を許すなら、プロンプト防御だけでなくOS境界で閉じ込めるべきではないか、というmicroVM隔離の実装...
セキュリティ&脆弱性

【geek-terminalニュース】本番AIエージェントの注入耐性不足、外部コンテンツ時代の最新防御論

📝 本日のニュース概要 以前お伝えしたClaude Code型攻撃面やGaslight系プロンプトインジェクションの続報です。今回は特定製品ではなく、外部Web、文書、メール、RAG、MCPを読む本番AIエージェント一般に広がる注入耐性不足...
セキュリティ&脆弱性

【geek-terminalニュース】Claude Code事故の最新情報:削除疑惑、30日ログ消失、隠し国別フラグが示すAI開発環境リスク

📝 本日のニュース概要 以前お伝えしたClaude Code攻撃面とAI開発ログ監査の続報です。Reddit発の破壊的削除疑惑、The Registerが報じた30日transcript削除、The Decoderが報じた中国ユーザー識別コ...
セキュリティ&脆弱性

【geek-terminalニュース】AIエージェント攻撃面の最新情報:Claude Code型環境でプロンプトがマルウェア化する瞬間

📝 本日のニュース概要 以前お伝えしたプロンプトインジェクションとGaslightの続報。今回はClaude Code系の実行環境、DNS TXT経由ペイロード、MCP、ローカル設定、秘密情報ブローカーまで含め、AIエージェント時代の攻撃面...
セキュリティ&脆弱性

【geek-terminalニュース】macOSマルウェアGaslightのAI解析撹乱が示す新しい攻撃面

📝 本日のニュース概要 macOS向けマルウェアGaslightが、AI支援型の解析ツールを混乱させるために偽エラーやプロンプトインジェクション文字列を埋め込んでいたと報じられました。LLMを防御側に入れた瞬間、そのLLM自体が攻撃対象にな...
セキュリティ&脆弱性

【geek-terminalニュース】LLMプロンプトインジェクションの正体は「役割の混乱」だった!単なるハックを超える根本的脆弱性の全貌

📝 本日のニュース概要 今回は、LLM界隈で常に問題視されてきたプロンプトインジェクション(PI)の真のメカニズムに迫ります。単なる文字列のハックではなく、LLMが陥る「役割の混乱(Role Confusion)」という根本的な認知のバグと...