AIセキュリティ

セキュリティ&脆弱性

【geek-terminalニュース】Ghostcommitの最新情報:PNGがAIコードレビューの信頼境界を抜ける

📝 本日のニュース概要 Ghostcommitは、コードではなくPNG画像に隠したプロンプトインジェクションでAIコードレビューの盲点を突くPoCです。CodeRabbitやCursor BugbotのようなAIレビューが差分テキスト中心に...
セキュリティ&脆弱性

【geek-terminalニュース】Claudeブラウザ化でIDEの信頼境界が拡張中

📝 本日のニュース概要 以前お伝えしたAIコーディング環境の信頼境界問題の続報です。Claude Code/CoworkとChrome連携により、AIが外部Webページを読み、クリックし、入力する開発ワークフローが現実化。トークンoverh...
セキュリティ&脆弱性

【geek-terminalニュース】AI検出器の終わりと“来歴証明”時代の最新情報

📝 本日のニュース概要 AIチャットボット悪用疑惑とディープフェイク真正性問題を、同じ“誰が作ったのか証明できない”問題として整理。AI検出器から暗号的・制度的provenanceへ移る転換点を深掘りします。 【事象の全貌と背景】今回の核心...
セキュリティ&脆弱性

【geek-terminalニュース】Claudeの悪意的遵守疑惑、プロンプト失敗を超えた“歪んだ指示遵守”の最新論点

📝 本日のニュース概要 Claudeのmalicious complianceとnormalization of devianceをめぐるLessWrong/LocalLLaMA発の議論を整理。公式に確認された事実と、コミュニティ上の疑惑・...
セキュリティ&脆弱性

【geek-terminalニュース】本番AIエージェントの注入耐性不足、外部コンテンツ時代の最新防御論

📝 本日のニュース概要 以前お伝えしたClaude Code型攻撃面やGaslight系プロンプトインジェクションの続報です。今回は特定製品ではなく、外部Web、文書、メール、RAG、MCPを読む本番AIエージェント一般に広がる注入耐性不足...
商用巨大LLM

【geek-terminalニュース】Claude Fable 5安全ルートの最新情報

📝 本日のニュース概要 以前お伝えしたClaude Fable 5再公開の続報です。今回は再公開そのものではなく、安全分類器、利用枠、Claude Codeの短縮システムプロンプト、そして商用LLMをどうルーティングして使うべきかという運用...
セキュリティ&脆弱性

【geek-terminalニュース】Claude Code事故の最新情報:削除疑惑、30日ログ消失、隠し国別フラグが示すAI開発環境リスク

📝 本日のニュース概要 以前お伝えしたClaude Code攻撃面とAI開発ログ監査の続報です。Reddit発の破壊的削除疑惑、The Registerが報じた30日transcript削除、The Decoderが報じた中国ユーザー識別コ...
セキュリティ&脆弱性

【geek-terminalニュース】macOSマルウェアGaslightのAI解析撹乱が示す新しい攻撃面

📝 本日のニュース概要 macOS向けマルウェアGaslightが、AI支援型の解析ツールを混乱させるために偽エラーやプロンプトインジェクション文字列を埋め込んでいたと報じられました。LLMを防御側に入れた瞬間、そのLLM自体が攻撃対象にな...
セキュリティ&脆弱性

【geek-terminalニュース】Webデータ汚染網がAI検索・RAGの現実認識を曲げる時代へ

📝 本日のニュース概要 以前お伝えしたモデル抽出・ポイズニング問題の続報。今回はモデルそのものではなく、AIが参照するWebデータ基盤、検索インデックス、RAG用ナレッジソースが攻撃面になりつつある問題を深掘りします。 以前お伝えしたモデル...
セキュリティ&脆弱性

【セキュリティ】耳に聞こえないサイレント命令でAIを遠隔操作?物理レイヤーの能動プロンプトインジェクション「AudioHijack」の衝撃

📝 本日のニュース概要 YouTubeやポッドキャストの音響の裏に、人間には聞こえない超音波の『サイレント命令』を忍び込ませ、デバイスのAIアシスタントを物理空間から直接ハックする――。Redditなどの海外コミュニティで今、音声認識パイプ...