AI

セキュリティ&脆弱性

【geek-terminalニュース】AIエージェント攻撃面の最新情報:Claude Code型環境でプロンプトがマルウェア化する瞬間

📝 本日のニュース概要 以前お伝えしたプロンプトインジェクションとGaslightの続報。今回はClaude Code系の実行環境、DNS TXT経由ペイロード、MCP、ローカル設定、秘密情報ブローカーまで含め、AIエージェント時代の攻撃面...
ロボティクス&エージェント

【geek-terminalニュース】完遂型AIの最新情報:AIエージェントは同僚ではなく実行系になる

📝 本日のニュース概要 以前お伝えしたAIエージェント運用・観測可能性テーマの続報。AIの価値基準がチャット品質から、権限付きタスクを最後まで閉じる能力へ移る転換点を深掘りします。 【事象の全貌と背景】以前お伝えしたAIエージェント運用・観...
プログラミング

【geek-terminalニュース】AI開発ログがVibe Codingのブラックボックス化に対する監査レイヤーになり始めた最新情報

📝 本日のニュース概要 Claude CodeやCodexのAIコーディング会話を、消えるチャットではなく検索・監査・再利用できる開発資産として扱う流れを深掘り。ai-devlog、Codex CLI運用、セッションログ、HNでの議論を整理...
セキュリティ&脆弱性

【geek-terminalニュース】中国360のMythos対抗サイバーAIと“サイバー核抑止”論の最新情報

📝 本日のニュース概要 以前お伝えしたClaude Mythos自律ハッキングAI論の続報です。中国360 Security TechnologyがAnthropic Mythosに対応する国内向けサイバーAIツールを開発したと発表し、AI...
ローカルLLM

【geek-terminalニュース】DFlashのllama.cpp統合報告、ローカルLLM高速化が“周辺ハック”から日常運用へ近づく続報

📝 本日のニュース概要 以前お伝えしたDFlashトレンドの続報です。RedditのLocalLLaMAで「DFlash support merged into llama.cpp」と話題になり、ローカルLLM推論のtok/s、メモリ効率、...
商用巨大LLM

【geek-terminalニュース】GPT-5.6 Sol政府審査アクセスの最新情報

📝 本日のニュース概要 OpenAIのGPT-5.6 Sol初期提供に米政府の顧客別審査が関与すると報じられ、クラウドAIの可用性、ローカルLLM回帰、開発者主権の論点が一気に接続されています。 【事象の全貌と背景】以前お伝えしたClaud...
学術研究

【geek-terminalニュース】報酬関数デバッガーとReward Hacking検出の最新情報

📝 本日のニュース概要 RL訓練中のreward hackingを、事後ログではなく報酬関数そのものから検出・診断する発想がAI安全性コミュニティで注目されています。LessWrongで議論されたnegated reward hacking...
ロボティクス&エージェント

【geek-terminalニュース】AIエージェント観測の最新情報:eval harness・権限・コスト・失敗ログが本番運用の主戦場へ

📝 本日のニュース概要 以前お伝えしたモデル統治・ゼロトラスト権限管理の続報。今回は、AIエージェントを本番で使うための評価ハーネス、観測可能性、権限、メモリ、ツール実行、コスト計測、失敗パターン検出に焦点を当てます。 【事象の全貌と背景】...
AIツール&サービス

【geek-terminalニュース】Mistral OCR 4でPDF RAGの入口が構造化レイヤー化する最新情報

📝 本日のニュース概要 以前お伝えしたBaidu Unlimited OCRの続報。今回はMistral OCR 4を中心に、OCRが単なる文字起こしから、引用付きJSON、構造化出力、RAG投入前の文書理解レイヤーへ進化している流れを深掘...
セキュリティ&脆弱性

【geek-terminalニュース】Webデータ汚染網がAI検索・RAGの現実認識を曲げる時代へ

📝 本日のニュース概要 以前お伝えしたモデル抽出・ポイズニング問題の続報。今回はモデルそのものではなく、AIが参照するWebデータ基盤、検索インデックス、RAG用ナレッジソースが攻撃面になりつつある問題を深掘りします。 以前お伝えしたモデル...