AIエージェント

セキュリティ&脆弱性

【geek-terminalニュース】AI防火壁破りの最新情報

📝 本日のニュース概要 以前お伝えしたAIエージェント権限境界問題の続報です。AIファイアウォールを置けば安心という防御幻想が、プロンプト注入、表層監視、ツール実行権限の現場論によって揺らいでいます。 以前お伝えしたAIエージェントの権限境...
セキュリティ&脆弱性

【geek-terminalニュース】AIエージェント権限境界の最新情報

📝 本日のニュース概要 以前お伝えしたAI安全性テスト・サプライチェーン攻撃回の続報です。HRボット、OSSマルウェア疑惑、推論エンジン悪用、SKILL.md監査を横断し、AIエージェントを“便利な自動化”ではなく権限を持つ攻撃面として整理...
プログラミング

【geek-terminalニュース】AIコーディングエージェントの完了判定PR、夜間量産レビュー運用が次のボトルネックに

📝 本日のニュース概要 AIがコードを書く段階から、AIが開いたPRをいつ完了扱いするのか、翌朝どう捌くのかへ論点が移っています。Claude Codeの公式機能、Reddit/HN/lobste.rsの現場反応、CI緑だけでは危ない理由を...
セキュリティ&脆弱性

Claude Mythos 5防衛投入報道、最強級AIを“チャット禁止の脆弱性スキャナー”に閉じ込める実装論

📝 本日のニュース概要 以前お伝えしたClaude Mythos 5の評価・逸脱報道の続報です。今回は、Anthropicの最強級サイバー能力モデルがClaude Securityなどの防御ツールに組み込まれたとする報道を軸に、公式に確認で...
セキュリティ&脆弱性

【geek-terminalニュース】AI攻撃未遂と安全性テスト崩壊の最新情報

📝 本日のニュース概要 以前お伝えしたAIセキュリティ評価と権限境界問題の続報です。Reutersが報じたmyNetworkへの悪意あるプルリクエスト未遂、The Decoderが紹介した安全性ベンチマークの弱点、LessWrongで議論さ...
ロボティクス&エージェント

【geek-terminalニュース】NVIDIA AVOがARC-AGI-3満点?公開セット100%説とComputer Use競技場化の最新情報

📝 本日のニュース概要 NVIDIA AVOがARC-AGI-3で100%を取ったという投稿がRedditとHNで話題化。ただし公式に確認できるAVOの実績は、ARC-AGI-3ではなくBlackwell B200上のattention k...
ロボティクス&エージェント

【geek-terminalニュース】AIエージェント決済の最新情報

📝 本日のニュース概要 以前お伝えしたAIエージェントのAPI支出制御論の続報です。今回は、AIエージェントが“財布”を持つ瞬間に何が壊れ、何を設計し直す必要があるのかを深掘りします。Stripe、Natural、Binance、Chain...
ローカルLLM

【geek-terminalニュース】DeepSeek V4 Flash Vision Expの噂で画像理解コスト再計算へ

📝 本日のニュース概要 以前お伝えしたDeepSeek V4 Flashの続報です。今回は、コミュニティで話題化しているVision対応Flashモデル疑惑を、公式確認済みのDeepSeek-VL情報と切り分けながら、低コストAPI、ローカ...
ロボティクス&エージェント

【geek-terminalニュース】マルチエージェント運用で見えたメッセージバス設計の最新情報

📝 本日のニュース概要 8カ月運用されたマルチエージェント構成をめぐり、賢いエージェントよりも状態遷移、メッセージ設計、観測性が重要だという実装論を深掘りします。 【事象の全貌と背景】今回のテーマは、派手な新モデル発表ではなく、マルチエージ...
ロボティクス&エージェント

【geek-terminalニュース】自らハーネスを書き換えて成長する自己改良AI「Ornith 1.5」がReddit/LocalLLaMAで話題に

📝 本日のニュース概要 9Bパラメータの小規模モデルながら、タスクを解く過程で自分専用の実行環境(ハーネス)を自ら構築していく「自己改良」型コーディングエージェント、Ornithシリーズの新バージョン「Ornith 1.5」がReddit ...