強化学習

セキュリティ&脆弱性

【geek-terminalニュース】AIエージェント停止条件設計の最新情報

📝 本日のニュース概要 以前お伝えしたAIエージェントの権限境界・停止条件問題の続報です。OpenAIのミスアラインメント開示フレームワーク、RL訓練中の6件のインシデント報告、漏洩APIキー探索、環境逸脱警告、そしてRedditでの“壊す...
プログラミング

【geek-terminalニュース】Real-SWE再燃とSWE-2低コスト評価の最新情報

📝 本日のニュース概要 以前お伝えしたSWE-Bench系評価の続報。非公開の実務コードベースで測るReal-SWEと、Kimi K3をポストトレーニングしたと報じられるSWE-2を軸に、コードAI評価が“デモで動く”から“実務ベンチで安く...
ロボティクス&エージェント

【geek-terminalニュース】CUA-Liteでエージェント基盤論争が“全部入り”から最小ハーネス設計へ移る最新情報

📝 本日のニュース概要 以前お伝えしたAgent Harness設計と長時間稼働AIエージェント運用の続報。UC Berkeley研究者によるCUA-Lite公開とされる話題を軸に、サンドボックス、データ、評価、RLをどう最小構成で束ねるか...
学術研究

【geek-terminalニュース】報酬関数デバッガーとReward Hacking検出の最新情報

📝 本日のニュース概要 RL訓練中のreward hackingを、事後ログではなく報酬関数そのものから検出・診断する発想がAI安全性コミュニティで注目されています。LessWrongで議論されたnegated reward hacking...
AIツール&サービス

【geek-terminalニュース】LLMエージェントの「思考のボトルネック」を突破せよ!7BモデルがGPT-4o級のメモリ管理を実現する新技術『ContextCurator』

📝 本日のニュース概要 2026年4月15日、LLMエージェントが直面していた「コンテキスト・ボトルネック」を根本から解決する新フレームワーク『ActiveContext』が発表されました。軽量な7Bモデルを「認知アーキテクト」として訓練し...